跳到正文
熱點事件持續更新

Zyphra 提出 OVQ Attention 處理長上下文

1 篇報道1 個報道來源6 小時前更新

先了解這件事

AI 綜述

2026年10月6日,Zyphra Research 提出 Online Vector-Quantized(OVQ)Attention,用於處理長上下文。報道指,OVQ-attention 具有線性計算複雜度和常數記憶體複雜度,並透過稀疏狀態更新擴大記憶容量。實驗顯示,在上下文長度達 16k 以上時,OVQ-attention 使用的記憶狀態僅為強自注意力基線的一小部分,表現與該基線相若或略有差距;在長上下文任務中,則顯著勝過線性注意力及 SSM 基線。

AI 根據報道生成 · 6 小時前更新

報道時間線

沿着報道,瞭解事件的不同側面。

10月6日
  1. Zyphra Research
    Zyphra 提出 Online Vector-Quantized (OVQ) Attention 處理長上下文

    Zyphra 提出 Online Vector-Quantized(OVQ)attention,以線性計算複雜度和常數記憶體複雜度處理長上下文。其稀疏狀態更新可擴大記憶容量;實驗顯示,在 16k+ 上下文長度下,OVQ-attention 使用的記憶狀態僅為強自注意力基線的一小部分,表現相若或略有差距。長上下文任務中,OVQ-attention 顯著勝過線性注意力及 SSM 基線。

本事件熱度走勢

還沒有足夠的連續觀測數據,暫不繪製趨勢。