跳到正文
原文
Baseten Base Labs:模型研究·· 6 小時前AI 評分45

邁向無限上下文窗口:STILL 的神經式 KV cache 壓縮

06Towards infinite context windows: neural KV cache compactionCheckpoint·APR 2026

AI 導讀

STILL 可在毫秒內將 LLM 的 KV cache 壓縮 8 倍,並在不同領域保留 85% 以上的事實準確度。它以固定的學習型查詢向量對完整 KV cache 執行交叉注意力,在單次前向傳播中生成緊湊快取,並以 KL 蒸餾訓練。

來源:Baseten Base Labs:模型研究 · labs.baseten.co