Redwood Research:Blog· Dylan Xu·· 13 天前AI 評分71
GPT-6-Astra 使用填充 token 時的推理表現明顯優於其他模型
Astra is much better at reasoning with filler tokens than previous models
AI 導讀
Redwood Research 發現,提示詞加入無意義填充 token 後,GPT-6-Astra 在多項推理與數學評測的提升幅度高於其他受測模型。在 4-hop natural facts 評測中,其成績由約 10-20% 升至約 50%;舊版 AIME 題目則由約 60-70% 升至約 90%,填充 token 的效益在約 8,192 tokens 時達峯值。
來源:Redwood Research:Blog · blog.redwoodresearch.org