跳到正文

全部動態

今日 127 條
10月3日週六
  1. LlamaIndex:產品、工程與評測38

    LlamaIndex 2026-03-10 電子報

    LlamaIndex 本期電子報介紹其由 RAG 框架發展為智能體文件處理平台,並聚焦 LlamaParse、耐久工作流程及文件解析工具更新。平台服務 300k+ 用户、支援 50+ 格式;DBOS 整合提供自動步驟持久化與崩潰復原,另有簡報搜尋及 PDF 圖表解析工具。

  2. LlamaIndex:產品、工程與評測48

    LlamaParse 改善 Word(.docx)文件的表格解析

    LlamaParse 更新了 Word(.docx)文件的表格解析方式,改為直接從 Word XML 擷取表格內容並保留原始結構。其專有技術會將 Word XML 表格元素對應至渲染結果中的正確頁面位置,並把 XML 表格內容轉換為 Markdown;這項更新目前適用於 .docx 表格。

  3. LlamaIndex:產品、工程與評測37

    LlamaIndex 2026-03-31 電子報:推出 LiteSearch 並更新文件解析能力

    LlamaIndex 本期電子報宣佈推出 LiteSearch 本地文件檢索系統,並聚焦文件解析能力更新。LiteSearch 以 LiteParse 建構檢索流程,涵蓋解析、分塊、嵌入向量與向量儲存,無需外部依賴;電子報亦介紹 .docx 表格頁面定位改進,以及整合 Gemini 3.1 Live API 的語音助理示範。

  4. LlamaIndex:產品、工程與評測52

    LlamaParse 推出行、字詞及儲存格級精細邊界框

    LlamaIndex 宣佈 LlamaParse 推出精細邊界框功能,可按行、字詞及表格儲存格標示文件位置。只有頁面上明確存在的文字會獲分配座標,推斷值、AI 摘要及重建內容則不會有邊界框。功能現以 beta 形式向所有付費方案提供,建立解析任務時須以單一參數選擇啟用;Agentic Plus 會額外執行驗證輪次以提升精度。

  5. LlamaIndex:產品、工程與評測50

    LlamaIndex 7-15-26 電子報整理多項產品更新

    LlamaIndex 在 7-15-26 電子報公佈多項產品更新,涵蓋抽取、Markdown 輸出、表格處理和方案席位。Conversational Extract 可透過對話建立抽取 schema,fast tier 預設輸出 Markdown,Agentic Plus 的表格處理有所改善,所有方案(包括免費方案)均支援 100 位使用者。

  6. OpenAI Developers:Blog30

    Hello, world! OpenAI 推出開發者網誌

    OpenAI 推出面向開發者的新網誌,將刊載技術深入文章、版本更新説明及最佳實踐,並由工程師直接分享工具與功能資訊。首批兩篇文章包括 Realtime API 開發者備忘,聚焦整合 GA Realtime API 及新即時模型時涉及的重要技術變更。

  7. OpenAI Developers:Blog76

    OpenAI Realtime API 開發者筆記:GA 後語音對語音更新要點

    OpenAI 整理 Realtime API 與 gpt-realtime 語音對語音模型進入 GA 後的介面變更、新功能及整合注意事項。文章建議客户遷移至 GA 介面,並説明 beta 與 GA 在功能支援、temperature 和非同步函式呼叫上的差異。

    推薦理由:文章對照 beta 與 GA 的功能支援差異,並説明介面遷移、temperature 設定及長對話截斷的處理方式,方便開發者按整合環節核對需要調整的設定。

  8. Anthropic:Alignment Science Blog63

    Anthropic 發佈開源工具 Bloom,自動生成行為評測

    Anthropic 發佈開源 Bloom,這套 AI 智能體框架可按研究者指定的行為自動生成評測,並量化其在多種情境中的出現頻率與嚴重程度。Anthropic 同時公佈 16 個模型在妄想式迎合、受指示的長期破壞、自我保存和自我偏袒四類行為的基準;在 40 份轉錄中,Claude Opus 4.1 的評分與人工標註 Spearman 相關係數為 0.86。

  9. Anthropic:Alignment Science Blog66

    Anthropic 發佈 Petri 2.0,新增 70 個場景並更新模型比較及評測意識緩解措施

    Anthropic 發佈 Petri 2.0,為自動化行為審計工具新增 70 個 seed 指令、評測意識緩解改進和較新前沿模型的評測結果。真實感分類器與人工修訂 seed 指令合用時,Claude 模型的評測意識中位相對降幅為 47.3%,但部分模型的未提示主動性亦有下降。

  10. The Verge · AI71

    OpenAI 的 Dots 智能體像企業軟件,也能代點晚餐

    作者實測 OpenAI 的 Dots 智能體,發現它更像可操作其他軟件的工作助理,處理個人購物時則屢受網站安全檢查阻礙。取得電腦存取權後,Dots 成功整理影片及更新個人網站;在協助登入 Uber Eats 後,也訂到了照燒餐。作者透過每月 $100 的 Pro 賬户測試,認為以自己的工作需求而言,Dots 尚不值這個月費。