跳到正文

#搜尋

今日 8 條
今天10月6日週二
  1. Goodfire Research45

    Goodfire 與 Radical AI 用自我修正搜尋加速材料發現

    Goodfire 與 Radical AI 合作,利用可解釋性工具讓擴散模型從自身內部取得回饋並自我修正,使目標範圍內的可行候選材料增加約 30%。研究在 MatterGen 取樣時利用 probe 從模型嵌入向量提取結構作修正,改善目標命中率而不犧牲獨特性。自我修正搜尋亦可能適用於蛋白質設計和藥物發現等領域。

  2. Prime Intellect66

    Prime Intellect 整合 23 個 Agentic RL 任務集,涵蓋約 365,000 項任務

    Prime Intellect 將 23 個軟件工程、終端機及搜尋任務集整合至同一 taskset API,合計約 365,000 項任務。這些任務可用於評測及 RL 訓練;多個 SWE 數據集經 gold patch 與無修改檢查後,已重新上載清理版本。作者指出,智能體與評分機制共用沙盒仍有 reward hack 風險,隔離評分環境仍在路線圖上。

  3. Google Cloud:Databases64

    Google Cloud 預覽 AlloyDB 與 Cloud SQL 原生 BM25 排序功能

    Google Cloud 預覽 AlloyDB 與 Cloud SQL for PostgreSQL 17+ 的原生 BM25 索引,透過 Tiger Data 開源的 pg_textsearch 擴充功能,讓全文關鍵字搜尋直接在資料庫內執行。這可與向量搜尋組成混合搜尋,避免另設全文搜尋後端;AlloyDB 提供使用 RRF 的混合搜尋 UDF,Cloud SQL 則可用 CTE 合併搜尋結果。

  4. NAVER / CLOVA 研究35

    聖地亞哥 NeurIPS 2025:NAVER 的 AI 現況與未來

    NAVER 在聖地亞哥舉行的 NeurIPS 2025 展示 9 篇研究論文及最新技術示範,研究聚焦效率、可控性與真實世界 AI。其中,KVzip 的記憶體節省幅度最高達 4 倍、速度提升接近 2 倍;CodeGEMM 令 70B 模型運行速度最高提升 8.93 倍。NAVER 亦提出 C-SEO Bench,並以開源方式發布數據集、程式碼及基準。

10月3日週六
  1. LlamaIndex:產品、工程與評測51

    LlamaIndex 以 Alpha 調校提升 RAG 混合搜尋的檢索表現

    LlamaIndex 使用 Retrieval Evaluation module,在 Weaviate 中按查詢類型調校 RAG 混合搜尋的 Alpha,並比較有無重排器的檢索結果。實驗涵蓋六類查詢,以及索引一篇或三篇論文的資料集,並以 Hit Rate 和 MRR 評估檢索表現。文中結果顯示,重排器提升所測資料的兩項指標,而 Alpha 的表現會隨查詢類型和索引文檔數量而異。

  2. LlamaIndex:產品、工程與評測47

    使用 Oxylabs 與 LlamaIndex 構建更智能的 AI 智能體指南

    Oxylabs 與 LlamaIndex 的整合指南示範如何設定專用讀取器,並構建可透過 Google 搜尋取得即時網頁資料的 AI 智能體。整合提供 Google、Amazon、YouTube 的資料讀取器,也支援一般網站抓取,並可解析 HTML、應對反抓取措施。範例使用 OpenAI 的 gpt-4o-mini,文章指出此方案可降低頻繁網頁搜尋的成本。

  3. LlamaIndex:產品、工程與評測55

    LlamaIndex 文件推出原生 MCP 搜尋,提供三種工具

    LlamaIndex 為文件推出原生 MCP 搜尋,讓編碼智能體和智能體工作流可直接搜尋全部文件。服務網址為 https://developers.llamaindex.ai/mcp,提供 search_docs(BM25 詞彙搜尋)、grep_docs(正則搜尋)及 read_doc(讀取指定頁面的完整內容)三種工具。BM25 索引在建置時靜態生成,準確度略低於向量搜尋,但維護較輕量。

  4. LlamaIndex:產品、工程與評測37

    LlamaIndex 2026-03-31 電子報:推出 LiteSearch 並更新文件解析能力

    LlamaIndex 本期電子報宣佈推出 LiteSearch 本地文件檢索系統,並聚焦文件解析能力更新。LiteSearch 以 LiteParse 建構檢索流程,涵蓋解析、分塊、嵌入向量與向量儲存,無需外部依賴;電子報亦介紹 .docx 表格頁面定位改進,以及整合 Gemini 3.1 Live API 的語音助理示範。

  5. MiniMax:Blog76

    MiniMax M2.5:為真實工作場景生產力而打造

    MiniMax 發佈 M2.5 與 M2.5-Lightning,稱兩款模型在編碼、智能體工具調用、搜索及辦公任務達到 SOTA,M2.5 在 SWE-Bench Verified 得分 80.2%。

    推薦理由:文中並列 SWE-Bench Verified 成績、不同腳手架的評測結果、執行時間與定價,方便比較 M2.5 的編碼表現和使用成本。

10月2日週五
10月1日週四
9月30日週三
  1. Google AI:DEV 作者專屬52

    如何以 AlloyDB for PostgreSQL 整合 Jev 模型,實現亞秒級語義篩選

    文章展示如何在 AlloyDB for PostgreSQL 中整合 TypeSafe AI 的 Jev 模型,直接對資料庫資料執行語義篩選與分類。作者以 PostgreSQL 陣列批次處理 50 筆商品,將多項模型評估合併成一次 HTTP 請求;測試耗時約 180 毫秒,逐行使用 Jev 約需 5,600 毫秒,預設模型約需 19,500 毫秒。

8月21日週五
  1. Hugging Face Blog63

    Hugging Face Inference Endpoints、Jobs 和 Buckets 如何支撐 Papers with Code 搜尋

    Hugging Face 以 Inference Endpoints、Jobs 和 Storage Buckets 建立 Papers with Code 混合搜尋系統,為來自 arXiv 和 Daily Papers 的超過 110,000 篇論文維護嵌入向量。

    推薦理由:文章拆解離線批次建向量與線上查詢的分工,並説明端點冷啟動時如何回退全文檢索,呈現混合搜尋進入生產環境的工程取捨。

8月20日週四
  1. Mistral AI68

    Mistral 推出 Agentic Search,以多步檢索提升準確率並降低延遲和 token 使用量

    Mistral 推出 Agentic Search,讓模型透過多步檢索搜尋、查看、導覽及核實複雜文件中的資料。在 FinanceBench 金融文件測試中,正確率由 26.7% 升至 86%;OfficeQA Pro 表格密集的多文件問題則由 6.3% 升至 51.9%。

    推薦理由:FinanceBench 和 OfficeQA Pro 的基準數據呈現 Agentic Search 相較單次 RAG 的準確率提升,也量化延遲與 token 使用量變化。

8月18日週二
  1. Hugging Face Blog72

    Sentence Transformers v6.0 多向量(Late Interaction)嵌入模型使用指南

    Sentence Transformers v6.0 新增 MultiVectorEncoder,支援 ColBERT 式多向量檢索。文中示範載入 PyLate 與 Stanford-NLP ColBERT checkpoint、接入檢索索引,以及以同一 API 執行 ColPali 視覺文件檢索。

    推薦理由:文章對照 LateOn 與 DenseOn 在 NanoBEIR 13 個資料集的結果,並以索引體積數據呈現多向量檢索表現與儲存成本的取捨。

5月28日週四
  1. Mistral AI56

    Mistral AI 推出開源 Search Toolkit 公開預覽版

    Mistral AI 發佈開源 Search Toolkit 公開預覽版,將資料匯入、檢索與評估整合為共享介面的 AI 搜索框架。它內置 BM25 稀疏檢索、基於嵌入向量的密集檢索及混合檢索,並提供 recall、precision、MRR 和 NDCG 指標,可在自有測試集評估。框架可在雲端、本地部署及邊緣環境運行,並提供 starter app template。

5月19日週二
  1. Hugging Face Blog66

    Hugging Face 發佈 Ettin Reranker 系列六款模型,規模涵蓋 17.6M 至 1.00B

    Hugging Face 發佈六款基於 Ettin ModernBERT encoder 的 Sentence Transformers CrossEncoder reranker,參數規模由 17.6M 至 1.00B,並公開訓練數據及完整訓練方案。

    推薦理由:文章以 MTEB(eng, v2) Retrieval、NanoBEIR 及多種硬件吞吐測試比較六種尺寸,呈現 Ettin Reranker 在排序品質與速度間的取捨。

5月15日週五
  1. Hugging Face Blog63

    Granite Embedding Multilingual R2 發佈兩款 Apache 2.0 多語嵌入模型,支援 32K 上下文

    IBM Granite 發佈兩款採 Apache 2.0 授權的多語嵌入模型:97M 參數的 granite-embedding-97m-multilingual-r2 和 311M 參數的 granite-embedding-311m-multilingual-r2。

    推薦理由:文章提供 97M 與 311M 版本在多語檢索、長文及程式碼基準的比較,並交代 Matryoshka 維度選項對儲存與部署取捨的影響。

5月14日週四
4月10日週五
4月9日週四
  1. Hugging Face Blog66

    Sentence Transformers v5.4 多模態嵌入與 Reranker 模型使用指南

    Sentence Transformers v5.4 的同一 API 現可編碼並比較文字、圖像、音訊和影片,文章示範其多模態嵌入與 reranker 用法。嵌入模型將不同模態映射至共享嵌入空間;預訓練多模態 reranker 目前主要處理文字與圖像配對。示例涵蓋跨模態檢索、混合模態文件重排及先檢索再重排流程,並列出輸入格式、支援模型和安裝依賴。

    推薦理由:文章展示 Sentence Transformers v5.4 的跨模態檢索與 reranker 重排流程,並整理支援模型和輸入格式,提供實作參考。

3月5日週四
2月17日週二
1月26日週一
1月20日週二
12月10日週三
  1. Manus:Blog51

    Manus Web App 加入內置 SEO 功能

    Manus Web App 新增內置 SEO 功能,會向搜索引擎爬蟲提供預渲染的靜態 HTML,同時讓普通訪客繼續使用互動式網站版本。功能會自動管理規範 URL、robots.txt 和動態網站地圖,並提供頁面 SEO 評分及 AI 優化建議;現供所有付費訂閲計劃使用。

12月9日週二
9月22日週一
8月18日週一
7月30日週三
7月1日週二
  1. Hugging Face Blog64

    使用 Sentence Transformers 訓練及微調稀疏嵌入模型

    Hugging Face Blog 示範如何使用 Sentence Transformers 訓練及微調稀疏嵌入模型,介紹 SPLADE、Inference-free SPLADE、CSR 架構,以及資料、損失函數、評估器和訓練器的配置。

    推薦理由:文章按 SPLADE、Inference-free SPLADE 與 CSR 的適用情境梳理架構選擇,並以實作例子串連資料、損失函數和評估器配置。