跳到正文

#產品更新

今日 1 條
9月1日週二
8月28日週五
  1. Hugging Face Blog68

    Open ASR Leaderboard 新增 Hindi、Indian English 評測集,首度納入全球南方語言

    Voice Arena 與 Hugging Face 為 Open ASR Leaderboard 加入 Monsoon en-IN 和 Monsoon hi-IN 評測集,涵蓋 Indian English 與 Hindi,令 Hindi 成為其多語言分頁首個 Indic language。

    推薦理由:這批評測集把説話者背景與可接受的拼寫變體納入 ASR 評估,讓總體 WER 之外的區域差異和 Hindi 正字法誤差更容易被辨識。

8月26日週三
8月25日週二
8月24日週一
8月20日週四
  1. Mistral AI68

    Mistral 推出 Agentic Search,以多步檢索提升準確率並降低延遲和 token 使用量

    Mistral 推出 Agentic Search,讓模型透過多步檢索搜尋、查看、導覽及核實複雜文件中的資料。在 FinanceBench 金融文件測試中,正確率由 26.7% 升至 86%;OfficeQA Pro 表格密集的多文件問題則由 6.3% 升至 51.9%。

    推薦理由:FinanceBench 和 OfficeQA Pro 的基準數據呈現 Agentic Search 相較單次 RAG 的準確率提升,也量化延遲與 token 使用量變化。

8月19日週三
8月18日週二
8月13日週四
  1. Hugging Face Blog53

    OlmoEarth Studio 新增自訂嵌入向量匯出功能

    OlmoEarth Studio 新增自訂嵌入向量匯出功能,輸出可用於下游分析的 COG。使用者可設定研究區域、時間範圍、編碼器、解析度及影像來源;文章示範相似度搜尋、少樣本分割、變化檢測和 PCA 探索。以 60 個標註像素訓練的分類器取得 weighted F1 = 0.84,匯出檔可用於 QGIS、GDAL、rasterio 等工具。

8月11日週二
  1. OpenAI News61

    OpenAI 開始在 ChatGPT 測試廣告,以支持免費使用

    OpenAI 開始在 ChatGPT 測試廣告,以支持免費使用。測試安排包括清晰標示廣告、維持答案獨立、提供強力私隱保障,並保留用户控制。

    推薦理由:材料列出 OpenAI 測試 ChatGPT 廣告時的設計邊界,包括清晰標示、答案獨立、私隱保障及用户控制,呈現其支持免費使用時採取的安排。

8月10日週一
8月4日週二
7月30日週四
7月29日週三
7月23日週四
  1. OpenAI News65

    OpenAI 在 ChatGPT 推出 Health 功能

    OpenAI 推出 ChatGPT 的 Health 功能,讓符合資格的美國用户安全連接醫療紀錄和 Apple Health。用户可藉此獲取更個人化的洞察,並更瞭解自身健康。

    推薦理由:材料交代了 Health 的適用對象、可連接的健康資料來源及預期用途,便於瞭解這項功能的使用範圍。

7月22日週三
7月21日週二
  1. Hugging Face Blog62

    Pollen Robotics 發佈開源機械人操作數據採集系統 Grabette

    Pollen Robotics 發佈開源、低成本的 Grabette 手持式系統,可記錄人工操作示範並轉成機械人訓練數據集。裝置配備兩部攝影機,瀏覽器處理流程透過 RTAB-MAP 執行 SLAM,並輸出 LeRobot 格式數據;Grabette 的物料清單成本約 490€。

    推薦理由:Grabette 把手持式示範、SLAM 軌跡處理與 LeRobot 數據集串成採集流程,並以 200 段示範呈現訓練及機械臂評估的端到端用法。

7月17日週五
7月9日週四
  1. Mistral AI52

    Mistral Studio 為 Prompts 和 Skills 提供集中管理與版本追溯

    Mistral Studio 現已為 Prompts 和 Skills 提供集中記錄系統,涵蓋版本、負責人、完整歷史和追溯能力。AI 開發者及非開發者均可即時編輯和測試,正式部署仍須經企業既有測試與審批流程,標籤亦可觸發 CI/CD。Studio 支援版本比較、回滾和審計記錄,並透過 Observability 將生產輸出追溯至相應資產版本。

7月8日週三
  1. Hugging Face Blog75

    Hugging Face 更新 vLLM Transformers 建模後端,多種相容 LLM 架構推理吞吐量達原生實作水平

    Hugging Face 更新 vLLM 的 Transformers 建模後端,令多種相容 LLM 架構的推理吞吐量達到或超過 vLLM 手寫原生實作。測試涵蓋 Qwen3-4B 單 GPU、Qwen3-32B 張量並行,以及 Qwen3-235B-A22B-FP8 MoE 在同一 8×H100 節點上的數據並行與專家並行,三者均達到或超越原生實作吞吐量。

    推薦理由:文章以三種不同規模及並行配置的 Qwen3 模型對照 vLLM 手寫實作,並説明 torch.fx 分析與運行時融合如何使相容模型達到原生推理速度。

7月7日週二
  1. Hugging Face Blog63

    Hugging Face 精選模型目錄登陸 Microsoft Foundry Managed Compute,開放預覽

    Hugging Face 與 Microsoft 將每週更新的精選開放權重模型目錄加入 Microsoft Foundry Model Catalog,並可一鍵部署至 Foundry Managed Compute。

    推薦理由:文章梳理模型篩選、權重預置和執行環境掃描的上架流程,説明企業如何在私有網絡內部署而毋須連出 Hugging Face Hub。

  2. Hugging Face Blog75

    LeRobot v0.6.0 發佈,新增世界模型策略、六項模擬基準及部署 CLI

    LeRobot v0.6.0 新增世界模型策略、統一六項模擬基準的 lerobot-eval,以及用於部署和收集人工修正資料的 lerobot-rollout CLI。

    推薦理由:版本把策略部署、人工接管修正與資料回訓串成可重複流程,並以統一 CLI 整合六項模擬基準,呈現機械人學習由實作到評估的工作流。

7月6日週一
7月1日週三
6月30日週二
6月25日週四
6月24日週三