跳到正文

#產品更新

今日 27 條
5月21日週二
5月16日週四
5月13日週一
  1. Hugging Face Blog70

    Hugging Face 發佈 Transformers Agents 2.0,新增兩種可迭代的智能體

    Hugging Face 發佈 Transformers Agents 2.0,新增 ReactCodeAgent 和 ReactJsonAgent,能根據過往觀察迭代。框架以簡潔、模組化,以及工具和提示詞透明為設計目標。使用 Llama-3-70B-Instruct 的智能體在完整 GAIA 基準中排名第 4,超越多個基於 GPT-4 的智能體。

    推薦理由:文中比較 Code 與 JSON 智能體在不同模型上的表現,並展示 Llama-3-70B-Instruct 智能體於 GAIA 的名次,可作為評估 Agent 架構與模型搭配的具體參照。

5月9日週四
5月7日週二
  1. OpenAI News27

    OpenAI 對數據與 AI 的方針

    OpenAI 説明其對數據與 AI 的方針,並介紹一款面向創作者及內容所有者的全新 Media Manager。ChatGPT 推出一年多後,AI 正改變人們的生活、工作與學習方式,亦引發關於 AI 時代數據的重要討論;OpenAI 並談及未來方向。

5月3日週五
4月24日週三
  1. OpenAI News77

    GPT-4 API 正式開放,OpenAI 公佈 Completions API 舊模型棄用計劃

    OpenAI 宣佈 GPT-4 API 正式開放使用,並表示 GPT-3.5 Turbo、DALL·E 和 Whisper APIs 亦已正式開放。OpenAI 同時公佈 Completions API 舊模型的棄用計劃,稱相關舊模型將於 2024 年初退役。

    推薦理由:公告並列 GPT-4 API 等服務的正式可用狀態與 Completions API 舊模型退役安排,讀者可據此辨識不同 API 的變更範圍。

4月23日週二
4月16日週二
4月10日週三
  1. Hugging Face Blog64

    Hugging Face 推出 Deploy on Google Cloud,讓開放模型可部署至 Vertex AI 和 GKE

    Hugging Face 推出 Deploy on Google Cloud 整合,讓用户可把 Hub 上的開放模型部署至 Vertex AI 或 GKE。所有帶有「text-generation-inference」標籤的模型均獲支援;Vertex Model Garden 提供數百個熱門開放 LLM 的即用測試硬件配置。

    推薦理由:這項整合串起 Hugging Face 模型探索與 Google Cloud 部署,並為數百個熱門開放 LLM 提供測試硬件配置,呈現更直接的雲端部署流程。

4月4日週四
4月1日週一
3月29日週五
3月25日週一
3月21日週四
3月18日週一
2月27日週二
  1. Hugging Face Blog59

    TTS Arena:在真實使用場景中評測文字轉語音模型

    Hugging Face 推出 TTS Arena,讓用户輸入文字、盲聽兩個文字轉語音模型合成的語音,並投票選出聽起來較自然的一方。模型名稱會在投票提交後揭示,結果將按類似 Elo 評分系統的算法生成公開排行榜,累積足夠票數後模型才會逐步顯示。啟動時納入 ElevenLabs(專有)、MetaVoice、OpenVoice、Pheme、WhisperSpeech 和 XTTS。

2月19日週一
2月13日週二
2月8日週四
1月10日週三
1月4日週四
12月11日週一
11月7日週二
  1. Hugging Face Blog49

    推出 Prodigy-HF:與 Hugging Face 直接整合

    Explosion 推出 Prodigy-HF,將 Prodigy 與 Hugging Face 生態系直接整合,支援以標註資料訓練及重用 Hugging Face 模型。插件可透過命令列微調命名實體識別及文本分類模型,並將訓練模型儲存至磁碟後上載至 Hugging Face Hub。使用者亦可把已標註資料集發佈至 Hugging Face Hub,供社羣共享。

11月6日週一
11月3日週五
10月11日週三
9月25日週一
9月22日週五
  1. Hugging Face Blog61

    Hugging Face 推出 Inference for PROs,開放精選模型 API 端點

    Hugging Face 推出 Inference for PROs,為 PRO 用户開放精選模型的專屬 API 端點,並提高免費 Inference API 的使用速率限制。服務提供可直接使用的 HTTP 端點,方便試驗及原型開發;文章指出它不適合重型生產應用,並建議此類用途使用 Inference Endpoints。

    推薦理由:文中列出 PRO 可用的精選模型、端點呼叫方式及服務不適用於重型生產應用的邊界,便於評估其原型測試用途。

8月28日週一
8月23日週三
  1. Hugging Face Blog76

    Hugging Face 將 AutoGPTQ 整合至 Transformers,支援大語言模型 GPTQ 量化

    Hugging Face 將 AutoGPTQ 整合至 Transformers,支援以 GPTQ 將大語言模型量化至 8、4、3 或 2-bit。4-bit 量化的精度下降可忽略,小批次推理速度與 fp16 基準相若;整合支援 NVIDIA GPU 和 ROCm 驅動的 AMD GPU。

    推薦理由:文章列出 4-bit 量化的精度變化與小批次推理速度,並説明 GPU 支援範圍及 TGI 大批次下的速度限制,呈現 GPTQ 的部署取捨。

8月22日週二
  1. Hugging Face Blog57

    Hugging Face 推出企業程式碼助手方案 SafeCoder

    Hugging Face 推出 SafeCoder 企業程式碼助手方案,讓客户在自家基礎設施訓練及部署,程式碼於訓練和推理期間不離開 VPC。SafeCoder 初始版本以 StarCoder 為基礎,可按客户私有程式碼庫微調;程式碼補全建議會對照 The Stack,顯示其是否匹配資料集中的程式碼及相關授權。SafeCoder 與 VMware 合作推出,現向 VMware 企業客户提供。

8月10日週四