跳到正文

全部動態

今日 7 條
1月24日週二
  1. Hugging Face Blog60

    甚麼令對話智能體有用?

    Hugging Face Blog 梳理對話智能體的訓練方法,涵蓋 IFT、SFT、RLHF 和 CoT。文中指出,IFT 所需指令數據僅為數百例量級,SFT 以人工標註改善有用性和安全性,RLHF 則根據人類偏好訓練獎勵模型,再用強化學習訓練對話智能體。

    推薦理由:文章把 IFT、SFT、RLHF 與 CoT 放在對話智能體訓練脈絡中梳理,並比較多個系統的訓練資料和評估方向,呈現各方法的分工。

1月23日週一
1月17日週二
1月16日週一
1月4日週三
1月3日週二
  1. Hugging Face Blog48

    圖機器學習入門

    Hugging Face Blog 概述圖機器學習基礎,涵蓋圖的結構、應用任務、表示方式與圖上學習方法。內容説明節點、邊及同質/異質、有向/無向圖等概念,並介紹圖層級、節點、邊與子圖任務,以及邊集合和鄰接矩陣等表示方式。文章亦簡述前神經網絡方法、Graph Neural Networks 和用於圖的 Transformers。

1月2日週一
1月1日週日
12月21日週三
  1. Hugging Face Blog56

    CLIPSeg 零樣本圖像分割使用指南

    Hugging Face Blog 示範如何透過 Transformers 使用 CLIPSeg,以文字或參考圖像作為提示,為圖像生成零樣本分割遮罩。CLIPSeg 使用 352 x 352 像素圖像,輸出遮罩分辨率較低;文章示範將預測作為 Segments.ai 的粗略預標註,再人工修正以供後續模型訓練。

12月20日週二
  1. Hugging Face Blog56

    Hugging Face 推出模型卡建立工具、指南及更新範本

    Hugging Face 推出模型卡建立工具及配套指南,並在 huggingface_hub library 發佈更新版模型卡範本。工具以圖形介面支援不同背景與角色的團隊毋須編程或使用 Markdown 協作撰寫,範本加入預設提示文字,特別涵蓋偏差、風險與限制。這項工作亦包括 Hugging Face 的模型卡使用者研究,以及機器學習文檔現況分析和文獻回顧。

12月15日週四
  1. Hugging Face Blog63

    Hugging Face 倫理與社會電子報第 2 期:談談機器學習中的偏見

    Hugging Face 的 Ethics and Society 團隊在第 2 期電子報中,探討機器學習偏見如何隨部署情境轉化為風險,並整理團隊用於不同開發階段的工具與建議。

    推薦理由:文章把機器偏見連結至具體部署情境,並按任務定義、資料整理與模型開發階段整理評估及記錄做法,讓風險辨識不只停留在模型輸出檢查。

12月9日週五
  1. Hugging Face Blog68

    RLHF 圖解:人類反饋強化學習的訓練流程

    Hugging Face Blog 梳理 RLHF 的三階段訓練流程,包括預訓練語言模型、收集偏好數據並訓練獎勵模型,以及以強化學習微調模型。人類標註者透過比較並排序同一提示下生成的文本來建立偏好數據;PPO 微調時,KL 懲罰用於限制策略偏離初始模型。

    推薦理由:文章拆解 RLHF 的三階段訓練流程,並説明偏好排序如何訓練獎勵模型,以及 KL 懲罰如何約束後續策略更新。

12月2日週五
  1. Hugging Face Blog62

    蛋白質深度學習入門:遷移學習與摺疊預測

    Hugging Face Blog 説明如何將語言模型的遷移學習應用於蛋白質序列,先以大量蛋白質序列預訓練,再遷移至摺疊和分類等任務。文章指出,ESMFold 類似 AlphaFold2,但執行時毋須外部資料庫或搜尋步驟。文中亦提供 PyTorch 和 TensorFlow 的蛋白質模型微調範例,以及目前僅支援 PyTorch 的 ESMFold 筆記本。

    推薦理由:文章以語言模型遷移學習作類比,説明蛋白質序列預訓練如何延伸至摺疊及分類任務,並提供微調筆記本作實作起點。

12月1日週四
11月30日週三
  1. OpenAI News93

    OpenAI 介紹對話模型 ChatGPT

    OpenAI 介紹了名為 ChatGPT 的對話模型,該模型以對話方式與用户互動。對話格式使 ChatGPT 能回答追問、承認錯誤、質疑不正確前提,並拒絕不當請求。

    推薦理由:原文把追問、承認錯誤、質疑錯誤前提及拒絕不當請求列為對話格式支持的行為,具體呈現 ChatGPT 的互動設計。

11月29日週二
  1. Hugging Face Blog34

    Hugging Face 招募實習生!

    Hugging Face 宣佈 2023 年實習計劃,招募開源、科學及其他團隊的實習生。職位涵蓋 Accelerate、文字轉語音、具身 AI、大語言模型分散式訓練框架、LLM 資料集、社會影響評估及 AI 藝術工具。申請須建立 Hugging Face 帳户。

11月25日週五
11月21日週一
  1. Hugging Face Blog64

    Hugging Face 分享以開源模型加速 Document AI 的方法

    Hugging Face 介紹如何以開源模型建立 Document AI 方案,並按任務梳理文件分類、版面分析、文件解析、表格處理及文件問答。文中以 RVL-CDIP 為例,列出 BERT-base、DiT、LayoutLMv3 和 Donut 的文件分類準確率分別為 89%、92% 及 95%,並討論授權、數據準備、微調與評估等實作考量。

    推薦理由:文章按文件類型與任務梳理 Document AI 模型選擇,並串連授權、數據準備和評估考量,提供從小規模微調起步的實作思路。

11月17日週四
11月8日週二
  1. Hugging Face Blog56

    Hugging Face 更新定價與計費安排,Inference API 付費層將取消

    Hugging Face 調整付費服務安排,Inference API 將取消付費層,並繼續免費向所有人開放。Inference Endpoints 是面向快速、企業級推理即服務的新方案;Spaces 亦新增硬件升級,讓機器學習示範可在自選硬件上運行。使用這些服務無須訂閲,只需在帳户加入信用卡,也可為組織綁定付款方式;付費服務及訂閲費用於每月月初收取,並提供合併發票。

11月7日週一
  1. Hugging Face Blog73

    使用 Diffusers 以 Dreambooth 微調 Stable Diffusion 的實驗與設定建議

    Hugging Face 團隊以 Diffusers 的 `train_dreambooth.py` 對 Stable Diffusion 進行 Dreambooth 微調實驗,整理降低過擬合及改善生成品質的設定建議。

    推薦理由:文中以不同主體的對照實驗梳理學習率、訓練步數與 prior preservation 對過擬合的影響,為 Dreambooth 微調提供具體設定參照。

11月3日週四
11月2日週三
10月24日週一
  1. Hugging Face Blog54

    使用 🤗 Evaluate 評估語言模型偏差

    Hugging Face 團隊在 🤗 Evaluate 加入多項偏差評估指標,並示範如何檢視因果語言模型根據提示詞生成的文本。示例使用 Toxicity、Regard 和 HONEST 評估文本毒性、不同羣體的語言極性差異,以及有害句子完成中的性別刻板印象。文章提醒,現有資料集涵蓋的身份特徵有限,這些指標只能呈現偏差的不同面向,建議結合多種指標使用。

10月21日週五
10月19日週三
  1. Hugging Face Blog71

    MTEB 提供文本嵌入模型的大規模基準測試與排行榜

    MTEB 是一套評估文本嵌入模型在多種任務上表現的大型基準測試,並以排行榜彙整模型成績。該基準涵蓋 56 個數據集、8 類任務及最多 112 種語言,排行榜彙整 >2000 項結果。

    推薦理由:MTEB 把 56 個數據集、8 類任務納入同一排行榜,並提供自行測試及提交結果的流程,方便按具體任務比較文本嵌入模型。

10月14日週五
10月12日週三
  1. Hugging Face Blog63

    BLOOM 推理優化實錄:延遲降低 5x、吞吐量提升 50x

    Hugging Face 團隊記錄了為 BLOOM 建置推理伺服器的優化過程,稱數週內將延遲降低 5x、吞吐量提升 50x。改用 Tensor Parallelism 後,延遲由 300ms/token 降至 91ms/token,吞吐量升至 10RPS;其後透過 torch.jit.script 和自訂 kernel 將延遲再降至 71ms/token。

    推薦理由:文章以 BLOOM 的實測串連並行策略、算子融合和批次服務的取捨,呈現大型模型推理優化中如何平衡延遲與吞吐量。

10月7日週五
10月5日週三
  1. Hugging Face Blog61

    rinna 發佈日語文本生成圖像模型 Japanese Stable Diffusion

    rinna Co., Ltd. 發佈 Japanese Stable Diffusion,這款文本生成圖像模型以日語標註圖片微調 Stable Diffusion,支援日語提示詞並生成反映日語文化圈的圖像。

    推薦理由:文章拆解 Japanese Stable Diffusion 的兩階段微調流程,説明專用日語文本編碼器與聯合調整潛在擴散模型的作用,訓練數據約為 Stable Diffusion 訓練集的 1/20。

10月3日週一
9月28日週三
  1. Hugging Face Blog59

    Hugging Face AutoTrain 新增圖像分類任務

    Hugging Face 為 AutoTrain 新增圖像分類任務,擴展其 Computer Vision 支援,讓用户可透過免配置流程訓練圖像分類模型。AutoTrain 可載入本地資料或 Hugging Face Hub 上的資料集,並嘗試多個模型候選;文中的蝴蝶分類例子中,最佳模型準確率為 84%。使用 5 個候選模型及少於 500 張圖片訓練免費。

9月26日週一
9月22日週四
  1. Hugging Face Blog38

    Hugging Face《倫理與社會通訊》第 1 期

    Hugging Face 推出《倫理與社會通訊》,分享將協作、責任與透明度等價值融入 AI 開發的思考與實踐。通訊每季於春分、秋分及夏至、冬至刊出,內容涵蓋文件與評估工具、教育項目、資料偏斜與偏見分析,以及模型訓練碳排追蹤。Hugging Face 亦開放對模型、資料及 Spaces 的直接回饋,並支援舉報模型與 Spaces 儲存庫中的倫理及法律問題。

9月21日週三
  1. OpenAI News66

    OpenAI 開源語音識別神經網絡 Whisper

    OpenAI 宣佈將其訓練的神經網絡 Whisper 開源。Whisper 在英語語音識別上的穩健性與準確度接近人類水平。

    推薦理由:Whisper 的開源安排與英語語音識別表現並列,且以接近人類水平作比較,讓讀者可同時掌握模型發佈範圍與性能定位。