跳到正文

全部動態

今日 7 條
9月2日週二
9月1日週一
  1. Berkeley AI Research49

    word2vec 究竟學到了甚麼?

    研究提出 word2vec 學習過程的定量理論,證明在若干實際可行條件下,其學習可化為無權最小二乘矩陣分解,最終表示由 PCA 給出。從接近零的隨機初始化出發,word2vec 以離散步驟逐一學得正交線性子空間,每步提高嵌入矩陣的秩;這些特徵對應由語料統計及演算法超參數定義的目標矩陣頂部特徵向量。

8月28日週四
  1. OpenAI News76

    OpenAI 發佈 gpt-realtime 語音對語音模型並更新 Realtime API

    OpenAI 發佈更先進的語音對語音模型 gpt-realtime,並為 Realtime API 加入新 API 能力。更新包括 MCP server 支援、圖像輸入及 SIP 電話呼叫支援。

    推薦理由:公告同時列出語音對語音模型與 Realtime API 的更新,並點明 MCP server、圖像輸入及 SIP 電話呼叫支援,方便掌握本次功能範圍。

8月27日週三
8月26日週二
8月21日週四
8月18日週一
8月12日週二
8月8日週五
  1. Hugging Face Blog67

    Hugging Face 推出開源 AI Sheets,供用户無代碼建立、豐富及轉換資料集

    Hugging Face 推出開源無代碼工具 AI Sheets,讓用户使用 AI 模型建立、豐富及轉換資料集。它以試算表介面新增提示詞欄位,支援透過 Inference Providers 使用 Hugging Face Hub 上數以千計的開放模型,也可使用本地模型,並可本機部署或部署至 Hub。

    推薦理由:AI Sheets 將提示詞生成、人工校訂與資料集匯出串成工作流,校訂及按讚的儲存格可作為 few-shot 範例供後續生成重用。

8月7日週四
  1. OpenAI News75

    OpenAI 介紹 GPT-5,稱其為迄今最佳 AI 系統

    OpenAI 介紹 GPT-5,稱其為迄今最佳 AI 系統,並指其智能較此前所有模型有顯著提升。GPT-5 在編碼、數學、寫作、健康及視覺感知等方面均達到最先進水平。

    推薦理由:原文以此前模型作比較,並列出編碼、數學、寫作、健康及視覺感知等表現領域,讓讀者掌握 GPT-5 公佈的能力範圍。

8月6日週三
  1. OpenAI News69

    OpenAI 與美國總務署(GSA)合作,向美國聯邦行政部門全體員工提供一年幾乎免費的 ChatGPT Enterprise

    OpenAI for Government 宣佈與美國總務署(GSA)合作,未來一年向美國聯邦行政部門全體員工提供幾乎免費的 ChatGPT Enterprise。OpenAI 將此安排作為一項新倡議推出。

    推薦理由:安排涵蓋整個美國聯邦行政部門員工,並設定為期一年且幾乎免費,呈現這項合作的服務覆蓋範圍與使用期限。

8月5日週二
  1. OpenAI News76

    OpenAI 發佈迄今能力最強的開放權重模型

    OpenAI 今日發佈其迄今能力最強的開放權重模型,稱這是讓先進 AI 在全球更開放、靈活且更容易取得的重要一步。該公司表示,其使命是讓盡可能多人都能使用 AI;AI 的下一個前沿不只關乎能力,也關乎誰能使用它。

  2. Hugging Face Blog91

    OpenAI 發佈開源 GPT OSS 模型系列

    OpenAI 發佈 GPT OSS 開源模型系列,包含 117B 參數的 gpt-oss-120b 和 21B 參數的 gpt-oss-20b。兩款均為 MoE 推理模型,採用 MXFP4 4-bit 量化;gpt-oss-120b 可在單張 80 GB GPU 運行,gpt-oss-20b 可在 16GB 記憶體內運行。

    推薦理由:文章將兩款模型的量化方式、硬件需求與多種部署路徑整理在一起,便於評估本地推理的資源門檻及接入方式。

  3. OpenAI News84

    OpenAI 發佈 gpt-oss-120b 和 gpt-oss-20b 兩款開放權重語言模型

    OpenAI 發佈 gpt-oss-120b 和 gpt-oss-20b 兩款低成本開放權重語言模型,採用 Apache 2.0 授權。它們在推理任務上優於規模相近的開放模型,並具備良好工具使用能力,亦針對消費級硬件高效部署作最佳化。

    推薦理由:推理表現、工具使用能力與消費級硬件部署資訊一併呈現,便於從能力和部署兩方面理解兩款開放權重模型的取向。

8月4日週一
  1. OpenAI News40

    OpenAI 為 ChatGPT 優化的方向

    OpenAI 正依據專家意見改進 ChatGPT,涵蓋艱難時刻支援、休息提醒和生活建議,目標是按用户所需提供協助。休息提醒已推出,艱難時刻支援正在改善,生活建議則仍在完善中。

8月1日週五
  1. OpenAI News15

    Figma 利用 AI 重塑數碼設計

    Figma 正利用 AI 重塑數碼設計工作流程。David Kossnick 分享 Figma Make 等工具如何協助團隊以 AI 製作原型、協作及構建,並改變設計師、開發者和非技術創作者的工作流程。

7月31日週四
  1. Hugging Face Blog62

    用 Python 實作 MCP 伺服器:以 Gradio 建立 AI 購物助手

    文章示範如何以 Gradio 在 Python 中實作 MCP 伺服器,並建立可瀏覽服裝網站、呼叫 IDM-VTON 虛擬試穿的 AI 購物助手。Gradio 會把應用程式的 API endpoint 自動轉為具名稱、描述及輸入 schema 的 MCP 工具,並支援即時進度通知和自動檔案上傳。

    推薦理由:示例將 Gradio MCP 伺服器、Playwright 網頁瀏覽與 IDM-VTON 虛擬試穿串成工作流程,並列出 VS Code 設定步驟。

7月30日週三
7月29日週二
7月23日週三
  1. Hugging Face Blog50

    TimeScope:大型多模態模型能理解多長的影片?

    Hugging Face Blog 介紹開源基準 TimeScope,評估視覺語言模型對 1 分鐘至 8 小時影片的理解能力。基準在長影片中插入約 5–10 秒短片,分別測試局部檢索、資訊綜合和細粒度時間感知。結果顯示模型表現會隨影片變長而下降;Gemini 2.5-Pro 是唯一在超過一小時影片上仍維持良好準確率的模型,而千問(Qwen)2.5-VL 在文字資訊綜合較強、細粒度動態辨識較弱。