跳到正文

全部動態

今日 8 條
11月25日週二
  1. Hugging Face Blog47

    OVHcloud 成為 Hugging Face Hub 支援的推理服務提供商

    OVHcloud 已成為 Hugging Face Hub 支援的推理服務提供商,用户可透過 Hub 模型頁面及 JS、Python SDK 使用其服務。OVHcloud AI Endpoints 是全託管無伺服器服務,每百萬個 tokens 收費由 €0.04 起,基建設於歐洲數據中心。服務支援結構化輸出、函數呼叫及文字和圖像處理,首個 token 回應時間低於 200ms。

11月24日週一
  1. Google DeepMind68

    Google DeepMind 支持白宮 Genesis Mission,與美國能源部合作加速科研創新

    Google DeepMind 宣佈支持白宮 Genesis Mission,並與美國能源部合作,向其 17 個國家實驗室的科學家提供 AI for Science 模型及智能體工具。

    推薦理由:合作將 AI for Science 模型及智能體工具分階段提供予美國能源部 17 個國家實驗室,並交代即日起的首階段與 2026 年初的擴展安排。

11月22日週六
11月20日週四
  1. Google DeepMind66

    Google DeepMind 如何將 AI 圖像驗證功能帶入 Gemini App

    Google DeepMind 在 Gemini App 推出 AI 圖像驗證功能,使用 SynthID 水印判斷圖片是否由 Google AI 生成或編輯。用户可上載圖片並直接提問;SynthID 自 2023 年推出以來,已為超過 20 billion 件 AI 生成內容加上水印。

    推薦理由:文章交代 Gemini 如何透過 SynthID 水印檢查圖像是否由 Google AI 生成或編輯,並説明後續支援影片、音訊及更多介面的計劃。

  2. Google DeepMind75

    使用 Nano Banana Pro(Gemini 3 Pro Image)構建圖像應用

    Google DeepMind 發佈 Nano Banana Pro(Gemini 3 Pro Image),並以付費預覽方式向開發者開放。模型具備更準確的文字渲染和圖像本地化能力,支援 2K 和 4k 解析度;啟用 Google Search grounding 時,亦可連接即時網頁內容。

    推薦理由:文章把 Nano Banana Pro 的文字渲染、本地化能力與接入方式,連同相較 Gemini 2.5 Flash Image 的成本和延遲取捨一併交代。

11月19日週三
  1. Google Research75

    Google Research 介紹即時語音到語音翻譯模型,標準延遲為 2 秒

    Google Research 介紹端到端即時語音到語音翻譯模型,以原説話者聲線輸出譯音,標準延遲為 2 秒。模型採用串流架構及時間同步訓練資料,支援英語與西班牙語、德語、法語、意大利語、葡萄牙語之間的雙向翻譯。相關功能已在 Google Meet 伺服器端提供,並作為 Pixel 10 的內置裝置端功能推出;Pixel Voice Translate 採用級聯式流程以擴大語言覆蓋。

    推薦理由:文章説明串流架構如何配合時間同步訓練資料,把語音互譯的標準延遲控制在 2 秒,並以原説話者聲線輸出譯音,可瞭解低延遲與個人化如何結合。

  2. OpenAI News65

    ChatGPT for Teachers 為經核實的美國 K–12 教育工作者提供免費安全工作空間

    OpenAI 的 ChatGPT for Teachers 為經核實的美國 K–12 教育工作者提供免費安全工作空間,免費期限至 2027 年 6 月。工作空間設有教育級私隱保護和管理員控制。

    推薦理由:免費方案面向經核實的美國 K–12 教育工作者,期限至 2027 年 6 月,讀者可據此辨認服務對象和使用期限。

  3. OpenAI News32

    GPT-5.1-Codex-Max 系統卡

    這份系統卡列明 GPT-5.1-CodexMax 已實施的全面安全措施,涵蓋模型與產品層面的防護。模型層麪包括針對有害任務及提示詞注入的專門安全訓練;產品層面則包括智能體沙盒及可配置的網絡存取。

  4. Google DeepMind81

    Google 發佈 Antigravity 智能體開發平台,免費開放公開預覽

    Google 推出 Antigravity 智能體開發平台,並免費開放公開預覽。平台保留 AI IDE 編輯器,另設以智能體為核心的 Manager,支援瀏覽器控制及非同步互動,讓智能體自主規劃和執行端到端軟件任務;Artifacts 可供使用者檢視工作成果並提供回饋。

    推薦理由:Antigravity 將 IDE 編輯與 Agent Manager 分成不同工作介面,並以任務級 Artifacts、驗證結果和非同步回饋呈現及修正智能體工作。

  5. Google Research77

    Google Research 介紹生成式 UI:為各類提示生成客製化視覺互動體驗

    Google Research 介紹生成式 UI 實作,Gemini app 今日起推出 dynamic view 和 visual layout 兩項實驗,Google Search 的 AI Mode 亦加入生成式互動介面。

    推薦理由:文章對照生成式 UI 與標準 LLM 輸出及專家設計網站的偏好結果,並交代生成有時需一分鐘以上及輸出偶有不準確的限制。

11月18日週二
11月17日週一
  1. Google DeepMind72

    Google DeepMind 與 Google Research 發佈 WeatherNext 2 天氣預測模型

    Google DeepMind 與 Google Research 發佈 WeatherNext 2,預報生成速度快 8 倍,並提供細至每小時解析度的全球天氣預測。

    推薦理由:WeatherNext 2 與前代 WeatherNext 的比較覆蓋 0–15 天內 99.9% 的變量與預報時效,並列出單顆 TPU 每項預測少於一分鐘的耗時,便於同時衡量預報表現與計算效率。

11月14日週五
  1. OpenAI News33

    OpenAI 推出 OpenAI for Ireland

    OpenAI 推出 OpenAI for Ireland,並與愛爾蘭政府、Dogpatch Labs 及 Patch 合作。計劃旨在協助中小型企業(SMEs)、創辦人及年輕創業者運用 AI 推動創新、提升生產力,並建立新一代愛爾蘭科技初創企業。

11月13日週四
  1. Google DeepMind66

    Google DeepMind 推出 SIMA 2:能在虛擬 3D 世界中遊玩、推理並與你一同學習的智能體

    Google DeepMind 推出研究智能體 SIMA 2,將 Gemini 推理能力整合至虛擬 3D 遊戲,使其能理解目標、規劃行動並與用户對話。它能將在不同遊戲中學到的概念遷移,也可透過試錯及 Gemini 回饋利用自身經驗繼續訓練,並在 Genie 3 生成的新世界中嘗試執行任務。

    推薦理由:SIMA 2 結合 Gemini 推理、跨遊戲技能遷移與自生成經驗訓練,並交代長程任務、記憶和精細鍵盤滑鼠操作的限制。

  2. Hugging Face Blog58

    Hugging Face 宣佈與 Google Cloud 深化合作,協助企業建置開放模型 AI

    Hugging Face 與 Google Cloud 宣佈深化策略合作,協助企業以開放模型建置及客製化 AI。Google Cloud 客户對 Hugging Face 的使用量在過去 3 年增長 10x,目前每月涉及數十 PB 模型下載及數十億次請求;雙方正建置 CDN Gateway,將模型和資料集快取至 Google Cloud,以縮短下載時間並加強模型供應鏈穩健性。

11月12日週三
  1. OpenAI News65

    OpenAI 抗拒《紐約時報》要求提供 20 million 則私人 ChatGPT 對話

    OpenAI 正抗拒《紐約時報》要求提供 20 million 則私人 ChatGPT 對話。OpenAI 同時加快推出新的安全與私隱保護措施,以保護用户數據。

    推薦理由:這則聲明同時交代《紐約時報》索取私人 ChatGPT 對話的要求,以及 OpenAI 加快推出安全及私隱保護措施,呈現爭議涉及的用户資料保護面向。

  2. OpenAI News67

    GPT-5.1:更聰明、對話感更強的 ChatGPT

    OpenAI 正在升級 GPT-5 系列,以更温暖、能力更強的模型和新增的 ChatGPT 語氣、風格自訂方式推出 GPT-5.1。GPT-5.1 今天開始向付費用户逐步推出。

    推薦理由:GPT-5.1 更新同時涵蓋模型能力與 ChatGPT 語氣、風格自訂,並交代先向付費用户推出,便於把握其功能變化和開放範圍。

11月10日週一