跳到正文

全部動態

今日 7 條
2月27日週五
  1. Google DeepMind76

    Google DeepMind 發佈 Nano Banana 2(Gemini 3.1 Flash Image),融合 Pro 能力與 Flash 速度

    Google DeepMind 發佈圖像生成模型 Nano Banana 2(Gemini 3.1 Flash Image),以 Flash 速度帶來 Nano Banana Pro 的世界知識、品質與推理能力。

    推薦理由:Nano Banana 2 將 Nano Banana Pro 的世界知識、視覺品質與創作控制帶到 Flash 速度,並交代其在 Google 產品中的推出範圍及 Nano Banana Pro 的保留使用方式,説明兩款模型面向的工作流程差異。

2月26日週四
2月25日週三
2月24日週二
2月23日週一
2月20日週五
  1. Hugging Face Blog76

    GGML 團隊加入 Hugging Face,支持 llama.cpp 及 Local AI 長期發展

    GGML 團隊加入 Hugging Face,並將持續維護 llama.cpp;Hugging Face 會為項目提供長期資源支持。團隊仍將 100% 時間用於維護,並對技術方向及社羣保有完全自主權與領導權;項目會繼續 100% 開源並由社羣推動。雙方計劃讓 transformers library 的模型定義更順暢地用於 llama.cpp,並改善 ggml 軟件封裝及本地模型部署體驗。

    推薦理由:文章交代 GGML 團隊加入後 llama.cpp 的維護自主權與資源支持,也列出連接 transformers library 模型定義及改善本地部署體驗的方向。

  2. Google DeepMind77

    Gemini 3.1 Pro:面向最複雜任務的更智能模型

    Google DeepMind 發佈 Gemini 3.1 Pro,作為 Gemini 3 系列核心模型升級,提升複雜問題的推理能力。它在 ARC-AGI-2 取得經驗證的 77.1% 得分,推理表現超過 Gemini 3 Pro 兩倍。

    推薦理由:Gemini 3.1 Pro 在 ARC-AGI-2 取得經驗證的 77.1% 得分,並稱推理表現超過 Gemini 3 Pro 兩倍,為核心推理升級提供量化比較依據。

2月19日週四
  1. Google DeepMind75

    Google DeepMind 推出 Lyria 3 音樂生成模型,於 Gemini app 開放 beta 使用

    Google DeepMind 在 Gemini app beta 推出 Lyria 3 音樂生成模型,使用者可用文字提示或上傳照片、影片生成 30 秒音軌。系統會按提示生成歌詞,並可調整風格、人聲和節奏;音軌嵌入 SynthID,Gemini 的核驗功能亦延伸至音訊,使用者可上傳檔案詢問其是否由 Google AI 生成。

    推薦理由:Lyria 3 在 Gemini app 開放以文字、圖片或影片生成音樂,並納入 SynthID 與音訊核驗,呈現創作功能和 AI 內容識別並行的設計。

2月18日週三
2月17日週二
  1. Google DeepMind65

    Google DeepMind 與印度政府及當地機構合作,推進 AI 科學與教育應用

    Google DeepMind 宣佈與印度政府部門及當地機構建立新合作,擴大 AI 在科學與教育領域的應用。合作將向印度研究人員提供 AlphaGenome、AI Co-scientist 和 Earth AI,並推出 $30 million Google.org Impact Challenge: AI for Science。

    推薦理由:文章列出研究機構合作、AI 科學挑戰賽及教材互動化安排,呈現 Google DeepMind 在印度推進科學與教育應用的具體路徑。

2月13日週五
2月12日週四
  1. OpenAI News67

    OpenAI 發佈 GPT-5.3-Codex-Spark 即時編碼模型

    OpenAI 發佈 GPT-5.3-Codex-Spark,並稱其為首個即時編碼模型,生成速度快 15x,具備 128k 上下文窗口。目前以研究預覽形式向 ChatGPT Pro 用户提供。

    推薦理由:公告列出生成速度、上下文窗口及研究預覽的適用對象,讓讀者可同時瞭解 GPT-5.3-Codex-Spark 的性能宣稱與目前開放範圍。

2月11日週三
  1. Google Research49

    超越一對一:以 DialogLab 編寫、模擬及測試動態人類與 AI 羣體對話

    Google Research 提出開源原型框架 DialogLab,用於編寫、模擬及測試動態人類與 AI 羣體對話。框架採用「編寫、測試、驗證」流程,並以視覺化介面及驗證儀錶板協助設計與分析對話。14 名參與者的評估顯示,人類控制模式顯著更具投入感,並普遍被認為更有效、寫實。

2月9日週一
2月6日週五
2月5日週四
2月4日週三
  1. Hugging Face Blog65

    Hugging Face Hub 推出 Community Evals,開放社羣提交模型評測結果

    Hugging Face Hub 推出 Community Evals,讓 benchmark 資料集託管排行榜,並在模型卡片展示評測分數。使用者可透過 PR 為任意模型提交結果,結果會標示為「community」,且可附上論文、Model Card 或評測日誌等來源。資料集可用 eval.yaml 定義評測規格,供他人重現;這項功能目前處於 beta。

    推薦理由:Hugging Face 將評測規格、模型分數與社羣提交納入 Hub 的可追溯流程,Hub 的 Git 歷史記錄新增及修改時間,方便聚合比較不同來源的模型成績。

  2. Google Research59

    Google Research 與 Included Health 宣佈將開展全美對話式 AI 虛擬醫療隨機研究

    Google Research 與 Included Health 宣佈,待機構審查委員會(IRB)批准後,將在全美開展前瞻性、經參與者同意的隨機研究,評估對話式 AI 在真實虛擬醫療流程中的表現。研究將把 AI 管理患者互動的能力與限制,和標準臨牀實踐比較,從模擬研究及單中心可行性測試推進至全國規模的真實臨牀評估。

2月3日週二