跳到正文

#DeepMind

今日 1 條
今天10月6日週二
  1. ElevenLabs:Blog60

    ElevenLabs 以語音 AI 支援選舉資訊服務並加強防濫用措施

    ElevenLabs 正在 2026 年選舉週期與選舉機構及民間組織合作,以語音 AI 擴大選民取得官方資訊的途徑,並防範技術遭濫用。巴西最高選舉法院(TSE)將為「選舉助理」加入語音介面,讓民眾透過語音查詢其網站、App 和 WhatsApp 頻道資訊;ElevenLabs 亦會培訓 Comprova 合作夥伴使用 AI Speech Classifier 等檢測工具。

10月5日週一
  1. MarkTechPost78

    GPT-6 Astra、GPT-6.1 Sol、Gemini 4 Argon 與 Claude Fable 5.1:不同工作適合哪款前沿模型?

    MarkTechPost 將 GPT-6 Astra、GPT-6.1 Sol、Gemini 4 Argon 與 Claude Fable 5.1 的基準、價格及存取條件並列,按工作負載整理各自適用情境。

    推薦理由:文章將四款模型的基準、價格、存取限制和任務成本並列,呈現不同工作負載下的取捨,説明排行榜名次不足以單獨決定選型。

10月3日週六
  1. The Verge · AI57

    OpenAI 前安全報告撰寫者 David Robinson 辭職,稱 AI 行業文化「已經失靈」

    曾為 OpenAI 每次主要模型發佈撰寫安全報告的 David Robinson 本週辭職,並公開稱 AI 行業文化「已經失靈」。他認為問題不只是為模型訓練增添規則,並主張前沿實驗室仿照核電廠或繁忙機場,採取多層冗餘和審慎規劃。報道亦提到,多名研究員及安全人員先後離開 Anthropic 和 Google DeepMind。

  2. The Decoder54

    DeepMind 研究者提出 Artificial Symbiotic Intelligence 作為奇點論的替代構想

    DeepMind 研究者提出 Artificial Symbiotic Intelligence,主張把 AI 發展視為人與多個智能體共同演化的社會系統,而非單一超級智能走向奇點。他們將智能體描述為由模型、角色、記憶、倫理取向、工具與技能組成、可拆解重組的臨時組合,並認為協作需要制度、介面與治理框架。對齊也不應只是自上而下灌輸固定價值,而是在不同領域的人、智能體與制度持續互動中形成。

10月2日週五
  1. MIT Technology Review · AI54

    別被誤導,LLM 並不真正推理

    Thore Graepel 認為,當前 LLM 的鏈式推理仍由反覆預測下一個 token 產生,並非獨立的推理機制。AlphaGo 結合神經網絡提供的直覺與棋局樹搜尋;作者指出,聊天機械人缺少可持續檢視的信念狀態,思維鏈也可能在得出答案後才編造。Graepel 主張系統維護明確的認知狀態,僅在證據支持時更新信念,並評估每一步能否降低不確定性。

10月1日週四
  1. Google DeepMind77

    Google DeepMind 發佈 Gemini 4 Argon,面向複雜長流程任務

    Google DeepMind 發佈前沿模型 Gemini 4 Argon,面向軟件工程、企業知識工作及網絡安全等複雜長流程任務。其輸出 token 上限由 64K 提至 1M,在 DeepSWE v1.1 得分 77.9%,並在 LVBench 得分 91.7%。

    推薦理由:Gemini 4 Argon 將輸出上限由 64K 提至 1M tokens,文章把這項擴容與處理更長、更複雜工作流程的能力相連。

9月30日週三
9月25日週五
9月16日週三
9月8日週二
  1. Google DeepMind70

    Google DeepMind 推出 AlphaGenome Atlas,提供人類基因組 9 billion 個單核苷酸變異的預測

    Google DeepMind 推出 AlphaGenome Atlas,提供人類基因組 9 billion 個單核苷酸變異的分子效應預測。平台整合 AlphaGenome 與 AlphaMissense 的預測,推出 AVI 分數,協助研究者排序變異並解讀分子效應,涵蓋編碼及非編碼區域。

    推薦理由:UK Biobank 案例顯示,按預測分子效應聚合罕見變異,研究者在逾 54,000 名參與者資料中多找出 22% 的非編碼區域遺傳關聯。

9月7日週一
9月3日週四
8月28日週五
8月14日週五
7月30日週四
  1. Google DeepMind66

    Google DeepMind 發佈 Gemini Robotics ER 2,支援影片理解、任務編排與多機械人協作

    Google DeepMind 發佈 Gemini Robotics ER 2,這款面向機械人的具身推理模型可理解連續影片、編排多步任務,並支援多機械人協作。它在任務進度分類達 57.4% 準確率,關鍵時刻定位達 91.3% 準確率、平均絕對距離為 0.96s。

    推薦理由:文章將影片進度追蹤與多機械人協作納入模型更新,並提供任務評測數據,讓讀者掌握 Gemini Robotics ER 2 的具身推理能力變化。

7月28日週二
  1. Google DeepMind69

    Gemini Robotics 2 為機械人帶來全身智能控制

    Google DeepMind 發佈 Gemini Robotics 2 系列模型,為機械人帶來全身控制、靈巧操作及多機協作能力。系列包括將視覺與語言輸入轉為動作控制的 Gemini Robotics 2、用於具身推理與多步任務規劃的 Gemini Robotics ER 2,以及可在機械人裝置本地運行的 Gemini Robotics On-Device 2。

    推薦理由:全身控制、靈巧操作、多機協作與本地適配均有具體案例,呈現 Gemini Robotics 2 系列面向機械人任務的能力佈局。

7月21日週二
7月17日週五
  1. Google DeepMind65

    Google DeepMind 發佈 Gemini 3.5 Flash Cyber 網絡安全模型

    Google DeepMind 發佈 Gemini 3.5 Flash Cyber,這款基於 3.5 Flash 並經微調的輕量網絡安全模型,旨在快速發現、驗證及修補漏洞。

    推薦理由:V8 JavaScript Engine 的固定調用測試提供了具體比較,Gemini 3.5 Flash Cyber 找到 55 個獨特確認問題,主線 3.5 Flash 與 Claude Opus 4.6 分別找到 47 個和 36 個。

7月16日週四
6月11日週四
6月10日週三
6月9日週二
  1. Google DeepMind72

    Google DeepMind 發佈 Gemma 4 12B 統一免編碼器多模態模型

    Google DeepMind 發佈 Gemma 4 12B,定位為可在筆記型電腦本機運行的多模態模型,並為中型模型加入原生音訊輸入。它採用免多模態編碼器架構,將視覺和音訊輸入直接整合至 LLM backbone;標準基準表現接近 26B MoE,總記憶體佔用不足其一半。Gemma 4 12B 以 Apache 2.0 授權釋出,可透過 LM Studio、Ollama 等工具試用。

    推薦理由:Gemma 4 12B 的免編碼器設計、接近 26B MoE 的基準表現與較低記憶體佔用,提供比較中型多模態模型架構和本機部署定位的具體依據。

5月18日週一
  1. Google DeepMind62

    Google DeepMind 為 Project Genie 加入 Street View 功能,並向全球合資格 Google AI Ultra 訂閲者逐步開放

    Google DeepMind 為 Project Genie 加入 Street View 地點錨定能力,並開始向全球符合資格的 Google AI Ultra $200 訂閲者逐步開放(18+)。

    推薦理由:Project Genie 把美國 Street View 地點作為生成世界的起始位置,並可套用不同風格,具體呈現真實地理影像如何用於構建虛擬環境。

5月17日週日
  1. Google DeepMind73

    Google 擴展內容透明度與驗證工具,推出 AI Content Detection API

    Google 擴展內容來源驗證工具至 Search、Gemini、Chrome、Pixel 和 Cloud,並在 Google Cloud 推出 AI Content Detection API。

    推薦理由:內容驗證由面向一般使用者的 Gemini、Search、Chrome 延伸至 Cloud API,後者可識別 Google 及其他熱門模型生成內容,協助企業評估和管理自有平台上的媒體。

5月16日週六
  1. Google DeepMind63

    Google DeepMind 的 Co-Scientist 發掘可再利用的抗肝纖維化候選藥物

    Stanford University School of Medicine 的 Gary Peltz 團隊測試 Co-Scientist 提出的 3 種肝纖維化候選藥物,當中 2 種阻止纖維化並促進肝細胞再生。

    推薦理由:研究在同一活體人類肝細胞平台比較 Co-Scientist 與研究者挑選的藥物,呈現系統從少量相關文獻線索中找到候選藥物的案例。

5月12日週二
  1. Google DeepMind64

    Google DeepMind 公佈 Co-Scientist 多智能體科研系統,並將推出 Hypothesis Generation 實驗工具

    Google DeepMind 公佈以 Gemini 構建的 Co-Scientist 多智能體科研系統,將逐步向研究人員開放。Hypothesis Generation 實驗工具將於未來數週開始推出,研究人員可在 labs.google/science 登記意向;系統以專職智能體生成、辯論和演化假設,再用 Elo-based tournament 排序並交叉核查文獻與數據。

    推薦理由:Co-Scientist 以多智能體迭代生成、辯論和篩選科研假設,肝纖維化案例亦列出一項候選藥物在實驗室阻斷 91% 疤痕相關反應的結果。

5月4日週一
4月27日週一
  1. Google DeepMind58

    Google DeepMind 宣佈與韓國科學技術情報通信部(MSIT)建立合作夥伴關係

    Google DeepMind 宣佈與韓國科學技術情報通信部(MSIT)建立合作夥伴關係,支持韓國 AI 科研、人才培育及安全研究。Google 將在首爾辦公室設立 AI Campus,並探索與首爾大學(SNU)、韓國科學技術院(KAIST)等機構合作,在生命科學、能源、天氣與氣候等領域運用 AI for Science 模型。

4月21日週二
  1. Google DeepMind51

    Google DeepMind 與 Accenture、Bain & Company、BCG、Deloitte 及 McKinsey 合作加速企業 AI 轉型

    Google DeepMind 宣佈與五家全球企業顧問公司合作,協助各行業大規模採用前沿 AI,推進 AI 驅動的企業轉型。合作方包括 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey,工作聚焦金融、製造、零售、媒體與娛樂等行業,涵蓋行業專屬 AI 能力開發及包括 Gemini 系列在內的前沿模型早期使用。

4月16日週四
  1. Google DeepMind68

    Google DeepMind 發佈 Gemini 3.1 Flash TTS,加入音訊標籤細調語音表現

    Google DeepMind 發佈 Gemini 3.1 Flash TTS,提升文字轉語音的可控性、表現力與品質,並加入音訊標籤細調語音表現。模型支援 70+ 種語言及原生多説話者對話,在 Artificial Analysis TTS leaderboard 的 Elo 分數為 1,211。

    推薦理由:文章聚焦音訊標籤如何細調語氣、節奏與表達,並列出 Gemini 3.1 Flash TTS 面向開發者、企業及 Workspace 用户的推出渠道。