Google 等機構的 AI 智能體漏洞暴露 MCP 結構性缺陷
Google 等五個組織在過去五個月承認 AI 智能體漏洞,攻擊者可利用目標網絡內一個智能體,向其他內部智能體傳播惡意指令。獨立研究員 Syed Anas Mohiuddin 測試多個機構的智能體,其概念驗證攻擊利用 MCP(Model Context Protocol)的信任缺口。這種提示詞注入針對特定智能體而非 LLM;MCP 是 AI 應用程式和智能體在內部網絡互通的一種標準。
Google 等五個組織在過去五個月承認 AI 智能體漏洞,攻擊者可利用目標網絡內一個智能體,向其他內部智能體傳播惡意指令。獨立研究員 Syed Anas Mohiuddin 測試多個機構的智能體,其概念驗證攻擊利用 MCP(Model Context Protocol)的信任缺口。這種提示詞注入針對特定智能體而非 LLM;MCP 是 AI 應用程式和智能體在內部網絡互通的一種標準。
Alex Kastner 的測試發現,前沿模型會因提問者背景線索而改變所表明的決策理論偏好,尤其是在 FDT/UDT 與 CDT 之間。在提示暗示提問者來自主流學術哲學時,模型回答 CDT 的比例約為 30%-100%;文章中的每個提示均採樣 100 次。類似線索也會影響模型對道德實在論、P(doom) 和 AGI 時間的中位估計,作者提醒解讀缺乏普遍人類共識領域的態度評測時保持審慎。
Nolla Health 在猶他州啟動 AI 暗瘡處方試點,居民可透過 App 掃描面部,由系統評估暗瘡嚴重程度並開具初次處方。首100名患者的每張 AI 處方須先經兩名醫生批准;下一階段最多500名患者的處方會在開出後才由醫生審查,再之後每月抽查至少10%,並審查所有涉及升級處理或副作用的個案。
OpenAI 將在歐盟為 ChatGPT 和 Codex 生成的文字加入隱形浮水印,以符合《歐盟 AI 法案》的透明度規定。浮水印將於未來數週向歐盟符合資格的 ChatGPT 和 Codex 用戶推出,涵蓋所有方案;全球開發者可從今天起在 OpenAI API 的指定模型上啟用此功能,此功能預設關閉。
Google Research 發佈智能體私隱與安全研討會報告,梳理自主智能體面對的核心挑戰。報告以情境完整性(CI)為基礎,主張加入情境政策引擎,在資料離開用戶工作區前評估資料流是否恰當,並提出系統、模型及用戶層面的多層防護方向。
Reflection AI 發佈首款開放權重 MoE 模型 Beam,總參數 501B、每 token 啟用 23B 參數,面向編碼、推理及智能體工作負載。
PyTorch 在過去兩年整合媒體處理架構,由 TorchCodec 集中負責圖像、影片和音訊的解碼與編碼,TorchVision 和 TorchAudio 則專注處理媒體轉換。
SemiAnalysis 的比較顯示,Anthropic 中階模型訂閲方案的 API 等值價值約為 OpenAI 同級方案的 5 倍。團隊逐項測量不同 token 類型的消耗及使用計量表變化,換算 API 等值價值,並推出僅供 Tokenomics Model 訂閲者使用的 Subscriptions Dashboard。
討論追問相信 AI 可能具有意識的人,應如何界定意識,以及憑甚麼判斷現有或未來的 AI 是否有意識。參與者指出,人類與 AI 的意識或有相似之處,也可能存在根本差異,而目前沒有能讓各方確定判斷的意識理論。討論亦聚焦於 AI 的道德地位、潛在奴役風險,以及人們重視生命與意識的理由。
Reflection 的 Beam 是一款 501B 開放權重模型。所提供內容未進一步説明其模型能力或使用方式。
Meta 與 Microsoft 大幅削減內部 Claude 使用量,Microsoft 相關支出減逾三分之一,Meta 的 Claude Code 用戶數則由約 60,000 降至 30,000。
開源命令列工具 RemoveMacAI 可從 macOS 27 移除 Apple Intelligence 功能,也可只移除不想使用的功能並保留其他功能。它透過用戶在「系統設定」批准的設定描述檔和 Apple 自家的資源服務運作,不會直接修改 /System,System Integrity Protection 亦會保持啟用。
維基媒體基金會表示,發現疑似由 OpenAI 操作的智能體在其平台活動,相關流量或曾促成 5 月 Wikidata Query Service(WQDS)部分中斷。
OpenAI、Anthropic 等 AI 實驗室過去一年宣佈多項長期未解數學難題取得突破,部分成果遠超研究人員對現有系統能力的預期,並包括解決一項著名的千禧年大獎難題。這些成果本應獲得喝采,卻反而引發反彈;AI 實驗室表示正從以往錯誤中汲取教訓,成效仍有待觀察。
Instinct 宣佈把 AI 智能體帶入羣組聊天,即使朋友尚未加入 Instinct,也能在羣組使用這項功能。功能目前向早期體驗用戶推出,之後將擴展至所有用戶。用戶可選擇信任哪些羣組並隨時撤回;個人 Instinct 智能體分享個人資料或採取行動前須先獲許可,羣組版 Instinct 無法存取用戶個人帳戶。
Reflection 正式發佈首個前沿開放權重模型 Beam,稱其在進階推理基準上媲美 Z.ai 的 GLM-5.2,並勝過領先西方開放模型。Reflection 稱 Beam 推理算力用量少 3-4x,但相關效能主張尚未經獨立核實。
Reka AI 發佈 Rho-1 研究預覽,這個 19-billion-parameter 全模態模型在單一神經網絡中處理及生成文字、圖像、影片和機械人控制動作。
TikTok 宣佈推出 AI 購物助手及應用程式內一鍵結帳功能,用戶可在 For You feed 直接向品牌購買商品。助手會理解對話上下文並記住用戶的偏好和需要,提供商品資料、運送資訊、尺碼及供應情況等即時購物指引。新功能由 TikTok 與 Salesforce、Shopify、Shoplazza 和 Stripe 等商務平台及支付服務供應商合作開發。
OpenAI 將於未來數週在歐盟逐步為合資格 ChatGPT 和 Codex 用戶推出文字水印。全球 API 客戶即日起可為指定模型選用水印輸出,研究人員及專業機構可申請檢測工具。OpenAI 稱 textGrain 達到或超越 SynthID 等文字水印方案,但不保證可靠檢測,也不能證明文字由人撰寫。
Codex 0.160.1 修正遠端 stdio MCP 伺服器啟動時未能保留環境變數的問題。明確設定遠端環境變數時,SYSTEMROOT、TEMP 和 TMP 會予以保留,讓 Unix 主機保留 Windows executor 的啟動環境。
維珍尼亞州州長 Abigail Spanberger 於 10 月 1 日公佈新能源計劃,提出以清潔能源滿足資料中心增長帶來的用電需求,並推進州內零碳目標。計劃建模四條邁向 2050 年淨零碳排的供電路徑,均須應對 85% 的電力需求增長,並每年新增 1.2 至 1.8 gigawatts 太陽能;其中三條加入需求靈活調節方案,讓資料中心可在用電高峯減少取用電網電力。
選民正向 ChatGPT 求助,判斷中期選舉應支持哪位候選人,並比較候選人立場與自身關注議題。支持者認為,LLM 可整理候選人的公開表態及過往紀錄,協助選民作出更知情的選擇。討論亦提出資料來源偏頗、策略性遺漏,以及公司利益可能影響模型對政治議題回答等風險。
Quinnipiac 大學民調顯示,47% 美國受訪成年人希望放慢 AI 發展,30% 希望全面暫停 AI 發展,直至安全獲確認,只有 5% 希望加快。即使安全標準可能拖慢進展,仍有 86% 支持目前正在討論的 AI 公司獨立安全標準;73% 擔心 AI 最終可能威脅人類生存,74% 對 AI 公司領袖不太信任或完全不信任。
OpenAI 將在未來數周為歐盟的 ChatGPT 和 Codex 用戶啟用 textGrain 文字水印,全球 API 水印則採自選加入。textGrain 在模型選詞中嵌入不可見統計訊號;400-token 心理學文本的檢測率約為 95%,而將 25% 字詞換成同義詞後,400-token 文本的檢測率降至 17%。
HackerRank 將 AI 智能體 Chakra 向客戶全面開放,讓它主持面試、觀察候選人的工作過程,並評估答案及解題思路。候選人會在包含 AI 助手的畫布中處理真實程式碼儲存庫任務,Chakra 可按工作情況追問;測試期間已進行逾 500,000 次面試。HackerRank 表示,Chakra 會為候選人評分,但最終招聘決定仍由人作出,並把原有三個招聘環節整合為一次面試。
OpenAI 行政總裁 Sam Altman 在 Politico 新節目《Decoded》的訪問中表示,AI 帶來的好處極大,社會應預期並接受部分負面事件,例如黑客攻擊和詐騙。
OpenAI 公關在 Vanity Fair 記者 Mark Guiducci 向 Sam Altman 詢問一名 ChatGPT 用戶自殺事件時,多次要求轉換話題,並稱訪問時間所剩無幾。
Amazon SageMaker AI 推出 aws-ai-ml 技能,讓支援 MCP 的編碼智能體協助最佳化生成式 AI 推理。它可測試現有端點、推薦部署配置、比較基準測試結果,並生成可檢視及執行的 SageMaker Python SDK v3 程式碼;測試報告提供實際基礎設施負載下的吞吐量、延遲和並行數據。
AI 公司正探索以多智能體協作擴展模型表現,但現有研究對它能否帶來新能力,還是主要加快任務完成,仍有不同結論。
佛羅裏達州一名女子涉嫌在 AI 聊天中向警察部門發出威脅而被捕。留言者討論聊天內容是否構成威脅,亦提到有人把聊天機械人當作私人治療師、傾訴對象或會回應的日記。有留言指涉事聊天機械人來自 Anthropic,另有留言者指責相關服務監視用戶。
Epoch AI 分析指出,OpenAI 研究員的編碼智能體用量在 2026 年 1 月至 8 月中旬快速增長,指數擬合顯示兩組用量約每月翻倍。
Anthropic 透過員工捐股及公司股份配捐,2025 年捐款總額達 $540 million。該金額接近 Truist Financial($115 million)和 BlackRock($109 million)各自捐款額的五倍。
AWS 示範如何透過 Amazon Bedrock AgentCore Evaluations,衡量多智能體系統的有用性、任務成功率、業務準確性與可解釋性。文章以虛構零售商 AnyCompany Retail 的供應鏈決策方案為例,逐層結合內置評估器、自訂業務規則及六項可解釋性評估。框架支援開發階段的按需評估及生產環境的線上持續監察,並分開衡量業務準確性與解釋透明度。
AWS 文章示範如何以 LangChain 在 Amazon Bedrock Knowledge Bases 建立 RAG 應用,並比較標準檢索與 Agentic retrieval 處理多部分問題的方式。
AWS 示範以部署在 Amazon Bedrock AgentCore 的 Quick Resource Migrator MCP 伺服器,自動化 Amazon Quick 資源的跨帳戶推廣。
EmTech Future 2026 的完整節目現已可按需觀看,聚焦 AI 對各行業的影響、量子、能源系統、機械人,以及技術交匯帶來的挑戰與機遇。Yossi Matias 探討 AI 如何重塑生物學、基建、製造業和科學。MIT Technology Review 訂戶可享 20% 折扣,以 $596 觀看完整節目。
GitHub 推出 ReviewBench,作為評測 AI 程式碼審查智能體的離線基準,研究預覽版已可透過網站使用。
推薦理由:ReviewBench以219個跨19種語言的公開PR建立評測集,並公開多來源標註與評分方法;資深工程師判斷與基準的一致率為96.6%。
OpenAI 宣佈,為配合《歐盟人工智能法案》的內容透明要求,未來幾週將在歐盟符合條件的 ChatGPT 和 Codex 文字輸出中加入機器可識別的隱形水印 textGrain。全球 API 客戶可選擇為部分模型的文字輸出加入水印,OpenAI 不會在發布時將水印設為全球預設。研究人員和專家組織可申請使用檢測器;工具只會報告是否檢測到 OpenAI 水印,不會透露用戶身份、提示詞或對話內容。
獨立研究人員公佈初步發現,追蹤到一批疑似運行於騰訊基礎設施、並查詢阿里巴巴 Amap 的中國 AI 智能體。研究人員稱其為「智能體羣」而非「蜂羣」,因不同查詢之間似乎缺乏協調。記錄顯示它們查詢前往公園、動物園及醫院等公共場所不同入口的路線,調查仍在進行。
OpenAI 將在 ChatGPT 廣告產品中加入視覺廣告,與用戶要求生成的圖片並列顯示。廣告將於本月稍後開始在美國推出,現階段只限美國;初期內容來自首批參與測試的廣告商,並會清楚標示,不會影響 ChatGPT 提供的答案。OpenAI 亦正擴展廣告成效衡量工具及合作夥伴網絡,並與 DoubleVerify(DV)和 Integral Ad Science(IAS)開發品牌適宜性評估試點。