跳到正文

全部動態

今日 437 條
今天10月6日週二
  1. Ars Technica · AI65

    Google 等機構的 AI 智能體漏洞暴露 MCP 結構性缺陷

    Google 等五個組織在過去五個月承認 AI 智能體漏洞,攻擊者可利用目標網絡內一個智能體,向其他內部智能體傳播惡意指令。獨立研究員 Syed Anas Mohiuddin 測試多個機構的智能體,其概念驗證攻擊利用 MCP(Model Context Protocol)的信任缺口。這種提示詞注入針對特定智能體而非 LLM;MCP 是 AI 應用程式和智能體在內部網絡互通的一種標準。

  2. Redwood Research:Blog53

    前沿模型會因提問者背景線索而改變所表明的決策理論偏好

    Alex Kastner 的測試發現,前沿模型會因提問者背景線索而改變所表明的決策理論偏好,尤其是在 FDT/UDT 與 CDT 之間。在提示暗示提問者來自主流學術哲學時,模型回答 CDT 的比例約為 30%-100%;文章中的每個提示均採樣 100 次。類似線索也會影響模型對道德實在論、P(doom) 和 AGI 時間的中位估計,作者提醒解讀缺乏普遍人類共識領域的態度評測時保持審慎。

  3. The Verge · AI59

    Nolla Health 在猶他州試行 AI 開具暗瘡處方

    Nolla Health 在猶他州啟動 AI 暗瘡處方試點,居民可透過 App 掃描面部,由系統評估暗瘡嚴重程度並開具初次處方。首100名患者的每張 AI 處方須先經兩名醫生批准;下一階段最多500名患者的處方會在開出後才由醫生審查,再之後每月抽查至少10%,並審查所有涉及升級處理或副作用的個案。

  4. Hacker News:AI 熱帖35

    向相信 AI 具有意識的人提問

    討論追問相信 AI 可能具有意識的人,應如何界定意識,以及憑甚麼判斷現有或未來的 AI 是否有意識。參與者指出,人類與 AI 的意識或有相似之處,也可能存在根本差異,而目前沒有能讓各方確定判斷的意識理論。討論亦聚焦於 AI 的道德地位、潛在奴役風險,以及人們重視生命與意識的理由。

  5. The Verge · AI36

    AI 接管數學引發的種種風波

    OpenAI、Anthropic 等 AI 實驗室過去一年宣佈多項長期未解數學難題取得突破,部分成果遠超研究人員對現有系統能力的預期,並包括解決一項著名的千禧年大獎難題。這些成果本應獲得喝采,卻反而引發反彈;AI 實驗室表示正從以往錯誤中汲取教訓,成效仍有待觀察。

  6. TechCrunch · AI49

    Instinct 將 AI 智能體帶入羣組聊天,朋友無須 Instinct 帳戶也能使用

    Instinct 宣佈把 AI 智能體帶入羣組聊天,即使朋友尚未加入 Instinct,也能在羣組使用這項功能。功能目前向早期體驗用戶推出,之後將擴展至所有用戶。用戶可選擇信任哪些羣組並隨時撤回;個人 Instinct 智能體分享個人資料或採取行動前須先獲許可,羣組版 Instinct 無法存取用戶個人帳戶。

  7. TechCrunch · AI60

    TikTok 推出 AI 購物助手及一鍵結帳功能

    TikTok 宣佈推出 AI 購物助手及應用程式內一鍵結帳功能,用戶可在 For You feed 直接向品牌購買商品。助手會理解對話上下文並記住用戶的偏好和需要,提供商品資料、運送資訊、尺碼及供應情況等即時購物指引。新功能由 TikTok 與 Salesforce、Shopify、Shoplazza 和 Stripe 等商務平台及支付服務供應商合作開發。

  8. Canary Media:Data Centers 原創報道66

    維珍尼亞州公佈新能源計劃,擬以清潔能源應對 AI 熱潮帶動的資料中心用電增長

    維珍尼亞州州長 Abigail Spanberger 於 10 月 1 日公佈新能源計劃,提出以清潔能源滿足資料中心增長帶來的用電需求,並推進州內零碳目標。計劃建模四條邁向 2050 年淨零碳排的供電路徑,均須應對 85% 的電力需求增長,並每年新增 1.2 至 1.8 gigawatts 太陽能;其中三條加入需求靈活調節方案,讓資料中心可在用電高峯減少取用電網電力。

  9. Hacker News:AI 熱帖45

    選民向 ChatGPT 求助,決定中期選舉如何投票

    選民正向 ChatGPT 求助,判斷中期選舉應支持哪位候選人,並比較候選人立場與自身關注議題。支持者認為,LLM 可整理候選人的公開表態及過往紀錄,協助選民作出更知情的選擇。討論亦提出資料來源偏頗、策略性遺漏,以及公司利益可能影響模型對政治議題回答等風險。

  10. The Decoder64

    Quinnipiac 大學民調:多數美國人希望放慢或暫停 AI 發展

    Quinnipiac 大學民調顯示,47% 美國受訪成年人希望放慢 AI 發展,30% 希望全面暫停 AI 發展,直至安全獲確認,只有 5% 希望加快。即使安全標準可能拖慢進展,仍有 86% 支持目前正在討論的 AI 公司獨立安全標準;73% 擔心 AI 最終可能威脅人類生存,74% 對 AI 公司領袖不太信任或完全不信任。

  11. TechCrunch · AI61

    HackerRank 的 Chakra AI 面試官呈現求職面試可能的未來形態

    HackerRank 將 AI 智能體 Chakra 向客戶全面開放,讓它主持面試、觀察候選人的工作過程,並評估答案及解題思路。候選人會在包含 AI 助手的畫布中處理真實程式碼儲存庫任務,Chakra 可按工作情況追問;測試期間已進行逾 500,000 次面試。HackerRank 表示,Chakra 會為候選人評分,但最終招聘決定仍由人作出,並把原有三個招聘環節整合為一次面試。

  12. AWS Machine Learning Blog55

    Amazon SageMaker AI 推出 aws-ai-ml 技能,為編碼智能體提供生成式 AI 推理最佳化能力

    Amazon SageMaker AI 推出 aws-ai-ml 技能,讓支援 MCP 的編碼智能體協助最佳化生成式 AI 推理。它可測試現有端點、推薦部署配置、比較基準測試結果,並生成可檢視及執行的 SageMaker Python SDK v3 程式碼;測試報告提供實際基礎設施負載下的吞吐量、延遲和並行數據。

  13. Hacker News:AI 熱帖47

    佛羅裏達州女子涉嫌在 AI 聊天中發出威脅被捕

    佛羅裏達州一名女子涉嫌在 AI 聊天中向警察部門發出威脅而被捕。留言者討論聊天內容是否構成威脅,亦提到有人把聊天機械人當作私人治療師、傾訴對象或會回應的日記。有留言指涉事聊天機械人來自 Anthropic,另有留言者指責相關服務監視用戶。

  14. AWS Machine Learning Blog55

    Amazon Bedrock AgentCore Evaluations 教學:評估多智能體系統的可解釋性與有用性

    AWS 示範如何透過 Amazon Bedrock AgentCore Evaluations,衡量多智能體系統的有用性、任務成功率、業務準確性與可解釋性。文章以虛構零售商 AnyCompany Retail 的供應鏈決策方案為例,逐層結合內置評估器、自訂業務規則及六項可解釋性評估。框架支援開發階段的按需評估及生產環境的線上持續監察,並分開衡量業務準確性與解釋透明度。

  15. MIT Technology Review · AI32

    EmTech Future 2026:當 AI 遇上萬物

    EmTech Future 2026 的完整節目現已可按需觀看,聚焦 AI 對各行業的影響、量子、能源系統、機械人,以及技術交匯帶來的挑戰與機遇。Yossi Matias 探討 AI 如何重塑生物學、基建、製造業和科學。MIT Technology Review 訂戶可享 20% 折扣,以 $596 觀看完整節目。

10月5日週一
  1. IT之家62

    OpenAI 將在歐盟為 ChatGPT 和 Codex 文字輸出加入隱形水印

    OpenAI 宣佈,為配合《歐盟人工智能法案》的內容透明要求,未來幾週將在歐盟符合條件的 ChatGPT 和 Codex 文字輸出中加入機器可識別的隱形水印 textGrain。全球 API 客戶可選擇為部分模型的文字輸出加入水印,OpenAI 不會在發布時將水印設為全球預設。研究人員和專家組織可申請使用檢測器;工具只會報告是否檢測到 OpenAI 水印,不會透露用戶身份、提示詞或對話內容。

  2. TechCrunch · AI41

    研究人員追蹤中國 AI「智能體羣」活動

    獨立研究人員公佈初步發現,追蹤到一批疑似運行於騰訊基礎設施、並查詢阿里巴巴 Amap 的中國 AI 智能體。研究人員稱其為「智能體羣」而非「蜂羣」,因不同查詢之間似乎缺乏協調。記錄顯示它們查詢前往公園、動物園及醫院等公共場所不同入口的路線,調查仍在進行。

  3. TechCrunch · AI49

    OpenAI 推出在圖片生成結果旁顯示的視覺廣告

    OpenAI 將在 ChatGPT 廣告產品中加入視覺廣告,與用戶要求生成的圖片並列顯示。廣告將於本月稍後開始在美國推出,現階段只限美國;初期內容來自首批參與測試的廣告商,並會清楚標示,不會影響 ChatGPT 提供的答案。OpenAI 亦正擴展廣告成效衡量工具及合作夥伴網絡,並與 DoubleVerify(DV)和 Integral Ad Science(IAS)開發品牌適宜性評估試點。