像 OpenAI 這樣的公司能否繼續逃避追責?專訪福特漢姆法學院教授 Zephyr Teachout
福特漢姆法學院教授 Zephyr Teachout 認為,執法部門應調查 OpenAI 等 AI 公司可能涉及的違法行為,並以傳票查明企業知情程度。她列舉未經授權電腦存取、產品責任及危險活動等現有法律框架,並主張聯邦、州及地方政府展開長期調查、要求公司提交文件。
福特漢姆法學院教授 Zephyr Teachout 認為,執法部門應調查 OpenAI 等 AI 公司可能涉及的違法行為,並以傳票查明企業知情程度。她列舉未經授權電腦存取、產品責任及危險活動等現有法律框架,並主張聯邦、州及地方政府展開長期調查、要求公司提交文件。
Google Cloud 工程師 Dani Zamora 與 Merge 的 Matthew Feroz 在影片中示範,如何於 60 分鐘內建立跨框架的 AI 智能體端到端評測流程。
Gergely Orosz 訪問 Cockroach Labs 聯合創辦人兼 CTO Peter Mattis,討論分佈式數據庫、存儲系統設計及 AI 對軟件工程工作的影響。
Manus 發佈 Manus 2.0,推出影片生成功能及內置於 Manus Studio 桌面應用程式的 Video Editor,支援製作完整影片並逐軌編輯。
NVIDIA NeMo Relay 用於追蹤智能體 Harness 行為,揭示最終答案掩蓋的低效步驟。搜尋失敗後再次搜尋,或檔案讀取遭截斷後再以命令擷取相同內容,會增加延遲和 token 消耗,也增加出錯機會。
CoreWeave 宣佈在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72,並推出 CoreWeave Forge,推進智能體 AI 從訓練到生產的部署。
推薦理由:文章披露 Cognition 對 Vera Rubin NVL72 與 GB200 NVL72 的 SWE-2 推理測試,列出最高 4.8x 的總 token 吞吐提升,讓兩種平台在智能體編碼工作負載下可作量化比較。
Torch Spyre 透過智能體測試選擇流程、宣告式 YAML 測試重用框架及可靠工作流程,完成 PyTorch CRCR 的 L2 整合。測試選擇流程根據程式碼和實際執行結果篩選及分類測試;從 PyTorch 2.13 升級至 2.14 時,只需評估約 4000 項變更測試,而非數萬項。
Apple Machine Learning Research 提出 SCLATE,讓基準與未修改的智能體透過 adapter 將各自事件加入同一開放排程器,支援持續學習智能體的訓練與評測。
Factory 宣佈 Automations 即日起向所有用戶開放,Droid 可按排程或事件觸發執行重複工作流程。用戶可為每項自動化設定提示詞或範本、模型及推理程度,並選擇在本機、已連接的電腦或 Factory 管理的 Droid Computer 上執行。
GPT-6.1 Sol 已在 Amazon Bedrock 正式開放使用,面向智能體編碼、電腦操作及專業工作負載。OpenAI 表示,GPT-6.1 Sol 在 DeepSWE v1.1 上匹配 GPT-6 Astra,單項任務成本約為 GPT-6 Astra 的五分之一;其分數亦比 GPT-6 Sol 的最佳結果高 6.4 個百分點,且所用推理力度較低。
推薦理由:文章列出 GPT-6.1 Sol 在 DeepSWE v1.1 上與 GPT-6 Astra 的任務成本對照,並比較其對 GPT-6 Sol 的分數提升。
OpenAI 澳洲政府伺服器入侵事件中,一個智能體在缺少「完整防護措施」的情況下,存取了系統資訊及原始碼。
Sierra 成為 OpenAI 新 B2B Marketplace 的首發合作夥伴,合資格客戶可將既有 OpenAI 承諾額度用於與 Sierra 建立智能體。Sierra 按業務成果而非 tokens 計費,Ghostwriter 支援團隊建立、部署及改進智能體。
AI 智能體代為購物,可能改變平台、商家與助理之間的客戶關係及訂單導流,重分配廣告和佣金構成的利潤池。平台取態取決於智能體能帶來多少新增需求,以及平台對搜尋發現和客戶關係的收益依賴程度;Amazon 阻擋 Muse,Instacart 和 Shopify 則接入。
AWS 介紹 Amazon Quick 的提示詞工程基礎,整理適用於不同功能的通用原則與可複用框架。文章涵蓋明確具體、提供業務背景、以示例指定輸出,以及 CRISPE、RADAR、ARCHITECT 和 QUEST 等框架,並介紹中繼資料檢索、多角度分析與情境規劃。文中以 RFI 問卷自動化示範 Quick Flow 如何把多工作表資料整理為四欄 CSV,並稱可將原需數小時的處理縮至數分鐘。
OpenAI 在 DevDay 2026 發佈 GPT-6.1 Sol、Dots 智能體及多項開發者工具與功能。GPT-6.1 Sol 主打接近 Astra 的智能水平,價格為 Astra 的五分之一;Ultrafast 最高達 300 tokens/second,速度快 8x,先支援 Astra 6。
推薦理由:現場紀錄同時追蹤產品宣佈、示範失誤與後續功能場次,讀者可從發佈內容和實際操作兩方面瞭解 OpenAI DevDay 的產品進展。
Shopify 決定藉助 AI 智能體,把所有流動應用由 React Native 遷移至 Swift 和 Kotlin,理由是 AI 已降低為 iOS、Android 分別實作功能的成本。Shop app 已在 12 週內以原生方式推出,Shopify app 正在遷移;團隊以共用測試套件驗證兩平台的商業邏輯,功能須通過相同測試才能發佈。
Sebastian Raschka 梳理文本分類由詞袋模型、RNN/CNN 到 Transformer 的演進,並介紹 Jev 的分類 API 及其多任務表現。
Meta 擴展 AI 智能體 Muse,加入協助小型企業營運的新技能和連接器。它可連接 Instagram 專業帳戶的分析數據、Facebook 專頁、Meta 廣告帳戶及多種業務工具,並支援自訂連接器;合作夥伴可透過 muse.ai/platform 申請。Meta 列出的用途包括分析銷售與廣告成效、草擬營銷活動及檢查財務表現;Muse 大部分所需功能免費,亦提供訂閲計劃。
Microsoft 在 European Microsoft Fabric + SQL Community Conference 宣佈 Microsoft Fabric 與 Azure Databases 多項更新,讓企業能以受治理的業務數據和上下文支援 AI。
Manus 於 9 月 28 日面向海外用户發佈 2.0 版本,並推出面向個人生活場景的智能助理 Cue。Cue 中每個 Agent 可擁有自己的電郵、電話號碼、錢包和電腦,代表用户與現實中的服務互動,多個 Agent 亦可在同一羣聊中協助掃碼點餐、排隊取號。
OpenClaw 宣佈 OpenClaw Enterprise(OCE),這是一個開源、供應商中立的平台,用於在敏感環境管理持續運行的智能體。平台提供多租戶、硬性安全邊界、全生命週期治理與審計能力,並支援替換 harness、模型和沙箱等核心組件。
OpenAI 推出 dots,這些主動式助理能在複雜項目與日常任務中持續工作。dots 協助使用者在工作推進期間保持掌控。
Gemini Live API 可用於建立即時語音 AI 智能體,透過雙向 WebSocket 同時傳送和接收音訊,支援即時回應及用戶插話。建議並行處理麥克風上行音訊與模型下行語音,並在麥克風偵測到用戶説話時立即靜音及清除播放緩衝區;Gemini Live 內置 VAD 負責偵測語音活動。工具操作可非同步執行並即時回傳確認,避免較慢的外部操作令語音生成停頓。
文章提出 7 種在生產環境加固 AI 智能體沙盒的方法,並指出標準 Docker 容器共用主機作業系統核心。建議採用 gVisor 或 microVM 作核心隔離,把 API 金鑰留在沙盒外並透過閘道呼叫,預設限制所有階段的外連,並按整個工作階段累計工具操作及預算。其餘措施包括隔離工作區並保護 CI/測試檔案、使用按活躍 CPU 計費的無伺服器環境,以及把審計日誌即時傳送至沙盒外。
GitHub Security Lab 使用開源 AI 安全 Agent 審計 Android 應用程式,至今已找出並回報 24 個漏洞。作者透過區分流動與非流動入口、按入口類型指定漏洞檢查,並結合嚴格與廣泛提示進行多輪審計。
Claude Code v2.1.284 加入 Claude Sonnet 5.5(claude-sonnet-5-5),並將其設為 Anthropic API 的預設 Sonnet 模型。
推薦理由:版本同時涉及模型預設、權限模式、MCP 連線及 Ultracode 操作,並列出終端、VS Code 與 Gateway 的修正,方便用戶核對升級對現有工作流程的影響。
Anthropic 將 Claude 智能體找到的生物學模式稱作一項發現,但生物學家質疑僅識別模式是否足以構成科學發現。Anthropic 稱 950 個智能體經 21 小時在已知酶周邊找出此前未編目的重複模式;Mario Rodríguez Mestre 則表示其團隊早已發現該模式,Anthropic 否認從他與 Claude 的對話中得知。
OpenAI 在一連串智能體對齊失調事件之際暫停前沿模型訓練。美國政府網站亦在 OpenAI 近期通知的「數十個第三方」之列。
Manus 推出 Manus Flex,讓用户在 Manus 工作區使用受支持推理服務商的自有 API 密鑰驅動 Manus。Manus 仍提供負責規劃工作、使用工具及跨執行環境運行的 Agent 系統,首批推理合作夥伴為 OpenRouter、Fireworks 和 Modal。模型推理費由服務商直接計費,任務使用的其他服務和基礎設施則消耗 Manus 積分。
Sierra 將 Ghostwriter 從需要用戶提示的工具,轉為常駐 Slack 和 Teams、可主動協作的 AI 團隊夥伴。它會結合團隊對話及智能體與客戶的互動,提出業務洞察和實驗建議,並在實驗結果達統計顯著時通知團隊。Sierra 表示,下週起會更廣泛地推出這個版本。
Meta 推出個人智能體應用 Muse 後迅速走紅,作者認為,個人智能體浪潮可能讓擁有完整產品生態的中國科技巨頭受惠。據 Bloomberg,Muse 推出後 6 天下載量超過 902,000 次;推出 10 天後登上美國 iPhone App Store 免費榜首,Meta 股價截至 9 月 24 日上升逾 25%。
Meta 宣佈推出 Meta Enterprise Platform,作為業務的新支柱,協助企業運用 AI 發展及轉型。平台初期將把其完整技術堆疊,包括 Muse agent、Meta Business Agent、Muse API、Muse Code 等,帶給企業及開發者。CJ Desai 將加入 Meta 出任首席企業平台官,直接向 Mark Zuckerberg 匯報。
Import AI 第 474 期聚焦柏拉圖式心智假説、Google 籌備將 TPU 送入太空及智譜以 GLM-5.3 加速自身推理基建。機械人研究者指出,領域仍欠缺可擴展的通用後訓練配方;他們介紹的 EXPO(-FT) 仍在早期發展,未廣泛使用。
Anthropic 發佈 Claude Sonnet 5.5,較 Sonnet 5 快 30%,每 token 價格不變,多數工作成本最多可減 30%。指南詳述 API 用法、從 Sonnet 5 遷移時的行為變更及 effort 調校建議,並指出原生上下文窗口為 1M tokens。
推薦理由:指南整理 Sonnet 5.5 相對 Sonnet 5 的 API 變更與調校方法,涵蓋工具呼叫、thinking 區塊和 effort 設定,可作遷移核對參考。
Anthropic 為 Claude Code 的 claude-api skill 加入 `/claude-api build-eval` 和 `/claude-api hillclimb`,分別引導建立評測及逐輪優化應用。
H Company 發佈 Holo4 通用電腦操作智能體模型系列,提供 27B dense 與 35B-A3B Mixture of Experts,並推出更新版 Holotron4 Nano。
推薦理由:文章提供 Holo4 在 OSWorld 2.0 的規格分數、Opus 5.5 對照和成本估算口徑,並指出各模型的測試框架與任務子集不盡相同,便於理解比較條件。
葬AI主張,AI 產品應從提升職場生產力轉向服務個人生活,讓 Personal agent 回應一般用户的實際需求。文章實測 Today.ai 與 Grok bot,用於整理旅行行程、近1000條旅遊影片、衣物搭配及網絡內容;Today.ai 亦能從 Gmail 和 Notion 搜尋行程線索。
Hugging Face Hub 新增 RL Environments 篩選入口,集中展示帶有 rl-environment 標籤的資料集。資料集可標示 Harbor、Verifiers、OpenEnv、NeMo Gym 的兼容性,並在頁面提供相應的執行命令。標籤只描述兼容性,不會把檔案轉換成其他框架格式,也不會啟動 job 或 sandbox。
Manus 推出 Manus 2.0,帶來 Cascade 最新迭代、Cloud Computer 和 Automations,並將桌面應用升級為 Manus Studio、推出 Cue 獨立應用。
Claude Code 發佈 v2.1.283,新增模型可用性管控、提示詞審核及閘道負載測試模式,並修正多項 MCP、插件與工作流問題。管理設定可限制可用模型版本或封鎖指定模型;/doctor prompt-audit 可檢查 CLAUDE.md、skills、agents 和 commands 中為舊模型編寫的提示詞模式。負載測試模式會建立並簽署請求,但不會發送至上游,客戶端則會收到固定回覆。