OpenAI 的前沿治理框架
OpenAI 的前沿治理框架闡述其 AI 安全、資訊保安及風險實務如何與歐盟及加州新興法規接軌。
OpenAI 的前沿治理框架闡述其 AI 安全、資訊保安及風險實務如何與歐盟及加州新興法規接軌。
Google將新型密碼學聚合協定與可信執行環境(TEE)結合,為私隱分析建立零信任防護,確保Google只能取得匿名化的羣體彙總洞察。新協定讓裝置以單一訊息提交資料,免須在多輪互動期間持續在線;密碼學層確保個人原始資料不會在任何伺服器記憶體中暴露或重建。
Manus 的 Notion 連接器可讀取資料庫結構、跨工作區搜尋,並在授權範圍內寫入結構化資料和更新頁面,讓 Notion 工作區支援工作流程執行。文章示範用它建立趨勢資料庫與定時研究、交叉參照客户紀錄撰寫提案,以及製作銷售管道儀錶板。使用者可指定 Manus 存取的頁面和資料庫,並隨時撤銷權限;文章建議對外分享前審核 AI 生成內容。
Cisco 與 OpenAI 藉助 Codex 重塑企業工程,協助 Cisco 擴展 AI 原生開發、加快 AI Defense 工作,並自動化缺陷修復。
OpenAI、Thrive 與 Crete 使用 Codex 構建自我改進的税務智能體,實現申報自動化、提升準確度並加快工作流程。
OpenAI 將透過可靠資訊、網絡防禦與 AI 透明度等措施,支援 2026 年選舉。其支援範圍亦包括濫用防護及偏見監察。
Ethan Mollick 主張應有意識地選擇哪些認知工作交由 AI 處理,而非預設讓 AI 代做,避免削弱學習與思考所需的投入。土耳其高中數學實驗中,使用 ChatGPT 的學生作業表現較好,但測驗成績低於未使用 AI 的同學;台北高中五個月 Python 課程中,使用 AI 導師個人化題目序列的學生,在無 AI 協助的期末考高出 0.15 個標準差。
Hugging Face 梳理 AI 智能體常見術語,解釋 Model、Scaffolding、Harness、Agent 等概念及其區別。文中將 Harness 定義為調用模型、處理工具調用及決定何時停止的執行層,Scaffolding 則涵蓋系統提示詞、工具描述、回應解析和上下文管理等行為定義層。
推薦理由:文章以模型、Scaffolding、Harness 與 Agent 的分工建立實用心智模型,並把這套脈絡延伸至訓練術語,便於理解智能體系統的組成與相關討論。
OpenAI 與 Grupo Folha、Grupo UOL 宣佈建立戰略內容合作,將可信的巴西新聞內容帶入 ChatGPT。合作將擴大新聞資訊的可及性,並提供來源歸屬與透明度。
Benedict Evans認為,按職業逐項評分、量化 AI 影響程度,難以可靠預測 AI 對工作的實際影響。他以會計師人數在長期財務自動化下仍增加為例,指出自動化可能擴大工作需求,也會改變職務內容和職業分類。互聯網及 Uber 的例子則顯示,技術可改變企業商業模式和工作需求,這些影響未必能從職務描述預先推算。
Manus 推出 Shopify on Manus,讓用户透過對話建立店舖、管理商品目錄及營運營銷活動。Manus 建構店舖前端並透過 Shopify API 讀寫商品、價格、商品系列及折扣;Shopify 處理商品目錄、結帳和支付,兩邊變更保持同步。功能即日起向所有 Manus 付費等級開放,支援正式營運及開發店舖。
Mistral AI 宣佈已達成收購 Physics AI 公司 Emmi AI 的最終協議,以擴充工業工程領域的模型與專業能力。Emmi AI 的聯合創辦人及 30 多名研究人員和工程師將於 5 月加入 Mistral AI 的 Science 和 Applied AI 團隊。Mistral AI 表示,Emmi AI 的模型將補充其自有模型,並支持打造工程師智能體、推進即時模擬及數碼孿生。
推薦理由:收購將 Emmi AI 的 Physics AI 專長、工程模型及逾 30 名研究人員與工程師納入 Mistral AI,呈現其拓展工業工程能力的具體路徑。
Google 宣稱一組 AI 智能體花費 $916.92 建成作業系統,但作者認為公開資料不足以獨立核實。這次執行共使用 2.6B tokens;Google 所稱的單一提示詞長達數千行,但提示詞、程式碼及執行紀錄均未公開,人工介入與重試情況亦未交代。作者將此類長時程任務視為開放世界評測,認為其可補充基準評測,但需要新的方法規範。
Mistral 推出 Mistral Medium 3.5 公開預覽,並以此支援 Mistral Vibe 雲端遠端編碼代理及 Le Chat 的 Work mode。
推薦理由:材料展示模型、雲端編碼代理與 Le Chat 多步驟工具流程的連接方式,能看出長程任務如何落入具體產品工作流。
Mistral AI 在 Studio 推出 Connectors,內置連接器及自訂 MCP 現可透過 API/SDK 用於模型與 Agent 調用。開發者可直接調用工具、程式化建立和管理連接器,並在工具執行前加入人工確認流程。Connectors 目前於 Studio 開放 Public Preview,集中註冊的連接器亦可供 LeChat 和 AI Studio 使用,Vibe 即將推出。
推薦理由:連接器把 MCP 整合封裝成可跨對話、Agent 與工作流重用的項目,並以直接調用和人工確認保留工具執行控制。
Virgin Atlantic 使用 Codex,在固定的假日旅遊期限前交付改版流動應用程式。成果包括近乎全面的單元測試覆蓋率,以及零宗 P1 缺陷。
OpenAI 獲 Gartner 評為 2026 年企業級 AI 編碼智能體魔力象限的領導者。Codex 因創新及企業規模部署獲得認可。
Sayash Kapoor 主張,面對 AI 濫用風險,政府應優先投資社會韌性,而非依賴限制 AI 產品發佈等非常規幹預。文章指出,開放權重模型及前沿實驗室的廣泛 API 存取,令公開可用能力與前沿能力的差距最多隻有數月。作者建議透過 AI 輔助紅隊測試、漏洞懸賞、合成生物訂單篩查及危險材料追蹤,提升網絡與生物安全防護。
AdventHealth 正使用 ChatGPT for Healthcare 精簡工作流程、減輕行政負擔,讓醫護人員把更多時間投入患者照護。
Ramp 工程師使用 Codex 搭配 GPT-5.5 審查程式碼並交付改進,讓取得實質回饋的時間由數小時縮短至數分鐘。
OpenAI 推進 Education for Countries,透過新合作夥伴關係、教師培訓及工具,擴大學校採用 AI。相關工具旨在改善全球學習成效。
OpenAI 的一個模型解決了有 80 年歷史的單位距離問題,推翻離散幾何中的一項重要猜想。這項成果標誌著 AI 驅動數學的一個里程碑。
推薦理由:這項成果為 AI 驅動數學提供一個具體案例,呈現模型解決離散幾何 80 年單位距離問題並推翻重要猜想的結果。
OpenAI 啟動 OpenAI for Singapore 多年期 AI 合作計劃,旨在擴大 AI 部署、培育本地人才,並支援企業及公共服務採用 AI。
Google Research 開放 ERA 科學研究工具,並開始逐步開放由 ERA 與 AlphaEvolve 構建的 Computational Discovery。
推薦理由:文章把 ERA 的樹狀搜尋方法與多學科基準和實際科學問題並置,呈現其從程式碼優化延伸至預測研究的應用範圍。
OpenAI 透過 Content Credentials、SynthID 及驗證工具推進 AI 內容溯源,協助人們識別並信任 AI 生成媒體。這項工作旨在推動更安全、透明的 AI 生態系統。
Hugging Face 發佈六款基於 Ettin ModernBERT encoder 的 Sentence Transformers CrossEncoder reranker,參數規模由 17.6M 至 1.00B,並公開訓練數據及完整訓練方案。
推薦理由:文章以 MTEB(eng, v2) Retrieval、NanoBEIR 及多種硬件吞吐測試比較六種尺寸,呈現 Ettin Reranker 在排序品質與速度間的取捨。
Claude Platform 5 月 19 日推出 MCP tunnels 研究預覽,並為 Claude Managed Agents 提供自託管沙箱。MCP tunnels 可連接私有網絡中的 MCP 伺服器;進行中的工作階段可更新 MCP 伺服器及工具設定,自託管沙箱則提供 Anthropic 基礎設施以外的工具執行選項。
Manus 推出 Higgsfield MCP 連接器,讓專業內容創作者可在 Manus 工作流程中調用 Higgsfield 的圖片及影片生成能力,並將素材接續至編輯、網站呈現和團隊審核。
PaddleOCR 3.5 為支援的 OCR 與文件解析模型加入 Transformers 推理後端,開發者可透過 `engine` 參數選擇。`engine_config` 可設定 dtype、裝置配置及 attention implementation;若優先考慮 OCR 或文件解析吞吐量,文章通常建議使用預設的 paddle_static 後端。
Import AI 第 457 期整理 fast16 對高精度計算工具的篡改、Muon optimizer 的神經元死亡問題、正向對齊及 AI 自動化研究等內容。
OpenAI 與 Dell 合作,將 Codex 帶進混合式及本地部署企業環境。合作協助企業跨數據與工作流程安全部署 AI 編碼智能體。
Google DeepMind 為 Project Genie 加入 Street View 地點錨定能力,並開始向全球符合資格的 Google AI Ultra $200 訂閲者逐步開放(18+)。
推薦理由:Project Genie 把美國 Street View 地點作為生成世界的起始位置,並可套用不同風格,具體呈現真實地理影像如何用於構建虛擬環境。
Google DeepMind 推出 Gemini Omni 系列首個模型 Gemini Omni Flash,可結合圖像、影片、文字及語音參考生成影片,並支援透過對話編輯。
推薦理由:材料把 Gemini Omni Flash 的多模態輸入、對話式影片編輯和分階段上線平台放在一起,便於理解新模型如何連接生成能力與實際使用入口。
Manus 定時任務 2.0 擴展週期性工作的執行場景,支援沿用同一任務上下文、項目設定,或在 Manus 建構的網頁應用中定時運行。用户可選擇每次運行留在同一任務或建立獨立任務,並透過側邊欄、日程及日曆視圖查看排程和運行結果。該功能目前已向所有用户開放。
Google DeepMind 推出 Gemini for Science,涵蓋 Google Labs 三項科學研究實驗及 Google Antigravity 的 Science Skills。
推薦理由:三項實驗工具分別對應假設生成、計算探索與文獻整理,呈現 Gemini for Science 將 AI 智能體引入科研流程不同環節的設計。
Google 擴展內容來源驗證工具至 Search、Gemini、Chrome、Pixel 和 Cloud,並在 Google Cloud 推出 AI Content Detection API。
推薦理由:內容驗證由面向一般使用者的 Gemini、Search、Chrome 延伸至 Cloud API,後者可識別 Google 及其他熱門模型生成內容,協助企業評估和管理自有平台上的媒體。
Sebastian Raschka 梳理 Gemma 4、Laguna XS.2、ZAYA1-8B 和 DeepSeek V4 的架構改動,聚焦降低長上下文處理成本的設計。
Google DeepMind宣佈在新加坡推出多項AI合作計劃,並參與Google與新加坡政府的全國AI夥伴關係。計劃涵蓋醫療與生命科學、科研、教育及可持續發展,並推進多模態與多語言安全基準研究;Gemini for Education已提供予小學至初級學院的所有教育工作者。
愛丁堡大學的 Filippo Menolascina 團隊使用 Co-Scientist 梳理 MASH 文獻,提出後經實驗驗證的肝病機製假説。針對近期獲批、用於 MASH 特定階段的 resmetirom 僅對少部分合資格患者有效的問題,該假説將 NLRP3 炎症小體指為連接疾病中炎症與代謝的分子橋樑。
Stanford University School of Medicine 的 Gary Peltz 團隊測試 Co-Scientist 提出的 3 種肝纖維化候選藥物,當中 2 種阻止纖維化並促進肝細胞再生。
推薦理由:研究在同一活體人類肝細胞平台比較 Co-Scientist 與研究者挑選的藥物,呈現系統從少量相關文獻線索中找到候選藥物的案例。