MilleMiglia:中段物流擬真實例生成器
Google Research 提出 MilleMiglia,一款以 C++ 編寫、用於生成中段物流配送問題擬真基準實例的工具。它以保護私隱的方式生成資料,旨在支援中段物流優化的後續研究。原始碼及文件可於 GitHub 取得。
Google Research 提出 MilleMiglia,一款以 C++ 編寫、用於生成中段物流配送問題擬真基準實例的工具。它以保護私隱的方式生成資料,旨在支援中段物流優化的後續研究。原始碼及文件可於 GitHub 取得。
MIT Reads 在成立 10 週年之際重新定位,將重心轉向小説與回憶錄,藉共同閲讀、反思與討論促進校園社羣連結。MIT 校長 Sally Kornbluth 選定 Ted Chiang 的短篇小説集《Exhalation》為 2026 年秋季選書,作品探討身分、自由意志、語言、科技影響,以及人與 AI 的關係。
ChinaTalk 作者 Irene Zhang 分析中國 AI 圈對美國 AI 安全論述的疑慮如何加深,並指出部分研究者逐漸將其視為遏制中國技術發展的政治工具。
OpenAI 推出《澳洲青年安全藍圖》,提出一套由六大支柱構成的路線圖,旨在打造更安全的 AI 體驗,保護並賦權年輕人。
Trail of Bits 為審計 Miden VM,先花六個月以 AI 智能體從零建置工具,再在審計中發現安全漏洞。工具包括 LSP 伺服器、反編譯器、靜態分析引擎及 VM 執行器的 Lean 模型;分析找出逾 400 處可改善類型驗證的位置,並發現一項可讓惡意證明者偽造 Falcon 簽章、盜取由 Falcon 金鑰對控制的 Miden 帳戶資金的高危漏洞。
vLLM 整合 PyNvVideoCodec,支援使用 NVIDIA GPU 解碼影片,將影片解碼工作從 CPU 移走,以擴展多 GPU 影片字幕生成吞吐量。在 8 張 H100 的測試中,GPU 解碼吞吐量比 CPU 解碼高逾一倍,且大型負載的 CPU 瓶頸消除。PyNvVideoCodec 已包含於標準 CUDA 版 vLLM;自訂安裝需加入 PyNvVideoCodec==2.0.4。
OpenClaw 推出原子更新機制,準備更新時會維持現有 gateway 運作,更新失敗則回復至上一個可用設定,並保留可協助診斷問題的 Agent。同時,OpenClaw 推出更新問題回報按鈕。Jason Sy 表示新流程在不少情況下有效,但尚未稱更新問題已完全解決。
Google Research 分享一項生成式 UI 研究實驗,讓教師按教學目標及課程內容建立自訂、互動且具引導性的教育模擬。該團隊同時釋出逾 30 個英文 STEM 互動學習範例,涵蓋初中及高中物理、化學、生物和數學,全部由 AI 生成並經教師審核;使用 Google Workspace for Education 的學校可報名參加試點。
Anthropic 員工 Jacob Coxon 宣佈離職並批評 AI 公司未負責任行事,其推文瀏覽量超過 170 million 次,令 AI 風險突然成為主流議題。文章指出,AI 風險已成為美國全國層面的政治議題,但全球暫停前沿 AI 系統的協議短期內似乎難以達成,國會亦不太可能在新年前通過 AI 法案。一些公司領導人則表示,若競爭對手也放慢步伐,他們願意自願減速。
Epoch AI 分析 arXiv 數學預印本後發現,承認使用 AI 的比例由 4 月的 4% 升至 8 月的 25%。即使只計至少有一位 2023 年前持續發表的作者,該比例每月仍與整體相差不超過 1.5 個百分點。8 月有 6% 的論文明確承認 AI 作出約達共同作者水平的實質研究貢獻。
Sierra 通過 Schellman 獨立審核及 AIUC 測試,取得專為 AI 智能體設計的 AIUC-1 認證。測試涵蓋聊天及語音智能體的日常互動、對抗情境和真實語音條件,包括他人嘗試操控智能體、存取受保護資訊或令其超越授權範圍的情境。相關技術評估至少每季重複,並每年進行全面審核。
Sakana AI 公佈公司內部研究團體 Frontier Intelligence Group(FIG),旨在探索主流 AI 範式以外的智能研究方向。FIG 定期舉行討論、邀請外部研究者交流,並為長期探索性研究提供時間與自由。
Microsoft 根據自身數百項 AI 轉型實踐,總結出五項經驗,涵蓋以業務成果為先、重設端到端流程及讓員工參與等做法。文中舉例,銷售團隊成交率提高 20%,部分供應鏈工作流程週期縮短最多 75%,而一支 9 人工程團隊在 35 天內交付初始產品版本。Microsoft Frontier Playbook 整理了數百項轉型實踐,提供按職位、工作流程或全新業務機會調整的實踐模式。
Cooley 使用 ChatGPT Work 建立 GO Public,為 IPO 流程引入智能支援。該工具協助律師提早發現問題,並把專業判斷集中於最重要之處。
inclusionAI 發佈 Ming-Image-0.1-Design-Layer,可按輸入圖像及圖層規劃,將扁平設計圖像拆分為指定數量的 RGBA 圖層。模型提供六層卡片製作示例,建議工作分辨率為 1024,亦可使用 512 加快分層;採樣步數為 12,驗證配置為一張 CUDA GPU、80 GiB VRAM。
Pragmatic Engineer主持人Gergely Orosz訪問Matt Pocock,討論他為AI編碼智能體建立可重用技能的做法,以及軟件工程基本原則如何適用於智能體開發。
inclusionAI 發佈 Ming-Image-0.1-Design,這款 6B 文生圖模型面向 UI、資訊圖表、海報等文字密集的視覺設計。模型可生成完整視覺構圖並支援透明背景 RGBA 輸出,建議解像度為 2048 x 2048,或採用 1024 x 1024 加快生成。建議採樣步數為 12,驗證配置為一張配備 80 GiB VRAM 的 CUDA GPU,授權為 MIT License。
Midjourney 更新 Alpha 網站,改善 v8.2 編輯器、手機和平板版面、提示詞欄及圖片整理功能。v8.2 編輯器在附加圖片時會詢問用戶想修改甚麼,草稿批次可在網格中預覽來源圖片並使用 Enhance;手機和平板版亦改善版面及上載刪除操作。團隊下一步計劃設定預設參數、以提示詞預覽 sref,並在用戶開啟圖片再返回時保留搜尋內容。
Microsoft提出教育 AI 的五項原則,包括安全、私隱、保安與透明度、教師主導、支援學生思考、強化教育體系,以及培養面向 AI 未來的能力。
OpenAI 分享一套用於追蹤、調查及披露模型失配的框架。同時發布六份報告,記錄模型出現的意外或令人憂慮行為。
OpenAI 與 AARP 將在美國 10 個城市為 1,000 名長者舉辦免費、實作型 ChatGPT 工作坊,協助他們安全地培養實用 AI 技能。
MIT 與合作機構研究人員開發 xvr,將術中 X 光與患者術前 3D 醫學影像配準;模型約 5 分鐘即可適配新患者,並在數秒內完成亞毫米精度配準。系統以患者 CT 或 MRI 進行物理模擬,生成合成 X 光,並使用逾 2,000 名患者的全身 3D 掃描預訓練基礎模型。在涵蓋 5 間醫院的資料測試中,xvr 的準確度和穩健性比其他 AI 方法高一個數量級。
Sakana AI 更新 Sakana Chat(https://chat.sakana.ai/),向所有用戶開放 Fugu Max,並新增可將會話內容帶入後續對話的記憶功能。Fugu Max 會按提示詞將處理分配給合適的開源模型;官方稱其性能可媲美前沿模型,且不依賴單一模型。記憶功能適用於 Namazu 和 Fugu Max,可在設定中查看或關閉;只記錄本次更新後的對話。
OpenAI 探索以 AI 驅動的全新廣告體驗,涵蓋 Sponsored Agents、面向營銷人員的工具,以及與 HubSpot 和 Shopify 的整合。
Mistral 宣佈與 Mozilla 合作,由 Mistral 模型為 Firefox Smart Window(beta)提供支援。這款 AI 瀏覽助理可協助理解複雜搜尋、記住用户曾點開後離開的重要內容,並根據瀏覽器分頁整理對用户重要的資訊;目前為法國及北美用户提供支援,英國和德國預計於今年稍後跟進。對話預設不會儲存在 Mozilla 的伺服器上,Mistral 等合作夥伴同意零資料保留。
GPT-6 Astra 協助 Hex 的資料智能體將答案轉化為互動式視覺化內容,令員工引以為傲並樂於分享。
ChatGPT Work 與 Codex analytics 協助團隊瞭解 AI 使用情況及開支,並將採用情況連結至業務成果。團隊亦可藉此辨識培訓需求。
ChinaTalk 第二部分分析台灣無人機產業的擴張條件,指出政黨角力使國防採購不穩,供應鏈缺口與海外市場門檻亦限制發展。文章認為,台灣較可行的路徑是發展零部件供應並與海外企業合作,而非追求完整自主生產。2026 年上半年出口增加,但測試場地、認證及海外銷售經驗仍是擴張障礙。
OpenAI 的經濟研究揭示,員工如何在傳統職責以外運用 AI,以及哪些新活動成為工作中經常出現的部分。
inclusionAI 發佈 Realtime-Venus 全雙工互動系統,提供視聽版 Realtime-Venus-Omni 與音訊版 Realtime-Venus-Audio,兩者均為 9B。
MIT 政治學家 Naoki Egami 研究社會科學方法,著重準確衡量政治現象,並檢視研究結果能否適用於其他情境。他亦研究 AI 工具用於社會科學研究時的準確性,探索如何系統辨識其引入的錯誤並在研究中加以考量;這項研究早於 ChatGPT 於 2022 年底帶動的 AI 熱潮。
OpenClaw 推出安全資訊頁,集中呈現目前安全狀態、安全公告、持續工作、研究及漏洞回報指引。自 1 月以來,項目已發布 722 項修復;14 宗回報涉及經確認的嚴重漏洞,全部已修復並披露。OpenClaw 亦公開包含超過 67,000 次 ClawHub 技能掃描的數據集,並列出掃描技能、阻止安裝惡意或已隔離技能等持續工作。
Together AI 分享由閉源模型轉向開源模型的遷移流程,涵蓋候選模型篩選、評測、調整、決策和投產。文章建議以真實流量評估準確度、效能及成本,並逐項調整提示詞、推理設定、工具環境或模型權重。Together AI 表示,部分客戶轉用開源模型後成本減幅可達 70%;投產時可先以 10% 流量進行金絲雀部署。
SemiAnalysis估算,地方暫停令及紐約州行政命令令約 2.3 GW 美國數據中心規劃容量延誤,認為目前尚未大規模拖慢整體建設。其模型預測,美國 2027 年將交付 +38GW 數據中心 IT 容量,超過 2026 年兩倍。地方限制區域內約 20 GW 名義受限容量中,只有 1,525 MW 被直接延誤;分析逐項比對限制範圍、項目地塊及仍待取得的審批。
Google DeepMind 發佈 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking,前者面向規模化與成本效率,後者針對高複雜度任務。
推薦理由:文章區分兩款模型在規模化成本效率與高複雜度任務上的定位,並列出語音代理基準成績,方便比較其應用取向。
Epoch AI 將 AI Data Centers explorer 擴至 86 個數據中心,估計涵蓋全球 AI 算力的 44%,並重新設計頁面。各站點資料包括以 H100-equivalents 計的算力容量、晶片類型、資本成本、建設狀態及衞星影像。
Epoch AI 的 ECI 比較顯示,GPT-6 Astra 在數學基準測試領先,但未在軟件工程領先。比較涵蓋 GPT-6 Astra、Claude Fable 5.1、GPT-5.6 Sol 和 Kimi K3,並以數學及軟件工程專項 ECI 評估模型能力;專項分數可與一般 ECI 比較。
Manus 宣佈透過 SkillsFuture AI Subscription 計劃及 Singtel AI Pass 在新加坡展開合作,結合結構化學習、AI 工具使用權與持續實踐機會。符合資格學員可透過 Singtel AI Pass 試用精選高級 AI 工具三個月,再選一項續用三個月;Manus 課程涵蓋基礎、中級、進階及特定職位學習內容。
OpenAI 圍繞 Codex 運作智能體軟件工廠,讓智能體參與編碼、測試、審查、部署及生產監控。Perf Factory 會整理告警與儀錶板、識別延遲回退並提出修復建議,部署智能體亦會監測變更相關訊號。Codex 帶來的程式碼增量令部分建置、測試及部署系統在約 6 個月內負荷增至約 10 倍,團隊因此重新思考 PR 和程式碼審查流程。
Sakana AI 為 Sakana Marlin 新增 Interactive Reading 和可編輯 PowerPoint 投影片匯出,讓用戶查核報告依據並編修調查結果。