Peter Mattis談分佈式數據庫與AI對編碼工作的影響
Gergely Orosz 訪問 Cockroach Labs 聯合創辦人兼 CTO Peter Mattis,討論分佈式數據庫、存儲系統設計及 AI 對軟件工程工作的影響。
Gergely Orosz 訪問 Cockroach Labs 聯合創辦人兼 CTO Peter Mattis,討論分佈式數據庫、存儲系統設計及 AI 對軟件工程工作的影響。
Google 正透過 AI 內容貢獻試點,向對 Gemini 搜尋結果有實質貢獻的網站付費,但參與者反映所得款項極少。據 The Information 報道,試點約有 100 家出版商;數家中小型出版商稱,所得款項約佔其廣告收入的 0.1%。數家較大型出版商據報拒絕參與,希望促使 Google 提供更優厚條件。
Manus 2.0 推出 Game Dev,讓沒有編程經驗的人可用 AI 製作並打磨自己喜愛的遊戲。它會為遊戲生成專屬調參面板,讓用户遊玩時即時調整速度、重力、傷害和生成頻率,並可管理、替換及用 AI 編輯素材。Game Dev 亦協助處理多人遊戲的伺服器及部署等複雜工作,讓更多玩家可同時加入遊戲。
Manus 發佈 Manus 2.0,推出影片生成功能及內置於 Manus Studio 桌面應用程式的 Video Editor,支援製作完整影片並逐軌編輯。
NVIDIA NeMo Relay 用於追蹤智能體 Harness 行為,揭示最終答案掩蓋的低效步驟。搜尋失敗後再次搜尋,或檔案讀取遭截斷後再以命令擷取相同內容,會增加延遲和 token 消耗,也增加出錯機會。
Google 找到為 AI 設計的蛋白質加水印的方法,目標是協助生物安全。這項方法可與一款受歡迎的 AI 蛋白質設計工具配合使用。
Google DeepMind 推出 SynthID Bio,將可檢測水印嵌入蛋白質序列和預測結構,以辨識 AI 生成的生物設計。
推薦理由:SynthID Bio 把水印延伸至合成後的蛋白質,並以三種靶蛋白的濕實驗展示來源辨識與保留生物功能並行的做法。
CoreWeave 宣佈在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72,並推出 CoreWeave Forge,推進智能體 AI 從訓練到生產的部署。
推薦理由:文章披露 Cognition 對 Vera Rubin NVL72 與 GB200 NVL72 的 SWE-2 推理測試,列出最高 4.8x 的總 token 吞吐提升,讓兩種平台在智能體編碼工作負載下可作量化比較。
MIT、Carnegie Mellon University、New York University 和 Stanford University 的研究者開發 Ataraxos,在 Stratego 以 15-1-4 擊敗世界最強玩家;相關研究刊於 Nature。
OpenAI 因 AI 安全疑慮延後 IPO 計劃。公司正尋求額外 $30 billion 私募資金,IPO 計劃則有所延後。
Torch Spyre 透過智能體測試選擇流程、宣告式 YAML 測試重用框架及可靠工作流程,完成 PyTorch CRCR 的 L2 整合。測試選擇流程根據程式碼和實際執行結果篩選及分類測試;從 PyTorch 2.13 升級至 2.14 時,只需評估約 4000 項變更測試,而非數萬項。
a16z 發佈第二期《State of Markets II》,以圖表梳理 2026 年首兩季的股市與科技業變化。報告指出,截至 8 月下旬,科技業貢獻標普 500 2026 年總盈利增長約 76%,市場焦點亦由軟件轉向硬件與基礎設施,算力需求仍超過供應。
OpenAI 挫敗一場旨在提取受保護模型推理過程的協同蒸餾行動。該公司正加強防禦,以應對對抗性蒸餾。
OpenAI 與 America’s SBDC 合作,擴大小型企業的實務 AI 培訓及本地支援。另有一份新報告探討小型團隊如何使用 AI。
Anthropic 為 Claude Code 的 claude-api plugin 加入 build_eval 和 hill-climb 指令,協助建立評測、檢查評分器並改進應用程式。
心資本創始合夥人韓彥指出,IPO市場回暖之際,2026至2028年是中國硬科技的投資窗口,但早期資本尚未充分迴流。香港2026年上半年有85宗上市,募資約2,100億港元,同比增長92%,當中74%來自工業和科技企業。他強調,退出渠道恢復令價值實現路徑更清晰;要參與價值創造,投資者需更早建立對企業的理解及與創始人的關係。
數據公司估值快速攀升,成立未滿一年的公司中已有 UniPat 估值達25億美元,另有若干家公司估值3-8億美元。數據商透過採集專家解題軌跡,或製作包含任務、運行環境和評分準則的 RL environment,為模型提供訓練材料;文章指出模型公司現時更重視數據交付的速度、數量和供應商關係。這個行業尚無公認驗收標準,模型公司通常先抽檢,再從小額訂單逐步建立合作信任。
Amazon Bedrock 現已在印度提供 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,透過印度地理跨區域推理處理請求。
Amazon Bedrock 現已在首爾支援 Claude Opus 5 和 Claude Sonnet 5 的區域內推理,並在新加坡支援 Claude Sonnet 5。
研究團隊系統性比較大語言模型(LLM)在概念注入與移除時的條件控制方法,發現高效引導往往以流暢度受損為代價。Activation steering 在指令微調模型上的效果遠不及在基礎模型上;提示詞和監督式微調可用於概念注入,但不擅長移除。低成本文本指標與成本較高的 LLM 評判分數高度相關。
Apple Machine Learning Research 提出 SCLATE,讓基準與未修改的智能體透過 adapter 將各自事件加入同一開放排程器,支援持續學習智能體的訓練與評測。
Hugging Face 建立 Open TTS Leaderboard,以客觀指標評估開源、多語言 TTS 模型及聲音複製能力。評估涵蓋 WER/CER、批次推理速度(RTFx)、首段音訊延遲(TTFA)及説話者相似度(SIM),可把單個模型的評估時間由數週縮短至數小時。排行榜不取代人工偏好評選,並設有 Listen 頁籤供用户比較生成音訊及投票;其指標不直接衡量自然度、表現力或聽者偏好。
推薦理由:排行榜以客觀指標並列呈現語音清晰度、説話者相似度與速度表現,並保留聆聽投票,方便比較多語言及聲音複製模型。
IDC數據顯示,AGIBOT於2026年上半年出貨逾8,600台人形機械人,全球排名第一,約佔全球出貨量35%。同期全球出貨量接近25,000台,按年增長432.1%;IDC預計全球人形機械人出貨量到2030年將超過750,000台。
Factory 宣佈 Automations 即日起向所有用戶開放,Droid 可按排程或事件觸發執行重複工作流程。用戶可為每項自動化設定提示詞或範本、模型及推理程度,並選擇在本機、已連接的電腦或 Factory 管理的 Droid Computer 上執行。
Simon Willison 引述 Anthropic Frontier Red Team 的評估指出,GLM-5.3 在 100 項內部 Binary Exploitation benchmark 任務中,有 4% 試次形成完整控制流程劫持。
反對 OpenAI 的抗議行動愈趨有創意,最新一件雕塑描繪 AI 領袖逃離一艘正在下沉的船。
AMD 收購 AI 初創公司 World Labs,交易金額為 $8.2 billion,預計於年底前完成。
JEPA-TTT 透過在測試期間持續自我監督更新預訓練世界模型的潛在動力學預測器,適應測試時與訓練時不同的環境動力學。在 4 個連續控制環境的 8 種動力學轉變中,JEPA-TTT 均改善規劃表現;經 500 個測試回合後,潛在自回歸預測誤差平均降低 83%,規劃表現較凍結的 JEPA 世界模型提升 153%。
GPT-6.1 Sol 已在 Amazon Bedrock 正式開放使用,面向智能體編碼、電腦操作及專業工作負載。OpenAI 表示,GPT-6.1 Sol 在 DeepSWE v1.1 上匹配 GPT-6 Astra,單項任務成本約為 GPT-6 Astra 的五分之一;其分數亦比 GPT-6 Sol 的最佳結果高 6.4 個百分點,且所用推理力度較低。
推薦理由:文章列出 GPT-6.1 Sol 在 DeepSWE v1.1 上與 GPT-6 Astra 的任務成本對照,並比較其對 GPT-6 Sol 的分數提升。
《紐約時報》報道指出,OpenAI 在 Hugging Face 事件發生前數月已收到警告,相關員工與高層之間的交流此前未曾報道。受訪員工和獨立安全研究人員稱,OpenAI 未把安全列為優先事項,問題不只出現在 AI 模型測試,也出現在該公司其他領域。
NVIDIA TensorRT Model Connect 是一個面向編碼智能體設計、基於 NVIDIA TensorRT 建構的開源 C++ AI 模型參考實作集合。其開發經驗包括並行工作、模型家族隔離、可逆變更,以及 GPU 支援的驗證。
OpenAI 澳洲政府伺服器入侵事件中,一個智能體在缺少「完整防護措施」的情況下,存取了系統資訊及原始碼。
Sierra 成為 OpenAI 新 B2B Marketplace 的首發合作夥伴,合資格客戶可將既有 OpenAI 承諾額度用於與 Sierra 建立智能體。Sierra 按業務成果而非 tokens 計費,Ghostwriter 支援團隊建立、部署及改進智能體。
文章展示如何在 AlloyDB for PostgreSQL 中整合 TypeSafe AI 的 Jev 模型,直接對資料庫資料執行語義篩選與分類。作者以 PostgreSQL 陣列批次處理 50 筆商品,將多項模型評估合併成一次 HTTP 請求;測試耗時約 180 毫秒,逐行使用 Jev 約需 5,600 毫秒,預設模型約需 19,500 毫秒。
AI 智能體代為購物,可能改變平台、商家與助理之間的客戶關係及訂單導流,重分配廣告和佣金構成的利潤池。平台取態取決於智能體能帶來多少新增需求,以及平台對搜尋發現和客戶關係的收益依賴程度;Amazon 阻擋 Muse,Instacart 和 Shopify 則接入。
AWS 介紹 Amazon Quick 的提示詞工程基礎,整理適用於不同功能的通用原則與可複用框架。文章涵蓋明確具體、提供業務背景、以示例指定輸出,以及 CRISPE、RADAR、ARCHITECT 和 QUEST 等框架,並介紹中繼資料檢索、多角度分析與情境規劃。文中以 RFI 問卷自動化示範 Quick Flow 如何把多工作表資料整理為四欄 CSV,並稱可將原需數小時的處理縮至數分鐘。
Meta 宣佈 Facebook 羣組專用應用程式 Forum 在美國 iOS 和 Android 平台開放下載,並介紹多項新功能。Ask 以 AI 突顯已加入及公開羣組中的既有貼文和留言,協助用戶查找基於真實經驗的討論,首頁亦會根據近期搜尋建議新問題。
OpenAI 在 DevDay 2026 發佈 GPT-6.1 Sol、Dots 智能體及多項開發者工具與功能。GPT-6.1 Sol 主打接近 Astra 的智能水平,價格為 Astra 的五分之一;Ultrafast 最高達 300 tokens/second,速度快 8x,先支援 Astra 6。
推薦理由:現場紀錄同時追蹤產品宣佈、示範失誤與後續功能場次,讀者可從發佈內容和實際操作兩方面瞭解 OpenAI DevDay 的產品進展。
Azeem Azhar 分析 Anthropic 的 S-1 招股文件,指公司收入增長快於成本,並可能於 2026 年轉為盈利。文件列出 2025 年 $8bn 營運虧損及 $42bn 淨虧損,後者受一筆會計費用推高。公司有為期 7-10 年、總額 $518bn 的算力承諾,約 80%(約 $410bn)不可取消;其年化收入預計於 2026 年底超過 $100bn。
Shopify 決定藉助 AI 智能體,把所有流動應用由 React Native 遷移至 Swift 和 Kotlin,理由是 AI 已降低為 iOS、Android 分別實作功能的成本。Shop app 已在 12 週內以原生方式推出,Shopify app 正在遷移;團隊以共用測試套件驗證兩平台的商業邏輯,功能須通過相同測試才能發佈。