Replit 推出 Free Mode,Core 訂閲用戶可比以往多創作 30X
Replit 推出由 OpenAI 的 GPT-5.6 Luna 驅動的 Free Mode,日常聊天、構思和任務不再消耗 credits。Core 訂閲用戶可藉此比以往多創作 30X,並每月使用最多 30 小時聊天;Core 和 Pro 用戶的使用上限每 5 小時重設。
Replit 推出由 OpenAI 的 GPT-5.6 Luna 驅動的 Free Mode,日常聊天、構思和任務不再消耗 credits。Core 訂閲用戶可藉此比以往多創作 30X,並每月使用最多 30 小時聊天;Core 和 Pro 用戶的使用上限每 5 小時重設。
英國 AI Security Institute 開發並開源 Python 套件 optstop,按模型表現估計的精度或穩定程度提前停止評測抽樣。在涵蓋三類評分方式、三種預期模型表現水平,以及 MATH、GPQA Diamond 和 WritingBench 等公開基準的測試中,optstop 節省 57% 至 97% 的預定運行次數,且未影響分數估計。
Google Cloud 預覽 AlloyDB 與 Cloud SQL for PostgreSQL 17+ 的原生 BM25 索引,透過 Tiger Data 開源的 pg_textsearch 擴充功能,讓全文關鍵字搜尋直接在資料庫內執行。這可與向量搜尋組成混合搜尋,避免另設全文搜尋後端;AlloyDB 提供使用 RRF 的混合搜尋 UDF,Cloud SQL 則可用 CTE 合併搜尋結果。
Google Cloud 公佈 AlloyDB 面向 AI 智能體的資料庫架構,並開放 AlloyDB PostgreSQL for agents 預覽,主打隔離、亞毫秒儲存 I/O,以及按需求擴展至數千個節點。
Google Cloud 宣佈 AlloyDB 面向智能體的 PostgreSQL 架構現以預覽版提供,透過數秒內建立的沙盒資料庫執行查詢,並與生產工作負載隔離。沙盒實例可即時唯讀存取生產資料,並在工作完成後自動縮至零;整體架構支援每秒超過 300 萬次查詢。它亦可連接 BigQuery 與 Spark 執行 lakehouse 分析,無需複雜 ETL pipeline。
Google Cloud 正式推出 Memorystore for Valkey 9.1,較 Memorystore for Redis Cluster 最高可達 3 倍 QPS,延遲達微秒級。
Google Cloud 宣佈 Spanner Omni 正式推出,這個可自行部署的 Spanner 版本可在本地數據中心及其他雲端運行,並提供與全託管 Spanner 相同的核心能力。
Google Cloud 宣佈 Spanner queues 正式推出,將原生交易式訊息佇列整合至 Spanner,讓智能體狀態更新與下游任務在同一交易中原子提交或一併失敗。
Anthropic 為 Model Hardware Standard(MHS)啟動研究預覽,向首批科研實驗室及先進製造商提供讓 AI 智能體協調操作多種實體設備的共同規格。
Anthropic 宣佈推出 Enterprise Frontier Safeguards(EFS),結合零數據保留(ZDR)的私隱保障與自動化濫用監測。客戶可選擇將活動數據存放於自有雲端帳戶,並自行管理加密金鑰、存取政策及審計記錄;自動系統會分析滾動時間範圍內的流量,將嚴重濫用訊號直接交予客戶,Anthropic 員工毋須進行人工審查。
Anthropic 推出生命科學驗證計劃(LSVP),讓經核實的生命科學團隊及機構申請使用 Mythos、Opus 和 Sonnet,並為生物學相關工作提供較寬鬆的防護設定。
Anthropic 推出 Claude Frontier Academy,承諾投入 $100 million,目標在 2027 年底前培訓 10,000 名 Frontier Deployed Engineers(FDEs)。
小米 MiMo 團隊的終端式編碼智能體 MiMo Code 基於 OpenCode 構建,採用 MIT 授權開源,面向長程自動化程式編寫任務。其架構以計算、記憶和跨會話演進為主軸,包含並行候選選擇、獨立完成驗證、檢查點與分層記憶。
Cerebras 為 OpenAI 正在預覽的 GPT-5.6 Sol Ultrafast 提供服務,最高可達每秒 750 個輸出 tokens。它與標準 OpenAI endpoint 使用相同的模型架構、權重、精度、上下文設定及推理設定;Cerebras WSE-3 配備 44 GB SRAM,分佈在 900,000 個核心旁,讓權重接近計算單元。
Cerebras 發佈第四代 AI 系統 CS-4,稱其推理速度最高可達 GPU 系統的 30 倍。CS-4 由三個 Wafer Scale Engine 3 Turbo 處理器構成,採用 Nexus 模組化機架,並支援由 GPU 或 ASIC 執行 prefill、再由 CS-4 解碼的分離式推理。Cerebras 稱其每瓦吞吐量最高可達 CS-3 的 10 倍,首批出貨將於本季度開始。
Baseten 已在 Hugging Face 和 Baseten Model Library 提供 NVIDIA Nemotron 3 Diarization 的批次、串流及即時説話者標記轉錄預設。
LangChain 宣佈推出 LangSmith Fine-Tuning,開放用戶透過 smithtune 將 LangSmith traces 中成功的 runs 轉成監督式微調數據集,並在 Baseten Loops 訓練模型。
Lakebase Postgres 以指定時間點建立分支來復原資料庫,Databricks 稱即使資料庫達 100 TB,復原也可在數秒內完成。新分支引用物件儲存中已有的歷史資料,不必複製資料,並配有獨立運算資源及連線字串。文章亦指出,這種操作可讓 Replit 或 v0 等 Agent 平台支援資料庫版本回退或撤銷。
Genie One 以企業業務脈絡為依據,協助財務團隊分析業績變動成因,並將重複分析轉為可重用工作流程。它依循經批准的指標、財政年度邏輯、實體架構及企業用語,且不取代財務判斷或現有控制。支援預算差異分析、現金流預測、財務結算管理及支出分析,並可將對話儲存為 Genie Agent,供團隊重用和完善。
Databricks Runtime 透過 NEAREST BY Join 將批次向量搜尋表達為 top-k 排名連接,並以 Photon 融合式 GEMM 核心執行。
華碩推出 ROG Strix OLED XG32UQDS 顯示器,採用 31.5" UHD(3840×2160)180Hz QD-OLED 面板,並覆蓋 BlackShield 低反光抗刮鍍膜。其 SDR 亮度為 250nits、HDR 峯值亮度為 450nits,灰階(GtG)反應時間為 0.03ms,並支援動態準星、動態暗影增強及 AI Visual 三項 ROG 遊戲 AI 技術。
Microsoft 為 Word 中的 Copilot 新增引用功能,回覆會附上來源連結,讓用戶可跳轉至原始網頁或內部文件核實資訊。Microsoft 表示,此舉有助提升透明度;此外,Copilot Chat 的設計與功能經過優化,Copilot App 新增插件、連接器及 Work IQ 增強功能,PowerPoint 中的 Copilot 亦新增技能與連接器。
Anthropic 的 Felix Rieseberg 表示,Cowork 新版把模型推理和 VM 都移至雲端,每個工作階段均使用不與其他工作階段共享狀態的獨立沙盒。
Google 的 Call for Me 或將擴展至親友私人電話,讓 Gemini 代用戶轉達訊息或進行簡單查詢。現有功能主要用於致電商戶及處理預約;新版介紹畫面出現「媽媽」和「約翰」等私人聯絡人示例。Google 尚未確認是否推出擴展功能,正式推出時間亦未明。
Google 或會把 Gemini 的「Call for Me」AI 功能擴展至商務電話以外,讓用戶透過電話向親友傳達簡短訊息。Android Authority 在 APK 拆解中發現「Gemini Calling」介紹畫面及 Gemini 在個別應用程式中的細緻權限選項,當中似乎包括電話權限。Google 仍可能不會公開推出這項功能擴展或相關設定。
Together AI 推出免費、採 MIT 授權的 Together Link CLI,連接六款既有工具,使用由 Together AI 託管的開放模型,目前仍處於 beta。
Nolla Health 在猶他州啟動 AI 暗瘡處方試點,居民可透過 App 掃描面部,由系統評估暗瘡嚴重程度並開具初次處方。首100名患者的每張 AI 處方須先經兩名醫生批准;下一階段最多500名患者的處方會在開出後才由醫生審查,再之後每月抽查至少10%,並審查所有涉及升級處理或副作用的個案。
開源命令列工具 RemoveMacAI 可從 macOS 27 移除 Apple Intelligence 功能,也可只移除不想使用的功能並保留其他功能。它透過用戶在「系統設定」批准的設定描述檔和 Apple 自家的資源服務運作,不會直接修改 /System,System Integrity Protection 亦會保持啟用。
Instinct 宣佈把 AI 智能體帶入羣組聊天,即使朋友尚未加入 Instinct,也能在羣組使用這項功能。功能目前向早期體驗用戶推出,之後將擴展至所有用戶。用戶可選擇信任哪些羣組並隨時撤回;個人 Instinct 智能體分享個人資料或採取行動前須先獲許可,羣組版 Instinct 無法存取用戶個人帳戶。
TikTok 宣佈推出 AI 購物助手及應用程式內一鍵結帳功能,用戶可在 For You feed 直接向品牌購買商品。助手會理解對話上下文並記住用戶的偏好和需要,提供商品資料、運送資訊、尺碼及供應情況等即時購物指引。新功能由 TikTok 與 Salesforce、Shopify、Shoplazza 和 Stripe 等商務平台及支付服務供應商合作開發。
OpenAI 將於未來數週在歐盟逐步為合資格 ChatGPT 和 Codex 用戶推出文字水印。全球 API 客戶即日起可為指定模型選用水印輸出,研究人員及專業機構可申請檢測工具。OpenAI 稱 textGrain 達到或超越 SynthID 等文字水印方案,但不保證可靠檢測,也不能證明文字由人撰寫。
Codex 0.160.1 修正遠端 stdio MCP 伺服器啟動時未能保留環境變數的問題。明確設定遠端環境變數時,SYSTEMROOT、TEMP 和 TMP 會予以保留,讓 Unix 主機保留 Windows executor 的啟動環境。
OpenAI 將在未來數周為歐盟的 ChatGPT 和 Codex 用戶啟用 textGrain 文字水印,全球 API 水印則採自選加入。textGrain 在模型選詞中嵌入不可見統計訊號;400-token 心理學文本的檢測率約為 95%,而將 25% 字詞換成同義詞後,400-token 文本的檢測率降至 17%。
HackerRank 將 AI 智能體 Chakra 向客戶全面開放,讓它主持面試、觀察候選人的工作過程,並評估答案及解題思路。候選人會在包含 AI 助手的畫布中處理真實程式碼儲存庫任務,Chakra 可按工作情況追問;測試期間已進行逾 500,000 次面試。HackerRank 表示,Chakra 會為候選人評分,但最終招聘決定仍由人作出,並把原有三個招聘環節整合為一次面試。
Amazon SageMaker AI 推出 aws-ai-ml 技能,讓支援 MCP 的編碼智能體協助最佳化生成式 AI 推理。它可測試現有端點、推薦部署配置、比較基準測試結果,並生成可檢視及執行的 SageMaker Python SDK v3 程式碼;測試報告提供實際基礎設施負載下的吞吐量、延遲和並行數據。
GitHub 推出 ReviewBench,作為評測 AI 程式碼審查智能體的離線基準,研究預覽版已可透過網站使用。
推薦理由:ReviewBench以219個跨19種語言的公開PR建立評測集,並公開多來源標註與評分方法;資深工程師判斷與基準的一致率為96.6%。
OpenAI 宣佈,為配合《歐盟人工智能法案》的內容透明要求,未來幾週將在歐盟符合條件的 ChatGPT 和 Codex 文字輸出中加入機器可識別的隱形水印 textGrain。全球 API 客戶可選擇為部分模型的文字輸出加入水印,OpenAI 不會在發布時將水印設為全球預設。研究人員和專家組織可申請使用檢測器;工具只會報告是否檢測到 OpenAI 水印,不會透露用戶身份、提示詞或對話內容。
OpenAI 將在 ChatGPT 廣告產品中加入視覺廣告,與用戶要求生成的圖片並列顯示。廣告將於本月稍後開始在美國推出,現階段只限美國;初期內容來自首批參與測試的廣告商,並會清楚標示,不會影響 ChatGPT 提供的答案。OpenAI 亦正擴展廣告成效衡量工具及合作夥伴網絡,並與 DoubleVerify(DV)和 Integral Ad Science(IAS)開發品牌適宜性評估試點。
OpenAI 將在 ChatGPT 推出全新圖片廣告形式,廣告會與用戶正在生成的圖片相互獨立,亦不會影響 ChatGPT 的回答。測試將於本月稍後在美國啟動,首批邀請部分廣告主參與。OpenAI 亦會擴充廣告效果衡量工具及合作生態,並研發評估品牌適配性的方案。
開源命令列工具 RemoveMacAI 可在 macOS 關閉 Apple Intelligence 功能、刪除其 AI 模型,並阻止模型再次下載。開發者稱模型約佔 12GB,工具會關閉 Siri、Writing Tools、Genmoji、Image Playground、ChatGPT 擴充功能及各項摘要,並稱 Dictation 仍可使用。