Cerebras 開放預覽 Gemma 4 31B,多模態推理速度達每秒 1,851 個 token
Cerebras 已在 Cerebras Inference Cloud 限時公開預覽 Gemma 4 31B,支援以圖片輸入進行多模態推理。Artificial Analysis 測得其輸出速度為每秒 1,851 個 token,是典型 GPU 端點的 35 倍;首次回應 token(包括推理)在 1.5 秒內返回。
Cerebras 已在 Cerebras Inference Cloud 限時公開預覽 Gemma 4 31B,支援以圖片輸入進行多模態推理。Artificial Analysis 測得其輸出速度為每秒 1,851 個 token,是典型 GPU 端點的 35 倍;首次回應 token(包括推理)在 1.5 秒內返回。
ElevenLabs 在 ElevenCreative 推出 Ads Engine,首項功能可把廣告素材本地化並推回 Google、Meta 和 LinkedIn。
Google Cloud 預覽 AlloyDB 與 Cloud SQL for PostgreSQL 17+ 的原生 BM25 索引,透過 Tiger Data 開源的 pg_textsearch 擴充功能,讓全文關鍵字搜尋直接在資料庫內執行。這可與向量搜尋組成混合搜尋,避免另設全文搜尋後端;AlloyDB 提供使用 RRF 的混合搜尋 UDF,Cloud SQL 則可用 CTE 合併搜尋結果。
Google Cloud 公佈 AlloyDB 面向 AI 智能體的資料庫架構,並開放 AlloyDB PostgreSQL for agents 預覽,主打隔離、亞毫秒儲存 I/O,以及按需求擴展至數千個節點。
Google Cloud 宣佈 AlloyDB 面向智能體的 PostgreSQL 架構現以預覽版提供,透過數秒內建立的沙盒資料庫執行查詢,並與生產工作負載隔離。沙盒實例可即時唯讀存取生產資料,並在工作完成後自動縮至零;整體架構支援每秒超過 300 萬次查詢。它亦可連接 BigQuery 與 Spark 執行 lakehouse 分析,無需複雜 ETL pipeline。
Google Cloud 正式推出 Memorystore for Valkey 9.1,較 Memorystore for Redis Cluster 最高可達 3 倍 QPS,延遲達微秒級。
Google Cloud 宣佈 Spanner Omni 正式推出,這個可自行部署的 Spanner 版本可在本地數據中心及其他雲端運行,並提供與全託管 Spanner 相同的核心能力。
Google Cloud 介紹以 Memorystore for Valkey 和 AlloyDB AI 分別處理短期會話快取與長期記憶的 AI 智能體雙層架構。
Google Cloud 宣佈 Spanner queues 正式推出,將原生交易式訊息佇列整合至 Spanner,讓智能體狀態更新與下游任務在同一交易中原子提交或一併失敗。
Google 的 Call for Me 或將擴展至親友私人電話,讓 Gemini 代用戶轉達訊息或進行簡單查詢。現有功能主要用於致電商戶及處理預約;新版介紹畫面出現「媽媽」和「約翰」等私人聯絡人示例。Google 尚未確認是否推出擴展功能,正式推出時間亦未明。
Google 或會把 Gemini 的「Call for Me」AI 功能擴展至商務電話以外,讓用戶透過電話向親友傳達簡短訊息。Android Authority 在 APK 拆解中發現「Gemini Calling」介紹畫面及 Gemini 在個別應用程式中的細緻權限選項,當中似乎包括電話權限。Google 仍可能不會公開推出這項功能擴展或相關設定。
Google 等五個組織在過去五個月承認 AI 智能體漏洞,攻擊者可利用目標網絡內一個智能體,向其他內部智能體傳播惡意指令。獨立研究員 Syed Anas Mohiuddin 測試多個機構的智能體,其概念驗證攻擊利用 MCP(Model Context Protocol)的信任缺口。這種提示詞注入針對特定智能體而非 LLM;MCP 是 AI 應用程式和智能體在內部網絡互通的一種標準。
Google Research 發佈智能體私隱與安全研討會報告,梳理自主智能體面對的核心挑戰。報告以情境完整性(CI)為基礎,主張加入情境政策引擎,在資料離開用戶工作區前評估資料流是否恰當,並提出系統、模型及用戶層面的多層防護方向。
澳洲正考慮禁止在部分公共場所使用智能眼鏡,多國法院亦已禁止在法庭使用可穿戴技術。挪威表示不打算全面禁令,但將擬議限制列為「高度優先」,並將很快向國會提交法案;政府稱,沒有未經同意拍攝他人風險的情況才屬適當使用。
a16z 第七版《Top 100 Consumer AI Apps》按網頁訪問量及手機月活躍用戶排名,並首次加入美國消費者支出排名。YipitData 美國電子收據樣本顯示,2026 年 8 月有 4.5% 合資格消費者持有 ChatGPT、Gemini 或 Claude 至少一項個人付費訂閲;前 1% 付費者佔觀察到的消費級 AI 支出 19.5%。
瑞典滾珠軸承製造商 SKF 使用 AI 生成已故女星葛麗泰·嘉寶的虛擬形象拍攝廣告,呼應她曾參與推介瑞典產業的短片。
Google 因 AI 提交大幅增加,暫停其開源軟件漏洞獎勵計劃,暫停自 10 月 1 日起生效,並承諾於 2027 年第一季提供更新。Google 表示,自動化提交中絕大多數無效;Tom's Hardware 指,Google 工程師及開源維護者被無效或含有模型幻覺的報告淹沒,參與者可考慮 Google 其他漏洞獎勵計劃。
MarkTechPost 將 GPT-6 Astra、GPT-6.1 Sol、Gemini 4 Argon 與 Claude Fable 5.1 的基準、價格及存取條件並列,按工作負載整理各自適用情境。
推薦理由:文章將四款模型的基準、價格、存取限制和任務成本並列,呈現不同工作負載下的取捨,説明排行榜名次不足以單獨決定選型。
Google 宣佈,OSS VRP 自 2026 年 10 月 1 日起不再接收產品漏洞提報。調整不影響此前提交的產品漏洞;部分可能影響 Google Cloud 產品的 Google Cloud 代碼倉庫,如涉及產品漏洞,仍可能由 Cloud VRP 接收報告。
Google 將自 2026 年 10 月起收緊個人帳戶的 Gemini 模型使用權限,未訂閲用戶只可使用 Flash-Lite,AI Plus 訂戶則無法使用 Pro。
Google Research 公佈以 TEE 為基礎的新一代聯邦學習系統,並稱其中央差分隱私(DP)保證可由外部驗證。裝置會在本地加密訓練樣本,存取政策公開記錄於 Rekor,KMS 只向符合政策的工作負載發放金鑰。Gboard 已用新系統推出英文及日文下一詞預測模型;訓練現可跨機器並行,瓶頸轉為 TEE 資源,Google 未公佈具體加速倍數。
全球經濟的電氣化轉型比最終能源數據所呈現的更深入:電力已支撐全球 GDP 的 46%,但只佔最終能源使用量的 23%。電力效率較高,每焦耳電力可完成約 2.5 倍於每焦耳石油的有用功;電動車效率為 85-90%,汽油車則約 25%。
DeepMind 研究者提出 Artificial Symbiotic Intelligence,主張把 AI 發展視為人與多個智能體共同演化的社會系統,而非單一超級智能走向奇點。他們將智能體描述為由模型、角色、記憶、倫理取向、工具與技能組成、可拆解重組的臨時組合,並認為協作需要制度、介面與治理框架。對齊也不應只是自上而下灌輸固定價值,而是在不同領域的人、智能體與制度持續互動中形成。
YouTube 正調整 Shorts 推薦演算法,計劃降低主要搬運其他創作者內容、且未作實質加工的帳號曝光,並優先推薦原創內容。平台未披露具體機制,並建議創作者加入自身觀點和表達,為原始素材增添真正價值,而非簡單截取後重新上載。
Google 將自 2026 年 10 月 9 日起調整 Gemini Web / App 個人帳號的模型可用權限,未訂閲用户將僅能使用 Flash-Lite。
Google Viewer 已上架 Google Play,現僅適用於 Googlebook,定位為綜合媒體編輯工具。首次啟動可選擇啟用 AI 即時建議,AI 能識別內容中的日期並建議加入 Google 日曆,亦可提供基於 Google 地圖的路線提示。編輯功能涵蓋圖像註釋、文字、調整尺寸、裁剪與旋轉,以及 PDF 文字、註釋和簽名;影片播放器亦可將內容轉至照片編輯功能。
作者以 KOSMOS-2、Google PaLM API 和 LlamaIndex 建構 Streamlit 多模態原型,讓使用者上載圖片並就圖像內容對話。KOSMOS-2 生成圖片描述,PaLM 負責對話,LlamaIndex 串接流程;示範版每個工作階段最多可傳送 20 則訊息。
LlamaIndex 推出文件智能體工作流程教學系列,涵蓋法律文件、發票及患者病例摘要。LlamaParse 新增可遵守 SharePoint 權限的 RAG 智能體內置支援,並可整合 Azure 企業資料來源、維持文件層級存取控制。LlamaIndex 亦為 Google 最新 Gemini 2.0 模型提供 day-0 支援。
LlamaIndex 更新 LlamaParse,將解析模式重新命名為 Fast、Balanced 和 Premium,並提供無 AI、LLM、LVM 與 Agent 四種解析方式。
LlamaIndex 宣佈 LlamaParse 開放所有人註冊,並公佈 $19M A 輪融資。Parse With Agent 模式現支援 Claude Sonnet 3.7 和 Gemini 2.0 Flash,以改善表格解析及跨頁一致性。電子報亦列出 HuggingFace 的智能體課程,以及 DeepLearning.AI 合作推出的智能體文件工作流程課程。
LlamaIndex 電子報彙整本週產品與社羣更新,涵蓋 Llama4 深度研究方案、金融研究智能體教程,以及 Gemini 2.5 Flash 和 GPT-4.1 支援。開源專案 LlamaResearcher 會拆分查詢、搜尋網絡並撰寫文章;Gemini 2.5 Flash 整合無需升級,GPT-4.1 則已獲 API Day 0 支援。
LlamaIndex 為 LlamaParse 發佈 2025 年 5 月更新,新增 OpenAI GPT 4.1、Google Gemini 2.5 Pro 支援及頁面方向與歪斜自動校正。
LlamaIndex 本期通訊彙整多項產品與工程更新,包括 Gemini Live 的 TypeScript、Python 語音整合,以及 LlamaParse Indexes 上線託管嵌入向量功能,毋須自備 API key,並提供 10,000 個免費 credits。
LlamaIndex 建立了 audio-kb CLI 工具,讓使用者可從終端錄製或上傳音訊筆記,並對筆記進行語義搜尋。工具以 LlamaParse 提取逐字稿,將文本分塊後用 Gemini Embedding 2 產生嵌入向量,再存入帶有 HNSW 索引的本地 SurrealDB。
LlamaIndex 推出開源 LiteParse,這是一款基於多年 LlamaParse 開發經驗打造的輕量本機文件解析器。LiteParse 支援版面保留、本機 OCR 及多模態 LLM,並可透過 `npm i -g @llamaindex/liteparse` 安裝。
LlamaIndex 本期電子報宣佈推出 LiteSearch 本地文件檢索系統,並聚焦文件解析能力更新。LiteSearch 以 LiteParse 建構檢索流程,涵蓋解析、分塊、嵌入向量與向量儲存,無需外部依賴;電子報亦介紹 .docx 表格頁面定位改進,以及整合 Gemini 3.1 Live API 的語音助理示範。
Google 開源 Credentio C++ 庫,用於驗證 C2PA Content Credentials,起步支援規格版本 2.2 和 2.4。其 API 可在開發者應用程式本地執行驗證,媒體檔案毋須傳送至雲端或外部驗證端點;驗證大型檔案時,Credentio 使用的記憶體亦少於其他方案。
Google 介紹如何以 Agent Development Kit(ADK)構建零信任 AI 智能體,並以 Gemini 驅動的客服退款智能體作示範。文章提出三層防護,分別以硬件支援的簽名、gVisor 沙箱及確定性語義閘道,保護資料寫入、動態程式碼執行和業務規則。
Google 在 ADK 加入原生即時評測功能,可透過模擬使用者以音訊與即時語音智能體對話,評分語音回覆,並沿用文字智能體的評測流程。測試案例可採對話情境或固定對話,並以自然語言評分規準評估整段多輪互動,也可逐輪評分回覆或工具執行。評測可由 CLI 執行,或透過 AgentEvaluator 納入 CI/CD;ADK Web 會呈現轉錄文字及可播放音訊。
Google for Startups AI Agents Challenge 各賽道的高排名參賽方案呈現四種工程模式,包括雙向 MCP、事件驅動並行、模型回退後共用驗證,以及昂貴模型調用前的分層路由。