跳到正文

#產品更新

今日 27 條
10月6日週二
  1. 英國 AI Security Institute:Blog57

    最佳停止:英國 AI Security Institute 的 optstop 如何節省評測計算資源

    英國 AI Security Institute 開發並開源 Python 套件 optstop,按模型表現估計的精度或穩定程度提前停止評測抽樣。在涵蓋三類評分方式、三種預期模型表現水平,以及 MATH、GPQA Diamond 和 WritingBench 等公開基準的測試中,optstop 節省 57% 至 97% 的預定運行次數,且未影響分數估計。

  2. Google Cloud:Databases64

    Google Cloud 預覽 AlloyDB 與 Cloud SQL 原生 BM25 排序功能

    Google Cloud 預覽 AlloyDB 與 Cloud SQL for PostgreSQL 17+ 的原生 BM25 索引,透過 Tiger Data 開源的 pg_textsearch 擴充功能,讓全文關鍵字搜尋直接在資料庫內執行。這可與向量搜尋組成混合搜尋,避免另設全文搜尋後端;AlloyDB 提供使用 RRF 的混合搜尋 UDF,Cloud SQL 則可用 CTE 合併搜尋結果。

  3. Google Cloud:Databases55

    Google Cloud 宣佈 AlloyDB 面向 AI 智能體的 PostgreSQL 架構進入預覽版

    Google Cloud 宣佈 AlloyDB 面向智能體的 PostgreSQL 架構現以預覽版提供,透過數秒內建立的沙盒資料庫執行查詢,並與生產工作負載隔離。沙盒實例可即時唯讀存取生產資料,並在工作完成後自動縮至零;整體架構支援每秒超過 300 萬次查詢。它亦可連接 BigQuery 與 Spark 執行 lakehouse 分析,無需複雜 ETL pipeline。

  4. Anthropic:Newsroom62

    Anthropic 推出 Enterprise Frontier Safeguards,讓企業自主管理監測數據並接收濫用警示

    Anthropic 宣佈推出 Enterprise Frontier Safeguards(EFS),結合零數據保留(ZDR)的私隱保障與自動化濫用監測。客戶可選擇將活動數據存放於自有雲端帳戶,並自行管理加密金鑰、存取政策及審計記錄;自動系統會分析滾動時間範圍內的流量,將嚴重濫用訊號直接交予客戶,Anthropic 員工毋須進行人工審查。

  5. Cerebras:Blog55

    Cerebras 發佈第四代 CS-4,稱推理速度最高可達 GPU 系統的 30 倍

    Cerebras 發佈第四代 AI 系統 CS-4,稱其推理速度最高可達 GPU 系統的 30 倍。CS-4 由三個 Wafer Scale Engine 3 Turbo 處理器構成,採用 Nexus 模組化機架,並支援由 GPU 或 ASIC 執行 prefill、再由 CS-4 解碼的分離式推理。Cerebras 稱其每瓦吞吐量最高可達 CS-3 的 10 倍,首批出貨將於本季度開始。

  6. Databricks:Blog54

    Lakebase Postgres 以時間點分支加快大規模資料庫復原

    Lakebase Postgres 以指定時間點建立分支來復原資料庫,Databricks 稱即使資料庫達 100 TB,復原也可在數秒內完成。新分支引用物件儲存中已有的歷史資料,不必複製資料,並配有獨立運算資源及連線字串。文章亦指出,這種操作可讓 Replit 或 v0 等 Agent 平台支援資料庫版本回退或撤銷。

  7. Databricks:Blog39

    Genie One 如何重塑財務團隊的工作

    Genie One 以企業業務脈絡為依據,協助財務團隊分析業績變動成因,並將重複分析轉為可重用工作流程。它依循經批准的指標、財政年度邏輯、實體架構及企業用語,且不取代財務判斷或現有控制。支援預算差異分析、現金流預測、財務結算管理及支出分析,並可將對話儲存為 Genie Agent,供團隊重用和完善。

  8. IT之家22

    華碩推出 XG32UQDS 顯示器:31.5" UHD 180Hz QD-OLED 面板

    華碩推出 ROG Strix OLED XG32UQDS 顯示器,採用 31.5" UHD(3840×2160)180Hz QD-OLED 面板,並覆蓋 BlackShield 低反光抗刮鍍膜。其 SDR 亮度為 250nits、HDR 峯值亮度為 450nits,灰階(GtG)反應時間為 0.03ms,並支援動態準星、動態暗影增強及 AI Visual 三項 ROG 遊戲 AI 技術。

  9. The Verge · AI26

    Gemini「Call for Me」或可代你致電母親,告知你會遲到

    Google 或會把 Gemini 的「Call for Me」AI 功能擴展至商務電話以外,讓用戶透過電話向親友傳達簡短訊息。Android Authority 在 APK 拆解中發現「Gemini Calling」介紹畫面及 Gemini 在個別應用程式中的細緻權限選項,當中似乎包括電話權限。Google 仍可能不會公開推出這項功能擴展或相關設定。

  10. The Verge · AI59

    Nolla Health 在猶他州試行 AI 開具暗瘡處方

    Nolla Health 在猶他州啟動 AI 暗瘡處方試點,居民可透過 App 掃描面部,由系統評估暗瘡嚴重程度並開具初次處方。首100名患者的每張 AI 處方須先經兩名醫生批准;下一階段最多500名患者的處方會在開出後才由醫生審查,再之後每月抽查至少10%,並審查所有涉及升級處理或副作用的個案。

  11. TechCrunch · AI49

    Instinct 將 AI 智能體帶入羣組聊天,朋友無須 Instinct 帳戶也能使用

    Instinct 宣佈把 AI 智能體帶入羣組聊天,即使朋友尚未加入 Instinct,也能在羣組使用這項功能。功能目前向早期體驗用戶推出,之後將擴展至所有用戶。用戶可選擇信任哪些羣組並隨時撤回;個人 Instinct 智能體分享個人資料或採取行動前須先獲許可,羣組版 Instinct 無法存取用戶個人帳戶。

  12. TechCrunch · AI60

    TikTok 推出 AI 購物助手及一鍵結帳功能

    TikTok 宣佈推出 AI 購物助手及應用程式內一鍵結帳功能,用戶可在 For You feed 直接向品牌購買商品。助手會理解對話上下文並記住用戶的偏好和需要,提供商品資料、運送資訊、尺碼及供應情況等即時購物指引。新功能由 TikTok 與 Salesforce、Shopify、Shoplazza 和 Stripe 等商務平台及支付服務供應商合作開發。

  13. TechCrunch · AI61

    HackerRank 的 Chakra AI 面試官呈現求職面試可能的未來形態

    HackerRank 將 AI 智能體 Chakra 向客戶全面開放,讓它主持面試、觀察候選人的工作過程,並評估答案及解題思路。候選人會在包含 AI 助手的畫布中處理真實程式碼儲存庫任務,Chakra 可按工作情況追問;測試期間已進行逾 500,000 次面試。HackerRank 表示,Chakra 會為候選人評分,但最終招聘決定仍由人作出,並把原有三個招聘環節整合為一次面試。

  14. AWS Machine Learning Blog55

    Amazon SageMaker AI 推出 aws-ai-ml 技能,為編碼智能體提供生成式 AI 推理最佳化能力

    Amazon SageMaker AI 推出 aws-ai-ml 技能,讓支援 MCP 的編碼智能體協助最佳化生成式 AI 推理。它可測試現有端點、推薦部署配置、比較基準測試結果,並生成可檢視及執行的 SageMaker Python SDK v3 程式碼;測試報告提供實際基礎設施負載下的吞吐量、延遲和並行數據。

10月5日週一
  1. IT之家62

    OpenAI 將在歐盟為 ChatGPT 和 Codex 文字輸出加入隱形水印

    OpenAI 宣佈,為配合《歐盟人工智能法案》的內容透明要求,未來幾週將在歐盟符合條件的 ChatGPT 和 Codex 文字輸出中加入機器可識別的隱形水印 textGrain。全球 API 客戶可選擇為部分模型的文字輸出加入水印,OpenAI 不會在發布時將水印設為全球預設。研究人員和專家組織可申請使用檢測器;工具只會報告是否檢測到 OpenAI 水印,不會透露用戶身份、提示詞或對話內容。

  2. TechCrunch · AI49

    OpenAI 推出在圖片生成結果旁顯示的視覺廣告

    OpenAI 將在 ChatGPT 廣告產品中加入視覺廣告,與用戶要求生成的圖片並列顯示。廣告將於本月稍後開始在美國推出,現階段只限美國;初期內容來自首批參與測試的廣告商,並會清楚標示,不會影響 ChatGPT 提供的答案。OpenAI 亦正擴展廣告成效衡量工具及合作夥伴網絡,並與 DoubleVerify(DV)和 Integral Ad Science(IAS)開發品牌適宜性評估試點。