跳到正文

#部署/工程

今日 15 條
10月6日週二
  1. Cerebras:Blog55

    Cerebras 發佈第四代 CS-4,稱推理速度最高可達 GPU 系統的 30 倍

    Cerebras 發佈第四代 AI 系統 CS-4,稱其推理速度最高可達 GPU 系統的 30 倍。CS-4 由三個 Wafer Scale Engine 3 Turbo 處理器構成,採用 Nexus 模組化機架,並支援由 GPU 或 ASIC 執行 prefill、再由 CS-4 解碼的分離式推理。Cerebras 稱其每瓦吞吐量最高可達 CS-3 的 10 倍,首批出貨將於本季度開始。

  2. NAVER / CLOVA 研究35

    聖地亞哥 NeurIPS 2025:NAVER 的 AI 現況與未來

    NAVER 在聖地亞哥舉行的 NeurIPS 2025 展示 9 篇研究論文及最新技術示範,研究聚焦效率、可控性與真實世界 AI。其中,KVzip 的記憶體節省幅度最高達 4 倍、速度提升接近 2 倍;CodeGEMM 令 70B 模型運行速度最高提升 8.93 倍。NAVER 亦提出 C-SEO Bench,並以開源方式發布數據集、程式碼及基準。

  3. Databricks:Blog54

    Lakebase Postgres 以時間點分支加快大規模資料庫復原

    Lakebase Postgres 以指定時間點建立分支來復原資料庫,Databricks 稱即使資料庫達 100 TB,復原也可在數秒內完成。新分支引用物件儲存中已有的歷史資料,不必複製資料,並配有獨立運算資源及連線字串。文章亦指出,這種操作可讓 Replit 或 v0 等 Agent 平台支援資料庫版本回退或撤銷。

  4. Databricks:Blog55

    Databricks 分享挑選首批高影響力 Genie Agents 的方法

    Databricks 分享一套挑選首批 Genie Agents 的方法,建議團隊按五項準則評估候選工作流程,篩選適合作為試點的項目。準則涵蓋業務影響、需求頻率與重複性、數據與元數據準備度、範圍清晰度,以及治理和風險適配度;各項按 1–5 分評分,總分 20–25 可立即開發,14–19 需進一步完善,低於 14 則暫不適合。若沒有業務負責人或高層主管積極支持,即使評分高也應暫緩。

  5. AWS Machine Learning Blog55

    Amazon SageMaker AI 推出 aws-ai-ml 技能,為編碼智能體提供生成式 AI 推理最佳化能力

    Amazon SageMaker AI 推出 aws-ai-ml 技能,讓支援 MCP 的編碼智能體協助最佳化生成式 AI 推理。它可測試現有端點、推薦部署配置、比較基準測試結果,並生成可檢視及執行的 SageMaker Python SDK v3 程式碼;測試報告提供實際基礎設施負載下的吞吐量、延遲和並行數據。

10月5日週一
  1. IT之家64

    JEDEC 發佈首份全行業矽光子學(SiPh)可靠性標準 JESD264

    JEDEC 發佈 JESD264 矽光子學器件認證和可靠性要求,這是首份面向全行業的統一矽光器件認證與可靠性實踐規範。標準建立測試和製造控制的共同基準,並釐清代工廠、外包封測及系統開發商之間的可靠性責任。它亦規定裝配工藝、激光集成、生產控制和可追溯性要求,有助降低部署風險,支持矽光技術在高速數據中心、電信及人工智能網絡中更廣泛應用。

10月4日週日
  1. MarkTechPost70

    Google Research 將聯邦學習遷移至 TEE,Gboard 現以可外部驗證的差分隱私訓練模型

    Google Research 公佈以 TEE 為基礎的新一代聯邦學習系統,並稱其中央差分隱私(DP)保證可由外部驗證。裝置會在本地加密訓練樣本,存取政策公開記錄於 Rekor,KMS 只向符合政策的工作負載發放金鑰。Gboard 已用新系統推出英文及日文下一詞預測模型;訓練現可跨機器並行,瓶頸轉為 TEE 資源,Google 未公佈具體加速倍數。

10月3日週六
  1. IT之家64

    浙江以 AI 識別後廚違規,19.5 萬家外賣商家接入系統

    浙江已有 19.5 萬家入網外賣商家接入「明廚亮灶」監管系統,具備 AI 識別功能的攝像頭覆蓋率為 97.3%。後廚畫面同步上傳至監管平台與外賣平台,AI 識別違規後推送監管人員,再由人員短信督促商家整改。浙江省市場監督管理局餐飲服務食品安全監管處處長邵慧羣表示,非現場監管後廚環境衞生不合格率由上線時逾 28% 逐月降至 3.9%。

  2. IT之家48

    LG 電子將在美國新建 AI 數據中心冷水機組工廠,韓國本土同步擴產

    LG 電子計劃在美國興建全球第三座人工智能數據中心(AIDC)冷水機組工廠,並擴大韓國平澤、昌原兩座工廠的產能,相關投資合計 1,500 億韓元。美國新廠位於弗吉尼亞州温莎市,將生產空冷式 AIDC 冷水機組,預計於 2027H2 投產。相關佈局將使冷水機組產能實現北美本地化,以靈活回應當地客户需求。

  3. LlamaIndex:產品、工程與評測47

    Vellum 與 LlamaIndex 整合

    Vellum 與 LlamaIndex 整合,讓使用者可透過 Vellum 管理提示詞,並在不修改程式碼下更新提示詞及進行版本管理。Vellum Test Suites 支援以 CSV 批量匯入測試案例,文章建議提示詞上線前執行 50–100 個測試。Vellum 的 Sandbox 可迭代提示詞、模型、提供者及參數,Deployment 則提供提示詞版本管理與請求監控。

  4. LlamaIndex:產品、工程與評測59

    LlamaIndex 發佈 0.9,新增 IngestionPipeline 並更新多項開發介面

    LlamaIndex 發佈 0.9,新增用於資料匯入與轉換的 IngestionPipeline,並支援快取各轉換步驟。版本亦簡化節點解析與文字切分介面,將 LangChain 改為選裝套件,並將全域 tokenizer 改為可配置,預設採用 CL100K。此外,多模態 RAG 模組以 beta 形式推出,涵蓋多模態 LLM、嵌入及檢索。

  5. LlamaIndex:產品、工程與評測63

    如何用 LlamaIndex、Qdrant 和 Render 建立可從 Slack 對話學習的聊天機械人

    LlamaIndex 的教程示範如何用 LlamaIndex、Qdrant 和 Render 建立並部署 Slack 聊天機械人,讓它從工作區對話記錄資訊並回答相關問題。機械人把未提及它的訊息存入索引,將提及它的訊息作為查詢;Qdrant 用來持久保存記憶,FixedRecencyPostprocessor 配合最多 20 條檢索結果,令較新的訊息優先。