ElevenLabs 與烏克蘭合作建設全球首個智能體政府
ElevenLabs 與烏克蘭政府簽署諒解備忘錄,合作推動 AI 公共服務由概念走向部署。教育部團隊正開發 Mriia 個人化 AI 導師應用程式,經濟部則把智能體整合至 Obriy,醫療領域運用語音技術減少行政工作。烏克蘭數碼轉型部計劃於 2030 年前成為 AI 公共服務應用的領先者,並以 Diia.AI 踏出第一步;該平台是全球首個公共服務智能體應用程式及平台。
ElevenLabs 與烏克蘭政府簽署諒解備忘錄,合作推動 AI 公共服務由概念走向部署。教育部團隊正開發 Mriia 個人化 AI 導師應用程式,經濟部則把智能體整合至 Obriy,醫療領域運用語音技術減少行政工作。烏克蘭數碼轉型部計劃於 2030 年前成為 AI 公共服務應用的領先者,並以 Diia.AI 踏出第一步;該平台是全球首個公共服務智能體應用程式及平台。
Cohere 聯合創辦人兼 CEO Aidan Gomez 主張,AI 安全規則不應由少數大型公司透過反壟斷豁免制定,再要求其他開發者遵守。他支持對高能力 AI 系統進行獨立審查,但提出由公開、循證和多方參與的程序制定風險框架,配合強制透明度、按證據界定測試範圍及獨立保障。
Harvey 與 ElevenLabs 合作,為法律界打造全球化多語語音能力,讓 Harvey 能以數十種語言、方言或口音自然溝通。合作以 ElevenLabs 的 Text to Speech 和 Speech to Text 為基礎,首階段讓 Harvey 幾乎可用任何語言或方言以語音提供答案。
ElevenLabs 發佈 Scribe v2 Realtime,即時語音轉文字模型可在低於 150 ms 內轉錄語音,面向語音智能體、會議助理及即時字幕等場景。
Matthew McConaughey 已投資 ElevenLabs 數年,並將以創作者身份把電子通訊 Lyrics of Livin’ 擴展至由 ElevenLabs 支援的西班牙語版本。相關故事和內容將以他的聲音提供西班牙語音訊,觸及更廣泛受眾。
ElevenLabs 推出 Image & Video (Beta),在同一平台整合圖像、影片生成及音訊後製流程。用戶可透過 Nanobanana、Flux Kontext、GPT Image 和 Seedream 生成圖像,並以 Veo、Sora、Kling、Wan 和 Seedance 生成影片,再匯出至 Studio 加入語音、背景音樂及音效。
MasterClass 與 ElevenLabs 合作,讓用戶可在 MasterClass On Call 與 Gordon Ramsay、Mark Cuban 等講師的 AI 版本進行即時語音對話。
ElevenLabs 推出《The Eleven Album》,專輯由多位音樂人與 AI 協作創作,並由 Eleven Music 提供生成技術。Eleven Music 可按簡單提示詞生成完整作品,並支援音樂人調整歌詞、時間安排及配器,以及下載最多六條錄音室級分軌。
ElevenLabs 推出 Scribe v2,面向大規模批量轉錄、字幕製作及字幕生成,並提升對長篇、複雜錄音的處理穩定性與準確度。Scribe v2 在業界標準基準測試中錄得最低詞錯誤率,支援最多 100 個詞語或短語的關鍵詞提示,以及涵蓋最多 56 個類別、附精確時間戳的實體偵測。
Audi Revolut F1 Team 與 ElevenLabs 合作探索 AI 音訊及語音生成技術,期望支援車隊溝通和連繫全球車迷。雙方正探討相關技術如何支援賽道上的車隊,並透過數碼平台和體驗,讓世界各地車迷以新形式體驗及連繫這項運動。
ElevenLabs 的 Eleven v3 文字轉語音模型已結束 Alpha 階段,現已在所有平台正式提供。內部基準涵蓋 8 種語言、27 個類別,模型錯誤率由 15.3% 降至 4.9%,減少 68%。測試中,用戶有 72% 的情況偏好新版本;模型處理數字、符號及專門記法的準確度亦有所提升。
Revolut在英國及歐洲部署 ElevenLabs Agents,作為第一線語音客服,服務範圍擴至逾 400 萬名客戶。首階段部署令問題解決時間縮短逾 8 倍,智能體處理的來電中逾 99.7% 成功完成。智能體支援逾 30 種語言並可即時偵測及切換語言,Revolut亦保留編排及業務邏輯控制。
Klarna 在美國推出以 ElevenAgents 建構的語音 AI 智能體,作為電話支援第一線;查詢由智能體處理時,解決速度快至 10x。服務供美國 35 million 名 Klarna 客戶使用,智能體可處理資訊查詢,並在有需要時轉交人工客服。Klarna 計劃將服務擴展至全球,目標涵蓋 114 million 名客戶。
ElevenLabs 完成 $500M D 輪融資,估值達 $11B,並由 Sequoia Capital 領投。公司 2025 年底的 ARR 超過 $330 million;此輪使其自 2022 年成立以來的五輪融資總額達 $781 million。
ElevenLabs 今日在馬德里開設辦事處,並擴大西班牙業務,擴充本地銷售及工程團隊。eDreams ODIGEO(eDO)使用 Eleven Agents,以五種語言處理數以百萬計的客戶支援互動,並在問題解決速度及轉接率方面取得雙位數改善。
ElevenLabs 推出教授語音 AI 使用計劃,並推出以 Einstein 的聲音和作品為基礎的互動學習體驗。教授可免費使用 Pro tier,並可為特定課程和項目向學生提供限時使用權限。重現後的 Einstein 聲音可在 ElevenReader 聆聽;基於 ElevenLabs Agents 的互動體驗則支援用戶即時提問和探索科學概念。
ElevenLabs 推出 AI 音樂探索與創作平台 ElevenMusic,整合聆聽、改編、原創創作、發布及收益功能。平台現已可透過應用程式或網頁使用,已有超過 4,000 名獨立及新興藝人參與,並同步推出收錄 Danger Twins、Justin Love 等藝人曲目的 Eleven Album Vol. 2。
ElevenLabs 宣佈 ARR 在 2026 年首四個月已超過 $500 million,並完成 Series D 第三次交割,迎來 BlackRock、NVIDIA(透過 NVentures)等新投資者。
ElevenLabs 表示,Voice Library 創作者累計收入六個月內由 $11 million 增至逾 $22 million。平台現有 10,400+ 名創作者,Voice Library 收錄 32 種語言的聲音,涵蓋數十種口音和風格。創作者可設定授權用途、價格級別及最長兩年的通知期,收益按使用量和所訂條款計算,亦可更新條款、限制用途或移除聲音。
ElevenLabs 發佈音樂生成模型 Music v2,改善不同曲風的歌聲、樂器與編曲表現,並提升多語言支援。用戶可逐段構建完整歌曲,並選取曲目任一部分重新生成,而不影響其他部分。
ElevenLabs 推出 Dubbing v2,直接以原始表演作為條件,將説話者的語調、語氣、節奏和情感意圖延續至 90+ 種語言。其同步感知翻譯系統會自動對齊內容的起始、結束位置和節奏,減少手動調整。
ElevenLabs 與希臘政府建立戰略合作,將探索語音 AI 在公共服務、旅遊及希臘語言文化遺產保存方面的應用。公共服務方向包括政府呼叫中心及 gov.gr,該平台現提供超過 2,200 項服務;旅遊方向涉及官方旅遊網站 Visitgreece.gr 及新的旅遊平台。
ElevenLabs 在 ElevenCreative 推出 Flows Agent,讓用戶以對話描述創作需求,由智能體建立、連接並執行工作流程。它會選擇合適模型、建立及連接節點,並在生成前確認影片長度、語氣和結構;啟用 Assist mode 後,高成本生成須經用戶確認。
ElevenLabs 與英國科學、創新及科技部(DSIT)簽署合作備忘錄,探索以語音 AI 改善公共服務,並深化 AI 安全研究及英國語音與音訊 AI 人才培育。
波蘭政府透過 BGK 集團旗下的 Vinci 入股 ElevenLabs,並共同推出 AI Lab Poland。這項倡議整合資本、技術、科研與人才,目標是協助新一代波蘭 AI 公司從起步時便以全球發展為目標。
ElevenLabs 宣佈擴大加州業務,將在全州增聘 173 人,涵蓋研究、工程、銷售等高薪職位,並投入數百萬美元。公司獲 California Competes Tax Credit(CalCompetes)計劃提供獎勵,並計劃與加州政府探索以語音 AI 提升公共服務的可及性;公司亦參與州長打擊科技促成詐騙的專責小組。
ElevenLabs 在 ElevenCreative 推出 Ads Engine,首項功能可把廣告素材本地化並推回 Google、Meta 和 LinkedIn。
ElevenLabs 在 ElevenAgents 推出 Procedures,讓團隊為智能體設定常見情境下的操作指示。Procedures 分為按固定步驟執行的結構化流程,以及可按對話調整並調用工具的自由形式流程。用戶可匯入 docs、PDFs 或 txt 檔案,由 ElevenAgents 草擬 Procedure 供確認或修改;功能目前處於 Alpha。
ElevenLabs 正式在加拿大開展業務,並加大對當地團隊及實體據點的投資。公司委任 Max Lemmens 為加拿大總經理,計劃今年將團隊擴大至目前規模的兩倍,並在多倫多開設首間加拿大辦公室。ElevenLabs 在加拿大已有 30,000 名用戶。
ElevenLabs 正在 2026 年選舉週期與選舉機構及民間組織合作,以語音 AI 擴大選民取得官方資訊的途徑,並防範技術遭濫用。巴西最高選舉法院(TSE)將為「選舉助理」加入語音介面,讓民眾透過語音查詢其網站、App 和 WhatsApp 頻道資訊;ElevenLabs 亦會培訓 Comprova 合作夥伴使用 AI Speech Classifier 等檢測工具。
ElevenLabs 推出 CLI v1,將 ElevenLabs API 帶入終端機,並以面向編碼智能體的指令和結構化 JSON 結果設計操作流程。CLI 支援 agents-as-code,可將工作區內的 Agent 匯入本機設定檔、編輯及預覽差異,再手動或透過編碼智能體推送至 production;`--dry-run` 可在操作影響工作區前預覽。
Ethan Tandowsky 加入 ElevenLabs 出任首席財務官,將擴展公司的財務基建,並塑造公司在研究、產品及全球擴張方面的投資方向。他最近曾任支付公司 Adyen 的 CFO,於 2016 年加入其財務團隊,並於 2023 年出任 CFO;任內 Adyen 員工人數由 400 增至 5,000,收入增長 20x。
Zyphra 公佈 Zyda,一個包含 1.3T tokens、供語言模型訓練使用的開放數據集。它整合七個開放數據集,經統一的品質過濾及跨數據集去重,並以開放且寬鬆的授權發布。消融研究顯示,Zyda 表現勝過 Dolma、Fineweb、Pile、RefinedWeb 和 SlimPajama 等現有開放數據集。
Zyphra 發佈 Zamba2-small(2.7B),一款面向裝置端應用的小型語言模型。相較 Phi3-3.8B,其首 token 生成速度快 2x、記憶體開銷減少 27%,生成延遲低 1.29x。模型權重以 Apache 2.0 授權開源。
Zyphra 提出 Tree Attention,以樹狀歸約平行化多 GPU Transformer 解碼,實測可提升長上下文注意力的解碼速度並降低記憶體開銷。Zyphra 估算,在 1M 序列長度下,Tree Attention 的解碼速度較 Ring Attention 快逾 8x,通訊量則減至一半或更低。其跨裝置複雜度為對數級,而 Ring Attention 為線性級。
Zyphra 發佈 Zamba2-VL 視覺語言模型系列,提供 1.2B、2.7B 和 7B 參數版本,採用 Zamba2 混合 SSM–Transformer 骨幹。
Zyphra 提出 MixPR,一套結合兩類 PageRank 檢索、用於高效預處理長上下文輸入的 RAG 系統。系統按任務採用 PageRank 作全域檢索,或 Personalized PageRank 作局部檢索,並在多項長上下文基準測試取得 SOTA 結果。MixPR 可配合任何現有基礎模型,把有效 LLM 上下文長度延伸至十億級,並可在 CPU 上高效運行。
Zyphra Research 發佈 Zonos-v0.1 beta,開源兩款採用 Transformer 與 SSM hybrid 架構的 1.6B TTS 模型,授權為 Apache 2.0。
Zyphra 預覽 ZAYA1,稱其為首個完全以 AMD 硬件、軟件及網絡堆疊端到端訓練的 AI 模型。ZAYA1-base 使用 Zyphra 內部 AMD 專用訓練堆疊,訓練總量為 14T tokens;訓練叢集由 128 個節點組成,搭載 AMD MI300X GPU,實際訓練效能超過 750 PFLOPs。
Zyphra 提出 Online Vector-Quantized(OVQ)attention,以線性計算複雜度和常數記憶體複雜度處理長上下文。其稀疏狀態更新可擴大記憶容量;實驗顯示,在 16k+ 上下文長度下,OVQ-attention 使用的記憶狀態僅為強自注意力基線的一小部分,表現相若或略有差距。長上下文任務中,OVQ-attention 顯著勝過線性注意力及 SSM 基線。