跳到正文
創業邦·· 44 分鐘前精選AI 評分78

Claude Haiku 5.5降價、GPT-6 Luna開放免費使用,矽谷大模型價格競爭加劇

硅谷大模型不装了:Claude卷价格,GPT学豆包

AI 導讀

Anthropic推出Claude Haiku 5.5,對單次請求內容不超過10萬tokens的請求,每百萬tokens輸入收費0.10美元、輸出0.50美元;OpenAI則宣佈GPT-6全面上線,並向免費用戶開放GPT-6 Luna。

推薦理由

文章比較短上下文 API 價格、重複調用的快取成本與訂閲收入結構,呈現低價模型如何成為用戶入口及其收入依託。

正文 · 繁體中文

图片

編者按:本文來自微信公眾號AIX財經(AIXcaijing),作者:王璐,編輯:魏佳,創業邦經授權轉載。

過去兩年,説起大模型的“價格屠夫”,沒人會想到Claude。DeepSeek把百萬tokens的價格打到幾毛錢,逼着國內廠商一輪輪跟降,讓“大模型用不起”成了舊聞,便宜也幾乎成了國產模型的集體人設。Claude則一直站在價格表的另一頭,上一代Haiku 4.5每百萬tokens輸入1美元、輸出5美元,在不少開發者眼裏,屬於好用但不便宜的那一檔。10月8日凌晨,位置換過來了。Anthropic推出了一款主打日常簡單任務、走低價路線的輕量級模型Claude Haiku 5.5,10萬tokens以內的請求每百萬tokens輸入0.10美元、輸出0.50美元,單價只有上一代的1/10,甚至比國內同為小模型的DeepSeek-V4.1-Flash還便宜。幾乎同一時間,OpenAI宣佈GPT-6全量上線,付費用戶可使用GPT-6 Sol,免費用戶也能用上GPT-6 Luna。有網友調侃,OpenAI這是要“變豆包”了。一家降到地板價,一家直接免費,海外兩大巨頭同時對價格動了手。它們圖什麼?0.1美元的Claude、免費的GPT真的好用嗎?當便宜不再是國產大模型的專屬,DeepSeek們手裏還剩什麼牌?

01.Claude比DeepSeek還便宜,是真的

本輪模型廠商的價格戰重心,集中在小模型身上。旗艦模型通常承擔着模型廠商的品牌與技術上限,定價不宜大改。而小模型以有限的推理成本承接高併發、輕量化任務,是爭奪開發者的入口,也最適合拿來打價格戰。小模型中,當前最具可比性的三個樣本是DeepSeek-V4.1-Flash、Claude Haiku 5.5與GPT-6 Luna。AI軟件工程師覃相告訴「AIX財經」,三者在設計理念、目標場景與成本結構上高度相似,適合直接對比。先看定價。API方面,Claude Haiku 5.5與GPT-6 Luna同價:輸入在10萬以內,每百萬tokens輸入0.10美元、輸出0.50美元。橫向對比DeepSeek-V4.1-Flash,兩家海外廠商在輸入與輸出端均價格更低,即便以後者五折後的非高峯檔計算,結論依然成立。图片GPT-6 Luna在此基礎上更進一步,OpenAI已將其下放至ChatGPT免費層,C端用戶可零成本使用。需要説明的是,Haiku 5.5的低價有一個前提,每次發送的內容不超過10萬tokens。超過這條線,輸入輸出價格均漲為原來的五倍(0.50/2.50美元)。DeepSeek-V4.1-Flash則是一百萬tokens容量內統一計價,不分長短。如果同一份材料要反覆使用,DeepSeek-V4.1-Flash的緩存價0.003美元也低於Haiku 5.5的0.01美元。我們以一份4萬tokens的產品文檔為例,置頂後連續追問,每輪新增提問500tokens、回答300tokens,均按非高峯價計算。第一輪,文檔要寫入緩存。按Anthropic的緩存寫入價(保留5分鐘為0.125美元/百萬tokens),加上回答,Claude合計約0.52美分;DeepSeek無寫入溢價,約0.63美分。Claude花費更低。從第二輪起,雙方的文檔部分都進入緩存價,這時DeepSeek更便宜。同樣一輪,Haiku5.5約0.06美分,DeepSeek約0.04美分,每輪便宜約0.02美分。首輪攢下的優勢,追問幾輪就被追平了。也就是説,如果是輕度使用,隨手問幾次,Claude是便宜的。如果是重度複用,把文檔當知識庫反覆查,DeepSeek的緩存價會更有優勢。賬算清楚了,剩下的問題是:這麼便宜,好用嗎?Haiku 5.5的定位是執行層模型,摘要、壓縮、分類、數據庫查詢,以及作為大模型的子代理執行子任務,均在其設計範圍內。按Anthropic公佈的基準,其各項維度的表現均強於同級別的GPT-6 Luna。DeepSeek-V4.1-Flash的發佈基準則集中在另一個方向,DeepSWE v1.1(多文件軟件工程)74.2、Terminal-Bench 2.1(終端任務)90.6,官方稱在其選定的Agent基準上超過了自家上一代旗艦V4-Pro。需要注意的是,這些成績都是廠商自報,DeepSeek的成績基於最高推理強度,兩家用的也不是同一套測試,三家之間目前沒有可以直接橫向比較的官方數據。但大模型從業者雲中江樹做過簡單任務的實測,他的感受是,三家小模型水平相似,拉不開差距,能感知的差別在複雜指令上。綜合現有信息,可以下一個結論,三家小模型能力差距不大,均能勝任其目標場景。價格上,在“短上下文、API裸價”口徑下,Haiku 5.5與Luna的價格確實降至DeepSeek之下,且Luna對C端免費。值得一提的是,Anthropic為這一低價設定的適用範圍,恰好是其過往請求分佈的主體,按官方口徑,約90%的Haiku請求發送內容不超過10萬tokens。也就是説,絕大多數日常用量都落在優惠區裏,0.10美元是Anthropic算過賬的入口價。至於入口之外從哪裏賺錢,就要從它的整張價格表來找答案。

02.把價格打到0,圖啥?

同一張價格表上,一家公司最便宜和最貴的模型,跨度巨大。OpenAI的GPT-6分三檔,最貴的Astra輸入10美元,比Luna貴出百倍。Anthropic也類似,旗艦Fable 5.1輸入10美元,主力檔Opus 5.5輸入4美元,均比Haiku 5.5高出不少。0.1美元與10美元之間,賣的是不同的東西。先看Anthropic。第一筆是入門價,不求賺錢。覃相的判斷是,小模型這一檔大概率是微利或保本,但它不是虧錢引流的工具,而是整個商業生態的流量引擎與生態構建抓手。單次調用可以不賺錢,但只要調用量足夠大、開發者足夠多,用戶就留在這個生態裏,後面訂閲、長文、企業服務這些更貴的收入,才有機會發生。0.1美元/百萬tokens的輸入價格,買的是這張入場券。第二筆才是收入。入門價讓出去的部分,要靠更貴的檔位賺回來。Haiku 5.5超10萬tokens後,輸出價漲為原來的五倍;Opus一檔的輸入單價是Haiku低價檔的40倍,承接的是長文檔、複雜任務這些賬單膨脹的場景。同一天,Anthropic還宣佈Sonnet5.5的緩存讀取價從0.20美元砍至0.10美元。這一刀“砍下去”,主要是為了留存,Claude Code等Agent應用中,系統提示、工具定義與歷史上下文每輪均需重複讀取,緩存讀取佔輸入的大頭。對靠它寫代碼的團隊來説,Agent每跑一輪,這些固定內容都要重新讀一遍,一個月下來,緩存讀取往往超過新增內容本身。這次砍的正是賬單裏佔比最大的那塊。低價吸進來的新客要接住,已在付費的老客也要留住。Anthropic敢這麼降,是因為它的基本盤不在token差價上。它的收入主要是Claude Code帶動的開發者訂閲與企業席位,入門檔就算不賺錢,也能用存量賬戶補回來。OpenAI的賬,算法不同。它是真免費,但有條件。ChatGPT的免費版從來都有,過去跑的是上一代模型,旗艦升級、免費層接舊型號。而這一次,免費用戶拿到的是與旗艦同代發佈的Luna,免費與付費的代際差被抹平了。但成本是可控的,免費層有次數限制,跑的又是小模型,成本壓在低位,卻能拉來用戶。同時,Luna API照收0.10美元的輸入價,説明免費只限於C端,免費用戶消耗的算力,OpenAI可以記在獲客成本里。這套分層定價,已經成了海外大模型公司的共識。Google動手最早,旗艦Gemini 3.1 Pro(輸入2美元、輸出12美元),小模型是Flash家族,免費端為Flash-Lite。也正因為有這套多層結構托底,各家才不怕0.1美元的API不賺錢。國內的情況不太一樣。“國內旗艦雖然也不是完全不收錢,GLM、Kimi這些也賣會員(每月幾十塊),但付費滲透率很低,撐不起營收主體。C端訂閲只是零花錢,主要收入是API與ToB。”覃相表示。图片對Anthropic和OpenAI來説,0.1美元是門檻,門檻後面還有別的收入。但到了國內廠商這裏,能不能也成“門檻”,取決於除了裸價之外,它們手裏還有沒有別的牌。

03.海外低價潮下,國內頭部模型怎麼接?

綜合幾位從業者的判斷,牌有沒有,要分國內、海外兩個市場來看。在國內,影響有限。價格只是用戶決策的一個因素,海外低價能奪走的,主要是價格敏感型用戶。多位從業者表示,DeepSeek在國內的地位短時間內不會被動搖,原因有三點。一是中文語境的優勢;二是Claude在中國境內未提供服務,接入不穩定,實際使用成本遠高於官網標價;三是國內企業大量需求是私有化部署與微調定製,這是閉源模型進不來的市場。雲中江樹的體驗是,在國內,綜合使用成本更低的仍然是DeepSeek。國內其他幾家大模型廠商的處境各不相同,短期來看,各有各的壁壘。千問同走開源路線,是Hugging Face上衍生模型數量最多的開源家族之一,微調、部署的工具鏈最為成熟,開發者生態是它的護城河。豆包背靠字節的流量與廣告變現體系,靠C端免費做到國內用戶規模最大的AI原生應用,免費對它來説本就是獲客手段。Kimi押注長上下文,能讀長文檔的心智在國內仍屬獨一份,但如何把這份心智變成收入,是它自己的待解題。智譜深耕ToB,政企客戶與私有化交付構成基本盤,海外閉源廠商降價擠不進這個領域。但在海外,壓力是真的。Haiku 5.5會分流一部分原本傾向DeepSeek的開發者。覃相的判斷代表了一部分受訪者的看法,它確實帶來了壓力,但可能沒那麼大,因為海外同樣存在大量私有化部署與定製化需求,開源生態(如DeepSeek開放權重)能承接這部分需求,這是閉源API給不了的護城河。那麼接下來怎麼接?從業者的答案類似:拼價格意義不大,更重要的是補結構。一方面是補分層,建立旗艦+小模型+免費端的三層結構,讓旗艦敢於定價、小模型走量、免費端做滲透;另一方面是放大開源。閉源低價不可避免,但開源生態、私有化部署、定製化服務,是國內廠商手裏唯一不依賴裸價的牌。但國內廠商真要照搬三層結構,也有幾個卡點。首先是C端很難收費。在國內,免費已經是用戶的默認預期,誰先收費,誰就可能先流失用戶。海外用戶為軟件訂閲付費的習慣更成熟,國內廠商要在先免費鋪開之後再收費,難度大得多。图片圖源 / AI生成其次是缺少一個能撐起訂閲的產品。Anthropic敢在小模型上讓利,背後有Claude Code帶來的開發者訂閲和企業席位兜底。國內各家的編程工具和會員產品還在起步階段,訂閲收入還托不住入門價的補貼。各家離補齊的距離也不一樣。豆包底子最好,C端滲透已經基本完成,且已經在推行會員訂閲;Kimi缺在獨立的輕量模型,7月它用開源旗艦K3打了一輪技術牌,但當對手都在不斷降價,缺乏低價獨立小模型的產品線,可能將大批開發者拒之門外。值得注意的是,小模型並不需要獨立的研發線,行業通行的做法是旗艦蒸餾,邊際成本遠低於一次旗艦迭代,Kimi缺的並非能力,而是優先級排序。DeepSeek的API這一層最完整,Flash檔、非高峯半價、開源權重都在,缺的是給C端講一個收費的故事;智譜是另一種情況,免費端有清言、訂閲有會員和Coding Plan、B端有私有化部署,三層都具備,但清言的用戶規模與豆包、DeepSeek存在明顯差距,三者之間沒有形成有效協同。海外廠商敢把0.1美元當門檻,是因為門檻後面還有訂閲、緩存、工具與企業服務這幾份收入。如今小模型變成入口,token差價不再是利潤主體,國內廠商真正要補的,是門檻背後那套收錢的結構。*題圖由AI生成。

本文為專欄作者授權創業邦發表,版權歸原作者所有。文章系作者個人觀點,不代表創業邦立場,轉載請聯繫原作者。如有任何疑問,請聯繫editor@cyzone.cn。

來源:創業邦 · cyzone.cn