繁體
  • 简体中文
  • 繁體中文

熱門資訊> 正文

毛利率被吸至-50%!硅谷獨角獸反水OpenAI 中國開源模型成救星

2026-09-22 11:18

財聯社9月22日訊(編輯 瀟湘)估值達156億美元的法律AI獨角獸Harvey,其業務核心原本是訓練OpenAI的GPT-4等AI模型,為律師提供專業服務。然而,近期急劇膨脹的算力與調用成本,正迫使這家明星初創公司重新審視對AI巨頭的深度依賴。

據知情人士透露,在3月對其AI智能體進行更新后,Harvey的客户使用量激增,但毛利率卻急劇下降——從年初的約50%跌至了6月的-50%。

如今,面對成本失衡,Harvey正選擇加入越來越多軟件企業的行列,倒向開放權重模型生態,其中便包括實力日益精進的中國開源模型方案。相較於美國AI巨頭昂貴的閉源專有模型,這些開源架構不僅大幅降低了調用門檻,還賦予了Harvey等企業利用自身私有數據深度定製專屬模型的自由度。

擁抱開源模型

據悉,紅杉資本和General Catalyst等頭部風投機構目前也在力挺這一技術轉向。該路徑不僅為企業卸下了沉重的成本包袱,更將核心技術控制權從OpenAI和Anthropic的手中奪了回來。而隨着OpenAI與Anthropic緊鑼密鼓地籌備各自備受矚目的IPO,初創企業的這股「去巨頭化」浪潮,恐將分流這兩大巨頭可觀的商業化營收。

今年8月,Harvey已推出了首款自研模型,其底層由中國大模型開發商月之暗面的Kimi K3驅動。據介紹,該模型在性能上逼近Anthropic旗下的頂配方案,而綜合成本僅為其一小部分。據接近該項目的內部人士稱,得益於新模型的上線以及對整體AI調用架構的精細化重構,Harvey的毛利率現已成功重回正值。

與此同時,醫療科技初創公司Abridge最近也宣佈,正在基於英偉達的開源架構構建一款適用於臨牀環境的定製基礎模型。AI智能客服獨角獸Decagon則透露,目前已有80%的諮詢通過其自有模型處理。

在金融科技領域,Ramp與Rogo等先鋒企業也破天荒地試水自主訓練模型;而在編程賽道,剛剛被SpaceX收入囊中的Cursor,以及估值高達480億美元的Cognition,更是在早期便率先推出了定製化模型。

Ramp聯合首席執行官Karim Atiyeh表示,雖然此前模型構建對Ramp來説成本過高,但該公司在6月完成7.5億美元融資后,正考慮開展相關工作,因為開放權重模型的性能已大幅提升。「一年前這完全説不通。但現在開始變得很有道理了。」

面對持續走高的算力支出,正在籌備新一輪融資的Atiyeh直言,「如果一家公司到現在還不去思考算力成本、不着手做定向優化,那完全是在拿未來冒險。」

算力賬單壓垮初創企業

Harvey總裁兼聯合創始人Gabe Pereyra坦言,直到去年年底,AI應用的性能主要取決於其底層模型。訓練這些基礎模型是一項極其昂貴的工程,通常由那些最大的AI實驗室負責。相比之下,當時訓練定製模型的努力意義不大,因此像Harvey這樣的公司必須花大價錢購買最好的基礎模型。

然而,飛漲的底層API調用開銷正將這類應用層企業逼入牆角。

Harvey表示,今年以來其平臺的Token消耗量呈幾何級暴漲20倍。團隊高層深知,如果繼續無休止地依賴OpenAI和Anthropic的高價模型,公司迟早會被成本拖垮。

事實上,儘管Anthropic與OpenAI今年也相繼上線了走量版的平價模型,但兩家公司目前都在基礎訂閲費之外,對企業的模型使用量額外收費。這一改動讓那些推行「Tokenmaxxing」(詞元消耗最大化)策略的企業猝不及防。例如,Uber此前極力鼓勵內部研發人員敞開使用Anthropic的Claude Code,結果到4月份,全年的AI預算便已被提前耗盡。

「如果不通過微調專屬模型來優化單位成本,從本質上講你的商業模式就算不上高效,」舊金山早期風投機構Basis Set創始人兼管理合夥人Lan Xuezhao斷言。她補充道:「如果公司不致力於構建供自身使用的模型,我認為它將難以獲得融資。」

目前,Anthropic和OpenAI也更加積極地進軍初創企業領域。今年,兩家公司都在大力招聘,發佈插件,並在法律、金融和醫療保健等行業推出試點項目。

在Anthropic辦公室最近舉辦的一次投資者論壇上,與會者討論了自主構建模型的初創企業日益興起這一現象。據一位知情人士透露,Anthropic在一張關於如何「把握價值曲線」的幻燈片中提到了Rogo和醫療健康初創公司OpenEvidence等企業。該公司還提到了Harvey在人工智能領域的內部工作,並提醒道,這家初創公司仍需要依賴Anthropic最先進的模型之一——Claude的Opus——來處理最棘手的任務。

儘管如此,一些初創公司仍擔心,如果這些AI巨頭切斷其訪問權限,會發生什麼情況。就在SpaceX完成對Cursor的收購僅一周后,OpenAI便宣佈暫停這家編程初創公司對其模型的訪問權限,理由是馬斯克旗下的公司過去曾多次違反OpenAI的服務條款。

相比之下,開放權重模型提供了一種替代方案。OpenAI和Anthropic的封閉式模型將其內部參數嚴加保密,而開放權重模型則會公開這些參數,供外部開發者下載並進行修改,這一過程被稱為「后訓練」(Post-training)。

據兩位知情人士透露,有些公司——如Kimi K3的開發商月之暗面,甚至會派出自己的工程師,幫助客户將現成的模型微調為定製化的內部模型。

無論如何,從昔日的「寄生巨頭」到如今的「自立門户」,Harvey等硅谷初創們的集體倒戈不僅是初創企業應對算力成本危機的自救之舉,更標誌着生成式AI商業格局的深刻裂變。

隨着開源生態與自研方案逐漸抹平頂尖模型的技術鴻溝,應用層企業正在重新掌握議價權與生存命脈。對即將邁入二級市場的OpenAI與Anthropic而言,如何在維持高昂研發支出的同時守住搖搖欲墜的商業客户壁壘,將成為其IPO前夕必須作答的一道關鍵命題。

風險及免責提示:以上內容僅代表作者的個人立場和觀點,不代表華盛的任何立場,華盛亦無法證實上述內容的真實性、準確性和原創性。投資者在做出任何投資決定前,應結合自身情況,考慮投資產品的風險。必要時,請諮詢專業投資顧問的意見。華盛不提供任何投資建議,對此亦不做任何承諾和保證。