熱門資訊> 正文
2026-09-08 10:38
不知名的低價AI模型「Ox-Alpha」突然出現並迅速走紅。在分別使用多種模型的美國OpenRouter的服務中,使用該模型的token數激增。超過了DeepSeek的「V4-Flash」,真實身份是……
中國的人工智能(AI)新興企業正推出低價格的AI模型。低於美國AI產品,甚至低於中國知名AI企業DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提價的機會擴大份額。
8月20日,不知名的低價AI模型「Ox-Alpha」突然出現並迅速走紅。在分別使用多種模型的美國OpenRouter的服務中,使用該模型的token數(數據量)激增。超過了DeepSeek的「V4-Flash」。
中國AI新興企業北京智譜華章科技(智譜)9月26日透露,Ox-Alpha的真實身份是該公司的「GLM-5.3-Flash」。每token的價格比提價后的DeepSeek便宜20%~70%。
性能也表現出色。專注於AI性能評測的美國調查公司Artificial Analysis的數據顯示,GLM-5.3-Flash在綜合性能上超越了DeepSeek V4-Flash的高端版「V4-Pro」。此外,截至9月9日價格下調至半價,性價比尤為突出。
2025年1月,DeepSeek發佈了低成本高性能的「R1」模型,引發全球關注。目前的V4是繼R1之后推出的旗艦型號。相比性能的提升,市場更受關注的是2026年8月17日的大幅提價。
爲了轉嫁基礎設施所需的費用,引入了提高token單價、在工作日白天進一步上調至原來的2倍的制度。結果,單價最高達到了提價前的12倍。
隨即推出低價方案的是智譜。中國互聯網巨頭阿里巴巴集團也於8月26日推出「Qwen3.8-Flash」。其價格與智譜的常規定價基本持平。
接連推出的是將顯示AI性能的參數數量減少的輕量版。這類模型名稱中大多帶有「Flash」,使用成本較低。
美國調查公司晨星(Morningstar, Inc)的分析師Chelsey Tam預測稱,「未來大部分需求將由低成本的Flash模型承擔,只有在需要高級處理時纔會使用旗艦模型」。背后是能夠自主完成各種任務的AI智能體的普及。
AI智能體需反覆進行規劃制定和錯誤修正,會消耗大量token。Chelsey Tam指出「隨着降低成本的需求日益增長,Flash模型正在興起」。
美國OpenAI於7月推出了低價版「GPT-5.6-Luna」,並於當月30日起將價格下調80%。首席執行官(CEO)薩姆·奧爾特曼表示「我們希望在各個價位提供最佳的價格與性能的平衡」。
美國谷歌也在8月13日,緊隨DeepSeek宣佈提價之后推出了「Gemini 3.7 Flash」。同時啟動了2026年內價格減半的促銷活動。
儘管如此,目前中國AI仍佔據優勢。按周觀察OpenRouter的token使用數量,在排名前五的模型中,有四個來自中國企業。從整體token使用數量來看,中國企業也佔據約一半的份額。低價的吸引力十分顯著。
瑞士金融巨頭瑞銀(UBS)的分析師熊瑋表示,「中國企業的研發費用不到美國巨頭的十分之一,價格也能控制在對方的10%~20%」。還採用了被稱為「MoE」的技術創新,即在模型中只調用處理所需的部分,從而實現低成本。熊瑋認為「中國企業不僅在追求高性能的競爭中,在低價競爭方面也逐步佔據優勢」。
美國政府對英偉達等的高性能AI半導體實施了對華出口管制,導致計算資源成為中國AI發展的瓶頸。
中國企業正積極應對。中國媒體報道稱,智譜針對GLM-5.3-Flash表示,用於推理的半導體全部為國產。
今后,中國AI的低價攻勢仍將持續。瑞銀的熊瑋指出,「再加上(公開技術信息的)開源戰略,有可能推動中國AI的全球市場份額擴大」。
日本經濟新聞(中文版:日經中文網)藤野逸郎 廣州