据法新社报道,国内大语言模型(LLM)市场的定价体系正面临持续的下行压力。本土企业不断下调产品售价以贴近成本线,导致国内与国际模型之间的价格鸿沟已拉大至数十倍。
近期,深度求索(DeepSeek)在发布DeepSeek-V4-Pro后,迅速将其应用程序接口(API)调用价格降至原标准的25%左右,在特定缓存命中场景下甚至低至10%。官方明确表示,自6月1日起该促销价将固化为长期标准,标志着低价运营成为常态。随后,小米也宣布其MiMo-V2.5系列大模型API在全球范围内永久降价,降幅在57%至99%之间。
目前,国内大模型订阅服务大致划分为三个价格梯队:40元人民币以下的入门级产品主要用于快速引流;80元至200元人民币的主流区间是各平台核心会员的定价带;而超过500元乃至上千元的高价产品,则主要面向长上下文处理、多模态交互及智能体(Agent)等高级功能。
相比之下,海外市场的ChatGPT、Claude和Gemini等主流大模型,其订阅费用普遍在20美元(约人民币135.97元)至250美元(约人民币1699.66元)之间,部分高端版本如Gemini Ultra和Claude Max的定价已逼近200美元(约人民币1359.73元)。
在API调用成本方面,国内外差异更为显著。据测算,DeepSeek-V4-Pro的综合调用成本已降至约9元人民币/百万tokens。而同级别的国际模型中,GPT-5.5长上下文版本约为374元人民币,Claude Opus约为204元人民币,Gemini 3.1 Pro约为149元人民币,国内外价差普遍达到20至40倍以上。
业内分析指出,这种巨大的价格差异不仅是技术路线的不同,更是商业战略分化的体现。OpenAI、谷歌和Anthropic等海外科技巨头倾向于维持高毛利率和企业级定价,以分摊高昂的算力与研发开销。而国内厂商则更多采用低价或补贴手段,旨在加速开发者生态建设和智能体应用的普及,通过压低token成本来抢占流量入口。
不过,在视频生成等算力密集型垂直领域,价格已开始回归成本。数据显示,字节跳动的Seedance 2.0模型生成单条15秒视频的费用,短期内从约0.65元人民币上涨至5元人民币,涨幅近7倍,反映出图形处理器(GPU)算力成本的实际压力。
整体而言,国内大模型产业正处于抢占生态入口与应对算力、训练及推理成本上升的双重博弈中。尽管部分企业营收保持增长,但短期亏损依然存在。长远来看,行业最终仍需在成本控制与商业盈利之间寻找最佳平衡点。
注:按1美元≈6.80人民币计算