中国大模型,“卷”到海外

来源:中国新闻周刊2026-08-18 10:16

中国新闻周刊记者:陈惟杉

发于2026.8.17总第1248期《中国新闻周刊》杂志

“没人抱怨人工智能的成本,直到账单贵得离谱。”这是美国创业者Ben Cera 7月底在社交媒体发布的帖文。

过去一段时间,这是不少美国开发者、企业的共同感受,中国的开源模型以极高的性价比将他们从高昂的人工智能账单中“拯救”出来。

当更多使用中国大模型的声音从美国传来,人们甚至描绘出一幅图景,中国的大模型像其他中国商品一样,以性价比优势席卷全球,甚至倒逼OpenAI、Anthropic等美国巨头降价。

一场争夺企业用户的竞争确实正在展开,而中国大模型想要在海外站住脚跟却并不容易。

AI账单失控了

去年10月,Ben Cera创办了一家一人公司Polsia,给其他公司提供策划、编程、市场营销等方面的人工智能生产力。尽管他知道Anthropic和OpenAI的模型很贵,但是最初他并不在意,更关心客户是不是对公司开发的人工智能产品感兴趣。

今年3月,Ben Cera意识到成本失控,Polsia受到越来越多关注,付费用户从500人上涨到5000人,他收到的AI账单达到50万美元。当时他使用的模型是Anthropic旗下的Opus和Sonnet。他需要更多投资,“这样才能缓解AI账单带来的痛苦”。

投资给了Ben Cera喘息机会,但是他知道公司每月使用大模型的花销正向100万美元迈进。他极力平衡成本与收入,随着用户增长,今年4月,他收到了一张接近120万美元的AI账单。他面临选择,要么提高服务收费,要么寻找降低成本的方式,而他无法用Anthropic的模型做到这点。“如果用户数量从5000人上涨到5万人,我3个月之内就会把融资花光,所以在扩大规模之前,必须先解决成本问题。”

多数Polsia用户只会提出简单需求,Polsia可以提供相对标准的答案,需要尽可能低的成本提供服务,向用户收取较低价格,从而吸引更多用户。这是Ben Cera当时面临的问题。

他开始通过租用GPU部署开源模型,两个月后的 6月,公司在人工智能方面的支出降低到10万美元左右,他使用了Minimax和GLM模型。“这意味着公司能够盈利,并且以更低价格向客户提供服务,甚至可以提供免费版服务。”

在Ben Cera帖子下面的留言中,有人创造了一个新词Chinamaxxing,戏仿Tokenmaxxing,意指人们应该像此前不遗余力地“烧”Token一样最大程度使用中国大模型。

当下,Chinamaxxing在硅谷的开发者、初创公司中已经是一股风潮。第三方模型聚合平台OpenRouter数据显示,8月3日到7日这一周,DeepSeek-V4-Flash新旧版本调用量共计11.31万亿Tokens,GPT5.6 Luna调用量为3.54万亿Tokens,相差近三倍。而在此前一周大模型调用榜单中,排名前五的产品均是中国模型。

这种趋势已经持续一段时间。OpenRouter数据显示,用户消耗中国模型Token占比增幅显著,2025年上半年这一比例只有4.5%,今年一路上涨,达到如今的百分之五六十。

“这并不意味着中国模型占据了美国企业市场一半以上的份额。OpenRouter 更多代表的是开发者、初创公司使用大模型的趋势。”人工智能第三方数据公司XSignal CEO刘震告诉《中国新闻周刊》,今年美国企业用户市场中,开源模型占比不到15%,而中国模型在其中占比为20%—30%,整体占比在3%—5%,2025年这一比例约为1%。

因此,还难以说美国企业集体转向中国大模型,但是不论是Ben Cera这样的创业者,还是一些大公司,都开始感受到AI账单的压力。

从今年7月开始,微软已经为各业务部门设置了“AI Token预算目标”。还将GPT 5.6设置为内部默认模型,原因是它更便宜。公司CEO纳德拉在6月参与一档播客节目时说,微软内部存在很多Tokenmaxxing的情况,他自己承认疯狂刷Token很上瘾。但是生产率提升的边际收益,必须匹配Token的边际成本。不是每个问题都值得调用最强、最贵的前沿模型,模型跑得更久、Agent开得更多,不等于最终成果更好。

大模型“价格战”?

截至 2026 年 7 月,DeepSeek-V4-Flash的输入Token价格为每百万 0.14 美元,而 OpenAI的GPT 5.5的报价是5美元,差价在4倍到100倍之间浮动。OpenRouter表示,中国开源模型的价格普遍比 Anthropic、OpenAI 的旗舰产品便宜60%到90%。

就在过去几周,一张图开始在海外社交平台流行,横坐标反映大模型完成一项任务的费用,纵坐标反映大模型智能水平,这是一张衡量大模型“性价比”的图表。其中多数模型被认为处在DeepSeek的“斩杀线”之下,换言之,这些模型智能水平不及DeepSeek-V4,但是价格更高。

随即,OpenAI宣布下调模型价格,GPT 5.6系列7月9日才正式发布,其中Luna版本上线三周就被砍到原价的五分之一。Luna是GPT 5.6系列中速度最快、价格最低的一档,主要面向批量内容处理、信息提取、客服、翻译、代码辅助和轻量Agent等高频任务。这让人们嗅到了中美大模型“价格战”的意味。

刘震认为,用价格战形容当前模型市场的情况并不准确,这不是一个简单的国产模型把OpenAI、Anthropic模型价格“打下来”的故事,更多是模型应用进入新阶段的必然结果。

观察OpenAI当前营收结构会发现,目前营收主要来自个人订阅,企业业务占比很小。这让OpenAI、Anthropic都在将目标瞄准企业级用户。

对于企业用户而言,并非任何场景都要使用智能水平最高的模型,而是对使用场景分层,适配不同模型,这也是OpenAI、Anthropic等公司降低一些智能水平相对较低的模型的价格的原因,希望将产品“分层”,比如让Luna降价,应对一些对成本敏感,但是所需智能水平比较低的工作,从而打开B端市场,但是最顶级的模型并未调价。

相比于“降价”,刘震更愿意称之为调整产品线,拉开廉价、中端、高端和顶端模型之间的价差。“在美国,大模型路由的概念已经比较成熟,企业会根据应用场景选择不同智能水平的模型,国内类似的概念也在发展。”

美国外卖平台DoorDash联合创始人、CTO Andy Fang 7月初在社交媒体上称,公司开始将较低级别的工作交给Kimi K2.6处理,只将“最困难的工作”交给Anthropic旗下的Fable 5处理,这样的模型组合相比之前成本更低,效率却大幅提升。

一位大厂员工也告诉记者,一种比较流行的用法是用Opus来做规划,然后执行就让Sonnet,甚至Haiku去做。因为像Opus这样的模型确实很贵,消耗太快了,公司就上了很多便宜的模型,包括DeepSeek的模型,有很多人开始用。

“之前国产大模型的成本优势主要来自模型(推理)精度、MoE结构、相对小的模型体量和稀疏机制等模型本身的特性。”上海财经大学特聘教授胡延平告诉记者,对于国产模型,未来要形成快慢不同、水准不同、模态不同、功能不同的模型梯度和功能组合,成本结构也因此不同,结合分时分层等精细化运营机制,提高营收水平。

对于企业用户而言,真正的成本不是“每个Token的价格”,而是每次解决任务的价格。刘震认为,对于企业用户而言,模型比拼的维度从单纯的智能水平排名,变为完成一个任务的质量与成本的平衡。

例如,Kilo Code于2026年6月发表的一份测试研究显示:基于开源大模型的任务解决测试,每次平均成本0.22美元,成功率46.7%;Claude Opus 4.8、Sonnet 4.6 和GPT 5.5的每次平均成本则是0.79美元,但成功率是65.6%。这意味着如果考虑成功率,两者的成本差距并非想象的那么大。

怎么赚钱?

最近DeepSeek计划陆续通过分时定价、V4 Pro正式版提价等,提高整体的价格水平。这其实也引发一个疑问,就是国产模型的极致性价比能否持续,后续该如何转化为商业上的成功。

“DeepSeek此前的低价有阶段性促销,补贴扩大用户量的考虑。”胡延平认为,国产模型与美国模型的价格差,也有市场基础、用户支付能力、用户付费习惯差异等方面的原因,国产模型如果价格大幅度提高,会严重影响用户市场导入速度。

尽管在声量上国产模型已经在挑战OpenAI、Anthropic等公司的闭源大模型,但是从营收的角度来看,两者还不可同日而语。

今年5月中旬,Anthropic公布的 ARR(年度经常性收入)为470亿美元。之后,Anthropic没有再公布ARR数据。第三方数据公司TickerTrends在7月中旬对Anthropic做出的ARR估算是741亿美元。华尔街甚至猜测,2027年底,Anthropic的ARR将达到4000亿美元。

OpenAI的ARR增长一度缓慢。但是今年7月底,OpenAI高管在内部会议上宣称,7月的ARR“超过了整个二季度之和”。

相比之下,中国模型公司如月之暗面ARR在2026年3月首次突破1亿美元,5月达到2亿美元,6月站稳3亿美元关口,在3个月内翻了3倍。其中,API收入已占公司整体收入七成以上并持续提升。

刘震认为:“智谱、月之暗面等中国初创模型公司,与美国模型公司C端营收已经占比七八成,再去做B端市场增量不同。像API已经是Kimi的主要业务,其基本已经放弃C端市场。”

他表示,这与中国互联网的流量环境有关。在国内,流量入口掌握在互联网巨头手中,任何初创公司想要获得流量,曝光成本极高,比如月之暗面在获得融资之初一度砸钱让月活达到3000万级别,之后投入的可持续性与效果都存疑,这也是“六小虎”纷纷放弃C端市场的原因之一。“目前国内大模型C端用户市场开拓比较好的只有字节跳动的豆包,以及阿里巴巴的千问和夸克。如果C端用户规模有限,更多只能通过企业调用API赚钱。”

这也是市场对于中国大模型在美国企业市场打开一定市场空间感到兴奋的原因。一位投资人向记者直言,像智谱的月活只有百万级,如果仅看C端用户,其实无法支撑其市值。

当前,确实有更多全球大企业开始使用中国模型。比如微软就向媒体证实,正在探索将经过微调并部署在Azure上的DeepSeek V4版本,用作 Copilot Cowork的低成本模型选项,以替代目前由OpenAI和Anthropic模型承担的部分工作负载,同时把该产品从固定收费改成按用量计费。西门子、Airbnb等企业也表态正在使用DeepSeek、千问等中国模型。

刘震认为,中国模型还没成为美国企业,特别是大企业的主流选择。“大企业采购模型时受到诸多因素限制,不只是考虑性价比,还要考虑模型运行是否稳定,数据是否安全等因素。比如前一段时间Kimi K3就出现宕机,这意味着企业硬件能力无法匹配,企业在采购模型时也会考虑这些问题。中国模型公司在进入美国模型核心市场方面还处在初级阶段。”

一位在全球布局业务的初创企业负责人告诉记者,国产大模型目前能力边界比较明确,比如只具备不错的中文、英文能力,其他语种的能力比较欠缺,而类似的细节是出海时绕不开的问题,“性价比只是中国大模型出海的开始”。

《中国新闻周刊》2026年第30期

声明:刊用《中国新闻周刊》稿件务经书面授权

  • 餐饮转向质量优先,老乡鸡跨过2000家门店

    在餐饮行业步入存量博弈、不少品牌放缓拓店节奏的当下,中式快餐头部品牌老乡鸡迎来发展新节点。记者获悉,截至2026年8月底,老乡鸡全国门店突破2000家,覆盖9省61城,其中直营门店超1000家,加盟店
    环球网
    2026-09-29 16:40
  • 5万亿元城市,“开抢”年轻人

    每经记者|淡忠奎 过去10年,北京人口结构经历明显转变。 2015年,北京20~29岁常住人口达到461.8万人,占全市常住人口的21.3%,明显高于全国平均水平。但10年后,这一数字降至248.
    每日经济新闻
    2026-09-29 10:14
  • 口腔种植体集采接续采购启动 种植牙迈入集采2.0时代

    小小一颗牙,关系大健康。口腔健康是全身健康的重要组成部分,牙齿缺失,不仅影响咀嚼进食、言语容貌,还会间接影响消化功能与生活质量。缺牙修复,也因此成为很多群众迫切的民生需求。 国家医保局28日举办口腔
    中央广播电视总台中国之声
    2026-09-29 10:14
  • 2025年中国政府采购规模33212.96亿元

    中新社北京9月28日电 (记者 赵建华)中国财政部28日公布的数据显示,2025年全国政府采购规模为33212.96亿元(人民币,下同)。其中,货物、工程、服务政府采购规模分别占全国政府采购规模比例为
    中国新闻网
    2026-09-29 10:14
  • 中秋假期中国跨区域人员流动量超6.4亿人次

    中新社北京9月28日电 (记者 刘文文)中国交通运输部28日发布数据,2026年中秋三天假期(9月25日—9月27日),全社会跨区域人员流动总量为64316.1万人次,日均为21438.7万人次,比2
    中国新闻网
    2026-09-29 10:13
  • 报告指出,中国城市休闲化迎来“人均时代”

    中新网上海9月28日电 (记者 李佳佳)《2026中国城市休闲化发展指数报告》28日在上海正式发布。报告首次以“人均评价”为导向发布评价结果,显示中国城市休闲化发展正从“规模竞争”转向“密度比拼”,“
    中国新闻网
    2026-09-29 10:13
  • 前8月中国境内民营上市公司新增49家

    中新社北京9月28日电 (记者 陈康亮)据中国上市公司协会28日发布的统计月报,今年前8月,中国境内民营上市公司新增49家。 统计显示,截至2026年8月31日,中国境内股票市场(下称“全市场”)共
    中国新闻网
    2026-09-29 10:13
  • 加速走向全球市场 今年1至8月我国挖掘机出口量超内销

    根据中国工程机械工业协会最新数据,今年1—8月,我国挖掘机累计出口量超过国内销量,出口同比增长31.8%,增速远超内销。 业内人士表示,挖掘机出海火热,一方面是海外需求回暖,亚非拉地区矿山开发需求旺
    央视财经
    2026-09-29 09:50
  • 今年前8月全国社会物流总额243.6万亿元 同比增长4.9%

    中国物流与采购联合会今天(29日)公布今年1—8月份物流运行数据。数据显示,今年1—8月份,我国物流运行保持稳中有进发展态势、物流市场规模稳步扩张,国际物流通道扩容提质。 今年1—8月份,全国社会物
    央视新闻客户端
    2026-09-29 09:49
  • 中信集团董事长奚国华获颁哈萨克斯坦“二级友谊勋章”

    2026年9月21日,中信集团党委书记、董事长奚国华在哈萨克斯坦驻华大使馆会见哈萨克斯坦第一副总理纳利巴耶夫,并获颁哈萨克斯坦总统托卡耶夫签发授予的“二级友谊勋章”。哈萨克斯坦驻华大使努雷舍夫,中信集
    中新网上海
    2026-09-28 14:49
  • 金价回落叠加节日促销 黄金零售市场迎来消费旺季

    本报记者 孟 珂 进入9月,国际金价回落带动国内金饰挂牌价持续下行,本月下旬,主流品牌足金零售价回落至约1290元/克附近,单克价格较前期高点下跌超100元,市场观望情绪有所缓和,不少消费者抓住价格
    证券日报
    2026-09-28 09:41
  • AI需求催热PCB行情 上市公司布局高端产能

    本报记者 许林艳 随着AI(人工智能)技术加速落地,AI服务器市场需求迎来爆发式增长,直接带动PCB(印制电路板)产业供给端结构性变革,行业整体景气度持续升温。 “AI服务器需要大量高性能PCB,
    证券日报
    2026-09-28 09:40
  • 算力市场需求持续旺盛

    本报记者 郭冀川 随着人工智能应用范围持续扩大,一批A股上市企业加速向智算中心、GPU(图形处理器)算力租赁、算力调度平台等赛道倾斜资本与产业资源。2026年下半年以来,A股上市公司频繁披露算力领域
    证券日报
    2026-09-28 09:40
  • 去景点化、重体验感、全域漫游,进阶的“中国游”全球圈粉

    9月的深圳,热浪未退,华强北市场人声鼎沸。来自全球各地的游客带着拉杆箱穿梭在商铺之间,挑选智能眼镜、无人机、运动相机等新潮数码产品,沉浸式感受“中国智造”的魅力。刚在广州参加完展览会的印尼游客维妮,乘
    证券日报
    2026-09-28 09:39
  • “数智人文,创新生态”高端对话活动在上海长宁举办

    9月24日,“数智人文 创新生态”高端对话会暨ACM SIGGRAPH DAC城市公共数字艺术亚洲首秀在上海长宁举办。本次对话旨在以跨界智识的碰撞,形成可持续的数智人文交流机制,为对外合作、产业协作与
    环球网
    2026-09-28 09:31
  • 韩国航司把中国看作“盈利支柱”

    “中国正成为韩国廉价航司重要的盈利生命线。”据《韩国时报》25日报道,韩中航线客流持续回升,韩国廉价航空公司又获得北京、上海等热门航线的新增航权。对受成本上涨和亏损困扰的韩国廉价航司而言,中国航线正成
    环球时报
    2026-09-28 09:30
  • 早一步识别,多一份记忆:深圳二院义诊关注阿尔茨海默病黄金窗口期

    中国有认知障碍的老人已经达到5000万。这个数字背后,是从轻度认知功能障碍到严重痴呆的漫长过程——可能长达10到20年,患者在没有任何症状的时候,大脑里已经发生了病理改变。如何在这段“沉默期”里识别出
    环球网
    2026-09-24 16:07
  • 江西低空经济何以“乘风起飞”?

    中新网景德镇9月23日电 (记者 李韵涵)直升机、无人机、电动垂直起降航空器、大功率电推进系统……日前在江西景德镇举行的2026垂直起降飞行器大会上,一批低空装备和产业链成果集中亮相,这也成为观察江西
    中国新闻网
    2026-09-24 09:33
  • 低糖养生、小份零食化、加速出海,月饼市场呈现哪些新趋势?

    中秋月圆,饼香情浓。曾经的月饼,是中秋专属的节日仪式感,是走亲访友的节庆礼盒;而如今的月饼,早已跳出“中秋限定”的标签,变身日常零食、养生点心,甚至是出海好物,解锁了全新打开方式。 根据中国数据研究
    中央广播电视总台中国之声
    2026-09-24 09:30
  • 智能算力、先进存力,齐头并进

    随着人工智能快速发展,算力已成为不可或缺的新型信息基础设施。工业和信息化部数据显示,截至今年6月底,我国智能算力规模达2185EFLOPS(每秒百亿亿次浮点运算),围绕算力枢纽建成70余条算力大通道。
    人民日报海外版
    2026-09-24 09:26