梁文锋、马斯克同日上新:DeepSeek暂未涨价,Grok 4.6单任务成本与Kimi K3持平,中美大模型价差正在收窄 | 每经网 每经网首页丨 宏观丨 金融丨 公司丨 视频丨 券商丨 IPO丨 基金丨 汽车丨 房产丨 新文化丨 未来商业丨 文创通丨 城市丨 每经商学院 要闻 每经网首页 > 要闻 > 正文 梁文锋、马斯克同日上新:DeepSeek暂未涨价,Grok 4.6单任务成本与Kimi K3持平,中美大模型价差正在收窄 2026-08-13 17:36:34 当地时间8月12日,DeepSeek与马斯克旗下SpaceXAI同日发布新模型。从最新评测来看,两款模型均进一步逼近全球头部水平。其中,SpaceXAI的Grok 4.6除了在性能上追平OpenAI的旗舰模型,更是在单任务成本上与Kimi K3持平。能力差距缩小的同时,中美大模型之间悬殊的价格差距正在发生变化。 每经记者|罗雪琳 每经编辑|兰素英 8月12日,DeepSeek与马斯克旗下SpaceXAI同日发布新模型DeepSeek-V4-Pro和Grok 4.6,新一轮大模型竞争再次升温。 从最新评测来看,两款模型均进一步逼近全球头部水平。其中,DeepSeek-V4-Pro在多项智能体相关测试中超过Anthropic的Claude Opus 4.8;Grok 4.6则在Artificial Analysis智能指数中追平OpenAI旗舰模型GPT-5.6 Sol。 能力差距缩小的同时,中美大模型之间悬殊的价格差距也在发生变化。摩根士丹利最新研报显示,中国大模型API平均价格过去一年明显上涨,而美国闭源模型价格近期持续下降,中美大模型价格差距正在收窄。 摩根士丹利指出,中国大模型市场的竞争重点正在从“价格战”转向“智力战”。 DeepSeek-V4-Pro正式版Agent性能大幅提升,多项测试超过Claude Opus 4.8,此前预告的“大幅涨价”暂未落地 8月12日晚,DeepSeek更新官方API文档,正式上线旗舰模型DeepSeek-V4-Pro-0813,API及Chat端已同步更新。 这是继7月31日DeepSeek-V4-Flash-0731正式上线后,DeepSeek V4系列迎来的又一次更新。 从DeepSeek公布的评测结果来看,此次V4-Pro正式版的主要提升集中在Agent能力。 与DeepSeek今年4月发布的V4-Pro预览版相比,正式版在多项Agent相关测试中的成绩明显提高。其中,考察软件工程能力的DeepSWE得分由12.8升至62.7;高难度数据科学任务测试DSBench-Hard得分由31.1升至67.2;终端操作能力测试Terminal Bench 2.1得分由72.1升至87.9;网络安全测试Cybergym得分由52.7升至83.3;HLE带工具测试则由48.2升至60.0。 DeepSeek还将V4-Pro与Anthropic旗下的Claude Opus 4.8和Fable 5进行了比较。官方公布的评测数据显示,V4-Pro在多项测试中超过Claude Opus 4.8,与Fable 5则各有胜负。其中,在Terminal Bench 2.1中,V4-Pro得分87.9,与Fable 5的88.0基本持平;在Cybergym中,V4-Pro以83.3略高于Fable 5的83.1;在DSBench-FullStack中,V4-Pro得分71.1,低于Fable 5的77.2。 8月13日,半导体与AI研究机构SemiAnalysis在社交平台发文称,DeepSeek-V4-Pro在Agent任务上的表现大幅超过英伟达Nemotron 3 Ultra。其引用的Terminal Bench 2.1数据显示,Nemotron 3 Ultra得分53.9,V4-Pro则达到87.9。 除性能升级外,V4-Pro支持100万Token上下文窗口和最高38.4万Token输出,并同时支持思考与非思考模式,其中思考模式默认开启。DeepSeek官方API文档显示,新模型还支持工具调用等功能,并同时兼容OpenAI和Anthropic两套API格式。 不过,在模型性能明显提升的同时,DeepSeek此前预告的API“大幅涨价”并未随V4-Pro正式版上线一同落地。 截至8月13日,DeepSeek官方API价格页面显示,V4-Pro每百万Token缓存命中输入价格为0.025元,缓存未命中输入为3元,输出为6元,与此前V4-Pro预览版定价相同。V4-Flash对应价格分别为0.02元、1元和2元。 目前,DeepSeek仍在官方价格页面明确提示,计划近期整体上调DeepSeek API服务定价,且“预计涨幅较大”,具体方案以正式通知为准。也就是说,截至8月13日V4-Pro正式版上线,DeepSeek此前预告的这轮API调价尚未实施。 Grok 4.6性能追平OpenAI旗舰模型,单任务成本与Kimi K3持平 当地时间8月12日,SpaceXAI发布新一代大模型Grok 4.6,这距离上一代Grok 4.5发布仅一个多月。Grok 4.6主要面向长时间运行的AI智能体,以及更复杂的交互和视觉任务。 从AI模型评测机构Artificial Analysis的最新评测结果来看,Grok 4.6的综合得分已经追平OpenAI旗舰模型。 Artificial Analysis 8月12日公布的数据显示,在最新版本的Artificial Analysis Intelligence Index(智能指数)中,Grok 4.6获得61分,与OpenAI的GPT-5.6 Sol并列,低于Claude Opus 5的63分和Claude Fable 5的62分,高于Kimi K3的60分和DeepSeek-V4-Pro的53分。 Artificial Analysis将这一指数用于综合衡量不同模型的能力表现,并明确标注分数越高越好。该指数综合了9项评测,包括用于测试高经济价值职场任务的GDPval-AA v2、终端操作测试Terminal-Bench v2.1,以及Humanity's Last Exam、GPQA Diamond等。 性能提升的同时,Grok 4.6并未同步涨价。SpaceXAI公布的价格显示,新模型每百万Token输入和输出价格分别为2美元和6美元,与上一代Grok 4.5保持一致。相比之下,Claude Opus 5的每百万Token输入和输出价格分别为5美元和25美元,GPT-5.6 Sol分别为5美元和30美元。 Artificial Analysis从完成一项智能指数测试任务所产生的实际Token消耗出发,对不同模型的单任务成本进行了测算。结果显示,Grok 4.6完成一项测试任务的平均成本为0.84美元,与Kimi K3持平。 马斯克也在新模型发布后密集宣传Grok 4.6。媒体8月13日报道称,模型上线后约两小时内,马斯克转发了约10条相关推文,并称Grok 4.6“智能、快速且性价比超高”,在同时考虑智能水平、速度和成本的情况下“客观上是第1”。 中美大模型价差正在收窄,中国市场从“价格战”转向“智力战” DeepSeek此次暂未兑现此前预告的“大幅涨价”,但从更长的时间维度看,中国大模型的价格正在整体上行。 摩根士丹利8月9日发布的研报《告别价格战,打响智力战》(Intelligence War Over Price War)显示,其统计字节跳动、阿里巴巴、百度、腾讯、MiniMax、智谱、月之暗面和DeepSeek等厂商官方报价后发现,2026年第二季度,中国大模型平均API输入价格已经升至每百万Token 4.9元,输出价格升至21.9元,相比2025年第一季度的3.3元和12.2元,分别上涨约48%和80%。 摩根士丹利认为,中国大模型行业正在建立更加健康的商业化环境,竞争重点也在从价格转向模型能力。8月8日,DeepSeek曾预告将“大幅”上调API价格。摩根士丹利认为,这一变化可能与V4系列需求增强带来的定价能力提升、维持合理毛利以支持前沿模型持续投入,以及推理成本等因素有关。随着模型能力和规模继续提升,中国新一代大模型的定价可能进一步上升,行业竞争将更多转向模型能力和算力供给。 研报进一步指出,“模型智能,而非价格,才是大模型长期竞争地位的关键决定因素”。原因在于,头部模型厂商可以推出价格更低、能力稍弱的模型进入大众市场,但普通模型厂商要反过来追赶至最前沿水平则困难得多。持续提升前沿模型能力还需要大量训练和算力投入,单纯依靠低价争夺市场可能压低毛利,并进一步限制下一代模型研发所需的资金。 中国模型涨价的另一面,则是美国头部模型价格下降,中美之间悬殊的模型价格差距正在缩小。 摩根士丹利8月12日发布的另一份研报指出,2025年一季度中国大模型输入、输出API均价仅分别占到美国同行的6%、5%,到2026年二季度,这两个指标的占比已上涨至 19%与14%。随着中国模型价格上涨,以及美国厂商继续下调模型价格,这一差距预计还将进一步收窄。研报认为,中国模型已经“不再像过去那么便宜”,与此同时,美国厂商特别是中低端模型仍存在进一步降价空间。 从Silicon Data的LLM Token价格指数也可以看到这一变化。截至2026年8月,闭源模型Token价格指数已从此前超过4美元的高位快速降至3.07美元;同期,开源模型Token价格指数约为0.66美元。摩根士丹利指出,开源模型使用比例上升与闭源模型降价正在共同推动整体Token价格下降。 免责声明:文章内容和数据仅供参考,不构成投资建议。投资者据此操作,风险自担。 封面图片来源:每经记者 兰素英 摄 如需转载请与《每日经济新闻》报社联系。 未经《每日经济新闻》报社授权,严禁转载或镜像,违者必究。 读者热线:4008890008 特别提醒:如果我们使用了您的图片,请作者与本站联系索取稿酬。如您不希望作品出现在本站,可联系我们要求撤下您的作品。 上一篇文章 深交所向荣盛石化股份有限公司发出监管函 返回每经网首页 下一篇文章 华康洁净:中标金华市中心医院新院区项目净化系统采购及安装 相关文章 获马斯克关注!Kimi K3搭载2.8万亿参数开源挑战GPT、Claude双雄,涨价潮下赛道竞争加速转向商业价值兑现 Kimi冲击美EDA巨头暴跌 Kimi K3风暴第四日 月之暗面回应争议 热文精选 双场中芯,一轨怡心 亚马逊卖家大会首次落子西部,为什么是四川? 站在APEC“中国年”中场,成都如何推动全球人工智能规则重塑? 把“教育链”扎进产业链 四川推进教育科技人才一体改革综合试点 从“数字底座”到敏捷治理:APEC数字周外宾近距离探寻“成都方案” 点击排行 1 A股跳空高开,尾盘却突发跳水,超4300股下跌!发生了什么? 2 见证历史,普京首次登上俄日争议岛屿!他亲自指挥太平洋舰队,点名日本:日本觊觎俄领土,还对俄实施无端制裁 3 四大指数齐涨,超3000只个股下跌!医药股大爆发,贵金属板块走弱|A股早盘 4 DeepSeek-V4-Pro正式版深夜上线,多项测试逼近Claude Fable 5;Cerebras Q2营收增74%,硬件收入下滑拖累股价盘后一度跌17%|全球科技早参 5 梁文锋、马斯克同日上新:DeepSeek暂未涨价,Grok 4.6单任务成本与Kimi K3持平,中美大模型价差正在收窄 6 lululemon对手ALO在华正式开售,天猫店铺成交额1分钟破1000万元!一双袜子380元,销量最高的裤子1150元,已售出9000多条 7 超4300股飘绿!贵金属领跌,黄金、白银跳水;13天9板传智教育跌停;生物科技、CRO领涨,创新药近10股涨停|A股收盘 8 卫龙美味(09985.HK)上半年新品拓展与健康方向并举 蔬菜制品收入贡献持续提升 9 收评:三大指数冲高回落集体收绿 10 长鑫科技登顶A+H市值最高上市公司!港股分化,联想集团暴涨20%创新高;科网股普跌,黄金股、內房股下挫|港股收盘 欢迎关注每日经济新闻APP