DeepSeek V4-Pro与Grok 4.6同日发布,中美大模型竞争新格局
2026年8月12日,人工智能领域迎来重磅消息——DeepSeek与马斯克旗下SpaceXAI同日发布新模型DeepSeek-V4-Pro和Grok 4.6,新一轮大模型竞争再次升温。
DeepSeek V4-Pro:Agent能力大幅提升

DeepSeek于8月12日晚正式上线旗舰模型DeepSeek-V4-Pro,这是继7月31日V4-Flash发布后V4系列的又一次重要更新。此次正式版的主要提升集中在Agent能力方面。
根据DeepSeek公布的评测数据,V4-Pro正式版相比预览版取得了显著进步:
- 软件工程能力(DeepSWE):由12.8分提升至62.7分
- 高难度数据科学任务(DSBench-Hard):由31.1分提升至67.2分
- 终端操作能力(Terminal Bench 2.1):由72.1分提升至87.9分
- 网络安全测试(Cybergym):由52.7分提升至83.3分
与Anthropic旗下Claude Opus 4.8相比,V4-Pro在多项测试中实现超越,与顶级模型Fable 5则各有胜负。在Terminal Bench 2.1中,V4-Pro得分87.9,与Fable 5的88.0基本持平。
此外,V4-Pro支持100万Token上下文窗口和最高38.4万Token输出,同时支持思考与非思考模式,默认开启思考模式。新模型还兼容OpenAI和Anthropic两套API格式。
Grok 4.6:追平OpenAI旗舰模型
同日,SpaceXAI发布新一代大模型Grok 4.6,距离上一代Grok 4.5仅一个多月。该模型主要面向长时间运行的AI智能体以及更复杂的交互和视觉任务。
根据AI模型评测机构Artificial Analysis的最新数据,Grok 4.6在智能指数中获得了61分,与OpenAI的GPT-5.6 Sol并列。这一指数综合了9项评测,包括高价值职场任务测试、终端操作测试等。
更令人关注的是,Grok 4.6并未同步涨价,每百万Token输入和输出价格分别为2美元和6美元,与上一代保持一致。相比之下,Claude Opus 5的输入输出价格分别为5美元和25美元,GPT-5.6 Sol分别为5美元和30美元。
中美大模型价差正在收窄
DeepSeek此次还发布了API调价公告,采用峰谷定价机制,高峰时段价格翻倍。新价格将于8月17日生效,deepseek-v4-pro高峰时段百万tokens输出最高价格达27元。
摩根士丹利最新研报显示,中国大模型API平均价格过去一年明显上涨,2026年第二季度输入价格升至每百万Token 4.9元,输出价格升至21.9元,相比2025年第一季度分别上涨约48%和80%。
与此同时,中国大模型API价格已从美国同行的6%和5%上升至19%和14%。摩根士丹利认为,中国大模型行业的竞争重点正在从"价格战"转向"智力战",模型能力而非价格才是长期竞争地位的关键决定因素。
随着模型能力和规模继续提升,中国新一代大模型的定价可能进一步上升,行业竞争将更多转向模型能力和算力供给。
本文内容基于公开网络资讯整理