2026年8月初,人工智能行业迎来了一轮重磅消息。中国AI研究公司DeepSeek正式发布了V4 Flash模型,其定价策略在业内引发了巨大震动。该模型的输入token价格仅为每百万0.14美元,输出token价格为每百万0.28美元,这一价格相比一年前美国前沿模型动辄数百美元每百万token的成本,可以说是断崖式下降。

DeepSeek V4 Flash:小模型大能力
令人惊讶的不仅是价格,更是其性能表现。DeepSeek V4 Flash在Terminal-Bench基准测试中获得了82.7%的分数,甚至超越了DeepSeek自家拥有1.6万亿参数的Pro模型在代理基准测试中的表现。代理基准测试专门衡量模型完成复杂多步骤任务的能力,包括编写和运行代码、搜索网页、填写表单以及在长链操作中做出决策。这意味着,这个体积更小、价格更低廉的模型,在AI日益被实际应用的工作场景中,表现反而更加出色。
DeepSeek已经形成了一套成熟的策略:发布比美国竞争对手便宜得多的模型,展示其性能相当甚至更优,然后看着整个行业不得不跟进调整。AI成本曲线正在以超出多数观察者预期的速度压缩,受益的是每一位按token付费的开发者、企业和个人用户。
微软AI收入突破900亿美元
与此同时,微软公布了2026财年第四季度财报,营收达到900亿美元,其中Azure云服务收入同比增长44%。这一增长几乎完全由AI工作负载驱动——企业在Azure上运行大语言模型、构建AI代理、存储训练数据以及处理推理请求。财报发布当天,微软股价飙升15%,创下了史上最大单日市值增长纪录。
Palantir Technologies同期也交出了亮眼成绩单,第二季度营收同比增长93%,达到19.4亿美元,超出分析师预期的18亿美元。其美国商业收入增长149%,反映出AI已深度嵌入大型机构的决策基础设施中。
Grok 4.6即将发布:1.5万亿参数
在另一条赛道上,马斯克在SpaceX 2026年第二季度财报电话会议上预告,将于下周发布Grok 4.6模型。该模型总参数量达到1.5万亿,重点改进监督微调(SFT)和强化学习(RL)技术。马斯克还透露,未来3至4周内将发布Grok 4.7模型,参数量进一步增至2.1万亿,各方面性能都将更上一层楼。
AI代理正在接管工作场所
研究机构Gartner预测,到2026年底,40%的企业应用将内置任务型AI代理,而一年前这一比例不足5%。AI代理与聊天机器人有着本质区别:聊天机器人只是回答问题然后等待,而AI代理接收目标后会自主跨越多个步骤完成工作——搜索网页、编写代码、调用API、填写表单、发送邮件、阅读文档,并在每个阶段基于所获信息做出决策。这种能力的快速普及,正在深刻重塑人们的工作方式。
2026年至今,AI行业已追踪到337个以上的主要模型发布。新能力涌入市场的步伐不是在放缓,而是在加速。每一轮新模型发布通常都会带来推理能力、速度或成本方面的改进,使AI代理更加强大且更经济可行。AI竞赛正在加速进入一个连2023年最乐观预测都低估的新阶段。
本文内容基于公开网络资讯整理