SENQICE NET
bar
IP:216.73.216.45 Time:
加载中...
| 本站首页 | 在线新闻 | 技术文献 | 软件工具 | 国际版 |

-------- Welcome To Senqice Network !Thank You For Your Support !--------
·软件信息
·科技新闻
·阿里通义千问Qwen 2026全面进化:六大升级落地,从开源王者到全栈AI平台
·谷歌落子广州CBD,是“重返中国”还是“重新定位”?
·GPT-5.6曝光:OpenAI加速迭代,150万上下文+UltraFast模式即将登场
·Computex 2025:英伟达发布GB300超级芯片,定义AI基础设施新纪元
·2026 科技新坐标:从深空“芯片工厂”到地面“全自动驾驶”
·法国政府250万台电脑弃用Windows转向Linux:数字主权背后的博弈
·宇树科技73天闪电过会:A股人形机器人第一股呼之欲出,具身智能赛道全面爆发
·英伟达2026股东大会黄仁勋定调:AI基建周期长达数十年,"60年最大重置"才刚刚开始
·“韬”光养晦:华为定律改写芯片规则,英伟达向现实低头
·微软Copilot转向按量计费,DeepSeek等开源模型成商业必选项

DeepSeek V4 Flash重磅发布:以极低价格颠覆AI行业格局

2026年8月初,人工智能行业迎来了一轮重磅消息。中国AI研究公司DeepSeek正式发布了V4 Flash模型,其定价策略在业内引发了巨大震动。该模型的输入token价格仅为每百万0.14美元,输出token价格为每百万0.28美元,这一价格相比一年前美国前沿模型动辄数百美元每百万token的成本,可以说是断崖式下降。

AI行业竞争格局示意图

DeepSeek V4 Flash:小模型大能力

令人惊讶的不仅是价格,更是其性能表现。DeepSeek V4 Flash在Terminal-Bench基准测试中获得了82.7%的分数,甚至超越了DeepSeek自家拥有1.6万亿参数的Pro模型在代理基准测试中的表现。代理基准测试专门衡量模型完成复杂多步骤任务的能力,包括编写和运行代码、搜索网页、填写表单以及在长链操作中做出决策。这意味着,这个体积更小、价格更低廉的模型,在AI日益被实际应用的工作场景中,表现反而更加出色。

DeepSeek已经形成了一套成熟的策略:发布比美国竞争对手便宜得多的模型,展示其性能相当甚至更优,然后看着整个行业不得不跟进调整。AI成本曲线正在以超出多数观察者预期的速度压缩,受益的是每一位按token付费的开发者、企业和个人用户。

微软AI收入突破900亿美元

与此同时,微软公布了2026财年第四季度财报,营收达到900亿美元,其中Azure云服务收入同比增长44%。这一增长几乎完全由AI工作负载驱动——企业在Azure上运行大语言模型、构建AI代理、存储训练数据以及处理推理请求。财报发布当天,微软股价飙升15%,创下了史上最大单日市值增长纪录。

Palantir Technologies同期也交出了亮眼成绩单,第二季度营收同比增长93%,达到19.4亿美元,超出分析师预期的18亿美元。其美国商业收入增长149%,反映出AI已深度嵌入大型机构的决策基础设施中。

Grok 4.6即将发布:1.5万亿参数

在另一条赛道上,马斯克在SpaceX 2026年第二季度财报电话会议上预告,将于下周发布Grok 4.6模型。该模型总参数量达到1.5万亿,重点改进监督微调(SFT)和强化学习(RL)技术。马斯克还透露,未来3至4周内将发布Grok 4.7模型,参数量进一步增至2.1万亿,各方面性能都将更上一层楼。

AI代理正在接管工作场所

研究机构Gartner预测,到2026年底,40%的企业应用将内置任务型AI代理,而一年前这一比例不足5%。AI代理与聊天机器人有着本质区别:聊天机器人只是回答问题然后等待,而AI代理接收目标后会自主跨越多个步骤完成工作——搜索网页、编写代码、调用API、填写表单、发送邮件、阅读文档,并在每个阶段基于所获信息做出决策。这种能力的快速普及,正在深刻重塑人们的工作方式。

2026年至今,AI行业已追踪到337个以上的主要模型发布。新能力涌入市场的步伐不是在放缓,而是在加速。每一轮新模型发布通常都会带来推理能力、速度或成本方面的改进,使AI代理更加强大且更经济可行。AI竞赛正在加速进入一个连2023年最乐观预测都低估的新阶段。

本文内容基于公开网络资讯整理

查看人数:22
上一篇: Linux内核7.2-rc6发布:AI助推创近年来最大RC版本
下一篇: 台积电扩大CoWoS封装外包规模,2纳米制程年底月产目标10万片
评论
评论已关闭