天脉资讯
财经快讯 价值公司 财经人物 IPO解读 热门赛道 经济解码 科技业界 文化艺术 消费零售 大燕公益 商业快讯

中美AI双雄同日亮剑:DeepSeek与Grok夹击Fable 5,AI赛道格局生变?

2026-08-13来源:天脉网编辑:瑞雪

AI领域两大阵营近日展开激烈角逐,中美科技企业几乎同步推出重磅模型升级,引发行业震动。DeepSeek与SpaceXAI在同一天内分别发布V4 Pro正式版和Grok 4.6旗舰模型,形成对Anthropic旗下Claude Fable 5的双重挑战。这场技术竞赛不仅体现在性能突破上,更因成本差异引发市场格局重构。

在Agent能力评测中,DeepSeek V4 Pro展现显著进步。其网络安全智能体CyberGym得分达83.3分,自动化任务处理取得31.8分,两项指标均超越Claude Fable 5。更引人注目的是,该模型在真实工程运维测试"Terminal Bench 2.1"中,与Fable 5的差距缩小至0.1分,代码理解项目测试"DeepSWE"性能较预览版提升390%。SpaceXAI的Grok 4.6则选择差异化竞争路线,在GDPVal‑AA v2职场综合能力测试中以1753 Elo分登顶全球榜首,超越Fable 5的1741分和GPT‑5.6 Sol Max的1728分。

开发者实测反馈揭示技术落地的现实困境。某代码项目测试显示,DeepSeek V4 Pro虽成本优势显著,但任务执行耗时长达二三十分钟,过程缺乏进度反馈;Grok 4.6响应速度提升明显,输出稳定性更佳,但单次任务成本仍高于市场平均水平。这种性能与成本的博弈,直接反映在模型定价策略上:Fable 5保持每百万token输入10美元、输出50美元的高价定位,DeepSeek V4 Pro则将输入成本压低至0.43美元,输出仅0.87美元,缓存命中输入成本更是低至0.0036美元。Grok 4.6定价虽较Fable 5降低5-8倍,但仍高于DeepSeek的解决方案。

市场格局因此出现微妙变化。老一代旗舰模型如Gemini 3.1 Pro和GPT-5.5 Pro陷入双重挤压:其性能既无法企及Fable 5,定价又难以与新晋挑战者竞争,生存空间持续萎缩。行业观察人士指出,AI模型评价标准正经历根本性转变,从静态知识测试转向动态任务交付能力。能否独立完成终端命令操作、环境部署、错误调试等工程任务,成为衡量模型实用价值的核心指标。这种转变导致部分榜单高分模型因落地效率低下,加速被市场淘汰。

技术竞赛远未结束。DeepSeek即将发布的Harness Agent框架被视为下一阶段竞争焦点,马斯克则公开宣称Grok 4.7将实现全面超越。面对中美科技企业的双重夹击,Anthropic面临技术路径选择与定价策略调整的双重考验。这场围绕Agent能力的精细化竞争,正在重塑全球AI产业的技术路线图与商业生态。

人形机器人热潮涌动,守住“慢功夫”方能走稳产业长跑路
以人形机器人本体为例,有头部企业两年间将成本从约70万元降至约20万元,靠的不是奇迹,而是一个个核心零部件国产化的攻坚。要让人形机器人真正嵌入工业场景,在高温高危的产线上替代人工,在井下巡检中守护安全,“扛得…

2026-08-13

荣耀Robot Phone:以机器人之姿,引领智能手机迈向全新智能时代
在早些时候举行的影像技术发布会上,荣耀方面就已经明确表示,Robot Phone将会成为他们定义手机影像、特别是手机视频拍摄能力的一个起点。如果说以往的智能手机是冰冷的通讯与随身计算设备,那么Robot …

2026-08-13

从概念到现实:荣耀Robot Phone以机械云台与AI融合开启手机新形态
机械云台、系统级Agent、阿莱影像,再加上第五代骁龙8至尊版和7060mAh电池,这一次荣耀想做的,明显不只是给手机加一个新功能。但我觉得Robot Phone最有意思的地方,还不是机械臂本身,而是机械…

2026-08-13

康盛股份董事长兼总经理王亚骏取保候审,公司运营一切如常
康盛股份公告,公司董事长兼总经理王亚骏被司法机关采取取保候审措施,但不影响其履职。经核实,该事项不涉及公司生产经营活动,不涉及公司业务、资产及应披露而未披露的重大事项。截至本公告披露日,王亚骏能够正常履行董…

2026-08-13

Gemini月活破10亿追平ChatGPT,消费级AI市场格局生变竞争升级
分析指出,周活与月活用户之间并无直接可比性,但综合现有数据的最简单解读是:ChatGPT仍是用户规模更大的平台,而Gemini的增速可能更快。在平台分布上,Gemini首席负责人Josh Woodward…

2026-08-12

英伟达新布局:Nemotron 3.5与模型路由器,引领AI工作流新变革
在一个复杂的企业AI系统里,大模型负责任务规划和复杂推理,Lightning则承担大量代码审查、安全监控、数据处理、告警分析这类专业化工作。只要模型跑在英伟达的路由、推理和部署体系里,无论企业最终选择谁的模型…

2026-08-12