天脉资讯
财经快讯 价值公司 财经人物 IPO解读 热门赛道 经济解码 科技业界 文化艺术 消费零售 大燕公益 商业快讯

Meta新模型Muse Spark 1.3来袭,性价比超群,AI圈“价格战”一触即发

2026-09-04来源:快讯编辑:瑞雪

九月刚拉开帷幕,人工智能领域便掀起了一场激烈的技术竞赛。短短三天内,五家科技巨头接连发布了各自的前沿模型,包括Anthropic的Fable 5.1和Mythos 5.1、谷歌的Gemini 3.8 Flash和Cyber,以及meta的Muse Spark 1.3。这场突如其来的“模型风暴”让整个行业为之震动,也引发了人们对人工智能发展速度的惊叹。

在这场竞赛中,meta的表现尤为引人注目。公司首席执行官马克·扎克伯格在社交平台X上高调宣布,Muse Spark 1.3正式发布。他强调,这款新模型以“前沿性能”和“几乎可以忽略不计的成本”为特点,标志着meta在编程和智能体工作方面取得了重大突破。meta超级智能实验室负责人亚历山大王进一步解释,与前代版本相比,Muse Spark 1.3减少了无效交互轮次,工具调用次数减少了约20%,token消耗降低了约25%,同时在长周期任务中能更好地保持需求一致性。

Muse Spark 1.3的发布立即对竞争对手构成了压力。就在前一天晚上,谷歌刚刚宣布其Gemini 3.8 Flash成为轻量级模型的新霸主,但这一地位很快被meta的新模型动摇。跑分数据显示,Muse Spark 1.3在多个基准测试中表现优异,不仅超越了GPT-5.6 Sol和Fable 5,还在Max推理强度下的Artificial Analysis智力指数中获得了62分,跻身当前第一梯队。

在DeepSWE v1.1基准测试中,Muse Spark 1.3的表现尤为突出。这项测试被视为衡量模型真实长程编程能力的关键指标,Muse Spark 1.3以75.4分的成绩超越了Claude Opus 5(74.0分)和GPT-5.6 Sol(73.0分),甚至将刚发布的Gemini 3.8 Flash甩在身后。在SWEAtlas CodeBase QnA、Terminal-Bench 2.1和MRCR 512K-1M等其他关键开发者指标中,Muse Spark 1.3也展现出了强大的竞争力,尤其是在MRCR 512K-1M测试中,它以98.1分的惊人成绩碾压了竞争对手。

除了性能上的优势,Muse Spark 1.3的成本效益也成为了其一大卖点。meta首席AI官亚历山大王公开嘲讽谷歌,称Gemini在Artificial Analysis智力指数上“只能吃别家模型的尾气”。他指出,Muse Spark 1.3的输入成本比Fable 5低8倍,输出成本低近12倍,真正实现了“前沿性能,成本只是零头”。这一优势在开发者社区中引起了强烈反响,许多人认为meta正在重新定义大模型的经济性。

一个真实的测试案例进一步证明了Muse Spark 1.3的性价比。开发者@SPAC89使用Muse Spark 1.3 Ultra Contributor模式与Fable 5.1 xHigh进行了对比。在严苛的“自我改进规则”下,Muse Spark 1.3在2小时内完成了20轮自我改进循环,每次启动3个智能体,相当于运行了60多次智能体任务,而总成本不到1美元。这一结果让开发者惊叹不已,认为Muse Spark 1.3“简直是一件艺术品”。

meta的快速迭代能力也令人印象深刻。自今年7月发布Muse Spark 1.1以来,公司在不到两个月的时间内便推出了1.3版本,将长程编码能力提升到了与GPT-5.6相当的水平。这种速度背后,是亚历山大王接手meta超级智能实验室后带来的变革。他和扎克伯格都明确表示,meta的目标是打造“7×24小时在线的个人智能体”,而Muse Spark 1.3正是这一战略的重要一步。

然而,Muse Spark 1.3的成功也引发了一些质疑。知名AI机构BridgeMind指出,尽管基准测试分数飙升,但真实世界的体验并未显著提升。这种“刷榜”现象让人们对当前大模型行业的评价标准产生了怀疑。一些网友通过压力测试发现,Muse Spark 1.3和Gemini Flash 3.8在实际应用中并不如跑分数据那样完美,甚至暴露了某些缺陷。

尽管如此,Muse Spark 1.3的发布无疑为人工智能领域注入了新的活力。它的出现表明,大模型的发展正在从单纯的参数扩张转向系统架构和工具调用的优化。未来,能够在极低成本下实现长程任务真实落地的模型,将更有可能在竞争中脱颖而出。meta的这一举措,或许正在引领人工智能进入一个全新的发展阶段。

沙特主权财富基金旗下HUMAIN发布humain-m3模型,推动阿拉伯语AI发展
其在 7 个公开的阿拉伯语基准测试中取得了参测前沿模型中的最高平均分。同时,通过 HUMAIN Node,我们将这种智能技术开放给开发者、研究人员和创新者,让他们能够进行实验、在此基础上进行开发,并创造下一代…

2026-09-04

人工智能赋能科研新变革:驱动全链条融合 塑造未来创新生态
同时,企业凭借数据、算力、资本等优势,从科研的需求与应用方逐渐转变为科研活动的主要参与者,在某些领域甚至成为主导者,推动科学研究与应用场景融合发展;智能工具、支撑平台和开源社区也将成为新型技术参与主体,丰富科…

2026-09-04

森工科技14年蜕变:从多元探索到深耕科研级3D打印领域
2012年,我们开始创业做3D打印。 那个时候,国内做3D打印设备的企业还不多。我们从FDM开始,一点点做机器、调参数、试材料。 而是沿着科研材料3D打印这条路继续往前走。 从材料测试、工艺验证,到设…

2026-09-04

小米玄戒O3纪念铝板首曝光:雷军亲签加持,芯片性能飙升引期待
IT之家今日收到了小米玄戒 O3 纪念铝板,采用黑色包装盒,盒子正面印有小米 Logo 和玄戒 XRING 标志。 玄戒 O3 的 CPU采用十核全大核设计:6 超大核心 + 4 大核心,最高 4.35G…

2026-09-03

美光“近GPU NAND”技术探索:为人工智能大模型运行开辟硬件新路径
来源:环球网 这项被称作“近GPU NAND”的技术,力求在存储密度与耐久性能之间实现平衡优化,主要面向非极致低延迟、超高带宽类业务场景。作为介于显存与普通存储之间的全新高速缓冲层级,该技术对于运行超大规模…

2026-09-03

马斯克预测:2036年全球人形机器人或超10亿台,AI助力经济大增长
联合国此前预测,到2037年全球人口会达到约90亿,按此估算,届时相当于平均每9人就拥有一台人形机器人。马斯克称,十亿台人形机器人的生产力将超过所有人类生产力的总和。(剪辑 匡萍) 责编:曾梓民 一审:匡萍…

2026-09-03