天脉资讯
财经快讯 价值公司 财经人物 IPO解读 热门赛道 经济解码 科技业界 文化艺术 消费零售 大燕公益 商业快讯

MiniMax M2.5强势突围:性能成本双优,引爆全球Agent需求新热潮

2026-02-24来源:快讯编辑:瑞雪

春节期间,AI领域迎来一匹黑马——MiniMax凭借其新一代模型M2.5在开发者圈掀起热潮。2月20日港股马年首个交易日,MiniMax股价大涨14.52%,市值一度突破3042亿港元。这一资本市场的积极反应,源于M2.5在性能与市场表现上的双重突破,为智能体(Agent)场景的应用落地提供了关键支撑。

过去两年,AI行业聚焦于供给侧技术升级,更强大的模型与更高效的芯片成为主流方向,但Agent相关需求却因技术与成本限制长期被压制。M2.5的推出恰好填补了这一市场空白。作为专为智能体场景设计的生产级旗舰模型,M2.5上线仅12小时便登顶OpenRouter热度榜,一周内以3.07T tokens的周调用量占据平台榜首,这一数据甚至超过Kimi K2.5、GLM-5与DeepSeek V3.2三家的总和。更关键的是,M2.5直接带动了OpenRouter平台100K至1M长文本区间的增量调用需求,而这一区间正是Agent工作流的典型消耗场景。此前,开发者因缺乏能力与成本兼备的模型,难以将现成的Agent工作流落地,M2.5的出现让这一困境迎刃而解。

M2.5的技术实力在多个维度得到验证。在编程领域权威的SWE-Bench Verified评测中,其以80.2%的通过率达到Claude Opus系列水平,并在多语言任务Multi-SWE-Bench上排名第一。知名技术博主Simon Willison的独立测评显示,M2.5在主流模型中位列第三,仅次于Claude Opus 4.5和Gemini 3 Flash,且是所有开源模型中的第一名。执行效率方面,研究机构SemiAnalysis实测表明,在8张H200显卡上,M2.5每GPU每秒可稳定处理约2500个token,即使在处理超1万个token的上下文时,解码速度依然稳定。这些数据直接证明了M2.5在性能上的硬实力。

硅谷开发者生态对M2.5的认可早已显现。早在M2.1模型推出时,AI编程工具新贵Kilo Code便将其设为默认模型,其CEO称M2.1在真实编码工作流中可与前沿模型媲美。此次M2.5全面开源后,模型权重在HuggingFace上线并支持本地部署,Kilo Code第一时间宣布接入,同时OpenCode、OpenClaw、Fireworks、魔搭社区等国内外知名开源Agent应用与工具平台也纷纷跟进。开源社区的密集接入,不仅源于M2.5的技术优势,更因其极具竞争力的定价策略。M2.5推出两个版本:100 TPS快速版输入每百万tokens仅0.3美元、输出2.4美元,50 TPS版本输出价格再降一半,精准落在开源社区的成本接受区间。能力、速度与成本的平衡,让M2.5在OpenRouter上走出近乎指数型的增长曲线。

M2.5的突破并非偶然,其背后是MiniMax从工程底层重新设计的原生Agent强化学习系统——代号Forge。传统RL框架存在工程复杂度高、训练推理一致性维护成本高的问题,Forge通过引入中间件抽象层,将Agent执行逻辑与底层训练推理引擎解耦。Gateway Server作为标准化通信网关隔离高层行为与模型复杂性,Data Pool异步收集训练轨迹,实现生成与训练的解耦。这一设计让开发者无需修改Agent内部代码,即可接入数百种框架、数千种工具调用格式进行训练。在训练效率与稳定性上,Forge通过Prefix Tree Merging方案将训练样本重构为树形结构,消除重复上下文前缀,实现约40倍训练加速并降低显存开销;Windowed FIFO异步调度策略在最大化吞吐量的同时控制样本离策略程度;自研CISPO算法保障MoE模型大规模训练稳定性,并针对Agent长轨迹信用分配难题设计复合奖励机制,解决长程任务的注意力稀释问题。正是这套底层系统,让M2.5能在Kilo、OpenClaw等严苛的Agent框架上稳定运行。

MiniMax的技术迭代速度同样令人瞩目。过去108天内,其陆续推出M2、M2.1、M2.5三款模型,在SWE-Bench Verified榜单上的进步速度远超Claude、GPT、Gemini系列,成为行业迭代最快的模型系列。这一节奏恰好踩中全球Agent需求爆发的窗口期——OpenClaw从默默无闻到席卷全球仅用一两个月,OpenRouter平台上已有上千种同类AI工具和应用生长。在ChatGPT、Claude、Gemini“御三家”之外的新生态中,开发者的评判标准只有一个:模型是否跑得通、用得起。M2.5的出现精准击穿了性能与成本的临界点:能力跻身全球第一梯队,价格仅为主流旗舰模型的十分之一,还支持本地部署。这不仅让MiniMax收获了3T tokens的周调用量,更让开源社区中原本仅存在于Demo中的复杂多Agent系统首次具备大规模商业落地的经济可行性。全球开发者用脚投票的结果,不仅是M2.5模型的增量,更是硅谷下一代开源生态应用的增量,标志着被压制许久的全球Agent需求正迎来真正的爆发时刻。

AI设计全新噬菌体:生物技术新突破,生物安全监管迎新挑战
研究团队表示,噬菌体是感染细菌的病毒,选择噬菌体作为研究对象是因为它们基因组较小、易于实验验证,同时广泛应用于分子生物学、微生物工程和医疗等领域。 业内人士认为,这是AI首次成功设计完整病毒基因组,有望开启…

2026-08-07

招商局集团与中国物流集团共谋合作:深化多领域协作 助力物流体系建设
他希望双方在交通物流、综合金融、物业服务等领域,进一步加大合作力度,共同支撑现代物流体系建设,为畅通经济循环、提升产业链供应链安全韧性,提供坚实保障。 招商局集团作为股东方,为中国物流集团高质量发展提供了有力…

2026-08-07

特斯拉Robotaxi扩张遇阻,马斯克如何破局商业化难题?
马斯克曾多次强调,特斯拉未来将从一家汽车公司转变为人工智能公司,Robotaxi也被认为是连接自动驾驶技术和商业化收入的重要路径。他表示,虽然特斯拉已经积累了大量FSD数据,但Cybercab仍需要针对自身车…

2026-08-07

张一鸣明确表态:字节跳动舍短期之利,坚守AI自研技术“长跑道”
字节跳动Seed团队近日召开全员大会,张一鸣在会上做出了一次少见的公开表态——公司不会把模型蒸馏当作提升AI能力的捷径,宁愿牺牲短期收益,也要坚持长期技术路线。字节跳动是国内头部AI公司中,唯一一家大语言模型…

2026-08-07

DeepSeek API将迎较大涨幅,此前性能亮眼却遇调用容量难题
随后在8月3日,海外开发者平台OpenCode披露了一组数据:8月1日当天,DeepSeek V4Flash在其平台上单日处理Token总量达8万亿。也有网友发文表示:DeepSeek V4 Flash官…

2026-08-07

字节AI“慢”行道:张一鸣划红线,梁汝波布长局,以长期主义筑技术壁垒
但更令外界瞩目的,是一则几乎同步传出的消息:向来低调的创始人张一鸣,在内部会议上罕见地为AI路线定调:字节拒绝走“模型蒸馏”这条捷径,即便这意味着短期内会落后于竞争对手。 而新部门负责人谭待则以视频生成模型…

2026-08-07

Anthropic组建团队自研芯片 助力Claude提升运行效率满足部署需求
Anthropic发言人表示,公司正在建立内部硅芯片团队,为Claude设计定制芯片,并将采用硬件与模型协同设计的方式,以提升Claude运行速度和效率,更好满足客户大规模部署需求。 招聘信息写道:“这是一…

2026-08-07

AI Agent手机新阶段:国标L3启幕,未来体验升级尚需时日
大模型负责理解语言、识别图像和规划任务,是手机的核心能力来源;但模型再强,如果只能困在聊天框里回答问题,依然不足以让整台手机成为 L3。换句话来讲,L3 级别的 AI Agent 的手机仍是一名助手:它能拆…

2026-08-07

张一鸣“拒绝蒸馏”引热议:字节跳动坚持长期主义能否突围AI赛道?
8月6日,字节跳动创始人张一鸣在近期Seed团队内部会议上罕见发声,字节跳动不会依赖AI蒸馏技术来改进模型、蒸馏会干扰真正意义上的长期技术突破等言论,引发广泛关注。 但也有不少用户直言,豆包在复杂推理和代码…

2026-08-07

兆易创新携手地瓜机器人,推出六轴协作机械臂完整控制系统新方案
观点网讯:8月5日,兆易创新与地瓜机器人联合发布六轴协作机械臂完整控制系统。作为双方达成深度战略合作后的核心量产落地成果,整套系统采用“上位大脑+关节小脑”架构,底层伺服驱动搭载兆易创新GD32H77R工业…

2026-08-07