月之暗面(Moonshot AI)近日宣布开源其最新大模型Kimi K3,并同步发布47页技术报告,同时开放MoonEP、FlashKDA、AgentEnv三大底层基础设施技术。这一举措意味着全球开发者均可自由下载并部署该模型,无论是用于内部研发还是嵌入终端产品。作为参数规模达2.8万亿的开源模型,Kimi K3超越了此前1.6万亿参数的DeepSeek-V4 Pro,成为当前参数量最大的开源权重模型。
Kimi K3的发布引发了行业广泛关注。第三方评估平台Code Arena显示,其编程能力位列全球开源模型首位,首次超越闭源模型登顶。在多模态能力测试中,该模型展现出较强的视觉理解能力,例如可根据现有网页或截图生成新设计。这一突破被认为显著缩小了国产模型与全球顶尖水平的差距——加州大学伯克利分校教授Ion Stoica指出,此前中国开源模型与全球领先水平存在6至9个月差距,如今已缩短至2至3个月。
然而,Kimi K3也面临争议。OpenAI与Anthropic指控其通过模型蒸馏技术窃取知识产权,即让小模型学习大模型答案以降低成本。对此,月之暗面企业业务负责人黄震昕回应称,性能提升源于底层架构创新,而非蒸馏技术。尽管如此,该模型的高成本仍引发关注:其API输入价格达每百万Tokens 20元(未命中缓存),输出价格高达100元,在主流国产模型中处于最高水平。相比之下,GLM-5.2的输入单价为8元,输出单价为28元。
应用层面,Kimi K3的性价比受到质疑。开发C端口语练习应用的TalkMe CEO贾子健测试发现,虽然Kimi K3在前端3D游戏生成等任务中表现突出,但在常规后端编程任务中与DeepSeek-V4 Pro能力相当,但效率更低且价格高出十余倍。例如,完成相同测试任务时,Kimi K3比DeepSeek慢30%以上,且在记忆力测试中多花费近7分钟。贾子健认为,模型参数量并非越大越好,需考虑实际部署成本——Kimi K3可能需要二三十台英伟达H200服务器,而DeepSeek-V4 Pro仅需十台左右。
行业分析指出,Kimi K3的发布对美国半导体产业造成冲击。发布前后72小时内,美股半导体板块市值蒸发数千亿美元,《华尔街日报》认为这加剧了芯片股抛售。部分观点认为,该模型与DeepSeek-R1类似,动摇了市场对高端算力芯片的依赖。但也有业内人士指出,Kimi K3目前更适合海外用户,其API价格虽高于国内主流模型,但仍低于Claude Fable 5和GPT-5.6 Sol。例如,Kimi K3输入价格为每百万Tokens 3美元(换算后),而Claude Fable 5输入价格为10美元。
月之暗面正处在融资关键期。据报道,公司计划启动新一轮融资,目标估值达500亿美元,这将是其上市前最后一轮融资。自2023年4月成立以来,该公司估值快速攀升:2024年完成超10亿美元融资后估值达33亿美元,2025年底升至43亿美元,2026年上半年连续四轮融资后估值突破200亿美元,最新一轮已达315亿美元。推动估值增长的因素包括抓住年初市场机遇,年化经常性收入在2026年6月中旬突破3亿美元。
不过,大模型领域的竞争日益激烈。Kimi K3发布后,Anthropic迅速推出Claude Opus 5,宣称其性能接近Claude Fable 5但价格减半。与此同时,模型迭代对用户增长的拉动作用正在减弱——数据显示,GPT-5.5发布后ChatGPT月活跃用户增幅明显低于GPT-5时期。专家认为,下一阶段竞争将聚焦推理成本优化、付费转化率提升,以及Agent技术在复杂生产力场景中的渗透。月之暗面能否维持融资热度,取决于其商业化进展的可持续性。
