今年最大黑马?MiniMax M2 多项实测首发,碾压DeepSeek,平替Claude!

Minimax M2 在编码和 Agent 任务上,完全不输 Claude Sonnet 4.5,跟 GLM 4.6 表现接近,在小游戏和3D交互项目中一把过率高于 DeepSeek 。

文章集更新 · 2025-10-294 min read
大家好!我是瓜哥,前互联网技术总监,现在AI编程这条路上持续探索和分享。

10月27日,MiniMax 发布了他们的新一代旗舰大模型:MiniMax - M2。

###

先说结论

从我亲测结果来看,Minimax M2 在编码和 Agent 任务上,完全不输 Claude Sonnet 4.5,跟 GLM 4.6 表现接近,在小游戏和3D交互项目中一把过率高于 DeepSeek 。

为什么现在需要了解?

官方限时免费至 11月7日。

如果你本身就在用Claude Code/Cursor/VSCode,近两周可零成本切换,M2 是个可快速平替的选项!

一、实测效果

话不多说,直接把 M2 接入Claude Code ,用多个项目(主题网站/3D设计/小游戏)实测一遍。

1.1 Web网站 - 终结者电影网站

生成静态网页,考察 M2 在需求理解、HTML代码生成、页面结构、UI设计等能力。

生成页面结构没问题,没有自动补图片,整体不够美观。能满足快速验证需求和出原型的需要。

1.2 Web网站 - 户外生活网站

户外主题网站,页面结构、配图、完整度都很好。完全可满足一般小型公司官网或个人的主题网站生成需要。

###

1.3 3D设计 - 流体艺术

生成3D网页,考察 M2 在3D效果、交互逻辑、技术整合等综合能力。

一把过,交互完整度很高,流体效果不错。流体效果出色,多种技术整合运用达到主流大模型水准。

1.4 3D设计 - 3D虚拟城市

同样是一把过,支持3D模型的缩放,拖动旋转,建筑、街道、树木的实现细节都很OK。

1.5 小游戏 - 反应力测试

生成小游戏,考察 M2 需求理解与场景拆解能力。

游戏操作逻辑和数据统计都很好的实现了,页面的美观度一般。要达到美观可用的状态,还需人工进行UI设计再交给AI执行。

1.6 小游戏 - 切水果

第一版生成有bug,鼠标滑动切水果不生效,反馈bug给M2,成功修复了。在操作体验上不算特别丝滑,还需再打磨打磨。

二、实力介绍

2.1 榜单评分?

在 Artificial Analysis 榜单上,M2 取得了开源全球第一、闭源全球第四的成绩。这个榜单覆盖了数学,科学,代码,Agent等多个核心维度,可信度还挺高的。

2.2 擅长什么?

据官网介绍,这是一款专注 Coding(编码)、Agent(代理)的开源大模型。总参数量230B,激活参数10B。

2.3 限时免费?

MiniMax CEO闫俊杰说:

限时免费(截至11月7日),羊毛党,抓紧冲。

2.4 后续收费?

M2模型的API收费标准:

  • 输入:2.1元/百万tokens
  • 输出:8.4元/百万tokens

在国产大模型里,与K2、GLM 差不多,高于 DeepSeek V3.2 ;在海外则不到Claude的 8%。

三、使用方式:

3.1 网页版

快速体验:https://agent.minimaxi.com/

3.2 API 调用

具体的方法和步骤,我放在文末了

MiniMax支持大部分 AI Agent 编程工具,包括:Claude Code、Cursor、Cline、Kilo Code 和 Droid 等。这里以Claude Code为例。

Claude Code 配置成功

四、小结一下

从实测的结果来,在需求理解和编码能力上都表现不错。在多个任务里,都能做到一把过,结果远超 Deepseek,期待未来能超越Claude和Gemini,成为AI大模型的TOP3。

另一个印象比较深的点是,Minimax M2在性能、价格和速度之间取平衡,并没有过分强调性能而牺牲了速度,要知道任何用户都无法忍受大模型长时间的推理而带来的等待。

评论区

暂无公开评论

还没有公开评论。

提交反馈

图文今年最大黑马?MiniMax M2 多项实测首发,碾压DeepSeek,平替Claude!

反馈类型

请等待管理员审核,通过后将显示在评论区。

0 / 500