找回密码
 立即注册
  • QQ空间
  • 回复
  • 收藏

Mini Max开源首个推理模型

6月17日,Minimax正式开源推理模型M1,采用Lightning Attention机制的混合注意力架构。M1支持目前业内最高100万token上下文输入,同时支持最多8万token输出。
成本表现方面,M1在用8万Token深度推理的时候,需要使用DeepSeek R1约30%的算力。
团队表示,M1整个强化学习阶段只用到512块H800三周时间,租赁成本为53.74万美金。

Mini Max开源首个推理模型-1.jpg
回复

使用道具 举报

大神点评(5)

牛X
回复 支持 反对

使用道具 举报

single013 楼主 昨天 18:57 显示全部楼层
🤙🤙🤙🤙🤙🤙🤙🤙🤙
回复 支持 反对

使用道具 举报

4
回复 支持 反对

使用道具 举报

Mini Max开源首个推理模型-1.jpg
回复 支持 反对

使用道具 举报

说点什么

您需要登录后才可以回帖 登录 | 立即注册
HOT • 推荐