麦克雷 Mavom.cn
标题:
Mini Max开源首个推理模型
[打印本页]
作者:
single013
时间:
3 天前
标题:
Mini Max开源首个推理模型
6月17日,Minimax正式开源推理模型M1,采用Lightning Attention机制的混合注意力架构。M1支持目前业内最高100万token上下文输入,同时支持最多8万token输出。
成本表现方面,M1在用8万Token深度推理的时候,需要使用DeepSeek R1约30%的算力。
团队表示,M1整个强化学习阶段只用到512块H800三周时间,租赁成本为53.74万美金。
(, 下载次数: 0)
上传
点击文件名下载附件
作者:
wlbigxtr12
时间:
3 天前
牛X
作者:
single013
时间:
3 天前
🤙🤙🤙🤙🤙🤙🤙🤙🤙
作者:
Yoo_Hoooo
时间:
3 天前
4
作者:
wlbigxtr12
时间:
3 天前
(, 下载次数: 0)
上传
点击文件名下载附件
欢迎光临 麦克雷 Mavom.cn (http://mavom.cn/)
Powered by Discuz! X3.5