MiniMax开源首个推理模型M1

i黑马  •  扫码分享
我是创始人李岩:很抱歉!给自己产品做个广告,点击进来看看。  

6月17日,Minimax正式开源推理模型M1,采用Lightning Attention机制的混合注意力架构。M1支持目前业内最高100万token上下文输入,同时支持最多8万token输出。成本表现方面,M1在用8万Token深度推理的时候,需要使用DeepSeek R1约30%的算力。团队表示,M1整个强化学习阶段只用到512块H800三周时间,租赁成本为53.74万美金。

文章评价
MiniMax开源首个推理模型M1 匿名用户
发布
发布

    随意打赏

    提交建议
    微信扫一扫,分享给好友吧。