SEMI大半导体产业网

MiniMax开源首个推理模型M1

来源：大半导体产业网 2025-06-18

M1支持目前业内最高100万token上下文输入，同时支持最多8万token输出。

6月18日消息，6月17日，Minimax正式开源推理模型M1，采用Lightning Attention机制的混合注意力架构。

M1支持目前业内最高100万token上下文输入，同时支持最多8万token输出。

成本表现方面，M1在用8万Token深度推理的时候，需要使用DeepSeek R1约30%的算力。

团队表示，M1整个强化学习阶段只用了3周时间、512块H800 GPU，租赁成本为53.74万美金。