MiniMax模型上新：新架构，且开源

和AI一起进步的 2025-01-15 12:10 北京

做Agent时代的“头号玩家”

1月15日，云启天使轮项目、国内领先大模型创业公司MiniMax发布并开源MiniMax-01全新系列模型，包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。

这一全新系列模型在复杂Agent的“刚需能力”——长文本上有显著进阶，同时创新性地采用全新模型架构。受益于包括架构创新在内的多重因素，MiniMax的文本、多模态理解API价格区间也实现业内最低。更多详情，欢迎和本期「云启伙伴」一起了解。

关于MiniMax的技术路线选择及对未来模型能力的愿景，公司创始人&CEO闫俊杰也在此前和云启的一次深度对话中有过详细阐述，??也欢迎点击这里回顾。

性能比肩GPT-4o

长文本处理再进阶

先来看一个重要指标：参数量。据MiniMax披露，全新系列模型参数量高达4560亿，其中单次激活459亿。

而根据业界主流的文本和多模态理解测评结果，MiniMax-01全新系列模型在大多数任务上追平了海外公认最先进的两个模型——GPT-4o-1120以及Claude-3.5-Sonnet-1022。

其中，值得一提的是新模型的长文本处理能力：高效处理全球最长400万token的上下文，是GPT-4o的32倍，Claude-3.5-Sonnet的20倍。在Agent这一AI应用形态快速发展的趋势下，长文本能力的打磨进阶至关重要。

模型架构创新

首次大规模采用线性注意力机制

架构创新是MiniMax-01的另一个亮点。其将线性注意力机制扩展到商用模型的级别，系业内首个大规模以线性注意力为核心的模型。据MiniMax公开的模型结构，模每8层中有7个基于Lightning Attention的线性注意力。

围绕这一创新，MiniMax几乎重构了训练和推理系统，包括更高效的MoE All-to-all通讯优化、更长的序列的优化，以及推理层面线性注意力的高效Kernel实现。

API极高性价比

开源模型完整权重

MiniMax同时公布了文本和多模态理解的API价格：标准定价输入token 1元/百万token，输出token 8元/百万token。此系业内最低价格区间，主要受益于架构创新、效率优化、集群训推一体设计以及MiniMax内部大量并发算力复用。

此外，MiniMax开源了新系列两个模型的完整权重（https://github.com/MiniMax-AI ）。“一是因为我们认为这有可能启发更多长上下文的研究和应用，从而更快促进Agent时代的到来，二是开源也能促使我们努力做更多创新，更高质量地开展后续的模型研发工作。”关于开源原因，MiniMax如是说。