云启资本 01月19日
MiniMax模型上新:新架构,且开源 | 云启伙伴
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_guoji1.html

 

MiniMax发布并开源了MiniMax-01全新系列模型,包括基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。新模型在长文本处理能力上取得显著突破,可高效处理高达400万token的上下文,远超GPT-4o和Claude-3.5-Sonnet。此外,MiniMax创新性地采用了线性注意力机制架构,并实现了业内最低的API价格区间。同时,MiniMax还开源了新系列模型的完整权重,旨在推动长上下文研究和Agent应用的发展。这些突破为AI应用层创新带来了更多可能性,也预示着Agent时代的加速到来。

🚀MiniMax发布全新系列模型,参数量高达4560亿,性能比肩GPT-4o和Claude-3.5-Sonnet,在长文本处理能力上取得显著突破。

✨新模型采用线性注意力机制架构,是业内首个大规模以线性注意力为核心的模型,并对训练和推理系统进行了重构,实现了更高效的MoE All-to-all通讯优化。

💰MiniMax公布了文本和多模态理解的API价格,标准定价输入token 1元/百万token,输出token 8元/百万token,为业内最低价格区间,且开源了新系列两个模型的完整权重。

💡MiniMax开源新模型权重,旨在启发更多长上下文的研究和应用,并促进Agent时代的到来,同时也促使自己努力进行更多创新和更高质量的模型研发工作。

和AI一起进步的 2025-01-15 12:10 北京

做Agent时代的“头号玩家”


1月15日,云启天使轮项目、国内领先大模型创业公司MiniMax发布并开源MiniMax-01全新系列模型,包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。


这一全新系列模型在复杂Agent的“刚需能力”——长文本上有显著进阶,同时创新性地采用全新模型架构。受益于包括架构创新在内的多重因素,MiniMax的文本、多模态理解API价格区间也实现业内最低更多详情,欢迎和本期「云启伙伴」一起了解。


关于MiniMax的技术路线选择及对未来模型能力的愿景,公司创始人&CEO闫俊杰也在此前和云启的一次深度对话中有过详细阐述,??也欢迎点击这里回顾


性能比肩GPT-4o

长文本处理再进阶


先来看一个重要指标:参数量。据MiniMax披露,全新系列模型参数量高达4560亿,其中单次激活459亿。


而根据业界主流的文本和多模态理解测评结果MiniMax-01全新系列模型在大多数任务上追平了海外公认最先进的两个模型——GPT-4o-1120以及Claude-3.5-Sonnet-1022。


其中,值得一提的是新模型的长文本处理能力:高效处理全球最长400万token的上下文是GPT-4o的32倍,Claude-3.5-Sonnet的20倍。在Agent这一AI应用形态快速发展的趋势下,长文本能力的打磨进阶至关重要。




模型架构创新

首次大规模采用线性注意力机制

架构创新是MiniMax-01的另一个亮点。其将线性注意力机制扩展到商用模型的级别,系业内首个大规模以线性注意力为核心的模型。据MiniMax公开的模型结构,模每8层中有7个基于Lightning Attention的线性注意力。


围绕这一创新,MiniMax几乎重构了训练和推理系统,包括更高效的MoE All-to-all通讯优化、更长的序列的优化,以及推理层面线性注意力的高效Kernel实现。



API极高性价比

开源模型完整权重


MiniMax同时公布了文本和多模态理解的API价格:标准定价输入token 1元/百万token,输出token 8元/百万token。此系业内最低价格区间,主要受益于架构创新、效率优化、集群训推一体设计以及MiniMax内部大量并发算力复用。


此外,MiniMax开源了新系列两个模型的完整权重(https://github.com/MiniMax-AI )。“一是因为我们认为这有可能启发更多长上下文的研究和应用,从而更快促进Agent时代的到来,二是开源也能促使我们努力做更多创新,更高质量地开展后续的模型研发工作。”关于开源原因,MiniMax如是说。



在2024年底与云启的深度对话中,闫俊杰曾表示,无论开发toB还是toC产品,错误率、无限长度的输入输出多模态是关乎模型能力的重要指标。


云启认为,伴随Agent、音视频生成等AI应用形态的快速发展,“基建层”长文本处理和多模态能力的打磨至关重要,我们也期待MiniMax在新模型上取得的相关突破给应用层创新带来更多可能。



新模型论文链接:

https://filecdn.minimax.chat/_Arxiv_MiniMax_01_Report.pdf

MiniMax开放平台:

https://www.minimaxi.com/platform

MiniMax开放平台海外版:

https://www.minimaxi.com/en/platform

MiniMax-01系列模型在https://github.com/MiniMax-AI开源,后续也会持续更新。







阅读原文

跳转微信打开

Fish AI Reader

Fish AI Reader

AI辅助创作,多种专业模板,深度分析,高质量内容生成。从观点提取到深度思考,FishAI为您提供全方位的创作支持。新版本引入自定义参数,让您的创作更加个性化和精准。

FishAI

FishAI

鱼阅,AI 时代的下一个智能信息助手,助你摆脱信息焦虑

联系邮箱 441953276@qq.com

相关标签

MiniMax 大模型 长文本处理 线性注意力机制 Agent
相关文章