MiniMax 发布新一代通用模型 M3:自研稀疏注意力架构,推理效率大幅提升
·1 分钟阅读

MiniMax 发布新一代通用模型 M3:自研稀疏注意力架构,推理效率大幅提升

分享

据证券时报报道,MiniMax 于 6 月 1 日正式发布新一代通用模型 MiniMax M3。该模型采用全新自研的稀疏注意力架构 MiniMax Sparse Attention(MSA),在编程、智能体能力、超长上下文与原生多模态等方向实现突破。

据介绍,在 100 万 token 上下文规模下,M3 的单 token 计算量仅为上一代模型的约二十分之一,显著降低长上下文场景的推理成本。

据 证券时报 报道整理。

相关资讯