2026-06-01·1 分钟阅读 MiniMax 发布新一代通用模型 M3:自研稀疏注意力架构,推理效率大幅提升 分享 微博 复制链接 分享 据证券时报报道,MiniMax 于 6 月 1 日正式发布新一代通用模型 MiniMax M3。该模型采用全新自研的稀疏注意力架构 MiniMax Sparse Attention(MSA),在编程、智能体能力、超长上下文与原生多模态等方向实现突破。 据介绍,在 100 万 token 上下文规模下,M3 的单 token 计算量仅为上一代模型的约二十分之一,显著降低长上下文场景的推理成本。 据 证券时报 报道整理。