当前标签:稀疏注意力
腾讯混元提出 Stem 稀疏注意力算法,首字延迟降低 3.6 倍
腾讯混元团队提出创新的Stem稀疏注意力算法,通过优化注意力计算机制,将模型推理时的首字生成延迟降低3.6倍,显著提升大模型响应速度。
MiniMax发布新模型M3,竞争转向长上下文与Agent能力
MiniMax M3正式发布,以1M超长上下文、前沿编程与智能体能力、原生多模态三大核心功能,推动AI大模型竞争从单一能力转向综合Agent与长上下文应用。
首个三项能力兼备的国产旗舰模型:MiniMax M3 发布,百万上下文、原生多模态
MiniMax M3发布,采用稀疏注意力架构实现百万上下文效率暴增,原生多模态统一建模,成为行业首个长上下文、多模态与高性价比兼备的国产旗舰大模型。