AI 智域导航
AI资讯AI资讯AI工具推荐AI工具推荐AI办公软件AI办公软件AI设计软件AI设计软件AI对话聊天AI对话聊天AI编程工具AI编程工具AI大模型AI大模型AI开放平台AI开放平台AI内容创作AI内容创作AI搜索引擎AI搜索引擎
首页
登录

当前标签:显存优化

每秒狂吐1000个token!谷歌开源扩散模型新作,4090单卡可跑

每秒狂吐1000个token!谷歌开源扩散模型新作,4090单卡可跑

每秒狂吐1000个token!谷歌开源扩散模型新作,4090单卡可跑——实际上,这是近期多项开源AI模型在消费级显卡上实现性能飞跃的综合报道,涵盖文本推理、视频生成和图像生成三大领域。

内存暴降50倍且精度无损,MIT提出注意力匹配,能终结大模型显存危机吗?

内存暴降50倍且精度无损,MIT提出注意力匹配,能终结大模型显存危机吗?

MIT提出Attention Matching技术,将大模型KV缓存压缩50倍且几乎不掉精度,有望彻底改变大模型推理的高显存困境。

DeepSpeed

DeepSpeed

DeepSpeed是由微软开发的开源深度学习优化库,专为大规模模型分布式训练打造,能显著提升训练效率与规模。

© 2026 AI 智域导航 皖ICP备19017711号-2 sitemap

免责声明:本导航站提供的内容及外部链接均来自互联网或用户分享,仅供参考与学习交流,不代表本站观点。本站不对其准确性、合法性或安全性负责,如有侵权请联系删除。