当前标签:AI加速

让 32GB 内存能跑 GPT-OSS-120B:Nextorage 将推外接式 AI 加速硬件

让 32GB 内存能跑 GPT-OSS-120B:Nextorage 将推外接式 AI 加速硬件

一款名为Nextorage的外接式AI加速硬件即将问世,旨在让仅配备32GB内存的普通电脑流畅运行GPT-OSS-120B等百亿级大模型,通过专用硬件桥接与边缘计算优化,彻底打破AI算力的内存瓶颈。

高通推出个人 AI 设备上市加速计划 Snapdragon START

高通推出个人 AI 设备上市加速计划 Snapdragon START

高通在2025骁龙峰会上携手中国产业伙伴启动“AI加速计划”,旨在推动终端侧AI规模化落地,加速个人AI设备从概念走向市场。

Analog Tech 推出 5L 边缘 AI PC,内置 214 TOPS dNPU 加速卡

Analog Tech 发布全球首款5L体积边缘AI PC,内置自研214 TOPS dNPU加速卡,为工业4.0与端侧大模型部署提供极致算力密度。

手机上跑MoE?Meta提出MobileMoE,iPhone 16 Pro提速3.8倍

手机上跑MoE?Meta提出MobileMoE,iPhone 16 Pro提速3.8倍

在14项基础测试中,MobileMoE-S/M仅用稠密基线1/2到1/4的计算量即达到持平甚至更高准确率,在iPhone 16 Pro上输入阶段最高提速3.8倍,将MoE高效推理首次带入商用手机。

算法1年翻倍,芯片2年翻倍?重磅实锤:AI正在自我加速,拦不住了

算法1年翻倍,芯片2年翻倍?重磅实锤:AI正在自我加速,拦不住了

AI算法计算效率每18个月提升2倍,芯片性能每2年翻番,两者叠加使AI自我加速速度远超摩尔定律,技术变革已进入不可逆的快车道。

AMD

AMD

AMD官网入口是访问其高性能计算产品的核心渠道,提供针对AI训练、推理及边缘计算的解决方案。

单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地

单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地

aiX-apply-4B模型以极低算力成本实现15倍推理速度提升,将原本依赖高端集群的大模型推理任务压缩至单张消费级显卡,显著降低企业AI部署门槛并加速研发落地。