AMD Ryzen AI Halo:本地AI每秒45 Token
Hands-On with the AMD Ryzen AI Halo

这次我亲自上手测试了AMD Ryzen AI Halo,结果令人惊喜。在本地运行AI模型时,它竟然能达到每秒45个Token的生成速度,这意味着我们不再需要依赖云端服务就能流畅使用AI。对于注重隐私和延迟的用户来说,这是一个巨大的突破。AMD正在用硬件实力证明,本地AI计算不再是遥不可及的梦想,而是触手可及的现实。
AMD Ryzen AI Halo 实现了本地 AI 每秒 45 个 Token 的惊人速度。
- Strix Halo 的内存带宽(约 250GB/s)远低于 5090(1.8TB/s)和 M3 Ultra(900GB/s),导致其作为 AI 机器性能平庸,仅适合通用计算。
- 尽管缺乏原生 FP4 支持且速度受限,Strix Halo 凭借 128GB 统一内存可运行 Qwen3.5-122B 等超大模型,而受限于 VRAM 的独立显卡无法做到这一点。
- 有用户指出 4000 美元的定价过高,相比此前 2000 美元的 Framework Desktop 性价比大幅下降,甚至被戏称为'Radio Shack 玩具'。
- 部分开发者认为未来 2 年内本地大模型普及的关键在于共享内存架构,AMD 和 Apple 是打破 Nvidia 显存限制、实现 100B+ 模型本地运行的希望。
- 针对 Strix Halo 的局限,有评论者提出理想的未来架构应是结合 GDDR7 高速缓存与大容量 LPDDR5x/DDR5 的混合 GPU,以优化 MOE 模型性能。