AMD 192GB 统一内存:英伟达跟进验证了这条路,但 DRAM 暴涨是现实难题
Computex 2026 期间,AMD 正式发布了 Ryzen AI MAX PRO 400 Series 处理器(代号 Gorgon Halo)。最大的卖点不是 CPU/GPU 频率的微调,而是内存容量的跃迁——最高 192 GB 统一内存,其中 GPU 可分配 160 GB 作为显存。

这让它成为全球首款能在本地运行 300B+ 参数大语言模型的 x86 客户端芯片(4-bit 量化)。对比前代 Strix Halo 的 128GB 上限,这一代直接拉高了 50%。
规格一览
旗舰型号 Ryzen AI Max+ PRO 495 配备 16 核 32 线程 Zen 5 CPU(最高 5.2 GHz)、40 CU 的 Radeon 8065S 集成显卡(RDNA 3.5 架构)以及 55 TOPS 的 XDNA 2 NPU。内存控制器升级后支持最高 192 GB LPDDR5X-8000,四通道 256-bit 带宽。
全系列三款 SKU:
- Max+ PRO 495(旗舰):16C/32T,Radeon 8065S 40CU,55 TOPS NPU
- Max PRO 490:12C/24T,Radeon 8050S 32CU,50 TOPS NPU
- Max PRO 485:8C/16T,Radeon 8050S 32CU
OEM 合作伙伴 ASUS、HP、Lenovo 已签约,终端产品预计 Q3 2026 上市。
英伟达入局,AMD 的先发优势
更具戏剧性的是,NVIDIA 几乎同时在 Computex 发布了 RTX Spark SoC,同样走统一内存路线(最高 128 GB,Blackwell GPU,ARM 架构)。
AMD 高级副总裁 David McAfee 在圆桌采访中表示统一内存架构"机遇无限",并积极评价英伟达的跟进。客户端业务总经理 Rahul Tikoo 则直言 Gorgon Halo"会是一款更好的产品"。
AMD 在统一内存 APU 领域的先发优势超过两年——从 2025 CES 发布 Strix Halo(Max 300 系列)开始,就独占大内存 AI 芯片赛道。RTX Spark 的加入,某种程度上验证了这条路的方向。而 AMD 还保有 x86 兼容性这一差异化壁垒,RTX Spark 的 ARM 架构在 Windows 生态的迁移成本仍是未知数。
DRAM 暴涨:理想与现实的差距
但硬币的另一面不容忽视。Tom's Hardware 报道指出,DRAM 合约价格 Q1 涨幅已达 90-95%,Q2 预计再涨 58-63%,且三星、SK 海力士、美光三大厂商的产能重心已转向高利润的 HBM,传统 DRAM 供给持续收紧。SK 集团董事长甚至在 Computex 表示内存短缺将持续到 2030 年。
192 GB 的 LPDDR5X 内存在技术上令人印象深刻,但成本会成为普及的最大障碍。NVIDIA 已因内存成本将 DGX Spark 从 $3,999 涨至 $4,699。AMD Ryzen AI Halo 开发者平台也定价 $3,999 起。真正走量的 SKU,大概率仍会落在 64GB/128GB 档位。
写在最后
AMD 在统一内存架构上的押注,从硬件角度看无疑是正确的方向——对于本地 AI 推理,内存容量往往比算力更重要。大模型必须先装进内存,吞吐量才有意义。英伟达的跟进进一步印证了这一点。
但 DRAM 暴涨给"大内存 AI PC"的美好愿景泼了一盆冷水。技术方向正确,不等于时机正确。AMD 和 NVIDIA 同时在算力和内存上做加法,但供应链的减法,可能会让这场竞赛的胜负取决于谁能先解决成本问题,而非谁的规格数字更大。
来源:AMD 官方博客、Tom's Hardware、中关村在线
- 苹果 A20 Pro 改用 WMCM 封装,内存移至芯片侧面改善散热6/27/2026
- 美国政府要求 OpenAI 分阶段发布 GPT-5.66/26/2026
- Anthropic 获美国政府批准,恢复 Mythos 5 模型对关键基础设施组织的部署6/27/2026
- 腾讯玄武阿图因AI在CyberGym测试中超越Mythos7/3/2026
- 华为开源 920 亿参数 openPangu-2.0-Flash 模型6/30/2026
- Gemini Omni Flash 登顶 Video Arena 盲测榜,领先第二名 101 分7/3/2026
- DeepSeek 联合北大开源 DSpark:半自回归推测解码,推理速度提升 57% 至 85%6/27/2026
- 苹果首款触屏 MacBook 确认搭载 M5 Pro/Max,M7 版计划 2027 年跟进6/27/2026
- 华为天才少年的开源AI Agent全书:6700星、十章、可跑实验代码7/20/2026
- Cursor 研究:越强的 AI 模型越会"作弊"应对编程基准测试6/26/2026
- Hallmark:一份写给AI编码助手的反AI味设计手册7/17/2026
- Claude Code 被指通过 system prompt 隐蔽传递代理与时区信息6/30/2026
- Voicebox:43K Stars 的开源 AI 语音工作室,7 引擎 TTS + MCP Agent 集成7/19/2026
- OmniRoute:日增 1300+ Star 的开源 AI 网关,一个端点接通 250 个模型提供商7/20/2026
- AI 代码审查的 token 困境:code-review-graph 如何用代码图谱砍掉 98% 的上下文7/20/2026
- 27B 模型塞进手机:PrismML Bonsai 27B 把权重压到 1-bit7/18/2026
- 6.4 万 Star 的开源全球情报平台:World Monitor 架构与能力全景7/21/2026
- KTransformers:单 GPU 跑 671B MoE 模型的清华方案7/21/2026
- Qwen-Image-3.0 发布:追求实用的图像生成7/21/2026
- Qwen3.8 发布:2.4T 参数、原生多模态、开放权重承诺7/19/2026
- Kimi K3:2.8万亿参数开源模型,前端编程Arena登顶7/17/2026
- Kimi K3 首登 DeepSWE v1.1:开源权重模型挤进前三7/18/2026
- GPT-5.6用一段十页提示词,关闭凸优化30年的复杂性缺口7/19/2026
- jcode:用 Rust 重写的 AI 编码代理,内存占用仅为 Claude Code 的 1/147/22/2026
- Gemini 3.6 Flash 发布:Token 效率砍 65%,多模态全面领先7/21/2026
- AI 连破三大数学猜想:Jacobian 猜想 87 年反例与形式化验证的新时代7/21/2026
- B站在WAIC展出开源AI猫娘:能看懂屏幕、主动搭话的桌面伙伴7/18/2026
- 2026 年 AI 都学会了记忆,但你的记忆不属于你7/19/2026
- Moonshine Micro:80美分芯片跑完整语音流水线,500KB内存装下VAD+STT+TTS7/18/2026
- LingBot-Map:用前馈3D基础模型做流式重建,20FPS跑完一万帧7/18/2026