AMD 在笔记本芯片上集成 192GB 内存:本地一次跑完 3000 亿参数大模型,不再依赖云端
在刚刚结束的柏林 IFA 2026 展会上,AMD 发布了一款代号为"Gorgon Halo"的笔记本处理器——Ryzen AI Max PRO 400 系列。
它的最大亮点只有一个数字:192GB 统一内存。
这意味着什么?意味着在不连接云端、不插独立显卡的情况下,这台笔记本可以直接运行参数量超过 3000 亿的 AI 大模型。
为什么这个规格这么离谱
传统笔记本的独立显卡,比如目前最顶级的 RTX 4090 Laptop,显存也只有 16GB,顶格到 24GB。而一个 700 亿参数的模型,即便采用 4-bit 量化,也需要约 38-40GB 的空间——根本装不进去。
AMD 的做法是换一个思路:不再用独立的显卡显存,而是让 CPU 和 GPU 共用一块 192GB 的 LPDDR5X-8533 内存池,其中最多可以有 160GB 分配给集成 GPU 作为显存使用。
这块内存以约 273 GB/s 的速度运行,远高于传统系统中通过 PCIe 总线传输数据的速度(Gen 4 ×16 实用带宽仅约 32 GB/s)。换句话说,数据不用再在 CPU 和 GPU 之间来回搬了,直接共享同一块物理内存,瓶颈直接消灭。
3000 亿参数是怎么算出来的
AMD 宣称的"本地运行 3000 亿参数模型",是基于 4-bit 量化精度计算的:
- 3000 亿参数在 4-bit 下约占 150GB 存储空间
- 分配给 GPU 的 160GB VRAM 中还留有约 10GB 余量,用于存放模型推理时需要的键值缓存(KV Cache)
这不是纸上谈兵。基于统一内存架构,笔记本可以加载完整的大模型权重,所有推理都在本地完成,敏感数据完全不会离开设备。
什么时候能买到
HP 和联想已确认将在 2026 年第三季度(即 9 月底前)推出搭载该芯片的商用系统。不过具体定价和供货情况尚未公布,AMD 方面也提到,当前全球 DRAM 供应紧张,可能会影响最终产量。
与此同时,Framework 和 ACEMAGIC 等厂商也已经基于这款芯片推出了桌面版和迷你主机方案,内存同样达到 192GB。
对谁有用
- 个人开发者 / 研究人员:不需要租云端 GPU,本地就能跑大模型做实验
- 对数据隐私敏感的企业:金融、医疗、政务等场景,数据不出设备才能合规
- 远程办公人群:本地运行 AI 助手,不依赖网络,随时随地可用
写在最后
昨天 AMD 还发布了 Threadripper Halo Station(id=704),那是面向专业工作站的双液冷加速卡方案;今天发布的 Ryzen AI Max PRO 400,则是把同样逻辑下沉到了笔记本 SoC。从服务器到工作站再到笔记本,AMD 正在把"本地 AI"这件事做成一个全尺寸覆盖的产品线。
---
*本文基于 AMD IFA 2026 主题演讲内容,并参考 TechTimes、腾讯新闻、VideoCardz 等多家媒体报道转述整理。*
参考来源
- TechTimes: https://www.techtimes.com/articles/326623/20260904/ryzen-ai-max-pro-400-192gb-unified-memory-puts-300b-parameter-llms-your-desk-without-cloud.htm
- 腾讯新闻: https://news.qq.com/rain/a/20260905A09HPW00
- VideoCardz: https://videocardz.com/newz/framework-desktop-with-ryzen-ai-max-pro-495-gets-6-6-higher-memory-bandwidth-and-192gb-ram