AMD 这场发布会讲了不少东西,但从头看到尾,“本地跑 AI”基本一直没离开舞台。台上先拿笔记本做实时内容生成,后面又搬出了桌边的液冷工作站。再去展区逛一圈,会发现联想、极摩客、铭凡、阿迈齐这些厂商也在做类似的事,只是机器大小和产品定位各不相同。共同点倒很明显:内存越做越大,本地跑模型也被放到了更靠前的位置。

发布会现场直接用笔记本运行本地AI应用
9月4日,AMD高级副总裁、计算与图形总经理Jack Huynh以个人AI为主题登台IFA开幕演讲。结合演讲内容与AMD现场展示,这届IFA上最值得关注的,不只是处理器型号更新,而是锐龙AI Max平台从硬件能力,逐步走向可以部署的整机与软件组合。
其中,锐龙AI Max+ PRO 495成为新一批迷你AI工作站的重要基础。需要厘清时间线:AMD在5月20日的官方公告中已经介绍Max PRO 400系列,IFA是整机和应用集中亮相的节点。它释放的信号是,大模型本地运行正在形成一条覆盖开发者、创作者和企业的产品线。
495的关键变化是更大的模型容纳空间
锐龙AI Max+ PRO 495采用16核32线程Zen 5 CPU、40个计算单元的Radeon 8065S集成显卡和XDNA 2 NPU;AMD公布的CPU最高加速频率为5.2GHz,NPU最高55 TOPS。相比单纯追逐算力数字,更影响本地大模型使用边界的是支持最高192GB统一内存,以及最高160GB的显存分配容量。

联想ThinkCentre X Ultra
本地跑大模型有一个很现实的问题:模型得先塞得进去。GPU 最后能调用多少内存,比跑得有多快更早遇到。192GB 到底有什么用,拿大模型的体积算一下会比较直观。比如 3000 亿参数的模型,按照 4bit 来算,光权重就已经接近 150GB。机器真正跑起来当然不只装这一样东西,上下文缓存等内容同样要占空间。也就是说,看到 192GB 不能简单理解成“300B 随便跑”,模型怎么量化、上下文开多长,都会继续吃掉内存。
联想现场展示这台 ThinkCentre X Ultra 没有直接把平台规格全部拉满。现场展牌写的是 1.6L 机身,处理器最高可选 锐龙AI Max+ PRO 495,内存是128GB,依托统一内存架构技术可分配最高 96GB专属显存。放在办公室桌面上,它更像是一台体积压得比较小的 AI 工作主机。
不按token付费之后仍要算整机成本
主题演讲甚至专门拿了一页 PPT 来算 token 的账。画面左边是云端模型,一千万输出 token 对应的数字约为 500 欧元;换到本地模型,直接降至 0 欧元。这里的 0 欧元是因为不再需要按 token 付云端费用,并不是机器本身不用花钱。代码、文档这些任务如果每天反复跑,调用次数多起来以后,这笔费用确实很可观。

发布会将云端输出token费用与本地模型进行对照
购机、用电、模型部署和维护仍有成本;任务完成率、出错后的返工,以及等待时间,同样会影响真实收益。更合理的比较单位是“完成一个合格任务花多少钱”,而非只看生成了多少token。
由此看锐龙AI Max+ PRO 495的价值,大内存首先扩大了可选模型范围,并为模型、检索服务和开发工具共同运行留下余量。高频、可重复、数据不便外传的工作适合优先尝试本地;偶发的高难度任务仍可能交给云端。发布会讨论的也是这种按需协同,而不是所有计算都必须输出云端。
所以我们看这种本地 AI 主机,也不会只盯着 TOPS。实际坐在电脑前,发出指令以后要等多久,模型连续生成时速度会不会往下掉,上下文越拉越长以后还能不能保持,这些感受都更直接。大内存先给模型腾出地方,但机器跑起来顺不顺,还得继续看带宽、计算和软件。
微软开始补齐开发者的开箱体验
本地AI过去常把硬件门槛转化成安装门槛:机器到手,驱动、运行环境、模型工具还需要逐一配置。微软在9月4日公布Project Zenith,面向具备64GB以上统一内存、250GB/s以上内存带宽的开发者级设备,首批将落在AMD Ryzen AI Halo平台。

微软与AMD在发布会共同讨论个人AI
Project Zenith 做的事情更像是把开发前的准备工作先做好一部分。Windows 环境和开发工具预先配好,文件管理、终端、编辑器这些常用入口也直接留给开发者,同时还加入智能体身份、隔离和管理方面的设计。
演讲中Jack还拿一句很简单的话举了例子——“帮我准备明天的事”。上班的人可能想到第二天的会议,学生想到的却可能是考试。模型想把这句话真正接下去,就不能只理解字面意思,还得知道用户有哪些文件、日程怎么排、平时在做什么。不过模型知道得越多,权限这件事就越绕不开。电脑里哪些文件可以看,哪些只能读不能改,碰到什么操作必须先问一句,这些规则不能全交给模型自己决定。
所以 PC 上做 AI,最后看的也不只是芯片。处理器把内存和计算资源准备好,Windows 要管权限和任务怎么跑,真正的应用还得把模型给出的结果变成用户能用的操作。这几层如果没接顺,即使机器塞进很大的内存,买回来也可能还是一台需要自己慢慢折腾的开发设备。
极摩客把迷你PC的卖点转向本地AI
极摩客(GMKtec)把自己的 IFA 全球发布活动放在了 9 月 5 日。展前公布的信息里,AMD锐龙 AI Max+ PRO 495 是这次新品的重点,EVO-X5 Pro 也已经确认亮相。本地模型、内容创作和专业计算,都是官方给它安排的主要使用方向。

极摩客展位上的竖置与横置主机
极摩客展位上有一行字很难忽略——“Desktop-AI Supercomputing”。下面几台主机有横着摆的,也有竖着放的,前面的接口伸手就能接。旁边的屏幕还直接把图形内存等系统信息亮了出来。以前逛迷你 PC 展台,首先想到的往往是机器够不够小;这一次,现场更想告诉观众的是:这么小的机器,也准备拿来长期跑本地模型了。
真要长时间这么用,比较的东西也会跟着变。满负载跑几个小时以后性能还能剩多少,风扇会不会一直很吵,驱动多久更新一次,模型部署碰到问题有没有地方找人,这些都不是跑一次分就能知道的。
锐龙AI Max+ PRO 495 平台能做到多大内存,不代表每台 495 主机出厂都是同一个配置。到底卖 64GB、128GB 还是更大的192GB版本,有哪些接口,什么时候交货,都得分别看厂商最后公布的 SKU。
铭凡把工作站与AI存储放在一起
铭凡这边几乎直接把卖点写在了屏幕上:MS-S1 MAX-P495、AMD锐龙 AI Max+ PRO 495、最高 192GB 统一内存、LPDDR5X 8533 MT/s,以及最高 160GB 显存。想买它回去跑本地模型的人,估计第一眼看的也是这些数字,而不是机箱用了什么造型。

铭凡MS-S1 MAX-P495
铭凡还公布了N5 MAX-P495 AI Agent NAS。前者定位紧凑AI工作站,后者将计算与最高200TB本地存储结合,面向模型、知识库和持续运行的智能体服务。两款产品被放在同一个本地AI方案中,而非分别介绍为普通PC和传统文件存储盒。
模型跑起来以后,机器里还会多出一堆东西。原始文档要存,检索索引要建,向量数据和不同用户的权限也得管。铭凡把计算和本地存储放到一起,至少可以让这些数据少在不同设备之间来回搬。如果多人共用一套资料,知识库也可以直接留在本地。
N5 MAX-P495 把大容量存储和本地 AI 放到一起以后,硬盘空间只是最容易看懂的一部分。真正用来做知识库,资料旧了要更新,搜的时候得找到对的文件,不同成员还不能什么都看。再加上备份、恢复这些日常管理,事情很快就比“能存多少 TB”复杂得多。要让它长期给一个团队用,后面的软件显然不能只是附带功能。
阿迈齐在两升机身里保留扩展空间
阿迈齐(ACEMAGIC)的F9A PRO 495是另一种495整机思路。官方介绍给出约2L铝制机身、最高192GB LPDDR5X-8533内存,并保留双PCIe 4.0 NVMe存储、USB4、OCuLink扩展和双2.5GbE网络。现场展牌与实机则让这套紧凑设计有了直观尺度。

阿迈齐F9A PRO 495现场实机与展牌
阿迈齐这类小主机上,接口多少并不只是“扩展性强”这么简单。系统、模型和资料可以拆开放在不同硬盘里,网络接口决定其他设备访问它时有多方便,OCuLink 之类的扩展也给后面加设备留了位置。
两升左右的机器做到这种配置,放在桌上确实很省地方。不过真让模型连续跑上一下午,关注点很快就会变成另外几件事:外壳热不热,性能会不会掉,风扇是不是一直响。接口数量打开规格页就能数出来,持续负载到底怎么样,还是得让机器多跑一会儿。不过从以往395的机型表现来看,值得期待。
六联以两升机身与可选万兆网络拓展用途
六联智能的 AXB35-03-H13-YC 把移动便利性与工作站扩展放在一起。银色竖置机箱配橙色提手,侧面大面积开孔。厂商参数页写得比较具体:机身体积约 2L,采用锐龙 AI Max PRO 400 系列平台,LPDDR5X-8533 内存最高 192GB,位宽 256bit。

六联智能AXB35-03-H13-YC采用提手式竖置设计
接口这里需要分开看。机器前后各有一个 USB4,同时提供 HDMI、DP 和 SD 读卡器。网络可以选 2.5GbE,也有双 10GbE 方案;存储和扩展则涉及第三个 M.2 以及可选 PCIe 4.0 x4 OCuLink。
双 10GbE 放在这种机器上,最容易想到的还是高速 NAS 和团队共享服务。大文件来回传会快很多,但网络再快也不是内存。现场积核 GEEKOM 还把几台小主机叠在一起展示,看上去很像一个小型计算集群。不过机器接上网线只是第一步,任务怎么分、软件怎么调度,才决定多台机器最后能不能一起干活。
六联之前还做过 SixClaw、AI Assistant 和企业智能体管理方案,所以它想提供的显然是随处理器升级的整体解决方案。硬件装好以后,模型怎么部署、最后怎么接进企业自己的流程,同样属于交付的一部分。
从迷你主机延伸到桌边AI工作站
到了 Threadripper Halo Station,机器已经不是迷你主机这个量级了。作为推出的新品类,AMD 目前把它放在官网的原型产品中,计划 2027 年推出。公布的规格包括 96 核 192 线程 Threadripper PRO 9995WX、最高 2TB 系统内存,以及最高 576GB HBM3e 图形内存。

发布会展示的Threadripper Halo Station原型
这套系统与495迷你主机服务于不同尺度的需求。前者把数据中心级加速器带到桌边,后者用集成平台降低机身体积和部署复杂度。两条路线共同指向一个目标:让更多AI工作在本地完成。
SUSE在台上的讨论进一步把话题引向生产环境:本地开发之后,应用如何进入企业的管理和扩展体系。这也是整场发布会的落点——演示可以由一台机器完成,长期使用则需要更新、权限、运维和支持。
逛完发布会和几个整机展台之后,锐龙AI Max+ PRO 495 带来的变化其实挺容易感受到:以前想在桌面上给大模型留出很大的内存空间,机器选择并不多,现在联想、极摩客、铭凡、阿迈齐、六联这些厂商已经开始往不同尺寸、不同用途的方向迈出了第一步。很快这些产品将陆续上市,届时实际表现如何?让我们拭目以待。也请关注我们的评测,为大家揭晓更多性能和体验细节。
192GB内存走向桌面 ,AMD在IFA 2026推进个人AI与495整机生态
Arlo















沪公网安备 31010702005758号
发表评论注册|登录