
这几天数码圈被 AMD 刷屏了:锐龙 AI Max PRO 400 系列正式发布,官方口径是全球率先能在本地运行 3000 亿参数模型的 x86 客户端处理器,直接喊出智能体计算机这个概念。听着很猛,但冷静下来要问一句:本地跑大模型,到底是真生产力,还是营销噱头?我把官方数据和网友实测都翻了一遍,聊点实在的。
一、这次 AMD 到底发布了什么
先说硬货。这次一共三款:AI Max+ PRO 495、AI Max PRO 490、AI Max PRO 485。旗舰 495 是 16 核 32 线程,最高 5.2GHz,Radeon 8065S 显卡,NPU 最高 55 TOPS,整机算力 131 TOPS。
真正的大杀器是内存:统一内存最高 192GB,其中最多 160GB 可以划给核显当显存用。四比特量化后,3000 亿参数模型的权重大概 150GB,正好塞进这个内存池,这就是本地跑 300B 说法的来源。
定位上,AMD 这次不聊跑分,聊的是智能体计算机:不联网也能在本地跑 AI 智能体,数据不出门,低延迟,主打隐私和企业场景。2026 年第三季度,惠普、联想这些 OEM 会陆续出货。

二、关键点:300B 是能跑,不是跑得快
这里必须划个重点:官方说的 300B,是能跑,不是跑得好。
AMD 自己公布的实测速度,用的是 Meta 的 30B 模型,在 AI Max+ 395 上最高 24 token 每秒;Qwen 27B 也是 24.5 token 每秒。30B 都只有这个速度,你想想 300B 真跑起来会是什么体验,大概率是能出字,但出得慢。
而且 495 的功耗是 45 到 120 瓦,跑满 AI 负载照样烫、照样费电,续航打折跑不掉。同样的性能塞进笔记本,散热和功耗的代价省不掉。
三、网友怎么看:支持的和泼冷水的都在
支持的声音很真实。有评测拿锐龙 AI Max 的机器实测,64GB 内存分 48GB 给显存,本地跑 70B 模型没问题;还有人拿它当真 AI NAS,断网也能给局域网设备提供大模型服务,隐私数据不出门。对剪片、写代码、出差断网场景,本地模型确实有用。
泼冷水的也不少,而且都挺扎心。有博主直接点破:本地 AI 模型,能跑不等于值得用,技术演示包装成产业趋势,收割流量。更常见的是这类吐槽:普通办公本跑大模型,CPU 占用 80% 以上、内存拉满、风扇狂转、机身发烫,等十几分钟,生成结果还胡言乱语、逻辑不通。还有人买了大内存旗舰机跑本地模型,接上智能体框架后慢得离谱,问一句你好,回答要四分钟。律师圈也流传一句话:能装不等于能用,想喝牛奶,没必要把奶牛牵回家。
四、我的看法:真生产力还是噱头,得分人
直接说结论:方向是真的,300B 是名片。
对开发者和企业,本地跑大模型是真需求:敏感数据不能上云,智能体要低延迟、要离线可用,这时候统一内存的优势是实打实的,云端替代不了。
对普通用户,本地跑 30B 到 70B 级别,离线翻译、文档整理、写代码、AI 修图,已经有实用价值;但 300B 这种旗舰,更多是秀肌肉,能跑,但没几个人真拿它当日常主力,因为慢、烫、贵,192GB 内存的机器价格基本奔着两万去了。
所以别被 300B 三个字冲昏头。想要隐私和离线,本地方案值得等;追求速度和效果,云端大模型依然是多数人的最优解。选之前先问自己:你的数据真的不能上云吗?你真的每天要跑几百亿参数吗?
最后提醒一句:目前这些还都是纸面参数,300B 到底跑成什么样,得等第三季度真机上市、看第一批实测。在那之前,宣传片里的数字,都当参考,别当圣旨。














