192GB+300B大模型!新品官宣:10月上市

据媒体报道,在德国柏林举办的IFA 2026上极摩客公司推出了EVO-X5 Pro迷你主机,该机采用的是AMD锐龙AI Max+ PRO 495处理器和192GB LPDDR5X-8533统一内存,并且可以在桌面大小的空间里实现全离线运行300B参数级别的大语言模型。



Zen5 全大核,整机算力为 131TOPS


锐龙AI Max+ PRO 495的代号是"Gorgon Halo",它使用了Zen 5架构,并且有16个核心以及32条线程,在最大加速状态下可以达到每秒五点二吉赫兹的速度,在最低基准下也可以得到每秒三点一吉赫兹的速度,它还配备了十六兆字节大小的二级缓存和六十四兆字节大小的一级缓存。它的基础功耗大约在五十瓦到一百二十瓦之间可调。


图形上使用的是Radeon 8065S核显,基于RDNA 3.5架构,拥有40个计算单元并且有硬件级别的光线追踪能力。XDNA 2架构NPUs可以做到每秒处理55万亿次运算量,而CPU、GPU和NPU三者合计起来总共有131万亿次运算量的能力。之前泄露出来的Geekbench 6多核心分数大概在18000分左右,所以它的性能应该差不多就是高端移动工作站级别了。



300B 模型可以运行起来,但是并不意味着它跑得很快


EVO-X5 Pro最突出的地方是使用了192GB LPDDR5X-8533统一内存,带宽为273GB/s,并且可以灵活地把其中的最大160GB分配给GPU使用。CPU和核显可以共享同一块物理内存,在大模型推理时避免大量的数据传输,也能解决传统独立显卡显存不够大的问题。



但是能够跑起300B模型,并不等于可以流畅地跑起这个模型。把300B稠密模型做四舍五入之后,它的权重大小只有约150G左右,再加上量化元数据、KV缓存以及推理框架等因素的影响下,整个系统的总容量就会更大一些,而上下文长度也会随之减少。


带宽依然是个问题,根据273G/s来算的话,稠密300B模型生成的速度大概在1.5token/秒左右,实际体验比较慢一些。对于这台机器来说,更适合的就是MoE模型了,比如总的参数量有2840亿,但是每次只会激活一部分专家,在推理的时候可以做到6到7token/秒的样子。展会上用Qwen3.8-Flash-Next做演示时,输出速度能达到十几毫秒一个数的程度,并且已经有了不错的交互感受。



使用的是三风扇散热方式,适合专业的用户群使用


从散热的角度来看,新机使用了VC均热板和三风扇系统、前置F-MODE实体按键可以快速切换三种工作状态并且在屏幕上显示当前的工作状态、采用了CNC一体式的全金属材质并有黑色和银色两种颜色可供选择。



接口有前面两个为USB4、后面两个也为USB4 V2,可以外接显卡坞和多台设备联网使用,并且配有高速网口。企业的使用上,该款机器具有AMD DASH远程控制的功能,在内部安装了单独的安全芯片,并且通过了连续七天每天二十四小时不间断测试。


EVO-X5 Pro预计在2026年10月份上市,并且只推出一个顶配版本为192GB,在此之前的价格信息还未公开。根据前一代产品EVO-X2 128GB版本在国内首发时定价为14999元来推算的话,考虑到大容量内存的成本问题,该产品的售价很可能会出现较大的上涨趋势。



这并不是给普通消费者使用的便携式电脑,而是为人工智能开发、本地计算以及高要求的工作环境所设计的小型工作站在此情况下下订单的话可以得到192G的统一内存空间,在不需要在线运行大型模型的情况下也可以选择旧款产品或者云上的服务。

展开阅读全文

更新时间:2026-09-14

标签:数码   模型   新品   运算量   大小   内存   速度   稠密   架构   级别   多核   工作站

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302034903号

Top