跳到正文
硅脉动SiliconMai

此芯科技发布AGX X2,面向端侧智能体推理

该平台支持70亿至1220亿参数模型,配置最高160GB统一内存。公司称单Token能耗较行业降低逾50%,并计划兼容多家国产加速卡。

硅脉动
AI资料图

此芯科技在9月18日深圳客户大会上发布AGX X2计算平台,将边缘推理和AI智能体作为主要应用方向。公司公布的端侧峰值算力为80至300 TOPS,支持70亿至1220亿参数大模型原生推理,希望通过提高本地算力和内存容量扩大终端可运行的模型范围。

公司首席市场官Danny Zhang表示,平台配置64至160GB LPDDR5统一内存,单Token能耗较行业降低50%以上。这些性能及能耗数据来自公司介绍;其中降低能耗的比较口径,报道未提供具体测试配置。

此芯将边缘设备的限制归纳为模型规模、内存带宽及功耗散热三项。其方案结合大容量统一内存、制程工艺和异构调度,把模型运行所需的计算与存储能力放在同一平台中。 与单一芯片发布相比,AGX X2还涉及扩展硬件和软件体系。公司称平台兼容多家国产AI加速卡、GPU卡及VPU卡,支持通过不同处理器级联增加算力,并以自研Agentic OS协调客户端和服务端。

公司列出的部署方式包括办公智能体主机、个人AI超算及混合模态智能体集群,应用范围还包括智能制造、智能座舱和具身智能。其端边云方案把实时推理放在终端,边缘设备负责聚合算力,云端承担训练迭代。

在大会上,此芯也与生态伙伴展示了基于其片上系统的终端产品和行业方案。后续平台战略包括迭代高性能SoC、推动SoC与NPU协同,以及对模型生成的Token进行统一生产和计量。