9月18日,此芯科技在深圳举办2026客户大会,正式发布AGX X2平台,同时以AGXcelerator作为该平台的产品名。平台定位为面向边缘推理与智能体应用的算力底座,官方给出的规格是80至300TOPS的端侧峰值算力,支持7B至122B参数的大模型在本地原生推理,配置64至160GB LPDDR5统一内存,单Token能耗比行业水平降低50%以上。
这套规格针对的是边缘设备的三个现实门槛:模型规模受限、内存带宽不足、功耗与散热受限。统一内存容量上探到160GB,意味着原本只能在数据中心跑的百亿参数级模型有机会落到终端;把能耗压下来,则直接关系到设备能否在无风扇或小体积散热的条件下持续工作。
平台还定义了Agentic Compute开放架构,兼容多家国产AI加速卡、GPU卡与VPU卡,支持多卡级联扩展算力。配套的自研Agentic OS采用一套系统、两端协同的方式,主打服务端与客户端的端云协同,并通过模型即服务的方式对Token做统一生产与计量。
产品形态上,平台给出办公智能体主机、个人AI超算、混合模态智能体集群三类部署方式,可覆盖桌面超算、智能制造、阵列服务器、智能座舱与具身智能等边缘场景,按端侧实时推理、边缘聚合算力、云端训练迭代组织协同闭环。
把这件事放在行业脉络里看,端侧算力的竞争已经从单一芯片指标转向系统能力。模型每几个月换代一次,而芯片与软件栈的适配需要编译、算子与精度对齐等长期工程投入,两者节奏不一致时,再高的峰值算力也难以转化为可用的性价比。开放架构与统一软件栈要解决的正是这个问题。
对开发者而言,值得关注的是平台能否把内存、功耗与软件生态三件事同时交代清楚;对整机厂商而言,关键是同一套底座能否覆盖从办公设备到机器人本体的不同形态。规格已经摆在台面上,接下来要看的是实际交付与生态落地节奏。
A5创业网 版权所有