新浪新闻客户端

芯展速AICC 2026圆满收官 副总裁许玮演讲拆解AI90推理成本新边界

芯展速AICC 2026圆满收官 副总裁许玮演讲拆解AI90推理成本新边界
2026年09月21日 18:13
图:芯展速副总裁许玮图:芯展速副总裁许玮

  9月21日,芯展速AI战略发布会仅3日后,再度携「AI90全新架构 」出席AICC 2026人工智能大会。副总裁许玮受邀在AI芯片论坛发表AI90主题演讲,深度拆解其技术架构和对AI推理成本边界的重新定义,成为多家媒体深度报道与追问的焦点。

  展区人气:消费级GPU跑出数据中心级Token产能

  展区AI90 Token工厂的亮相,让芯展速成为本次AICC备受关注的参展企业之一。

  现场,AI90展示屏幕上跳动的TPS数字让不少来自智算中心、AI应用厂商专业观众停下脚步,与芯展速技术团队深入交流。

  专题演讲:AI90 Token 工厂

  AICC AI芯片论坛上,芯展速副总裁 - 许玮带来专题演讲,深度拆解AI90边侧推理引擎的技术架构与实测数据。

  他介绍:AI90的核心思路是KV Cache 智能调度——将大模型推理中的KV Cache从GPU显存智能卸载到AI SSD,构建HBM+DRAM+AI SSD三级存储智能调度体系。

  他强调:实测中,Ai90 的10倍TPS吞吐提升、50倍TTFT首Token响应提升的突出表现,对于智能体、对话机器人等强交互场景,意味着从"卡顿等待"到"实时响应"的质变。

  媒体采访:AI90是芯展速「云边端」战略的边侧核心

  演讲结束后,CSDN记者第一时间找到许玮,就AI90 Token工厂架构及边侧推理落地场景展开深度专访。

  (左一)芯展速副总裁许玮 受媒体采访

  采访中,许玮从AI90产品技术延伸到芯展速云边端的战略全景——

  在边侧,AI90 Token工厂降低推理成本,让大模型在边缘节点高效运行;云端,以芯展速全介质存储底座支撑智算中心海量数据集高效读写;端侧,AI SSD加速方案布局,进一步赋能Agent PC与智能终端,让本地推理成为可能。

  当算力不再是唯一瓶颈,数据流动的效率正在决定AI的边界。作为AI算力基础设施的重要一环,芯展速将继续以“存—连—管”全栈能力,携手产业伙伴推动存算协同落地,让AI算力在云端、边缘与端侧真正释放。

  关于芯展速

  (来源:资讯中国)

责任编辑:雷晓燕 SV010

举报邮箱:jubao@vip.sina.com

Copyright © 1996-2026 SINA Corporation

All Rights Reserved 新浪公司 版权所有