芯展速董事长孙丹:以存强算,全景覆盖,构建“云、边、端”三级数据基座

新浪科技讯 9月18日消息,芯展速17日宣告“云-边-端”全景覆盖的AI战略布局正式落地。芯展速董事长兼CEO孙丹指出,GPU算力二十年间增长近6万倍,而显存带宽与容量的增长却近乎线性——内存墙之下,主流解法似乎只剩下KV Cache压缩+HBM堆叠。在这样的困局下,芯展速选择走出第三条创新的解法——让存储参与计算,以存力强化算力。 “以存强算,全景覆盖。”...

新浪科技讯 9月18日消息,芯展速17日宣告“云-边-端”全景覆盖的AI战略布局正式落地。芯展速董事长兼CEO孙丹指出,GPU算力二十年间增长近6万倍,而显存带宽与容量的增长却近乎线性——内存墙之下,主流解法似乎只剩下KV Cache压缩+HBM堆叠。在这样的困局下,芯展速选择走出第三条创新的解法——让存储参与计算,以存力强化算力。 “以存强算,全景覆盖。”孙丹表示,“构建‘云、边、端’三级数据基座——云端AI SSD提升集群整体吞吐与稳定性、边缘Token工厂与实时推理、端侧本地化AI能力。” 芯展速副总裁李蓁与VAST Data中国区售前总监刘陈泓共同发布了芯展速面向云端AI存储的全介质栈方案。这一方案已获得VAST Data官方认证。 刘陈泓表示,“AI存储演进的一个重要方向,就是走向无分层的统一数据平台:让上层应用看到一套统一的系统、统一的数据,而不是多个割裂的层级。”他指出:“芯展速PT200Z AI SSD的超高耐久与MQ系列的122.88TB 超大容量,正是为‘架构之上无分层’的云存储需求而生。” 李蓁介绍,VAST Data等云存储客户的真实需求是无分层架构——这正是芯展速的核心战略布局:SCM+高密度QLC+高性能TLC的组合。 芯展速副总裁许玮与高级总监杨泽宏携AI90训推加速引擎亮相。许玮首先介绍了AI90 Token工厂的技术实现:AI90通过智能KV Cache调度与智能P2P互联,将KV Cache从HBM卸载至高性能AI SSD,构建HBM+DRAM+SSD三级存储体系,让‘有限’显存承载‘无限’上下文,消费级硬件跑出企业级性能。杨泽宏以Live Demo提供了AI90硬核数据:推理吞吐量从约120tk/s跃升至610tk/s,首Token延迟从27.99秒降至0.56秒——吞吐提升5倍,响应快50倍。 海威智算CTO刘超从合作伙伴视角,肯定了AI90的实践数据:基于AMD-AI90一体机,Qwen 72B模型下,单Token成本仅为同档云API价格的约1/67。 Flowy CEO祁国良分享了AI PC的技术实现。他强调:“AI30 让端侧设备真正成为独立的AI算力节点,端侧AI的‘最后一公里’正在被铺平。” 当天,芯展速合伙人兼COO钱亚欧代表芯展速先后与‘光环新网’、‘海威智算’、‘云工厂’、‘Flowy’签署战略合作协议。合作覆盖智算中心、云、端侧AI三大关键场景,宣告云边端生态闭环正式落地。

查看原文