
圖:芯展速副總裁許玮
/朝聞通/9月21日,芯展速AI戰略發布會僅3日後,再度攜「AI90全新架構 」出席AICC 2026人工智能大會。副總裁許玮受邀在AI芯片論壇發表AI90主題演講,深度拆解其技術架構和對AI推理成本邊界的重新定義,成為多家媒體深度報道與追問的焦點。
展區人氣:
展區AI90 Token工廠的亮相,讓芯展速成為本次AICC備受關注的參展企業之一。

現場,AI90展示屏幕上跳動的TPS數字讓不少來自智算中心、AI應用廠商專業觀衆停下腳步,與芯展速技術團隊深入交流。
專題演講:
AICC AI芯片論壇上,芯展速副總裁 - 許玮帶來專題演講,深度拆解AI90邊側推理引擎的技術架構與實測數據。

他介紹:AI90的核心思路是KV Cache 智能調度——将大模型推理中的KV Cache從GPU顯存智能卸載到AI SSD,構建HBM+DRAM+AI SSD三級存儲智能調度體系。
他強調:實測中,Ai90 的10倍TPS吞吐提升、50倍TTFT首Token響應提升的突出表現,對于智能體、對話機器人等強交互場景,意味着從"卡頓等待"到"實時響應"的質變。
媒體采訪
演講結束後,CSDN記者第一時間找到許玮,就AI90 Token工廠架構及邊側推理落地場景展開深度專訪。

(左一)芯展速副總裁許玮 受媒體采訪
采訪中,許玮從AI90産品技術延伸到芯展速雲邊端的戰略全景——
在邊側,AI90 Token工廠降低推理成本,讓大模型在邊緣節點高效運行;雲端,以芯展速全介質存儲底座支撐智算中心海量數據集高效讀寫;端側,AI SSD加速方案布局,進一步賦能Agent PC與智能終端,讓本地推理成為可能。
當算力不再是唯一瓶頸,數據流動的效率正在決定AI的邊界。作為AI算力基礎設施的重要一環,芯展速将繼續以“存—連—管”全棧能力,攜手産業夥伴推動存算協同落地,讓AI算力在雲端、邊緣與端側真正釋放。