芯展速董事長孫丹:以存強算,全景覆蓋,構建「雲、邊、端」三級數據基座

新浪科技
60分鐘前

  新浪科技訊 9月18日消息,芯展速17日宣告「雲-邊-端」全景覆蓋的AI戰略佈局正式落地。芯展速董事長兼CEO孫丹指出,GPU算力二十年間增長近6萬倍,而顯存帶寬與容量的增長卻近乎線性——內存牆之下,主流解法似乎只剩下KV Cache壓縮+HBM堆疊。在這樣的困局下,芯展速選擇走出第三條創新的解法——讓存儲參與計算,以存力強化算力。

  「以存強算,全景覆蓋。」孫丹表示,「構建‘雲、邊、端’三級數據基座——雲端AI SSD提升集群整體吞吐與穩定性、邊緣Token工廠與實時推理、端側本地化AI能力。」

  芯展速副總裁李蓁與VAST Data中國區售前總監劉陳泓共同發布了芯展速面向雲端AI存儲的全介質棧方案。這一方案已獲得VAST Data官方認證。

  劉陳泓表示,「AI存儲演進的一個重要方向,就是走向無分層的統一數據平台:讓上層應用看到一套統一的系統、統一的數據,而不是多個割裂的層級。」他指出:「芯展速PT200Z AI SSD的超高耐久與MQ系列的122.88TB 超大容量,正是為‘架構之上無分層’的雲存儲需求而生。」

  李蓁介紹,VAST Data等雲存儲客戶的真實需求是無分層架構——這正是芯展速的核心戰略佈局:SCM+高密度QLC+高性能TLC的組合。

  芯展速副總裁許瑋與高級總監楊澤宏攜AI90訓推加速引擎亮相。許瑋首先介紹了AI90 Token工廠的技術實現:AI90通過智能KV Cache調度與智能P2P互聯,將KV Cache從HBM卸載至高性能AI SSD,構建HBM+DRAM+SSD三級存儲體系,讓‘有限’顯存承載‘無限’上下文,消費級硬件跑出企業級性能。楊澤宏以Live Demo提供了AI90硬核數據:推理吞吐量從約120tk/s躍升至610tk/s,首Token延遲從27.99秒降至0.56秒——吞吐提升5倍,響應快50倍。

  海威智算CTO劉超從合作伙伴視角,肯定了AI90的實踐數據:基於AMD-AI90一體機,Qwen 72B模型下,單Token成本僅為同檔雲API價格的約1/67。

  Flowy CEO祁國良分享了AI PC的技術實現。他強調:「AI30 讓端側設備真正成為獨立的AI算力節點,端側AI的‘最後一公里’正在被鋪平。」

  當天,芯展速合夥人兼COO錢亞歐代表芯展速先後與‘光環新網’、‘海威智算’、‘雲工廠’、‘Flowy’簽署戰略合作協議。合作覆蓋智算中心、雲、端側AI三大關鍵場景,宣告雲邊端生態閉環正式落地。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10