商業
撰文:島聞編輯部2026/9/172 分鐘閱讀
華為全聯接大會2026期間,華為副董事長、輪值董事長汪濤在主題演講中,正式推出OceanStor M900 AI記憶儲存。面向超大規模資料中心AI推理場景,該產品為超節點提供PB級大容量、TB級高效能的全共享記憶空間,推動AI基礎設施從以計算為中心,邁向計算、網路與儲存深度協同的新階段,進一步釋放超節點算力潛能。
2026年,人工智慧加速從技術突破走向規模應用,AI應用從Chatbot對話進一步演進為能夠自主完成複雜任務的智慧體,並加速進入科研、醫療、金融和公共服務等關係國計民生的重要領域,人類社會由此進入Agentic AI時代。
隨著大模型邁向10T級引數規模,超節點成為AI基礎設施建設的必然選擇,同時業界主流大模型的上下文視窗已突破百萬詞元,多輪推理和複雜任務成為常態,推理過程中產生的KV Cache資料規模持續增長,視訊記憶體和記憶體容量與價效比均已無法滿足需求。構建視訊記憶體、記憶體與SSD協同的多級儲存體系,打造大容量的全共享記憶空間,已成為行業共識。
為了突破超長上下文、多輪推理場景的記憶體容量瓶頸,華為全新推出的OceanStor M900 AI記憶儲存,利用靈衢網路構建了「一跳直通」的PB級全域性KV Cache多級快取方案,充分釋放超節點的算力潛能,加速超大規模資料中心AI推理,其具備三大核心能力:
打破容量邊界,讓大規模AI擁有更充足的記憶
依託靈衢高速網際網路絡,實現KV Cache的全域性池化共享和分級儲存,將超節點的KV Cache從視訊記憶體與記憶體擴充套件至SSD,單叢集可提供64PB容量,單NPU可用KV Cache容量從GB級提升至TB級,讓更多上下文得以儲存、共享和復用,大幅提升KV Cache快取命中率。
躍升推理效能,讓算力釋放更充分
業界首創的CPU、網路、盤控三芯合一架構,提供原生KV語義,實現超節點的NPU一跳直通到SSD,避免協議轉換和CPU轉發,訪問時延由ms級降至60μs,縮短90%;單叢集可提供40TB/s聚合訪問頻寬,相比業界方案提升1.5倍。在典型AI程式設計場景中,可實現推理叢集Token吞吐率翻倍、首Token時延縮短一半,讓算力更快轉化為生產力。
降低Token成本,讓AI規模化應用更經濟
採用業界首創的KV-Aware自適應儲存技術,根據KV Cache資料價值預測生命週期,對多模介質上的資料排布進行智慧排程,實現最高24 DWPD,使得SSD介質壽命提升16倍,支撐三年穩定執行;通過減少介質更換和運維投入,降低大規模AI推理基礎設施的長期成本,加速人工智慧規模化普及。
面向未來,隨著人工智慧加速進入各行業核心生產系統,AI基礎設施將由單純追求算力規模,進一步邁向算力、網路與存力的系統協同,AI記憶儲存將成為持續提升超大規模推理KV Cache容量與訪問效率的必然選擇。華為將不斷推進軟硬體協同和系統級創新,打造開放、高效、可持續的AI基礎設施,為人工智慧技術進步、產業智慧化升級提供堅實支撐。
原文出自 PR Newswire Asia →

科技
撰文:島聞編輯部2026/10/10