/朝聞通/近日,由中關村雲計算産業聯盟牽頭的《通算智算一體化雲基礎設施總體技術要求》團體标準編制工作正式啟動。青雲科技作為參編單位深度參與本次标準建設,将自身企業級 AI 基礎設施的落地實踐融入标準編制,推動通算智算一體化産業共識的形成。
《通算智算一體化雲基礎設施總體技術要求》團體标準面向中心雲、邊緣雲多元部署場景,覆蓋 AI 推理、智能體應用、通用業務處理、多業務混合承載等主流業務,重點對通算、智算、存儲資源統一納管、協同調度建立技術準則,同時明确接口兼容、安全可靠、運維運營、測試評價等多維度規範,為通智一體基礎設施建設提供依據。後續該團體标準還将推進向國家标準升級申報。
青雲科技于今年正式确立了企業級 AI 基礎設施(AI Infra)與解決方案提供商的核心戰略定位,以 AI 原生理念驅動全棧産品體系重構。依托 KubeSphere 内核打造的 UniDock 統一智能底座,打通虛拟化、雲、雲原生與 AI 智算能力,實現算力資源從分散孤立走向一體化統一供給。這條技術演進路線,與本次标準倡導的通智一體、存算分離、統一納管、協同調度、開放兼容、可運營等核心訴求高度契合。
從 “多套平台” 到 “一套底座”:統一管控是通智一體化的起點
通算智算一體化的核心,不隻是具備 GPU 算力,更要實現異構計算資源在同一技術體系下識别、管理與調度。本次标準草案将統一管控平台、資源池化、跨集群協同、多元算力協同作為核心要求,通過管理調度層完成資源管理、調度、監控、計量與運維,推動通算、智算、存儲、網絡,從分散設備、獨立平台轉變為可統一編排、按需供給的基礎設施能力。
青雲科技産品體系正沿着該方向持續疊代。KubeSphere 作為全棧産品統一的技術基座,持續優化多集群治理、節點組管理、租戶資源隔離、異構基礎設施納管、彈性調度、可觀測等核心能力;底座的統一讓虛拟機、容器、AI 推理等多種工作負載可共享底層基礎設施能力,規避多平台重複建設、重複适配難題。 對于企業客戶而言,一體化不是各類軟硬件簡單堆砌,而是支撐傳統業務與 AI 業務,在同一套基礎設施之上持續疊代演進。
從 “設備接入” 到 “算力協同”:把異構硬件變成可調度算力池
當前産業内 NVIDIA GPU、國産 GPU/NPU 等多元芯片并存,行業訴求已經從 “硬件設備能否被平台識别” 升級為 “異構算力統一抽象、分配、度量、面向業務任務調度”。标準草案針對 GPU/NPU/TPU 智算資源、GPU 共享、多任務排隊、任務優先級搶占、彈性伸縮、多租戶隔離、跨資源池調度提出明确規範,标志異構算力建設,從硬件兼容邁入協同運營新階段。
青雲 AI 智算平台可面向多區域、多業務完成算力統一管理與分布式調度,兼容 NVIDIA GPU 以及多款國産 GPU、NPU 芯片,構建靈活可調度的算力資源池,支持 GPU 虛拟化等多樣化供給模式。通過統一資源模型 + 統一調度平面 + 上層任務編排架構,青雲将孤立硬件資産轉化為面向 AI 推理、工程計算、通用業務按需交付的服務能力,最大化釋放算力價值。
從 “算力堆疊” 到 “算存協同”:補齊 AI 基礎設施的數據效率短闆
AI 業務整體性能,并不單純取決于算力峰值。模型加載、數據集讀取、向量檢索、推理緩存、檢查點保存、多實例模型共享,都會受存儲吞吐、訪問時延、網絡能力深度制約。為此,标準草案專門增設存儲資源與存算分離獨立章節,對統一共享訪問、彈性擴展、多協議接入、數據保護、冷熱分層、AI 推理場景數據訪問優化做出要求,正式将數據基礎設施納入通算智算一體化整體架構。
青雲擁有全棧自研存儲與雲原生數據能力:QingStor 對象存儲兼容 S3、RESTful API,作為模型、數據集、業務數據統一存儲入口;QingStor NeonSAN 全閃塊存儲結合 RDMA 技術,保障高性能核心業務;KubeSphere 集成 Fluid 雲原生數據編排,實現 NFS、對象存儲本地緩存與數據預取,消解遠程訪問 I/O 瓶頸。 由此實現計算靈活編排、存儲獨立擴縮容、業務數據高效訪問的存算協同體系。
從 “技術可用” 到 “生産可運營”:标準聚焦落地建設、驗收與持續運維
一套通算智算一體化基礎設施,不能僅以硬件規模、理論性能作為評判标尺。标準草案覆蓋多集群治理、彈性伸縮、監控告警、計量審計、自動化運維、安全可靠性、測試評價,從功能完備、性能、安全、運維多維度建立評價體系,更加看重生産環境穩定性、資源利用率、故障恢複、可觀測與運營能力。
青雲 UniDock 統一智能底座繼承 KubeSphere 内核能力,具備面向生産環境的多集群治理、節點精細化管控、彈性伸縮、監控告警、日志審計、全鍊路可觀測能力;青雲 AI 智算平台面向算力中心建設運營,完成多區域多業務資源整合、可視化監控、精細化運維、算力統一調度。 青雲将把大量生産落地實踐沉澱為可驗證的标準條款與測試方法,讓标準不僅定義 “需要具備什麼能力”,更能夠指導産業 “如何建設、如何驗收、如何長期運營”。
堅持開放兼容:以标準化接口降低産業協同成本
通算智算一體化,不等于封閉的一體化。芯片、服務器、存儲、網絡、雲平台、AI 應用會長期多元共存,成熟的基礎設施,需要依靠開放接口、标準化适配降低生态接入成本。本次标準草案納入 RESTful API、gRPC、OpenAPI、Kubernetes 原生 API、CNI、CSI、異構設備接入、跨平台互通等接口兼容性要求,貫徹 “統一而不封閉” 的設計理念。
開放也是青雲一貫堅持的技術路線。KubeSphere 基于 Kubernetes 構建插件化可擴展架構;QingStor 對象存儲原生兼容 S3 标準接口;AI 智算平台開放應用框架,向上層訓練、推理業務輸出算力與平台能力。 在标準編制過程中,青雲将推動 “标準接口 + 插件适配 + 分層能力 + 可驗證測試” 落地,減少重複适配,規避廠商綁定,讓不同技術路線在統一規則下協同創新。
《通算智算一體化雲基礎設施總體技術要求》團體标準的編制,将打通産業鍊上下遊共識,為資源管理、接口兼容、運營評價建立統一 “行業語言”。作為全棧自研企業級 AI Infra 服務商,青雲科技将持續深度參與标準起草各項工作,輸出在統一資源管理、異構算力調度、雲原生、多集群治理、存算協同、開放接口、生産級運維領域的實踐經驗,攜手中關村雲計算産業聯盟及廣大産業夥伴,共同完善标準、推動落地,助力企業打造适配 AI 與智能體時代的的數智化基礎設施。