M×N 跨層優化體系

智慧平台解決方案

打造連接 M 種場景與模型與 N 種硬體與晶片的 AI 算力基礎設施新範式,整體解決方案以「雲-邊-端」全端布局,形成三大核心產品矩陣。

三大核心產品線

實現從雲端算力調度到終端智能落地的全鏈路覆蓋

雲端 AI 運算平台

AI雲

相容異構算力的雲端服務平台,統一管理異構算力,提供標準化訓練、推理、資料服務。

企業 AI 應用 研究機構 大規模模型訓練
智慧 Agent 開發平台

智慧平台

協助 Agentic AI 開發者的一體化平台,從支援大模型到驅動智慧體,提供完整開發環境。

AI 開發者 模型廠商 智慧體應用團隊
終端 AI 優化方案

終端智慧

有限硬體資源的極致利用方案,端側軟硬一體優化,實現低功耗下的強推理多模態能力。

AI PC 智慧座艙 智慧終端廠商

三層優化架構

透過模型-系統-晶片三層協同優化,解決異構算力相容與效率問題

模型層優化

模型壓縮、剪枝、量化、稀疏化、MoE 架構優化

系統層優化

算子優化、分布式訓練框架、推理引擎、算力調度演算法

晶片層優化

客製加速器設計、3D 堆疊架構、異質芯粒互聯、指令集優化

AI雲 技術架構

分層技術架構支援各類晶片混合訓練

應用層

  • 金融醫療
  • 智慧製造
  • 創意生成
  • 自動駕駛
  • Deep Research

平台服務層

  • 模型服務
  • Agent 框架
  • 開發工具
  • 安全沙箱
  • 彈性推理

AI-Native 基礎設施

  • 彈性訓練
  • 分布式推理
  • 跨集群管理
  • RL 框架
  • Serverless 容器

異構算力基座

  • NVIDIA GPU
  • AMD GPU
  • 運算加速卡
  • XPU Agents
  • 儲存代理

千卡規模混訓

全球首個支援千卡規模異構晶片混合訓練平台

97.6% 利用率

集群算力利用率最高達 97.6%

FlashDecoding++

自研 GPU 推理提速 2-4 倍

全品類晶片支援

支援 NVIDIA、AMD 及國產晶片

智慧平台 技術架構

面向 Agent 時代的核心技術架構

1.0

支援型

大模型 ChatBot

2.0

工具型

智能體 Agent

3.0

共生型

AGI

跨域算力統一調度

跨廠商、跨地域算力統一管理與調度

MaaS 服務

全面支援多元晶片,提供標準化模型服務

全鏈路支援

從環境搭建、工具集成到部署運維、效果評測

蜂群調度

支援大規模多智能體協同執行複雜任務

Agentic Infra 架構圖

Agent 應用
具身智能
自動駕駛
圖片/影片生成
Deep Research
Vibe Coding
Agent 基礎設施
Agent Infra
通用大模型
程式碼模型
視覺模型
語音模型
嵌入 & 檢索模型
Framework
Agent框架
Environment
安全沙箱 FaaS
Context
長短期記憶 RAG ICL
Tools
MCP Function Call
Identity gateway
Agent Router 資安防護
Observability
Agent Trace
AI 基礎設施
AI-Native Infra
彈性服務
serverless 容器編排
訓練服務
容錯訓練 MoE/異構混訓
推理服務
集群分布式推理 自動擴縮容推理
強化學習服務
RL框架 彈性RL訓練
多集群管理
算力統一調度 跨域推理
雲端原生
K8S 雲端原生基礎設施
Core API & CRD
Scheduler
Runtime
Network
Logging
Monitoring
Storage
Cluster Manager
IaaS 基礎設施
NVIDIA GPU 算力集群
CPU
記憶體
GPU
OS
儲存
網路
AMD 算力集群
CPU
記憶體
XPU
OS
儲存
網路
其他算力集群 A
CPU
記憶體
XPU
OS
儲存
網路
其他算力集群 N
CPU
記憶體
XPU
OS
儲存
網路
智慧平台基礎設施 Agent 蜂群
MaaS
自主篩選組合 SOTA 模型 API 呼叫
智慧體執行追蹤 Agent Trace
智慧體執行評測 Evaluation
智慧體資料 Agentic Data
智慧體持續訓練 Continue Train
Model Agents
多Agents協同
Manager Agents
PaaS
PaaS MCP
Resource Agents
多Agents協同
Monitor Agents
IaaS
IaaS MCP
XPU Agents
多Agents協同
Storage Agents

終端智慧 技術架構

打破智慧終端「不可能三角」:智能提升、能耗降低、空間成本降低

🧠

多模態輕量模型

全球領先多模態輕量模型

支援圖片、音頻、文字處理,3B 參數實現 21B 級智能水平,推理速度領先同精度模型 300%。

⚙️

模型推理引擎

稀疏推理 + 權重量化

自主可控大模型推理引擎,針對 PC/手機環境深度優化,支援跨平台多後端(CPU/GPU/NPU/iGPU)。

💾

AI 推理晶片 IP

能效提升 15 倍

自研大模型推理 LPU IP,支援文生文/圖/影片多模態任務,3D 堆疊異質整合架構。

300%

推理速度領先

40%

內存占用與能耗降低

15x

能效提升

了解更多 AI 技術架構

有 AI 相關專案規劃需求嗎?歡迎與我們技術團隊聊聊,我們可以幫您找到最適合的解決方案