聯繫我們

課程簡介

中國 AI GPU 生態系統概覽

  • 華為昇騰、壁仞、寒武紀 MLU 的比較
  • CUDA 與 CANN、壁仞 SDK 及 BANGPy 模型的對照
  • 產業趨勢與供應商生態系統

遷移前的準備工作

  • 評估您的 CUDA 程式庫
  • 確定目標平台與 SDK 版本
  • 工具鏈安裝與環境設定

程式碼轉換技術

  • 移植 CUDA 記憶體存取與核心邏輯
  • 對應運算網格/線程模型
  • 自動化與手動轉換選項的比較

平台特定實現

  • 使用華為 CANN 算子與自訂核心
  • 壁仞 SDK 的轉換管道
  • 使用 BANGPy(寒武紀)重建模型

跨平台測試與最佳化

  • 在各目標平台上剖析執行狀況
  • 記憶體調校與平行執行比較
  • 效能追蹤與反覆迭代

管理混合 GPU 環境

  • 多架構的混合部署
  • 回退策略與裝置偵測
  • 提升程式碼可維護性的抽象層

案例研究與最佳實務

  • 將視覺/NLP 模型移植至昇騰或寒武紀
  • 在壁仞叢集上改造推論管道
  • 處理版本不一致與 API 缺漏問題

總結與後續步驟

最低要求

  • 具備 CUDA 或基於 GPU 的應用程式開發經驗
  • 了解 GPU 記憶體模型與運算核心(kernels)
  • 熟悉 AI 模型部署或加速工作流程

適用對象

  • GPU 程式設計師
  • 系統架構師
  • 移植專家
 21 小時

人數


每位參與者的報價

即將到來的課程

課程分類