感謝您提交詢問!我們的一位團隊成員將在短時間內與您聯繫。
感謝您提交預訂!我們的一位團隊成員將在短時間內與您聯繫。
課程簡介
中國 AI GPU 生態系統概覽
- 華為昇騰、壁仞、寒武紀 MLU 的比較
- CUDA 與 CANN、壁仞 SDK 及 BANGPy 模型的對照
- 產業趨勢與供應商生態系統
遷移前的準備工作
- 評估您的 CUDA 程式庫
- 確定目標平台與 SDK 版本
- 工具鏈安裝與環境設定
程式碼轉換技術
- 移植 CUDA 記憶體存取與核心邏輯
- 對應運算網格/線程模型
- 自動化與手動轉換選項的比較
平台特定實現
- 使用華為 CANN 算子與自訂核心
- 壁仞 SDK 的轉換管道
- 使用 BANGPy(寒武紀)重建模型
跨平台測試與最佳化
- 在各目標平台上剖析執行狀況
- 記憶體調校與平行執行比較
- 效能追蹤與反覆迭代
管理混合 GPU 環境
- 多架構的混合部署
- 回退策略與裝置偵測
- 提升程式碼可維護性的抽象層
案例研究與最佳實務
- 將視覺/NLP 模型移植至昇騰或寒武紀
- 在壁仞叢集上改造推論管道
- 處理版本不一致與 API 缺漏問題
總結與後續步驟
最低要求
- 具備 CUDA 或基於 GPU 的應用程式開發經驗
- 了解 GPU 記憶體模型與運算核心(kernels)
- 熟悉 AI 模型部署或加速工作流程
適用對象
- GPU 程式設計師
- 系統架構師
- 移植專家
21 小時