聯繫我們

課程簡介

中國AI GPU生態系統概覽

  • 華為昇騰、壁仞、寒武紀MLU的比較
  • CUDA與CANN、壁仞SDK和BANGPy模型的比較
  • 業界趨勢和供應商生態系統

遷移準備

  • 評估您的CUDA程式碼庫
  • 識別目標平台和SDK版本
  • 工具鏈安裝和環境設置

程式碼轉換技術

  • 移植CUDA記憶體存取和核心邏輯
  • 映射計算網格/執行緒模型
  • 自動轉換與手動轉換選項

平台特定實現

  • 使用華為CANN操作數和自定義核心
  • 壁仞SDK轉換管線
  • 使用BANGPy(寒武紀)重建模型

跨平台測試和最佳化

  • 在各目標平台上剖析執行
  • 記憶體調整和並行執行比較
  • 效能跟蹤和迭代

管理混合GPU環境

  • 多種架構的混合部署
  • 回退策略和裝置檢測
  • 用於程式碼可維護性的抽象層

案例研究與最佳實務

  • 將視覺/NLP模型移植到昇騰或寒武紀
  • 在壁仞叢集上改造推斷管線
  • 處理版本不一致和API差異

總結與下一步

最低要求

  • 具有使用CUDA或基於GPU的應用程式編程經驗
  • 理解GPU記憶體模型和計算核心
  • 熟悉AI模型部署或加速工作流程

受眾

  • GPU程式設計師
  • 系統架構師
  • 移植專家
 21 小時

課程分類