將CUDA應用程式遷移至中國GPU架構培訓
中國GPU架構,如華為昇騰(Huawei Ascend)、壁仞(Biren)和寒武紀(Cambricon)MLU,為本地AI和HPC市場提供了專為其量身打造的CUDA替代方案。
這門由講師主導的實地培訓課程(線上或現場)旨在服務於希望將現有CUDA應用程式遷移並最佳化,以部署於中國硬體平台的高階GPU程式設計師和基礎設施專家。
完成此培訓後,參與者將能夠:
- 評估現有CUDA工作負載與中國晶片替代方案的相容性。
- 將CUDA程式碼庫移植至華為CANN、壁仞SDK和寒武紀BANGPy環境。
- 比較不同平台的效能並識別最佳化點。
- 解決跨架構支援和部署中的實際挑戰。
課程形式
- 互動式講授和討論。
- 實作程式碼轉換和效能比較實驗。
- 專注於多GPU適配策略的引導式練習。
課程客製化選項
- 如需根據您的平台或CUDA專案請求此課程的客製化培訓,請聯絡我們以進行安排。
感謝您提交詢問!我們的一位團隊成員將在短時間內與您聯繫。
感謝您提交預訂!我們的一位團隊成員將在短時間內與您聯繫。
課程簡介
中國AI GPU生態系統概覽
- 華為昇騰、壁仞、寒武紀MLU的比較
- CUDA與CANN、壁仞SDK和BANGPy模型的比較
- 業界趨勢和供應商生態系統
遷移準備
- 評估您的CUDA程式碼庫
- 識別目標平台和SDK版本
- 工具鏈安裝和環境設置
程式碼轉換技術
- 移植CUDA記憶體存取和核心邏輯
- 映射計算網格/執行緒模型
- 自動轉換與手動轉換選項
平台特定實現
- 使用華為CANN操作數和自定義核心
- 壁仞SDK轉換管線
- 使用BANGPy(寒武紀)重建模型
跨平台測試和最佳化
- 在各目標平台上剖析執行
- 記憶體調整和並行執行比較
- 效能跟蹤和迭代
管理混合GPU環境
- 多種架構的混合部署
- 回退策略和裝置檢測
- 用於程式碼可維護性的抽象層
案例研究與最佳實務
- 將視覺/NLP模型移植到昇騰或寒武紀
- 在壁仞叢集上改造推斷管線
- 處理版本不一致和API差異
總結與下一步
最低要求
- 具有使用CUDA或基於GPU的應用程式編程經驗
- 理解GPU記憶體模型和計算核心
- 熟悉AI模型部署或加速工作流程
受眾
- GPU程式設計師
- 系統架構師
- 移植專家
21 小時
需要幫助選擇合適的課程嗎?
macao@nobleprog.com 或 +852 81990613
將CUDA應用程式遷移至中國GPU架構培訓 - 詢問
將CUDA應用程式遷移至中國GPU架構 - 咨詢詢問
相關課程
開發基於華為昇騰與CANN的AI應用程式
21 小時
這門授課者主導的澳門培訓指導中級AI工程師使用華為昇騰平台和CANN工具包構建並優化神經網絡模型。參與者將配置環境、使用MindSpore開發應用,並部署到邊緣或雲端環境。
更多...
使用 CANN 及 Ascend AI 處理器部署 AI 模型
14 小時
本 澳門 實地培訓旨在指導中級 AI 開發人員使用 CANN 工具包在 Ascend 處理器上部署模型。學習如何轉換 PyTorch 和 TensorFlow 等框架,優化性能,並調試問題,以實現高效的邊緣及雲端推理場景。
更多...
使用 CloudMatrix 進行 AI 推理與部署
21 小時
這門由導師帶領的 澳門 培訓課程介紹了用於可擴展 AI 推理的 CloudMatrix。學習如何使用 CANN 和 MindSpore 部署、優化和監控模型。動手練習涵蓋打包、轉換、服務提供以及針對實時和批量工作負載的性能調優。
更多...
在壁仞AI加速器上進行GPU編程
21 小時
這門澳門的實地培訓為開發人員提供了在壁仞AI加速器上編程和優化應用程序的技能。參與者將學習GPU架構,設置SDK,並將CUDA代碼轉換為壁仞代碼。課程重點在於性能調優和除錯技術。
更多...
使用 BANGPy 和 Neuware 進行寒武紀 MLU 開發
21 小時
這門在 澳門 進行的講師授課式現場培訓,旨在使開發人員掌握使用 BANGPy 和 Neuware 在寒武紀 MLU 上構建及部署 AI 模型的技能。學員將配置環境、開發優化模型,並將 MLU 加速功能整合到邊緣及數據中心應用中。
更多...
AI框架開發者的CANN入門
7 小時
本門在澳門進行的實地培訓為AI框架開發者介紹了CANN工具包。學員將學習如何設置環境、轉換模型,並利用MindSpore、TensorFlow或PyTorch在Ascend硬體上部署應用,涵蓋從訓練到推理的完整工作流程。
更多...
CANN 用於邊緣 AI 部署
14 小時
這門在 澳門 舉行的講師主導實地培訓課程,涵蓋了使用 CANN 工具包在 Ascend 邊緣設備上部署 AI 模型的核心概念與實作基礎,協助學員建立編譯、最佳化及管理受限環境的實用技能。
更多...
深入了解華為 AI 計算堆疊:從 CANN 到 MindSpore
14 小時
本講師引導的實地培訓 澳門 探討了華為的 AI 堆疊,涵蓋從 CANN SDK 到 MindSpore 框架。協助初級及中級專業人員了解這些組件如何在 Ascend 硬體上整合,以實現生命週期管理與部署。
更多...
使用CANN SDK優化神經網絡性能
14 小時
通過這門高級的講師主導培訓課程,在昇騰AI處理器上優化神經網絡推斷性能,深入學習澳門。探索CANN的運行時架構,利用圖引擎、TIK和TVM進行性能分析、自定義算子開發及解決內存瓶頸。
更多...
用於電腦視覺與自然語言處理管線的 CANN SDK
14 小時
本講師帶領的 澳門 課程涵蓋如何使用 CANN SDK 在 Ascend 硬體上部署與優化 CV 及 NLP 模型。參與者將學習如何轉換模型、將其整合至即時管線,並提升即時偵測與分析的推論效能。
更多...
使用 CANN TIK 和 TVM 建構自訂 AI 運算子
14 小時
此課程為講師帶領的實地培訓 澳門,使進階開發人員具備建構、部署和調整自訂 AI 運算子的技能。參與者將掌握 CANN TIK 和 Apache TVM 的整合,從而能在華為 Ascend 硬體上實現先進的最佳化和調度,以滿足實際生產環境的效能需求。
更多...
Ascend、Biren 及 Cambricon 上的性能優化
21 小時
透過這門 澳門 的實戰培訓,掌握如何在 Ascend、Biren 及 Cambricon 平台上優化 AI 工作負載。學習進行模型基準測試、識別瓶頸,並應用圖級別、內核級別及操作符級別的優化技術。調整部署流水線,以增強這些領先平台的吞吐量並優化延遲表現。
更多...