感謝您提交詢問!我們的一位團隊成員將在短時間內與您聯繫。
感謝您提交預訂!我們的一位團隊成員將在短時間內與您聯繫。
課程簡介
必能 GPU 架構介紹
- 必能概述與使用案例。
- 硬體配置:核心、記憶體、運算叢集。
- 與 NVIDIA 和 AMD GPU 的比較。
設定必能程式設計環境
- 安裝必能 SDK 與執行階段。
- 理解工具鏈與編譯器模型。
- 基本專案結構與建構流程。
使用必能堆疊進行 GPU 程式設計
- 執行緒與區塊模型。
- 記憶體管理與資料傳輸。
- 核心開發與啟動模式。
從 CUDA 移植至必能
- CUDA 程式碼的轉換技術。
- 常見的 API 對應與適應。
- 程式碼轉換實驗室與實務練習。
除錯與效能分析
- 使用必能的除錯器與效能分析工具。
- 識別瓶頸。
- 記憶體存取模式與最佳化。
最佳化技術
- 執行緒排程與指令流水線。
- 迴路展開與共享記憶體的使用。
- 為吞吐量進行進階核心微調。
案例研究與應用範例
- 使用必能加速器訓練模型。
- 移植並分析視覺或 NLP 模型的效能。
- 比較與 CUDA/NVIDIA 的效能。
總結與下一步行動
最低要求
- 具備 GPU 架構與平行處理的理解。
- 擁有 CUDA、OpenCL 或類似 GPU 程式設計環境的使用經驗。
- 熟悉 PyTorch 或 TensorFlow 等深度學習框架。
對象
- HPC 開發人員。
- AI 基礎架構工程師。
- 效能最佳化專家。
21 小時
客戶評論 (2)
所提供的廣泛工具選擇
Miruna Buzduga - Aeronamic Eastern Europe
課程 - AI Enablement Training for Engineers
機器翻譯
逐步進行的培訓,包含大量練習。這就像一場研討會,我對此感到非常高興。
Ireneusz - Inter Cars S.A.
課程 - Intelligent Applications Fundamentals
機器翻譯