聯繫我們

課程簡介

必能 GPU 架構介紹

  • 必能概述與使用案例。
  • 硬體配置:核心、記憶體、運算叢集。
  • 與 NVIDIA 和 AMD GPU 的比較。

設定必能程式設計環境

  • 安裝必能 SDK 與執行階段。
  • 理解工具鏈與編譯器模型。
  • 基本專案結構與建構流程。

使用必能堆疊進行 GPU 程式設計

  • 執行緒與區塊模型。
  • 記憶體管理與資料傳輸。
  • 核心開發與啟動模式。

從 CUDA 移植至必能

  • CUDA 程式碼的轉換技術。
  • 常見的 API 對應與適應。
  • 程式碼轉換實驗室與實務練習。

除錯與效能分析

  • 使用必能的除錯器與效能分析工具。
  • 識別瓶頸。
  • 記憶體存取模式與最佳化。

最佳化技術

  • 執行緒排程與指令流水線。
  • 迴路展開與共享記憶體的使用。
  • 為吞吐量進行進階核心微調。

案例研究與應用範例

  • 使用必能加速器訓練模型。
  • 移植並分析視覺或 NLP 模型的效能。
  • 比較與 CUDA/NVIDIA 的效能。

總結與下一步行動

最低要求

  • 具備 GPU 架構與平行處理的理解。
  • 擁有 CUDA、OpenCL 或類似 GPU 程式設計環境的使用經驗。
  • 熟悉 PyTorch 或 TensorFlow 等深度學習框架。

對象

  • HPC 開發人員。
  • AI 基礎架構工程師。
  • 效能最佳化專家。
 21 小時

客戶評論 (2)

課程分類