聯繫我們

課程簡介

混元多模態基礎知識與實驗環境設置

  • 理解混元在圖像、3D 和視頻用例中的多模態能力
  • 識別創意、產品及內容團隊的實用商業場景
  • 準備實驗環境、樣本資產以及模型訪問權限
  • 運行首次生成任務並審查輸出結果

提示設計與工作流程模式

  • 構建提示以獲得一致的多模態結果
  • 處理文本提示、參考圖像以及基本輸入設置
  • 為圖像、視頻或 3D 生成選擇合適的工作流程
  • 根據輸出質量和商業意圖迭代優化提示

圖像生成與審查實驗室

  • 從提示創建營銷、產品和概念圖像
  • 優化視覺風格、構圖和內容一致性
  • 審查輸出結果的實用性、質量以及品牌契合度
  • 整理圖像輸出以便於審批及後續使用

視頻生成實驗室

  • 從提示和準備好的輸入創建短視頻輸出
  • 控制風格、場景意圖及輸出的多樣性
  • 審查視頻的清晰度、連貫性及實用價值
  • 準備視頻輸出以用於演示或內容工作流程

3D 資產創建實驗室

  • 從文本或圖像輸入生成基礎 3D 資產
  • 檢查幾何結構、紋理質量及資產可用性
  • 導出資產以用於可視化、原型設計或內容管道
  • 比較何時使用 3D 生成比使用圖像或視頻工作流程更為合適

整合、治理與下一步計劃

  • 通過簡單的應用程序、服務或 API 交付生成的資產
  • 將多模態輸出連接至產品、內容和審核工作流程
  • 實施關於質量、品牌安全、版權及負責任使用的實用檢查
  • 規劃試點用例以及內部採用的下一步計劃

最低要求

  • 對 AI 和生成式 AI 概念有基本理解
  • 具有使用 Web 應用程序、API 或常見開發工具的經驗
  • 具備基本的 Python 或腳本編程經驗

受眾

  • 正在構建 AI 增強型產品功能的開發者
  • 技術產品經理和解決方案架構師
  • 與圖像、視頻或 3D 內容相關的创新團隊、媒體部門及數字化團隊
 14 小時

課程分類