高評分continuous action space工具

探索使用者最推薦的continuous action space工具,以高效、穩定的解決方案提升您的工作品質。

continuous action space

  • MAGAIL使多個代理能透過生成對抗訓練模仿專家示範,促進彈性的多代理策略學習。
    0
    0
    MAGAIL 是什麼?
    MAGAIL實現了一個多代理擴展的生成對抗模仿學習,使多組代理能從專家示範中學習協調行為。基於Python並支援PyTorch(或TensorFlow變體),MAGAIL由策略(生成器)和判別器模組組成,透過對抗迴圈聯合訓練。代理在如OpenAI多代理粒子環境或PettingZoo等環境中產生軌跡,判別器用來評估軌跡的真實性與專家數據的對應性。透過反覆更新,政策網路逐步收斂到類似專家的策略,且無需明確的獎勵函數。MAGAIL的模組化設計允許自訂網路架構、專家資料輸入、環境整合與訓練超參數。此外,內建的日誌記錄與TensorBoard可視化便於監控和分析多代理學習的進展與性能基準。
    MAGAIL 核心功能
    • 多代理生成對抗模仿學習演算法
    • 支援連續與離散行動空間
    • 與多代理環境(MPE、PettingZoo)整合
    • 模組化策略(生成器)和判別器架構
    • 可自訂的神經網路架構與超參數
    • 支援日誌記錄與TensorBoard可視化
精選