초보자 친화적 estrutura PyTorch 도구

간단한 설정과 쉬운 사용법을 제공하는 estrutura PyTorch 도구로 시작부터 성공적인 작업을 만드세요.

estrutura PyTorch

  • 다중 에이전트 강화학습 작업에서 에이전트가 출현 커뮤니케이션 프로토콜을 학습할 수 있는 PyTorch 프레임워크.
    0
    0
    Learning-to-Communicate-PyTorch란?
    이 저장소는 PyTorch를 사용하여 다중 에이전트 강화학습에서 출현하는 커뮤니케이션을 구현합니다. 사용자들은 송신자와 수신자 신경망을 구성하여 참조 게임이나 협력 네비게이션을 수행하게 하고, 에이전트들이 이산 또는 연속 통신 채널을 개발하도록 격려합니다. 학습, 평가, 학습된 프로토콜 시각화 스크립트와 환경 생성, 메시지 인코딩/디코딩 유틸리티를 제공합니다. 연구자들은 맞춤형 작업을 확장하거나 네트워크 구조를 변경하고, 프로토콜 효율성을 분석하여 빠른 실험을 촉진할 수 있습니다.
  • PyTorch와 Unity ML-Agents를 사용한 분산형 다중 에이전트 DDPG 강화 학습 구현으로 협력 에이전트 훈련을 지원합니다.
    0
    0
    Multi-Agent DDPG with PyTorch & Unity ML-Agents란?
    이 오픈소스 프로젝트는 PyTorch와 Unity ML-Agents를 기반으로 구축된 완전한 다중 에이전트 강화 학습 프레임워크를 제공합니다. 분산 DDPG 알고리즘, 환경 래퍼, 훈련 스크립트를 포함하며, 사용자들은 에이전트 정책, 비평 네트워크, 재현 버퍼, 병렬 훈련 워커를 구성할 수 있습니다. 로깅 후크는 TensorBoard 모니터링을 가능하게 하며, 모듈화된 코드는 사용자 지정 보상 함수와 환경 매개변수를 지원합니다. 저장된 Unity 예제 씬은 협력 탐색 작업을 시연하며, 시뮬레이션에서 다중 에이전트 시나리오 확장과 벤치마킹에 이상적입니다.
추천