Herramientas 동적 위험 de alto rendimiento

Accede a soluciones 동적 위험 que te ayudarán a completar tareas complejas con facilidad.

동적 위험

  • Pits and Orbs ofrece un entorno de mundo en una cuadrícula multi-agente donde los agentes AI evitan trampas, recogen orbes y compiten en escenarios por turnos.
    0
    0
    ¿Qué es Pits and Orbs?
    Pits and Orbs es un entorno de código abierto para aprendizaje por refuerzo, implementado en Python, que ofrece un mundo en una cuadrícula multi-agente por turnos donde los agentes persiguen objetivos y enfrentan peligros ambientales. Cada agente debe navegar en una cuadrícula ajustable, evitar trampas colocadas aleatoriamente que penalizan o terminan episodios, y recolectar orbes para recompensas positivas. El entorno soporta modos competitivos y cooperativos, permitiendo a investigadores explorar diversos escenarios de aprendizaje. Su API simple se integra perfectamente con bibliotecas RL populares como Stable Baselines o RLlib. Características principales incluyen dimensiones de cuadrícula ajustables, distribuciones dinámicas de trampas y orbes, estructuras de recompensa configurables y registro opcional para análisis del entrenamiento.
    Características principales de Pits and Orbs
    • Simulación de mundo en cuadrícula multi-agente por turnos
    • Tamaños y diseños de cuadrícula personalizables
    • Peligros de trampas aleatorias y recompensas de orbes
    • Soporte para modos competitivos y cooperativos
    • API compatible con Gym sencilla
    • Opciones de registro y renderizado de episodios
Destacados