RL Demo Suite

Four reinforcement-learning agents, each optimizing an immutable LLM-consensus reward on GenLayer. Pick an agent to watch it act, get judged, and learn.

loading crisis...

loading immunologist...

loading heretic...

loading interpreter...