Run This Ai
EN DE

RLLM

Agentisches RL auf jedem Harness, mit jedem Backend, auf jedem Benchmark.

★ 5,797 GitHub Apache-2.0 reinforcement-learningllm-trainingagent-frameworkverlgrpo LLM & Chat

Überblick

rLLM ist ein Open-Source-Framework für das Training von Sprachagenten mittels Reinforcement Learning. Nutzen Sie jedes beliebige Framework, führen Sie es in einer beliebigen Sandbox aus und wechseln Sie die Trainings-Backends mit nur einem Flag – derselbe Agent-Code steuert sowohl die Evaluierung als auch das Training. Enthält über 60 integrierte Benchmarks, mehrere RL-Methoden wie GRPO, REINFORCE und RLOO sowie praxiserprobte Ergebnisse wie DeepScaleR-1.5B und DeepCoder-14B.

Anforderungen

Min vCPU
2
Min RAM
4096 MB
Min Disk
10 GB
Rec vCPU
4
Rec RAM
8192 MB
Rec Disk
20 GB

Empfohlener VPS

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 8

8 vCPU · 32256 MB · 400 GB

$20.00
Zum Anbieter

Affiliate-Hinweis

Docker Compose

# Generated by Run This Ai — docker-compose.yml
services:
  rllm:
    image: https://github.com/rllm-org/rllm/blob/main/Dockerfile
    restart: unless-stopped
    ports:
      - 8080:8080
    volumes:
      - ./data/rllm:/data

Bester VPS für RLLM →

Verwandte Tools

Anleitungen & Artikel