trl
Trainieren Sie Transformer-Sprachmodelle mit Reinforcement Learning. Aufbauend auf dem Transformers-Ökosystem unterstützt TRL eine Vielzahl von Modellarchitekturen und -modalitäten und kann auf verschiedene Hardware-Setups skaliert werden.
Welches Problem es löst
Trainieren Sie Transformer-Sprachmodelle mit Reinforcement Learning. Aufbauend auf dem Transformers-Ökosystem unterstützt TRL eine Vielzahl von Modellarchitekturen und -modalitäten und kann auf verschiedene Hardware-Setups skaliert werden.
Der Projektkontext auf dieser Seite ist kostenlos lesbar. Das ursprüngliche GitHub-Repository bleibt maßgeblich; nur zum Speichern oder Diskutieren ist eine Anmeldung nötig.
Community-Notizen