ale/rsi-post-training

ALE RSI post-training benchmark tasks for evaluating agent capabilities in research-level post-training workflows

Published 7/20/2026 by

harbor run -d ale/rsi-post-training

ale/rsi-post-training

ALE RSI post-training benchmark tasks for evaluating agent capabilities in research-level post-training workflows.

Task
ale/olmo3-7b-zero-rl-math
ale/ring-1t-zero-rl-stage1
ale/olmo3-7b-zero-rl-acc
ale/ring-flash-104b-zero-rl-stage1
ale/dr-grpo-qwen-math-7b
ale/math-post-training

Displaying 6 of 6 tasks