MLPerf Training v6.1: First LLM Post-Training Benchmark
MLPerf Training v6.1 adds an agentic RL benchmark: teach a 397B-parameter model to repair real software. Reference run: 256 Blackwell Ultra GPUs.
MLCommons ยท MLCommons
Topics: Benchmarks
Entities: Benchmarks