Compare top models

LLM Benchmarks

See how today's leading models write Spacetime code, scored task by task on live modules.

Trends

Task pass rate over time, per model.
OpenAI: GPT-6 AstraAnthropic: Claude Fable 5Anthropic: Claude Fable 5.1Claude Opus 5Claude Opus 4.8

Task Pass Rate Over Time

Click a data point to view that day's leaderboard.