Quality
Evaluation correctness for every served model — benchmark scores and pass rates, not latency.
| Model | Type | Score | Pass rate | Detail |
|---|---|---|---|---|
| Claude Fable 5Claude | Language | awaiting evaluation | — | |
| Claude Haiku 4.5Claude | Language | awaiting evaluation | — | |
| Claude Haiku 4.5Claude | Language | awaiting evaluation | — | |
| Claude Opus 5Claude | Language | awaiting evaluation | — | |
| Claude Sonnet 5Claude | Language | awaiting evaluation | — | |
| GPT Image 2GPT Image 2 | Image | awaiting evaluation | — | |
| GPT-5.3 CodexGPT | Language | awaiting evaluation | — | |
| GPT-5.4GPT | Language | awaiting evaluation | — | |
| GPT-5.4 MiniGPT | Language | awaiting evaluation | — | |
| GPT-5.5GPT | Language | awaiting evaluation | — | |
| GPT-5.6 LunaGPT | Language | awaiting evaluation | — | |
| GPT-5.6 SolGPT | Language | awaiting evaluation | — | |
| GPT-5.6 TerraGPT | Language | awaiting evaluation | — | |
| Grok 4.5Grok | Language | awaiting evaluation | — | |
| grok-4.6Grok | Language | awaiting evaluation | — | |
| Nano Banana 2Gemini Image | Image | awaiting evaluation | — | |
| Nano Banana ProGemini Image | Image | awaiting evaluation | — |