Inference Space

Quality

Evaluation correctness for every served model — benchmark scores and pass rates, not latency.

ModelTypeScorePass rateDetail
Claude Fable 5ClaudeLanguageawaiting evaluation
Claude Haiku 4.5ClaudeLanguageawaiting evaluation
Claude Haiku 4.5ClaudeLanguageawaiting evaluation
Claude Opus 5ClaudeLanguageawaiting evaluation
Claude Sonnet 5ClaudeLanguageawaiting evaluation
GPT Image 2GPT Image 2Imageawaiting evaluation
GPT-5.3 CodexGPTLanguageawaiting evaluation
GPT-5.4GPTLanguageawaiting evaluation
GPT-5.4 MiniGPTLanguageawaiting evaluation
GPT-5.5GPTLanguageawaiting evaluation
GPT-5.6 LunaGPTLanguageawaiting evaluation
GPT-5.6 SolGPTLanguageawaiting evaluation
GPT-5.6 TerraGPTLanguageawaiting evaluation
Grok 4.5GrokLanguageawaiting evaluation
grok-4.6GrokLanguageawaiting evaluation
Nano Banana 2Gemini ImageImageawaiting evaluation
Nano Banana ProGemini ImageImageawaiting evaluation