PerceptionBench
5 models tested · Updated 2026-07-09 · Verified sources only
GPT-5.6 Sol leads at 59.7%
1
OpenAI · Blog/OpenAI · 2026-07-09
Score as cited in Kimi K3 blog (source: OpenAI official).
59.7%
2
Moonshot AI · Blog/Moonshot AI · 2026-07-16
In-house atomic visual perception benchmark.
58.5%
3
Anthropic · Blog/Anthropic · 2026-06-09
Score as cited in Kimi K3 blog (source: Anthropic official). Fable 5 hit fallbacks on 35% of tasks.
57.2%
4
OpenAI · Blog/OpenAI · 2026-06-26
Score as cited in Kimi K3 blog (source: OpenAI official).
55.8%
5
Anthropic · Blog/Anthropic · 2026-06-17
Score as cited in Kimi K3 blog (source: Anthropic official).
47.2%