← All comparisons

Claude 4.5 Haiku (Reasoning) vs Gemini 2.0 Flash Thinking Experimental (Jan '25)

Anthropic vs Google — side-by-side benchmark comparison

Claude 4.5 Haiku (Reasoning)Gemini 2.0 Flash Thinking Experimental (Jan '25)
Intelligence Index37.119.6
Coding Index32.624.1
Math Index83.7
Output speed (tok/s)142.20.0
Blended price ($/1M)$2.19$0.00
Time to first token (s)10.48s0.00s
aime50.0%
aime 2583.7%
artificial analysis coding index32.6024.10
artificial analysis intelligence index37.1019.60
artificial analysis math index83.70
gpqa67.2%70.1%
hle9.7%7.1%
ifbench54.3%
lcr70.3%
livecodebench61.5%32.1%
math 50094.4%
mmlu pro76.0%79.8%
scicode43.3%32.9%
tau254.7%
terminalbench hard27.3%

Benchmark data from Artificial Analysis.