BenchmarkEmpirical
Claude Haiku 4.5
72.22
Claude Sonnet 4.6
91.67
Tested on Javanese Speech Levels, Anthropic's Cheapest AI Got It Wrong 10 Times
Claude Haiku, Anthropic's cheapest model, answered 10 of 36 Javanese politeness-level questions wrong. Claude Sonnet, its expensive counterpart, missed only 3.
August 19, 2026 · 3 menit bacaRead the finding →