Insight

Seberapa jauh AI dan mesin bahasa kami bisa dipercaya?

Kami menguji mesin koreksi kami sendiri dan berbagai model AI dari luar terhadap bahasa Indonesia dan bahasa daerah, lalu menerbitkan angkanya apa adanya. Di halaman ini, kami meringkas tiap temuan jadi satu gambar saja. Metode lengkap dan data mentahnya bisa dibuka lewat tautan di tiap kartu.

1 temuanTiap temuan menaut ke versi teknisnya
TersaringBenchmarkHapus penyaring

1 temuan

BenchmarkEmpiris
Claude Haiku 4.5
72,22
Claude Sonnet 4.6
91,67
Skor benar dari 36 soal sopan santun bahasa Jawa

Diuji Unggah-Ungguh Jawa, AI Termurah Anthropic Salah 10 Kali

Claude Haiku, model termurah Anthropic, salah menjawab 10 dari 36 soal sopan santun bahasa Jawa. Claude Sonnet, versi mahalnya, hanya salah 3.

19 Agustus 2026 · 3 menit bacaBaca temuannya