GPT-6 Astra dan Luna imbang pada benchmark slang Indonesia
GPT-6 Astra menjawab benar 42 dari 42 soal pada separuh publik benchmark slang Indonesia kami, hasil terbaik bersama di panel. Dihitung bersama 18 soal tertahan, Astra menutup pengujian di angka 59 dari 60, terpaut 1 soal di belakang GPT-5.6 Luna milik OpenAI sendiri yang jauh lebih murah. Selisih 1 soal dari 60 bukan jarak yang berarti secara statistik, dan justru di situ letak temuan yang lebih menarik: separuh soal publik sudah tidak lagi memisahkan model-model terkuat.