Google son zamanlar Android proqramlarının hazırlanması sahəsində böyük dil modellərini (LLM) dəyərləndirmək üçün Android Bench alətini yeniləyib. İndi bu benchmarketin liderlər cədvəlində Claude Fable 5, Claude Sonnet 5, Claude Opus 4.8, GLM 5.2, Kimi K2.7 Code, MiniMax M3, Qwen 3.7 Plus və Qwen 3.7 Max kimi yeni modellər yer alır.
Mart ayından bəri istifadəyə verilən bu alət dəyərləndirmələrinə xərc və səmərəlilik kimi meyarlar da əlavə edib və tərtibatçılar öz testlərini keçirərək geribildirim verməklə Android Bench-in gələcək inkişafına kömək edə bilirlər. Bu yeniləmənin məqsədi süni intellekt modellərinin yüz müxtəlif Android proqramlaşdırma tapşırığını yerinə yetirmə performansını aydınlaşdırmaq və tərtibatçılara ən optimal aləti seçməkdə kömək etməkdir.

