Google yaqinda Android ilova ishlab chiqish sohasida katta til modellari (LLM)ni baholash uchun Android Bench vositasini yangilab chiqdi. Endi bu benchmark reytingining yuqori qismida Claude Fable 5, Claude Sonnet 5, Claude Opus 4.8, GLM 5.2, Kimi K2.7 Code, MiniMax M3, Qwen 3.7 Plus va Qwen 3.7 Max kabi yangi modellarning nomlari ko‘rsatilgan.
Mart oyidan boshlab ishga tushirilgan bu vosita baholash uchun xarajat va samaradorlik kabi mezonlarni ham qo‘shdi, va ishlab chiquvchilar o‘z testlarini o‘tkazib, Android Bench kelajagini takomillashtirishga yordam beradigan fikr-mulohazalarini taqdim etishlari mumkin. Bu yangilanishning maqsadi sun’iy intellekt modellari tomonidan yuzta turli Android dasturlash vazifalarini bajarishdagi samaradorlikni aniqlashtirish va dasturchilarga eng optimal vositani tanlashda yordam berishdir.

