FilBench یک بنچمارک جدید است که برای سنجش قابلیتهای مدلهای زبانی بزرگ (LLMs) در درک و تولید زبان فیلیپینی طراحی شده است. این ابزار به محققان کمک میکند تا عملکرد این مدلها را در زبانهای کمترپوششدهنده مانند فیلیپینی ارزیابی کنند.
با استفاده از FilBench، چالشها و نقاط ضعف موجود در مدلهای زبانی بزرگ هنگام کار با زبانهای محلیتر مشخص میشود و گامی مهم در جهت توسعه هوش مصنوعی چندزبانه محسوب میشود.

