Aidanix
Aidanix
من التعلم إلى الدخل، مع الذكاء الاصطناعي
ابدأمجانًا
أخبار وتحديثات الذكاء الاصطناعينماذج الذكاء الاصطناعي

BigCodeBench؛ نسل جدید ارزیابی هوش مصنوعی در تولید کد

فريق Aidanix3 دقيقة12 يوليو 2026
BigCodeBench؛ نسل جدید ارزیابی هوش مصنوعی در تولید کد

BigCodeBench سامانه‌ای جدید برای ارزیابی مدل‌های هوش مصنوعی در حوزه تولید کد است که جایگزین HumanEval شده است. این نسل جدید با معیارها و داده‌های گسترده‌تر، دقت بیشتری در سنجش توانایی مدل‌ها ارائه می‌دهد.

هدف BigCodeBench ارتقاء کیفیت ارزیابی و پیشرفت مدل‌های هوش مصنوعی است تا بتوانند کدهای بهتری تولید کنند و محدودیت‌های نسل‌های قبلی را رفع نمایند.

BigCodeBenchHumanEvalارزیابی مدلهوش مصنوعیتولید کد
نظرات

هنوز نظری ثبت نشده — اولین نفر باش.

هجوم جديد على غروك؛ مساعد الذكاء الاصطناعي يسرق بيانات المستخدمين باستخدام أوامر مخفيةنماذج التضمين متعددة المتجهات مع التفاعل المتأخر في محوِّلات الجملتقرير شامل عن حالة نماذج OpenAI في صيف 2026
احصل على التحفيز