Aidanix
Aidanix
از یادگیری تا درآمد، با هوش مصنوعی
شروعرایگان
اخبار و تازه‌های هوش مصنوعیابزارها

تحول در اجرای LLMها: vLLM بک‌اند مدل‌سازی ترنسفورمرها را با سرعت بومی معرفی می‌کند

تیم Aidanix3 دقیقه۲۱ تیر ۱۴۰۵
تحول در اجرای LLMها: vLLM بک‌اند مدل‌سازی ترنسفورمرها را با سرعت بومی معرفی می‌کند

vLLM، یک فریم‌ورک متن‌باز برجسته برای استنتاج (inference) با کارایی بالا در مدل‌های زبان بزرگ (LLMs)، اخیراً از یک بک‌اند مدل‌سازی جدید برای ترنسفورمرها رونمایی کرده است که با 'سرعت بومی' عمل می‌کند. این پیشرفت فنی چشمگیر به معنای آن است که مدل‌های ترنسفورمر می‌توانند با حداکثر سرعت ممکن و حداقل سربار نرم‌افزاری اجرا شوند.

بهره‌گیری از این بک‌اند جدید، به طور قابل توجهی توان عملیاتی (throughput) را افزایش داده و تأخیر (latency) را در پاسخ‌دهی LLMها کاهش می‌دهد، که برای کاربردهای مقیاس‌پذیر هوش مصنوعی مانند چت‌بات‌ها، دستیارهای هوشمند و پردازش زبان طبیعی بسیار حیاتی است. این نوآوری به توسعه‌دهندگان امکان می‌دهد تا با بهینه‌سازی بی‌سابقه، مدل‌های خود را مستقر کرده و از قابلیت‌های سخت‌افزاری به بهترین نحو بهره‌برداری کنند، در نتیجه تجربه کاربری روان‌تر و پاسخگوتر را فراهم می‌آورد.

vLLMمدل‌های ترنسفورمراستنتاج هوش مصنوعیLLMبهینه‌سازی عملکردسرعت بومی
نظرات

هنوز نظری ثبت نشده — اولین نفر باش.

فریب دادگاه با تزریق دستورات پنهان به هوش مصنوعی؛ ترفند جدید یک شاکی برای تغییر رأیShieldFont؛ سلاح جدید طراحان برای فریب خزنده‌های هوش مصنوعیحمله زنجیره تأمین به LiteLLM: نشت ترابایتی اطلاعات حساس شرکت‌های بزرگ فناوری
انگیزه بگیر