مدلهای زبانی بزرگ (LLM) بهطور فزایندهای بهعنوان تحلیلگران هوش مصنوعی برای پردازش گزارشهای مالی و پشتیبانی از تصمیمهای سرمایهگذاری مبتنی بر هوش مصنوعی بهکار گرفته میشوند. بااینحال، این سیستمها معمولاً بر اساس آ…
گسترش سریع ارزیابیهای مقیاس بزرگ و پذیرش رو به رشد تولید خودکار آیتمها، نگرانیهای مربوط به تکرار تصادفی محتوا را تشدید کرده است، به طوری که عناصر غیر مرتبط با ساختار (مانند قالببندی یا تزریق زمینهای) بهطور تصادفی د…
بزرگترین مدلهای زبانی بزرگ بهصورت فزایندهای برای پاسخدهی به سوالات بر پایهٔ دانشگراف (KGQA) به کار میروند، اما ممکن است در جایگذاری پاسخها بر روی گراف زیربنایی شکست بخورند. رویکردهای فعلی KGQA مبتنی بر LLM یا به…
کارهای اخیر، مدلهای فضای حالت (SSMs) سبک مامْبا را برای کاربردهای تشخیص ناهنجاری در ویدیو بهکار گرفتهاند؛ بااینحال، رویکردهای موجود همچنان بهطور ضمنی از بافر کردن کلیپها یا پنجرهها استفاده میکنند، رابطهای نظری د…
کارتهای مدل، اسنادی ساختاریافته هستند که اطلاعات کلیدی درباره مدلهای یادگیری ماشین را بهطور خلاصه ارائه میکنند تا شفافیت، قابلیت استفاده و پاسخگویی را ارتقا دهند. بااینحال، این کارتها اغلب فاقد ساختاری یکپارچهاند…
Esakkivel Esakkiraja، Denis Akhiyarov، Vikas Yadav، Sai Rajeswar و 3 نفر دیگر
**StarHarness** را معرفی میکنیم، چارچوبی برای تکامل مهارهای (harness) اختصاصیافته به محیط، با حفظ ثابت بودن وزنهای مدل. مهار تکاملیافته میتواند شامل چارچوببندی وظیفه و دستور (prompt)، واسطهای ابزاری، مهارتها، ارا…
Group-based reinforcement learning methods such as GRPO for large language models avoid training a critic by sampling multiple responses for each prompt. A reliable critic could instead estimate token-level advantages fr…
ما یک روش نوتنگریان مستقیم تسریعشده و بدون هسسی جدید را برای بهینهسازی توابع خمیده با هسسی پیوسته لپسچیتز توسعه میدهیم. این الگوریتم تنها از متغیرهای اولیه استفاده میکند و در هر تکرار تنها یک حل خطی انجام میدهد. با…
Elaine Lau، Thanuka Udumulla، Lee Izhaki-Tavor، Francisco Guzmán و 2 نفر دیگر
در حوزههای حرفهای علوم زندگی، دانشمندان معمولاً از تفسیر آثار بصری مانند ژلهای بلوتها، تصاویر میکروسکوپی، نقشههای پلازمید، نمودارهای سیتومتری جریان، ساختارهای مولکولی و غیره استفاده میکنند تا تصمیمگیریهای پژوهشی…