وبلاگ تحقیقات هوش مصنوعی

جدیدترین مقالات تحقیقاتی هوش مصنوعی از arXiv را کشف کنید — به‌روزرسانی خودکار روزانه برای پژوهشگران و علاقه‌مندان.

۱۲۶ مقاله · به‌روزرسانی روزانه

arXiv:2609.05385ترجمه شده

ضروری یا کافی؟ ارزیابی توضیحات مدل‌های زبانی بزرگ با شواهد رفتاری

Urja Pawar، Rajitha Ramanayake، Nabeel Kemal، Ashwin Kandath و 3 نفر دیگر

اجزای تصمیم‌گیری در مدل‌های بزرگ زبانی (LLM) که قادر به عمل در جریان‌های کاری عامل (agent workflows) هستند، اغلب توصیه‌ها یا قضاوت‌های عملی را همراه با توضیحاتی تولید می‌کنند. اپراتورها ممکن است از عوامل نام‌گذاری برای ن…

arXiv:2609.04198ترجمه شده

مهندسی تمیز، اندازه‌گیری ناپایدار: یک شکست اعتمادپذیری پیش‌ثبت‌شده رصدگرهای جعبه‌سیاه LLM در نقاط پایانی مشترک

Haoyaun Zhu، Jie Zhang

داوران مدل‌های زبانی اکنون با داده‌های آموزشی سر و کار دارند، تولیدات را امتیاز می‌دهند و لیست‌های برتر را پیش می‌برند. این داوران در واقع ابزاری اندازه‌گیرنده‌اند، اما بر یک فرضی که به ندرت بیان می‌شود استوارند: درخواست…

arXiv:2609.04197ترجمه شده

ESPO: بهینه‌سازی پرس‌وجوی ساختارمند مبتنی بر خطا از طریق تشخیص، تنوع‌بخشی و پایدارسازی

Lihao Liu، Peng Tang، Kunwar Yashraj Singh، Shabnam Ghadar

توسعه‌دهندگان تکاملی پرامپت، مانند GEPA، با مشکل «تورم پرامپت» مواجه هستند: در هر تکرار، قوانین و ملاحظات جدیدی اضافه می‌شوند و پرامپت‌ها تا سه برابر طولانی‌تر می‌شوند، اما دقت بیشتری ارائه نمی‌دهند. ما این مشکل را به سه…

arXiv:2609.04190ترجمه شده

یک ویرایشگر، ویرایش‌های متعدد: یک چارچوب یکپارچه بدون نیاز به آموزش برای ویرایش متنوع ویدیو

Adheesh Sunil Juvekar، Onkar Kishor Susladkar، Kiet A. Nguyen، Muntasir Wahed و 5 نفر دیگر

ویرایش ویدئو شامل طیف گسترده‌ای از روش‌ها است؛ اما دستیابی به ویرایش با کیفیت بالا مبتنی بر دستورالعمل یا موضوع در یک چارچوب واحد و یکپارچه همچنان چالش‌برانگیز است. ما EditVid را معرفی می‌کنیم؛ چارچوبی بدون نیاز به آموزش…

arXiv:2609.04183ترجمه شده

مشاهده پیش از ترکیب: شناسایی رویدادهای انتقالی به‌راهنمایی VLM برای توصیف ویدئوی متراکم با نظارت ضعیف

Ye-Chan Kim، Seunghee Choi، SeungJu Cha، Si-Woo Kim و 3 نفر دیگر

هدف از پوشش‌دهی ویدیوی غنی بدون نظارت ضعیف، شناسایی و توصیف رویدادهای متعدد در ویدیوهای بدون برش با استفاده از مجموعه‌ای مرتب از نامه‌های رویداد برای هر ویدیو است. تحقیقات اخیر با استفاده از مدل‌های زبانی هوش مصنوعی (LLM…

arXiv:2609.04180ترجمه شده

اکتساب دانش در حین پیش‌آموزش: مدل‌های زبانی بزرگ (LLMs) با دیدگاه‌های کمکی بهتر یاد می‌گیرند

Joseph Lee، Yidi Huang، Dokyoon Kim، Shu Yang و 1 نفر دیگر

تکانه‌های همچنان درک ما از نحوه به‌دست‌آوردن دانش توسط مدل‌های زبانی بزرگ (LLMs) در پیش‌آموزش دارند. ما معتقدیم که دیدگاه‌های کمکی (بازنگری‌های دانش) به‌صورت علّی برای یادگیری مفید هستند و این موضوع را از طریق طراحی آزما…

arXiv:2609.04177ترجمه شده

چارچوبی قابل محاسبه و عملیاتی برای توضیح احتمالی علّی

Rafal Urbaniak، Sam Witty، Daniel Waxman، Andy Zane و 6 نفر دیگر

بیان دلایل وقوع یک نتیجهٔ خاص و تعیین ورودی‌هایی که مسئول یا مورد قدردانی آن هستند، در قلب تحلیل‌های فلسفی، علمی و سیاست‌گذاری قرار دارد. ابزارهای موجود را می‌توان به دو دسته تقسیم کرد. نظریهٔ علیت واقعی (AC) تصمیم‌گیری‌…

مقالات منبع از arXiv cs.AI

به‌روزرسانی خودکار روزانه با جدیدترین تحقیقات هوش مصنوعی