وبلاگ تحقیقات هوش مصنوعی

جدیدترین مقالات تحقیقاتی هوش مصنوعی از arXiv را کشف کنید — به‌روزرسانی خودکار روزانه برای پژوهشگران و علاقه‌مندان.

۱۲۴ مقاله · به‌روزرسانی روزانه

arXiv:2609.11916

Can Edge-Deployable Vision-Language Models Identify Species?

William Zhou، Mayukha Siripuram، Xiao Yan، Ziqi Liu و 1 نفر دیگر

Camera traps often run in the field on edge hardware with limited or no connectivity, making small, locally-deployable vision-language models (VLMs) -- not frontier-scale ones -- the practically relevant class to evaluat…

arXiv:2609.11915ترجمه شده

مدل‌سازی آمیخته بازاریابی مولد: چارچوبی برای استنتاج علی که GEO و GEM را به پیامدهای کسب‌وکار پیوند می‌دهد

Masahiro Kato، Daiki Honma، Taka Kato

هوش مصنوعی مولد، شیوه‌ی رساندن شرکت‌ها به مشتریان را تغییر می‌دهد؛ با این حال، داده‌های بازاریابی استاندارد، میزان دیده‌شدن نام شرکت و توجه کاربران به آن را در پاسخ‌های تولیدشده ثبت نمی‌کنند. ما برای تخمین اثرات علّی، مد…

arXiv:2609.11911ترجمه شده

آید مصنوعی: درایو و همترازی پایدار در AI عاملی

Yakov Pyotr Shkolnikov

هوش مصنوعی عاملی در حال گذار از اجرای وظایف محدود به سوی سیستم‌هایی است که حالت‌های مهم را حفظ می‌کنند، به کار خود ادامه می‌دهند و در سراسر مرزهای وظایف تطبیق می‌یابند. این تغییر، چالشی درونی برای کنترل‌کننده ایجاد می‌کن…

arXiv:2609.10522ترجمه شده

Show-Harness: فقط یک عامل VLM می‌تواند نقش ربات‌ها را بازی کند

Yanzhe Chen، Zechen Bai، Zhijun Cao، Wenzheng Zeng و 6 نفر دیگر

مدل‌های پایهٔ بینایی‌ـ‌زبان (VLMs) دانش گسترده‌ای درباره جهان از خود نشان می‌دهند؛ بااین‌حال، تبدیل این دانش به کنترل روبوت همچنان چالشی دشوار است. ما Show-Harness را معرفی می‌کنیم؛ نمونه‌ای از Harness جسمانی (Embodied H…

arXiv:2609.09158ترجمه شده

TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model

Anqi Li، Yuxin Chen، Zhaobo Li، Zhuo Cao و 3 نفر دیگر

ما به مسئله‌ی حرکت روبات انسان‌شبیه در محیط‌های داخلی پرزرق و برق می‌پردازیم. برخلاف روش‌های رایج که مسیریابی را به‌عنوان یک مسأله‌ی برنامه‌ریزی مسیر دوبعدی مدل می‌کنند، حرکت انسان‌شبیه در فضاهای پرزرق و برق نیازمند تنظی…

arXiv:2609.09153ترجمه شده

گراف‌های رویه‌ای: ساختارهای اجرایی خودتکاملی برای آژانت‌های LLM

Yuxing Lu، Yicheng Chen، Shanchan Wu، Sercan Ö. Arık

مدل‌های زبانی بزرگ (LLM) به‌طور فزاینده به‌عنوان عوامل (agents) مستقر می‌شوند که در افق‌های طولانی برنامه‌ریزی می‌کنند و از طریق ابزارهای خارجی عمل می‌کنند. اکثر عوامل، از طریق تولید بی‌محدود، بر تاریخچهٔ تجمعی اقدامات ت…

arXiv:2609.09140ترجمه شده

NOAH: یادگیری مسیر کامل بیمار؛ مدلی طولی، چندوجهی و آگاه از زمان برای بازنمایی و پیش‌بینی

Tobias Susetzky، Raphael Rehms، Dmitrii Seletkov، Özgün Turgut و 4 نفر دیگر

دیجیتال‌سازی مراقبت‌های بهداشتی، رکوردهای بیمار گسترده، طولانی‌مدت و چندگانه را در طول عمر تولید کرده است، اما به‌کارگیری کامل این داده‌ها برای نمایش و پیش‌بینی مسیرهای وضعیت بیمار همچنان یک چالش مهم است. مدل‌های هوش مصن…

arXiv:2609.09134ترجمه شده

هارس و مدل‌های هم‌تکامل: اصلاح در همان سیاست کمک به مدل‌های ضعیف در جایی که تقلید شکست می‌خورد

Zhou Yu، Bin Bi، Shiva Kumar Pentyala، Shubham Mehrotra و 7 نفر دیگر

تله‌های عامل (پرامپت سیستمی، مجموعه ابزار، قلاب‌های اجرایی و ساختار حمایتی مدیریت زمینه در اطراف یک مدل) نقش تعیین‌کننده‌ای در موفقیت وظایف عاملی دارند. تکامل خودکار تله می‌تواند مدل‌های کوچک‌تر را در انجام وظایف تخصصی ح…

مقالات منبع از arXiv cs.AI

به‌روزرسانی خودکار روزانه با جدیدترین تحقیقات هوش مصنوعی