Urja Pawar، Rajitha Ramanayake، Nabeel Kemal، Ashwin Kandath و 3 نفر دیگر
اجزای تصمیمگیری در مدلهای بزرگ زبانی (LLM) که قادر به عمل در جریانهای کاری عامل (agent workflows) هستند، اغلب توصیهها یا قضاوتهای عملی را همراه با توضیحاتی تولید میکنند. اپراتورها ممکن است از عوامل نامگذاری برای ن…
Many recurring text functions are easy to describe but difficult to implement with rules, while calling a large remote model for every input introduces repeated cost, latency, and dependency on a provider. We present com…
داوران مدلهای زبانی اکنون با دادههای آموزشی سر و کار دارند، تولیدات را امتیاز میدهند و لیستهای برتر را پیش میبرند. این داوران در واقع ابزاری اندازهگیرندهاند، اما بر یک فرضی که به ندرت بیان میشود استوارند: درخواست…
توسعهدهندگان تکاملی پرامپت، مانند GEPA، با مشکل «تورم پرامپت» مواجه هستند: در هر تکرار، قوانین و ملاحظات جدیدی اضافه میشوند و پرامپتها تا سه برابر طولانیتر میشوند، اما دقت بیشتری ارائه نمیدهند. ما این مشکل را به سه…
Adheesh Sunil Juvekar، Onkar Kishor Susladkar، Kiet A. Nguyen، Muntasir Wahed و 5 نفر دیگر
ویرایش ویدئو شامل طیف گستردهای از روشها است؛ اما دستیابی به ویرایش با کیفیت بالا مبتنی بر دستورالعمل یا موضوع در یک چارچوب واحد و یکپارچه همچنان چالشبرانگیز است. ما EditVid را معرفی میکنیم؛ چارچوبی بدون نیاز به آموزش…
Ye-Chan Kim، Seunghee Choi، SeungJu Cha، Si-Woo Kim و 3 نفر دیگر
هدف از پوششدهی ویدیوی غنی بدون نظارت ضعیف، شناسایی و توصیف رویدادهای متعدد در ویدیوهای بدون برش با استفاده از مجموعهای مرتب از نامههای رویداد برای هر ویدیو است. تحقیقات اخیر با استفاده از مدلهای زبانی هوش مصنوعی (LLM…
Joseph Lee، Yidi Huang، Dokyoon Kim، Shu Yang و 1 نفر دیگر
تکانههای همچنان درک ما از نحوه بهدستآوردن دانش توسط مدلهای زبانی بزرگ (LLMs) در پیشآموزش دارند. ما معتقدیم که دیدگاههای کمکی (بازنگریهای دانش) بهصورت علّی برای یادگیری مفید هستند و این موضوع را از طریق طراحی آزما…
Rafal Urbaniak، Sam Witty، Daniel Waxman، Andy Zane و 6 نفر دیگر
بیان دلایل وقوع یک نتیجهٔ خاص و تعیین ورودیهایی که مسئول یا مورد قدردانی آن هستند، در قلب تحلیلهای فلسفی، علمی و سیاستگذاری قرار دارد. ابزارهای موجود را میتوان به دو دسته تقسیم کرد. نظریهٔ علیت واقعی (AC) تصمیمگیری…
Davide Paglieri، Logan Cross، Tim Genewein، Joel Z. Leibo و 2 نفر دیگر
Multi-agent AI science ecosystems rely on agents possessing tools that allow them to communicate, coordinate, and build on each other's work. Yet this shared infrastructure can also introduce vulnerabilities by creating…