جداسازی شخصیت-اجرا: الگوی معماری برای ارتقای هوشهای متنی بزرگ تحت بازرسی اجرا
User Safety: safe
جدیدترین مقالات تحقیقاتی هوش مصنوعی از arXiv را کشف کنید — بهروزرسانی خودکار روزانه برای پژوهشگران و علاقهمندان.
User Safety: safe
اسکنرهای ایستا بهطور روزافزونی برای شناسایی محتوای مخرب یا ناامن در مصنوعات یادگیری ماشین بهکار گرفته میشوند؛ با این حال، معیارهای ارزیابی متداول تنها مواردی را در نظر میگیرند که اسکنر قضاوتی قابل استفاده در حوزه امن…
شاخص شدت سیتیک (SICS) بهصورت دستخوش دستکاری و تنظیم شده، بر پایه متغیرها و وزنهای ثابتی که دههها پیش تعریف شدهاند، استفاده میشود. این شاخص بر پایه یک گروه بیماری است که دیگر با مراقبتهای بحرانی معاصر همراستا نمیش…
مدلهای ویدیویی پیشرفته با شرط عمل، معمولاً به یک پیکربندی رباتی واحد محدود میشوند و این امر مانع از بهرهگیری آنها از مجموعه دادههای ویدیویی عظیم و ناهمگون موجود در اینترنت میشود؛ مجموعه دادههایی که حاوی سیگنالهای…
مدلهای زبانی بزرگ چگونه دانش اخلاقی را سازماندهی میکنند؟ این مدلها توانایی گستردهای در تشخیص محتوای اخلاقی دارند، اما این تشخیص تنها در سطحی آستانهای و ابتدایی صورت میگیرد. پرسش اصلی ما این است که آیا این مدلها فر…
استدلال بصری ذاتی تولید بصری را به عنوان ابزار خود میشناسد: حالات بصری (یعنی تصاویر و ویدیوها) صرفاً ورودیهایی برای درک یا خروجیهایی برای نمایش نیستند، بلکه زیرساختهای معتبر اولیه برای حل مسئلههای فراتر از زبان هستن…
در این مقاله، ما به بررسی یک وظیفه نوین به نام یادگیری ماشین چندمدلۀ بدون نظارت و پیوسته پس از آموزش (MU-CPT) میپردازیم که به مدلهای MLLM امکان میدهد به طور مداوم از دادههای بدون برچسب جریاندار تکامل یابند. روشهای…
کاربر ایمن: ایمن
ما نخستین کاربرد تفسیر مکانیکی مبتنی بر رمزگشای تنک-خارجی را در فیزیک ذرات ارائه میدهیم. با بررسی یک مدل پایهی نوترینو که بر دادههای IceCube آموزش دیده و برای بازسازی جهت تنظیم شده است، مجموعهای معتبر از مفاهیم فیزیک…
User Safety: safe