Counterfactual regret minimization (CFR) is one of the few large numerical workloads that still runs faster on CPUs than on GPUs. Each iteration sweeps a game tree with up to billions of states in millions of small, inte…
تعمیمپذیری تحت جابجایی توزیع همچنان چالشی اساسی در یادگیری ماشین مدرن است؛ با این حال، نظریه محدودیتهای یادگیری موجود تنها در چارچوبهای محدود و ایدهآفرینیشده معتبر است و از دادههای نمونه قابل برآورد نیست. در این مق…
Yanzhe Chen، Zechen Bai، Zhijun Cao، Wenzheng Zeng و 6 نفر دیگر
مدلهای پایهٔ بیناییـزبان (VLMs) دانش گستردهای درباره جهان از خود نشان میدهند؛ بااینحال، تبدیل این دانش به کنترل روبوت همچنان چالشی دشوار است. ما Show-Harness را معرفی میکنیم؛ نمونهای از Harness جسمانی (Embodied H…
Anqi Li، Yuxin Chen، Zhaobo Li، Zhuo Cao و 3 نفر دیگر
ما به مسئلهی حرکت روبات انسانشبیه در محیطهای داخلی پرزرق و برق میپردازیم. برخلاف روشهای رایج که مسیریابی را بهعنوان یک مسألهی برنامهریزی مسیر دوبعدی مدل میکنند، حرکت انسانشبیه در فضاهای پرزرق و برق نیازمند تنظی…
Yuxing Lu، Yicheng Chen، Shanchan Wu، Sercan Ö. Arık
مدلهای زبانی بزرگ (LLM) بهطور فزاینده بهعنوان عوامل (agents) مستقر میشوند که در افقهای طولانی برنامهریزی میکنند و از طریق ابزارهای خارجی عمل میکنند.
اکثر عوامل، از طریق تولید بیمحدود، بر تاریخچهٔ تجمعی اقدامات ت…
Tobias Susetzky، Raphael Rehms، Dmitrii Seletkov، Özgün Turgut و 4 نفر دیگر
دیجیتالسازی مراقبتهای بهداشتی، رکوردهای بیمار گسترده، طولانیمدت و چندگانه را در طول عمر تولید کرده است، اما بهکارگیری کامل این دادهها برای نمایش و پیشبینی مسیرهای وضعیت بیمار همچنان یک چالش مهم است. مدلهای هوش مصن…
Zhou Yu، Bin Bi، Shiva Kumar Pentyala، Shubham Mehrotra و 7 نفر دیگر
تلههای عامل (پرامپت سیستمی، مجموعه ابزار، قلابهای اجرایی و ساختار حمایتی مدیریت زمینه در اطراف یک مدل) نقش تعیینکنندهای در موفقیت وظایف عاملی دارند. تکامل خودکار تله میتواند مدلهای کوچکتر را در انجام وظایف تخصصی ح…