تاریخ انتشار: دوشنبه 1405/05/12 - 16:06
کد خبر: 561064

دستاورد پژوهشگران دانشگاه تهران درتوسعه نسل جدید سامانه‌های هوشمند

دستاورد پژوهشگران دانشگاه تهران درتوسعه نسل جدید سامانه‌های هوشمند

پژوهشگران دانشگاه تهران با ارائه روشی توزیع‌شده در یادگیری تقویتی چندعامله، آموزش و تصمیم‌گیری مستقل عامل‌های هوشمند را در مسائل پیچیده ممکن کردند.

به گزارش «خبرنامه دانشجویان ایران»؛ به نقل از دانشگاه تهران، پژوهشگران دانشکدگان فنی دانشگاه تهران با ارائه یک روش جدید و توزیع‌شده در حوزه یادگیری تقویتی چندعامله، امکان آموزش و تصمیم‌گیری مستقل عامل‌های هوشمند را در مسائل پیچیده و دارای قیود تداخلی مشترک فراهم کردند؛ دستاوردی که می‌تواند زمینه‌ساز توسعه سامانه‌های هوشمند چندعاملی در حوزه‌هایی مانند رباتیک، شبکه‌های هوشمند انرژی، حمل‌ونقل و اقتصاد محاسباتی باشد.

این مقاله با عنوان «A Distributed Primal-Dual Method for Constrained Multi-Agent Reinforcement Learning With General Parameterization» به قلم علی کاهه دانش‌آموخته رتبه اول کارشناسی ارشد مهندسی برق دانشگاه تهران و حامد کبریایی استاد و عضو هیئت علمی دانشکدگان فنی دانشگاه تهران، در سال ۲۰۲۶ در نشریه معتبر IEEE Transactions on Automatic Control منتشر شده است. این مجله با شاخص اعتبار علمی SJR=۳.۹۲۹، در جدیدترین رتبه‌بندی پایگاه استنادی SCImago، جایگاه نخست را در میان ۳۸۲ نشریه بین‌المللی حوزه سیستم و کنترل به خود اختصاص داده است.

این پژوهش به ارائه روشی نوین برای حل مسائل یادگیری تقویتی چندعامله مقیدشده (Constrained Multi-Agent Reinforcement Learning) می‌پردازد. در بسیاری از سامانه‌های هوشمند، مجموعه‌ای از عامل‌ها (Agents) باید به‌صورت هم‌زمان و مستقل تصمیم‌گیری کنند و در عین حال به اهداف مشترکی دست یابند. اغلب روش‌های موجود برای آموزش این عامل‌ها به یک واحد کنترل‌کننده مرکزی یا هماهنگی متمرکز نیاز دارند که اجرای آن‌ها را در محیط‌های واقعی و مقیاس بزرگ با محدودیت مواجه می‌کند. پژوهشگران دانشگاه تهران در این مطالعه، روشی کاملاً توزیع‌شده ارائه کرده‌اند که در آن هر عامل تنها با استفاده از اطلاعات محلی خود و عامل‌های همسایه، قادر به یادگیری و تصمیم‌گیری است.

این روش مبتنی بر الگوریتم «اولیه دوگان (Primal-Dual)» و ساختار «Actor-Critic» طراحی شده و به عامل‌های هوشمند اجازه می‌دهد ضمن رعایت محدودیت‌های مشترک سیستم، به‌صورت آنلاین و مستقل فرآیند یادگیری را انجام دهند. همچنین پژوهشگران نشان داده‌اند که متغیرهای دوگان یا ضرایب لاگرانژ میان عامل‌ها به اجماع می‌رسند و الگوریتم پیشنهادی از لحاظ، نظری به یک نقطه تعادل همگرا می‌شود.

از ویژگی‌های مهم این پژوهش، امکان استفاده از سیاست‌های پارامتری عمومی در محیط‌های با فضای حالت بزرگ است که قابلیت کاربرد آن را در مسائل پیچیده دنیای واقعی افزایش می‌دهد. به‌علاوه، عملکرد الگوریتم در یک مدل مشارکتی و پویای بازی اقتصادی «کورنو» مورد ارزیابی قرار گرفته و نتایج، کارآمدی روش پیشنهادی را در شرایط پیچیده و تصادفی تأیید کرده است.

یادگیری تقویتی چندعامله یکی از مهم‌ترین شاخه‌های هوش مصنوعی به شمار می‌رود و کاربردهای گسترده‌ای در حوزه‌هایی نظیر رباتیک، کنترل شبکه‌های هوشمند برق، مدیریت ترافیک شهری، سامانه‌های خودران و مدل‌سازی بازارهای اقتصادی دارد. ارائه روش‌های توزیع‌شده و مقیاس‌پذیر در این حوزه می‌تواند نقش مهمی در توسعه نسل جدید سامانه‌های هوشمند و خودمختار ایفا کند.

مرتبط ها
نظرات
حداکثر تعداد کاراکتر نظر 200 ميياشد
نظراتی که حاوی توهین یا افترا به اشخاص، قومیت‌ها، عقاید دیگران باشد و یا با قوانین جمهوری اسلامی ایران و آموزه‌های دینی مغایرت داشته باشد منتشر نخواهد شد - لطفاً نظرات خود را با حروف فارسی تایپ کنید
معرفی کسب و کارها
امتحانات دروس تابستانی دانشگاه‌ها «حضوری» شد
رسانه عبری: باید می‌دانستیم حزب‌الله به حمله به علی‌الطاهر پاسخ می‌دهد
مراسم بزرگداشت چهلّم «آقای شهید ایران» در تهران، قم و مشهد
وزارت بهداشت، زیر ذره‌بین تشکل‌های دانشجویی؛ ۳۱ دفتر از دفاتر عضو اتحادیه انجمن های اسلامی دانشجویان خواستار پاسخگویی وزیر بهداشت شدند
ناوهایی که لنگرگاهشان سوخت / روایت نیویورک‌تایمز از فرسایش پنهان قدرت آمریکا در جنگ با ایران
۱۴ میلیون نفر در سنین فعال ازدواج، مجرد هستند
جنگ شکست‌خورده جمهوری خواهان علیه ایران را پایان دهید
تداوم جنایات دشمن اسرائیلی بی پاسخ نخواهد ماند
واکنش قطر به بازداشت خلبانان ایرانی
ادعای ضد ایرانی دبیرکل شورای همکاری خلیج فارس
کاپیتان جدید تیم ملی والیبال مشخص شد
پیروزی پرسپولیس برابر شمس آذر در نیمه اول
سکوت شورای امنیت سازمان ملل در قبال لبنان تاسف‌بار است
اتفاق باورنکردنی در پرسپولیس!
جنایات اسرائیل در لبنان و فلسطین با چراغ سبز آمریکا است
دیوان محاسبات: کنترل کالاهای اساسی وارداتی با ارز ترجیحی ناکارآمد است
بقائی: سیاست آمریکا در ارتباط با ایران دچار «دروغ-محوری» افراطی است
قالیباف: در آخرین حمله‌ای که به ضاحیه شد، مذاکرات را متوقف کردم
کمبود مهمات آمریکا؛ نشانه‌ای از فرسایش برتری نظامی غرب
مردانی: موج ضدصهیونیستی و ضدآمریکایی جهانی باید تقویت شود
پیام تبریک امیر الهامی به فرماندهان جدید نیروهای مسلح
آغاز اجرای طرح پایلوت «تغذیه نوین» در دانشگاه علامه از امروز
بازسازی دانش‌بنیان‌های آسیب دیده دانشگاه شریف با خط اعتباری جدید
آغاز اجرای طرح پایلوت «تغذیه نوین» در دانشگاه علامه از امروز
۴ مدال‌آور المپیاد جهانی هوش مصنوعی به دانشگاه شریف می‌روند
آغاز سال تحصیلی دانشگاه تهران از ۴ مهر/ تصمیم‌گیری درباره نحوه حضور دانشجویان
آقامیری: هدفمندسازی یارانه تغذیه دانشجویان نیازمند مطالعه و اجرای دقیق است
اختلال موقت در درگاه پرداخت آزمون‌های علوم پزشکی
دانشجویان، هوش مصنوعی را به جای خود سر کلاس می‌فرستند!
شکایت جنجالی علیه دانشگاه کلمبیا
شنبه آخرین مهلت ثبت‌نام در ۵ آزمون علوم پزشکی/ برگزاری آزمون ۲۹ مرداد
آغاز نام‌نویسی بیست‌ودومین فراخوان جذب هیئت علمی پزشکی از فردا
اعلام زمان ثبت‌نام فراخوان جذب اعضای هیئت‌علمی پیمانی وزارت بهداشت
ابتکار دانشگاه میشیگان برای کاهش استرس دانشجویان
شرایط پذیرش دانشجوی بدون آزمون در دوره‌های ارشد و دکتری اعلام شد
ممنوعیت تحصیل همزمان و شرکت پذیرفته‌شدگان دوره‌های رایگان در آزمون ارشد علوم پزشکی
اتحادیه انجمن‌های علمی دانشجویی علوم ارتباطات و رسانه ایران تشکیل شد
نظرسنجی
به نظر شما توافق با آمریکا به پایان مخاصمات می‌انجامد یا دوباره شاهد یک درگیری تمام عیار خواهیم بود؟


مشاهده نتایج
go to top