Фотография
click to show
click to show
مجموعه داده Hokoff با استفاده از اطلاعات بازی Honor of Kings برای بهبود یادگیری تقویتی آفلاین و یادگیری تقویتی چندعاملی آفلاین ایجاد شده است. این دادهها واقعیت و پیچیدگی بیشتری نسبت به مجموعههای داده قبلی دارند و شامل فضاهای عملیاتی سلسلهمراتبی هستند که تصمیمگیریهای پیچیده در بازیها را بهخوبی شبیهسازی میکنند. Hokoff همچنین یک الگوریتم پایه جدید ارائه میکند تا محققان بتوانند الگوریتمهای خود را برای سناریوهای واقعی بهینهسازی کنند. 🎮🧠
Github: https://github.com/tencent-ailab/hokoff
📕 Paper: https://arxiv.org/abs/2408.10556v1
🚀 Dataset: https://paperswithcode.com/dataset/d4rl
#هوش_مصنوعی
📣👨💻 @AlgorithmDesign_DataStructuer
2.7K ·