stable-baselines3
نگهدارنده k-dense-ai
الگوریتمهای RL آمادهٔ تولید با stable-baselines3
- نسخه فعلی
- نامشخص
- مجوز
- MIT license
- دسترسی شبکه
- نامشخص / ارزیابینشده
- وضعیت بررسی
- تأیید نشده
چه مسئلهای را حل میکند؟
آزمایش RL تکعامل به الگوریتم استاندارد و environment Gymnasium نیاز دارد.
چه زمانی مناسب است؟
برای standard RL experiment، quick prototyping یا implementation مستند با PPO، SAC، DQN، TD3، DDPG یا A2C استفاده شود؛ برای parallel training پرکارایی، multi-agent یا custom vectorized environment از pufferlib استفاده شود.
نصب و بهروزرسانی
این دستورها فقط برای کپی نمایش داده میشوند و روی سرور RefHub اجرا نمیشوند. پیش از اجرا، منبع بالادستی پیوندشده را بررسی کنید.
npx skills add k-dense-ai/scientific-agent-skills --skill stable-baselines3 -y
سازگاری با ایجنتها
هنوز تست سازگاری ثبت نشده است
تا وقتی شواهد تست ثبت نشده، سازگاری این مهارت با ایجنتها را تأییدشده فرض نکنید.