eval
نگهدارنده alirezarezvani
ارزیابی و رتبهبندی نتیجههای عامل با metric یا داور LLM برای نشست AgentHub.
- نسخه فعلی
- نامشخص
- مجوز
- نامشخص
- دسترسی شبکه
- نامشخص / ارزیابینشده
- وضعیت بررسی
- تأیید نشده
چه مسئلهای را حل میکند؟
امتیازدهی، مقایسه و انتخاب نتیجهٔ برنده میان عاملهای تکمیلشده را فراهم میکند.
چه زمانی مناسب است؟
برای `/hub:eval` یا رتبهبندی نتیجههای عامل در یک نشست AgentHub از آن استفاده کنید.
نتیجههای عامل را برای یک نشست AgentHub با metric یا داور LLM ارزیابی و رتبهبندی میکند. هنگامی که کاربر `/hub:eval` را اجرا میکند یا میخواهد از میان عاملهای تکمیلشده امتیازدهی، مقایسه یا برنده انتخاب شود، استفاده کنید.
نصب و بهروزرسانی
این دستورها فقط برای کپی نمایش داده میشوند و روی سرور RefHub اجرا نمیشوند. پیش از اجرا، منبع بالادستی پیوندشده را بررسی کنید.
دستور نصب
npx skills add alirezarezvani/claude-skills --skill eval -y
سازگاری با ایجنتها
هنوز تست سازگاری ثبت نشده است
تا وقتی شواهد تست ثبت نشده، سازگاری این مهارت با ایجنتها را تأییدشده فرض نکنید.