Loading

eval

نگه‌دارنده alirezarezvani

ارزیابی و رتبه‌بندی نتیجه‌های عامل با metric یا داور LLM برای نشست AgentHub.

نسخه فعلی
نامشخص
مجوز
نامشخص
دسترسی شبکه
نامشخص / ارزیابی‌نشده
وضعیت بررسی
تأیید نشده

چه مسئله‌ای را حل می‌کند؟

امتیازدهی، مقایسه و انتخاب نتیجهٔ برنده میان عامل‌های تکمیل‌شده را فراهم می‌کند.

چه زمانی مناسب است؟

برای `/hub:eval` یا رتبه‌بندی نتیجه‌های عامل در یک نشست AgentHub از آن استفاده کنید.

نتیجه‌های عامل را برای یک نشست AgentHub با metric یا داور LLM ارزیابی و رتبه‌بندی می‌کند. هنگامی که کاربر `/hub:eval` را اجرا می‌کند یا می‌خواهد از میان عامل‌های تکمیل‌شده امتیازدهی، مقایسه یا برنده انتخاب شود، استفاده کنید.

نصب و به‌روزرسانی

این دستورها فقط برای کپی نمایش داده می‌شوند و روی سرور RefHub اجرا نمی‌شوند. پیش از اجرا، منبع بالادستی پیوندشده را بررسی کنید.

دستور نصب
npx skills add alirezarezvani/claude-skills --skill eval -y

سازگاری با ایجنت‌ها

هنوز تست سازگاری ثبت نشده است

تا وقتی شواهد تست ثبت نشده، سازگاری این مهارت با ایجنت‌ها را تأییدشده فرض نکنید.

منبع و وضعیت بررسی

توضیح بالا معرفی ساختاریافتهٔ کاتالوگ است و بازبینی تحریریه‌ای آن ثبت نشده؛ اطلاعات فنی و وضعیت راستی‌آزمایی جداگانه نمایش داده می‌شوند.

آخرین بررسی منبع
ثبت نشده