Loading

online-evals

نگه‌دارنده launchdarkly

ارزیابی آنلاین variationهای config

نسخه فعلی
نامشخص
مجوز
نامشخص
دسترسی شبکه
نامشخص / ارزیابی‌نشده
وضعیت بررسی
تأیید نشده

چه مسئله‌ای را حل می‌کند؟

ارزیابی خودکار کیفیت variationهای LLM را با judge و score فراهم می‌کند.

چه زمانی مناسب است؟

برای attach judge، custom judge، sampling rate یا monitoring quality score variationهای config استفاده کنید.

judgeها را برای LLM-as-a-judge evaluation خودکار به config variation متصل می‌کند، custom judge می‌سازد، sampling rate را پیکربندی و quality score را پایش می‌کند.

نصب و به‌روزرسانی

این دستورها فقط برای کپی نمایش داده می‌شوند و روی سرور RefHub اجرا نمی‌شوند. پیش از اجرا، منبع بالادستی پیوندشده را بررسی کنید.

دستور نصب
npx skills add launchdarkly/ai-tooling --skill online-evals -y

سازگاری با ایجنت‌ها

هنوز تست سازگاری ثبت نشده است

تا وقتی شواهد تست ثبت نشده، سازگاری این مهارت با ایجنت‌ها را تأییدشده فرض نکنید.

منبع و وضعیت بررسی

توضیح بالا معرفی ساختاریافتهٔ کاتالوگ است و بازبینی تحریریه‌ای آن ثبت نشده؛ اطلاعات فنی و وضعیت راستی‌آزمایی جداگانه نمایش داده می‌شوند.

آخرین بررسی منبع
ثبت نشده