Loading

eval-driven-dev

نگه‌دارنده github

توسعهٔ AI مبتنی بر evaluation

نسخه فعلی
نامشخص
مجوز
MIT
دسترسی شبکه
نامشخص / ارزیابی‌نشده
وضعیت بررسی
تأیید نشده

چه مسئله‌ای را حل می‌کند؟

چرخهٔ سنجش و بهبود AI با eval و golden dataset را ساخت‌یافته می‌کند.

چه زمانی مناسب است؟

برای QA، test، eval، benchmark یا quality assurance پروژهٔ Pythonِ دارای LLM model استفاده کنید.

برنامهٔ AI را با evaluation-driven development بهبود می‌دهد: eval criteria، instrumentation، golden dataset، مشاهده و ارزیابی run، تحلیل و action plan. برای QA، test، eval، benchmark، رفتار نادرست یا quality assurance در پروژهٔ Pythonِ دارای LLM model همیشه به‌کار رود.

نصب و به‌روزرسانی

این دستورها فقط برای کپی نمایش داده می‌شوند و روی سرور RefHub اجرا نمی‌شوند. پیش از اجرا، منبع بالادستی پیوندشده را بررسی کنید.

دستور نصب
npx skills add github/awesome-copilot --skill eval-driven-dev -y

سازگاری با ایجنت‌ها

هنوز تست سازگاری ثبت نشده است

تا وقتی شواهد تست ثبت نشده، سازگاری این مهارت با ایجنت‌ها را تأییدشده فرض نکنید.

منبع و وضعیت بررسی

توضیح بالا معرفی ساختاریافتهٔ کاتالوگ است و بازبینی تحریریه‌ای آن ثبت نشده؛ اطلاعات فنی و وضعیت راستی‌آزمایی جداگانه نمایش داده می‌شوند.

آخرین بررسی منبع
ثبت نشده