eval-driven-dev
نگهدارنده github
توسعهٔ AI مبتنی بر evaluation
- نسخه فعلی
- نامشخص
- مجوز
- MIT
- دسترسی شبکه
- نامشخص / ارزیابینشده
- وضعیت بررسی
- تأیید نشده
چه مسئلهای را حل میکند؟
چرخهٔ سنجش و بهبود AI با eval و golden dataset را ساختیافته میکند.
چه زمانی مناسب است؟
برای QA، test، eval، benchmark یا quality assurance پروژهٔ Pythonِ دارای LLM model استفاده کنید.
برنامهٔ AI را با evaluation-driven development بهبود میدهد: eval criteria، instrumentation، golden dataset، مشاهده و ارزیابی run، تحلیل و action plan. برای QA، test، eval، benchmark، رفتار نادرست یا quality assurance در پروژهٔ Pythonِ دارای LLM model همیشه بهکار رود.
نصب و بهروزرسانی
این دستورها فقط برای کپی نمایش داده میشوند و روی سرور RefHub اجرا نمیشوند. پیش از اجرا، منبع بالادستی پیوندشده را بررسی کنید.
دستور نصب
npx skills add github/awesome-copilot --skill eval-driven-dev -y
سازگاری با ایجنتها
هنوز تست سازگاری ثبت نشده است
تا وقتی شواهد تست ثبت نشده، سازگاری این مهارت با ایجنتها را تأییدشده فرض نکنید.