google-agents-cli-eval
نگهدارنده google
راهنمای evaluation agent با Agent Platform و Quality Flywheel؛ شامل metric، schema داده، امتیازدهی LLM-as-judge و تحلیل failure.
- نسخه فعلی
- نامشخص
- مجوز
- نامشخص
- دسترسی شبکه
- نامشخص / ارزیابینشده
- وضعیت بررسی
- تأیید نشده
چه مسئلهای را حل میکند؟
سنجش و تحلیل کیفیت agent با dataset، metric و LLM-as-judge.
چه زمانی مناسب است؟
برای اجرای evaluation، تحلیل failure، مقایسه نتیجه یا بهینهسازی agent.
وقتی کاربر میخواهد «run an evaluation»، «evaluate my agent»، «evaluate my ADK agent»، «write an eval dataset»، «analyze eval failures»، «compare eval results» یا «optimize agent» را انجام دهد، یا به روششناسی Agent Platform eval و Quality Flywheel نیاز دارد، استفاده شود. eval metric، dataset schema، امتیازدهی LLM-as-judge و علتهای رایج failure را پوشش میدهد و برای هر پروژه agents-cli با هر framework کاربرد دارد. برای ADK API pattern از google-agents-cli-adk-code، برای deployment از google-agents-cli-deploy و برای scaffolding از google-agents-cli-scaffold استفاده شود.
نصب و بهروزرسانی
این دستورها فقط برای کپی نمایش داده میشوند و روی سرور RefHub اجرا نمیشوند. پیش از اجرا، منبع بالادستی پیوندشده را بررسی کنید.
دستور نصب
npx skills add google/agents-cli --skill google-agents-cli-eval -y
سازگاری با ایجنتها
هنوز تست سازگاری ثبت نشده است
تا وقتی شواهد تست ثبت نشده، سازگاری این مهارت با ایجنتها را تأییدشده فرض نکنید.