eval

Name: eval
Author: mikeyobrien

EvalKit is a conversational evaluation framework for AI agents that guides you through creating robust evaluations using the Strands Evals SDK. Through natural conversation, you can plan evaluations, generate test data, execute evaluations, and analyze results.

Ver código fuente productivity-tools

maintainer

mikeyobrien

Actualizado 1/20/2026

Estrellas

961

Forks

115

quick start

Installation and usage

Instalación

$ install --globalskills.sh

Uso

Después de instalarlo, puedes usar este skill ejecutando el siguiente comando en tu terminal:

skills use eval