home/categories/academic/applied-artificial-intelligence-claude-code-toolkit-skills-llm-evaluation-skill-md

academicresearch

llm-evaluation

LLM evaluation and testing patterns including prompt testing, hallucination detection, benchmark creation, and quality metrics. Use when testing LLM applications, validating prompt quality, implementing systematic evaluation, or measuring LLM performance.

Посмотреть исходный код academic

maintainer

applied-artificial-intelligence

Обновлено 1/14/2026

Звёзды

Форки

quick start

Installation and usage

Установка

$ install --globalskills.sh

Использование

После установки вы можете использовать этот skill, выполнив следующую команду в терминале:

skills use llm-evaluation