Retrieval Evaluation
AdvanceddataMinimum 32K context
Evaluates retrieval quality for search and RAG systems using grounded test sets, relevance metrics, failure taxonomy, chunking experiments, and actionable remediation.
Use cases
- RAG quality measurement
- Semantic search tuning
- Knowledge-base testing
Example prompt
Create a retrieval evaluation for this knowledge base. Define queries, relevance labels, metrics, failure categories, and experiments for chunking, embeddings, and ranking.
Recommended models
Compatible tools
claude-codecursorkiroany
Modalities
Input: text, file
→Output: text, code
Related Skills
Author
OpenModels Community