Retrieval Evaluation

AdvanceddataMinimum 32K context

Evaluates retrieval quality for search and RAG systems using grounded test sets, relevance metrics, failure taxonomy, chunking experiments, and actionable remediation.

Use cases

  • RAG quality measurement
  • Semantic search tuning
  • Knowledge-base testing

Example prompt

Create a retrieval evaluation for this knowledge base. Define queries, relevance labels, metrics, failure categories, and experiments for chunking, embeddings, and ranking.

Recommended models

Compatible tools

claude-codecursorkiroany

Modalities

Input: text, file
→
Output: text, code

Related Skills

Author

OpenModels Community

@openmodelsrun