haiku.rag/evaluations/evaluations
2025-12-08 15:54:56 +02:00
..
datasets Use Mean Reciprocal Rank for single document evaluation as metric. Use Mean Average Precision for variable document evaluation as metric 2025-11-24 14:49:30 +02:00
evaluators Use EmbeddingModelConfig similar to ModelConfig for embeddings 2025-12-02 11:55:31 +02:00
__init__.py Restructure into uv workspace to support minimal and full installations 2025-11-04 17:59:12 +02:00
benchmark.py Update evaluations and a2a 2025-12-08 15:54:56 +02:00
config.py Default eval db location, evaluation script 2025-11-25 11:07:20 +02:00
prompts.py Restructure into uv workspace to support minimal and full installations 2025-11-04 17:59:12 +02:00