From 9bf3a83b5de44aa888a0af40c460921ed9475dec Mon Sep 17 00:00:00 2001 From: Yiorgis Gozadinos Date: Mon, 5 Jan 2026 16:39:36 +0200 Subject: [PATCH] Fix typo --- docs/benchmarks.md | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/docs/benchmarks.md b/docs/benchmarks.md index 9dc2d1f8..73865415 100644 --- a/docs/benchmarks.md +++ b/docs/benchmarks.md @@ -73,7 +73,7 @@ For question-answering evaluation, `pydantic-evals` coordinates an LLM judge (Ol | Embedding Model | QA Model | Accuracy | Reranker | |------------------------------|----------------------------------|----------|------------------------| | Ollama / `qwen3-embedding:4b` | Ollama / `gpt-oss` - no thinking | 0.82 | None | -| Ollama / `qwen3-embedding:0.6b` | Ollama / `gpt-oss` - thinking | 0.89 | None | +| Ollama / `qwen3-embedding:8b` | Ollama / `gpt-oss` - thinking | 0.89 | None | | Ollama / `mxbai-embed-large` | Ollama / `qwen3` - thinking | 0.85 | None | | Ollama / `mxbai-embed-large` | Ollama / `qwen3` - thinking | 0.87 | `mxbai-rerank-base-v2` | | Ollama / `mxbai-embed-large` | Ollama / `qwen3:0.6b` | 0.28 | None |