Improve performance of vector search score normalization
Co-authored-by: Tres Seaver <tseaver@palladion.com>
This commit is contained in:
parent
5ffedf013b
commit
4773b56f9d
1 changed files with 1 additions and 1 deletions
|
|
@ -374,7 +374,7 @@ class ChunkRepository:
|
||||||
"""Extract scores from DataFrame columns based on search type."""
|
"""Extract scores from DataFrame columns based on search type."""
|
||||||
if "_distance" in df.columns:
|
if "_distance" in df.columns:
|
||||||
# Vector search - convert distance to similarity
|
# Vector search - convert distance to similarity
|
||||||
return [max(0.0, 1.0 / (1.0 + d)) for d in df["_distance"].tolist()]
|
return ((df["_distance"] + 1).rdiv(1)).clip(lower=0.0).tolist()
|
||||||
elif "_relevance_score" in df.columns:
|
elif "_relevance_score" in df.columns:
|
||||||
# Hybrid search - relevance score (higher is better)
|
# Hybrid search - relevance score (higher is better)
|
||||||
return df["_relevance_score"].tolist()
|
return df["_relevance_score"].tolist()
|
||||||
|
|
|
||||||
Loading…
Reference in a new issue