Initial public ModelForge release
This commit is contained in:
@@ -0,0 +1,11 @@
|
||||
# Embedding model comparison
|
||||
|
||||
`ModelComparison` keeps raw project quality, latency, resource, critical-case and blocker evidence
|
||||
separate. Evaluated rows reference immutable EvaluationRuns; blocked rows retain unknown metrics.
|
||||
Comparability requires the same suite revision and retrieval configuration. No weighted score is
|
||||
invented and no comparison can approve or promote a deployment.
|
||||
|
||||
The first live ExampleRAG comparison covers the nomic baseline, Qwen3-Embedding-0.6B raw,
|
||||
Qwen3-Embedding-0.6B retrieval-aware, and blocked Qwen3-Embedding-4B and BGE-M3 candidates. See
|
||||
`docs/quality/M7_VERIFICATION.md` for values and candidate blockers.
|
||||
|
||||
Reference in New Issue
Block a user