645 B
645 B
Embedding model comparison
ModelComparison keeps raw project quality, latency, resource, critical-case and blocker evidence
separate. Evaluated rows reference immutable EvaluationRuns; blocked rows retain unknown metrics.
Comparability requires the same suite revision and retrieval configuration. No weighted score is
invented and no comparison can approve or promote a deployment.
The first live ExampleRAG comparison covers the nomic baseline, Qwen3-Embedding-0.6B raw,
Qwen3-Embedding-0.6B retrieval-aware, and blocked Qwen3-Embedding-4B and BGE-M3 candidates. See
docs/quality/M7_VERIFICATION.md for values and candidate blockers.