Initial public ModelForge release

This commit is contained in:
Jens
2026-09-01 21:30:16 +02:00
commit 7082ab955a
490 changed files with 104252 additions and 0 deletions
@@ -0,0 +1,11 @@
# Embedding model comparison
`ModelComparison` keeps raw project quality, latency, resource, critical-case and blocker evidence
separate. Evaluated rows reference immutable EvaluationRuns; blocked rows retain unknown metrics.
Comparability requires the same suite revision and retrieval configuration. No weighted score is
invented and no comparison can approve or promote a deployment.
The first live ExampleRAG comparison covers the nomic baseline, Qwen3-Embedding-0.6B raw,
Qwen3-Embedding-0.6B retrieval-aware, and blocked Qwen3-Embedding-4B and BGE-M3 candidates. See
`docs/quality/M7_VERIFICATION.md` for values and candidate blockers.