qmd/finetune/data
Tobi Lutke 8572c2fd94
Deploy fine-tuned GRPO model as default for query expansion
Switch from generic Qwen3-1.7B-Q8_0 (~2.2GB) to fine-tuned
qmd-query-expansion-1.7B-q4_k_m (~1.1GB). The fine-tuned Q4
scores 91.7% avg with 30/30 Excellent, outperforming the base Q8.

- Update default generate model in src/llm.ts
- Update README model table, architecture diagram, config block
- Add v2 training data, eval scripts, and quantize job
- Remove superseded v1 training data (5,742 → 1,000 examples)
- Update finetune README with v2 results and file structure

Co-Authored-By: Claude (claude-fudge-eap-cc) <noreply@anthropic.com>
2026-01-28 23:24:58 -08:00
..
train Refactor finetune folder: train/rl scripts with YAML configs 2026-01-24 20:26:46 -05:00
train_v2 Deploy fine-tuned GRPO model as default for query expansion 2026-01-28 23:24:58 -08:00
qmd_expansion_v2.jsonl Deploy fine-tuned GRPO model as default for query expansion 2026-01-28 23:24:58 -08:00