Fine-tuned Qwen2.5-Coder-1.5B on 125k command pairs can write shell commands on a laptop CPU in about 1 second; runs via llama.cpp on 1.6GB RAM with 31.9 tok/s and 0.59s median per query
Read the original at old.reddit.com→I've been googling "tar extract gz" for about ten years. and I finally did something about it. It started out as a research project and I ended up with a Fine-tuned Qwen2.5-Coder-1.5B on 125k natural-language/command...
Original headline: "Trained a 1.5B to write shell commands so I'd stop googling tar flags. Runs on a laptop CPU in ~1 sec."
Coverage timeline
- Aug 13, 19:39 UTC r/LocalLLaMA lead source Trained a 1.5B to write shell commands so I'd stop googling tar flags. Runs on a laptop CPU in ~1 sec.