BetterGPT-150M: a 152M-parameter causal language model released with a live HF Space demo
Read the original at old.reddit.com→Hey everyone, I recently finished pre-training BetterGPT-150M, a small, lightweight causal language model with ~152 million parameters.Trained on 15B tokens. Dataset & Training: Trained across stable and annealing...
Original headline: "Built and released BetterGPT-150M – A compact 150M parameter completion model (+ live HF Space demo)"
Coverage timeline
- Jul 29, 06:47 UTC r/LocalLLaMA lead source Built and released BetterGPT-150M – A compact 150M parameter completion model (+ live HF Space demo)