04:00
2026-09-23
arxiv.org
large-language-models
ufakzeka-1: Building and Evaluating a 151M-Parameter Turkish Language Model from Scratch
Researchers released ufakzeka-1, a 151M-parameter (182M with embeddings) decoder-only Turkish language model pretrained from scratch on 13.5B tokens of openly licensed text and instruction-tuned for cā¦