Створення LLM, орієнтованої на міркування: практичний посібник зі потокового завантаження, відбору та донавчання корпусу міркувань SupraLabs
Цей посібник описує повний робочий процес створення компактної мовної моделі, орієнтованої на міркування. Завантажуючи корпус міркувань SupraLabs із Hugging Face у потоковому режимі, ми застосовуємо фільтри якості та відбираємо дані для контрольованого донавчання (SFT). Використовуючи SmolLM2-135M-Instruct і LoRA, ми демонструємо…