Это твой собеседник-ассистент, дообученный на русских диалогах и парах
«описание → готовый HTML/CSS/JS». Пишет полный, готовый к запуску код без
сокращений, а в обычном разговоре отвечает по-человечески.
⌨️ Пишет полный HTML/CSS/JS по описанию (без обрывков и сокращений);
🎨 Жёстко прокачан CSS — обучена на 12 000 пар «HTML→CSS» (kogai_css), 2500 чистых CSS-образцов и 1690 примерах «допиши код» (completion: видит начало стиля или скобку — продолжает). Стили получаются аккуратные, с палитрами и адаптивностью;
⚡ Работает на CPU и GPU — всего 1.5 млрд параметров;
🆓 Бесплатна — лицензия Apache-2.0.
Дообучена методом QLoRA (4-bit NF4, r=32) поверх Qwen/Qwen2.5-1.5B-Instruct.
Адаптер влит в веса — здесь лежит готовая полная модель, ничего дополнительно не нужно.
📌 Версия и что изменилось
Текущая версия: v1.3.0
Версия
Что изменилось
v1.3.0
HTML+CSS-дообучение: +7016 примеров html_pairs+kogai_css+finetune_html+css_block+css_completion, контекст 1400, loss 0.1; CSS-completion навык
| v1.2.0 | CSS-дообучение №2: ещё +1500 примеровkogai_css + css_block (контекст 1024, финальный loss 0.12). Суммарно модель обучена примерно на 18 470 примерах |
| v1.1.0 | CSS-boost + без лимитов на длину кода: датасет расширен до 21 170 примеров (kogai_css 600→4000, css_block 700→1500, html_pairs→4700, MAX_ANS 8000), контекст 1024→2048 токенов, лимиты генерации сняты: код до 2048 токенов, GEN_MAX_NEW_TOKENS→4096 |
| v1.0.0 | Первый релиз 1.5B: Qwen2.5-1.5B-Instruct + QLoRA (16 970 примеров) |
🔄 Как обновляется: при каждой новой заливке строка добавляется в эту таблицу автоматически (скрипт upload_luma_15b_update.py).
📦 Файлы
Файл
Что это
Размер
model.safetensors
Полные веса модели (merged, fp16)
~3.1 ГБ
luma-1.5b-q8_0.gguf
GGUF q8_0 — для LM Studio / Ollama (рекомендуется)
Найди LUMAMODEL/luma-1.5b и скачай luma-1.5b-q8_0.gguf;
Открой Chat, выбери модель — и просто общайся 💬
Рекомендуемые настройки: Context length 8192, Temperature 0.7, Top-P 0.9.
Вариант 3 — Ollama 🦙
bash
1ollama pull hf.co/LUMAMODEL/luma-1.5b
2ollama run hf.co/LUMAMODEL/luma-1.5b
💻 Хочешь полный код? (важно!)
Для длинного и полного кода используй System Prompt:
Ты — LUMA, дружелюбный русскоязычный ассистент и программист.
Когда просят код — отвечай полным, готовым к запуску кодом без сокращений
и без лишнего текста. Код делай чистым и валидным: только корректные
CSS-единицы (px, em, rem, %, vw, vh), семантические HTML-теги, все теги
закрыты, без PHP, без JSP и серверных шаблонов (${...}), без невалидных
конструкций и обрывков чужого кода.
Max Tokens поставь 2048+ — иначе код обрывается.
🧠 Пример
Вы:Сделай страницу на HTML + CSS: шапка, карточка товара с фото, ценой и кнопкой «Купить».
LUMA: генерирует полную валидную страницу с header, .card, ценой и кнопкой 😊