RU

Проверка теории улучшения результата LoRA файн‑тюнинга на «умных» слоях

При LoRA‑дообучении адаптеры обычно применяются ко всем слоям модели, хотя активность разных слоев во время обработки промпта заметно разл…

машинное обучениедообучение llmlorafine-tuningtransformerspytorchhuggingfacenlpllmresearch
Habr
RU

Промпт, RAG или дообучение: что реально выучит вашу LLM

Локальная модель может уверенно отвечать на общие вопросы и так же уверенно ошибаться в вашем домене. В статье сравнили на …

llmqloraragfine-tuningдообучениепромпт-инжинирингunslothqwen3локальные-llmэмбеддинги
Habr
RU

Как мы научили большую языковую модель говорить на карачаево-балкарском

Давно ничего не писал где-либо: разработка занимает много времени. Надеюсь, наш путь будет кому-либо полезен, особенно тем, кто обучает модельки на…

aillmкарачаево-балкарскийкарачайбалкарскийкарачаевскийfine-tuningмалоресурсные языкиобучениеии
Habr
RU

За кулисами нейросетей: полный цикл тренировки языкового ИИ

Ты уже пользуешься языковыми моделями — спрашиваешь, генерируешь, отлаживаешь код. Но откуда берётся сама способность отвечать? Не «где хранятся дан…

LLMобучение нейросетейRLHFfine-tuningпредобучениетрансформерGPTязыковые моделимашинное обучениеИИ
Habr
RU

Whisper или GigaAM для русского ASR в продакшене: три ловушки бенчмарка, которые перевернут ваши выводы

Полгода назад мы публиковали статью про то, как получили 3.3% WER для русского ASR с GigaAM. Замеры шли на пяти TTS-фрагментах из аудиокниг, что под…

распознавание речиASRWhisperGigaAMWERfaster-whisperбенчмаркfine-tuningрусский ASRоффлайн-распознавание
Habr
RU

Ожидание: сделать ИИ-примерочную обоев за 2 дня. Реальность: пришлось добучать свою модель на SD

В условиях жесткой конкуренции на рынке отделочных материалов любому магазину жизненно необходимо хоть какое-то осязаемое преимущество. Стандартными…

computer visionstable diffusionнейросетиfine-tuninge-commerceвизуализация интерьеровchatgpt
Habr
RU

Хотел упростить мониторинг проектов и в отпуск — пришлось обучать свой LLM.Часть 3.Дистилляция

Третья часть про DevOps-агента Oni. В первой статье я встретился с реальностью — локальные модели не справляются с простыми задачами. Во второй разб…

LLMфайнтюнингfine-tuningLoRADevOps-агентOllamaобучение LLMcatastrophic forgettingUnslothAI-агент
Habr
RU

Хотел упростить мониторинг проектов и в отпуск — пришлось обучать свой LLM.Часть 2.Обучение

Продолжаем серию про файнтюнинг и создание DevOps-агента Oni. В прошлой части я встретился с реальностью — ни одна локальная модель не справилась с…

LLMфайнтюнингfine-tuningQwen3LoRADevOps-агентобучение LLMcatastrophic forgettingUnslothAI-агент
Habr