RU

[Перевод] Занимаются ли разработчики ИИ‑моделей пеликанмаксингом?

Последние несколько лет Саймон Уиллисон тестировал каждый крупный релиз LLM одним и тем же промптом: «Сгенерируй SVG с пеликаном, сидящим на велосипед…

llmобучение моделейgrokqwenglmgptdeepseekclaudegemini
Habr
RU

Hermes + Qwen3.6-27B: как я собрал первую линию email-поддержки

Я решил в качестве эксперимента собрать первую линию email-поддержки вокруг локальной LLM — без файн-тюнинга и попыток сразу заменить всю службу подде…

hermesqwen3.6qwenhelpdeskagentоблачная инфраструктураgpuаренда gpurtx5090поддержка пользователей
Habr
RU

Погружаем модели в сказки русские, да рассказы древние – тестируем возможности Qwen и Whisper на дореволюционномъ

Хотите не забывать детали диалога или то, что вас просили купить в магазине? Конечно, можно по старинке открывать блокнот в телефоне или чат в избранн…

selectelраспознавание речиwhisperqwenasrтранскрибация речиавтоматическое распознавание речиискусственный интеллекттестирование моделей
Habr
RU

Миф о «равных весах»: что на самом деле скрывается внутри малых моделей

Последние годы развитие LLM шло по пути экстенсивного масштабирования: считалось, что чем больше весов и данных, тем умнее модель. В индустрии даже сл…

mlopsselectelllm-моделиqwenphi-4mistralgpt-ossdeepseekaiai-агенты
Habr
RU

Qwen3.6 MTP весит на +0.3 Гб больше, а даёт ускорение в ~2 раза. С 60 t/s до 130 t/s для Qwen3.6 27B без искажений

В llama.cpp добавили поддержку MTP Qwen3.6. Дополнительные слои Multi-Token Prediction позволяют сгенерировать сразу несколько токенов за 1 проход, чт…

искусственный интеллектmtpllama.cppqwenqwen3.6
Habr