RU

Тест Qwen3.5 9b, Gemma 4 12b и Bonsai 27b на легенде пенсионного возраста GTX 1080 ti

Все началось вообще не с идеи написать очередной бенчмарк. Мне нужно было собрать локальный пайплайн для длинных подкастов: полу…

gemmaqwenbonsaiбенчмарклокальные нейросетиaiискусственный интеллект
Habr
RU

Теги реакций и собираемый промпт: как удержать характер ИИ-персонажа по ходу диалога

Вектор диалога с LLM плывёт каждый ход, и к концу разговора персонаж уже не тот. Рассказываю, как я это чиню в своём движке: классификатор выбирает…

LLMпромпт-инжинирингprompt engineeringconstrained decodingstructured outputИИ-персонажичат-ботыконсистентность диалогаOllamagemma
Habr
RU

Собрал ИИ-бенчмарк под себя из 2 месяцев своих сессий — и дорогие модели проиграли дешёвым

Два месяца своих сессий с ИИ скормил скрипту и собрал бенчмарк под СВОЮ работу — не под чужой лидерборд. Результат: тройка «лучших открытых моделей»…

llmbenchmarkllm-as-a-judgegemmaglmself-hosting
Habr
RU

Идеальный склероз в сером ящике — мой опыт в ИИ-программировании

ИИ все прочнее входит в работу программиста. Кто-то все еще отрицает его роль, кто-то с энтузиазмом пробует все новые возможности, но квалифицирован…

llmai-codingархитектураqwengemmaгранулярностьопыт.
Habr