RU

Всё, что вы хотели знать о локальном ИИ, но стеснялись спросить

Если вы когда-нибудь смотрели на HF и не понимали, что такое DFlash, квантизация и почему одна и та же модель лежит в десяти репозиториях от десяти…

llmлокальные моделиквантизацияllama.cppapple siliconggufинференсmoemeta
Habr
RU

Пять неправильных токенов и 245 картинок: как Krea 2 заработала на Swift и MLX

На обложке — команда, которой не было.  В реальности Twisterminigen создавался за одним столом: я, Mac mini M4 с 32 ГБ объединённой памяти и Co…

krea 2mlxswiftswiftuiapple siliconmacoscodexropeлокальный inferenceгенерация изображений
Habr
RU

56 минут созвона → текст за 5 минут на M4 без OBS и облака

У меня от трёх до пяти созвонов в день, почти все в браузере: Meet, Яндекс Телемост, ktalk, реже всего Zoom. Детали встреч мне нужны в тексте, иначе…

whispermlxpyannotespeaker diarizationрасшифровка звонковpythonapple siliconтранскрибация звонков
Habr