RU

Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090

Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по…

llmaillama.cppqwenqwen3.8ggufквантованиелокальные нейросетилокальные модели
Habr
RU

Мой опыт с Hermes Agent — ненависть, любовь, ненависть, любовь

Началось все с установки. Я пошёл почти по самому простому пути - установил его на Mac, в Docker. Потому что это агент, который работает автономно и…

hermes agentai-агентыllmлокальный llmлокальные моделиqwenagentic workflowsai automationworkflowgo
Habr
RU

Флешбэки адового 2020 года, который в 2026 уже не кажется таким страшным

Спойлер: нет, я не про пандемию Всем привет! На связи Саша Петрушин, я руковожу группой разработки в центре разработки и машинного обучения компании…

ии-агентыуправление проектамиуправление разработкойспецификацияsddии-агенты для разработкиметодологии разработкилокальные моделиfrontend-разработкаbackend-разработка
Habr
RU

Всё, что вы хотели знать о локальном ИИ, но стеснялись спросить

Если вы когда-нибудь смотрели на HF и не понимали, что такое DFlash, квантизация и почему одна и та же модель лежит в десяти репозиториях от десяти…

llmлокальные моделиквантизацияllama.cppapple siliconggufинференсmoemeta
Habr
RU

Как я собрал полностью локальную диктовку для русского языка на Mac: GigaAM, Whisper, Qwen и Apple

VoiceSwitch — открытое menu bar-приложение для Apple Silicon: одна глобальная клавиша запускает запись, GigaAM, Whisper, Qwen или Apple распознают р…

VoiceSwitchраспознавание речиGigaAMWhisperQwenMLXmacOSлокальные модели
Habr
RU

Сколько на самом деле стоит решённая задача: считаем экономику self-hosted моделей vs API токены

Каждый раз, когда заходит разговор "что дешевле — поднять у себя открытую модель или платить за API", его почему-то ведут в ценах за токен. И почти…

цена токенамашинное+обучениеконтурлокальные моделилокальныелокальные нейросетилокальные llmkimi-k3deepseekopus 4.7
Habr
RU

Локальная RAG-система на Go, PostgreSQL и Ollama без облачных API

RAG уже стал стандартным способом научить LLM работать с собственными документами без дорогостоящего дообучения. Но за кажущейся простотой скрываетс…

RAGRetrieval-Augmented GenerationGogolangPostgreSQLOllamaэмбеддингивекторный поисклокальные моделиllm
Habr
RU

Мультиполярный ИИ: почему у каждой страны теперь свои модели

12 июня 2026 года миллионы пользователей по всему миру открыли привычный интерфейс — и увидели сообщение об ошибке. Anthropic отключил доступ к моде…

суверенный ииai actэтика иигеополитика ИИлокальные моделирегулирование ии
Habr
RU

Аналог Plaud на iPhone: эксперименты с локальной транскрибацией ASR на iOS

Мы делаем приложение Memo: есть куча гаджетов и сервисов вроде Plaud — это когда ты платишь за отдельную «умную» коробочку-диктофон, которая записыв…

iOSраспознавание речиASRspeech-to-texton-device MLлокальные моделитранскрибацияSpeechAnalyzerApple Neural Engineразработка под iOS
Habr
RU

Как мы перестраивали работу аналитиков под разработку с ИИ-агентами и SDD

Всем привет! Я Светлана Забирова, лид аналитики в Центре разработки и машинного обучения компании «Инфосистемы Джет». В ИТ работаю уже больше десяти…

ии-агенты для разработкиcursorаналитикаметодологии разработкиразработкаsddлокальные моделиагентная разработкаfrontend-разработкаbackend-разработка
Хабр — Управление
RU

Деперсонализация через QWENы или как завести маленького домашнего ИБшника

Приветики-пистолетики! Это Кирилл из Neuromed и сегодня я хотел бы затронуть вопрос деперсонализации. Да, этот тренд возможно уже уходящий, т к все…

информационная безопасностьискусственный интеллектдеперсонализацияdevopsragllm-моделиqwenлокальные моделинастройкаархитектура приложений
Habr
RU

Как за один вечер разгрести 36 000 фотографий и почту с 2005 года, руками AI-агента и локальных моделей

Есть задачи, которые не делаются никогда. Не потому что сложные, а потому что объём убивает любое намерение на втором часу. У меня такой задачей был…

AI-агентлокальные моделидедупликацияраспознавание лицдиаризацияCLIPQwen2.5-VLMLXInsightFaceczkawka
Habr
RU

Anthropic, Fable 5, Claude Code и большой отбор игрушек

9 июня Anthropic выкатила  Claude Fable 5 , он же Mythos 5 в закрытом контуре. 12 июня доступ к обеим версиям сняли. А между этими датами умест…

claude fable 5mythos 5anthropicllmлокальные моделиvllmollamahugging faceуправление зависимостямиИИ-безопасность
Habr
RU

Вам продают ИИ. Покупать нужно не его

Звонил мне на днях один знакомый CIO. Питерский, ритейл, средний бизнес, ничего особенного. Слушай, говорит, надо нам с ИИ что-то делать: все вокруг…

llmragискусственный интеллектлокальные моделиэмбеддингиархитектура данныххранилища данныхвнедрение ииdata engineeringцена ошибки
Habr
RU

Калькулятор VRAM для локальных LLM: Какие модели ИИ запустятся у вас на компьютере?

Когда я начал ковыряться с локальными LLM, главная боль была не в установке моделей, а в понимании, что вообще влезет в моё железо. Документация Hug…

LLMVRAMllama.cppлокальные моделиквантованиеKV cacheGQAбенчмаркGPU
Habr