RU

RAG в медицинской аналитике: как построить управляемый контур вместо очередного чат‑бота

Медицинская организация одновременно работает с электронными медицинскими картами, результатами исследований, врачебными заключениями, клиническими…

RAGмедицинская аналитикаискусственный интеллектбольшие языковые моделиLLMBIDWHмедицинские данныеархитектура системуправление рисками
Habr
RU

[Перевод] Хайп вокруг ИИ: реальное состояние дел и будущее

Меня зовут Ричард Кэмпбелл. Я из Ванкувера из канадской провинции Британская Колумбия. В Копенгагене я не впервые и, как уже говорил, выступал на мн…

искусственный интеллектИИБЯМбольшие языковые моделигенеративный ИИOpenAIChatGPTCopilotРичард КэмпбэллNDC
Habr
RU

Qwen3.8 Max вышла: выше Claude Fable 5 в агентном индексе при цене $6 за миллион токенов

Финальная модель Alibaba получила миллион токенов контекста, независимые оценки и очень серьёзную цену. Проверяем, что осталось от июльских обещаний…

qwen3.8 maxalibabaбольшие языковые моделиии-агентыclaude fable 5artificial analysisapiоткрытые весамультимодальные моделиllm
Habr
RU

OWASP LLM10: Unbounded Consumption. Тестируем современные языковые модели на ресурсоёмких промптах

Большие языковые модели становятся неотъемлемой частью современных информационных систем. Корпоративные помощники, RAG-приложения, AI-агенты, генера…

LLMбольшие языковые моделиинформационная безопасностьпентестred teamingnatural language processingjailbreakджейлбрейкпромптатака
Habr
RU

«Вам может это понравиться»: на Урбан ML разобрались, почему рекомендательные системы перестали предлагать похожее

Открывая онлайн-кинотеатр, сервис для прослушивания аудиокниг или музыки, пользователи редко задумывается о том, почему перед ним оказались именно э…

рекомендательные системымашинное обучениегенеративный ИИбольшие языковые моделиперсонализацияинженерия данныхранжированиеllmmws
Habr
RU

Structured outputs, которые не работают: пять ситуаций, где схема есть, а гарантий нет

Strict‑режим включён, схема валидна, ответ успешно парсится — а в проде всё равно всплывают None , пропавшие ограничения и аргументы…

структурированные ответыJSON Schemastrict-режимбольшие языковые моделиPydanticвалидация данныхOpenAI APIвызов инструментовИИ-агентыобработка ошибок
Habr
RU

Контекстная инженерия: что это такое, как работать с контекстом и почему за это начали платить

Вы собрали диалоговую систему — агента с RAG, инструментами и памятью. На коротких диалогах всё работает: модель выбирает нужный инструмент и достаё…

контекстная инженерияcontext engineeringllmии-агентыragmcpпромпт-инжинирингконтекстное окнобольшие языковые моделиtool calls
Habr
RU

Всё, что вы хотели знать про локальные LLM, но боялись заинференсить

LLM может влезать в контекст и генерировать 200 tok/s, но если она не может найти нужный факт в тексте, толку от этого мало. Поэтому мы захостили 8…

квантованиеllmбенчмаркиоблачная инфраструктураgpurtx 5090большие языковые модели
Habr
RU

[Перевод] Вопросы для собеседований по RL в 2026 году

Уже который раз я наблюдаю одну и ту же картину: человек проходит в аспирантуру, но затем почти сразу же во время весенней волны найма устраивается…

обучение с подкреплениемreinforcement learningRLмашинное обучениебольшие языковые моделивопросысобеседованияБЯМподготовка к собеседованиямвопросы на собеседования
Habr
RU

[Перевод] Все демонические насельники ИИ… по старшинству

Гоблины, призраки, монстры, богини: фантастические твари и где они обитают. В конце апреля OpenAI  опубликовала у себя в блоге пост , в котором…

большие языковые моделиискусственный интеллектдемонологияЛоабНоваСиднишогготгаллюцинациинейронные сетисознание
Habr
RU

Сикофантия? Или ускорение динамического пересчета определителя от O(n³) до O(n)?

Всем привет. Хотел бы поделиться своими результатами и обратиться за ответным мнением. Представлюсь: Шевченко Максим Юрьевич. Работал ману…

линейная алгебравычислительная сложностьопределитель матрицыбольшие языковые моделисикофантиягаллюцинации иироспатент
Habr
RU

Golden Armada: трассировки как основа наблюдаемой AI-native системы

Можно ли понимать сложную систему, вообще не читая её код? Golden Armada — экспериментальная AI-native система, в которой код перестаёт быть главным…

AIискусственный интеллектLLMбольшие языковые моделипрограммированиеархитектура ПОsoftware architectureAI-nativeгенерация кодаcode generation
Habr
RU

Ни одна ошибка не нова: почему провал ИИ в First Proof был предсказуем заранее

В начале июня 2026 вышли результаты First Proof Second Batch — первого матбенчмарка, где задачи заведомо не попадали в обучающие данные, а решения в…

First Proofбольшие языковые моделиLLMбенчмаркматематические доказательстваверификациякоррелированные ошибкиLeanИИ-агентынадёжность ИИ
Habr
RU

О конференции OpenTalks.AI 2026: мои впечатления и 5 полезных докладов

Я руковожу практикой машинного обучения Центра компетенций больших данных и искусственного интеллекта в ЛАНИТ. Также под моим началом трудится коман…

ланитискусственный интеллектAIllm. ragиибольшие языковые моделиai agent
Habr
RU

[Перевод] Верификация программного обеспечения в эпоху искусственного интеллекта

Генеративный ИИ возродил давнее обещание: что нам больше не придётся писать программы — что достаточно будет лишь сформулировать, что требуется , а…

генеративный ИИбольшие языковые моделиверификация ПОпроектирование по контрактуEiffelAutoProofинженерия требованийгаллюцинацииформальные методы
Habr
RU

Рождение LLM: история, которую мало кто знает

Когда люди слышат "языковая модель", у большинства сразу всплывает ChatGPT, Gemini, ну или на худой конец что-то связанное с Яндексом. Но мало кто з…

LLMбольшие языковые моделиистория ИИмашинное обучениенейронные сетиистория машинного обученияdeep learningOpenAIGoogle Brainискусственный интеллект
Habr
RU

Курсы по промптингу? Почитайте детям сказку на ночь

Привет, Хабр! За время написания нескольких книг я превратил искусственный интеллект в своего постоянного напарника. Он работает моим редактором, кр…

промпт-инжинирингLLMбольшие языковые моделифольклоррусские сказкиprompt engineeringAI safetyChatGPTагентные системыкогнитивные паттерны
Habr
RU

[Перевод] Каково это — работать с Fable 5 (Mythos)

У меня был ранний доступ к первой публично доступной модели класса Mythos — Claude 5 Fable. Большинство обсуждений вокруг Mythos сосредоточено на ки…

Claude MythosClaude Fableбольшие языковые моделиAI-агентымультиагентные системыавтономные AIClaude Codeстоимость inferenceбудущее разработкичеловек в контуре
Habr
RU

Смогут ли LLM выжить во время катастрофы? Gemini, ChatGPT и другие играют в «Бункер» (анализ поведения)

Тестирование современных LLM моделей проводится с помощью стандартных бенчмарков, которые оценивают математические способности, программирование, по…

искусственный интеллектнаучпопllmязыковые моделиgeminichatgptсравнение моделейтеория игрбольшие языковые моделиruvds_статьи
Habr
RU

“Автомойка в 50 метрах. Дойдем пешком”. Разбор первых рецензий на Claude Opus 4.8

Загадка. Автомойка находится 50 метрах от дома. Как доберетесь до нее? Поедете на машине или пойдете пешком? Если вы ответили “конечно, пешком — отч…

claude opus 4.8anthropicllmискусственный интеллектнейросетибольшие языковые моделиagentic aiclaude codechatgptgrok
Habr
RU

[Перевод] Почему ИИ решает математические задачи, если не умеет думать

На утверждение, что большие языковые модели не мыслят, есть простой встречный вопрос : “Если это так, как ИИ выполняет арифметические операции?” Дей…

большие языковые моделимашинное обучениеискусственный интеллектарифметикаинтерпретируемость моделейограничения LLM
Habr
RU

Почему ваш LLM-бот врёт клиентам — и паттерн, который это чинит

Air Canada проиграла суд за слова чат-бота. Дилер Chevrolet «продал» Tahoe за доллар. Корень один: LLM одновременно решает что сказать и как. Под да…

llmбольшие языковые моделичат-ботыai-агентыprompt engineeringархитектура поsycophancyevalгаллюцинации llmprompt injectiontriage-and-voice