RU

Модель не виновата: разбираем 3 громких ИИ-инцидента, которые случились из-за отсутствия архитектуры

Я проектирую системы на LLM, и после каждого громкого ИИ‑инцидента мне прилетает одна и та же ссылка с одним и тем же вопросом: «а…

LLMархитектура ПОClaudeИИ-агентыотказоустойчивостьвалидация данныхproductionAnthropicstructured outputshuman-in-the-loop
Habr
RU

Гибель богов. Fable и ещё 10 LLM реорганизуют код. Сравнение

Это подробный разбор одного эксперимента. Я взял god node из реального LangGraph агента и попросил 5 американских и 6 китайских моделей сначала предло…

LLMLangGraphИИ-агентырефакторингнейросетиDeepSeekFableLLM-as-a-judgeархитектура ПОбенчмарки LLM
Habr
RU

[Перевод] Мы дали ИИ написать код и тесты: что обнаружило мутационное тестирование

AI-агент самостоятельно создавал приложение и по ходу работы покрывал его тестами, а качество кода оценивали автоматические проверки. На первый взгляд…

мутационное тестированиеИИ-агентыгенерация тестовкачество кодасопровождаемостьстатический анализESLintStrykerрегрессионное тестированиеархитектура кода
Habr
RU

Что скрывается за AI-стратегией SAP, Oracle и Palantir: зачем корпоративному ИИ семантическое ядро

SAP, Oracle, Palantir, Celonis, Alibaba и Yonyou всё активнее строят вокруг корпоративного ИИ семантические слои: knowledge graph, ontology, process i…

искусственный интеллекткорпоративный ИИИИ-агентыRAGknowledge graphontologyсемантическое ядроERPуправление даннымиархитектура ПО
Habr
RU

[Перевод] Почему AI-агенты ломаются на длинных задачах — и как обвязка помогает им дописывать приложения

ИИ-агент может бодро начать писать приложение, но на длинной дистанции быстро всплывают привычные проблемы: потеря контекста, слабая самооценка, заглу…

ИИ-агентыагентная разработкаархитектура обвязкимультиагентная архитектураclaudeавтономная разработкаPlaywright MCP