RU

Как тестировать ИИ-агентов, если «правильно» не детерминировано

GitHub построил Trust Layer для Copilot-агентов: валидация по ключевым состояниям вместо жёстких скриптов. Узнайте, как снизить ложные падения CI. — Ч…

ТестированиеИнструментыМашинное обучениеНейронные сетиИскусственный интеллектМетодологии разработкиGitHubOpenAIСтатьи
Tproger
RU

ИИ-агент собрал сам себя: эксперимент с LangChain4j и уроки для Java-разработчиков

LLM по документации LangChain4j собрала клона себя — мультиагентного кодера. Он починил баги, прошёл 11 тестов и показал, почему workflow быстрее supe…

JavaИскусственный интеллектФреймворки и библиотекиOpenAIСтатьи
Tproger
RU

Можно ли аналитику в 2026 году положиться на ИИ и агентов или ещё нет?

Ведущий системный аналитик тестирует ИИ в реальном процессе: Use Case, Confluence, Figma, API-спецификации. Где агент помогает, где придумывает лишнее…

ОптимизацияИскусственный интеллектАналитикаСтатьи
Tproger
RU

Как OpenRouter Fusion обошёл Claude Fable 5

Мультимодельная оркестрация – модная: вместо одной модели дёргаешь несколько разом, а отдельная модель-судья сводит их ответы в один. OpenRouter прода…

Искусственный интеллектМашинное обучениеAPIНейросетиУправление проектамиБенчмаркиLLM
Хабр — Управление
RU

immers.cloud запустил Foundation Models: каталог open-source LLM с арендой GPU и без платы за токены

Каталог open-source LLM от immers.cloud: инференс на GPU в РФ с предсказуемой оплатой за время сервера вместо pay-per-token, автоподбор конфигураций и…

Open SourceИскусственный интеллектОблачные технологииСтатьи
Tproger
RU

OpenAI выпустила GPT-5.5-Cyber для поиска и исправления уязвимостей

OpenAI выпустила GPT-5.5-Cyber и обновила Codex Security. Модель ищет баги, проверяет их в изолированной среде и генерирует патчи. Разбираем, что меня…

Open SourceИнструментыБезопасностьИскусственный интеллектOpenAIНовости
Tproger
RU

Как Cloudflare строит ИИ-харнесс для охоты на уязвимости

ИИ-харнесс для поиска уязвимостей: как Cloudflare превратила 450-строчный скилл в оркестратор охоты на баги для 128 репозиториев. Читайте архитектуру,…

Open SourceБезопасностьМашинное обучениеИскусственный интеллектУязвимостьРазработкаСтатьи
Tproger
RU

Какой гуманизатор ИИ даёт самый естественный текст? Я протестировал самые популярные инструменты, чтобы вам не пришлось

Сравниваем гуманизаторы ИИ: GPTHuman AI, StealthGPT, UndetectedGPT, Grammarly и AIHumanize. Узнайте, какой сервис делает ИИ-текст человечнее и сохраня…

Для начинающихИнструментыИскусственный интеллектПереводы
Tproger
RU

70% разработчиков считают ИИ-код дырявым, при этом 30% всех опрошенных деплоят его в прод

93% компаний взламывали из-за уязвимого ИИ-кода. Разбираем исследование Checkmarx и объясняем, почему разработчики деплоят баги в прод. Читайте выводы…

Безопасный кодБезопасностьИскусственный интеллектОрганизация разработкиDevOpsРазработкаКибербезопасностьСтатьи
Tproger
RU

Meta* тестировала в приложении ИИ-ленту с кликбейтом и фейками

Meta тестировала ленту ИИ-статей с вымышленными фактами и фальшивыми изображениями. После вопросов журналистов компания объявила об отключении. Разбир…

НовостиИскусственный интеллектНовости компаний
Tproger
RU

[Перевод] Тест Лавлейс: переосмысление

Почему один из самых требовательных тестов ИИ уже, похоже, пройден Тест Лавлейс предложили в 2001 году, чтобы закрыть слабые места более известного те…

тест Лавлейсgenerative aiкреативность ИИLLMИскусственный интеллектмашинное обучение
Habr
RU

Размечать меньше, обучать лучше: эксперимент с активным обучением

Валерия Басова, руководитель отдела разработки AI в Embedika, про результаты тестирования стратегий активного обучения на договорах — Читать дальше « …

Машинное обучениеИскусственный интеллектРазработкаСтатьи
Tproger
RU

Addy Osmani зашил сениор-инженерную дисциплину в скиллы для AI-агентов

Addy Osmani выложил 20 markdown-навыков, которые заставляют AI-агента писать спеки, тесты, ревью и не пропускать сениорские шаги. Разбираем пять принц…

APIНейронные сетиИскусственный интеллектMarkdownНовости