Осознаёт ли Нейросеть, что её тестируют? Проверяю на практике
LLM знает, что её тестируют — и решает, стоит ли подыгрывать. Прогнал 24 эксперимента на qwen3-32b. Без маркера теста модель честно отвечает, что Па…
Tech news from the best sources
LLM знает, что её тестируют — и решает, стоит ли подыгрывать. Прогнал 24 эксперимента на qwen3-32b. Без маркера теста модель честно отвечает, что Па…
Агенты часто стараются угодить. LLM стремится дать полезный ответ как можно быстрее. Если данных для анализа еще недостаточно, она начинает додумыва…
Классический RAG хорошо ищет отдельные факты, но может пропускать исключения и связи между разными разделами документации. Я проверил альтернативный…
Anthropic показали, как работает агентная обвязка. Я не Anthropic — поэтому собрал эту обвязку из доступных компонентов, а не написал свой runtime.…
Меня зовут Темченко Сергей, и за последние два года я в разных ролях участвовал во множестве LLM-проектов. Недавно я заметил, что на полях моей тетр…
MCP упростил жизнь разработчикам: теперь у AI-агентов есть единый способ подключаться к инструментам и сервисам. Но у этой стандартизации есть обрат…
Создать LLM-судью легко. Гораздо сложнее сделать так, чтобы его оценкам можно было доверять. Мы убедились в этом на практике при разработке нейрораз…
Когда я начал активно использовать ИИ-агентов для разработки, у меня быстро появилось странное ощущение - c одной стороны, это действительно впечатл…
Я разрабатываю локальный AI‑runtime JIN , без использования привычных методов сохранения информации и с упором на долговременную памя…
В прошлом материале мы подробно разобрали кейс внедрения ИИ-ассистента. Сегодня пойдем глубже и препарируем саму архитектуру системы, которая позвол…