RU

Single Task Algorithmic Reasoning Models: как с помощью маленькой модели обойти большую LLM?

Привет, Хабр! Результаты коллег по цеху и наши исследования позволяют сделать однозначный вывод: в 2026-м для рецепта отличной reasoning -модели уже…

llmreasoningadaptive compute timeальтернативные архитектуры
Habr
RU

«Скопируй промпт дважды и получишь +76%». Я решил проверить

Всем привет. В декабре по всем AI-каналам пролетел лайфхак, который звучал как развод: продублируй свой запрос к нейросети, буквально Ctrl+C, Ctrl+V…

LLMпромпт-инжинирингGeminiвоспроизводимостьэкспериментreasoningпромптыab test
Habr
RU

Следим за релизами Codex: последние обновления

Если вы работаете с Codex, то наверняка замечали  следующее - нажимаешь кнопку “Обновить”, Codex перезапускается, но визуально ничего не меняет…

OpenAI CodexCodexGitHub Releasesобновления Codexpre-releaseMCPAI-инструментыразработкаreasoningCLI
Habr
RU

Рефлексивный бот с долгой памятью: почему универсальный LLM-чат тут не работает, и как я переписал онбординг по данным

Я какое-то время использовал ChatGPT и Claude как собеседника для рефлексии — выгрузить, что в голове, посмотреть на себя со стороны. С самим разгов…

AIreflectionreflectbottelegramclaudeclaude-codereasoningprovider
Habr
RU

Режим thinking у ИИ: что на самом деле происходит, когда модель «думает»

Когда нажимаешь кнопку Thinking и видишь, как модель несколько секунд «размышляет» перед ответом — легко решить, что она просто старается сильнее. Р…

thinkingchain-of-thoughtLLMязыковые моделиИИreasoningo1DeepSeekGPTрежим мышления
Habr
RU

Тайная слабость нейросетей: почему большие контекстные окна не работают

Крупнейшие ИИ-вендоры ведут агрессивную гонку контекстных окон: 128K токенов стали минимально необходимым стандартом, а некоторые модели заявляют и…

ИИAILLMэкспериментпромпт-инжинирингпромптыконтекстная гнильcontext rotlost in the middlereasoning