RU

Цена за успешный результат: почему дешёвая модель может обойтись дороже дорогой

Дешёвая LLM легко превращается в дорогую, если агент чаще ошибается, уходит в повторные прогоны и требует внимания инженера. В статье…

ИИ-агентыLLMстоимость LLMстоимость токеноввыбор моделиAI-агентыкэшированиемаршрутизация моделейчеловеко-времяeval
Habr
RU

Цена, которой не существовало: две недели поиска бага, который не видел мониторинг

Есть класс ошибок, которые невозможно найти простой сверкой. Не потому, что данные хорошо спрятаны, а потому, что искомого состояния нет ни в одной…

кэшированиераспределённые системыконсистентность данныхмониторингнаблюдаемостьметрикиразбор инцидента
Habr
RU

Кэш — это холодильник: TTL, инвалидация и cache stampede

Объясню кэш через холодильник, а потом покажу, где эта аналогия ломается, и что с этим делают в проде. Статья для тех, кто кэш уже ставил, но не раз…

кэшкэшированиеcache stampedesingleflightTTLинвалидация кэшаGoRedisthundering herdпроизводительность
Habr
RU

Большие модели и цена миллиона токенов

Китайские модели дешевле или это ловушка? Разбираемся, как не переплачивать за токены и почему цена в прайсе — еще не вся правда о расходах на ИИ. Ч…

hostkeyLLMAPIAnthropicOpenAIDeepSeekстоимость токеновкэшированиеконтекстное окнонейросети
Habr
RU

Кэширование в Symfony: мы сломали авторизацию и исправили это с помощью Lock

Мы добавили кэширование, чтобы ускорить работу бэкэнда. Затем кэширование нарушило авторизацию. Поначалу ситуация казалась безобидной. Сервису Symfo…

phpsymfonyпрограммированиеcachingmemcachedкэшированиеавторизациябэкенд
Habr
RU

Как VPS с 1 ГБ RAM пережил 1,2 млн запросов за сутки: разбираю «Шакализатор» по слоям

Мой мемный сервис «Шакализатор» победил в премии Яндекс Практикума , но меня больше интересовал другой вопрос: как VPS с одним ядром и 1 ГБ RAM пере…

Node.jsNext.jsNginxVPShighloadкэшированиеограничение конкурентностиgraceful degradationCodexswap
Habr
RU

Эволюция Telegram‑бота на C++: от «лапши» в main() до ООП, in‑memory кэша и мутов по Фибоначчи

Привет, Хабр! В этой статье я расскажу об эволюции моего проекта — GroupModerBot , бота для модерации Telegram‑групп. Я покажу,…

c++c++20sqlitetelegramtelegram botкэшированиемодерированиерефакторингботopen source
Habr
RU

Cache is hard — почему инвалидация кэша — это проблема согласованности, а не производительности

Кэш часто воспринимают как простой способ ускорить систему: положили данные ближе к приложению — получили быстрый ответ. Но&nbsp…

кэшированиеинвалидация кэшасогласованность данныхраспределённые системыRedisPostgreSQLCDCKafkaTTLвысоконагруженные системы
Habr
RU

5 слоев кэширования в веб-приложениях: Полное руководство для Python-разработчиков

Содержание Кэширование — ключевой механизм оптимизации производительности веб-приложений, позволяющий снизить задержки и уменьшить нагрузку на серве…

кэшированиеhttp-заголовкиcdnlocal storage
Habr
RU

Кэш результатов запросов в Postgres Pro: как ускорить часто выполняющиеся запросы и разгрузить базу

Каждый раз, когда пользователь открывает страницу каталога или дашборд со статистикой, база данных заново считает одно и то же. Запрос к 800 тысячам…

кешированиекешированиябаза данныхкэшированиекэширование запросовкэширование данныхкэшpostgresqlpostgrespostgres pro
Habr
RU

Гиперэкономия на токенах с API SpeShu.AI: как работает новое кэширование

Инфраструктура API SpeShu.AI обновилась. Для бизнеса с ИИ-агентами и чат-ботами это означает, что одни и те же задачи теперь стоят в десятки раз деш…

APIAPI нейросетейapi для бизнесакэшированиеэкономияприбыльсокращение расходовбизнесавтоматизация бизнеса
Habr
RU

Иллюзия памяти: как индустрия десятилетиями маскировала ограничения железа

Сейчас память можно увеличить ползунком, Redis поднять одной командой, а состояние сервера оценить по строке в панели управления. Но за этим удобств…

памятьвиртуальная памятьRAIDRedislatencydistributed systemsHBMCXLкэшированиеruvds_статьи
Habr
RU

Как я сделал трёхуровневый кэш сообщений в мессенджере на React Native — и что узнал по дороге

Я делаю мессенджер ONEMIX на React Native. К моменту, когда я начал писать этот пост, в нём уже больше десятка экранов, групповые WebRTC-звонки чере…

react nativesqliteкэшированиеexpoмессенджерdrizzle ormмобильная разработкапроизводительностьархитектураtelegram
Habr