RU

Одна строка в системном промпте отключала кеш целиком. 1% против 98% на живых вызовах

Токен, прочитанный из кеша, стоит не «немного дешевле». Он дешевле в 10–31 раз : DeepSeek — $0.44 против $0.014 за миллион, OpenAI — $4.00 против $0…

prompt cachingкеширование промптовLLMоптимизация затратprefix cachehit rateDeepSeekAnthropicOpenAIPython
Habr
RU

Не в 12,1 раз, а 2,3–2,9: сколько стоит новый тариф DeepSeek V4 и почему все решают 3 часа с 10:00 до 13:00 МСК

Цифру «+1100%» я увидел в чужом пересказе, и это ровно тот жанр новости, после которого приходят спрашивать, что будет со сметой. Часть нашей нагруз…

DeepSeekDeepSeek V4стоимость APILLM APIоптимизация затратпиковый тарифчасовые поясаcronбатч-обработкакеширование промптов