RU

Разработчики в вашей компании уже тратят много токенов. Как проверить реальную пользу ИИ для бизнеса?

За час ИИ-агент может изменить десятки файлов, написать тесты и потратить большой объём токенов. Польза для команды зависит от результата. Если разр…

ideaai-агентыaiai agentc++javascriptjavaпрограммированиетокенытокены разработчика
Habr
RU

OpenAI API в 2026 году: как получить ключ, выбрать модель и не разориться на токенах

В июле OpenAI выпустила новую линейку моделей, в конце месяца дважды поменяла цены, а на осень назначила отключение Assistants API, Videos API и все…

openaiopenai apiapiапиопенаиключиподключениеаитокенынейросети
Habr
RU

OpenAI API в 2026 году: как получить ключ, выбрать модель и не разориться на токенах

В июле OpenAI выпустила новую линейку моделей, в конце месяца дважды поменяла цены, а на осень назначила отключение Assistants API, Videos API и все…

openaiopenai apiапиключитокеныapiустановканейросетиaiai-агенты
Habr
RU

Почему нейросети съедают токены: что происходит с длинными чатами и как снизить расход

Один пользователь Claude утверждает, что прогнал через модель больше миллиарда входных токенов. Другой оставил AI-агента без присмотра и насчитал ок…

LLMтокеныконтекстное окноClaudeChatGPTcontext rotprompt cachingAI-агентыcontext engineeringрасход токенов
Habr
RU

Токены в ИИ и оптимизация промптов: как я сэкономила 50% бюджета и перестала здороваться с ChatGPT

Меня зовут Анна, я ведущий инженер по тестированию в Рексофт. Последние два года я плотно работаю с большими языковыми моделями: интегрирую их в CI/…

токеныэффективный промптпромптыэмбеддингконтекстное окно
Habr
RU

Архитектура под замену: чему нас научил переход с OIDC на Kerberos

Нужно было заменить OIDC на Kerberos при внедрении платформы в облако заказчика. Простая замена не сработала: пользовательский контекст и межсервисн…

KerberosOIDCJWTIAMмикросервисыаутентификациятокеныархитектураоблако
Habr
RU

Один ход агента — 120 000 токенов. Разбираемся, куда они уходят и как мы это починили

Мы делаем автономного агента, который умеет не отвечать, а делать: искать в сети, генерировать медиа, резать видео на клипы, публиковать результат.…

LLMагентытокеныprompt engineeringAIopenrouterагентные системыоптимизациябиллинг
Habr
RU

Как я потратил вечер, разбираясь, почему кэш в клоде, gpt и джемини — это три разных зверя

Устал переплачивать за одну и ту же память, которуе гоняю по кругу, и решил разобраться, как у кого на самом деле устроен кэш, а не просто верить ст…

ллмкэшклодчатгптгеминитокены
Habr
RU

Palantir и голые токены: как продать «суверенный ИИ» людям, которые не любят терять контроль

Palantir выложил в X пост , который журналисты быстро стали называть «манифестом». Формально это «The Technological Republic, in brief» — промо-выжи…

Palantirсуверенный ИИтокеныtokenmaxxingNVIDIA NemotronAlex KarpAIPвоенный ИИконтроль данныхalpha
Habr
RU

Context7 — стандарт для доков AI-агента. Я измерил 8 альтернатив и собрал бесплатную связку

Context7 — мой дефолтный источник свежих доков для агента уже полтора года. И всё устраивало, пока я не начал ловить устаревший код: старый z.string…

MCPContext7neuledgeдокументацияAI-агентыClaude CodeCodexбенчмаркитокеныRAG
Habr
RU

Context7 — стандарт для доков AI-агента. Я измерил 8 альтернатив и собрал бесплатную связку

Context7 — мой дефолтный источник свежих доков для агента уже полтора года. И всё устраивало, пока я не начал ловить устаревший код: старый z.string…

MCPContext7neuledgeдокументацияAI-агентыClaude CodeCodexбенчмаркитокеныRAG
Habr
RU

Контекстное окно человека: чем его теперь заполнять

Раньше ценность специалиста в продуктовой разработке — неважно, аналитик это, владелец продукта, разработчик или инженер сопровождения, — во многом…

контекстное окнопромпт-инжинирингsdlcпроизводственный процесстокены
Habr
RU

git ни разу не спросил у вас пароль — и в этом виноват скандал 2005 года

Признайтесь: вы не знаете, кто у вас сейчас просит пароль. Вы делаете git push. Иногда выскакивает окошко. Иногда терминал молча ждёт ввода, и буквы…

gitgithubsshаутентификацияистория itlinus torvaldscredential providergit pushбезопасностьтокены
Habr
RU

Что такое контекстное окно и почему модели забывают

Ты час разговариваешь с ChatGPT. Даёшь контекст, объясняешь задачу, уточняешь детали. А потом модель вдруг начинает противоречить тому, что говорила…

контекстное окноLLMтокеныпамять ИИChatGPTязыковые моделиlost in the middleRAGGPTконтекст
Habr
RU

П維чему нейро考ети дел思ют так

Если вы хоть раз тестировали локальную модель (да и нелокальную тоже) и замечали, как она посреди нормального текста вдруг выдает иероглиф, то загол…

нейросетимашинное обучениеэмбеддингиgrokkingгроккингllmвекторное пространствоmechanistic interpretabilityтокеныselectel
Habr
RU

PII-Shield: режем персональные данные в логах до того, как они доехали до ELK

Сначала хотелось просто скрывать случайные токены по энтропии. Потом выяснилось, что UUID, trace id и номера карт ломают эту идею, и пришлось собира…

PIIперсональные данныемаскирование логовKubernetessidecarKubernetes operatorGoсекретытокеныDevSecOps
Habr
RU

[Перевод] Ограничения размера cookie в ASP.NET Core в продакшене: причины и способы решения

В dev-среде аутентификация может годами выглядеть безобидно: логин прошёл, cookie выпущена, [Authorize] работает. А потом приложение переезжает в пр…

c#ASP.NET Corecookieаутентификацияавторизациясерверные сессиитокены
Habr
RU

[Перевод] Создание MCP‑серверов на FastMCP: 7 ошибок, которых стоит избегать

FastMCP позволяет быстро собрать MCP‑сервер, но скорость легко оборачивается ошибками: лишние токены, слабые схемы, сырые API‑примити…

MCPFastMCPИИ-агентыLLMPythonAPIбезопасностьобработка ошибоктокеныпроектирование инструментов
Habr
RU

Короткий промпт ≠ дешёвый промпт: как оптимизация ломает prefix cache в LLM-агентах

32 tools в промпте - дешевле, чем 7. Да, да - если вы строите агентов, это не опечатка. Это следствие того, как работает prefix cache в агентском ци…

llm-агентprefix cachingтокеныai-агентыaiprompt cachingprompt-engineeringcontext-engineering
Habr
RU

TokenToad: как я сделал Chrome-расширение, чтобы перестать удивляться счетам за AI

Расходы на AI API копятся незаметно: сессия Claude Code тут, batch к GPT-5 там — и к концу месяца биллинг удивляет. Собрал бесплатное Chrome-расшире…

chrome extensionai apiopenaianthropicclaudeрасходы apiтокеныбиллингpreactvite
Habr