RU

«Он 10 из 10, но… »: обсудили грабли внедрения ИИ-агентов на фестивале True Tech Friends

Сегодня компании все чаще используют нейросети не только для отдельных запросов, но и для выполнения целых цепочек задач. ИИ-агент может самостоятел…

ИИ-агентывнедрение ИИавтоматизацияязыковые моделидетерминированная логикапроверка результатаархитектура ИИ-системответственностьTrue Tech FriendsМТС
Habr
RU

Почему токенайзер реж ет сло ва не там где нужно

Заголовок этой статьи, частично, наглядная демонстрация того, как его видит языковая модель. Куски слов, нарезанные по логике, которая к русскому яз…

токенизациятокенизаторBPEbyte pair encodingLLMязыковые моделиэмбеддингиконтекстное окнопромпт-инжинирингselectel
Habr
RU

[Перевод] Скидка в 97%: как устроен китайский мошеннический рынок ИИ-токенов

Моя история Я долгое время размышлял о мошенничестве с токенами — проблеме, с которой впервые столкнулся, когда работал разработчиком ПО в ИИ-шлюзе.…

токены llmязыковые моделиllmинференсчерный рынокruvds_перевод
Habr
RU

[Перевод] Маршрутизация моделей кажется простой задачей. Но только до продакшна

Маршрутизация языковых моделей кажется достаточно тривиальной задачей: простые запросы уходят дешевым моделям, сложные — дорогим.  Еще можно вы…

архитектурамаршрутизациямодельязыковые моделиai-агентыискусственный интеллектhuggingfacehugging face
Habr
RU

Grok 4.6 вышел: разбираем тесты и цену долгих задач

12 августа SpaceXAI выпустила Grok 4.6. Модель получила 500 тысяч токенов контекста, четыре режима рассуждения и явный уклон в длинную агентную рабо…

grok 4.6spacexaixaiии-агентыагентное программированиеискусственный интеллектязыковые моделистоимость токенов
Habr
RU

Kimi K3 на PAC1 и ECOM1: результаты 204 задач и разбор отказов

27 июля Moonshot AI открыла веса Kimi K3 и опубликовала результаты модели на coding- и агентных бенчмарках. Мы проверили, как эти показатели перенос…

Kimi K3LLMязыковые моделиоткрытые весаopen sourceИИ-агентыtool callingагентные системыоценка моделейтестирование ИИ
Habr
RU

Как переводить смешанный русский-казахский и не сойти с ума

В Казахстане часто смешивают казахский и русский в соцсетях, переписке, быту. Но попробуйте скормить русско-казахскую фразу любой системе машинного…

SimAlignдатасетыдатасеты обучениямашинный переводязыковые моделиllmказахский языкnlpисследованиясинтетические данные
Habr
RU

Как переводить смешанный русский-казахский и не сойти с ума

В Казахстане часто смешивают казахский и русский в соцсетях, переписке, быту. Но попробуйте скормить русско-казахскую фразу любой системе машинного…

SimAlignдатасетыдатасеты обучениямашинный переводязыковые моделиllmказахский языкnlpисследованиясинтетические данные
Habr
RU

[Перевод] Структура, скрытая за написанием текста языковыми моделями

Языковые модели генерируют текст, следуя скрытым грамматическим правилам, или грамматика - просто побочный эффект предсказания следующего слова? Это…

языковые моделиllmграмматикаnlpгенерация текста
Habr
RU

Сравниваем LLM, 12 тестов для среднего класса: три Sonnet против GigaChat 2 MAX и YandexGPT Pro 5.1

В первой статье цикла мы гоняли по 12 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro.…

сравнение нейросетейLLMClaude SonnetGigaChatYandexGPTтестирование ИИискусственный интеллектязыковые моделироссийские нейросетибенчмарки
Habr
RU

Mamba: архитектура, которая шла убивать трансформеры

В декабре 2023 по ML-тусовке прокатилась волна заголовков в духе «трансформерам конец». Поводом стала статья двух исследователей — Альберта Гу и Три…

MambaSSMтрансформерыattentionязыковые моделинейросетимашинное обучениеRNNгибридные моделиselectel
Habr
RU

FINESSE-Bench: как мы обновили финансовый бенчмарк для LLM

В Лаборатории искусственного интеллекта «Финама» мы изучаем и развиваем применение ИИ в финансовом домене: от бенчмаркинга LLM до прикладных сценари…

искусственный интеллектсравнение моделей ииaiopenaigeminiбенчмарки llmtradingтехнический анализязыковые моделиclaude
Habr
RU

Как работает проверка текста на ИИ в 2026 году: что показал анализ 13 000 дипломных работ

Антиплагиат ищет заимствования, а детектор ИИ языковые признаки генерации. Это не одна и та же проверка, хотя в разговорах о дипломах их часто смеши…

ИИllm-моделиязыковые моделикопирайтингдиплом
Habr
RU

Kafka без брокеров: как я из художественного текста сделал современную техническую документацию

Недавно я решил перечитать рассказ «В исправительной колонии» Франца Кафки. Впервые я познакомился с ним еще студентом — задолго до того, как узнал…

ииязыковые моделитехническая документацияllm-моделиllmкафкапромпт
Habr
RU

От языковых моделей к вычислимому мышлению: как SymFSM меняет архитектуру AI-систем

Современные языковые модели умеют многое: писать код, объяснять сложные вещи, строить планы, рассуждать. Но фундаментально они остаются вероятностны…

искусственный интеллектязыковые моделиструктура мышленияавтоматыкогнитивные картыверификацияopen sourceAGI
Habr
RU

Что такое контекстное окно и почему модели забывают

Ты час разговариваешь с ChatGPT. Даёшь контекст, объясняешь задачу, уточняешь детали. А потом модель вдруг начинает противоречить тому, что говорила…

контекстное окноLLMтокеныпамять ИИChatGPTязыковые моделиlost in the middleRAGGPTконтекст
Habr
RU

Может ли ИИ думать? Разбираем вопрос без философии

Этот вопрос обычно заканчивается одинаково: кто-то произносит слово «сознание», дальше начинается философский спор, и через двадцать минут все расхо…

ИИмышлениеLLMпониманиеchain-of-thoughtGPTязыковые моделикитайская комнатаcognitionискусственный интеллект
Habr
RU

Режим thinking у ИИ: что на самом деле происходит, когда модель «думает»

Когда нажимаешь кнопку Thinking и видишь, как модель несколько секунд «размышляет» перед ответом — легко решить, что она просто старается сильнее. Р…

thinkingchain-of-thoughtLLMязыковые моделиИИreasoningo1DeepSeekGPTрежим мышления
Habr
RU

Смогут ли LLM выжить во время катастрофы? Gemini, ChatGPT и другие играют в «Бункер» (анализ поведения)

Тестирование современных LLM моделей проводится с помощью стандартных бенчмарков, которые оценивают математические способности, программирование, по…

искусственный интеллектнаучпопllmязыковые моделиgeminichatgptсравнение моделейтеория игрбольшие языковые моделиruvds_статьи
Habr
RU

За кулисами нейросетей: полный цикл тренировки языкового ИИ

Ты уже пользуешься языковыми моделями — спрашиваешь, генерируешь, отлаживаешь код. Но откуда берётся сама способность отвечать? Не «где хранятся дан…

LLMобучение нейросетейRLHFfine-tuningпредобучениетрансформерGPTязыковые моделимашинное обучениеИИ
Habr
RU

Как промт превратил языковую модель в проводника смыслов и источник инсайтов для бизнеса: AI-конструктор офферов

Как промт превратил языковую модель в проводника смыслов и источник инсайдов для бизнеса: AI-конструктор офферов История эволюции инструмента анализ…

gptпромтпромпт-инжинирингязыковые моделипромт-инжиниринг
Habr
RU

Как устроены LLM-агенты: архитектура, планирование и инструменты

Если вы хоть раз просили ChatGPT выполнить какую-то задачу и получали в ответ инструкцию "как это сделать" вместо того чтобы он взял и сделал сам -…

LLMагентыAI agentsprompt engineeringархитектура ИИLangGraphChatGPTязыковые модели
Habr
RU

Системный промпт или галлюцинация: как я проверял AI-ассистентов и что ответили bug bounty-команды

В марте я проверял, можно ли уговорить AI-ассистентов выдать что-то похожее на системный промпт. Ответы выглядели убедительно: внутренние правила, т…

AI-ассистентысистемный промптгаллюцинацииbug bountyобход ограниченийуязвимостиинформационная безопасностьязыковые моделиАлисаGigaChat
Habr
RU

Оксфорд доказал: чем добрее ваш ИИ, тем чаще он вам врёт. И это не баг

Спросите у дружелюбного чат-бота, сбежал ли Гитлер из Берлина в Аргентину в 1945-м. Обычная модель поправит вас и скажет, что Гитлер покончил с собо…

ИИязыковые моделиподхалимствоsycophancyGPT-4oOxfordгаллюцинациибезопасность ИИдообучениеэтика ИИ
Habr
RU

Слова, которых нет

LLM генерирует ответ за две секунды, но говорит «эта задача займёт две недели». За этой странностью — что-то более глубокое, чем просто эхо обучающи…

LLMискусственный интеллектвремяфилософия ИИкогнитивистиканейросетимашинное обучениечеловек и машинатемпоральностьязыковые модели
Habr
RU

Основы парсинга сайтов: от HTML до готового датасета для NLP

Даже сильная NLP‑модель быстро упирается в банальную проблему: ей нужны данные, причём не абстрактные «готовые датасеты», а текс…

парсинг сайтовPythonHTMLBeautifulSouprequestsPlaywrightNLPдатасеточистка данныхязыковые модели
Habr