Сравниваем LLM, 12 тестов для китайских флагманов: Kimi K3, GLM-5.2, DeepSeek V4 Pro и Qwen 3.8 Max
В первой статье цикла мы гоняли по 11 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro,…
Tech news from the best sources
В первой статье цикла мы гоняли по 11 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro,…
Показатели каждой новой версии LLM моделей стабильно превышают предыдущие, но при этом они не отвечают на вопрос: какой cli агент лучше использовать…
Излюбленный прием в аналитике это когда сравнивают зависящий от сезонности показатель с тем же месяцем прошлого года. То есть январь с январём, июль…
За последний год я поставил на прод все три: Claude Code, Cursor и Codex. Каждый закрывает свою часть процесса, и вопрос “что выбрать” почти всегда…
В прошлой статье мы устроили большое сравнение Opus 4.8, GPT 5.5 и Gemini 3.1 Pro и оговорились: GPT 5.5 Pro в том матче не участвовала, потому что…
CRM для проектов и продаж на рынке много, но выбрать подходящую — головная боль. У всех разные функции, тарифы и возможности. Сидеть и тестировать к…
Меньше месяца назад Anthropic выпустила модель Claude Opus 4.8. Как обычно, заявили много новых плюшек, вроде улучшенного кодинга и режима Fast Mode…
Я делаю VantageDNS, recursive DNS-resolver с фильтрацией. То есть прямой конкурент всех, про кого пишу ниже. Это, мягко говоря, неудобный жанр: писа…
Всем привет, меня зовут Михаил, я работаю главным экспертом в ОТП Банке. До банка я почти не работал в командах с выстроенными процессами. Суета, сп…
Привет, Хабр! Не то чтобы сильно планировал, но обстоятельства вынудили в очередной раз вернуться к теме сравнения российских хостингов — решил, что…