Сравниваем LLM, 12 тестов для Claude Fable 5 и GPT 5.5 Pro
В прошлой статье мы устроили большое сравнение Opus 4.8, GPT 5.5 и Gemini 3.1 Pro и оговорились: GPT 5.5 Pro в том матче не участвовала, потому что…
Tech news from the best sources
В прошлой статье мы устроили большое сравнение Opus 4.8, GPT 5.5 и Gemini 3.1 Pro и оговорились: GPT 5.5 Pro в том матче не участвовала, потому что…
Это подробный разбор одного эксперимента. Я взял god node из реального LangGraph агента и попросил 5 американских и 6 китайских моделей сначала пред…
В комментариях к моей предыдущей статье о тестировании трех флагманских LLM моделей были примерно такие мысли и вопросы: Читать далее
«Сначала Mythos был „слишком опасен, чтобы продавать“. Потом стал Fable „только до 22 июля“. Потом тихо исчез, сославшись на регулятора. Я поспорил…
После выхода первой части прошло 2 месяца, и наши многоуважаемые американские партнёры из Anthropic и Google что-то подхимичили, и новые версии Clau…