Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090
Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по…
Tech news from the best sources
Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по…
В последнее время ИИ-сфера не просто падает, а даже входит в активную стадию конкурентности между несколькими фронтами — корпоративные ИИ (OpenAI и…
Architectural Evolution: A Technical Deconstruction of Qwen3.8-Flash-Next The release of Qwen3.8-Flash-Next marks a significant shift in the deploym…
В какой‑то момент я осознал, что у меня много источников данных, есть мощная машинка в виде MacBook Pro M4 Max со 128 …
Началось все с установки. Я пошёл почти по самому простому пути - установил его на Mac, в Docker. Потому что это агент, который работает автономно и…
В этом месяце Alibaba выпустила две модели, и та, о которой все писали, оказалась не той, что мы ждали. Qwen3.8-Max — это API с 2,4 триллионами пара…
Three things happened this week that, together, change the game for small businesses in Mexico and Latin America. 1. Qwen released Qwen3.8-27B , a 2…
В первой статье цикла мы гоняли по 11 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro,…
Всем привет. В свободное время и под настроение я ваяю маленькие, незамысловатые игры на основе d10-кубов механик, похожие на PvP или PvE настолки,…
Все началось вообще не с идеи написать очередной бенчмарк. Мне нужно было собрать локальный пайплайн для длинных подкастов: полу…
Agentic benchmarks rank models differently than chat benchmarks do, and the gap between the two scores is now wide enough to matter for real deploym…
Have you ever wanted an AI coding assistant inside VS Code without paying for GitHub Copilot or other monthly subscriptions? The good news is—you ca…
There was a month where I blew through my token budget without noticing. Claude Code and Codex, running most of the day, on a codebase I was explori…
Последние несколько лет Саймон Уиллисон тестировал каждый крупный релиз LLM одним и тем же промптом: «Сгенерируй SVG с пеликаном, сидящим на велосип…
Written for the Qwen Cloud Global AI Hackathon 2026 — Track 3: Agent Society. The idea Most "AI marketing" tools are one LLM wearing a lot of hats —…
Каждую ночь у нас в JobPath запускается Celery-задача, которая берёт свежие вакансии из каталога (мы собираем их из открытых источников и Telegram-к…
Alibaba показала Qwen3.8-Max-Preview, новую флагманскую модель на 2,4 трлн параметров. Компания обещает вскоре открыть веса и называет Qwen3.8 одной…
Всем привет! На связи Сергей Иванов, аналитик технологий машинного обучения R-Vision. В этой статье разберем, почему для задач SOC можно начинать с…
The deal, which was rumored to be in the works last year, marks an important step for Apple's AI ambitions in a key market.
В «Ростелекоме», как в любом крупном корпоративном контуре, SAST-поток исчисляется тысячами срабатываний. Ручной триаж перестает быть инженерной раб…
Гений, миллиардер, плейбой, филантроп — цитата из «Железного человека», которую знают все. И полетать в железном костюме, конечно, тоже все хотели.…
Когда мы занялись поисковым слоем AI-ассистента в «Первой Форме», договорились на входе: языковую модель, которая отвечает пользователю, не трогаем.…
Я решил в качестве эксперимента собрать первую линию email-поддержки вокруг локальной LLM — без файн-тюнинга и попыток сразу заменить всю службу под…
ИИ снова закрывается. Пока мир следит за технологической войной чипов, Пекин и Вашингтон начали закрывать доступ к самому главному — готовым моделям…
Снаружи китайский рынок AI Security не прозрачный, у половины продуктов нет даже английского лендинга, а внутри там за последнюю пару лет выросла по…
I built an AI agent that catches other AI agents' fake citations — in 4 days, on Qwen Cloud How "vibe citing" became a product, and what I learned m…
В последнее время становится все более популярным локальный запуск LLM. У каждогг свои причины, но основные это: проблемы с западными сервисами, нес…
A new system called Qwen-Image-Agent gives text-to-image models the ability to plan, reason, and revise across multiple steps, closing what its auth…
Спойлер: коды готовы — вставьте и пользуйтесь. Знаете, что меня расстраивало больше всего в чатах с нейросетями? Сидишь, читаешь…
Хотите не забывать детали диалога или то, что вас просили купить в магазине? Конечно, можно по старинке открывать блокнот в телефоне или чат в избра…