10.10.2026

История Qwen: ИИ-модели Alibaba от 7B до 2.4T параметров

Article 17 image

В апреле 2023 года Alibaba Cloud продемонстрировала чат-бота, название которого примерно означает «истина из тысячи вопросов». Три с половиной года спустя, его потомок выкладывает открытые веса с 2,4 триллионами параметров. Вот история того, как Qwen пришёл к этому, релиз за релизом.

Глава 1 — 2023: тысяча вопросов

Alibaba двинулась после ChatGPT, но не на много. 7 апреля 2023 года Alibaba Cloud начал раздавать корпоративным клиентам приглашительные коды для модели под названием Tongyi Qianwen. Имя частично черпает из философа Менция.

Четыре дня спустя, на Alibaba Cloud Summit в Пекине, тогдашний CEO Дэниел Чжанг представил её публично. Alibaba заявила, что интегрирует модель во все бизнес-направления, начиная с DingTalk и голосового ассистента Tmall Genie (China Daily).

Настоящий перелом произошёл в августе. 3 августа 2023 года Alibaba открыла исходный код Qwen-7B и Qwen-7B-Chat, прямой ответ Meta на Llama 2. Qwen-7B была предобучена более чем на 2,2 триллионах токенов с контекстом 2048 токенов. Лицензия была свободной для коммерческого использования при менее 100 миллионах ежемесячных пользователей.

Видение последовало в течение недель. Qwen-VL, первый ветвь модели, способной работать с изображениями, вышла в конце августа 2023 года.

13 сентября 2023 года Tongyi Qianwen открылась для широкой публики, признак китайского регуляторного одобрения. В том же месяце команда опубликовала Qwen Technical Report на arXiv.

Год завершился масштабом. Алебабла выпустила 72B и 1,8B модели для загрузки примерно 1 декабря 2023 года. Qwen теперь охватывал размеры от ноутбукных до передовых.

Глава 2 — 2024: машина открытых весов

2024 год — это год, когда Qwen стала выбором по умолчанию для разработчиков. Команда выпустила 3 поколения за 8 месяцев.

Qwen1.5 (февраль): 5 февраля 2024 года команда выпустила Qwen1.5, позиционируемую как бета-версию Qwen2. Она охватывала плотные модели от 0,5B до 72B с стабильным контекстом 32K на каждом размере. 14B MoE с 2,7B активными параметрами последовала за ней. Также вышла 110B плотная модель, первая в семействе выше 100B.

Qwen2 (июнь): Команда анонсировала Qwen2 в начале июня 2024 года в пяти размерах, от 0,5B до 72B. В линейку вошла Qwen2-57B-A14B, первый флагман открытой смеси экспертов. Обучающие данные расширились на 27 языков помимо английского и китайского. Инструктируемые модели 7B и 72B обрабатывали до 128K токенов. Самое важное изменение — лицензирование: все размеры, кроме 72B, перешли на Apache 2.0.

Специалисты пришли летом. Qwen2-Math вышла в августе, наряду с Qwen2-Audio. Qwen2-VL последовала в конце августа, способная анализировать видео длиннее 20 минут.

Qwen2.5 (сентябрь): На Apsara Conference 19 сентября 2024 года Alibaba выпустила более 100 открытых моделей сразу. В Qwen2.5 Technical Report указано, что данные предобучения выросли с 7 триллионов до 18 триллионов токенов. Размеры шли от 0,5B до 72B, с контекстом 128K и генерацией 8K токенов.

Принятие было реальным. Alibaba сообщила, что модели Qwen набрали более 40 миллионов загрузок и вдохновили более 50 000 производных моделей на Hugging Face.

Кодирование и рассуждение (ноябрь–декабрь): Qwen2.5-Coder выпустила свою полную семейство 11 ноября 2024 года. Затем появилась первая рассуждающая модель. QwQ-32B-Preview пришла в конце ноября под Apache 2.0, как открытый конкурент OpenAI o1. QVQ-72B-Preview, экспериментальная визуальная рассуждающая модель, закрыла год 24 декабря.

Глава 3 — начало 2025: ответ DeepSeek

Январь 2025 года принадлежал DeepSeek-R1. Ответ Qwen последовал за неделю, а не за месяц.

26 января команда выпустила Qwen2.5-VL в размерах 3B, 7B и 72B. TechCrunch заметила, что она может управлять ПК и телефонами. Три дня спустя, в первый день Лунного Нового года, Alibaba запустила Qwen2.5-Max, крупную MoE модель. Reuters сообщила, что Alibaba утверждает, что она превзошла DeepSeek-V3.

Более крупное заявление последовало 6 марта. QwQ-32B, построенная на Qwen2.5-32B и обученная с подкреплением, вышла под Apache 2.0. Qwen заявляла о производительности, сопоставимой с DeepSeek-R1, моделью в 671B параметров. VentureBeat оценила аппаратную разницу в около 24 ГБ VRAM против более чем 1500 ГБ. Акции Alibaba в Гонконге выросли более чем на 7% в тот день.

Мультимодальность продолжала развиваться. Qwen2.5-Omni-7B появилась 26 марта под Apache 2.0. Она принимала текст, изображения, аудио и видео на вход, и отвечала текстом или речью. CNBC охарактеризовала её как модель для экономичных ИИ-агентов.

Глава 4 — 2025: Qwen3 и линия триллионных параметров

Qwen3 (апрель): 29 апреля 2025 года (по пекинскому времени) команда выпустила Qwen3: 6 плотных моделей от 0,6B до 32B и 2 MoE модели. Флагман — Qwen3-235B-A22B, с 22B активными параметрами. Каждая модель вышла под Apache 2.0.

Ключевая особенность — гибридное мышление. Одна модель могла рассуждать по шагам или отвечать мгновенно, переключаемая пользователем. В Qwen3 Technical Report указано предобучение на около 36 триллионах токенов. Языковое покрытие прыгнуло с 29 до 119 языков и диалектов. TechCrunch назвала семейство «гибридными» рассуждающими моделями.

Обновление 2507 (июль): 21 июля 2025 года Qwen разделила гибридное мышление обратно. Qwen3-235B-A22B-Instruct-2507 вышла как нерассуждающая модель с нативным контекстом 262K. Отдельные чекпойнты Thinking-2507 последовали (коллекции Hugging Face).

Агенты и изображения (июль–август): Qwen3-Coder-480B-A35B стартовала 22 июля 2025 года для агентного кодирования. Alibaba сопроводила её Qwen Code, открытым терминальным агентом для кодирования (Computerworld). 4 августа команда открыла исходный код Qwen-Image, 20B MMDiT модели, созданной для рендера текста внутри изображений.

Редакционная версия, Qwen-Image-Edit, была открыта 18 августа 2025 года.

Сентябрьский спринт: Qwen3-Max-Preview, первая Qwen модель свыше 1 триллиона параметров, появилась 5 сентября. В отличие от прошлых флагманов, она вышла только через API.

Через несколько дней появилась Qwen3-Next-80B-A3B, ставка на архитектуру. Она смешала линейное внимание Gated DeltaNet с гатированным вниманием в соотношении 3:1. В карточке модели утверждается, что она стоит 10% стоимости обучения Qwen3-32B и обеспечивает 10x пропускную способность инференса при длине свыше 32K токенов.

22 сентября последовали Qwen3-Omni и Qwen3-VL. На Apsara 24 сентября Alibaba официально запустила Qwen3-Max. CEO Eddie Wu сказал, что расходы превысят 380 млрд юаней (53 млрд долларов) трёхлетний план ИИ и облака.

К концу года Qwen стала национальной инфраструктурой для других. В ноябре 2025 года AI Singapore сказала, что её Sea-Lion модель перейдёт с Llama на Qwen в качестве базы.

Qwen также стала потребительским брендом. Qwen App вошла в открытую бета-версию 17 ноября 2025 года. Alibaba сообщила, что набрала 10 миллионов загрузок за первую неделю.

Глава 5 — 2026: 4 поколения за 6 месяцев

Быстрый старт (январь–февраль): 26 января 2026 года Qwen выпустила Qwen3-Max-Thinking, закрытую рассуждающую модель. Qwen сказала, что она сопоставима с GPT-5.2-Thinking, Claude Opus 4.5 и Gemini 3 Pro по 19 бенчмаркам (TestingCatalog). Qwen3-Coder-Next, маленькая гибридная модель для агентного кодирования, последовала 2 февраля. Qwen-Image-2.0 объединила генерацию и редактирование в одну модель 10 февраля.

Средняя серия последовала 24 февраля. Qwen сказала, что её Qwen3.5-35B-A3B обгоняет старую Qwen3-235B-A22B-2507. Маленькие модели для устройств пришли 2 марта.

Руководственный перелом (март): 3 марта техлид Junyang Lin опубликовал, что уходит в отпуск. Reuters сообщила, что он третий старший Qwen-фигура, ушедшая в 2026 году. Руководитель пост-обучения Yu Bowen тоже ушёл, а руководитель кодирования Hui Binyuan присоединился к Meta в январе (Yicai).

Причина, по 36Kr, — план разделить Qwen на горизонтальную предобучение, пост-обучения и модальные команды. 16 марта Alibaba поместила свои ИИ-подразделения в новую группу под руководством CEO Eddie Wu. К тому моменту Alibaba выпустила более 400 открытых Qwen моделей, загруженных более 1 миллиарда раз.

Qwen3.6 (апрель): Темп не снизился. Qwen3.6-Plus стартовала 2 апреля как проприетарная хостинговая модель. Это часть более широкого сдвига: SCMP сообщила, что китайские ИИ-гиганты переходят к проприетарным моделям для выручки. Открытая сторона продолжала двигаться. Qwen3.6-35B-A3B вышла под Apache 2.0 16 апреля, ориентированная на агентное кодирование.

Ещё две последовали в течение недели. Qwen3.6-Max-Preview, закрытый флагман-превью, появилась 20 апреля. 22 апреля вышла плотная Qwen3.6-27B под Apache 2.0. Qwen сказала, что она обгоняет Qwen3.5-397B-A17B по ключевым бенчмаркам кодирования.

Qwen3.7 (май–июнь): На Alibaba Cloud Summit 20 мая Alibaba представила Qwen3.7-Max, созданную для задач агентов с длинным горизонтом. Alibaba сказала, что Artificial Analysis поставила её на пятом месте глобально и первой среди китайских моделей. Qwen3.7-Plus последовала в начале июня по цене 0,4/1,6 доллара за 1M токенов. Обе остались закрытыми.

В июле CNBC сообщила, что Qwen будет интегрирована в Apple Intelligence в Китае.

Qwen3.8 (июль–август): Bloomberg сообщила о превью нового флагмана 19 июля. Хостинговая Qwen3.8-Max стартовала в начале августа. 12 августа Alibaba открыла исходный код её базы как Qwen3.8-2.4T-A95B: 2,4 триллиона параметров, 95B активных (Gigazine).

В лицензии появилось новое условие. Поставщики, зарабатывающие более 50 млн долларов за 12 месяцев, нуждаются в коммерческой лицензии. Два дня спустя, Qwen3.8-27B вышла под чистой Apache 2.0. 26 августа Reuters осветили Qwen3.8-Flash. Её открытый родственник, Qwen3.8-Flash-Next, позиционировался как раннее превью архитектуры Qwen4.

Сентябрь: 20 сентября Qwen-Image-2.1 пришла как 7B генератор. В отличие от более ранних открытых Qwen моделей изображений, она только для исследований.

Через два дня, на Apsara 2026, Alibaba сказала, что Qwen 4 «именно в обучении». Она спрогнозировала Qwen 4.5 и Qwen 5 в 5 до 10 триллионов параметров. Дата, размеры и лицензия для Qwen 4 не были указаны.

Глава 6 — Экосистема и эволюция лицензирования

Доход Qwen рос быстрее, чем её параметры. В сентябре 2024 Alibaba сообщила о 40 миллионах загрузок и более 50 000 производных моделей. К марту 2026 года Reuters оценила в более 400 открытых моделей и более 1 миллиарда загрузок. Тот же доклад говорил, что Qwen приложение набрало 203 миллиона ежемесячных активных пользователей в феврале 2026 года.

На запуске Qwen3-Max-Thinking в январе 2026 года Alibaba также сказала, что Qwen стала первой открытой модельной семьёй с более чем 200 000 производных моделей на Hugging Face.

Лицензии рассказывают более тихую историю. Qwen шла от ограниченной, к открытой, к намеренному двухуровневому разделу.

Шаблон последователен. Маленькие и средние модели остаются перmissive, чтобы разработчики продолжали строить на Qwen. Передовой уровень зарабатывает выручку через Alibaba Cloud.

Каждая дата ниже связана с главами выше. Новые сначала.

Qwen началась как Tongyi Qianwen, закрытая корпоративная бета-версия, анонсированная 11 апреля 2023 года.

Открытые веса последовали быстро: Qwen-7B в августе 2023 года, Qwen-72B к концу того же года.

Qwen3 (апрель 2025) добавила гибридное мышление, 36T обучающих токенов и 119 языков под Apache 2.0.

2026 принёс 4 поколения за 6 месяцев (Qwen3.5 до Qwen3.8) и разделение открытого/проприетарного подхода.

Qwen 4 в обучении; график Alibaba ставит Qwen 4.5 и Qwen 5 в 5 до 10 триллионов параметров.

Блог Qwen и QwenLM на GitHub

Qwen Technical Report (arXiv 2309.16609)

Qwen2.5 Technical Report (arXiv 2412.15115)

Qwen3 Technical Report (arXiv 2505.09388)

Alibaba Cloud: 2026 Apsara Conference roadmap

Alibaba Group: Apsara Conference 2025

Подписывайтесь на наш канал Дзен и группу ВК

MarkTechPost

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *