История Qwen: ИИ-модели Alibaba от 7B до 2,4T
В апреле 2023 года Alibaba Cloud продемонстрировала чат-бота, название которого примерно означает «истина из тысячи вопросов». Три с половиной года спустя его преемник выпускается с открытыми весами и 2,4 триллиона параметров. Это история того, как Qwen прошёл этот путь — от релиза к релизу.
Глава 1 — 2023 год: тысяча вопросов
Alibaba начала действовать после ChatGPT, но ненамного позже. 7 апреля 2023 года Alibaba Cloud начала раздавать коды приглашений корпоративным клиентам для модели под названием Tongyi Qianwen. Название частично отсылает к философу Мэн-цзы.
Четыре дня спустя на саммите Alibaba Cloud в Пекине тогдашний генеральный директор Дэниел Чжан представил её публике. Alibaba заявила, что внедрит модель во все направления бизнеса, начав с DingTalk и голосового помощника Tmall Genie (China Daily).
Настоящий поворот произошёл в августе. 3 августа 2023 года Alibaba открыла исходный код Qwen-7B и Qwen-7B-Chat — прямого ответа на Llama 2 от Meta. Qwen-7B предварительно обучалась на более чем 2,2 триллиона токенов с контекстом в 2048 токенов. Её лицензия разрешала бесплатное коммерческое использование при аудитории менее 100 миллионов пользователей в месяц.
Через несколько недель появилась работа с изображениями. Qwen-VL, первая ветвь для работы с визуальными данными и языком, вышла в конце августа 2023 года.
13 сентября 2023 года Tongyi Qianwen стала доступна широкой публике, что свидетельствовало о получении одобрения китайских регуляторов. В том же месяце команда опубликовала на arXiv технический отчёт Qwen.
Год завершился наращиванием масштабов. Примерно 1 декабря 2023 года Alibaba выпустила модели 72B и 1.8B для скачивания. Теперь Qwen охватывала весь диапазон — от моделей размером с ноутбук до моделей с открытыми весами уровня передовых систем.
Глава 2 — 2024 год: машина с открытыми весами
2024 год стал периодом, когда Qwen превратилась в стандартный выбор разработчиков. За 8 месяцев команда выпустила 3 поколения.
Qwen1.5 (февраль): 5 февраля 2024 года команда выпустила Qwen1.5, представленную как бета-версию Qwen2. Она включала плотные модели от 0.5B до 72B со стабильным контекстом в 32K для каждого размера. Затем появилась MoE-модель 14B с 2,7B активных параметров. Также вышла плотная модель 110B — первая в семействе с числом параметров более 100B.
Qwen2 (июнь): В начале июня 2024 года команда анонсировала Qwen2 в 5 вариантах размера — от 0.5B до 72B. В линейку вошла Qwen2-57B-A14B, первая открытая флагманская модель с архитектурой mixture-of-experts. В обучающие данные добавили 27 языков помимо английского и китайского. Инструкционные модели 7B и 72B поддерживали до 128K токенов. Однако важнее всего был сдвиг в лицензировании: все размеры, кроме 72B, перешли на Apache 2.0.
Летом появились специализированные модели. Qwen2-Math вышла в августе вместе с Qwen2-Audio. В конце августа последовала Qwen2-VL, способная анализировать видео продолжительностью более 20 минут.
Qwen2.5 (сентябрь): 19 сентября 2024 года на конференции Apsara Alibaba одновременно выпустила более 100 моделей с открытым исходным кодом. Согласно техническому отчёту Qwen2.5, объём данных для предварительного обучения вырос с 7 до 18 триллионов токенов. Размеры варьировались от 0.5B до 72B, контекст составлял 128K, а генерация — до 8K токенов.
Модель уже реально внедрялась. Alibaba заявила, что модели Qwen превысили показатель в 40 миллионов скачиваний и вдохновили создание более 50 000 производных моделей на Hugging Face.
Кодирование и рассуждения (ноябрь–декабрь): Qwen2.5-Coder в полном составе вышла 11 ноября 2024 года. Затем появилась первая модель для рассуждений. QwQ-32B-Preview вышла в конце ноября под лицензией Apache 2.0 как открытый конкурент o1 от OpenAI. QVQ-72B-Preview, экспериментальная модель для визуальных рассуждений, завершила год 24 декабря.
Глава 3 — начало 2025 года: ответ DeepSeek
Январь 2025 года прошёл под знаком DeepSeek-R1. Qwen ответила через недели, а не месяцы.
26 января команда выпустила Qwen2.5-VL в вариантах 3B, 7B и 72B. TechCrunch отметил, что она могла управлять компьютерами и телефонами. Три дня спустя, в первый день лунного Нового года, Alibaba запустила Qwen2.5-Max, крупную MoE-модель. Reuters сообщил о заявлении Alibaba, что она превзошла DeepSeek-V3.
Более весомое заявление прозвучало 6 марта. QwQ-32B, созданная на основе Qwen2.5-32B и обученная с использованием обучения с подкреплением, вышла под лицензией Apache 2.0. Qwen заявила о сопоставимой с DeepSeek-R1 производительности, хотя DeepSeek-R1 — модель на 671B параметров. VentureBeat оценил разрыв в требованиях к оборудованию как примерно 24 ГБ видеопамяти против более чем 1500 ГБ. В тот день гонконгские акции Alibaba выросли более чем на 7%.
Мультимодальность не отставала. Qwen2.5-Omni-7B вышла 26 марта под лицензией Apache 2.0. Она принимала на вход текст, изображения, аудио и видео, а отвечала текстом или речью. CNBC представил её как модель для экономичных ИИ-агентов.
Глава 4 — 2025 год: Qwen3 и рубеж в триллион параметров
Qwen3 (апрель): 29 апреля 2025 года (по пекинскому времени) команда выпустила Qwen3: 6 плотных моделей от 0.6B до 32B и 2 MoE-модели. Флагманом стала Qwen3-235B-A22B с 22B активных параметров. Все модели вышли под лицензией Apache 2.0.
Ключевой особенностью стало гибридное мышление. Одна модель могла рассуждать пошагово или отвечать мгновенно — режим переключал пользователь. В техническом отчёте Qwen3 указано, что предварительное обучение проводилось примерно на 36 триллионах токенов. Языковой охват вырос с 29 до 119 языков и диалектов. TechCrunch назвал её семейством «гибридных» моделей для рассуждений.
Обновление 2507 (июль): 21 июля 2025 года Qwen снова разделила гибридное мышление на отдельные режимы. Qwen3-235B-A22B-Instruct-2507 вышла как модель без режима рассуждений с нативным контекстом в 262K. Затем появились отдельные контрольные точки Thinking-2507 (коллекция Hugging Face).
Агенты и изображения (июль–август): Qwen3-Coder-480B-A35B вышла 22 июля 2025 года для агентного кодирования. Alibaba дополнила её Qwen Code — агентом для написания кода в терминале с открытым исходным кодом (Computerworld). 4 августа команда открыла исходный код Qwen-Image — модели 20B MMDiT, предназначенной для генерации текста внутри изображений.
Вариант для редактирования, Qwen-Image-Edit, получил открытый исходный код 18 августа 2025 года.
Сентябрьский спринт: Qwen3-Max-Preview, первая модель Qwen с более чем 1 триллионом параметров, появилась 5 сентября. В отличие от прежних флагманов, она была доступна только через API.
Через несколько дней появилась Qwen3-Next-80B-A3B — ставка на новую архитектуру. Она сочетала линейное внимание Gated DeltaNet с gated attention в соотношении 3:1. В карточке модели заявлены 10% от стоимости обучения Qwen3-32B и десятикратная пропускная способность при инференсе после 32K токенов.
22 сентября последовали Qwen3-Omni и Qwen3-VL. 24 сентября на конференции Apsara Alibaba официально представила Qwen3-Max. Генеральный директор Эдди Ву заявил, что расходы превысят 380 миллиардов юаней (53 миллиарда долларов США), предусмотренных трёхлетним планом развития ИИ и облачных технологий.
К концу года Qwen стала национальной инфраструктурой для других компаний. В ноябре 2025 года AI Singapore заявила, что её модель Sea-Lion перейдёт с Llama на Qwen в качестве базовой модели.
Qwen также превратилась в потребительский бренд. Приложение Qwen вышло в публичную бета-версию 17 ноября 2025 года. Alibaba заявила, что за первую неделю оно превысило отметку в 10 миллионов скачиваний.
Глава 5 — 2026 год: 4 поколения за 6 месяцев
Быстрый старт (январь–февраль): 26 января 2026 года Qwen выпустила Qwen3-Max-Thinking — закрытую модель для рассуждений. Qwen заявила, что по 19 тестам она сопоставима с GPT-5.2-Thinking, Claude Opus 4.5 и Gemini 3 Pro (TestingCatalog). 2 февраля последовала Qwen3-Coder-Next — небольшая гибридная модель для агентного кодирования. Qwen-Image-2.0 объединила генерацию и редактирование в одной модели 10 февраля.
Qwen3.5 (февраль): 16 февраля 2026 года, в канун лунного Нового года, Alibaba представила Qwen3.5 для так называемой эры агентного ИИ. Открытая Qwen3.5-397B-A17B активирует 17B из 397B параметров. Она работает на архитектуре с гибридным линейным вниманием, впервые представленной в Qwen3-Next. Размещённая в облаке Qwen3.5-Plus получила контекст в 1 миллион токенов.
Средняя серия последовала 24 февраля. Qwen заявила, что Qwen3.5-35B-A3B превзошла более старую Qwen3-235B-A22B-2507. Небольшие модели для устройств появились 2 марта.
Перестановки в руководстве (март): 3 марта технический руководитель Цзюньян Линь сообщил, что уходит со своей должности. Reuters написал, что он был третьей ключевой фигурой Qwen, покинувшей компанию в 2026 году. Руководитель постобучения Юй Бовэнь также ушёл, а руководитель направления кодирования Хуэй Биньюань в январе присоединился к Meta (Yicai).
Согласно 36Kr, причиной стал план разделить Qwen на команды горизонтального предварительного обучения, постобучения и модальностей. 16 марта Alibaba передала свои подразделения ИИ под управление новой группы во главе с генеральным директором Эдди Ву. К тому моменту Alibaba выпустила более 400 открытых моделей Qwen, которые скачали свыше 1 миллиарда раз.
Qwen3.6 (апрель): Темп не замедлился. 2 апреля Qwen3.6-Plus вышла как проприетарная модель, доступная через облако. Это соответствовало более широкому сдвигу: SCMP сообщила, что китайские гиганты ИИ переходят к проприетарным моделям ради получения дохода. Открытое направление продолжило развиваться. Qwen3.6-35B-A3B вышла под лицензией Apache 2.0 16 апреля с ориентацией на агентное кодирование.
В течение следующей недели появились ещё две модели. Qwen3.6-Max-Preview, предварительная версия закрытого флагмана, вышла 20 апреля. 22 апреля плотная Qwen3.6-27B вышла под лицензией Apache 2.0. Qwen заявила, что она превзошла Qwen3.5-397B-A17B в основных тестах на кодирование.
Qwen3.7 (май–июнь): 20 мая на саммите Alibaba Cloud Alibaba представила Qwen3.7-Max, разработанную для агентных задач с длинным горизонтом планирования. Alibaba заявила, что Artificial Analysis поставила её на пятое место в мире и на первое среди китайских моделей. Qwen3.7-Plus последовала в начале июня по цене 0,4/1,6 доллара за 1 миллион токенов. Обе модели остались закрытыми.
В июле CNBC сообщил, что Qwen будет интегрирована в Apple Intelligence в Китае.
Qwen3.8 (июль–август): Bloomberg сообщил о предварительной версии нового флагмана 19 июля. Размещённая в облаке Qwen3.8-Max вышла в начале августа. 12 августа Alibaba открыла исходный код её базовой версии — Qwen3.8-2.4T-A95B: 2,4 триллиона параметров, из которых 95B активны (Gigazine).
В лицензии появилось новое ограничение. Провайдерам, зарабатывающим более 50 миллионов долларов США за 12 месяцев, требуется коммерческая лицензия. Два дня спустя Qwen3.8-27B вышла под обычной лицензией Apache 2.0. 26 августа Reuters рассказал о Qwen3.8-Flash. Её открытая родственница Qwen3.8-Flash-Next была представлена как ранний предварительный вариант архитектуры Qwen4.
Сентябрь: 20 сентября Qwen-Image-2.1 вышла как генератор 7B. В отличие от прежних открытых моделей Qwen для работы с изображениями, она предназначена только для исследовательского использования.
Два дня спустя, на конференции Apsara 2026, Alibaba заявила, что Qwen 4 «в настоящее время обучается». Компания прогнозирует для Qwen 4.5 и Qwen 5 от 5 до 10 триллионов параметров. Для Qwen 4 не были названы ни дата выхода, ни размеры, ни лицензия.
Глава 6 — экосистема и развитие лицензирования
Охват Qwen рос быстрее, чем число её параметров. В сентябре 2024 года Alibaba сообщила о 40 миллионах скачиваний и более чем 50 000 производных моделей. К марту 2026 года Reuters оценивал показатели в более чем 400 открытых моделей и свыше 1 миллиарда скачиваний. В том же материале сообщалось, что приложение Qwen достигло 203 миллионов активных пользователей в месяц в феврале 2026 года.
Во время запуска Qwen3-Max-Thinking в январе 2026 года Alibaba также заявила, что Qwen стала первым семейством открытых моделей с более чем 200 000 производных моделей на Hugging Face.
Лицензии рассказывают менее заметную историю. Qwen прошла путь от ограничительной лицензии через открытое лицензирование к осознанному разделению на два уровня.
| Период | Что изменилось | Пример |
|---|---|---|
| Август 2023 | Собственная лицензия, бесплатное использование при аудитории менее 100 млн пользователей в месяц | Qwen-7B |
| Июнь 2024 | Большинство размеров переходят на Apache 2.0; для 72B сохраняется лицензия Qianwen | Qwen2 |
| Апрель 2025 | Все открытые модели выпускаются под Apache 2.0 | Qwen3 |
| Сентябрь 2025 | Флагман становится доступен только через API | Qwen3-Max |
| Апрель–июнь 2026 | Уровни Plus и Max становятся проприетарными; модели среднего размера остаются открытыми | Qwen3.6, Qwen3.7-Plus |
| Август 2026 | Веса 2.4T открыты, но действует порог дохода в 50 млн долларов США | Qwen3.8-2.4T-A95B |
| Сентябрь 2026 | Модель для работы с изображениями выпускается по лицензии только для исследований | Qwen-Image-2.1 |
Закономерность очевидна. Малые и средние модели остаются свободными, чтобы разработчики продолжали создавать решения на базе Qwen. Доход от передового уровня Alibaba получает через Alibaba Cloud.
Хронология
Все даты ниже связаны со ссылками в главах выше. Сначала новые.
Основные выводы
- Qwen начиналась как Tongyi Qianwen — бета-версия для предприятий с доступом по приглашениям, представленная 11 апреля 2023 года.
- Открытые веса появились быстро: Qwen-7B в августе 2023 года, Qwen-72B — к концу того же года.
- Qwen3 (апрель 2025 года) добавила гибридное мышление, 36 триллионов токенов для обучения и 119 языков под лицензией Apache 2.0.
- В 2026 году за 6 месяцев вышли 4 поколения (от Qwen3.5 до Qwen3.8), а стратегия разделилась на открытую и проприетарную.
- Qwen 4 находится в процессе обучения; согласно планам Alibaba, Qwen 4.5 и Qwen 5 получат от 5 до 10 триллионов параметров.
Ресурсы:
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.