Историята на Qwen: AI моделите на Alibaba от 7B до 2,4T
През април 2023 г. Alibaba Cloud представи чатбот, чието име приблизително означава „истината от хиляди въпроси“. Три години и половина по-късно неговият наследник се доставя с отворени тегла с 2,4 трилиона параметъра. Това е историята как Qwen стигна дотук, версия след версия.
Глава 1 — 2023 г.: хиляда въпроса
Alibaba предприе действия след ChatGPT, но не с много. На 7 април 2023 г. Alibaba Cloud започна да раздава кодове за покани на корпоративни клиенти за модел, наречен Tongyi Qianwen. Името отчасти е вдъхновено от философа Менций.
Четири дни по-късно, на срещата на върха на Alibaba Cloud в Пекин, тогавашният изпълнителен директор Даниел Джан го представи публично. Alibaba заяви, че ще внедри модела във всеки бизнес, започвайки с DingTalk и гласовия асистент Tmall Genie (China Daily).
Истинският поврат настъпи през август. На 3 август 2023 г. Alibaba предостави като отворен код Qwen-7B и Qwen-7B-Chat, пряк отговор на Llama 2 на Meta. Qwen-7B беше предварително обучен върху над 2,2 трилиона токена с контекст от 2 048 токена. Лицензът му беше безплатен за търговска употреба при под 100 милиона месечни потребители.
Зрението последва в рамките на седмици. Qwen-VL, първият клон за зрение и език, беше пуснат в края на август 2023 г.
На 13 септември 2023 г. Tongyi Qianwen стана достъпен за широката публика, което беше знак за регулаторно одобрение в Китай. През същия месец екипът публикува техническия доклад за Qwen в arXiv.
Годината завърши с мащабиране. Alibaba пусна за изтегляне своите модели 72B и 1.8B около 1 декември 2023 г. Qwen вече обхващаше от отворени тегла с размер за лаптопи до такива с мащаб на водещите модели.
Глава 2 — 2024 г.: машината за отворени тегла
2024 г. е годината, в която Qwen се превърна в стандартен избор за разработчиците. Екипът пусна 3 поколения за 8 месеца.
Qwen1.5 (февруари): На 5 февруари 2024 г. екипът пусна Qwen1.5, представен като бета версия на Qwen2. Той обхващаше плътни модели от 0.5B до 72B с стабилен контекст от 32K при всеки размер. Последва MoE модел 14B с 2.7B активни параметри. Появи се и плътен модел 110B, първият в семейството над 100B.
Qwen2 (юни): Екипът обяви Qwen2 в началото на юни 2024 г. в 5 размера — от 0.5B до 72B. Линията включваше Qwen2-57B-A14B, първия отворен водещ модел на екипа със смес от експерти. Данните за обучение добавиха 27 езика извън английския и китайския. Инструктивните модели 7B и 72B обработваха до 128K токена. Най-важна беше промяната в лицензирането: всички размери с изключение на 72B преминаха към Apache 2.0.
Специализираните модели се появиха през лятото. Qwen2-Math беше пуснат през август, заедно с Qwen2-Audio. Qwen2-VL последва в края на август и можеше да анализира видеоклипове с продължителност над 20 минути.
Qwen2.5 (септември): На конференцията Apsara на 19 септември 2024 г. Alibaba пусна над 100 модела с отворен код едновременно. Според техническия доклад за Qwen2.5 данните за предварително обучение са нараснали от 7 трилиона на 18 трилиона токена. Размерите варираха от 0.5B до 72B, с контекст от 128K и генериране на 8K токена.
Приемането вече беше реалност. Alibaba заяви, че моделите Qwen са надхвърлили 40 милиона изтегляния и са вдъхновили над 50 000 производни модела в Hugging Face.
Кодиране и разсъждение (ноември–декември): Qwen2.5-Coder излезе с пълното си семейство на 11 ноември 2024 г. След това се появи първият модел за разсъждение. QwQ-32B-Preview беше пуснат в края на ноември под Apache 2.0 като отворен конкурент на o1 на OpenAI. QVQ-72B-Preview, експериментален модел за визуално разсъждение, закри годината на 24 декември.
Глава 3 — началото на 2025 г.: отговорът на DeepSeek
Януари 2025 г. принадлежеше на DeepSeek-R1. Отговорът на Qwen дойде за седмици, а не за месеци.
На 26 януари екипът пусна Qwen2.5-VL в размери 3B, 7B и 72B. TechCrunch отбеляза, че той може да управлява компютри и телефони. Три дни по-късно, в първия ден на Лунната нова година, Alibaba пусна Qwen2.5-Max, широкомащабен MoE модел. Reuters съобщи твърдението на Alibaba, че той надминава DeepSeek-V3.
По-голямото заявление дойде на 6 март. QwQ-32B, изграден върху Qwen2.5-32B и обучен с подсилващо обучение, беше пуснат под Apache 2.0. Qwen заяви, че представянето му е сравнимо с това на DeepSeek-R1 — модел 671B. VentureBeat оцени разликата в хардуера на около 24 GB VRAM спрямо над 1 500 GB. Акциите на Alibaba в Хонконг поскъпнаха с над 7% същия ден.
Мултимодалността също не изостана. Qwen2.5-Omni-7B се появи на 26 март под Apache 2.0. Той приемаше като вход текст, изображения, аудио и видео и отговаряше с текст или реч. CNBC го представи като модел за рентабилни AI агенти.
Глава 4 — 2025 г.: Qwen3 и границата от трилион параметри
Qwen3 (април): На 29 април 2025 г. (пекинско време) екипът пусна Qwen3: 6 плътни модела от 0.6B до 32B и 2 MoE модела. Водещият модел беше Qwen3-235B-A22B с 22B активни параметри. Всеки модел беше пуснат под Apache 2.0.
Основната характеристика беше хибридното мислене. Един модел можеше да разсъждава стъпка по стъпка или да отговаря незабавно — превключването се извършваше от потребителя. Техническият доклад за Qwen3 посочва предварително обучение върху около 36 трилиона токена. Езиковото покритие нарасна от 29 на 119 езика и диалекта. TechCrunch го нарече семейство от „хибридни“ модели за разсъждение.
Обновяването 2507 (юли): На 21 юли 2025 г. Qwen отново раздели хибридното мислене. Qwen3-235B-A22B-Instruct-2507 беше пуснат като модел без мислене с естествен контекст от 262K. Последваха отделни контролни точки Thinking-2507 (колекцията в Hugging Face).
Агенти и изображения (юли–август): Qwen3-Coder-480B-A35B беше пуснат на 22 юли 2025 г. за агентно кодиране. Alibaba го комбинира с Qwen Code, агент за кодиране в терминал с отворен код (Computerworld). На 4 август екипът предостави като отворен код Qwen-Image, 20B MMDiT модел, създаден за изобразяване на текст в изображения.
Вариантът за редактиране Qwen-Image-Edit беше предоставен като отворен код на 18 август 2025 г.
Спринтът през септември: Qwen3-Max-Preview, първият модел Qwen с над 1 трилион параметри, се появи на 5 септември. За разлика от предишните водещи модели, той беше достъпен само чрез API.
Дни по-късно се появи Qwen3-Next-80B-A3B, залог върху архитектурата. Той комбинира линейно внимание Gated DeltaNet с gated attention в съотношение 3:1. В картата на модела се твърди, че разходите му за обучение са 10% от тези на Qwen3-32B, а пропускателната способност при извеждане е 10 пъти по-висока над 32K токена.
На 22 септември последваха Qwen3-Omni и Qwen3-VL. На Apsara на 24 септември Alibaba официално пусна Qwen3-Max. Изпълнителният директор Еди Ву заяви, че разходите ще надхвърлят 380 милиарда RMB (53 милиарда щатски долара), предвидени в тригодишния план за AI и облачни услуги.
До края на годината Qwen се беше превърнал в национална инфраструктура за други организации. През ноември 2025 г. AI Singapore заяви, че моделът му Sea-Lion ще премине от Llama към Qwen като своя основа.
Qwen се превърна и в потребителска марка. Приложението Qwen влезе в публична бета версия на 17 ноември 2025 г. Alibaba заяви, че е надхвърлило 10 милиона изтегляния през първата седмица.
Глава 5 — 2026 г.: 4 поколения за 6 месеца
Бърз старт (януари–февруари): На 26 януари 2026 г. Qwen пусна Qwen3-Max-Thinking, затворен модел за разсъждение. Qwen заяви, че той е сравним с GPT-5.2-Thinking, Claude Opus 4.5 и Gemini 3 Pro в 19 бенчмарка (TestingCatalog). Qwen3-Coder-Next, малък хибриден модел за агентно кодиране, последва на 2 февруари. Qwen-Image-2.0 обедини генерирането и редактирането в един модел на 10 февруари.
Qwen3.5 (февруари): На 16 февруари 2026 г., в навечерието на Лунната нова година, Alibaba представи Qwen3.5 за това, което нарече ерата на агентния AI. Отвореният Qwen3.5-397B-A17B активира 17B от 397B параметъра. Той работи с хибридната архитектура с линейно внимание, представена предварително от Qwen3-Next. Хостваният Qwen3.5-Plus добави контекст от 1 милион токена.
Средна серия последва на 24 февруари. Qwen заяви, че Qwen3.5-35B-A3B е надминал по-стария Qwen3-235B-A22B-2507. Малки модели за устройства се появиха на 2 март.
Промяна в ръководството (март): На 3 март техническият ръководител Джунъян Лин публикува, че се оттегля. Reuters съобщи, че той е третата високопоставена фигура в Qwen, напуснала през 2026 г. Ръководителят на дообучаването Ю Боуен също напусна, а ръководителят на кодиращото направление Хуей Бинюен се беше присъединил към Meta през януари (Yicai).
Според 36Kr причината е бил планът за разделяне на Qwen на екипи за хоризонтално предварително обучение, дообучаване и модалности. На 16 март Alibaba постави своите AI звена под нова група, ръководена от изпълнителния директор Еди Ву. Дотогава Alibaba беше пуснала над 400 отворени модела Qwen, изтеглени над 1 милиард пъти.
Qwen3.6 (април): Темпото не се забави. Qwen3.6-Plus беше пуснат на 2 април като собствен, хостван модел. Това съответстваше на по-широка промяна: SCMP съобщи, че китайските AI гиганти се насочват към собствени модели за генериране на приходи. Отвореното направление продължи да се развива. Qwen3.6-35B-A3B беше пуснат под Apache 2.0 на 16 април с насоченост към агентно кодиране.
Още два модела последваха в рамките на седмица. Qwen3.6-Max-Preview, затворен предварителен преглед на водещ модел, се появи на 20 април. На 22 април плътният Qwen3.6-27B беше пуснат под Apache 2.0. Qwen заяви, че е надминал Qwen3.5-397B-A17B в основни бенчмаркове за кодиране.
Qwen3.7 (май–юни): На срещата на върха на Alibaba Cloud на 20 май Alibaba представи Qwen3.7-Max, създаден за агентни задачи с дълъг хоризонт. Alibaba заяви, че Artificial Analysis го е класирал на пето място в света и на първо сред китайските модели. Qwen3.7-Plus последва в началото на юни на цена от 0,4/1,6 долара за 1 милион токена. И двата модела останаха затворени.
През юли CNBC съобщи, че Qwen ще бъде интегриран в Apple Intelligence в Китай.
Qwen3.8 (юли–август): Bloomberg съобщи за предварителен преглед на новия водещ модел на 19 юли. Хостваният Qwen3.8-Max беше пуснат в началото на август. На 12 август Alibaba предостави основата му като отворен код под името Qwen3.8-2.4T-A95B: 2,4 трилиона параметъра, от които 95B активни (Gigazine).
Лицензът имаше ново условие. Доставчиците, които печелят над 50 милиона щатски долара за 12 месеца, се нуждаят от търговски лиценз. Два дни по-късно Qwen3.8-27B беше пуснат под стандартния Apache 2.0. На 26 август Reuters отрази Qwen3.8-Flash. Неговият отворен брат Qwen3.8-Flash-Next беше представен като ранен предварителен преглед на архитектурата Qwen4.
Септември: На 20 септември Qwen-Image-2.1 се появи като генератор 7B. За разлика от по-ранните отворени модели за изображения на Qwen, той е предназначен само за изследователски цели.
Два дни по-късно, на Apsara 2026, Alibaba заяви, че Qwen 4 „в момента се обучава“. Компанията прогнозира Qwen 4.5 и Qwen 5 да достигнат от 5 до 10 трилиона параметъра. За Qwen 4 не бяха дадени дата, размери или лиценз.
Глава 6 — екосистемата и развитието на лицензите
Обхватът на Qwen нарасна по-бързо от броя на параметрите му. През септември 2024 г. Alibaba съобщи за 40 милиона изтегляния и над 50 000 производни модела. До март 2026 г. Reuters оцени броя на над 400 отворени модела и над 1 милиард изтегляния. В същия доклад се казваше, че приложението Qwen е достигнало 203 милиона месечно активни потребители през февруари 2026 г.
При пускането на Qwen3-Max-Thinking през януари 2026 г. Alibaba също заяви, че Qwen е станал първото семейство отворени модели с над 200 000 производни модела в Hugging Face.
Лицензите разказват по-тиха история. Qwen премина от ограничителен режим към отвореност, а след това към преднамерено двустепенно разделение.
| Период | Какво се промени | Пример |
|---|---|---|
| август 2023 г. | Специален лиценз, безплатен при под 100 млн. месечни потребители | Qwen-7B |
| юни 2024 г. | Повечето размери преминават към Apache 2.0; 72B запазва лиценза Qianwen | Qwen2 |
| април 2025 г. | Всеки отворен модел е под Apache 2.0 | Qwen3 |
| септември 2025 г. | Водещият модел става достъпен само чрез API | Qwen3-Max |
| април–юни 2026 г. | Нивата Plus и Max са собствени; моделите със среден размер са отворени | Qwen3.6, Qwen3.7-Plus |
| август 2026 г. | Теглата за 2.4T са отворени, с праг от 50 млн. щатски долара приходи | Qwen3.8-2.4T-A95B |
| септември 2026 г. | Моделът за изображения е с лиценз само за изследователски цели | Qwen-Image-2.1 |
Моделът е последователен. Малките и средните модели остават либерално лицензирани, за да продължат разработчиците да изграждат върху Qwen. Водещото ниво генерира приходи чрез Alibaba Cloud.
Хронология
Всяка дата по-долу е свързана в главите по-горе. Най-новите са първи.
Основни изводи
- Qwen започна като Tongyi Qianwen — бета версия само с покани за корпоративни клиенти, обявена на 11 април 2023 г.
- Отворените тегла се появиха бързо: Qwen-7B през август 2023 г., а Qwen-72B до края на същата година.
- Qwen3 (април 2025 г.) добави хибридно мислене, 36 трилиона токена за обучение и 119 езика под Apache 2.0.
- 2026 г. донесе 4 поколения за 6 месеца (от Qwen3.5 до Qwen3.8) и разделена стратегия с отворени и собствени модели.
- Qwen 4 се обучава; пътната карта на Alibaba предвижда Qwen 4.5 и Qwen 5 да достигнат от 5 до 10 трилиона параметъра.
Ресурси:
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.