Qwen3.8-Omni-Flash снижает цену Google Gemini Flash, сопоставляясь с ним в мультимодальных бенчмарках
Qwen3.8-Omni-Flash — первая мультимодальная модель Qwen, созданная для ИИ-агентов. Она одновременно обрабатывает аудио и видео, делает выводы и самостоятельно использует инструменты для монтажа видеоблогов, перевода коротких видео или создания кратких пересказов фильмов. Контекстное окно вмещает один миллион токенов. По словам Qwen, в задачах с аудио и видео модель почти не уступает Gemini 3.8 Flash.

Стоимость использования API составляет $0,15 за миллион входных токенов и $0,47 за миллион выходных токенов. По оценке Qwen, обработка аудио стоит менее $0,01 в час, а видео в разрешении 720p со звуком и частотой один кадр в секунду — около $0,20, без учета стоимости ответов. Для сравнения, Gemini 3.8 Flash на ввод и вывод взимает соответственно $0,75 и $3,75 за миллион токенов по стартовым тарифам; 1 января 2027 года цены должны удвоиться.
Модель доступна через Qwen Studio, Qwen Cloud и API. Открытый исходный код Qwen-MM-Plugins добавляет к таким агентам, как Claude Code, Gemini CLI и Qwen Code, функции редактирования видео, распознавания говорящих, создания заметок к видео в формате PDF и повторно используемых рабочих процессов. Qwen-Live Harness обеспечивает взаимодействие в реальном времени с помощью камеры и микрофона.
Новости ИИ без хайпа — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать статьи без рекламы, получать еженедельную рассылку об ИИ и наш эксклюзивный отраслевой отчет «AI Radar» шесть раз в год, иметь полный доступ к архиву и возможность оставлять комментарии.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.