Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← К новостям

StepFun выпустила предварительную версию Step 5: MoE-модель с 600 млрд. параметров всего и 27 млрд. активных, контекстом 1 млн токенов для долгосрочной агентной работы

StepFun выпустила Step 5 Preview — свою новую флагманскую модель для агентной работы. Целевые сценарии использования — разработка программного обеспечения, профессиональная интеллектуальная работа и финансы. Главный аргумент — стоимость. Команда StepFun заявляет, что модель обеспечивает сопоставимый уровень интеллекта при значительно более низкой стоимости выполнения задач. Именно это подразумевается под формулировкой «граница Парето» в заголовке запуска.

Можно ли её развернуть? Да, в виде размещаемого API и на платформе StepFun. Возможность самостоятельного развёртывания появится после публикации открытых весов. StepFun сообщает, что открытые веса будут опубликованы 15 октября 2026 года. Простые расчёты показывают, что для 600 млрд параметров требуется около 1,2 ТБ в BF16 без учёта KV-кэша. После публикации весов рассчитывайте на серверное оборудование с несколькими GPU.

Что выпустила StepFun

Step 5 Preview — разреженная модель Mixture-of-Experts (MoE). Она содержит около 600 млрд общих параметров и активирует около 27 млрд параметров на токен. Это примерно 4,5% весов на токен.

В официальной документации модели указаны следующие характеристики:

  • Идентификатор модели: step-5-preview
  • Контекстное окно: 1 млн токенов
  • Ввод: текст, изображения и видео
  • Вывод: текст
  • Уровень рассуждений: low, medium и high
  • Потоковая передача, вызов инструментов, JSON Mode, JSON Schema и кэширование промптов

Для исследовательских задач команда StepFun заявляет, что модель скоординировала 950 веб-запросов в рамках одного действия агента. Команда StepFun также документирует интеграцию с Claude Code через Step Plan.

Архитектура: узкая и глубокая

StepFun не стала расширять сеть. Согласно Pandaily, она объединила 92 слоя Transformer в узкой и глубокой архитектуре. Исследовательская команда утверждает, что более глубокие стеки обеспечивают более длинные пути для неявного многошагового рассуждения. Это важно во время длительного предварительного заполнения контекста, когда агенты выполняют поиск, запускают код и читают результаты работы инструментов.

В обучении активно используется обучение с подкреплением на основе политики с длинным горизонтом. StepFun упоминает побитово согласованные обучение и инференс при маршрутизации MoE. Среди других перечисленных методов — спекулятивное декодирование MTP-3, FP8 MoE и выгрузка KV-кэша. StepFun сообщает о более чем трёхкратном ускорении сквозного выполнения для обучения с подкреплением с длинным горизонтом.

Интерактивное объяснение

Бенчмарки: данные компании и независимая оценка

Step 5 Preview работала с высоким уровнем усилий, тогда как конкуренты — с максимальным.

StepFun сообщает следующие результаты, по данным RuntimeWire:

БенчмаркStep 5 PreviewClaude Opus 5GPT-6 Astra
FrontierFinance66.469.755
DRACO83.387.676.8

В задачах программирования StepFun сообщает результат 67.7 на DeepSWE v1.1, 49.0 на StepCodeBench и 80.5 на ProgramBench. GPT-6 Astra и Claude Opus 5 опережают её по всем трём показателям. StepCodeBench — собственный бенчмарк StepFun.

StepFun также провела 2 агентных эксперимента продолжительностью по 24 часа каждый. В первом модель оптимизировала ядро H100 до 508 TFLOPS против 493 у Claude Opus 5. Во втором она повысила результат Qwen3-30B-A3B на AIME24 с 53,3% до 60% посредством автоматизированного дообучения.

Независимую проверку провела Artificial Analysis. Она оценила Step 5 Preview в 44 балла по своему индексу интеллекта. Медианное значение для моделей рассуждений в сопоставимой ценовой категории составляет 24. На API StepFun была измерена скорость вывода 99,8 токена в секунду.

Стоимость

Тарифы API StepFun за 1 млн токенов:

Тип токеновЦена
Ввод, промах кэша$1.00
Ввод, попадание в кэш$0.05
Вывод, включая рассуждения$2.70

По данным Artificial Analysis, медианные значения для сопоставимых моделей составляют $1.88 за ввод и $10.00 за вывод. Есть один нюанс. Во время запуска индекса модель сгенерировала 160 млн выходных токенов против медианного значения в 92 млн. Многословные рассуждения частично нивелируют экономию на стоимости токена.

Ключевые выводы

  • StepFun Step 5 Preview — модель MoE с 600 млрд общих и 27 млрд активных параметров.
  • Она поддерживает контекст в 1 млн токенов, а также ввод текста, изображений и видео.
  • Стоимость API составляет $1.00 за 1 млн входных токенов и $2.70 за 1 млн выходных токенов.
  • Artificial Analysis оценивает её в 44 балла по своему индексу интеллекта.
  • Публикация открытых весов запланирована на 15 октября 2026 года.

Часто задаваемые вопросы

  1. Что такое Step 5 Preview? Это флагманская модель MoE от StepFun для агентного программирования, интеллектуальной работы и финансовых задач.
  2. Имеет ли Step 5 Preview открытые веса? Пока нет. StepFun планирует опубликовать открытые веса 15 октября 2026 года.
  3. Каков размер контекстного окна? 1 млн токенов, согласно документации StepFun.
  4. Сколько это стоит? $1.00 за 1 млн входных токенов и $2.70 за 1 млн выходных токенов.

Ознакомьтесь с разделом «Технические детали». Все заслуги принадлежат исследователю этого проекта. Также подписывайтесь на нас в Twitter и не забудьте присоединиться к нашему сабреддиту по машинному обучению с более чем 150 тыс. участников и подписаться на нашу рассылку. Постойте! Вы есть в Telegram? теперь вы также можете присоединиться к нам в Telegram.

Хотите сотрудничать с нами для продвижения своего репозитория GitHub, страницы Hugging Face, выпуска продукта, вебинара и т. д.? Свяжитесь с нами

Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

Впервые опубликовано изданием MarkTechPost

Читать оригинал на MarkTechPost ↗

Текст и изображения принадлежат MarkTechPost и приводятся здесь с указанием авторства и ссылкой на оригинальную публикацию.

← К новостям

Ещё новости

Все последние новости