Alltokens

Qwen: Qwen3.8 2.4T A95B (batch)

QwenQwenОбновлено: 12 августа 2026 г.

Qwen3.8 2.4T A95B (batch) — это мощная разреженная модель Mixture-of-Experts с 95 миллиардами активных параметров и внушительным контекстным окном в 1 миллион токенов. Она представляет собой открытую версию флагманской архитектуры Qwen3.8 Max, оптимизированную для пакетной обработки сложных текстовых задач.

Использовать через API

Метрики

Вход

240 ₽/M

Выход

718 ₽/M

Контекст

1M tokens

Параметры

19

Релиз

12 августа 2026 г.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Технический обзор

Qwen3.8 2.4T A95B — это модель с открытыми весами, использующая разреженную смесь экспертов, разработанная Qwen. Она является вариантом Qwen3.8 Max с открытыми весами и содержит 95 миллиардов активных параметров из общего числа 2,4 триллиона. Модель предназначена для...

Кодинг
Инструменты
Длинный контекст
Мультимодальность
Веб-автоматизация

Смежные подборки

Сравнение с похожими моделями

Модель

Для чего

Qwen3.8 2.4T A95B (batch) — это мощная разреженная модель Mixture-of-Experts с 95 миллиардами активных параметров и внушительным контекстным окном в 1 миллион токенов. Она представляет собой открытую версию флагманской архитектуры Qwen3.8 Max, оптимизированную для пакетной обработки сложных текстовых задач.

Контекст

1M

Цена ₽

240 / 718

Для чего

Идентичная архитектура и количество параметров, но стандартная версия работает в режиме реального времени, в то время как batch-версия предназначена для отложенной обработки данных.

Контекст

1M

Цена ₽

240 / 718

Модель

Для чего

Сопоставимая производительность в текстовых задачах и аналогичный уровень сложности архитектуры для корпоративных решений.

Контекст

131k

Цена ₽

359 / 718

Для чего

Предшествующая флагманская модель в линейке Qwen, предлагающая высокую точность, но уступающая новой версии в объеме контекста и сложности MoE-структуры.

Контекст

262k

Цена ₽

123 / 737

Когда выбирать

  • Необходимость обработки огромных массивов данных с контекстом до 1 миллиона токенов.
  • Задачи, требующие использования открытых весов (open-weight) для глубокой интеграции.
  • Сценарии пакетной обработки текстов, где не требуется мгновенный ответ в режиме чата.

Когда не выбирать

  • Приложения, требующие минимальной задержки ответа (latency) в реальном времени.
  • Простые задачи, где использование модели с 2.4 триллионами параметров будет избыточным.
  • Работа с мультимодальным контентом, так как модель поддерживает только текстовый ввод.

FAQ

МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru