Alltokens

Thinking Machines: Inkling Small (batch)

THThinkingmachinesОбновлено: 30 июля 2026 г.

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для пакетной обработки данных. Она поддерживает работу с текстом, изображениями и аудио, предлагая внушительное контекстное окно в 524 288 токенов для анализа сверхбольших объемов информации.

Использовать через API

Метрики

Вход

63 ₽/M

Выход

150 ₽/M

Контекст

524k tokens

Параметры

17

Релиз

30 июля 2026 г.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltystoptemperaturetool_choicetoolstop_ktop_logprobstop_p

Технический обзор

Inkling Small — это мультимодальная модель с открытым весом и архитектурой mixture-of-experts от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представляет собой более компактную и эффективную версию модели...

Кодинг
Инструменты
Длинный контекст
Мультимодальность
Веб-автоматизация

Смежные подборки

Сравнение с похожими моделями

Для чего

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для пакетной обработки данных. Она поддерживает работу с текстом, изображениями и аудио, предлагая внушительное контекстное окно в 524 288 токенов для анализа сверхбольших объемов информации.

Контекст

524k

Цена ₽

63 / 150

Для чего

Является стандартной версией той же модели для работы в режиме реального времени с идентичными параметрами генерации.

Контекст

1M

Цена ₽

56 / 150

Для чего

Старшая модель в линейке, доступная для бесплатного тестирования базовых мультимодальных возможностей.

Контекст

1M

Цена ₽

— / —

Когда выбирать

  • Необходима пакетная обработка больших массивов мультимодальных данных (текст, аудио, фото).
  • Требуется работа с очень длинными документами или логами благодаря контексту более 500k токенов.
  • Нужна высокая точность управления генерацией через расширенные параметры, такие как reasoning_effort и min_p.

Когда не выбирать

  • Требуется мгновенный ответ в чат-интерфейсе (batch-режим подразумевает задержку обработки).
  • Задача ограничена только простыми текстовыми запросами без использования мультимодальности.
  • Необходима максимальная мощность флагманских моделей для сложнейших научных вычислений.

FAQ

МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru