Alltokens

Thinking Machines: Inkling Small

THThinkingmachinesОбновлено: 30 июля 2026 г.

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, использующая 12 миллиардов активных параметров. Она поддерживает обработку текста, изображений и аудио, предлагая внушительное контекстное окно объемом более 500 тысяч токенов.

Использовать через API

Метрики

Вход

70 ₽/M

Выход

173 ₽/M

Контекст

524k tokens

Параметры

14

Релиз

30 июля 2026 г.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyseedstoptemperaturetop_ktop_p

Технический обзор

Inkling Small — это мультимодальная модель с открытым весом и архитектурой mixture-of-experts от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представлена как более компактная и эффективная версия модели.

Кодинг
Инструменты
Длинный контекст
Мультимодальность
Веб-автоматизация

Смежные подборки

Сравнение с похожими моделями

Модель

Для чего

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, использующая 12 миллиардов активных параметров. Она поддерживает обработку текста, изображений и аудио, предлагая внушительное контекстное окно объемом более 500 тысяч токенов.

Контекст

524k

Цена ₽

70 / 173

Для чего

Старшая версия в линейке с аналогичной мультимодальностью, но более высокими требованиями к ресурсам.

Контекст

1M

Цена ₽

120 / 485

Для чего

Сопоставимая производительность в обработке текста и изображений при схожем позиционировании на рынке.

Контекст

262k

Цена ₽

60 / 180

Для чего

Конкурирующая компактная модель, ориентированная на высокую скорость работы и эффективность.

Контекст

131k

Цена ₽

84 / 168

Когда выбирать

  • Необходима одновременная обработка текста, аудио и визуальных данных в рамках одного запроса
  • Требуется работа с огромными объемами информации благодаря контекстному окну в 524k токенов
  • Нужна сбалансированная модель с архитектурой MoE для оптимизации вычислительных затрат

Когда не выбирать

  • Требуется максимально возможная точность, доступная только в полноразмерной версии Inkling
  • Задачи ограничены исключительно текстовым форматом без необходимости мультимодальности
  • Необходима поддержка специфических файловых форматов, не входящих в стандартный набор модальностей

FAQ

МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru