Alltokens

Мультимодальные AI-модели (текст, изображения, аудио, видео)

В этой группе собраны модели, которые умеют работать не только с текстом, но и с изображениями, аудио или видео. Это основа для мультимодальных ассистентов.

Моделей в подборке

60

Средняя цена (вход)

143 ₽/M

Макс. контекст

2.0M

Модели

alltokens

Auto Router

Рассуждения

Ваш запрос будет обработан мета-моделью и направлен в одну из десятков доступных моделей для достижения наилучшего результата. Чтобы узнать, какая именно модель была использована, проверьте историю активности или атрибут model в ответе API. Стоимость запроса соответствует тарифу выбранной модели. Вы можете настроить список моделей для маршрутизации в документации. Запросы направляются в следующие модели: - anthropic/claude-haiku-4.5 - anthropic/claude-opus-4.6 - anthropic/claude-sonnet-4.5 - deepseek/deepseek-r1 - google/gemini-2.5-flash-lite - google/gemini-3-flash-preview - google/gemini-3-pro-preview - meta-llama/llama-3.3-70b-instruct - mistralai/codestral-2508 - mistralai/mistral-large - mistralai/mistral-medium-3.1 - mistralai/mistral-small-3.2-24b-instruct-2506 - moonshotai/kimi-k2-thinking - moonshotai/kimi-k2.5 - openai/gpt-5 - openai/gpt-5-mini - openai/gpt-5-nano - openai/gpt-5.1 - openai/gpt-5.2 - openai/gpt-5.2-pro - openai/gpt-oss-120b - perplexity/sonar - qwen/qwen3-235b-a22b - x-ai/grok-3 - x-ai/grok-3-mini - x-ai/grok-4

от Контекст 2.00MБесплатновхБесплатновых
meta

Meta: Muse Spark 1.2 Contributor

РассужденияНовая

Muse Spark 1.2 contributor tier — это модель рассуждения от Meta, предназначенная для разработчиков, которые хотят начать создавать проекты с еще меньшими затратами. Она значительно дешевле, чем Muse Spark...

от Контекст 1.05M13 ₽/Mвх25 ₽/Mвых
google

Google: Gemini 3.7 Flash

Рассуждения

Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.

от Контекст 1.05M24 ₽/Mвх117 ₽/Mвых
google

Google: Gemini 3.7 Flash (batch)

Рассуждения

Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.

от Контекст 1.05M24 ₽/Mвх117 ₽/Mвых
meta

Meta: Muse Spark 1.2

Рассуждения

Muse Spark 1.2 — это модель рассуждения от Meta, предназначенная для выполнения сложных агентных задач. Она принимает текст, изображения, видео, аудио и PDF-документы, возвращает текст и поддерживает контекст объемом до 1 миллиона токенов.

от Контекст 1.05M150 ₽/Mвх509 ₽/Mвых
google

Google: Gemini 3.6 Flash (batch)

Рассуждения

Gemini 3.6 Flash — это высокоэффективная модель от Google, предназначенная для программирования, агентных рабочих процессов, а также разработки веб-сайтов и приложений. Модель создана для генерации качественных результатов с минимальным количеством лишних правок и...

от Контекст 1.05M45 ₽/Mвх225 ₽/Mвых
google

Google: Gemini 3.6 Flash

Рассуждения

Gemini 3.6 Flash — это высокоэффективная модель от Google, предназначенная для программирования, агентных рабочих процессов, а также разработки веб-сайтов и приложений. Модель создана для генерации качественных результатов с минимальным количеством лишних правок и...

от Контекст 1.05M45 ₽/Mвх225 ₽/Mвых
google

Google: Gemini 3.5 Flash Lite (batch)

Рассуждения

Gemini 3.5 Flash Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих специализированные задачи в рамках сложных многоагентных рабочих процессов.

от Контекст 1.05M19 ₽/Mвх156 ₽/Mвых
google

Google: Gemini 3.5 Flash Lite

Рассуждения

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих специализированные задачи в рамках сложных многоагентных рабочих процессов.

от Контекст 1.05M19 ₽/Mвх156 ₽/Mвых
meta

Meta: Muse Spark 1.1

Рассуждения

Muse Spark 1.1 — это мультимодальная модель рассуждений от Meta, разработанная для выполнения агентных задач. Она принимает на вход текст, изображения, видео, аудио и PDF-документы и возвращает текст, поддерживая контекст до 1 миллиона токенов.

от Контекст 1.05M150 ₽/Mвх509 ₽/Mвых
google

Google: Gemini 3.5 Flash (batch)

Рассуждения

Gemini 3.5 Flash — это высокоэффективная мультимодальная модель от Google, обеспечивающая уровень программирования и рассуждений, близкий к профессиональному, с высокой скоростью и эффективностью. Модель оптимизирована для высокой производительности в программировании и параллельном агентном выполнении задач.

от Контекст 1.05M90 ₽/Mвх539 ₽/Mвых
google

Google: Gemini 3.5 Flash

Рассуждения

Gemini 3.5 Flash is Google's high-efficiency multimodal model, bringing near-Pro level coding and reasoning at Flash-tier cost and speed. It is highly optimized for coding proficiency and parallel agentic execution...

от Контекст 1.05M90 ₽/Mвх539 ₽/Mвых
google

Google: Gemini 3.1 Flash Lite (batch)

Рассуждения

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google, оптимизированная для задач с низкой задержкой и высокой нагрузкой. Она поддерживает ввод текста, изображений, видео, аудио и PDF, и предназначена для легковесных агентских приложений.

от Контекст 1.05M16 ₽/Mвх94 ₽/Mвых
google

Google: Gemini 3.1 Flash Lite

Рассуждения

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google с общедоступным выпуском, оптимизированная для задач с низкой задержкой и высокой нагрузкой. Модель поддерживает ввод текста, изображений, видео, аудио и PDF, и предназначена для использования в легких агентских приложениях.

от Контекст 1.05M16 ₽/Mвх94 ₽/Mвых
google

Google: Gemini 3.1 Flash Lite Preview

Рассуждения

Gemini 3.1 Flash Lite Preview — это высокоэффективная модель Google, оптимизированная для задач с высоким объемом использования. Она превосходит Gemini 2.5 Flash Lite по общему качеству и приближается к производительности Gemini 2.5 Flash по ключевым возможностям. Улучшения охватывают аудиовход/ASR, ранжирование фрагментов RAG, перевод, извлечение данных и завершение кода. Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для точной настройки компромисса между стоимостью и производительностью. Стоит в два раза дешевле Gemini 3 Flash.

от Контекст 1.05M16 ₽/Mвх94 ₽/Mвых
google

Google: Gemini 3.1 Pro Preview Custom Tools

Рассуждения

Gemini 3.1 Pro Preview Custom Tools — это специализированная версия модели Gemini 3.1 Pro, в которой оптимизирован механизм выбора инструментов. Модель реже использует стандартный bash-инструмент в тех случаях, когда доступны более эффективные сторонние или пользовательские функции. Этот предварительный эндпоинт на alltokens значительно повышает надежность вызова функций и гарантирует, что модель выберет наиболее подходящий инструмент в сценариях с кодинг-агентами и сложными рабочими процессами, включающими множество инструментов. Модель сохраняет все ключевые преимущества Gemini 3.1 Pro, включая мультимодальное рассуждение при работе с текстом, изображениями, видео, аудио и кодом, контекстное окно объемом 1 миллион токенов и высокую производительность в задачах разработки программного обеспечения.

от Контекст 1.05M230 ₽/Mвх1 380 ₽/Mвых
google

Google: Gemini 3.1 Pro Preview (batch)

Рассуждения

Gemini 3.1 Pro Preview — это передовая модель рассуждений от Google, обеспечивающая улучшенную производительность в области программной инженерии, повышенную надежность агентов и более эффективное использование токенов в сложных рабочих процессах. Модель основана на мультимодальной платформе...

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
google

Google: Gemini 3.1 Pro Preview

Рассуждения

Gemini 3.1 Pro Preview — это передовая модель Google с расширенными возможностями рассуждения, обеспечивающая повышенную производительность в разработке программного обеспечения, надежность работы агентов и эффективное использование токенов в сложных рабочих процессах. Основанная на мультимодальной базе серии Gemini 3, она сочетает в себе высокоточное логическое мышление при работе с текстом, изображениями, видео, аудио и кодом с контекстным окном в 1 миллион токенов. При использовании многошагового вызова инструментов на alltokens необходимо сохранять детали рассуждений. Обновление 3.1 демонстрирует измеримый рост в тестах SWE и реальных средах программирования, а также более уверенное выполнение автономных задач в структурированных областях, таких как финансы и работа с электронными таблицами. Разработанная для продвинутой разработки и агентных систем, Gemini 3.1 Pro Preview улучшает стабильность при выполнении длительных задач и оркестрацию инструментов, одновременно повышая эффективность расхода токенов. В модели представлен новый средний уровень мышления для оптимального баланса стоимости, скорости и производительности. Модель отлично справляется с написанием кода через агентов, структурированным планированием, мультимодальным анализом и автоматизацией рабочих процессов, что делает ее подходящей для автономных агентов, финансового моделирования, автоматизации таблиц и корпоративных задач с большим объемом контекста.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
google

Google: Gemini 3 Flash Preview (batch)

Рассуждения

Gemini 3 Flash Preview — это высокоскоростная модель с продвинутым уровнем мышления, разработанная для агентных рабочих процессов, многошагового общения и помощи в программировании. Она обеспечивает почти профессиональный уровень рассуждений и работы с инструментами.

от Контекст 1.05M32 ₽/Mвх187 ₽/Mвых
google

Google: Gemini 3 Flash Preview

Рассуждения
#18 в рейтинге

Gemini 3 Flash Preview — это высокоскоростная и эффективная модель с поддержкой логических рассуждений, разработанная для агентных рабочих процессов, многошаговых диалогов и помощи в написании кода. Она обеспечивает производительность в рассуждениях и использовании инструментов на уровне, близком к версии Pro, но с существенно меньшей задержкой, чем у более крупных вариантов Gemini. Это делает ее оптимальным выбором для интерактивной разработки, длительных циклов работы агентов и совместного программирования. По сравнению с Gemini 2.5 Flash, данная модель предлагает значительные улучшения в качестве логических выводов, мультимодальном понимании и надежности. Модель поддерживает контекстное окно объемом 1 миллион токенов и мультимодальные входные данные, включая текст, изображения, аудио, видео и PDF-файлы, с выводом в текстовом формате. Функционал включает настраиваемые уровни рассуждений (минимальный, низкий, средний, высокий), структурированный вывод, использование инструментов и автоматическое кэширование контекста. Gemini 3 Flash Preview оптимизирована для пользователей, которым требуются развитые способности к рассуждению и агентное поведение без затрат и задержек, характерных для полномасштабных флагманских моделей.

от Контекст 1.05M32 ₽/Mвх187 ₽/Mвых
google

Google: Gemini 2.5 Flash Lite (batch)

Рассуждения

Gemini 2.5 Flash-Lite — это облегчённая модель рассуждения из семейства Gemini 2.5, оптимизированная для сверхнизкой задержки и высокой экономичности. Она обеспечивает повышенную пропускную способность, более быструю генерацию токенов и улучшенную производительность.

от Контекст 1.05M7 ₽/Mвх25 ₽/Mвых
google

Google: Gemini 2.5 Flash Lite

Рассуждения
🏆 #1 в рейтинге

Gemini 2.5 Flash-Lite — это облегченная модель в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и максимальной экономической эффективности. Она обеспечивает повышенную пропускную способность, ускоренную генерацию токенов и лучшие показатели в стандартных тестах по сравнению с предыдущими моделями Flash. По умолчанию функция рассуждений отключена для обеспечения максимальной скорости работы, однако разработчики могут активировать ее через параметр Reasoning API, чтобы выборочно повысить интеллектуальные возможности модели за счет увеличения стоимости. На платформе alltokens вы можете интегрировать данную модель в свои проекты.

от Контекст 1.05M7 ₽/Mвх25 ₽/Mвых
google

Google: Gemini 2.5 Flash (batch)

Рассуждения

Gemini 2.5 Flash — это передовая модель от Google, специально разработанная для сложных задач, связанных с рассуждениями, программированием, математикой и научными исследованиями. Модель обладает встроенными возможностями "мышления", что позволяет ей давать более точные и продуманные ответы.

от Контекст 1.05M19 ₽/Mвх156 ₽/Mвых
google

Google: Gemini 2.5 Flash

Рассуждения
#20 в рейтинге

Gemini 2.5 Flash — это передовая высокопроизводительная модель от Google, специально разработанная для сложного логического вывода, написания кода, решения математических и научных задач. Она оснащена встроенными механизмами рассуждения, что позволяет ей выдавать ответы с повышенной точностью и глубокой проработкой контекста. Кроме того, Gemini 2.5 Flash поддерживает настройку через параметр max tokens for reasoning, доступный в API alltokens.

от Контекст 1.05M19 ₽/Mвх156 ₽/Mвых
google

Google: Gemini 2.5 Pro (batch)

Рассуждения

Gemini 2.5 Pro — это передовая модель искусственного интеллекта от Google, разработанная для сложных задач в области рассуждений, программирования, математики и науки. Она обладает способностью к «мышлению», что позволяет ей более точно анализировать и формировать ответы.

от Контекст 1.05M75 ₽/Mвх598 ₽/Mвых
google

Google: Gemini 2.5 Pro

Рассуждения

Gemini 2.5 Pro — это современная модель искусственного интеллекта от Google, разработанная для решения сложных задач в области логического рассуждения, программирования, математики и естественных наук. Модель использует возможности глубокого мышления, что позволяет ей выстраивать цепочки рассуждений для достижения повышенной точности и тонкой работы с контекстом. Gemini 2.5 Pro демонстрирует высочайшую производительность в различных тестах и занимает первое место в рейтинге LMArena, что подтверждает превосходное соответствие человеческим предпочтениям и выдающиеся способности к решению комплексных проблем.

от Контекст 1.05M75 ₽/Mвх598 ₽/Mвых
google

Google: Gemini 2.5 Pro Preview 05-06

Рассуждения

Gemini 2.5 Pro — это передовая модель искусственного интеллекта от Google, разработанная для решения сложных задач в области логического мышления, программирования, математики и естественных наук. Модель использует возможности глубокого рассуждения, что позволяет ей выстраивать цепочки мыслей для достижения повышенной точности и тонкой обработки контекста. Gemini 2.5 Pro демонстрирует высочайшую производительность в различных бенчмарках и занимает первое место в рейтинге LMArena, что подтверждает превосходное соответствие человеческим предпочтениям и выдающиеся способности к решению комплексных проблем. Доступ к модели осуществляется через API alltokens.

от Контекст 1.05M75 ₽/Mвх598 ₽/Mвых
google

Google: Gemini Embedding 2

Gemini Embedding 2 — первая мультимодальная модель встраивания от Google. В настоящее время она поддерживает преобразование текста и изображений в единое векторное пространство для семантического поиска и генерации с использованием дополненной информации (RAG). Модель поддерживает...

от Контекст 8K25 ₽/Mвхвых
google

Google: Gemini Embedding 2 Preview

Gemini Embedding 2 Preview — это первая мультимодальная модель векторных представлений от Google, которая отображает текст, изображения, видео, аудио и PDF-файлы в единое векторное пространство для семантического поиска и генерации с расширением через поиск (RAG).

от Контекст 8K25 ₽/Mвхвых
xiaomi

Xiaomi: MiMo-V2.5

Рассуждения

MiMo-V2.5 — это нативная омнимодальная модель от Xiaomi. Она обеспечивает производительность уровня Pro для агентных задач примерно за половину стоимости вывода, при этом превосходя MiMo-V2-Omni в мультимодальном восприятии при анализе изображений и видео.

от Контекст 1.05M15 ₽/Mвх30 ₽/Mвых
google

Google: Gemini 2.5 Pro Preview 06-05

Рассуждения

Gemini 2.5 Pro — это современная модель искусственного интеллекта от Google, разработанная для решения сложных задач в области логического рассуждения, программирования, математики и естественных наук. Модель использует возможности глубокого мышления, что позволяет ей выстраивать цепочки рассуждений для достижения повышенной точности и тонкой обработки контекста. Gemini 2.5 Pro демонстрирует высочайшую производительность в различных тестах и занимает лидирующие позиции в рейтинге LMArena, что подтверждает превосходное соответствие человеческим предпочтениям и выдающиеся способности к решению комплексных проблем. Доступ к модели осуществляется через API alltokens.

от Контекст 1.05M75 ₽/Mвх598 ₽/Mвых
amazon

Amazon: Nova 2 Lite

Рассуждения

Nova 2 Lite — это быстрая и экономичная модель рассуждения для повседневных задач, способная обрабатывать текст, изображения и видео для генерации текстовых ответов. Nova 2 Lite демонстрирует выдающиеся возможности в обработке документов, извлечении информации из видео, написании программного кода, предоставлении точных обоснованных ответов и автоматизации многоэтапных рабочих процессов с использованием агентов.

от Контекст 1.00M36 ₽/Mвх299 ₽/Mвых
nvidia

NVIDIA: Nemotron 3 Nano Omni (Бесплатно)

Рассуждения

NVIDIA Nemotron™ 3 Nano Omni — это открытая мультимодальная модель с 30 миллиардами параметров, разработанная для работы в качестве подсистемы восприятия и контекста в корпоративных агентных системах. Модель принимает текст, изображения, видео и другие виды данных.

от Контекст 256KБесплатновхБесплатновых
x-ai

SpaceXAI: Grok 4.20 Multi-Agent

Рассуждения

Grok 4.20 Multi-Agent — это вариант модели xAI Grok 4.20, созданный для совместной работы агентов. Несколько агентов работают параллельно для проведения глубоких исследований, координации использования инструментов и синтеза информации при решении сложных задач. Поведение при затратах на рассуждение: - низкое / среднее: 4 агента - высокое / очень высокое: 16 агентов

от Контекст 2.00M150 ₽/Mвх299 ₽/Mвых
x-ai

SpaceXAI: Grok 4.20

Рассуждения

Grok 4.20 — новейшая флагманская модель xAI с лидирующей скоростью и возможностями агентного вызова инструментов. Она сочетает самый низкий на рынке уровень галлюцинаций с строгим соблюдением инструкций, обеспечивая стабильно точные и правдивые ответы. Режим рассуждений можно включать/выключать с помощью параметра `reasoning` `enabled` в API. Подробнее в наших документах.

от Контекст 2.00M150 ₽/Mвх299 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna Pro (batch)

Рассуждения

GPT-5.6 Luna Pro использует ту же базовую модель, что и GPT-5.6 Luna, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M7 ₽/Mвх38 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna Pro

Рассуждения
#4 в рейтинге

GPT-5.6 Luna Pro использует ту же базовую модель, что и GPT-5.6 Luna, но с включённым режимом `reasoning.mode` в значении `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M13 ₽/Mвх75 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna (batch)

Рассуждения

GPT-5.6 Luna — это быстрый и экономичный модель из серии GPT-5.6. Она подходит для задач с высоким объемом и чувствительностью к задержкам, таких как чат, классификация и легкие агентные рабочие процессы, обеспечивая эффективное логическое мышление для...

от Контекст 1.05M7 ₽/Mвх38 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna

Рассуждения
#8 в рейтинге

GPT-5.6 Luna — это быстрый и эффективный по затратам модель из серии GPT-5.6. Она подходит для задач с высоким объемом и чувствительностью к задержкам, таких как чат, классификация и легкие агентные рабочие процессы, обеспечивая качественное логическое мышление для...

от Контекст 1.05M13 ₽/Mвх75 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra Pro (batch)

Рассуждения

GPT-5.6 Terra Pro использует ту же базовую модель, что и GPT-5.6 Terra, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M60 ₽/Mвх359 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra Pro

Рассуждения

GPT-5.6 Terra Pro использует ту же базовую модель, что и GPT-5.6 Terra, но с включённым режимом `reasoning.mode` в значении `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra (batch)

Рассуждения

GPT-5.6 Terra — это сбалансированная модель из серии GPT-5.6, расположенная между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневного программирования, рассуждений и выполнения агентских задач.

от Контекст 1.05M60 ₽/Mвх359 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra

Рассуждения

GPT-5.6 Terra — это сбалансированная модель из серии GPT-5.6, расположенная между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневного программирования, рассуждений и выполнения агентских задач.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol Pro (batch)

Рассуждения

GPT-5.6 Sol Pro — это та же базовая модель, что и GPT-5.6 Sol, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M60 ₽/Mвх299 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol Pro

Рассуждения

GPT-5.6 Sol Pro использует ту же базовую модель, что и GPT-5.6 Sol, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M120 ₽/Mвх598 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol (batch)

Рассуждения

GPT-5.6 Sol — это флагманская модель серии GPT-5.6. Она предназначена для сложных рассуждений, программирования и агентных рабочих процессов, особенно хорошо справляется с задачами командной строки и многошаговым программированием.

от Контекст 1.05M60 ₽/Mвх299 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol

Рассуждения

GPT-5.6 Sol — это флагманская модель серии GPT-5.6. Она предназначена для сложных рассуждений, программирования и агентных рабочих процессов, особенно хорошо справляется с задачами командной строки и многошаговым кодированием.

от Контекст 1.05M120 ₽/Mвх598 ₽/Mвых
openai

OpenAI: GPT-5.5 Pro (batch)

Рассуждения

GPT-5.5 Pro — это высокопроизводительная модель, оптимизированная для глубокого анализа и точности при работе с комплексными и критически важными задачами. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M828 ₽/Mвх4 968 ₽/Mвых
openai

OpenAI: GPT-5.5 Pro

Рассуждения

GPT-5.5 Pro — это высокопроизводительная модель, разработанная для глубокого анализа и высокой точности при работе с комплексными и критически важными задачами. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M1 656 ₽/Mвх9 936 ₽/Mвых
openai

OpenAI: GPT-5.5 (batch)

Рассуждения

GPT-5.5 — передовая модель, разработанная для сложных профессиональных задач, основанная на GPT-5.4 с улучшенными возможностями рассуждения, повышенной надежностью и улучшенной эффективностью обработки токенов при выполнении сложных заданий. Модель поддерживает работу с более чем 1 миллионом токенов.

от Контекст 1.05M150 ₽/Mвх897 ₽/Mвых
openai

OpenAI: GPT-5.5

Рассуждения

GPT-5.5 — передовая модель, разработанная для сложных профессиональных задач, основанная на GPT-5.4 с улучшенными возможностями рассуждения, повышенной надежностью и улучшенной эффективностью обработки токенов при выполнении сложных заданий. Модель поддерживает работу с более чем 1 миллионом токенов.

от Контекст 1.05M288 ₽/Mвх1 725 ₽/Mвых
openai

OpenAI: GPT-5.4 Pro (batch)

Рассуждения

GPT-5.4 Pro — самая продвинутая модель, основанная на единой архитектуре GPT-5.4 с улучшенными возможностями рассуждения для выполнения сложных и ответственных задач. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M828 ₽/Mвх4 968 ₽/Mвых
openai

OpenAI: GPT-5.4 Pro

Рассуждения

GPT-5.4 Pro — самая продвинутая модель OpenAI, построенная на унифицированной архитектуре GPT-5.4 с улучшенными способностями к рассуждению для сложных, критически важных задач. Она оснащена контекстным окном в 1M+ токенов (922K входных, 128K выходных) с поддержкой текстовых и изображений входных данных. Оптимизирована для пошагового рассуждения, следования инструкциям и точности, GPT-5.4 Pro отлично справляется с агентным кодированием, рабочими процессами с длинным контекстом и решением многошаговых задач.

от Контекст 1.05M1 656 ₽/Mвх9 936 ₽/Mвых
openai

OpenAI: GPT-5.4 (batch)

Рассуждения

GPT-5.4 — это новейшая модель компании OpenAI, объединяющая линии Codex и GPT в единую систему. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных) с возможностью...

от Контекст 1.05M75 ₽/Mвх449 ₽/Mвых
openai

OpenAI: GPT-5.4

Рассуждения

GPT-5.4 — это последняя флагманская модель OpenAI, объединяющая линии Codex и GPT в единую систему. Она оснащена контекстным окном более 1 млн токенов (922 тыс. входных, 128 тыс. выходных) и поддерживает текстовые и изображенные входные данные, что позволяет выполнять высококонтекстное рассуждение, программирование и мультимодальный анализ в рамках одного рабочего процесса. Модель демонстрирует улучшенные результаты в программировании, анализе документов, использовании инструментов и следовании инструкциям. Она разработана как надежный выбор как для общих задач, так и для разработки программного обеспечения, способна генерировать код промышленного качества, синтезировать информацию из множественных источников и выполнять сложные многошаговые рабочие процессы с меньшим количеством итераций и большей эффективностью использования токенов.

от Контекст 1.05M150 ₽/Mвх897 ₽/Mвых
stealth

Ox Alpha

Удаляется 31 декабря
РассужденияНовая
#14 в рейтинге

Ox Alpha — это модель рассуждений, разработанная для программирования, продолжительной агентной работы и производственных задач. Она подходит для долгосрочной разработки программного обеспечения, сложных рассуждений и рабочих процессов, которые сочетают текст с другими видами данных.

от Контекст 1.05MБесплатновхБесплатновых
thinkingmachines

Thinking Machines: Inkling Small (Бесплатно)

Рассуждения

Inkling Small — это мультимодальная модель с открытым весом и смесью экспертов от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представлена как более компактная и эффективная версия модели...

от Контекст 1.05MБесплатновхБесплатновых
thinkingmachines

Thinking Machines: Inkling Small

Рассуждения

Inkling Small — это мультимодальная модель с открытым весом и архитектурой mixture-of-experts от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представлена как более компактная и эффективная версия модели.

от Контекст 1.05M56 ₽/Mвх150 ₽/Mвых
thinkingmachines

Thinking Machines: Inkling (Бесплатно)

Рассуждения

Inkling — это мультимодальная модель с открытым весом и смесью экспертов от Thinking Machines Lab, содержащая 41 миллиард активных параметров из общего числа 975 миллиардов. Она предназначена для универсального рассуждения, программирования, создания агентных систем и использования инструментов.

от Контекст 1.05MБесплатновхБесплатновых
thinkingmachines

Thinking Machines: Inkling

Рассуждения

Inkling — это мультимодальная модель с открытыми весами и архитектурой mixture-of-experts от Thinking Machines Lab, содержащая 41 миллиард активных параметров из общего числа 975 миллиардов. Модель предназначена для универсального рассуждения, программирования, создания агентных систем и использования инструментов.

от Контекст 1.05M114 ₽/Mвх485 ₽/Mвых

Похожие модели внутри подборки

Быстрые связки для углубленного сравнения: по цене, контексту и поддерживаемым API-параметрам.

FAQ

Как понять, что модель мультимодальная?

Проверьте `inputModalities`: если там несколько модальностей (например, text+image), модель подходит для multimodal-задач.

Мультимодальные модели дороже?

Часто да, но многое зависит от провайдера и конкретной модели. Сравнивайте цены в каталоге перед запуском.

Смежные подборки

Лучшие для задач

Новости по теме

МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru