Alltokens

LLM-модели с длинным контекстным окном

Для работы с крупными документами, длинными диалогами и многофайловыми кодовыми базами выбирайте модели из этой подборки.

Моделей в подборке

60

Средняя цена (вход)

302 ₽/M

Макс. контекст

2.0M

Модели

alltokens

Pareto Code Router

Pareto Router — это способ, с помощью которого alltokens всегда выбирает для вас мощную модель для кодирования в соответствии с вашими потребностями, не привязываясь к конкретной модели. Вы выражаете единственное предпочтение `min_coding_score`...

от Контекст 2.00MБесплатновхБесплатновых
x-ai

SpaceXAI: Grok 4.20 Multi-Agent

Рассуждения

Grok 4.20 Multi-Agent — это вариант модели xAI Grok 4.20, созданный для совместной работы агентов. Несколько агентов работают параллельно для проведения глубоких исследований, координации использования инструментов и синтеза информации при решении сложных задач. Поведение при затратах на рассуждение: - низкое / среднее: 4 агента - высокое / очень высокое: 16 агентов

от Контекст 2.00M150 ₽/Mвх299 ₽/Mвых
x-ai

SpaceXAI: Grok 4.20

Рассуждения

Grok 4.20 — новейшая флагманская модель xAI с лидирующей скоростью и возможностями агентного вызова инструментов. Она сочетает самый низкий на рынке уровень галлюцинаций с строгим соблюдением инструкций, обеспечивая стабильно точные и правдивые ответы. Режим рассуждений можно включать/выключать с помощью параметра `reasoning` `enabled` в API. Подробнее в наших документах.

от Контекст 2.00M150 ₽/Mвх299 ₽/Mвых
alltokens

Auto Router

Рассуждения

Ваш запрос будет обработан мета-моделью и направлен в одну из десятков доступных моделей для достижения наилучшего результата. Чтобы узнать, какая именно модель была использована, проверьте историю активности или атрибут model в ответе API. Стоимость запроса соответствует тарифу выбранной модели. Вы можете настроить список моделей для маршрутизации в документации. Запросы направляются в следующие модели: - anthropic/claude-haiku-4.5 - anthropic/claude-opus-4.6 - anthropic/claude-sonnet-4.5 - deepseek/deepseek-r1 - google/gemini-2.5-flash-lite - google/gemini-3-flash-preview - google/gemini-3-pro-preview - meta-llama/llama-3.3-70b-instruct - mistralai/codestral-2508 - mistralai/mistral-large - mistralai/mistral-medium-3.1 - mistralai/mistral-small-3.2-24b-instruct-2506 - moonshotai/kimi-k2-thinking - moonshotai/kimi-k2.5 - openai/gpt-5 - openai/gpt-5-mini - openai/gpt-5-nano - openai/gpt-5.1 - openai/gpt-5.2 - openai/gpt-5.2-pro - openai/gpt-oss-120b - perplexity/sonar - qwen/qwen3-235b-a22b - x-ai/grok-3 - x-ai/grok-3-mini - x-ai/grok-4

от Контекст 2.00MБесплатновхБесплатновых
z-ai

Z.ai: GLM 5.3 Flash

Рассуждения
#14 в рейтинге

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она предназначена для эффективного программирования и задач с длительным горизонтом планирования. Гибридная архитектура с разреженным и линейным вниманием обеспечивает точное поведение при работе с длинным контекстом, одновременно...

от Контекст 1.31M10 ₽/Mвх32 ₽/Mвых
z-ai

Z.ai: GLM 5.3

Рассуждения

GLM-5.3 — это масштабная модель рассуждений от Z.ai, разработанная для сложных задач в области программной инженерии и долгосрочного планирования агентов. Модель поддерживает ввод и вывод текста с контекстным окном размером 1 миллион токенов и обеспечивает улучшенную производительность в соответствующих задачах.

от Контекст 1.31M105 ₽/Mвх402 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Flash 0731

Рассуждения
#8 в рейтинге

DeepSeek V4 Flash 0731 — это модель с разреженной смесью экспертов от DeepSeek, содержащая 13 миллиардов активных параметров из общего числа 284 миллиарда. Эта версия с повторным обучением подходит для программирования, логического мышления и работы с агентами.

от Контекст 1.31M4 ₽/Mвх9 ₽/Mвых
meta-llama

Meta: Llama 4 Scout

Llama 4 Scout 17B Instruct (16E) — это языковая модель на базе архитектуры смеси экспертов (MoE), разработанная Meta. Модель активирует 17 миллиардов параметров из общего числа в 109 миллиардов. Она поддерживает нативный мультимодальный ввод (текст и изображения) и мультиязычный вывод (текст и программный код) на 12 языках. Scout спроектирована для работы в режиме ассистента и визуального анализа, используя 16 экспертов на каждом проходе. Модель обладает контекстным окном в 10 миллионов токенов и обучена на корпусе объемом около 40 триллионов токенов. Созданная для высокой эффективности и локального или коммерческого развертывания, Llama 4 Scout использует технологию раннего слияния для бесшовной интеграции различных модальностей. Модель прошла процедуру настройки инструкций для использования в мультиязычных чатах, генерации описаний к изображениям и задач по распознаванию визуального контента. Выпущенная под лицензией Llama 4 Community License, она обучалась на данных вплоть до августа 2024 года и стала доступна на alltokens 5 апреля 2025 года.

от Контекст 1.31M13 ₽/Mвх38 ₽/Mвых
openai

OpenAI: GPT-6 Astra (batch)

Рассуждения

GPT-6 Astra — это флагманская модель для сложных комплексных задач. Она подходит для продвинутого анализа, разработки программного обеспечения, глубоких исследований, научной работы и создания документов, обладая особенно сильными возможностями при работе с длительными текстами и сложными контекстами.

от Контекст 1.05M575 ₽/Mвх2 875 ₽/Mвых
openai

OpenAI: GPT-6 Astra

Рассуждения

GPT-6 Astra — это передовая модель рассуждений, разработанная OpenAI, предназначенная для сложных задач логического мышления, программирования и агентных рабочих процессов.

от Контекст 1.05M1 104 ₽/Mвх5 520 ₽/Mвых
openai

OpenAI: GPT-6 Astra Pro (batch)

Рассуждения

GPT-6 Astra Pro использует ту же базовую модель, что и GPT-6 Astra, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M575 ₽/Mвх2 875 ₽/Mвых
openai

OpenAI: GPT-6 Astra Pro

Рассуждения

GPT-6 Astra Pro использует ту же базовую модель, что и GPT-6 Astra, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M1 104 ₽/Mвх5 520 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna Pro (batch)

Рассуждения

GPT-5.6 Luna Pro использует ту же базовую модель, что и GPT-5.6 Luna, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M13 ₽/Mвх75 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna Pro

Рассуждения
#15 в рейтинге

GPT-5.6 Luna Pro использует ту же базовую модель, что и GPT-5.6 Luna, но с включённым режимом `reasoning.mode` в значении `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M25 ₽/Mвх150 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna (batch)

Рассуждения

GPT-5.6 Luna — это быстрый и экономичный модель из серии GPT-5.6. Она подходит для задач с высоким объемом и чувствительностью к задержкам, таких как чат, классификация и легкие агентные рабочие процессы, обеспечивая эффективное логическое мышление для...

от Контекст 1.05M13 ₽/Mвх75 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna

Рассуждения
#4 в рейтинге

GPT-5.6 Luna — это быстрый и эффективный по затратам модель из серии GPT-5.6. Она подходит для задач с высоким объемом и чувствительностью к задержкам, таких как чат, классификация и легкие агентные рабочие процессы, обеспечивая качественное логическое мышление для...

от Контекст 1.05M25 ₽/Mвх150 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra Pro (batch)

Рассуждения

GPT-5.6 Terra Pro использует ту же базовую модель, что и GPT-5.6 Terra, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra Pro

Рассуждения

GPT-5.6 Terra Pro использует ту же базовую модель, что и GPT-5.6 Terra, но с включённым режимом `reasoning.mode` в значении `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M230 ₽/Mвх1 380 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra (batch)

Рассуждения

GPT-5.6 Terra — это сбалансированная модель из серии GPT-5.6, расположенная между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневного программирования, рассуждений и выполнения агентских задач.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra

Рассуждения

GPT-5.6 Terra — это сбалансированная модель из серии GPT-5.6, расположенная между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневного программирования, рассуждений и выполнения агентских задач.

от Контекст 1.05M230 ₽/Mвх1 380 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol Pro (batch)

Рассуждения

GPT-5.6 Sol Pro — это та же базовая модель, что и GPT-5.6 Sol, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M120 ₽/Mвх598 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol Pro

Рассуждения

GPT-5.6 Sol Pro использует ту же базовую модель, что и GPT-5.6 Sol, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M230 ₽/Mвх1 150 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol (batch)

Рассуждения

GPT-5.6 Sol — это флагманская модель серии GPT-5.6. Она предназначена для сложных рассуждений, программирования и агентных рабочих процессов, особенно хорошо справляется с задачами командной строки и многошаговым программированием.

от Контекст 1.05M120 ₽/Mвх598 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol

Рассуждения

GPT-5.6 Sol — это флагманская модель серии GPT-5.6. Она предназначена для сложных рассуждений, программирования и агентных рабочих процессов, особенно хорошо справляется с задачами командной строки и многошаговым кодированием.

от Контекст 1.05M230 ₽/Mвх1 150 ₽/Mвых
openai

OpenAI: GPT-5.5 Pro (batch)

Рассуждения

GPT-5.5 Pro — это высокопроизводительная модель, оптимизированная для глубокого анализа и точности при работе с комплексными и критически важными задачами. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M1 656 ₽/Mвх9 936 ₽/Mвых
openai

OpenAI: GPT-5.5 Pro

Рассуждения

GPT-5.5 Pro — это высокопроизводительная модель, разработанная для глубокого анализа и высокой точности при работе с комплексными и критически важными задачами. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M3 312 ₽/Mвх19 872 ₽/Mвых
openai

OpenAI: GPT-5.5 (batch)

Рассуждения

GPT-5.5 — передовая модель, разработанная для сложных профессиональных задач, основанная на GPT-5.4 с улучшенными возможностями рассуждения, повышенной надежностью и улучшенной эффективностью обработки токенов при выполнении сложных заданий. Модель поддерживает работу с более чем 1 миллионом токенов.

от Контекст 1.05M288 ₽/Mвх1 725 ₽/Mвых
openai

OpenAI: GPT-5.5

Рассуждения

GPT-5.5 — передовая модель, разработанная для сложных профессиональных задач, основанная на GPT-5.4 с улучшенными возможностями рассуждения, повышенной надежностью и улучшенной эффективностью обработки токенов при выполнении сложных заданий. Модель поддерживает работу с более чем 1 миллионом токенов.

от Контекст 1.05M575 ₽/Mвх3 450 ₽/Mвых
xiaomi

Xiaomi: MiMo-V2.5-Pro

Рассуждения

MiMo-V2.5-Pro — флагманская модель Xiaomi, демонстрирующая высокую производительность в общих агентных задачах, сложном программном инжиниринге и долгосрочных проектах, занимая лидирующие позиции в бенчмарках, таких как ClawEval, GDPVal и SWE-bench Pro.

от Контекст 1.05M38 ₽/Mвх76 ₽/Mвых
xiaomi

Xiaomi: MiMo-V2.5

Рассуждения

MiMo-V2.5 — это нативная омнимодальная модель от Xiaomi. Она обеспечивает производительность уровня Pro для агентных задач примерно за половину стоимости вывода, при этом превосходя MiMo-V2-Omni в мультимодальном восприятии при анализе изображений и видео.

от Контекст 1.05M15 ₽/Mвх30 ₽/Mвых
openai

OpenAI: GPT-5.4 Pro (batch)

Рассуждения

GPT-5.4 Pro — самая продвинутая модель, основанная на единой архитектуре GPT-5.4 с улучшенными возможностями рассуждения для выполнения сложных и ответственных задач. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M1 656 ₽/Mвх9 936 ₽/Mвых
openai

OpenAI: GPT-5.4 Pro

Рассуждения

GPT-5.4 Pro — самая продвинутая модель OpenAI, построенная на унифицированной архитектуре GPT-5.4 с улучшенными способностями к рассуждению для сложных, критически важных задач. Она оснащена контекстным окном в 1M+ токенов (922K входных, 128K выходных) с поддержкой текстовых и изображений входных данных. Оптимизирована для пошагового рассуждения, следования инструкциям и точности, GPT-5.4 Pro отлично справляется с агентным кодированием, рабочими процессами с длинным контекстом и решением многошаговых задач.

от Контекст 1.05M3 312 ₽/Mвх19 872 ₽/Mвых
openai

OpenAI: GPT-5.4 (batch)

Рассуждения

GPT-5.4 — это новейшая модель компании OpenAI, объединяющая линии Codex и GPT в единую систему. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных) с возможностью...

от Контекст 1.05M150 ₽/Mвх897 ₽/Mвых
openai

OpenAI: GPT-5.4

Рассуждения

GPT-5.4 — это последняя флагманская модель OpenAI, объединяющая линии Codex и GPT в единую систему. Она оснащена контекстным окном более 1 млн токенов (922 тыс. входных, 128 тыс. выходных) и поддерживает текстовые и изображенные входные данные, что позволяет выполнять высококонтекстное рассуждение, программирование и мультимодальный анализ в рамках одного рабочего процесса. Модель демонстрирует улучшенные результаты в программировании, анализе документов, использовании инструментов и следовании инструкциям. Она разработана как надежный выбор как для общих задач, так и для разработки программного обеспечения, способна генерировать код промышленного качества, синтезировать информацию из множественных источников и выполнять сложные многошаговые рабочие процессы с меньшим количеством итераций и большей эффективностью использования токенов.

от Контекст 1.05M288 ₽/Mвх1 725 ₽/Mвых
meituan

Meituan: LongCat 2.0

Рассуждения

LongCat 2.0 — это языковая модель с разреженной смесью экспертов от Meituan, имеющая 48 миллиардов активных параметров из общего числа 1,6 триллиона. Она подходит для программирования, изменений на уровне репозиториев, решения задач с длительным горизонтом и агентных приложений.

от Контекст 1.05M38 ₽/Mвх150 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4.1 Flash

РассужденияНовая

DeepSeek V4.1 Flash — это модель с разреженной смесью экспертов от DeepSeek, представляющая собой экономичный уровень семейства V4.1. По данным DeepSeek, она превосходит V4 Pro по производительности, скорости и выполнению задач.

от Контекст 1.05M19 ₽/Mвх75 ₽/Mвых
meta

Meta: Muse Spark 1.3 Contributor

Рассуждения

Muse Spark 1.3 Contributor — это экономичный уровень доступа к мультимодальной модели рассуждений Meta, предназначенный для экспериментов, обучения и начальных этапов работы с агентами, многоагентными системами и кодированием. Модель разработана для отслеживания информации...

от Контекст 1.05M13 ₽/Mвх25 ₽/Mвых
meta

Meta: Muse Spark 1.3

Рассуждения

Muse Spark 1.3 — это мультимодальная модель рассуждений от Meta, предназначенная для длительных агентных, многоагентных и программных рабочих процессов. Модель разработана для отслеживания информации в ходе выполнения продолжительных задач, эффективной работы с различными типами данных и поддержки сложных сценариев взаимодействия.

от Контекст 1.05M150 ₽/Mвх509 ₽/Mвых
google

Google: Gemini 3.8 Flash (batch)

Рассуждения

Gemini 3.8 Flash — самая интеллектуальная модель Flash от Google, разработанная для длительного программирования, автономных агентов и сложных корпоративных рабочих процессов.

от Контекст 1.05M45 ₽/Mвх225 ₽/Mвых
google

Google: Gemini 3.8 Flash

Рассуждения

Gemini 3.8 Flash — самая интеллектуальная модель Flash от Google, разработанная для долгосрочного программирования, автономных агентов и сложных корпоративных рабочих процессов.

от Контекст 1.05M90 ₽/Mвх449 ₽/Mвых
tencent

Tencent: Hy4 preview

Рассуждения

Tencent: Hy4 preview — это модель с архитектурой mixture-of-experts от Tencent, содержащая 49 миллиардов активных параметров из общего числа 770 миллиардов. Она предназначена для работы с кодированием, сложными рабочими процессами с использованием инструментов и задачами повышения производительности.

от Контекст 1.05M100 ₽/Mвх300 ₽/Mвых
z-ai

Z.ai: GLM 5.3 Flash (batch)

Рассуждения

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она предназначена для эффективного программирования и задач с длительным горизонтом планирования. Гибридная архитектура с разреженным и линейным вниманием обеспечивает точную работу с длинным контекстом, одновременно...

от Контекст 1.05M10 ₽/Mвх32 ₽/Mвых
meta

Meta: Muse Spark 1.2 Contributor

Рассуждения

Muse Spark 1.2 contributor tier — это модель рассуждения от Meta, предназначенная для разработчиков, которые хотят начать создавать проекты с еще меньшими затратами. Она значительно дешевле, чем Muse Spark...

от Контекст 1.05M13 ₽/Mвх25 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Flash Vision Exp (batch)

Рассуждения

DeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой обработки изображений, которая добавляет возможности понимания изображений, сохраняя при этом базовые текстовые функции модели, включая работу с агентами.

от Контекст 1.05M14 ₽/Mвх41 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Flash Vision Exp

Рассуждения

DeepSeek V4 Flash Vision Exp — экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой обработки изображений, которая добавляет возможности понимания изображений при сохранении базовых текстовых функций модели, включая работу с агентами.

от Контекст 1.05M27 ₽/Mвх81 ₽/Mвых
z-ai

Z.ai: GLM 5.3 (batch)

Рассуждения

GLM-5.3 — это масштабная модель рассуждений от Z.ai, разработанная для сложных задач в области программной инженерии и долгосрочного планирования агентов. Модель поддерживает ввод и вывод текста с контекстным окном размером 1 миллион токенов и обеспечивает улучшенную производительность в соответствующих задачах.

от Контекст 1.05M84 ₽/Mвх264 ₽/Mвых
google

Google: Gemini 3.7 Flash (batch)

Рассуждения

Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.

от Контекст 1.05M45 ₽/Mвх225 ₽/Mвых
google

Google: Gemini 3.7 Flash

Рассуждения
#10 в рейтинге

Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.

от Контекст 1.05M90 ₽/Mвх449 ₽/Mвых
qwen

Qwen: Qwen3.8 2.4T A95B

Рассуждения

Qwen3.8 2.4T A95B — это модель с открытыми весами, использующая разреженную смесь экспертов, разработанная Qwen. Она является вариантом Qwen3.8 Max с открытыми весами и содержит 95 миллиардов активных параметров из общего числа 2,4 триллиона. Модель предназначена для...

от Контекст 1.05M240 ₽/Mвх718 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Pro 0813 (batch)

Рассуждения

DeepSeek V4 Pro 0813 — это крупномасштабная модель с архитектурой mixture-of-experts от DeepSeek. Это стабильный релиз DeepSeek V4 Pro.

от Контекст 1.05M79 ₽/Mвх237 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Pro 0813

Рассуждения

DeepSeek V4 Pro 0813 — это крупномасштабная модель с архитектурой mixture-of-experts от DeepSeek. Это стабильный релиз DeepSeek V4 Pro.

от Контекст 1.05M70 ₽/Mвх208 ₽/Mвых
meta

Meta: Muse Spark 1.2

Рассуждения

Muse Spark 1.2 — это модель рассуждения от Meta, предназначенная для выполнения сложных агентных задач. Она принимает текст, изображения, видео, аудио и PDF-документы, возвращает текст и поддерживает контекст объемом до 1 миллиона токенов.

от Контекст 1.05M150 ₽/Mвх509 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Flash 0731 (batch)

Рассуждения

DeepSeek V4 Flash 0731 — это модель с разреженной смесью экспертов от DeepSeek, имеющая 13 миллиардов активных параметров из общего числа 284 миллиарда. Эта переработанная версия оптимизирована для программирования, логического мышления и работы с агентами.

от Контекст 1.05M14 ₽/Mвх35 ₽/Mвых
thinkingmachines

Thinking Machines: Inkling Small (Бесплатно)

Рассуждения

Inkling Small — это мультимодальная модель с открытым весом и смесью экспертов от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представлена как более компактная и эффективная версия модели...

от Контекст 1.05MБесплатновхБесплатновых
thinkingmachines

Thinking Machines: Inkling Small

Рассуждения

Inkling Small — это мультимодальная модель с открытым весом и архитектурой mixture-of-experts от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представлена как более компактная и эффективная версия модели.

от Контекст 1.05M56 ₽/Mвх150 ₽/Mвых
poolside

Poolside: Laguna S 2.1

Рассуждения

Laguna S 2.1 — это последняя модель агента для программирования от Poolside. Laguna S 2.1 имеет в общей сложности 118 миллиардов параметров, из которых 8 миллиардов активных. Модель достигает результата 70,2% на тесте Terminal-Bench 2.1.

от Контекст 1.05M12 ₽/Mвх23 ₽/Mвых
google

Google: Gemini 3.6 Flash (batch)

Рассуждения

Gemini 3.6 Flash — это высокоэффективная модель от Google, предназначенная для программирования, агентных рабочих процессов, а также разработки веб-сайтов и приложений. Модель создана для генерации качественных результатов с минимальным количеством лишних правок и...

от Контекст 1.05M45 ₽/Mвх225 ₽/Mвых
google

Google: Gemini 3.6 Flash

Рассуждения

Gemini 3.6 Flash — это высокоэффективная модель от Google, предназначенная для программирования, агентных рабочих процессов, а также разработки веб-сайтов и приложений. Модель создана для генерации качественных результатов с минимальным количеством лишних правок и...

от Контекст 1.05M90 ₽/Mвх449 ₽/Mвых
google

Google: Gemini 3.5 Flash Lite (batch)

Рассуждения

Gemini 3.5 Flash Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих специализированные задачи в рамках сложных многоагентных рабочих процессов.

от Контекст 1.05M19 ₽/Mвх156 ₽/Mвых
google

Google: Gemini 3.5 Flash Lite

Рассуждения

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих специализированные задачи в рамках сложных многоагентных рабочих процессов.

от Контекст 1.05M36 ₽/Mвх299 ₽/Mвых

Похожие модели внутри подборки

Быстрые связки для углубленного сравнения: по цене, контексту и поддерживаемым API-параметрам.

FAQ

Зачем нужен большой контекст?

Он позволяет модели удерживать больше информации в одном запросе и снижает необходимость агрессивной нарезки данных.

Какой порог используется в этой подборке?

В выборке показаны модели с контекстом от 200K токенов и выше.

Смежные подборки

Лучшие для задач

Новости по теме

МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru