Alltokens

Лучшие LLM-модели для программирования

Подборка для engineering-задач: генерация кода, рефакторинг, ревью и агентные workflow. В приоритете модели с reasoning и поддержкой tool use.

Моделей в подборке

60

Средняя цена (вход)

153 ₽/M

Макс. контекст

2.0M

Модели

x-ai

SpaceXAI: Grok 4.20 Multi-Agent

Рассуждения

Grok 4.20 Multi-Agent — это вариант модели xAI Grok 4.20, созданный для совместной работы агентов. Несколько агентов работают параллельно для проведения глубоких исследований, координации использования инструментов и синтеза информации при решении сложных задач. Поведение при затратах на рассуждение: - низкое / среднее: 4 агента - высокое / очень высокое: 16 агентов

от Контекст 2.00M150 ₽/Mвх299 ₽/Mвых
x-ai

SpaceXAI: Grok 4.20

Рассуждения

Grok 4.20 — новейшая флагманская модель xAI с лидирующей скоростью и возможностями агентного вызова инструментов. Она сочетает самый низкий на рынке уровень галлюцинаций с строгим соблюдением инструкций, обеспечивая стабильно точные и правдивые ответы. Режим рассуждений можно включать/выключать с помощью параметра `reasoning` `enabled` в API. Подробнее в наших документах.

от Контекст 2.00M150 ₽/Mвх299 ₽/Mвых
alltokens

Auto Router

Рассуждения

Ваш запрос будет обработан мета-моделью и направлен в одну из десятков доступных моделей для достижения наилучшего результата. Чтобы узнать, какая именно модель была использована, проверьте историю активности или атрибут model в ответе API. Стоимость запроса соответствует тарифу выбранной модели. Вы можете настроить список моделей для маршрутизации в документации. Запросы направляются в следующие модели: - anthropic/claude-haiku-4.5 - anthropic/claude-opus-4.6 - anthropic/claude-sonnet-4.5 - deepseek/deepseek-r1 - google/gemini-2.5-flash-lite - google/gemini-3-flash-preview - google/gemini-3-pro-preview - meta-llama/llama-3.3-70b-instruct - mistralai/codestral-2508 - mistralai/mistral-large - mistralai/mistral-medium-3.1 - mistralai/mistral-small-3.2-24b-instruct-2506 - moonshotai/kimi-k2-thinking - moonshotai/kimi-k2.5 - openai/gpt-5 - openai/gpt-5-mini - openai/gpt-5-nano - openai/gpt-5.1 - openai/gpt-5.2 - openai/gpt-5.2-pro - openai/gpt-oss-120b - perplexity/sonar - qwen/qwen3-235b-a22b - x-ai/grok-3 - x-ai/grok-3-mini - x-ai/grok-4

от Контекст 2.00MБесплатновхБесплатновых
z-ai

Z.ai: GLM 5.3 Flash

Удаляется 31 декабря
РассужденияНовая

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она предназначена для эффективного программирования и задач с длительным горизонтом планирования. Гибридная архитектура с разреженным и линейным вниманием обеспечивает точное поведение при работе с длинным контекстом, одновременно...

от Контекст 1.31M10 ₽/Mвх32 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Flash 0731

Рассуждения
#11 в рейтинге

DeepSeek V4 Flash 0731 — это модель с разреженной смесью экспертов от DeepSeek, содержащая 13 миллиардов активных параметров из общего числа 284 миллиарда. Эта версия с повторным обучением подходит для программирования, логического мышления и работы с агентами.

от Контекст 1.31M4 ₽/Mвх10 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna Pro (batch)

Рассуждения

GPT-5.6 Luna Pro использует ту же базовую модель, что и GPT-5.6 Luna, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M7 ₽/Mвх38 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna Pro

Рассуждения
#4 в рейтинге

GPT-5.6 Luna Pro использует ту же базовую модель, что и GPT-5.6 Luna, но с включённым режимом `reasoning.mode` в значении `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M13 ₽/Mвх75 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna (batch)

Рассуждения

GPT-5.6 Luna — это быстрый и экономичный модель из серии GPT-5.6. Она подходит для задач с высоким объемом и чувствительностью к задержкам, таких как чат, классификация и легкие агентные рабочие процессы, обеспечивая эффективное логическое мышление для...

от Контекст 1.05M7 ₽/Mвх38 ₽/Mвых
openai

OpenAI: GPT-5.6 Luna

Рассуждения
#8 в рейтинге

GPT-5.6 Luna — это быстрый и эффективный по затратам модель из серии GPT-5.6. Она подходит для задач с высоким объемом и чувствительностью к задержкам, таких как чат, классификация и легкие агентные рабочие процессы, обеспечивая качественное логическое мышление для...

от Контекст 1.05M13 ₽/Mвх75 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra Pro (batch)

Рассуждения

GPT-5.6 Terra Pro использует ту же базовую модель, что и GPT-5.6 Terra, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M60 ₽/Mвх359 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra Pro

Рассуждения

GPT-5.6 Terra Pro использует ту же базовую модель, что и GPT-5.6 Terra, но с включённым режимом `reasoning.mode` в значении `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra (batch)

Рассуждения

GPT-5.6 Terra — это сбалансированная модель из серии GPT-5.6, расположенная между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневного программирования, рассуждений и выполнения агентских задач.

от Контекст 1.05M60 ₽/Mвх359 ₽/Mвых
openai

OpenAI: GPT-5.6 Terra

Рассуждения

GPT-5.6 Terra — это сбалансированная модель из серии GPT-5.6, расположенная между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневного программирования, рассуждений и выполнения агентских задач.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol Pro (batch)

Рассуждения

GPT-5.6 Sol Pro — это та же базовая модель, что и GPT-5.6 Sol, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M60 ₽/Mвх299 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol Pro

Рассуждения

GPT-5.6 Sol Pro использует ту же базовую модель, что и GPT-5.6 Sol, но с включённым режимом `reasoning.mode` установленным на `pro` для получения более качественных ответов на сложные задачи.

от Контекст 1.05M120 ₽/Mвх598 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol (batch)

Рассуждения

GPT-5.6 Sol — это флагманская модель серии GPT-5.6. Она предназначена для сложных рассуждений, программирования и агентных рабочих процессов, особенно хорошо справляется с задачами командной строки и многошаговым программированием.

от Контекст 1.05M60 ₽/Mвх299 ₽/Mвых
openai

OpenAI: GPT-5.6 Sol

Рассуждения

GPT-5.6 Sol — это флагманская модель серии GPT-5.6. Она предназначена для сложных рассуждений, программирования и агентных рабочих процессов, особенно хорошо справляется с задачами командной строки и многошаговым кодированием.

от Контекст 1.05M120 ₽/Mвх598 ₽/Mвых
openai

OpenAI: GPT-5.5 Pro (batch)

Рассуждения

GPT-5.5 Pro — это высокопроизводительная модель, оптимизированная для глубокого анализа и точности при работе с комплексными и критически важными задачами. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M828 ₽/Mвх4 968 ₽/Mвых
openai

OpenAI: GPT-5.5 Pro

Рассуждения

GPT-5.5 Pro — это высокопроизводительная модель, разработанная для глубокого анализа и высокой точности при работе с комплексными и критически важными задачами. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M1 656 ₽/Mвх9 936 ₽/Mвых
openai

OpenAI: GPT-5.5 (batch)

Рассуждения

GPT-5.5 — передовая модель, разработанная для сложных профессиональных задач, основанная на GPT-5.4 с улучшенными возможностями рассуждения, повышенной надежностью и улучшенной эффективностью обработки токенов при выполнении сложных заданий. Модель поддерживает работу с более чем 1 миллионом токенов.

от Контекст 1.05M150 ₽/Mвх897 ₽/Mвых
openai

OpenAI: GPT-5.5

Рассуждения

GPT-5.5 — передовая модель, разработанная для сложных профессиональных задач, основанная на GPT-5.4 с улучшенными возможностями рассуждения, повышенной надежностью и улучшенной эффективностью обработки токенов при выполнении сложных заданий. Модель поддерживает работу с более чем 1 миллионом токенов.

от Контекст 1.05M288 ₽/Mвх1 725 ₽/Mвых
xiaomi

Xiaomi: MiMo-V2.5-Pro

Рассуждения

MiMo-V2.5-Pro — флагманская модель Xiaomi, демонстрирующая высокую производительность в общих агентных задачах, сложном программном инжиниринге и долгосрочных проектах, занимая лидирующие позиции в бенчмарках, таких как ClawEval, GDPVal и SWE-bench Pro.

от Контекст 1.05M38 ₽/Mвх76 ₽/Mвых
xiaomi

Xiaomi: MiMo-V2.5

Рассуждения

MiMo-V2.5 — это нативная омнимодальная модель от Xiaomi. Она обеспечивает производительность уровня Pro для агентных задач примерно за половину стоимости вывода, при этом превосходя MiMo-V2-Omni в мультимодальном восприятии при анализе изображений и видео.

от Контекст 1.05M15 ₽/Mвх30 ₽/Mвых
openai

OpenAI: GPT-5.4 Pro (batch)

Рассуждения

GPT-5.4 Pro — самая продвинутая модель, основанная на единой архитектуре GPT-5.4 с улучшенными возможностями рассуждения для выполнения сложных и ответственных задач. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных).

от Контекст 1.05M828 ₽/Mвх4 968 ₽/Mвых
openai

OpenAI: GPT-5.4 Pro

Рассуждения

GPT-5.4 Pro — самая продвинутая модель OpenAI, построенная на унифицированной архитектуре GPT-5.4 с улучшенными способностями к рассуждению для сложных, критически важных задач. Она оснащена контекстным окном в 1M+ токенов (922K входных, 128K выходных) с поддержкой текстовых и изображений входных данных. Оптимизирована для пошагового рассуждения, следования инструкциям и точности, GPT-5.4 Pro отлично справляется с агентным кодированием, рабочими процессами с длинным контекстом и решением многошаговых задач.

от Контекст 1.05M1 656 ₽/Mвх9 936 ₽/Mвых
openai

OpenAI: GPT-5.4 (batch)

Рассуждения

GPT-5.4 — это новейшая модель компании OpenAI, объединяющая линии Codex и GPT в единую систему. Модель поддерживает контекстное окно более 1 миллиона токенов (922 тысячи входных, 128 тысяч выходных) с возможностью...

от Контекст 1.05M75 ₽/Mвх449 ₽/Mвых
openai

OpenAI: GPT-5.4

Рассуждения

GPT-5.4 — это последняя флагманская модель OpenAI, объединяющая линии Codex и GPT в единую систему. Она оснащена контекстным окном более 1 млн токенов (922 тыс. входных, 128 тыс. выходных) и поддерживает текстовые и изображенные входные данные, что позволяет выполнять высококонтекстное рассуждение, программирование и мультимодальный анализ в рамках одного рабочего процесса. Модель демонстрирует улучшенные результаты в программировании, анализе документов, использовании инструментов и следовании инструкциям. Она разработана как надежный выбор как для общих задач, так и для разработки программного обеспечения, способна генерировать код промышленного качества, синтезировать информацию из множественных источников и выполнять сложные многошаговые рабочие процессы с меньшим количеством итераций и большей эффективностью использования токенов.

от Контекст 1.05M150 ₽/Mвх897 ₽/Mвых
meituan

Meituan: LongCat 2.0

Рассуждения

LongCat 2.0 — это языковая модель с разреженной смесью экспертов от Meituan, имеющая 48 миллиардов активных параметров из общего числа 1,6 триллиона. Она подходит для программирования, изменений на уровне репозиториев, решения задач с длительным горизонтом и агентных приложений.

от Контекст 1.05M38 ₽/Mвх150 ₽/Mвых
meta

Meta: Muse Spark 1.2 Contributor

РассужденияНовая

Muse Spark 1.2 contributor tier — это модель рассуждения от Meta, предназначенная для разработчиков, которые хотят начать создавать проекты с еще меньшими затратами. Она значительно дешевле, чем Muse Spark...

от Контекст 1.05M13 ₽/Mвх25 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Flash Vision Exp

РассужденияНовая

DeepSeek V4 Flash Vision Exp — экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой обработки изображений, которая добавляет возможности понимания изображений при сохранении базовых текстовых функций модели, включая работу с агентами.

от Контекст 1.05M28 ₽/Mвх82 ₽/Mвых
z-ai

Z.ai: GLM 5.3

Удаляется 31 декабря
Рассуждения

GLM-5.3 — это масштабная модель рассуждений от Z.ai, разработанная для сложных задач в области программной инженерии и долгосрочного планирования агентов. Модель поддерживает ввод и вывод текста с контекстным окном размером 1 миллион токенов и обеспечивает улучшенную производительность в соответствующих задачах.

от Контекст 1.05M168 ₽/Mвх527 ₽/Mвых
google

Google: Gemini 3.7 Flash

Рассуждения

Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.

от Контекст 1.05M24 ₽/Mвх117 ₽/Mвых
google

Google: Gemini 3.7 Flash (batch)

Рассуждения

Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.

от Контекст 1.05M24 ₽/Mвх117 ₽/Mвых
qwen

Qwen: Qwen3.8 2.4T A95B

Рассуждения

Qwen3.8 2.4T A95B — это модель с открытыми весами, использующая разреженную смесь экспертов, разработанная Qwen. Она является вариантом Qwen3.8 Max с открытыми весами и содержит 95 миллиардов активных параметров из общего числа 2,4 триллиона. Модель предназначена для...

от Контекст 1.05M240 ₽/Mвх718 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Pro 0813

Рассуждения

DeepSeek V4 Pro 0813 — это крупномасштабная модель с архитектурой mixture-of-experts от DeepSeek. Это стабильный релиз DeepSeek V4 Pro.

от Контекст 1.05M70 ₽/Mвх209 ₽/Mвых
meta

Meta: Muse Spark 1.2

Рассуждения

Muse Spark 1.2 — это модель рассуждения от Meta, предназначенная для выполнения сложных агентных задач. Она принимает текст, изображения, видео, аудио и PDF-документы, возвращает текст и поддерживает контекст объемом до 1 миллиона токенов.

от Контекст 1.05M150 ₽/Mвх509 ₽/Mвых
thinkingmachines

Thinking Machines: Inkling Small (Бесплатно)

Рассуждения

Inkling Small — это мультимодальная модель с открытым весом и смесью экспертов от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представлена как более компактная и эффективная версия модели...

от Контекст 1.05MБесплатновхБесплатновых
thinkingmachines

Thinking Machines: Inkling Small

Рассуждения

Inkling Small — это мультимодальная модель с открытым весом и архитектурой mixture-of-experts от Thinking Machines Lab, содержащая 12 миллиардов активных параметров из общего числа 276 миллиардов. Она представлена как более компактная и эффективная версия модели.

от Контекст 1.05M56 ₽/Mвх150 ₽/Mвых
poolside

Poolside: Laguna S 2.1

Рассуждения

Laguna S 2.1 — это последняя модель агента для программирования от Poolside. Laguna S 2.1 имеет в общей сложности 118 миллиардов параметров, из которых 8 миллиардов активных. Модель достигает результата 70,2% на тесте Terminal-Bench 2.1.

от Контекст 1.05M12 ₽/Mвх23 ₽/Mвых
google

Google: Gemini 3.6 Flash (batch)

Рассуждения

Gemini 3.6 Flash — это высокоэффективная модель от Google, предназначенная для программирования, агентных рабочих процессов, а также разработки веб-сайтов и приложений. Модель создана для генерации качественных результатов с минимальным количеством лишних правок и...

от Контекст 1.05M45 ₽/Mвх225 ₽/Mвых
google

Google: Gemini 3.6 Flash

Рассуждения

Gemini 3.6 Flash — это высокоэффективная модель от Google, предназначенная для программирования, агентных рабочих процессов, а также разработки веб-сайтов и приложений. Модель создана для генерации качественных результатов с минимальным количеством лишних правок и...

от Контекст 1.05M45 ₽/Mвх225 ₽/Mвых
google

Google: Gemini 3.5 Flash Lite (batch)

Рассуждения

Gemini 3.5 Flash Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих специализированные задачи в рамках сложных многоагентных рабочих процессов.

от Контекст 1.05M19 ₽/Mвх156 ₽/Mвых
google

Google: Gemini 3.5 Flash Lite

Рассуждения

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих специализированные задачи в рамках сложных многоагентных рабочих процессов.

от Контекст 1.05M19 ₽/Mвх156 ₽/Mвых
thinkingmachines

Thinking Machines: Inkling (Бесплатно)

Рассуждения

Inkling — это мультимодальная модель с открытым весом и смесью экспертов от Thinking Machines Lab, содержащая 41 миллиард активных параметров из общего числа 975 миллиардов. Она предназначена для универсального рассуждения, программирования, создания агентных систем и использования инструментов.

от Контекст 1.05MБесплатновхБесплатновых
thinkingmachines

Thinking Machines: Inkling

Рассуждения

Inkling — это мультимодальная модель с открытыми весами и архитектурой mixture-of-experts от Thinking Machines Lab, содержащая 41 миллиард активных параметров из общего числа 975 миллиардов. Модель предназначена для универсального рассуждения, программирования, создания агентных систем и использования инструментов.

от Контекст 1.05M114 ₽/Mвх485 ₽/Mвых
moonshotai

MoonshotAI: Kimi K3

Рассуждения

Kimi K3 — это ультра-масштабная мультимодальная модель с открытыми весами от Moonshot AI. Она предназначена для сложного программирования, работы с знаниями и долгосрочных агентных процессов, особенно хорошо справляется с навигацией...

от Контекст 1.05M294 ₽/Mвх1 467 ₽/Mвых
meta

Meta: Muse Spark 1.1

Рассуждения

Muse Spark 1.1 — это мультимодальная модель рассуждений от Meta, разработанная для выполнения агентных задач. Она принимает на вход текст, изображения, видео, аудио и PDF-документы и возвращает текст, поддерживая контекст до 1 миллиона токенов.

от Контекст 1.05M150 ₽/Mвх509 ₽/Mвых
z-ai

Z.ai: GLM 5.2

Рассуждения
#9 в рейтинге

GLM-5.2 — флагманская модель Z.ai для задач с длительным горизонтом. Обладая действительно применимым контекстным окном в 1 миллион токенов, она способна работать с инженерным контекстом на уровне проектов, выполнять длительные задачи с повышенной надежностью и следовать сложным инструкциям.

от Контекст 1.05M52 ₽/Mвх162 ₽/Mвых
minimax

MiniMax: MiniMax M3 (Бесплатно)

Рассуждения

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает ввод текста, изображений и видео с текстовым выводом, обладает контекстным окном на 1 миллион токенов и подходит для задач с длительным горизонтом, включая агентные системы и программирование.

от Контекст 1.05MБесплатновхБесплатновых
minimax

MiniMax: MiniMax M3

Рассуждения
#17 в рейтинге

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает ввод текста, изображений и видео с текстовым выводом, обладает контекстным окном на 1 миллион токенов и подходит для задач с длительным горизонтом, агентных систем, программирования и других применений.

от Контекст 1.05M29 ₽/Mвх120 ₽/Mвых
google

Google: Gemini 3.5 Flash (batch)

Рассуждения

Gemini 3.5 Flash — это высокоэффективная мультимодальная модель от Google, обеспечивающая уровень программирования и рассуждений, близкий к профессиональному, с высокой скоростью и эффективностью. Модель оптимизирована для высокой производительности в программировании и параллельном агентном выполнении задач.

от Контекст 1.05M90 ₽/Mвх539 ₽/Mвых
google

Google: Gemini 3.5 Flash

Рассуждения

Gemini 3.5 Flash is Google's high-efficiency multimodal model, bringing near-Pro level coding and reasoning at Flash-tier cost and speed. It is highly optimized for coding proficiency and parallel agentic execution...

от Контекст 1.05M90 ₽/Mвх539 ₽/Mвых
google

Google: Gemini 3.1 Flash Lite (batch)

Рассуждения

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google, оптимизированная для задач с низкой задержкой и высокой нагрузкой. Она поддерживает ввод текста, изображений, видео, аудио и PDF, и предназначена для легковесных агентских приложений.

от Контекст 1.05M16 ₽/Mвх94 ₽/Mвых
google

Google: Gemini 3.1 Flash Lite

Рассуждения

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google с общедоступным выпуском, оптимизированная для задач с низкой задержкой и высокой нагрузкой. Модель поддерживает ввод текста, изображений, видео, аудио и PDF, и предназначена для использования в легких агентских приложениях.

от Контекст 1.05M16 ₽/Mвх94 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Pro 0423

Рассуждения
#16 в рейтинге

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding,...

от Контекст 1.05M95 ₽/Mвх190 ₽/Mвых
deepseek

DeepSeek: DeepSeek V4 Flash 0423

Рассуждения
🥉 #3 в рейтинге

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...

от Контекст 1.05M9 ₽/Mвх20 ₽/Mвых
google

Google: Gemini 3.1 Flash Lite Preview

Рассуждения

Gemini 3.1 Flash Lite Preview — это высокоэффективная модель Google, оптимизированная для задач с высоким объемом использования. Она превосходит Gemini 2.5 Flash Lite по общему качеству и приближается к производительности Gemini 2.5 Flash по ключевым возможностям. Улучшения охватывают аудиовход/ASR, ранжирование фрагментов RAG, перевод, извлечение данных и завершение кода. Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для точной настройки компромисса между стоимостью и производительностью. Стоит в два раза дешевле Gemini 3 Flash.

от Контекст 1.05M16 ₽/Mвх94 ₽/Mвых
google

Google: Gemini 3.1 Pro Preview Custom Tools

Рассуждения

Gemini 3.1 Pro Preview Custom Tools — это специализированная версия модели Gemini 3.1 Pro, в которой оптимизирован механизм выбора инструментов. Модель реже использует стандартный bash-инструмент в тех случаях, когда доступны более эффективные сторонние или пользовательские функции. Этот предварительный эндпоинт на alltokens значительно повышает надежность вызова функций и гарантирует, что модель выберет наиболее подходящий инструмент в сценариях с кодинг-агентами и сложными рабочими процессами, включающими множество инструментов. Модель сохраняет все ключевые преимущества Gemini 3.1 Pro, включая мультимодальное рассуждение при работе с текстом, изображениями, видео, аудио и кодом, контекстное окно объемом 1 миллион токенов и высокую производительность в задачах разработки программного обеспечения.

от Контекст 1.05M230 ₽/Mвх1 380 ₽/Mвых
google

Google: Gemini 3.1 Pro Preview (batch)

Рассуждения

Gemini 3.1 Pro Preview — это передовая модель рассуждений от Google, обеспечивающая улучшенную производительность в области программной инженерии, повышенную надежность агентов и более эффективное использование токенов в сложных рабочих процессах. Модель основана на мультимодальной платформе...

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых
google

Google: Gemini 3.1 Pro Preview

Рассуждения

Gemini 3.1 Pro Preview — это передовая модель Google с расширенными возможностями рассуждения, обеспечивающая повышенную производительность в разработке программного обеспечения, надежность работы агентов и эффективное использование токенов в сложных рабочих процессах. Основанная на мультимодальной базе серии Gemini 3, она сочетает в себе высокоточное логическое мышление при работе с текстом, изображениями, видео, аудио и кодом с контекстным окном в 1 миллион токенов. При использовании многошагового вызова инструментов на alltokens необходимо сохранять детали рассуждений. Обновление 3.1 демонстрирует измеримый рост в тестах SWE и реальных средах программирования, а также более уверенное выполнение автономных задач в структурированных областях, таких как финансы и работа с электронными таблицами. Разработанная для продвинутой разработки и агентных систем, Gemini 3.1 Pro Preview улучшает стабильность при выполнении длительных задач и оркестрацию инструментов, одновременно повышая эффективность расхода токенов. В модели представлен новый средний уровень мышления для оптимального баланса стоимости, скорости и производительности. Модель отлично справляется с написанием кода через агентов, структурированным планированием, мультимодальным анализом и автоматизацией рабочих процессов, что делает ее подходящей для автономных агентов, финансового моделирования, автоматизации таблиц и корпоративных задач с большим объемом контекста.

от Контекст 1.05M120 ₽/Mвх718 ₽/Mвых

Похожие модели внутри подборки

Быстрые связки для углубленного сравнения: по цене, контексту и поддерживаемым API-параметрам.

FAQ

Какие признаки у хорошей модели для кодинга?

Практически важны reasoning, стабильность следования инструкциям, поддержка инструментов и длинный контекст.

Почему в подборке есть разные провайдеры?

Потому что для разных задач (быстрая генерация, сложный рефакторинг, агентный цикл) лучшие модели различаются.

Смежные подборки

Лучшие для задач

Новости по теме

МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru