Alltokens

Новости

Новые модели, обновления цен и улучшения возможностей.

Подборки моделей

Inclusionai21 апреля 2026 г.

inclusionAI: Ling-2.6-flash

Ling-2.6-flash — это высокопроизводительная модель с архитектурой MoE, оптимизированная для работы в качестве автономного агента. Благодаря 7.4 млрд активных параметров она обеспечивает мгновенный отклик и высокую точность при выполнении сложных инструкций.

Вход: 2 ₽/MВыход: 4 ₽/M
ТехнологииПрограммирование+1
Читать →
Inclusionai23 июля 2026 г.

Ling-3.0-flash

Ling-3.0-flash — это высокоэффективная модель на архитектуре Mixture-of-Experts с 124 миллиардами параметров, из которых активно используется лишь 5.1 миллиарда на токен. Она оптимизирована для масштабного развертывания ИИ-агентов и обеспечивает высокую скорость генерации при работе с контекстом до 128k токенов.

Вход: 3 ₽/MВыход: 8 ₽/M
ТехнологииПрограммирование+2
Читать →
Nex-agi24 июня 2026 г.

Nex AGI: Nex-N2-Mini

Nex-N2-Mini — это компактная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для работы в качестве автономного агента. Она поддерживает обработку текста и изображений, предлагая внушительное контекстное окно для решения сложных задач в программировании и анализе данных.

Вход: 4 ₽/MВыход: 13 ₽/M
ПрограммированиеТехнологии+2
Читать →
Upstage10 августа 2026 г.

Upstage: Solar Pro 4

Solar Pro 4 от Upstage — это мощная языковая модель с внушительным контекстным окном в 524 тысячи токенов, оптимизированная для сложных офисных задач и программирования. Она демонстрирует высокую эффективность в агентских сценариях и при работе с объемными документами.

Вход: 4 ₽/MВыход: 15 ₽/M
ПрограммированиеТехнологии+2
Читать →
Ibm-granite30 апреля 2026 г.

IBM: Granite 4.1 8B

IBM Granite 4.1 8B — это компактная и эффективная языковая модель, оптимизированная для корпоративных задач и работы с длинными контекстами до 131 тысячи токенов. Она демонстрирует высокую точность в структурировании данных и использовании инструментов, что делает её надежным решением для автоматизации бизнес-процессов.

Вход: 7 ₽/MВыход: 13 ₽/M
ТехнологииФинансы+2
Читать →
QwenQwen27 июля 2026 г.

Qwen: Qwen3.7 Flash

Qwen3.7 Flash — это высокопроизводительная мультимодальная модель от Alibaba, специализирующаяся на визуальном анализе и логических рассуждениях. Она отлично справляется с распознаванием объектов, пространственным ориентированием и сложным взаимодействием с компьютерными интерфейсами.

Вход: 4 ₽/MВыход: 17 ₽/M
ТехнологииПрограммирование+2
Читать →
Poolside02 июля 2026 г.

Poolside: Laguna XS 2.1

Laguna XS 2.1 — это специализированная модель-агент для программирования в категории 33B-A3B, предлагающая значительное улучшение производительности по сравнению с предыдущими версиями. Благодаря контекстному окну в 262 144 токена, она эффективно справляется с анализом крупных кодовых баз и сложными задачами разработки.

Вход: 8 ₽/MВыход: 15 ₽/M
ПрограммированиеТехнологии+1
Читать →
Rekaai20 марта 2026 г.

Reka Edge

Reka Edge — это высокоэффективная мультимодальная модель на 7 миллиардов параметров, специализирующаяся на глубоком анализе изображений и видео. Она демонстрирует отличные результаты в распознавании объектов и работе в качестве автономного агента с использованием инструментов.

Вход: 13 ₽/MВыход: 13 ₽/M
ТехнологииНаука+1
Читать →
DeepseekDeepseek24 апреля 2026 г.

DeepSeek: DeepSeek V4 Flash 0423

DeepSeek V4 Flash — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для мгновенного отклика. Благодаря поддержке контекстного окна в 1 миллион токенов, она идеально подходит для обработки сверхдлинных документов и сложного анализа данных.

Вход: 9 ₽/MВыход: 21 ₽/M
ПрограммированиеТехнологии+3
Читать →
DeepseekDeepseek31 июля 2026 г.

DeepSeek: DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для задач программирования и логических рассуждений. Благодаря огромному контекстному окну в 1 миллион токенов, она эффективно справляется с анализом масштабных кодовых баз и сложными агентскими сценариями.

Вход: 10 ₽/MВыход: 21 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia11 августа 2026 г.

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для быстрой генерации ответов. Благодаря 3 миллиардам активных параметров она идеально подходит для работы в составе ИИ-агентов и выполнения специализированных задач с высокой пропускной способностью.

Вход: 7 ₽/MВыход: 25 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen10 марта 2026 г.

Qwen: Qwen3.5-9B

Qwen3.5-9B — это эффективная мультимодальная модель, объединяющая возможности обработки текста, изображений и видео в компактной архитектуре. Благодаря раннему слиянию токенов и контекстному окну в 262 144 токена, она демонстрирует высокие результаты в логических рассуждениях и программировании.

Вход: 13 ₽/MВыход: 19 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia14 декабря 2025 г.

NVIDIA: Nemotron 3 Nano 30B A3B

NVIDIA Nemotron 3 Nano 30B A3B — это компактная и эффективная MoE-модель с открытыми весами, оптимизированная для создания специализированных агентных систем. Благодаря поддержке контекста до 262 144 токенов и высокой вычислительной точности, она идеально подходит для развертывания в частной инфраструктуре.

Вход: 7 ₽/MВыход: 25 ₽/M
ТехнологииПрограммирование+2
Читать →
Poolside21 июля 2026 г.

Poolside: Laguna S 2.1

Laguna S 2.1 — это специализированная модель для программирования с архитектурой MoE, обладающая 118 млрд параметров. Она демонстрирует высокие результаты в тестах Terminal-Bench и поддерживает внушительное контекстное окно объемом более миллиона токенов.

Вход: 12 ₽/MВыход: 23 ₽/M
ПрограммированиеТехнологии+1
Читать →
Tencent22 апреля 2026 г.

Tencent: Hy3 preview

Tencent Hy3 Preview — это высокоэффективная модель на архитектуре Mixture-of-Experts, оптимизированная для работы в агентских сценариях. Она поддерживает гибкую настройку уровней рассуждения, что позволяет адаптировать её под задачи разной сложности в производственных средах.

Вход: 8 ₽/MВыход: 27 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen25 февраля 2026 г.

Qwen: Qwen3.5-Flash

Qwen3.5-Flash — это быстрая мультимодальная модель на базе гибридной архитектуры с линейным вниманием и MoE. Она обеспечивает мгновенный отклик при работе с текстом, изображениями и видео, поддерживая контекст до 1 миллиона токенов.

Вход: 9 ₽/MВыход: 33 ₽/M
ТехнологииПрограммирование+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna Pro (batch)

GPT-5.6 Luna Pro в режиме batch представляет собой продвинутую модель с глубоким логическим выводом для обработки больших массивов данных. Благодаря огромному контекстному окну в 1,05 млн токенов, она идеально подходит для анализа сложной документации и мультимодальных задач.

Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это продвинутая версия модели Luna с активированным режимом глубокого рассуждения для решения сложнейших задач. Она поддерживает мультимодальный ввод данных и обладает внушительным контекстным окном в 1,05 миллиона токенов.

Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииНаука+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna (batch)

GPT-5.6 Luna (batch) — это высокопроизводительная модель, оптимизированная для обработки больших объемов данных с минимальными затратами. Она отлично справляется с классификацией, чатами и легкими агентскими сценариями, поддерживая мультимодальный ввод текста, изображений и файлов.

Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это высокопроизводительная модель от OpenAI, оптимизированная для задач с жесткими требованиями к скорости отклика. Она сочетает в себе продвинутые возможности рассуждения и огромный контекстный сектор, что делает её идеальной для обработки больших массивов данных и сложных агентских сценариев.

Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииМаркетинг+2
Читать →
OpenaiOpenai17 марта 2026 г.

OpenAI: GPT-5.4 Nano (batch)

GPT-5.4 Nano (batch) — это самая легкая и быстрая модель в семействе GPT-5.4, оптимизированная для обработки огромных массивов данных с минимальной задержкой. Она поддерживает мультимодальный ввод, включая текст и изображения, предлагая внушительное контекстное окно в 400 000 токенов для масштабных задач.

Вход: 7 ₽/MВыход: 39 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
GoogleGoogle03 апреля 2026 г.

Google: Gemma 4 26B A4B

Gemma 4 26B A4B — это эффективная мультимодальная модель от Google DeepMind, использующая архитектуру Mixture-of-Experts для быстрой обработки данных. Она поддерживает работу с текстом, изображениями и видео до 60 секунд, предлагая внушительное контекстное окно в 256K токенов.

Вход: 9 ₽/MВыход: 38 ₽/M
ТехнологииПрограммирование+2
Читать →
Bytedance-seed23 декабря 2025 г.

ByteDance Seed: Seed 1.6 Flash

Seed 1.6 Flash — это сверхбыстрая мультимодальная модель от ByteDance, поддерживающая глубокое мышление и анализ визуального контента. Благодаря контекстному окну в 256k токенов, она эффективно справляется с обработкой объемных документов и сложных медиафайлов.

Вход: 10 ₽/MВыход: 38 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
MistralaiMistralai02 декабря 2025 г.

Mistral: Ministral 3 14B 2512

Ministral 3 14B — это флагманская модель в линейке Ministral, предлагающая производительность уровня Mistral Small 24B при более компактном размере. Она поддерживает мультимодальный ввод и обладает внушительным контекстным окном в 262 144 токена для обработки сложных данных.

Вход: 25 ₽/MВыход: 25 ₽/M
ТехнологииПрограммирование+2
Читать →
Stepfun29 января 2026 г.

StepFun: Step 3.5 Flash

Step 3.5 Flash — это высокопроизводительная модель на базе архитектуры Mixture of Experts (MoE), которая сочетает огромный объем знаний с высокой скоростью работы. Благодаря активации всего 11 миллиардов параметров из 196 миллиардов, она обеспечивает мгновенные ответы и поддерживает внушительное контекстное окно в 256 тысяч токенов.

Вход: 13 ₽/MВыход: 38 ₽/M
ТехнологииПрограммирование+2
Читать →
Xiaomi22 апреля 2026 г.

Xiaomi: MiMo-V2.5

MiMo-V2.5 — это нативная мультимодальная модель от Xiaomi, обеспечивающая производительность уровня Pro-агентов. Она значительно превосходит предыдущие итерации в понимании изображений и видео, предлагая высокую эффективность при выполнении сложных задач.

Вход: 18 ₽/MВыход: 35 ₽/M
ТехнологииНаука+2
Читать →
GoogleGoogle02 апреля 2026 г.

Google: Gemma 4 31B

Gemma 4 31B — это мощная мультимодальная модель от Google DeepMind, поддерживающая работу с текстом и изображениями. Благодаря внушительному контекстному окну в 256K токенов и настраиваемому режиму рассуждений, она отлично справляется со сложным программированием и анализом объемных документов.

Вход: 10 ₽/MВыход: 43 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia11 марта 2026 г.

NVIDIA: Nemotron 3 Super

NVIDIA Nemotron 3 Super — это гибридная MoE-модель на 120 млрд параметров, использующая архитектуру Mamba-Transformer для высокой эффективности. Она оптимизирована для сложных мультиагентных систем и демонстрирует выдающиеся результаты в программировании и логическом планировании.

Вход: 11 ₽/MВыход: 45 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai19 января 2026 г.

Z.ai: GLM 4.7 Flash

Z.ai: GLM 4.7 Flash — это высокопроизводительная модель класса 30B, оптимизированная для задач программирования и сложного планирования. Благодаря внушительному контекстному окну более 200 тысяч токенов, она эффективно справляется с анализом объемных документов и разработкой комплексных ИИ-агентов.

Вход: 8 ₽/MВыход: 50 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed26 февраля 2026 г.

ByteDance Seed: Seed-2.0-Mini

Seed-2.0-Mini — это легковесная мультимодальная модель от ByteDance, оптимизированная для задач с высокой нагрузкой и жесткими требованиями к скорости ответа. Она поддерживает контекст до 256k токенов и предлагает четыре режима сложности рассуждений для гибкого управления ресурсами.

Вход: 13 ₽/MВыход: 50 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Tencent06 июля 2026 г.

Tencent: Hy3

Tencent Hy3 — это мощная модель на архитектуре Mixture-of-Experts с 295 миллиардами параметров, оптимизированная для сложных рассуждений и работы в качестве ИИ-агента. Благодаря поддержке настраиваемого уровня логических размышлений и огромному контекстному окну, она эффективно справляется с масштабными производственными задачами.

Вход: 16 ₽/MВыход: 66 ₽/M
ТехнологииПрограммирование+2
Читать →
Inclusionai08 мая 2026 г.

inclusionAI: Ring-2.6-1T

Ring-2.6-1T — это масштабная модель с архитектурой мышления, оптимизированная для сложных агентных рабочих процессов и написания кода. Благодаря 63 миллиардам активных параметров и внушительному контекстному окну, она обеспечивает высокую эффективность в решении многоступенчатых задач и интеграции с инструментами.

Вход: 10 ₽/MВыход: 78 ₽/M
ПрограммированиеТехнологии+2
Читать →
Inclusionai23 апреля 2026 г.

inclusionAI: Ling-2.6-1T

Ling-2.6-1T — это флагманская модель с триллионом параметров, оптимизированная для работы в качестве быстрого ИИ-агента. Она сочетает в себе огромную вычислительную мощность с высокой скоростью исполнения, что делает её подходящей для масштабных корпоративных задач.

Вход: 10 ₽/MВыход: 78 ₽/M
ТехнологииПрограммирование+2
Читать →
OpenaiOpenai17 марта 2026 г.

OpenAI: GPT-5.4 Nano

GPT-5.4 Nano — это самая легкая и экономичная модель в семействе GPT-5.4, оптимизированная для задач с критическими требованиями к скорости. Она поддерживает мультимодальный ввод и идеально подходит для классификации данных, извлечения информации и работы в составе распределенных агентских систем.

Вход: 13 ₽/MВыход: 78 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Kwaipilot10 июля 2026 г.

Kwaipilot: KAT-Coder-Air V2.5

KAT-Coder-Air V2.5 — это флагманская агентная модель, специально разработанная для автономного решения сложных задач программирования. Она способна самостоятельно анализировать бизнес-процессы, находить проблемные места в коде и вносить необходимые исправления в рамках всего проекта.

Вход: 19 ₽/MВыход: 75 ₽/M
ПрограммированиеТехнологии+1
Читать →
Minimax31 мая 2026 г.

MiniMax: MiniMax M3 (batch)

MiniMax M3 — это мощная мультимодальная модель, способная обрабатывать текст, изображения и видео с впечатляющим контекстным окном. Она оптимизирована для решения сложных агентских задач, написания кода и анализа объемных данных в пакетном режиме через alltokens.

Вход: 19 ₽/MВыход: 75 ₽/M
ПрограммированиеТехнологии+2
Читать →
MistralaiMistralai16 марта 2026 г.

Mistral: Mistral Small 4

Mistral Small 4 — это универсальная мультимодальная модель, объединяющая возможности анализа текста, обработки изображений и продвинутого написания кода. Благодаря интеграции наработок линеек Pixtral и Devstral, она эффективно справляется со сложными агентными задачами в рамках единого рабочего процесса.

Вход: 19 ₽/MВыход: 75 ₽/M
ПрограммированиеТехнологии+2
Читать →
Upstage27 января 2026 г.

Upstage: Solar Pro 3

Solar Pro 3 — это мощная модель на архитектуре Mixture-of-Experts (MoE) от Upstage, использующая 12 млрд активных параметров из 102 млрд. Она обеспечивает высокую производительность и эффективность, предлагая расширенную поддержку корейского, английского и японского языков.

Вход: 19 ₽/MВыход: 75 ₽/M
ТехнологииПеревод+1
Читать →
GoogleGoogle07 мая 2026 г.

Google: Gemini 3.1 Flash Lite (batch)

Gemini 3.1 Flash Lite (batch) — это высокоэффективная мультимодальная модель, оптимизированная для пакетной обработки огромных массивов данных. Она поддерживает работу с текстом, изображениями, видео и аудио, предлагая внушительное контекстное окно в 1 миллион токенов для сложных аналитических задач.

Вход: 16 ₽/MВыход: 94 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
GoogleGoogle07 мая 2026 г.

Google: Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель от Google, оптимизированная для задач с минимальной задержкой и большими объемами данных. Она поддерживает работу с текстом, изображениями, видео, аудио и PDF, предлагая контекстное окно в 1 миллион токенов для сложных агентских сценариев.

Вход: 16 ₽/MВыход: 94 ₽/M
ТехнологииПрограммирование+2
Читать →
GoogleGoogle03 марта 2026 г.

Google: Gemini 3.1 Flash Lite Preview

Gemini 3.1 Flash Lite Preview — это высокоэффективная модель от Google, оптимизированная для массовых задач с поддержкой мультимодальных данных. Она превосходит версию 2.5 Flash Lite по качеству и предлагает гибкую настройку уровней «мышления» для баланса между стоимостью и производительностью.

Вход: 16 ₽/MВыход: 94 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen04 февраля 2026 г.

Qwen: Qwen3 Coder Next

Qwen3 Coder Next — это специализированная языковая модель с открытыми весами, оптимизированная для задач программирования и локальной разработки. Благодаря архитектуре MoE с 80 миллиардами параметров, из которых активны только 3 миллиарда, она обеспечивает высокую скорость работы при сохранении глубокой экспертизы в кодинге.

Вход: 15 ₽/MВыход: 100 ₽/M
ПрограммированиеТехнологии+1
Читать →
Inception04 марта 2026 г.

Inception: Mercury 2

Mercury 2 — это инновационная диффузионная модель (dLLM), обеспечивающая рекордную скорость генерации свыше 1000 токенов в секунду. Она сочетает в себе глубокие рассуждения с параллельной обработкой данных, что делает её в 5 раз быстрее конкурентов при низкой стоимости эксплуатации.

Вход: 32 ₽/MВыход: 94 ₽/M
ПрограммированиеТехнологии+2
Читать →
Arcee-ai01 апреля 2026 г.

Arcee AI: Trinity Large Thinking

Trinity Large Thinking — это мощная open-source модель от Arcee AI, оптимизированная для сложных рассуждений и агентных сценариев. Она демонстрирует высокие результаты в бенчмарке PinchBench и поддерживает внушительное контекстное окно в 262 тысячи токенов.

Вход: 28 ₽/MВыход: 100 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.6 35B A3B

Qwen3.6-35B-A3B — это мультимодальная модель от Alibaba Cloud, использующая гибридную архитектуру Mixture-of-Experts для эффективной обработки текста, изображений и видео. Благодаря 35 миллиардам общих параметров и огромному контекстному окну, она обеспечивает высокую точность анализа сложных визуальных и текстовых данных.

Вход: 13 ₽/MВыход: 118 ₽/M
ТехнологииНаука+2
Читать →
Minimax12 февраля 2026 г.

MiniMax: MiniMax M2.5

MiniMax M2.5 — это передовая языковая модель, оптимизированная для офисной продуктивности и сложного программирования. Она демонстрирует выдающиеся результаты в работе с документами Word, Excel и PowerPoint, а также эффективно управляет контекстом при переключении между различными программными средами.

Вход: 28 ₽/MВыход: 112 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen25 февраля 2026 г.

Qwen: Qwen3.5-35B-A3B

Qwen3.5-35B-A3B — это инновационная мультимодальная модель, использующая гибридную архитектуру с линейным вниманием и механизмом Mixture-of-Experts (MoE). Она обеспечивает высокую эффективность инференса и поддерживает обработку текста, изображений и видео в рамках огромного контекстного окна.

Вход: 18 ₽/MВыход: 125 ₽/M
ТехнологииНаука+2
Читать →
Minimax31 мая 2026 г.

MiniMax: MiniMax M3

MiniMax M3 — это мощная мультимодальная модель, способная обрабатывать текст, изображения и видео с впечатляющим контекстным окном в 1 миллион токенов. Она оптимизирована для решения сложных задач программирования и длительной работы в режиме автономного агента.

Вход: 29 ₽/MВыход: 120 ₽/M
ПрограммированиеТехнологии+2
Читать →
Minimax18 марта 2026 г.

MiniMax: MiniMax M2.7

MiniMax M2.7 — это передовая языковая модель, ориентированная на автономную работу и решение сложных производственных задач через мультиагентное взаимодействие. Она демонстрирует высокие результаты в отладке кода, финансовом моделировании и создании полноценных документов в форматах Word, Excel и PowerPoint.

Вход: 30 ₽/MВыход: 120 ₽/M
ПрограммированиеФинансы+2
Читать →
Z-ai08 декабря 2025 г.

Z.ai: GLM 4.6V

GLM-4.6V — это мощная мультимодальная модель, специализирующаяся на глубоком анализе визуального контента и работе с длинными контекстами до 128K токенов. Она отлично справляется с распознаванием сложных макетов документов, анализом видео и извлечением данных из смешанных медиа-форматов.

Вход: 38 ₽/MВыход: 112 ₽/M
ТехнологииНаука+2
Читать →
Nex-agi08 июня 2026 г.

Nex AGI: Nex-N2-Pro

Nex-N2-Pro — это продвинутая мультимодальная модель на архитектуре Qwen3.5, использующая метод смеси экспертов (MoE) для эффективной обработки текста и изображений. Благодаря огромному контекстному окну в 262 144 токена и поддержке логических рассуждений, она отлично подходит для работы со сложными агентскими сценариями.

Вход: 32 ₽/MВыход: 125 ₽/M
ТехнологииПрограммирование+2
Читать →
Xiaomi22 апреля 2026 г.

Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro — это флагманская модель от Xiaomi, оптимизированная для решения сложных инженерных задач и длительных рабочих циклов. Она демонстрирует выдающиеся результаты в бенчмарках на программирование и автономное выполнение агентских функций.

Вход: 50 ₽/MВыход: 109 ₽/M
ПрограммированиеТехнологии+2
Читать →
DeepseekDeepseek12 августа 2026 г.

DeepSeek: DeepSeek V4 Pro 0813

DeepSeek V4 Pro 0813 представляет собой масштабную модель на архитектуре Mixture-of-Experts, оптимизированную для сложных текстовых задач. Релиз GA обеспечивает высокую стабильность работы и поддержку огромного контекстного окна для обработки сверхдлинных документов.

Вход: 55 ₽/MВыход: 109 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.6 Flash

Qwen3.6 Flash — это высокопроизводительная мультимодальная модель от Alibaba, оптимизированная для мгновенной обработки данных. Она поддерживает работу с текстом, изображениями и видео, предлагая внушительное контекстное окно в 1 миллион токенов для анализа сверхбольших документов.

Вход: 24 ₽/MВыход: 140 ₽/M
ТехнологииПрограммирование+2
Читать →
DeepseekDeepseek24 апреля 2026 г.

DeepSeek: DeepSeek V4 Pro

DeepSeek V4 Pro — это масштабная модель на архитектуре Mixture-of-Experts с 1,6 трлн параметров, оптимизированная для сложного логического вывода и программирования. Благодаря рекордному контекстному окну в 1 миллион токенов, она способна обрабатывать огромные массивы данных и длинные цепочки рассуждений.

Вход: 55 ₽/MВыход: 109 ₽/M
ПрограммированиеТехнологии+2
Читать →
OpenaiOpenai17 марта 2026 г.

OpenAI: GPT-5.4 Mini (batch)

GPT-5.4 Mini (batch) — это высокопроизводительная модель, оптимизированная для обработки больших объемов данных с поддержкой мультимодальных входных данных. Она сочетает в себе продвинутые возможности рассуждения и кодинга с внушительным контекстным окном в 400 000 токенов.

Вход: 24 ₽/MВыход: 140 ₽/M
ПрограммированиеТехнологии+2
Читать →
Stepfun28 мая 2026 г.

StepFun: Step 3.7 Flash

Step 3.7 Flash — это высокоэффективная мультимодальная модель на базе архитектуры Mixture-of-Experts, предназначенная для быстрой обработки текста, изображений и видео. Благодаря контекстному окну в 256 000 токенов и нативному визуальному кодировщику, она обеспечивает глубокое понимание сложного контента при минимальных задержках.

Вход: 25 ₽/MВыход: 143 ₽/M
ТехнологииМаркетинг+2
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.5 Flash Lite (batch)

Gemini 3.5 Flash Lite (batch) — это высокоэффективная модель от Google, оптимизированная для пакетной обработки данных и работы в качестве субагентов. Она обладает улучшенными агентными способностями и поддерживает огромный контекст до 1 миллиона токенов, включая мультимодальные входные данные.

Вход: 19 ₽/MВыход: 156 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.5 Flash Lite

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентскими способностями. Она оптимизирована для работы в качестве субагента, выполняющего узкоспециализированные задачи внутри сложных многоагентных систем.

Вход: 19 ₽/MВыход: 156 ₽/M
ТехнологииПрограммирование+2
Читать →
MetaMeta09 августа 2026 г.

Meta: Muse Glimmer 30B

Meta: Muse Glimmer 30B — это компактная мультимодальная модель с открытыми весами, оптимизированная для работы автономных агентов на пользовательском оборудовании. Благодаря дистилляции из Muse Spark, она эффективно справляется с длительными задачами и анализом визуальных данных при контекстном окне в 128k токенов.

Вход: 38 ₽/MВыход: 150 ₽/M
ТехнологииПрограммирование+2
Читать →
Meituan20 июля 2026 г.

Meituan: LongCat 2.0

LongCat 2.0 — это мощная MoE-модель от Meituan с 1,6 трлн параметров, оптимизированная для работы с огромными контекстами до 1 млн токенов. Она демонстрирует высокую эффективность в программировании на уровне репозиториев и решении сложных многошаговых задач.

Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+2
Читать →
Kwaipilot27 марта 2026 г.

Kwaipilot: KAT-Coder-Pro V2

KAT-Coder-Pro V2 — это специализированная модель для корпоративной разработки ПО и интеграции SaaS-решений. Она оптимизирована для работы в масштабных продакшн-средах, поддерживает многосистемную координацию и генерацию эстетичных веб-интерфейсов.

Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+1
Читать →
Minimax23 января 2026 г.

MiniMax: MiniMax M2-her

MiniMax M2-her — это специализированная языковая модель, оптимизированная для глубокого ролевого взаимодействия и создания выразительных диалогов. Она отлично удерживает контекст персонажа и демонстрирует высокую последовательность в многоходовых беседах.

Вход: 38 ₽/MВыход: 150 ₽/M
Ролевые сценарииПеревод+1
Читать →
Minimax23 декабря 2025 г.

MiniMax: MiniMax M2.1

MiniMax M2.1 — это компактная и высокопроизводительная модель, специально оптимизированная для написания кода и создания автономных агентов. Несмотря на малый объем активируемых параметров, она демонстрирует выдающиеся результаты в разработке современных приложений и сложных рабочих процессах.

Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+1
Читать →
QwenQwen03 июня 2026 г.

Qwen: Qwen3.7 Plus

Qwen3.7 Plus представляет собой сбалансированное решение в линейке Alibaba, предлагающее расширенные возможности обработки текста и изображений. Модель выделяется огромным контекстным окном в 1 миллион токенов, что позволяет эффективно работать с лонгридами и сложными визуальными данными.

Вход: 40 ₽/MВыход: 159 ₽/M
ТехнологииПрограммирование+2
Читать →
Thinkingmachines30 июля 2026 г.

Thinking Machines: Inkling Small

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, использующая 12 миллиардов активных параметров. Она поддерживает обработку текста, изображений и аудио, предлагая внушительное контекстное окно объемом более 500 тысяч токенов.

Вход: 56 ₽/MВыход: 150 ₽/M
ТехнологииНаука+2
Читать →
Perceptron12 мая 2026 г.

Perceptron: Perceptron Mk1

Perceptron Mk1 — это флагманская мультимодальная модель, специализирующаяся на глубоком анализе видеоконтента и визуальном мышлении. Она эффективно объединяет обработку изображений и видео с естественным языком для создания детальных отчетов и логических выводов.

Вход: 19 ₽/MВыход: 187 ₽/M
ТехнологииНаука+1
Читать →
GoogleGoogle30 июня 2026 г.

Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)

Nano Banana 2 Lite — это самая быстрая и оптимизированная модель в линейке Gemini, предназначенная для мгновенной генерации изображений и визуального анализа. Она идеально подходит для разработчиков, которым требуется высокая пропускная способность и минимальные задержки при работе с мультимодальными данными.

Вход: 32 ₽/MВыход: 187 ₽/M
ТехнологииМаркетинг+2
Читать →
QwenQwen25 февраля 2026 г.

Qwen: Qwen3.5-27B

Qwen3.5-27B — это производительная мультимодальная модель с линейным механизмом внимания, обеспечивающим высокую скорость отклика. По своим возможностям она сопоставима с более крупной версией 122B, предлагая отличный баланс между эффективностью и качеством обработки визуальных данных.

Вход: 25 ₽/MВыход: 194 ₽/M
ТехнологииНаука+2
Читать →
GoogleGoogle17 декабря 2025 г.

Google: Gemini 3 Flash Preview (batch)

Gemini 3 Flash Preview (batch) — это высокоскоростная модель с продвинутым мышлением, оптимизированная для пакетной обработки данных и сложных агентских сценариев. Она сочетает в себе возможности рассуждения уровня Pro-моделей с огромным контекстным окном в 1 миллион токенов для анализа мультимодального контента.

Вход: 32 ₽/MВыход: 187 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle17 декабря 2025 г.

Google: Gemini 3 Flash Preview

Gemini 3 Flash Preview — это высокоскоростная модель нового поколения, оптимизированная для работы автономных агентов и сложных многоэтапных диалогов. Она сочетает в себе глубокое логическое мышление уровня Pro-версий с поддержкой огромного контекстного окна и мультимодальных данных.

Вход: 32 ₽/MВыход: 187 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen16 февраля 2026 г.

Qwen: Qwen3.5 Plus 2026-02-15

Qwen3.5 Plus — это передовая мультимодальная модель на гибридной архитектуре, сочетающая линейное внимание и разреженные MoE-слои для высокой эффективности. Она демонстрирует значительный скачок в качестве обработки текста, изображений и видео по сравнению с предыдущим поколением, достигая уровня топовых мировых решений.

Вход: 33 ₽/MВыход: 194 ₽/M
ТехнологииНаука+2
Читать →
Aion-labs07 июля 2026 г.

AionLabs: Aion-3.0-Mini

Aion-3.0-Mini — это специализированная мультимодельная система от AionLabs, построенная на базе архитектуры DeepSeek. Модель использует процесс совместной генерации несколькими специализированными агентами для достижения высокого качества в творческих задачах.

Вход: 84 ₽/MВыход: 168 ₽/M
Ролевые сценарииТехнологии+2
Читать →
Nvidia04 июня 2026 г.

NVIDIA: Nemotron 3 Ultra (batch)

NVIDIA Nemotron 3 Ultra — это мощная модель с архитектурой Mixture-of-Experts (MoE), сочетающая трансформеры и Mamba для эффективного рассуждения. Благодаря огромному контекстному окну более 500 тысяч токенов, она отлично справляется с анализом масштабных документов и сложной оркестрацией задач.

Вход: 36 ₽/MВыход: 216 ₽/M
ТехнологииНаука+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.5 Plus 2026-04-20

Qwen3.5 Plus — это мощная мультимодальная модель от Alibaba, способная обрабатывать текст, изображения и видео. Благодаря рекордному контекстному окну в 1 миллион токенов, она идеально подходит для анализа сверхдлинных документов и сложных медиафайлов.

Вход: 36 ₽/MВыход: 216 ₽/M
ТехнологииПрограммирование+2
Читать →
Z-ai22 декабря 2025 г.

Z.ai: GLM 4.7

Z.ai: GLM 4.7 — это флагманская модель с улучшенными возможностями программирования и стабильным многошаговым рассуждением. Она оптимизирована для выполнения сложных агентских задач и точного исполнения инструкций в рамках длинного контекста.

Вход: 48 ₽/MВыход: 210 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen16 февраля 2026 г.

Qwen: Qwen3.5 397B A17B

Qwen3.5 397B A17B — это мощная мультимодальная модель на базе гибридной архитектуры MoE и линейного внимания, обеспечивающая высокую эффективность инференса. Она демонстрирует передовые результаты в логическом мышлении, генерации кода и анализе видеоконтента.

Вход: 37 ₽/MВыход: 231 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed10 марта 2026 г.

ByteDance Seed: Seed-2.0-Lite

Seed-2.0-Lite — это сбалансированная модель от ByteDance, оптимизированная для высоконагруженных корпоративных задач с акцентом на экономическую эффективность. Она превосходит предыдущее поколение Seed-1.8, предлагая стабильную работу с длинным контекстом и качественную генерацию структурированных данных.

Вход: 30 ₽/MВыход: 240 ₽/M
ТехнологииМаркетинг+2
Читать →
QwenQwen02 апреля 2026 г.

Qwen: Qwen3.6 Plus

Qwen3.6 Plus — это передовая мультимодальная модель на базе гибридной архитектуры, объединяющей линейное внимание и разреженную структуру MoE. Она поддерживает обработку текста, изображений и видео с впечатляющим контекстным окном в 1 миллион токенов, обеспечивая высокую производительность в сложных задачах.

Вход: 39 ₽/MВыход: 234 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.6 27B

Qwen3.6 27B — это продвинутая мультимодальная модель от Alibaba, способная обрабатывать текст, изображения и видео. Благодаря внушительному контекстному окну в 262 тысячи токенов, она эффективно справляется с анализом длинных документов и сложных медиафайлов.

Вход: 35 ₽/MВыход: 240 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen25 февраля 2026 г.

Qwen: Qwen3.5-122B-A10B

Qwen3.5-122B-A10B — это продвинутая мультимодальная модель на базе гибридной архитектуры с линейным вниманием и MoE, обеспечивающая высокую эффективность инференса. Она превосходит предыдущие флагманы Qwen3 по текстовым и визуальным возможностям, занимая второе место в линейке по общей производительности.

Вход: 32 ₽/MВыход: 249 ₽/M
ТехнологииНаука+2
Читать →
Aion-labs23 февраля 2026 г.

AionLabs: Aion-2.0

Aion-2.0 — это специализированная версия DeepSeek V3.2, созданная для глубокого погружения в ролевые игры и сторителлинг. Модель мастерски создает напряжение и конфликты, обеспечивая высокую вовлеченность в повествование даже при работе со сложными и мрачными темами.

Вход: 96 ₽/MВыход: 192 ₽/M
Ролевые сценарииТехнологии+1
Читать →
Moonshotai27 января 2026 г.

MoonshotAI: Kimi K2.5

Kimi K2.5 — это передовая мультимодальная модель от Moonshot AI, обученная на колоссальном массиве данных в 15 триллионов токенов. Она выделяется исключительными способностями к визуальному программированию и поддержкой парадигмы автономных агентских систем.

Вход: 45 ₽/MВыход: 243 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai16 июня 2026 г.

Z.ai: GLM 5.2

GLM-5.2 — это флагманская модель от Z.ai, специально разработанная для выполнения сложных задач с длительным горизонтом планирования. Благодаря контекстному окну в 1 миллион токенов, она эффективно справляется с анализом масштабных инженерных проектов и надежным следованием инструкциям.

Вход: 60 ₽/MВыход: 237 ₽/M
ПрограммированиеТехнологии+2
Читать →
Moonshotai12 июня 2026 г.

MoonshotAI: Kimi K2.7 Code (batch)

Kimi K2.7 Code — это специализированная модель из семейства Kimi K2, оптимизированная для решения сложных задач программирования. Благодаря архитектуре Mixture-of-Experts и поддержке длинного контекста, она эффективно справляется с написанием кода и анализом мультимодальных данных.

Вход: 57 ₽/MВыход: 240 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai11 февраля 2026 г.

Z.ai: GLM 5

GLM-5 от Z.ai — это флагманская open-source модель, специально разработанная для проектирования сложных систем и длительных агентных рабочих процессов. Она ориентирована на экспертную разработку ПО, предлагая возможности автономного планирования и глубокого логического обоснования бэкенд-задач.

Вход: 72 ₽/MВыход: 230 ₽/M
ПрограммированиеТехнологии+2
Читать →
Thinkingmachines17 июля 2026 г.

Thinking Machines: Inkling (batch)

Inkling (batch) — это мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для пакетной обработки данных. Она обладает внушительным контекстным окном в 524 288 токенов и специализируется на сложных рассуждениях, программировании и работе с мультимедийным контентом.

Вход: 60 ₽/MВыход: 243 ₽/M
ТехнологииПрограммирование+2
Читать →
OpenaiOpenai17 марта 2026 г.

OpenAI: GPT-5.4 Mini

GPT-5.4 Mini — это высокопроизводительная модель, оптимизированная для быстрой обработки больших объемов данных с поддержкой текста и изображений. Она сочетает в себе продвинутые возможности рассуждения и кодинга с низкой задержкой, что делает её идеальной для масштабируемых производственных решений.

Вход: 45 ₽/MВыход: 270 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia04 июня 2026 г.

NVIDIA: Nemotron 3 Ultra

NVIDIA Nemotron 3 Ultra — это передовая модель с архитектурой Mixture-of-Experts (MoE), сочетающая трансформеры и Mamba для эффективного рассуждения. Благодаря контекстному окну в 1 миллион токенов, она отлично справляется со сложной оркестрацией и анализом масштабных данных.

Вход: 60 ₽/MВыход: 264 ₽/M
ТехнологииНаука+2
Читать →
AmazonAmazon02 декабря 2025 г.

Amazon: Nova 2 Lite

Amazon Nova 2 Lite — это высокопроизводительная мультимодальная модель, оптимизированная для быстрой обработки текста, изображений и видео. Благодаря контекстному окну в 1 миллион токенов, она эффективно справляется с анализом объемных документов и длинных видеороликов.

Вход: 36 ₽/MВыход: 299 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Z-ai16 июня 2026 г.

Z.ai: GLM 5.2 (batch)

GLM 5.2 от Z.ai — это мощная модель для сложных рассуждений с внушительным контекстным окном до 512 000 токенов. Она оптимизирована для длительных рабочих процессов, управления агентами и разработки программного обеспечения на уровне целых проектов.

Вход: 84 ₽/MВыход: 264 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed12 августа 2026 г.

ByteDance Seed: Seed 2.1 Turbo

Seed 2.1 Turbo от ByteDance — это мощная мультимодальная модель, оптимизированная для написания кода и выполнения сложных многоэтапных задач. Благодаря поддержке контекста до 262 144 токенов, она эффективно справляется с анализом длинных документов и визуального контента.

Вход: 60 ₽/MВыход: 299 ₽/M
ПрограммированиеТехнологии+2
Читать →
X-aiX-ai20 мая 2026 г.

SpaceXAI: Grok Build 0.1

Grok Build 0.1 — это специализированная модель от xAI, оптимизированная для агентной разработки программного обеспечения и интерактивного кодинга. Она поддерживает мультимодальный ввод данных и обладает внушительным контекстным окном в 256 000 токенов для работы со сложными проектами.

Вход: 120 ₽/MВыход: 240 ₽/M
ПрограммированиеТехнологии+1
Читать →
OpenaiOpenai19 января 2026 г.

OpenAI: GPT Audio Mini

GPT Audio Mini — это оптимизированная версия мультимодальной модели от OpenAI, предназначенная для эффективной обработки аудио и текста. Обновленный декодер обеспечивает естественное звучание голоса и высокую стабильность вокальных характеристик при сохранении внушительного контекстного окна.

Вход: 72 ₽/MВыход: 288 ₽/M
ТехнологииПеревод+2
Читать →
Moonshotai20 апреля 2026 г.

MoonshotAI: Kimi K2.6

Kimi K2.6 — это мультимодальная модель нового поколения от Moonshot AI, оптимизированная для сложного программирования и создания UI/UX. Она поддерживает контекст до 262 тысяч токенов и эффективно справляется с многоагентной оркестрацией и долгосрочными задачами разработки.

Вход: 70 ₽/MВыход: 302 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed12 августа 2026 г.

ByteDance Seed: Seed-2.0-Code

Seed-2.0-Code от ByteDance — это специализированная модель, оптимизированная для агентного программирования и сложных рабочих процессов. Она отлично справляется с фронтенд-разработкой и многоязычными задачами, поддерживая огромный контекст для анализа целых репозиториев.

Вход: 60 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+1
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra Pro (batch)

GPT-5.6 Terra Pro (batch) — это продвинутая мультимодальная модель, работающая в режиме глубокого рассуждения для решения сложнейших задач. Благодаря огромному контекстному окну в 1,05 млн токенов и пакетной обработке, она идеально подходит для анализа массивов данных с высочайшей точностью.

Вход: 60 ₽/MВыход: 359 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra Pro

GPT-5.6 Terra Pro — это продвинутая версия модели Terra с активированным режимом глубокого рассуждения для решения сложнейших задач. Она поддерживает мультимодальный ввод данных, включая изображения и файлы, и обладает внушительным контекстным окном в 1 миллион токенов.

Вход: 60 ₽/MВыход: 359 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra (batch)

GPT-5.6 Terra (batch) — это сбалансированная модель среднего уровня, предназначенная для эффективной обработки больших объемов данных в отложенном режиме. Она сочетает в себе продвинутые возможности рассуждения и программирования, занимая нишу между флагманскими и максимально упрощенными решениями серии.

Вход: 60 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra

GPT-5.6 Terra представляет собой сбалансированное решение в линейке OpenAI, сочетающее высокую производительность с продвинутыми возможностями рассуждения. Модель оптимизирована для повседневного программирования, работы с мультимодальными данными и выполнения сложных агентских задач.

Вход: 60 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle18 июня 2026 г.

Google: Nano Banana 2 (Gemini 3.1 Flash Image)

Gemini 3.1 Flash Image, известная как Nano Banana 2, представляет собой передовую модель Google для генерации и редактирования изображений. Она сочетает в себе визуальное качество профессионального уровня с высокой скоростью работы и поддержкой длинного контекста.

Вход: 60 ₽/MВыход: 359 ₽/M
МаркетингТехнологии+2
Читать →
GoogleGoogle26 февраля 2026 г.

Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)

Gemini 3.1 Flash Image Preview (Nano Banana 2) — это передовая модель Google для генерации и редактирования изображений, сочетающая качество уровня Pro с высокой скоростью работы. Она обеспечивает глубокое понимание контекста и позволяет гибко настраивать соотношение сторон через API, оставаясь при этом экономически эффективным решением.

Вход: 60 ₽/MВыход: 359 ₽/M
ТехнологииМаркетинг+2
Читать →
Kwaipilot10 июля 2026 г.

Kwaipilot: KAT-Coder-Pro V2.5

KAT-Coder-Pro V2.5 — это флагманская агентная модель, специально разработанная для решения сложных задач программирования. Она способна автономно анализировать целые рабочие процессы, находить ошибки и вносить исправления в код проекта.

Вход: 89 ₽/MВыход: 355 ₽/M
ПрограммированиеТехнологии+1
Читать →
X-aiX-ai30 апреля 2026 г.

SpaceXAI: Grok 4.3

Grok 4.3 — это продвинутая мультимодальная модель от xAI, специализирующаяся на сложных рассуждениях и работе с контекстом до 1 миллиона токенов. Она отлично справляется с агентными сценариями, строгим следованием инструкциям и анализом визуальных данных.

Вход: 150 ₽/MВыход: 299 ₽/M
ТехнологииПрограммирование+3
Читать →
X-aiX-ai31 марта 2026 г.

SpaceXAI: Grok 4.20 Multi-Agent

Grok 4.20 Multi-Agent — это продвинутая мультиагентная система от xAI, предназначенная для глубоких исследований и параллельной обработки сложных задач. Модель способна задействовать до 16 агентов одновременно для координации инструментов и синтеза информации в рамках огромного контекстного окна.

Вход: 150 ₽/MВыход: 299 ₽/M
ТехнологииНаука+2
Читать →
X-aiX-ai31 марта 2026 г.

SpaceXAI: Grok 4.20

Grok 4.20 — это флагманская модель от xAI, выделяющаяся рекордной скоростью работы и минимальным уровнем галлюцинаций. Она поддерживает контекстное окно до 2 миллионов токенов и обладает продвинутыми возможностями вызова инструментов для создания автономных агентов.

Вход: 150 ₽/MВыход: 299 ₽/M
ТехнологииПрограммирование+3
Читать →
OpenaiOpenai10 декабря 2025 г.

OpenAI: GPT-5.2 (batch)

GPT-5.2 (batch) — это флагманская модель нового поколения, оптимизированная для работы с длинным контекстом и сложными агентскими задачами. Благодаря адаптивному мышлению и поддержке мультимодальных входных данных, она эффективно справляется с глубоким анализом информации в пакетном режиме.

Вход: 53 ₽/MВыход: 419 ₽/M
ТехнологииПрограммирование+3
Читать →
Relace08 декабря 2025 г.

Relace: Relace Search

Relace Search — это специализированная агентная модель, предназначенная для глубокого исследования кодовой базы. В отличие от стандартных RAG-систем, она использует параллельный запуск инструментов поиска и анализа файлов для предоставления максимально релевантных фрагментов кода.

Вход: 120 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+1
Читать →
Z-ai07 апреля 2026 г.

Z.ai: GLM 5.1

GLM-5.1 представляет собой значительный скачок в области генерации кода и решения долгосрочных задач. Модель способна работать автономно над сложными проектами, выходя за рамки простых коротких взаимодействий благодаря расширенному контекстному окну.

Вход: 116 ₽/MВыход: 364 ₽/M
ПрограммированиеТехнологии+2
Читать →
Moonshotai12 июня 2026 г.

MoonshotAI: Kimi K2.7 Code

MoonshotAI: Kimi K2.7 Code — это специализированная мультимодальная модель, оптимизированная для решения сложных задач программирования и работы с длинным контекстом. Благодаря архитектуре Mixture-of-Experts, она эффективно справляется с написанием кода и анализом визуальных данных.

Вход: 81 ₽/MВыход: 407 ₽/M
ПрограммированиеТехнологии+2
Читать →
OpenaiOpenai05 марта 2026 г.

OpenAI: GPT-5.4 (batch)

GPT-5.4 (batch) — это флагманская модель от OpenAI, объединяющая возможности Codex и GPT в единую систему с огромным контекстным окном более 1 миллиона токенов. Она поддерживает мультимодальный ввод и расширенные функции рассуждения, что делает её идеальной для обработки сверхбольших объемов данных в пакетном режиме.

Вход: 75 ₽/MВыход: 449 ₽/M
ТехнологииПрограммирование+3
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash (batch) — это высокоэффективная мультимодальная модель от Google, оптимизированная для пакетной обработки данных и сложных рабочих процессов. Она отличается высокой точностью в программировании и веб-разработке, предлагая чистый результат с минимальным количеством правок.

Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная мультимодальная модель от Google, оптимизированная для программирования и создания автономных агентов. Она отличается высокой скоростью работы и способностью обрабатывать огромные объемы данных благодаря контекстному окну в 1 миллион токенов.

Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen09 февраля 2026 г.

Qwen: Qwen3 Max Thinking

Qwen3 Max Thinking — это флагманская модель с продвинутыми возможностями рассуждения, предназначенная для решения сложнейших когнитивных задач. Благодаря масштабированию вычислительных мощностей и обучению с подкреплением, она демонстрирует высокую точность в многошаговых логических цепочках.

Вход: 94 ₽/MВыход: 467 ₽/M
ТехнологииНаука+2
Читать →
Sakana11 августа 2026 г.

Sakana: Sakana Namazu

Sakana Namazu — это специализированная рассуждающая модель, оптимизированная для работы с японским языком и бизнес-контекстом. Основанная на архитектуре Kimi K2.6, она отлично справляется с анализом мультимодальных данных и сложным следованием инструкциям.

Вход: 114 ₽/MВыход: 479 ₽/M
ТехнологииПеревод+2
Читать →
Thinkingmachines17 июля 2026 г.

Thinking Machines: Inkling

Inkling — это мощная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для сложных рассуждений и программирования. Благодаря поддержке текста, изображений и аудио, а также огромному контекстному окну, она эффективно справляется с ролью автономного агента.

Вход: 114 ₽/MВыход: 485 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai01 апреля 2026 г.

Z.ai: GLM 5V Turbo

GLM-5V-Turbo — это первая нативная мультимодальная модель от Z.ai, разработанная специально для работы в качестве ИИ-агента. Она эффективно обрабатывает текст, изображения и видео, демонстрируя высокие результаты в долгосрочном планировании и написании кода на основе визуальных данных.

Вход: 144 ₽/MВыход: 479 ₽/M
ПрограммированиеТехнологии+1
Читать →
Z-ai15 марта 2026 г.

Z.ai: GLM 5 Turbo

GLM-5 Turbo от Z.ai — это высокопроизводительная модель, оптимизированная для работы в агентных средах и сценариях OpenClaw. Она демонстрирует исключительную стабильность в длительных рабочих процессах, эффективно справляясь с декомпозицией сложных инструкций и использованием инструментов.

Вход: 144 ₽/MВыход: 479 ₽/M
ТехнологииПрограммирование+1
Читать →
GoogleGoogle19 мая 2026 г.

Google: Gemini 3.5 Flash (batch)

Gemini 3.5 Flash (batch) — это высокоэффективная мультимодальная модель от Google, оптимизированная для пакетной обработки данных и параллельного выполнения агентских задач. Она сочетает в себе продвинутые навыки программирования и логического вывода с огромным контекстным окном в 1 миллион токенов.

Вход: 90 ₽/MВыход: 539 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle19 мая 2026 г.

Google: Gemini 3.5 Flash

Gemini 3.5 Flash — это высокоэффективная мультимодальная модель от Google, сочетающая скорость работы с продвинутыми навыками программирования и логического вывода. Она оптимизирована для параллельного выполнения агентских задач и обработки огромных объемов данных благодаря контекстному окну в 1 миллион токенов.

Вход: 90 ₽/MВыход: 539 ₽/M
ПрограммированиеТехнологии+2
Читать →
МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru