Alltokens

Новости

Новые модели, обновления цен и улучшения возможностей.

Подборки моделей

Sakana11 сентября 2026 г.

Sakana: Fugu Max

Fugu Max от Sakana AI представляет собой продвинутую систему мультиагентной оркестрации, оптимизированную для баланса производительности и эффективности. Модель использует обученную логику маршрутизации запросов и поддерживает работу с огромным контекстом до 1 миллиона токенов, включая обработку изображений и файлов.

Вход: 240 ₽/MВыход: 718 ₽/M
ТехнологииНаука+2
Читать →
DeepseekDeepseek10 сентября 2026 г.

DeepSeek: DeepSeek V4.1 Flash

DeepSeek V4.1 Flash — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для скорости и эффективности. Она превосходит предыдущую версию Pro по качеству ответов и поддерживает работу с огромным контекстом до 1 миллиона токенов.

Вход: 19 ₽/MВыход: 75 ₽/M
ПрограммированиеТехнологии+3
Читать →
Inception08 сентября 2026 г.

Inception: Mercury 2.5

Mercury 2.5 — это инновационная модель на базе архитектуры dLLM, обеспечивающая сверхбыструю генерацию за счет параллельной обработки токенов. Она сочетает в себе глубокие способности к рассуждению и внушительное контекстное окно в 260 000 токенов.

Вход: 5 ₽/MВыход: 19 ₽/M
ТехнологииНаука+2
Читать →
Nex-agi08 сентября 2026 г.

Nex AGI: Nex-N2.5-Mini (Бесплатно)

Nex-N2.5-Mini — это специализированная агентная модель, ориентированная на достижение конкретных результатов в программировании. Она эффективно работает с многофайловыми изменениями и сложными кодовыми базами, используя визуальную обратную связь для верификации кода.

Вход: ₽/MВыход: ₽/M
ПрограммированиеТехнологии+1
Читать →
Nex-agi08 сентября 2026 г.

Nex AGI: Nex-N2.5-Pro (Бесплатно)

Nex-N2.5-Pro — это продвинутая агентская модель, специализирующаяся на превращении поставленных целей в проверенные результаты. Она обладает уникальной способностью к многофайловому программированию с использованием визуальной обратной связи для верификации кода.

Вход: ₽/MВыход: ₽/M
ПрограммированиеТехнологии+2
Читать →
OpenaiOpenai04 сентября 2026 г.

OpenAI: GPT-6 Astra (batch)

GPT-6 Astra (batch) — это флагманская модель OpenAI, оптимизированная для выполнения ресурсоемких задач в пакетном режиме. Она демонстрирует исключительные способности в глубоких исследованиях, разработке сложного ПО и анализе огромных массивов данных благодаря рекордному контекстному окну.

Вход: 575 ₽/MВыход: 2 875 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai04 сентября 2026 г.

OpenAI: GPT-6 Astra

GPT-6 Astra представляет собой передовую модель рассуждений от OpenAI, оптимизированную для решения сложнейших логических задач и написания кода. Благодаря поддержке мультимодального ввода и огромному контекстному окну, она идеально подходит для создания автономных агентов и глубокого анализа данных.

Вход: 1 104 ₽/MВыход: 5 520 ₽/M
ПрограммированиеТехнологии+3
Читать →
OpenaiOpenai04 сентября 2026 г.

OpenAI: GPT-6 Astra Pro (batch)

GPT-6 Astra Pro (batch) — это продвинутая версия флагманской модели от OpenAI, оптимизированная для решения сложнейших задач через пакетную обработку. Благодаря режиму reasoning.mode: pro, модель демонстрирует высочайшее качество рассуждений и глубокий анализ данных в рамках огромного контекстного окна.

Вход: 575 ₽/MВыход: 2 875 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai04 сентября 2026 г.

OpenAI: GPT-6 Astra Pro

GPT-6 Astra Pro — это продвинутая версия флагманской модели от OpenAI, работающая в режиме углубленного рассуждения. Она специально оптимизирована для решения сложнейших логических задач и анализа мультимодальных данных с контекстным окном более миллиона токенов.

Вход: 1 104 ₽/MВыход: 5 520 ₽/M
ТехнологииНаука+3
Читать →
QwenQwen03 сентября 2026 г.

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max (0902) — это обновленная мультимодальная модель от Alibaba с архитектурой Mixture-of-Experts и 2,4 триллионами параметров. Она поддерживает работу с текстом, изображениями и видео, предлагая внушительное контекстное окно в 1 миллион токенов для обработки сверхбольших объемов данных.

Вход: 240 ₽/MВыход: 718 ₽/M
ТехнологииПрограммирование+2
Читать →
MetaMeta02 сентября 2026 г.

Meta: Muse Spark 1.3 Contributor

Muse Spark 1.3 Contributor — это мультимодальная модель от Meta с огромным контекстным окном, оптимизированная для сложного рассуждения и анализа данных. Она отлично подходит для ранних этапов разработки агентов, программирования и работы с видео или аудио контентом.

Вход: 13 ₽/MВыход: 25 ₽/M
ПрограммированиеТехнологии+2
Читать →
MetaMeta02 сентября 2026 г.

Meta: Muse Spark 1.3

Meta: Muse Spark 1.3 — это продвинутая мультимодальная модель, оптимизированная для длительных рассуждений и сложных агентских сценариев. Она эффективно удерживает контекст при выполнении многоэтапных задач в программировании и анализе данных.

Вход: 150 ₽/MВыход: 509 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle02 сентября 2026 г.

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash (batch) — это самая интеллектуальная модель в линейке Flash, оптимизированная для пакетной обработки данных и сложных корпоративных задач. Она отлично справляется с длительным циклом разработки ПО, автономными агентами и анализом мультимодального контента через alltokens.

Вход: 45 ₽/MВыход: 225 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle02 сентября 2026 г.

Google: Gemini 3.8 Flash

Gemini 3.8 Flash — это самая интеллектуальная модель в линейке Flash, оптимизированная для долгосрочного проектирования ПО и создания автономных агентов. Она поддерживает работу с огромным контекстом и мультимодальными данными, включая видео и аудио.

Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+2
Читать →
AnthropicAnthropic01 сентября 2026 г.

Anthropic: Claude Fable 5.1 (batch)

Claude Fable 5.1 (batch) представляет собой значительное обновление линейки Fable, оптимизированное для пакетной обработки данных. Модель демонстрирует выдающиеся результаты в агентном программировании, рефакторинге сложного кода и выполнении длительных рабочих процессов с глубоким анализом знаний.

Вход: 575 ₽/MВыход: 2 875 ₽/M
ПрограммированиеТехнологии+2
Читать →
AnthropicAnthropic01 сентября 2026 г.

Anthropic: Claude Fable 5.1

Claude Fable 5.1 представляет собой значительное обновление линейки Fable, демонстрируя превосходство в агентном программировании и сложных рабочих процессах. Модель оптимизирована для глубокого рефакторинга кода, визуальной фронтенд-разработки и обработки огромных массивов данных благодаря контекстному окну в 1 миллион токенов.

Вход: 1 104 ₽/MВыход: 5 520 ₽/M
ПрограммированиеТехнологии+2
Читать →
Ibm-granite31 августа 2026 г.

IBM: Granite 4.2 8B

IBM Granite 4.2 8B — это компактная, но мощная модель, специализирующаяся на глубоких рассуждениях и многошаговых логических задачах. Она отлично справляется с написанием кода, математическими вычислениями и сложными агентскими сценариями благодаря поддержке длинного контекста.

Вход: 8 ₽/MВыход: 19 ₽/M
ПрограммированиеТехнологии+2
Читать →
Tencent28 августа 2026 г.

Tencent: Hy4 preview

Tencent Hy4 Preview — это мощная модель на архитектуре Mixture-of-Experts с 770 миллиардами параметров, оптимизированная для сложных рабочих процессов. Она демонстрирует высокую эффективность в задачах программирования и автоматизации благодаря поддержке инструментов и огромному контекстному окну.

Вход: 100 ₽/MВыход: 300 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen26 августа 2026 г.

Qwen: Qwen3.8 Flash

Qwen3.8 Flash — это мультимодальная модель от Alibaba, оптимизированная для быстрого рассуждения и анализа сложных данных. Она отлично справляется с программированием, разбором длинных видео и взаимодействием с интерфейсами рабочего стола благодаря огромному контекстному окну.

Вход: 19 ₽/MВыход: 59 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai26 августа 2026 г.

Z.ai: GLM 5.3 Flash (batch)

GLM 5.3 Flash от Z.ai — это мощная мультимодальная модель с гибридной архитектурой внимания, оптимизированная для работы с огромными контекстами до 1 миллиона токенов. Она отлично справляется с программированием, анализом видео и сложными агентскими задачами в пакетном режиме обработки.

Вход: 10 ₽/MВыход: 32 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai26 августа 2026 г.

Z.ai: GLM 5.3 Flash

GLM 5.3 Flash — это мультимодальная модель нового поколения, оптимизированная для работы с огромными контекстами до 1 миллиона токенов. Благодаря гибридной архитектуре внимания она демонстрирует высокую точность в задачах программирования и управлении сложными агентами.

Вход: 10 ₽/MВыход: 32 ₽/M
ПрограммированиеТехнологии+2
Читать →
MetaMeta21 августа 2026 г.

Meta: Muse Spark 1.2 Contributor

Meta: Muse Spark 1.2 Contributor — это специализированная мультимодальная модель с поддержкой рассуждений, ориентированная на разработчиков. Она предлагает огромный контекстный сектор в 1 миллион токенов и поддерживает широкий спектр входных данных, включая видео и аудио.

Вход: 13 ₽/MВыход: 25 ₽/M
ПрограммированиеТехнологии+2
Читать →
DeepseekDeepseek21 августа 2026 г.

DeepSeek: DeepSeek V4 Flash Vision Exp (batch)

DeepSeek V4 Flash Vision Exp — это экспериментальная мультимодальная модель, сочетающая высокую скорость работы с возможностью анализа изображений. Она поддерживает контекстное окно до 1 миллиона токенов, что делает её эффективным инструментом для обработки объемных документов и визуальных данных.

Вход: 14 ₽/MВыход: 41 ₽/M
ТехнологииПрограммирование+2
Читать →
DeepseekDeepseek21 августа 2026 г.

DeepSeek: DeepSeek V4 Flash Vision Exp

DeepSeek V4 Flash Vision Exp — это экспериментальная мультимодальная модель, сочетающая высокую скорость работы с возможностью анализа изображений. Она сохраняет все текстовые возможности базовой версии, включая эффективную работу в режиме агентов и обработку огромных контекстов до 1 миллиона токенов.

Вход: 27 ₽/MВыход: 81 ₽/M
ТехнологииПрограммирование+2
Читать →
Z-ai18 августа 2026 г.

Z.ai: GLM 5.3 (batch)

GLM-5.3 от Z.ai — это мощная модель для глубоких рассуждений, оптимизированная для сложных задач в области программной инженерии и работы с долгосрочными агентами. Благодаря контекстному окну в 1 миллион токенов, она эффективно справляется с анализом огромных объемов данных и многоэтапным планированием.

Вход: 84 ₽/MВыход: 264 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai18 августа 2026 г.

Z.ai: GLM 5.3

GLM-5.3 — это мощная модель рассуждений от Z.ai, специально разработанная для решения сложных задач в области программной инженерии и управления агентами. Благодаря контекстному окну в 1 миллион токенов, она эффективно справляется с анализом объемных данных и долгосрочным планированием.

Вход: 105 ₽/MВыход: 396 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen14 августа 2026 г.

Qwen: Qwen3.8 27B

Qwen3.8 27B — это мощная мультимодальная модель с открытыми весами, способная обрабатывать текст, изображения и видео. Благодаря внушительному контекстному окну в 262 144 токена, она отлично подходит для сложных исследовательских задач и длительной работы в режиме агента.

Вход: 18 ₽/MВыход: 240 ₽/M
ПрограммированиеТехнологии+2
Читать →
Dots-studio14 августа 2026 г.

Dots Studio: Dots3-Note Preview (Бесплатно)

Dots3-Note Preview — это легковесная мультимодальная модель с архитектурой Mixture-of-Experts, предлагающая 16 млрд активных параметров. Она поддерживает работу с текстом и изображениями, обладая внушительным контекстным окном в 512 000 токенов для обработки объемных данных.

Вход: ₽/MВыход: ₽/M
ТехнологииНаука+2
Читать →
GoogleGoogle13 августа 2026 г.

Google: Gemini 3.7 Flash

Gemini 3.7 Flash — это высокопроизводительная мультимодальная модель от Google, оптимизированная для быстрой работы ИИ-агентов и сложного многошагового рассуждения. Она сочетает в себе огромный контекстный сектор и продвинутые возможности кодинга, обеспечивая мгновенный отклик в ресурсоемких задачах.

Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+3
Читать →
GoogleGoogle13 августа 2026 г.

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash (batch) — это мультимодальная модель, оптимизированная для пакетной обработки данных и сложных многошаговых рассуждений. Она отлично справляется с программированием и агентными рабочими процессами, предлагая огромное контекстное окно в 1 миллион токенов.

Вход: 45 ₽/MВыход: 225 ₽/M
ПрограммированиеТехнологии+2
Читать →
Voyageai13 августа 2026 г.

VoyageAI by MongoDB: voyage-code-4

Специализированная модель эмбеддингов для работы с кодом, оптимизированная для создания продвинутых ИИ-агентов и систем поиска по репозиториям. Поддержка технологии Matryoshka позволяет гибко настраивать размерность векторов от 256 до 2048 без потери контекстуальной значимости.

Вход: 15 ₽/MВыход: ₽/M
ПрограммированиеТехнологии+1
Читать →
Bytedance-seed12 августа 2026 г.

ByteDance Seed: Seed 2.1 Turbo

Seed 2.1 Turbo от ByteDance — это мощная мультимодальная модель, оптимизированная для написания кода и выполнения сложных многоэтапных задач. Благодаря поддержке контекста до 262 144 токенов, она эффективно справляется с анализом длинных документов и визуального контента.

Вход: 60 ₽/MВыход: 299 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen12 августа 2026 г.

Qwen: Qwen3.8 2.4T A95B (batch)

Qwen3.8 2.4T A95B (batch) — это мощная разреженная модель Mixture-of-Experts с 95 миллиардами активных параметров и внушительным контекстным окном в 1 миллион токенов. Она представляет собой открытую версию флагманской архитектуры Qwen3.8 Max, оптимизированную для пакетной обработки сложных текстовых задач.

Вход: 240 ₽/MВыход: 718 ₽/M
ТехнологииПрограммирование+3
Читать →
QwenQwen12 августа 2026 г.

Qwen: Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B представляет собой открытую модель с архитектурой Mixture-of-Experts, использующую 95 миллиардов активных параметров. Она обеспечивает высокую производительность в текстовых задачах благодаря огромному контекстному окну в 262 144 токена.

Вход: 240 ₽/MВыход: 718 ₽/M
ТехнологииПрограммирование+3
Читать →
Bytedance-seed12 августа 2026 г.

ByteDance Seed: Seed-2.0-Code

Seed-2.0-Code от ByteDance — это специализированная модель, оптимизированная для агентного программирования и сложных рабочих процессов. Она отлично справляется с фронтенд-разработкой и многоязычными задачами, поддерживая огромный контекст для анализа целых репозиториев.

Вход: 60 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+1
Читать →
DeepseekDeepseek12 августа 2026 г.

DeepSeek: DeepSeek V4 Pro 0813 (batch)

DeepSeek V4 Pro 0813 — это мощная языковая модель на базе архитектуры Mixture-of-Experts, предназначенная для обработки колоссальных объемов данных. Благодаря рекордному контекстному окну в 1 миллион токенов, она идеально подходит для глубокого анализа длинных документов и сложных вычислений в пакетном режиме.

Вход: 79 ₽/MВыход: 237 ₽/M
ТехнологииПрограммирование+3
Читать →
DeepseekDeepseek12 августа 2026 г.

DeepSeek: DeepSeek V4 Pro 0813

DeepSeek V4 Pro 0813 представляет собой масштабную модель на архитектуре Mixture-of-Experts, оптимизированную для сложных текстовых задач. Релиз GA обеспечивает высокую стабильность работы и поддержку огромного контекстного окна для обработки сверхдлинных документов.

Вход: 70 ₽/MВыход: 208 ₽/M
ТехнологииПрограммирование+2
Читать →
X-aiX-ai12 августа 2026 г.

SpaceXAI: Grok 4.6

Grok 4.6 представляет собой флагманскую модель от SpaceXAI, демонстрирующую передовые возможности в области программирования и точных наук. Благодаря расширенному контекстному окну в 500 000 токенов, нейросеть эффективно справляется со сложной аналитикой и обработкой объемных документов.

Вход: 240 ₽/MВыход: 718 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia11 августа 2026 г.

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для быстрой генерации ответов. Благодаря 3 миллиардам активных параметров она идеально подходит для работы в составе ИИ-агентов и выполнения специализированных задач с высокой пропускной способностью.

Вход: 9 ₽/MВыход: 23 ₽/M
ТехнологииПрограммирование+2
Читать →
Nvidia11 августа 2026 г.

NVIDIA: Nemotron 3.5 Lightning (Бесплатно)

NVIDIA Nemotron 3.5 Lightning — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для быстрой генерации ответов. Благодаря поддержке контекста до 1 миллиона токенов, она отлично справляется с анализом объемных документов и сложными агентскими задачами.

Вход: ₽/MВыход: ₽/M
ТехнологииПрограммирование+2
Читать →
Upstage10 августа 2026 г.

Upstage: Solar Pro 4

Solar Pro 4 от Upstage — это мощная языковая модель с внушительным контекстным окном в 524 тысячи токенов, оптимизированная для сложных офисных задач и программирования. Она демонстрирует высокую эффективность в агентских сценариях и при работе с объемными документами.

Вход: 12 ₽/MВыход: 45 ₽/M
ПрограммированиеТехнологии+2
Читать →
MetaMeta09 августа 2026 г.

Meta: Muse Glimmer 30B (batch)

Muse Glimmer 30B — это компактная мультимодальная модель от Meta, оптимизированная для работы автономных агентов на потребительском оборудовании. Благодаря дистилляции из старших версий, она эффективно справляется с длинным контекстом и сложным планированием действий.

Вход: 22 ₽/MВыход: 94 ₽/M
ТехнологииНаука+2
Читать →
MetaMeta09 августа 2026 г.

Meta: Muse Glimmer 30B

Meta: Muse Glimmer 30B — это компактная мультимодальная модель с открытыми весами, оптимизированная для работы автономных агентов на пользовательском оборудовании. Благодаря дистилляции из Muse Spark, она эффективно справляется с длительными задачами и анализом визуальных данных при контекстном окне в 128k токенов.

Вход: 38 ₽/MВыход: 137 ₽/M
ТехнологииПрограммирование+2
Читать →
MetaMeta05 августа 2026 г.

Meta: Muse Spark 1.2

Meta: Muse Spark 1.2 — это продвинутая мультимодальная модель, специализирующаяся на сложных логических рассуждениях и агентских задачах. Благодаря поддержке контекста в 1 миллион токенов, она способна обрабатывать огромные массивы данных, включая текст, изображения, видео и аудио.

Вход: 150 ₽/MВыход: 509 ₽/M
ТехнологииНаука+2
Читать →
DeepseekDeepseek31 июля 2026 г.

DeepSeek: DeepSeek V4 Flash 0731 (batch)

DeepSeek V4 Flash 0731 — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для программирования и сложных логических задач. Благодаря огромному контекстному окну в 1 миллион токенов, она идеально подходит для анализа объемных кодовых баз и работы в качестве автономного агента.

Вход: 14 ₽/MВыход: 35 ₽/M
ПрограммированиеТехнологии+2
Читать →
DeepseekDeepseek31 июля 2026 г.

DeepSeek: DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для задач программирования и логических рассуждений. Благодаря огромному контекстному окну в 1 миллион токенов, она эффективно справляется с анализом масштабных кодовых баз и сложными агентскими сценариями.

Вход: 7 ₽/MВыход: 20 ₽/M
ПрограммированиеТехнологии+2
Читать →
Thinkingmachines30 июля 2026 г.

Thinking Machines: Inkling Small (batch)

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для пакетной обработки данных. Она поддерживает работу с текстом, изображениями и аудио, предлагая внушительное контекстное окно в 524 288 токенов для анализа сверхбольших объемов информации.

Вход: 63 ₽/MВыход: 150 ₽/M
ТехнологииНаука+2
Читать →
Thinkingmachines30 июля 2026 г.

Thinking Machines: Inkling Small (Бесплатно)

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, использующая 12 миллиардов активных параметров. Она поддерживает обработку текста, изображений и аудио, предлагая внушительное контекстное окно в 262 144 токена для сложных задач.

Вход: ₽/MВыход: ₽/M
ТехнологииНаука+2
Читать →
Thinkingmachines30 июля 2026 г.

Thinking Machines: Inkling Small

Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, использующая 12 миллиардов активных параметров. Она поддерживает обработку текста, изображений и аудио, предлагая внушительное контекстное окно объемом более 500 тысяч токенов.

Вход: 56 ₽/MВыход: 150 ₽/M
ТехнологииНаука+2
Читать →
QwenQwen27 июля 2026 г.

Qwen: Qwen3.7 Flash

Qwen3.7 Flash — это высокопроизводительная мультимодальная модель от Alibaba, специализирующаяся на визуальном анализе и логических рассуждениях. Она отлично справляется с распознаванием объектов, пространственным ориентированием и сложным взаимодействием с компьютерными интерфейсами.

Вход: 4 ₽/MВыход: 17 ₽/M
ТехнологииПрограммирование+2
Читать →
AnthropicAnthropic24 июля 2026 г.

Claude Opus 5 (batch)

Claude Opus 5 (batch) — это флагманская модель от Anthropic, оптимизированная для решения сложнейших задач в программировании и глубокого анализа данных. Благодаря контекстному окну в 1 миллион токенов, она идеально подходит для работы с масштабными проектами и длительными агентскими сценариями.

Вход: 288 ₽/MВыход: 1 438 ₽/M
ПрограммированиеТехнологии+2
Читать →
AnthropicAnthropic24 июля 2026 г.

Claude Opus 5

Claude Opus 5 — это флагманская модель от Anthropic, предназначенная для решения сложнейших задач в области программирования, глубокого анализа данных и многоэтапного планирования. Благодаря контекстному окну в 1 миллион токенов и продвинутым визуальным возможностям, она эффективно справляется с масштабными проектами и комплексным аудитом кода.

Вход: 575 ₽/MВыход: 2 875 ₽/M
ПрограммированиеТехнологии+3
Читать →
Inclusionai23 июля 2026 г.

inclusionAI: Ling 3.0 Flash

Ling-3.0-flash — это высокоэффективная модель на архитектуре Mixture-of-Experts с 124 миллиардами параметров, из которых активно используется лишь 5.1 миллиарда на токен. Она оптимизирована для масштабного развертывания ИИ-агентов и обеспечивает высокую скорость генерации при работе с контекстом до 128k токенов.

Вход: 3 ₽/MВыход: 8 ₽/M
ТехнологииПрограммирование+2
Читать →
Poolside21 июля 2026 г.

Poolside: Laguna S 2.1 (Бесплатно)

Laguna S 2.1 — это продвинутая модель-агент для написания кода с архитектурой MoE, обладающая 118 млрд параметров. Она демонстрирует высокую эффективность в решении технических задач и поддерживает работу с огромным контекстом до 1 миллиона токенов.

Вход: ₽/MВыход: ₽/M
ПрограммированиеТехнологии+1
Читать →
Poolside21 июля 2026 г.

Poolside: Laguna S 2.1

Laguna S 2.1 — это специализированная модель для программирования с архитектурой MoE, обладающая 118 млрд параметров. Она демонстрирует высокие результаты в тестах Terminal-Bench и поддерживает внушительное контекстное окно объемом более миллиона токенов.

Вход: 12 ₽/MВыход: 23 ₽/M
ПрограммированиеТехнологии+1
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash (batch) — это высокоэффективная мультимодальная модель от Google, оптимизированная для пакетной обработки данных и сложных рабочих процессов. Она отличается высокой точностью в программировании и веб-разработке, предлагая чистый результат с минимальным количеством правок.

Вход: 45 ₽/MВыход: 225 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная мультимодальная модель от Google, оптимизированная для программирования и создания автономных агентов. Она отличается высокой скоростью работы и способностью обрабатывать огромные объемы данных благодаря контекстному окну в 1 миллион токенов.

Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.5 Flash Lite (batch)

Gemini 3.5 Flash Lite (batch) — это высокоэффективная модель от Google, оптимизированная для пакетной обработки данных и работы в качестве субагентов. Она обладает улучшенными агентными способностями и поддерживает огромный контекст до 1 миллиона токенов, включая мультимодальные входные данные.

Вход: 19 ₽/MВыход: 156 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
GoogleGoogle21 июля 2026 г.

Google: Gemini 3.5 Flash Lite

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентскими способностями. Она оптимизирована для работы в качестве субагента, выполняющего узкоспециализированные задачи внутри сложных многоагентных систем.

Вход: 36 ₽/MВыход: 299 ₽/M
ТехнологииПрограммирование+2
Читать →
Meituan20 июля 2026 г.

Meituan: LongCat 2.0

LongCat 2.0 — это мощная MoE-модель от Meituan с 1,6 трлн параметров, оптимизированная для работы с огромными контекстами до 1 млн токенов. Она демонстрирует высокую эффективность в программировании на уровне репозиториев и решении сложных многошаговых задач.

Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+2
Читать →
Thinkingmachines17 июля 2026 г.

Thinking Machines: Inkling (Бесплатно)

Inkling — это мощная мультимодальная модель с архитектурой Mixture-of-Experts, обладающая внушительным контекстным окном в 262 тысячи токенов. Она отлично справляется с задачами программирования, сложными рассуждениями и работой с инструментами, поддерживая ввод текста, изображений и аудио.

Вход: ₽/MВыход: ₽/M
ПрограммированиеТехнологии+2
Читать →
Thinkingmachines17 июля 2026 г.

Thinking Machines: Inkling (batch)

Inkling (batch) — это мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для пакетной обработки данных. Она обладает внушительным контекстным окном в 524 288 токенов и специализируется на сложных рассуждениях, программировании и работе с мультимедийным контентом.

Вход: 120 ₽/MВыход: 485 ₽/M
ТехнологииПрограммирование+2
Читать →
Thinkingmachines17 июля 2026 г.

Thinking Machines: Inkling

Inkling — это мощная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для сложных рассуждений и программирования. Благодаря поддержке текста, изображений и аудио, а также огромному контекстному окну, она эффективно справляется с ролью автономного агента.

Вход: 114 ₽/MВыход: 485 ₽/M
ПрограммированиеТехнологии+2
Читать →
Moonshotai16 июля 2026 г.

MoonshotAI: Kimi K3 (batch)

Kimi K3 — это мощная мультимодальная модель с 2.8 трлн параметров, оптимизированная для глубоких рассуждений и работы с огромными контекстами до 1 млн токенов. Она отлично справляется со сложным программированием и анализом видео, обеспечивая высокую точность в агентских сценариях.

Вход: 345 ₽/MВыход: 1 725 ₽/M
ПрограммированиеТехнологии+2
Читать →
Moonshotai16 июля 2026 г.

MoonshotAI: Kimi K3

MoonshotAI Kimi K3 представляет собой сверхмасштабную мультимодальную модель с открытыми весами, оптимизированную для сложного логического вывода. Она демонстрирует исключительную эффективность в задачах программирования и длительных агентских рабочих процессах благодаря огромному контекстному окну.

Вход: 207 ₽/MВыход: 1 036 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia16 июля 2026 г.

NVIDIA: Nemotron 3 Embed 1B (Бесплатно)

NVIDIA Nemotron 3 Embed 1B — это высокопроизводительная модель для создания текстовых эмбеддингов, оптимизированная для задач поиска и систем RAG. Она обеспечивает низкую задержку при обработке данных и поддерживает внушительное контекстное окно в 16384 токена.

Вход: ₽/MВыход: ₽/M
ТехнологииПрограммирование+1
Читать →
Kwaipilot10 июля 2026 г.

Kwaipilot: KAT-Coder-Pro V2.5

KAT-Coder-Pro V2.5 — это флагманская агентная модель, специально разработанная для решения сложных задач программирования. Она способна автономно анализировать целые рабочие процессы, находить ошибки и вносить исправления в код проекта.

Вход: 89 ₽/MВыход: 355 ₽/M
ПрограммированиеТехнологии+1
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna Pro (batch)

GPT-5.6 Luna Pro в режиме batch представляет собой продвинутую модель с глубоким логическим выводом для обработки больших массивов данных. Благодаря огромному контекстному окну в 1,05 млн токенов, она идеально подходит для анализа сложной документации и мультимодальных задач.

Вход: 13 ₽/MВыход: 75 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это продвинутая версия модели Luna с активированным режимом глубокого рассуждения для решения сложнейших задач. Она поддерживает мультимодальный ввод данных и обладает внушительным контекстным окном в 1,05 миллиона токенов.

Вход: 25 ₽/MВыход: 150 ₽/M
ТехнологииНаука+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna (batch)

GPT-5.6 Luna (batch) — это высокопроизводительная модель, оптимизированная для обработки больших объемов данных с минимальными затратами. Она отлично справляется с классификацией, чатами и легкими агентскими сценариями, поддерживая мультимодальный ввод текста, изображений и файлов.

Вход: 13 ₽/MВыход: 75 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это высокопроизводительная модель от OpenAI, оптимизированная для задач с жесткими требованиями к скорости отклика. Она сочетает в себе продвинутые возможности рассуждения и огромный контекстный сектор, что делает её идеальной для обработки больших массивов данных и сложных агентских сценариев.

Вход: 25 ₽/MВыход: 150 ₽/M
ТехнологииМаркетинг+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra Pro (batch)

GPT-5.6 Terra Pro (batch) — это продвинутая мультимодальная модель, работающая в режиме глубокого рассуждения для решения сложнейших задач. Благодаря огромному контекстному окну в 1,05 млн токенов и пакетной обработке, она идеально подходит для анализа массивов данных с высочайшей точностью.

Вход: 120 ₽/MВыход: 718 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra Pro

GPT-5.6 Terra Pro — это продвинутая версия модели Terra с активированным режимом глубокого рассуждения для решения сложнейших задач. Она поддерживает мультимодальный ввод данных, включая изображения и файлы, и обладает внушительным контекстным окном в 1 миллион токенов.

Вход: 230 ₽/MВыход: 1 380 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra (batch)

GPT-5.6 Terra (batch) — это сбалансированная модель среднего уровня, предназначенная для эффективной обработки больших объемов данных в отложенном режиме. Она сочетает в себе продвинутые возможности рассуждения и программирования, занимая нишу между флагманскими и максимально упрощенными решениями серии.

Вход: 120 ₽/MВыход: 718 ₽/M
ПрограммированиеТехнологии+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Terra

GPT-5.6 Terra представляет собой сбалансированное решение в линейке OpenAI, сочетающее высокую производительность с продвинутыми возможностями рассуждения. Модель оптимизирована для повседневного программирования, работы с мультимодальными данными и выполнения сложных агентских задач.

Вход: 230 ₽/MВыход: 1 380 ₽/M
ПрограммированиеТехнологии+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Sol Pro (batch)

GPT-5.6 Sol Pro (batch) — это продвинутая версия модели Sol, оптимизированная для пакетной обработки данных с активированным режимом глубокого рассуждения. Она предназначена для решения наиболее сложных аналитических и логических задач, требующих повышенного качества ответов и работы с огромными контекстными окнами.

Вход: 120 ₽/MВыход: 598 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Sol Pro

GPT-5.6 Sol Pro — это продвинутая версия модели Sol, работающая в специальном режиме глубоких рассуждений для решения сложнейших задач. Благодаря огромному контекстному окну и поддержке мультимодального ввода, она идеально подходит для анализа масштабных документов и разработки комплексных ИТ-архитектур.

Вход: 230 ₽/MВыход: 1 150 ₽/M
ПрограммированиеТехнологии+3
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Sol (batch)

GPT-5.6 Sol (batch) — это флагманская модель OpenAI, оптимизированная для пакетной обработки данных с акцентом на сложное логическое рассуждение и программирование. Она обладает внушительным контекстным окном в 1 млн токенов и отлично справляется с многошаговыми агентскими сценариями.

Вход: 120 ₽/MВыход: 598 ₽/M
ПрограммированиеТехнологии+2
Читать →
OpenaiOpenai09 июля 2026 г.

OpenAI: GPT-5.6 Sol

GPT-5.6 Sol — это флагманская мультимодальная модель, оптимизированная для сложного логического вывода и автономных агентных рабочих процессов. Она демонстрирует исключительную эффективность в многошаговом программировании и работе с командной строкой, поддерживая контекст до 1 миллиона токенов.

Вход: 230 ₽/MВыход: 1 150 ₽/M
ПрограммированиеТехнологии+3
Читать →
X-aiX-ai08 июля 2026 г.

SpaceXAI: Grok 4.5

Grok 4.5 — это флагманская модель от xAI, демонстрирующая передовые возможности в области программирования, науки и сложных интеллектуальных задач. Благодаря поддержке мультимодальности и огромному контекстному окну в 500 000 токенов, она эффективно справляется с анализом объемных документов и изображений.

Вход: 240 ₽/MВыход: 718 ₽/M
ПрограммированиеТехнологии+2
Читать →
Tencent06 июля 2026 г.

Tencent: Hy3

Tencent Hy3 — это мощная модель на архитектуре Mixture-of-Experts с 295 миллиардами параметров, оптимизированная для сложных рассуждений и работы в качестве ИИ-агента. Благодаря поддержке настраиваемого уровня логических размышлений и огромному контекстному окну, она эффективно справляется с масштабными производственными задачами.

Вход: 11 ₽/MВыход: 41 ₽/M
ТехнологииПрограммирование+2
Читать →
Poolside02 июля 2026 г.

Poolside: Laguna XS 2.1 (Бесплатно)

Laguna XS 2.1 — это специализированная модель для программирования в категории 33B-A3B, предлагающая значительные улучшения по сравнению с предыдущими версиями. Благодаря контекстному окну в 262 144 токена, она эффективно справляется с анализом крупных кодовых баз и сложными задачами разработки.

Вход: ₽/MВыход: ₽/M
ПрограммированиеТехнологии+1
Читать →
Poolside02 июля 2026 г.

Poolside: Laguna XS 2.1

Laguna XS 2.1 — это специализированная модель-агент для программирования в категории 33B-A3B, предлагающая значительное улучшение производительности по сравнению с предыдущими версиями. Благодаря контекстному окну в 262 144 токена, она эффективно справляется с анализом крупных кодовых баз и сложными задачами разработки.

Вход: 8 ₽/MВыход: 15 ₽/M
ПрограммированиеТехнологии+1
Читать →
AnthropicAnthropic30 июня 2026 г.

Anthropic: Claude Sonnet 5 (batch)

Claude Sonnet 5 (batch) — это передовая модель от Anthropic, демонстрирующая флагманскую производительность в программировании и создании автономных агентов. Она поддерживает адаптивное мышление с настраиваемыми уровнями рассуждений и обладает огромным контекстным окном в 1 миллион токенов.

Вход: 120 ₽/MВыход: 598 ₽/M
ПрограммированиеТехнологии+2
Читать →
AnthropicAnthropic30 июня 2026 г.

Anthropic: Claude Sonnet 5

Claude Sonnet 5 — это передовая модель от Anthropic, демонстрирующая флагманскую производительность в программировании и создании автономных агентов. Она поддерживает адаптивное мышление с настраиваемыми уровнями сложности рассуждений и обладает огромным контекстным окном в 1 миллион токенов.

Вход: 230 ₽/MВыход: 1 150 ₽/M
ПрограммированиеТехнологии+2
Читать →
CohereCohere17 июня 2026 г.

Cohere: North Mini Code (Бесплатно)

North Mini Code — это первая агентная модель Cohere, оптимизированная специально для написания кода и решения сложных технических задач. Благодаря архитектуре Mixture-of-Experts с 3 миллиардами активных параметров, она обеспечивает высокую скорость работы при сохранении точности в программировании.

Вход: ₽/MВыход: ₽/M
ПрограммированиеТехнологии+1
Читать →
Z-ai16 июня 2026 г.

Z.ai: GLM 5.2 (batch)

GLM 5.2 от Z.ai — это мощная модель для сложных рассуждений с внушительным контекстным окном до 512 000 токенов. Она оптимизирована для длительных рабочих процессов, управления агентами и разработки программного обеспечения на уровне целых проектов.

Вход: 84 ₽/MВыход: 264 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai16 июня 2026 г.

Z.ai: GLM 5.2

GLM-5.2 — это флагманская модель от Z.ai, специально разработанная для выполнения сложных задач с длительным горизонтом планирования. Благодаря контекстному окну в 1 миллион токенов, она эффективно справляется с анализом масштабных инженерных проектов и надежным следованием инструкциям.

Вход: 60 ₽/MВыход: 188 ₽/M
ПрограммированиеТехнологии+2
Читать →
Moonshotai12 июня 2026 г.

MoonshotAI: Kimi K2.7 Code

MoonshotAI: Kimi K2.7 Code — это специализированная мультимодальная модель, оптимизированная для решения сложных задач программирования и работы с длинным контекстом. Благодаря архитектуре Mixture-of-Experts, она эффективно справляется с написанием кода и анализом визуальных данных.

Вход: 82 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+2
Читать →
AnthropicAnthropic09 июня 2026 г.

Anthropic: Claude Fable 5 (batch)

Claude Fable 5 — это модель класса Mythos, специально разработанная для автономной интеллектуальной работы и сложного программирования. Она поддерживает мультимодальный ввод данных, включая изображения и файлы, и обладает продвинутыми способностями к рассуждению в рамках огромного контекстного окна.

Вход: 575 ₽/MВыход: 2 875 ₽/M
ПрограммированиеТехнологии+2
Читать →
AnthropicAnthropic09 июня 2026 г.

Anthropic: Claude Fable 5

Claude Fable 5 — это модель класса Mythos, специально разработанная для автономной интеллектуальной работы и сложного программирования. Она поддерживает контекст до 1 миллиона токенов и обладает продвинутыми способностями к рассуждению при обработке текста, изображений и файлов.

Вход: 1 104 ₽/MВыход: 5 520 ₽/M
ПрограммированиеТехнологии+3
Читать →
Nvidia04 июня 2026 г.

NVIDIA: Nemotron 3 Ultra

NVIDIA Nemotron 3 Ultra — это передовая модель с архитектурой Mixture-of-Experts (MoE), сочетающая трансформеры и Mamba для эффективного рассуждения. Благодаря контекстному окну в 1 миллион токенов, она отлично справляется со сложной оркестрацией и анализом масштабных данных.

Вход: 60 ₽/MВыход: 264 ₽/M
ТехнологииНаука+2
Читать →
Nvidia04 июня 2026 г.

NVIDIA: Nemotron 3 Ultra (Бесплатно)

NVIDIA Nemotron 3 Ultra — это передовая модель с архитектурой Mixture-of-Experts (MoE), сочетающая трансформеры и Mamba для эффективного рассуждения. Благодаря 55 миллиардам активных параметров и контекстному окну в 1 миллион токенов, она отлично справляется со сложной оркестрацией задач.

Вход: ₽/MВыход: ₽/M
ТехнологииНаука+2
Читать →
QwenQwen03 июня 2026 г.

Qwen: Qwen3.7 Plus

Qwen3.7 Plus представляет собой сбалансированное решение в линейке Alibaba, предлагающее расширенные возможности обработки текста и изображений. Модель выделяется огромным контекстным окном в 1 миллион токенов, что позволяет эффективно работать с лонгридами и сложными визуальными данными.

Вход: 40 ₽/MВыход: 159 ₽/M
ТехнологииПрограммирование+2
Читать →
Minimax31 мая 2026 г.

MiniMax: MiniMax M3 (batch)

MiniMax M3 — это мощная мультимодальная модель, способная обрабатывать текст, изображения и видео с впечатляющим контекстным окном. Она оптимизирована для решения сложных агентских задач, написания кода и анализа объемных данных в пакетном режиме через alltokens.

Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+2
Читать →
Minimax31 мая 2026 г.

MiniMax: MiniMax M3

MiniMax M3 — это мощная мультимодальная модель, способная обрабатывать текст, изображения и видео с впечатляющим контекстным окном в 1 миллион токенов. Она оптимизирована для решения сложных задач программирования и длительной работы в режиме автономного агента.

Вход: 29 ₽/MВыход: 120 ₽/M
ПрограммированиеТехнологии+2
Читать →
Stepfun28 мая 2026 г.

StepFun: Step 3.7 Flash

Step 3.7 Flash — это высокоэффективная мультимодальная модель на базе архитектуры Mixture-of-Experts, предназначенная для быстрой обработки текста, изображений и видео. Благодаря контекстному окну в 256 000 токенов и нативному визуальному кодировщику, она обеспечивает глубокое понимание сложного контента при минимальных задержках.

Вход: 20 ₽/MВыход: 115 ₽/M
ТехнологииМаркетинг+2
Читать →
AnthropicAnthropic27 мая 2026 г.

Anthropic: Claude Opus 4.8 (batch)

Claude Opus 4.8 — это флагманская модель от Anthropic с поддержкой мультимодального ввода и расширенным контекстным окном до 1 миллиона токенов. Она демонстрирует выдающиеся способности в глубоких рассуждениях и обработке сложных структурированных данных через alltokens.

Вход: 288 ₽/MВыход: 1 438 ₽/M
ТехнологииНаука+2
Читать →
AnthropicAnthropic27 мая 2026 г.

Anthropic: Claude Opus 4.8

Claude Opus 4.8 — это самая мощная модель в семействе Opus от Anthropic, предлагающая продвинутые возможности рассуждения и обработки мультимодальных данных. Благодаря рекордному контекстному окну в 1 миллион токенов, она способна анализировать огромные массивы документов, изображений и кода с высокой точностью.

Вход: 575 ₽/MВыход: 2 875 ₽/M
ТехнологииНаука+3
Читать →
QwenQwen21 мая 2026 г.

Qwen: Qwen3.7 Max

Qwen3.7 Max — это флагманская модель от Alibaba, оптимизированная для сложных агентских сценариев и продуктивной офисной работы. Она обладает внушительным контекстным окном в 1 миллион токенов и демонстрирует исключительные результаты в программировании и логических задачах.

Вход: 177 ₽/MВыход: 530 ₽/M
ПрограммированиеТехнологии+3
Читать →
X-aiX-ai20 мая 2026 г.

SpaceXAI: Grok Build 0.1

Grok Build 0.1 — это специализированная модель от xAI, оптимизированная для агентной разработки программного обеспечения и интерактивного кодинга. Она поддерживает мультимодальный ввод данных и обладает внушительным контекстным окном в 256 000 токенов для работы со сложными проектами.

Вход: 120 ₽/MВыход: 240 ₽/M
ПрограммированиеТехнологии+1
Читать →
GoogleGoogle19 мая 2026 г.

Google: Gemini 3.5 Flash (batch)

Gemini 3.5 Flash (batch) — это высокоэффективная мультимодальная модель от Google, оптимизированная для пакетной обработки данных и параллельного выполнения агентских задач. Она сочетает в себе продвинутые навыки программирования и логического вывода с огромным контекстным окном в 1 миллион токенов.

Вход: 90 ₽/MВыход: 539 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle19 мая 2026 г.

Google: Gemini 3.5 Flash

Gemini 3.5 Flash — это высокоэффективная мультимодальная модель от Google, сочетающая скорость работы с продвинутыми навыками программирования и логического вывода. Она оптимизирована для параллельного выполнения агентских задач и обработки огромных объемов данных благодаря контекстному окну в 1 миллион токенов.

Вход: 173 ₽/MВыход: 1 035 ₽/M
ПрограммированиеТехнологии+2
Читать →
GoogleGoogle07 мая 2026 г.

Google: Gemini 3.1 Flash Lite (batch)

Gemini 3.1 Flash Lite (batch) — это высокоэффективная мультимодальная модель, оптимизированная для пакетной обработки огромных массивов данных. Она поддерживает работу с текстом, изображениями, видео и аудио, предлагая внушительное контекстное окно в 1 миллион токенов для сложных аналитических задач.

Вход: 16 ₽/MВыход: 94 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
GoogleGoogle07 мая 2026 г.

Google: Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель от Google, оптимизированная для задач с минимальной задержкой и большими объемами данных. Она поддерживает работу с текстом, изображениями, видео, аудио и PDF, предлагая контекстное окно в 1 миллион токенов для сложных агентских сценариев.

Вход: 32 ₽/MВыход: 187 ₽/M
ТехнологииПрограммирование+2
Читать →
OpenaiOpenai05 мая 2026 г.

OpenAI: GPT Chat Latest

GPT Chat Latest — это актуальная версия флагманской модели от OpenAI, которая автоматически обновляется до самых свежих стабильных релизов. Она поддерживает мультимодальный ввод, включая текст, изображения и файлы, предлагая внушительное контекстное окно в 400 000 токенов.

Вход: 575 ₽/MВыход: 3 450 ₽/M
ТехнологииПрограммирование+3
Читать →
X-aiX-ai30 апреля 2026 г.

SpaceXAI: Grok 4.3 (batch)

Grok 4.3 (batch) — это мощная мультимодальная модель от SpaceXAI, оптимизированная для пакетной обработки данных с поддержкой текста и изображений. Она отличается глубоким логическим мышлением и огромным контекстным окном в 1 миллион токенов, что делает её идеальной для сложных аналитических задач.

Вход: 120 ₽/MВыход: 240 ₽/M
ТехнологииНаука+2
Читать →
X-aiX-ai30 апреля 2026 г.

SpaceXAI: Grok 4.3

Grok 4.3 — это продвинутая мультимодальная модель от xAI, специализирующаяся на сложных рассуждениях и работе с контекстом до 1 миллиона токенов. Она отлично справляется с агентными сценариями, строгим следованием инструкциям и анализом визуальных данных.

Вход: 150 ₽/MВыход: 299 ₽/M
ТехнологииПрограммирование+3
Читать →
MistralaiMistralai30 апреля 2026 г.

Mistral: Mistral Medium 3.5 (batch)

Mistral Medium 3.5 — это мощная модель с 128 миллиардами параметров, оптимизированная для сложных агентских сценариев и программирования. Она поддерживает мультимодальный ввод данных и обладает внушительным контекстным окном в 256 тысяч токенов для обработки объемных документов.

Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+2
Читать →
MistralaiMistralai30 апреля 2026 г.

Mistral: Mistral Medium 3.5

Mistral Medium 3.5 — это мощная плотная модель на 128 миллиардов параметров, оптимизированная для сложных агентских сценариев и программирования. Она поддерживает мультимодальный ввод и обладает внушительным контекстным окном в 262 144 токена для обработки объемных документов.

Вход: 180 ₽/MВыход: 897 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.5 Plus 2026-04-20

Qwen3.5 Plus — это мощная мультимодальная модель от Alibaba, способная обрабатывать текст, изображения и видео. Благодаря рекордному контекстному окну в 1 миллион токенов, она идеально подходит для анализа сверхдлинных документов и сложных медиафайлов.

Вход: 36 ₽/MВыход: 216 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.6 Flash

Qwen3.6 Flash — это высокопроизводительная мультимодальная модель от Alibaba, оптимизированная для мгновенной обработки данных. Она поддерживает работу с текстом, изображениями и видео, предлагая внушительное контекстное окно в 1 миллион токенов для анализа сверхбольших документов.

Вход: 24 ₽/MВыход: 140 ₽/M
ТехнологииПрограммирование+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.6 Max Preview

Qwen3.6 Max Preview — это флагманская модель от Alibaba Cloud, построенная на архитектуре MoE с 1 триллионом параметров. Она демонстрирует выдающиеся способности в агентном программировании, использовании инструментов и обработке сверхдлинных контекстов до 262 тысяч токенов.

Вход: 123 ₽/MВыход: 737 ₽/M
ПрограммированиеТехнологии+2
Читать →
QwenQwen27 апреля 2026 г.

Qwen: Qwen3.6 27B

Qwen3.6 27B — это продвинутая мультимодальная модель от Alibaba, способная обрабатывать текст, изображения и видео. Благодаря внушительному контекстному окну в 262 тысячи токенов, она эффективно справляется с анализом длинных документов и сложных медиафайлов.

Вход: 36 ₽/MВыход: 240 ₽/M
ТехнологииПрограммирование+2
Читать →
OpenaiOpenai24 апреля 2026 г.

OpenAI: GPT-5.5 Pro (batch)

GPT-5.5 Pro (batch) — это флагманская модель от OpenAI, специально оптимизированная для глубоких рассуждений и обработки сверхбольших объемов данных. Благодаря контекстному окну более 1 миллиона токенов, она идеально подходит для анализа сложных документов и выполнения высокоточных задач в пакетном режиме.

Вход: 1 656 ₽/MВыход: 9 936 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai24 апреля 2026 г.

OpenAI: GPT-5.5 Pro

GPT-5.5 Pro — это флагманская модель от OpenAI, разработанная для глубокого логического анализа и решения критически важных задач. Благодаря рекордному контекстному окну более 1 миллиона токенов, она способна обрабатывать огромные массивы данных с высокой точностью.

Вход: 3 312 ₽/MВыход: 19 872 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai24 апреля 2026 г.

OpenAI: GPT-5.5 (batch)

GPT-5.5 (batch) — это передовая модель от OpenAI, оптимизированная для выполнения сложных профессиональных задач с повышенной надежностью и глубоким рассуждением. Благодаря контекстному окну более 1 миллиона токенов, она эффективно справляется с обработкой огромных массивов данных в пакетном режиме.

Вход: 288 ₽/MВыход: 1 725 ₽/M
ТехнологииНаука+3
Читать →
OpenaiOpenai24 апреля 2026 г.

OpenAI: GPT-5.5

GPT-5.5 представляет собой передовую модель от OpenAI, оптимизированную для решения сложнейших профессиональных задач с повышенной надежностью. Благодаря контекстному окну более 1 миллиона токенов и улучшенным механизмам рассуждения, она эффективно справляется с анализом огромных массивов данных и мультимодальным контентом.

Вход: 575 ₽/MВыход: 3 450 ₽/M
ТехнологииНаука+3
Читать →
DeepseekDeepseek24 апреля 2026 г.

DeepSeek: DeepSeek V4 Pro 0423

DeepSeek V4 Pro — это масштабная модель на архитектуре Mixture-of-Experts с 1,6 трлн параметров, оптимизированная для сложного логического вывода и программирования. Благодаря рекордному контекстному окну в 1 миллион токенов, она способна обрабатывать огромные массивы данных и длинные цепочки рассуждений.

Вход: 105 ₽/MВыход: 144 ₽/M
ПрограммированиеТехнологии+2
Читать →
DeepseekDeepseek24 апреля 2026 г.

DeepSeek: DeepSeek V4 Flash 0423

DeepSeek V4 Flash — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для мгновенного отклика. Благодаря поддержке контекстного окна в 1 миллион токенов, она идеально подходит для обработки сверхдлинных документов и сложного анализа данных.

Вход: 9 ₽/MВыход: 21 ₽/M
ПрограммированиеТехнологии+3
Читать →
МИРVisaMastercardСБП
AllTokens

© 2026 Alltokens. Все права защищены.

ИП Наумов Евгений Алексеевич · ИНН 434522560555 · ОГРНИП 324430000002724 · support@alltokens.ru