Inclusionai21 апреля 2026 г.
inclusionAI: Ling-2.6-flash
Ling-2.6-flash — это высокопроизводительная модель с архитектурой MoE, оптимизированная для работы в качестве автономного агента. Благодаря 7.4 млрд активных параметров она обеспечивает мгновенный отклик и высокую точность при выполнении сложных инструкций.
Вход: 2 ₽/MВыход: 4 ₽/M
ТехнологииПрограммирование+1
Читать →
Inclusionai23 июля 2026 г.
Ling-3.0-flash
Ling-3.0-flash — это высокоэффективная модель на архитектуре Mixture-of-Experts с 124 миллиардами параметров, из которых активно используется лишь 5.1 миллиарда на токен. Она оптимизирована для масштабного развертывания ИИ-агентов и обеспечивает высокую скорость генерации при работе с контекстом до 128k токенов.
Вход: 3 ₽/MВыход: 8 ₽/M
ТехнологииПрограммирование+2
Читать →
Nex-agi24 июня 2026 г.
Nex AGI: Nex-N2-Mini
Nex-N2-Mini — это компактная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для работы в качестве автономного агента. Она поддерживает обработку текста и изображений, предлагая внушительное контекстное окно для решения сложных задач в программировании и анализе данных.
Вход: 4 ₽/MВыход: 13 ₽/M
ПрограммированиеТехнологии+2
Читать →
Upstage10 августа 2026 г.
Upstage: Solar Pro 4
Solar Pro 4 от Upstage — это мощная языковая модель с внушительным контекстным окном в 524 тысячи токенов, оптимизированная для сложных офисных задач и программирования. Она демонстрирует высокую эффективность в агентских сценариях и при работе с объемными документами.
Вход: 4 ₽/MВыход: 15 ₽/M
ПрограммированиеТехнологии+2
Читать →
Ibm-granite30 апреля 2026 г.
IBM: Granite 4.1 8B
IBM Granite 4.1 8B — это компактная и эффективная языковая модель, оптимизированная для корпоративных задач и работы с длинными контекстами до 131 тысячи токенов. Она демонстрирует высокую точность в структурировании данных и использовании инструментов, что делает её надежным решением для автоматизации бизнес-процессов.
Вход: 7 ₽/MВыход: 13 ₽/M
ТехнологииФинансы+2
Читать →
Qwen27 июля 2026 г.Qwen: Qwen3.7 Flash
Qwen3.7 Flash — это высокопроизводительная мультимодальная модель от Alibaba, специализирующаяся на визуальном анализе и логических рассуждениях. Она отлично справляется с распознаванием объектов, пространственным ориентированием и сложным взаимодействием с компьютерными интерфейсами.
Вход: 4 ₽/MВыход: 17 ₽/M
ТехнологииПрограммирование+2
Читать →
Poolside02 июля 2026 г.
Poolside: Laguna XS 2.1
Laguna XS 2.1 — это специализированная модель-агент для программирования в категории 33B-A3B, предлагающая значительное улучшение производительности по сравнению с предыдущими версиями. Благодаря контекстному окну в 262 144 токена, она эффективно справляется с анализом крупных кодовых баз и сложными задачами разработки.
Вход: 8 ₽/MВыход: 15 ₽/M
ПрограммированиеТехнологии+1
Читать →
Rekaai20 марта 2026 г.
Reka Edge
Reka Edge — это высокоэффективная мультимодальная модель на 7 миллиардов параметров, специализирующаяся на глубоком анализе изображений и видео. Она демонстрирует отличные результаты в распознавании объектов и работе в качестве автономного агента с использованием инструментов.
Вход: 13 ₽/MВыход: 13 ₽/M
ТехнологииНаука+1
Читать →
Deepseek24 апреля 2026 г.DeepSeek: DeepSeek V4 Flash 0423
DeepSeek V4 Flash — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для мгновенного отклика. Благодаря поддержке контекстного окна в 1 миллион токенов, она идеально подходит для обработки сверхдлинных документов и сложного анализа данных.
Вход: 9 ₽/MВыход: 21 ₽/M
ПрограммированиеТехнологии+3
Читать →
Deepseek31 июля 2026 г.DeepSeek: DeepSeek V4 Flash 0731
DeepSeek V4 Flash 0731 — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для задач программирования и логических рассуждений. Благодаря огромному контекстному окну в 1 миллион токенов, она эффективно справляется с анализом масштабных кодовых баз и сложными агентскими сценариями.
Вход: 10 ₽/MВыход: 21 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia11 августа 2026 г.
NVIDIA: Nemotron 3.5 Lightning
NVIDIA Nemotron 3.5 Lightning — это высокопроизводительная модель с архитектурой Mixture-of-Experts, оптимизированная для быстрой генерации ответов. Благодаря 3 миллиардам активных параметров она идеально подходит для работы в составе ИИ-агентов и выполнения специализированных задач с высокой пропускной способностью.
Вход: 7 ₽/MВыход: 25 ₽/M
ТехнологииПрограммирование+2
Читать →
Qwen10 марта 2026 г.Qwen: Qwen3.5-9B
Qwen3.5-9B — это эффективная мультимодальная модель, объединяющая возможности обработки текста, изображений и видео в компактной архитектуре. Благодаря раннему слиянию токенов и контекстному окну в 262 144 токена, она демонстрирует высокие результаты в логических рассуждениях и программировании.
Вход: 13 ₽/MВыход: 19 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia14 декабря 2025 г.
NVIDIA: Nemotron 3 Nano 30B A3B
NVIDIA Nemotron 3 Nano 30B A3B — это компактная и эффективная MoE-модель с открытыми весами, оптимизированная для создания специализированных агентных систем. Благодаря поддержке контекста до 262 144 токенов и высокой вычислительной точности, она идеально подходит для развертывания в частной инфраструктуре.
Вход: 7 ₽/MВыход: 25 ₽/M
ТехнологииПрограммирование+2
Читать →
Poolside21 июля 2026 г.
Poolside: Laguna S 2.1
Laguna S 2.1 — это специализированная модель для программирования с архитектурой MoE, обладающая 118 млрд параметров. Она демонстрирует высокие результаты в тестах Terminal-Bench и поддерживает внушительное контекстное окно объемом более миллиона токенов.
Вход: 12 ₽/MВыход: 23 ₽/M
ПрограммированиеТехнологии+1
Читать →
Tencent22 апреля 2026 г.
Tencent: Hy3 preview
Tencent Hy3 Preview — это высокоэффективная модель на архитектуре Mixture-of-Experts, оптимизированная для работы в агентских сценариях. Она поддерживает гибкую настройку уровней рассуждения, что позволяет адаптировать её под задачи разной сложности в производственных средах.
Вход: 8 ₽/MВыход: 27 ₽/M
ТехнологииПрограммирование+2
Читать →
Qwen25 февраля 2026 г.Qwen: Qwen3.5-Flash
Qwen3.5-Flash — это быстрая мультимодальная модель на базе гибридной архитектуры с линейным вниманием и MoE. Она обеспечивает мгновенный отклик при работе с текстом, изображениями и видео, поддерживая контекст до 1 миллиона токенов.
Вход: 9 ₽/MВыход: 33 ₽/M
ТехнологииПрограммирование+2
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Luna Pro (batch)
GPT-5.6 Luna Pro в режиме batch представляет собой продвинутую модель с глубоким логическим выводом для обработки больших массивов данных. Благодаря огромному контекстному окну в 1,05 млн токенов, она идеально подходит для анализа сложной документации и мультимодальных задач.
Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииНаука+3
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Luna Pro
GPT-5.6 Luna Pro — это продвинутая версия модели Luna с активированным режимом глубокого рассуждения для решения сложнейших задач. Она поддерживает мультимодальный ввод данных и обладает внушительным контекстным окном в 1,05 миллиона токенов.
Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииНаука+2
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Luna (batch)
GPT-5.6 Luna (batch) — это высокопроизводительная модель, оптимизированная для обработки больших объемов данных с минимальными затратами. Она отлично справляется с классификацией, чатами и легкими агентскими сценариями, поддерживая мультимодальный ввод текста, изображений и файлов.
Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Luna
GPT-5.6 Luna — это высокопроизводительная модель от OpenAI, оптимизированная для задач с жесткими требованиями к скорости отклика. Она сочетает в себе продвинутые возможности рассуждения и огромный контекстный сектор, что делает её идеальной для обработки больших массивов данных и сложных агентских сценариев.
Вход: 7 ₽/MВыход: 38 ₽/M
ТехнологииМаркетинг+2
Читать →
Openai17 марта 2026 г.OpenAI: GPT-5.4 Nano (batch)
GPT-5.4 Nano (batch) — это самая легкая и быстрая модель в семействе GPT-5.4, оптимизированная для обработки огромных массивов данных с минимальной задержкой. Она поддерживает мультимодальный ввод, включая текст и изображения, предлагая внушительное контекстное окно в 400 000 токенов для масштабных задач.
Вход: 7 ₽/MВыход: 39 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Google03 апреля 2026 г.Google: Gemma 4 26B A4B
Gemma 4 26B A4B — это эффективная мультимодальная модель от Google DeepMind, использующая архитектуру Mixture-of-Experts для быстрой обработки данных. Она поддерживает работу с текстом, изображениями и видео до 60 секунд, предлагая внушительное контекстное окно в 256K токенов.
Вход: 9 ₽/MВыход: 38 ₽/M
ТехнологииПрограммирование+2
Читать →
Bytedance-seed23 декабря 2025 г.
ByteDance Seed: Seed 1.6 Flash
Seed 1.6 Flash — это сверхбыстрая мультимодальная модель от ByteDance, поддерживающая глубокое мышление и анализ визуального контента. Благодаря контекстному окну в 256k токенов, она эффективно справляется с обработкой объемных документов и сложных медиафайлов.
Вход: 10 ₽/MВыход: 38 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Mistralai02 декабря 2025 г.Mistral: Ministral 3 14B 2512
Ministral 3 14B — это флагманская модель в линейке Ministral, предлагающая производительность уровня Mistral Small 24B при более компактном размере. Она поддерживает мультимодальный ввод и обладает внушительным контекстным окном в 262 144 токена для обработки сложных данных.
Вход: 25 ₽/MВыход: 25 ₽/M
ТехнологииПрограммирование+2
Читать →
Stepfun29 января 2026 г.
StepFun: Step 3.5 Flash
Step 3.5 Flash — это высокопроизводительная модель на базе архитектуры Mixture of Experts (MoE), которая сочетает огромный объем знаний с высокой скоростью работы. Благодаря активации всего 11 миллиардов параметров из 196 миллиардов, она обеспечивает мгновенные ответы и поддерживает внушительное контекстное окно в 256 тысяч токенов.
Вход: 13 ₽/MВыход: 38 ₽/M
ТехнологииПрограммирование+2
Читать →
Xiaomi22 апреля 2026 г.
Xiaomi: MiMo-V2.5
MiMo-V2.5 — это нативная мультимодальная модель от Xiaomi, обеспечивающая производительность уровня Pro-агентов. Она значительно превосходит предыдущие итерации в понимании изображений и видео, предлагая высокую эффективность при выполнении сложных задач.
Вход: 18 ₽/MВыход: 35 ₽/M
ТехнологииНаука+2
Читать →
Google02 апреля 2026 г.Google: Gemma 4 31B
Gemma 4 31B — это мощная мультимодальная модель от Google DeepMind, поддерживающая работу с текстом и изображениями. Благодаря внушительному контекстному окну в 256K токенов и настраиваемому режиму рассуждений, она отлично справляется со сложным программированием и анализом объемных документов.
Вход: 10 ₽/MВыход: 43 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia11 марта 2026 г.
NVIDIA: Nemotron 3 Super
NVIDIA Nemotron 3 Super — это гибридная MoE-модель на 120 млрд параметров, использующая архитектуру Mamba-Transformer для высокой эффективности. Она оптимизирована для сложных мультиагентных систем и демонстрирует выдающиеся результаты в программировании и логическом планировании.
Вход: 11 ₽/MВыход: 45 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai19 января 2026 г.
Z.ai: GLM 4.7 Flash
Z.ai: GLM 4.7 Flash — это высокопроизводительная модель класса 30B, оптимизированная для задач программирования и сложного планирования. Благодаря внушительному контекстному окну более 200 тысяч токенов, она эффективно справляется с анализом объемных документов и разработкой комплексных ИИ-агентов.
Вход: 8 ₽/MВыход: 50 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed26 февраля 2026 г.
ByteDance Seed: Seed-2.0-Mini
Seed-2.0-Mini — это легковесная мультимодальная модель от ByteDance, оптимизированная для задач с высокой нагрузкой и жесткими требованиями к скорости ответа. Она поддерживает контекст до 256k токенов и предлагает четыре режима сложности рассуждений для гибкого управления ресурсами.
Вход: 13 ₽/MВыход: 50 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Tencent06 июля 2026 г.
Tencent: Hy3
Tencent Hy3 — это мощная модель на архитектуре Mixture-of-Experts с 295 миллиардами параметров, оптимизированная для сложных рассуждений и работы в качестве ИИ-агента. Благодаря поддержке настраиваемого уровня логических размышлений и огромному контекстному окну, она эффективно справляется с масштабными производственными задачами.
Вход: 16 ₽/MВыход: 66 ₽/M
ТехнологииПрограммирование+2
Читать →
Inclusionai08 мая 2026 г.
inclusionAI: Ring-2.6-1T
Ring-2.6-1T — это масштабная модель с архитектурой мышления, оптимизированная для сложных агентных рабочих процессов и написания кода. Благодаря 63 миллиардам активных параметров и внушительному контекстному окну, она обеспечивает высокую эффективность в решении многоступенчатых задач и интеграции с инструментами.
Вход: 10 ₽/MВыход: 78 ₽/M
ПрограммированиеТехнологии+2
Читать →
Inclusionai23 апреля 2026 г.
inclusionAI: Ling-2.6-1T
Ling-2.6-1T — это флагманская модель с триллионом параметров, оптимизированная для работы в качестве быстрого ИИ-агента. Она сочетает в себе огромную вычислительную мощность с высокой скоростью исполнения, что делает её подходящей для масштабных корпоративных задач.
Вход: 10 ₽/MВыход: 78 ₽/M
ТехнологииПрограммирование+2
Читать →
Openai17 марта 2026 г.OpenAI: GPT-5.4 Nano
GPT-5.4 Nano — это самая легкая и экономичная модель в семействе GPT-5.4, оптимизированная для задач с критическими требованиями к скорости. Она поддерживает мультимодальный ввод и идеально подходит для классификации данных, извлечения информации и работы в составе распределенных агентских систем.
Вход: 13 ₽/MВыход: 78 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Kwaipilot10 июля 2026 г.
Kwaipilot: KAT-Coder-Air V2.5
KAT-Coder-Air V2.5 — это флагманская агентная модель, специально разработанная для автономного решения сложных задач программирования. Она способна самостоятельно анализировать бизнес-процессы, находить проблемные места в коде и вносить необходимые исправления в рамках всего проекта.
Вход: 19 ₽/MВыход: 75 ₽/M
ПрограммированиеТехнологии+1
Читать →
Minimax31 мая 2026 г.
MiniMax: MiniMax M3 (batch)
MiniMax M3 — это мощная мультимодальная модель, способная обрабатывать текст, изображения и видео с впечатляющим контекстным окном. Она оптимизирована для решения сложных агентских задач, написания кода и анализа объемных данных в пакетном режиме через alltokens.
Вход: 19 ₽/MВыход: 75 ₽/M
ПрограммированиеТехнологии+2
Читать →
Mistralai16 марта 2026 г.Mistral: Mistral Small 4
Mistral Small 4 — это универсальная мультимодальная модель, объединяющая возможности анализа текста, обработки изображений и продвинутого написания кода. Благодаря интеграции наработок линеек Pixtral и Devstral, она эффективно справляется со сложными агентными задачами в рамках единого рабочего процесса.
Вход: 19 ₽/MВыход: 75 ₽/M
ПрограммированиеТехнологии+2
Читать →
Upstage27 января 2026 г.
Upstage: Solar Pro 3
Solar Pro 3 — это мощная модель на архитектуре Mixture-of-Experts (MoE) от Upstage, использующая 12 млрд активных параметров из 102 млрд. Она обеспечивает высокую производительность и эффективность, предлагая расширенную поддержку корейского, английского и японского языков.
Вход: 19 ₽/MВыход: 75 ₽/M
ТехнологииПеревод+1
Читать →
Google07 мая 2026 г.Google: Gemini 3.1 Flash Lite (batch)
Gemini 3.1 Flash Lite (batch) — это высокоэффективная мультимодальная модель, оптимизированная для пакетной обработки огромных массивов данных. Она поддерживает работу с текстом, изображениями, видео и аудио, предлагая внушительное контекстное окно в 1 миллион токенов для сложных аналитических задач.
Вход: 16 ₽/MВыход: 94 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Google07 мая 2026 г.Google: Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель от Google, оптимизированная для задач с минимальной задержкой и большими объемами данных. Она поддерживает работу с текстом, изображениями, видео, аудио и PDF, предлагая контекстное окно в 1 миллион токенов для сложных агентских сценариев.
Вход: 16 ₽/MВыход: 94 ₽/M
ТехнологииПрограммирование+2
Читать →
Google03 марта 2026 г.Google: Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash Lite Preview — это высокоэффективная модель от Google, оптимизированная для массовых задач с поддержкой мультимодальных данных. Она превосходит версию 2.5 Flash Lite по качеству и предлагает гибкую настройку уровней «мышления» для баланса между стоимостью и производительностью.
Вход: 16 ₽/MВыход: 94 ₽/M
ПрограммированиеТехнологии+2
Читать →
Qwen04 февраля 2026 г.Qwen: Qwen3 Coder Next
Qwen3 Coder Next — это специализированная языковая модель с открытыми весами, оптимизированная для задач программирования и локальной разработки. Благодаря архитектуре MoE с 80 миллиардами параметров, из которых активны только 3 миллиарда, она обеспечивает высокую скорость работы при сохранении глубокой экспертизы в кодинге.
Вход: 15 ₽/MВыход: 100 ₽/M
ПрограммированиеТехнологии+1
Читать →
Inception04 марта 2026 г.
Inception: Mercury 2
Mercury 2 — это инновационная диффузионная модель (dLLM), обеспечивающая рекордную скорость генерации свыше 1000 токенов в секунду. Она сочетает в себе глубокие рассуждения с параллельной обработкой данных, что делает её в 5 раз быстрее конкурентов при низкой стоимости эксплуатации.
Вход: 32 ₽/MВыход: 94 ₽/M
ПрограммированиеТехнологии+2
Читать →
Arcee-ai01 апреля 2026 г.
Arcee AI: Trinity Large Thinking
Trinity Large Thinking — это мощная open-source модель от Arcee AI, оптимизированная для сложных рассуждений и агентных сценариев. Она демонстрирует высокие результаты в бенчмарке PinchBench и поддерживает внушительное контекстное окно в 262 тысячи токенов.
Вход: 28 ₽/MВыход: 100 ₽/M
ТехнологииПрограммирование+2
Читать →
Qwen27 апреля 2026 г.Qwen: Qwen3.6 35B A3B
Qwen3.6-35B-A3B — это мультимодальная модель от Alibaba Cloud, использующая гибридную архитектуру Mixture-of-Experts для эффективной обработки текста, изображений и видео. Благодаря 35 миллиардам общих параметров и огромному контекстному окну, она обеспечивает высокую точность анализа сложных визуальных и текстовых данных.
Вход: 13 ₽/MВыход: 118 ₽/M
ТехнологииНаука+2
Читать →
Minimax12 февраля 2026 г.
MiniMax: MiniMax M2.5
MiniMax M2.5 — это передовая языковая модель, оптимизированная для офисной продуктивности и сложного программирования. Она демонстрирует выдающиеся результаты в работе с документами Word, Excel и PowerPoint, а также эффективно управляет контекстом при переключении между различными программными средами.
Вход: 28 ₽/MВыход: 112 ₽/M
ПрограммированиеТехнологии+2
Читать →
Qwen25 февраля 2026 г.Qwen: Qwen3.5-35B-A3B
Qwen3.5-35B-A3B — это инновационная мультимодальная модель, использующая гибридную архитектуру с линейным вниманием и механизмом Mixture-of-Experts (MoE). Она обеспечивает высокую эффективность инференса и поддерживает обработку текста, изображений и видео в рамках огромного контекстного окна.
Вход: 18 ₽/MВыход: 125 ₽/M
ТехнологииНаука+2
Читать →
Minimax31 мая 2026 г.
MiniMax: MiniMax M3
MiniMax M3 — это мощная мультимодальная модель, способная обрабатывать текст, изображения и видео с впечатляющим контекстным окном в 1 миллион токенов. Она оптимизирована для решения сложных задач программирования и длительной работы в режиме автономного агента.
Вход: 29 ₽/MВыход: 120 ₽/M
ПрограммированиеТехнологии+2
Читать →
Minimax18 марта 2026 г.
MiniMax: MiniMax M2.7
MiniMax M2.7 — это передовая языковая модель, ориентированная на автономную работу и решение сложных производственных задач через мультиагентное взаимодействие. Она демонстрирует высокие результаты в отладке кода, финансовом моделировании и создании полноценных документов в форматах Word, Excel и PowerPoint.
Вход: 30 ₽/MВыход: 120 ₽/M
ПрограммированиеФинансы+2
Читать →
Z-ai08 декабря 2025 г.
Z.ai: GLM 4.6V
GLM-4.6V — это мощная мультимодальная модель, специализирующаяся на глубоком анализе визуального контента и работе с длинными контекстами до 128K токенов. Она отлично справляется с распознаванием сложных макетов документов, анализом видео и извлечением данных из смешанных медиа-форматов.
Вход: 38 ₽/MВыход: 112 ₽/M
ТехнологииНаука+2
Читать →
Nex-agi08 июня 2026 г.
Nex AGI: Nex-N2-Pro
Nex-N2-Pro — это продвинутая мультимодальная модель на архитектуре Qwen3.5, использующая метод смеси экспертов (MoE) для эффективной обработки текста и изображений. Благодаря огромному контекстному окну в 262 144 токена и поддержке логических рассуждений, она отлично подходит для работы со сложными агентскими сценариями.
Вход: 32 ₽/MВыход: 125 ₽/M
ТехнологииПрограммирование+2
Читать →
Xiaomi22 апреля 2026 г.
Xiaomi: MiMo-V2.5-Pro
MiMo-V2.5-Pro — это флагманская модель от Xiaomi, оптимизированная для решения сложных инженерных задач и длительных рабочих циклов. Она демонстрирует выдающиеся результаты в бенчмарках на программирование и автономное выполнение агентских функций.
Вход: 50 ₽/MВыход: 109 ₽/M
ПрограммированиеТехнологии+2
Читать →
Deepseek12 августа 2026 г.DeepSeek: DeepSeek V4 Pro 0813
DeepSeek V4 Pro 0813 представляет собой масштабную модель на архитектуре Mixture-of-Experts, оптимизированную для сложных текстовых задач. Релиз GA обеспечивает высокую стабильность работы и поддержку огромного контекстного окна для обработки сверхдлинных документов.
Вход: 55 ₽/MВыход: 109 ₽/M
ТехнологииПрограммирование+2
Читать →
Qwen27 апреля 2026 г.Qwen: Qwen3.6 Flash
Qwen3.6 Flash — это высокопроизводительная мультимодальная модель от Alibaba, оптимизированная для мгновенной обработки данных. Она поддерживает работу с текстом, изображениями и видео, предлагая внушительное контекстное окно в 1 миллион токенов для анализа сверхбольших документов.
Вход: 24 ₽/MВыход: 140 ₽/M
ТехнологииПрограммирование+2
Читать →
Deepseek24 апреля 2026 г.DeepSeek: DeepSeek V4 Pro
DeepSeek V4 Pro — это масштабная модель на архитектуре Mixture-of-Experts с 1,6 трлн параметров, оптимизированная для сложного логического вывода и программирования. Благодаря рекордному контекстному окну в 1 миллион токенов, она способна обрабатывать огромные массивы данных и длинные цепочки рассуждений.
Вход: 55 ₽/MВыход: 109 ₽/M
ПрограммированиеТехнологии+2
Читать →
Openai17 марта 2026 г.OpenAI: GPT-5.4 Mini (batch)
GPT-5.4 Mini (batch) — это высокопроизводительная модель, оптимизированная для обработки больших объемов данных с поддержкой мультимодальных входных данных. Она сочетает в себе продвинутые возможности рассуждения и кодинга с внушительным контекстным окном в 400 000 токенов.
Вход: 24 ₽/MВыход: 140 ₽/M
ПрограммированиеТехнологии+2
Читать →
Stepfun28 мая 2026 г.
StepFun: Step 3.7 Flash
Step 3.7 Flash — это высокоэффективная мультимодальная модель на базе архитектуры Mixture-of-Experts, предназначенная для быстрой обработки текста, изображений и видео. Благодаря контекстному окну в 256 000 токенов и нативному визуальному кодировщику, она обеспечивает глубокое понимание сложного контента при минимальных задержках.
Вход: 25 ₽/MВыход: 143 ₽/M
ТехнологииМаркетинг+2
Читать →
Google21 июля 2026 г.Google: Gemini 3.5 Flash Lite (batch)
Gemini 3.5 Flash Lite (batch) — это высокоэффективная модель от Google, оптимизированная для пакетной обработки данных и работы в качестве субагентов. Она обладает улучшенными агентными способностями и поддерживает огромный контекст до 1 миллиона токенов, включая мультимодальные входные данные.
Вход: 19 ₽/MВыход: 156 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Google21 июля 2026 г.Google: Gemini 3.5 Flash Lite
Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентскими способностями. Она оптимизирована для работы в качестве субагента, выполняющего узкоспециализированные задачи внутри сложных многоагентных систем.
Вход: 19 ₽/MВыход: 156 ₽/M
ТехнологииПрограммирование+2
Читать →
Meta09 августа 2026 г.Meta: Muse Glimmer 30B
Meta: Muse Glimmer 30B — это компактная мультимодальная модель с открытыми весами, оптимизированная для работы автономных агентов на пользовательском оборудовании. Благодаря дистилляции из Muse Spark, она эффективно справляется с длительными задачами и анализом визуальных данных при контекстном окне в 128k токенов.
Вход: 38 ₽/MВыход: 150 ₽/M
ТехнологииПрограммирование+2
Читать →
Meituan20 июля 2026 г.
Meituan: LongCat 2.0
LongCat 2.0 — это мощная MoE-модель от Meituan с 1,6 трлн параметров, оптимизированная для работы с огромными контекстами до 1 млн токенов. Она демонстрирует высокую эффективность в программировании на уровне репозиториев и решении сложных многошаговых задач.
Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+2
Читать →
Kwaipilot27 марта 2026 г.
Kwaipilot: KAT-Coder-Pro V2
KAT-Coder-Pro V2 — это специализированная модель для корпоративной разработки ПО и интеграции SaaS-решений. Она оптимизирована для работы в масштабных продакшн-средах, поддерживает многосистемную координацию и генерацию эстетичных веб-интерфейсов.
Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+1
Читать →
Minimax23 января 2026 г.
MiniMax: MiniMax M2-her
MiniMax M2-her — это специализированная языковая модель, оптимизированная для глубокого ролевого взаимодействия и создания выразительных диалогов. Она отлично удерживает контекст персонажа и демонстрирует высокую последовательность в многоходовых беседах.
Вход: 38 ₽/MВыход: 150 ₽/M
Ролевые сценарииПеревод+1
Читать →
Minimax23 декабря 2025 г.
MiniMax: MiniMax M2.1
MiniMax M2.1 — это компактная и высокопроизводительная модель, специально оптимизированная для написания кода и создания автономных агентов. Несмотря на малый объем активируемых параметров, она демонстрирует выдающиеся результаты в разработке современных приложений и сложных рабочих процессах.
Вход: 38 ₽/MВыход: 150 ₽/M
ПрограммированиеТехнологии+1
Читать →
Qwen03 июня 2026 г.Qwen: Qwen3.7 Plus
Qwen3.7 Plus представляет собой сбалансированное решение в линейке Alibaba, предлагающее расширенные возможности обработки текста и изображений. Модель выделяется огромным контекстным окном в 1 миллион токенов, что позволяет эффективно работать с лонгридами и сложными визуальными данными.
Вход: 40 ₽/MВыход: 159 ₽/M
ТехнологииПрограммирование+2
Читать →
Thinkingmachines30 июля 2026 г.
Thinking Machines: Inkling Small
Inkling Small — это эффективная мультимодальная модель с архитектурой Mixture-of-Experts, использующая 12 миллиардов активных параметров. Она поддерживает обработку текста, изображений и аудио, предлагая внушительное контекстное окно объемом более 500 тысяч токенов.
Вход: 56 ₽/MВыход: 150 ₽/M
ТехнологииНаука+2
Читать →
Perceptron12 мая 2026 г.
Perceptron: Perceptron Mk1
Perceptron Mk1 — это флагманская мультимодальная модель, специализирующаяся на глубоком анализе видеоконтента и визуальном мышлении. Она эффективно объединяет обработку изображений и видео с естественным языком для создания детальных отчетов и логических выводов.
Вход: 19 ₽/MВыход: 187 ₽/M
ТехнологииНаука+1
Читать →
Google30 июня 2026 г.Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
Nano Banana 2 Lite — это самая быстрая и оптимизированная модель в линейке Gemini, предназначенная для мгновенной генерации изображений и визуального анализа. Она идеально подходит для разработчиков, которым требуется высокая пропускная способность и минимальные задержки при работе с мультимодальными данными.
Вход: 32 ₽/MВыход: 187 ₽/M
ТехнологииМаркетинг+2
Читать →
Qwen25 февраля 2026 г.Qwen: Qwen3.5-27B
Qwen3.5-27B — это производительная мультимодальная модель с линейным механизмом внимания, обеспечивающим высокую скорость отклика. По своим возможностям она сопоставима с более крупной версией 122B, предлагая отличный баланс между эффективностью и качеством обработки визуальных данных.
Вход: 25 ₽/MВыход: 194 ₽/M
ТехнологииНаука+2
Читать →
Google17 декабря 2025 г.Google: Gemini 3 Flash Preview (batch)
Gemini 3 Flash Preview (batch) — это высокоскоростная модель с продвинутым мышлением, оптимизированная для пакетной обработки данных и сложных агентских сценариев. Она сочетает в себе возможности рассуждения уровня Pro-моделей с огромным контекстным окном в 1 миллион токенов для анализа мультимодального контента.
Вход: 32 ₽/MВыход: 187 ₽/M
ПрограммированиеТехнологии+2
Читать →
Google17 декабря 2025 г.Google: Gemini 3 Flash Preview
Gemini 3 Flash Preview — это высокоскоростная модель нового поколения, оптимизированная для работы автономных агентов и сложных многоэтапных диалогов. Она сочетает в себе глубокое логическое мышление уровня Pro-версий с поддержкой огромного контекстного окна и мультимодальных данных.
Вход: 32 ₽/MВыход: 187 ₽/M
ПрограммированиеТехнологии+2
Читать →
Qwen16 февраля 2026 г.Qwen: Qwen3.5 Plus 2026-02-15
Qwen3.5 Plus — это передовая мультимодальная модель на гибридной архитектуре, сочетающая линейное внимание и разреженные MoE-слои для высокой эффективности. Она демонстрирует значительный скачок в качестве обработки текста, изображений и видео по сравнению с предыдущим поколением, достигая уровня топовых мировых решений.
Вход: 33 ₽/MВыход: 194 ₽/M
ТехнологииНаука+2
Читать →
Aion-labs07 июля 2026 г.
AionLabs: Aion-3.0-Mini
Aion-3.0-Mini — это специализированная мультимодельная система от AionLabs, построенная на базе архитектуры DeepSeek. Модель использует процесс совместной генерации несколькими специализированными агентами для достижения высокого качества в творческих задачах.
Вход: 84 ₽/MВыход: 168 ₽/M
Ролевые сценарииТехнологии+2
Читать →
Nvidia04 июня 2026 г.
NVIDIA: Nemotron 3 Ultra (batch)
NVIDIA Nemotron 3 Ultra — это мощная модель с архитектурой Mixture-of-Experts (MoE), сочетающая трансформеры и Mamba для эффективного рассуждения. Благодаря огромному контекстному окну более 500 тысяч токенов, она отлично справляется с анализом масштабных документов и сложной оркестрацией задач.
Вход: 36 ₽/MВыход: 216 ₽/M
ТехнологииНаука+2
Читать →
Qwen27 апреля 2026 г.Qwen: Qwen3.5 Plus 2026-04-20
Qwen3.5 Plus — это мощная мультимодальная модель от Alibaba, способная обрабатывать текст, изображения и видео. Благодаря рекордному контекстному окну в 1 миллион токенов, она идеально подходит для анализа сверхдлинных документов и сложных медиафайлов.
Вход: 36 ₽/MВыход: 216 ₽/M
ТехнологииПрограммирование+2
Читать →
Z-ai22 декабря 2025 г.
Z.ai: GLM 4.7
Z.ai: GLM 4.7 — это флагманская модель с улучшенными возможностями программирования и стабильным многошаговым рассуждением. Она оптимизирована для выполнения сложных агентских задач и точного исполнения инструкций в рамках длинного контекста.
Вход: 48 ₽/MВыход: 210 ₽/M
ПрограммированиеТехнологии+2
Читать →
Qwen16 февраля 2026 г.Qwen: Qwen3.5 397B A17B
Qwen3.5 397B A17B — это мощная мультимодальная модель на базе гибридной архитектуры MoE и линейного внимания, обеспечивающая высокую эффективность инференса. Она демонстрирует передовые результаты в логическом мышлении, генерации кода и анализе видеоконтента.
Вход: 37 ₽/MВыход: 231 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed10 марта 2026 г.
ByteDance Seed: Seed-2.0-Lite
Seed-2.0-Lite — это сбалансированная модель от ByteDance, оптимизированная для высоконагруженных корпоративных задач с акцентом на экономическую эффективность. Она превосходит предыдущее поколение Seed-1.8, предлагая стабильную работу с длинным контекстом и качественную генерацию структурированных данных.
Вход: 30 ₽/MВыход: 240 ₽/M
ТехнологииМаркетинг+2
Читать →
Qwen02 апреля 2026 г.Qwen: Qwen3.6 Plus
Qwen3.6 Plus — это передовая мультимодальная модель на базе гибридной архитектуры, объединяющей линейное внимание и разреженную структуру MoE. Она поддерживает обработку текста, изображений и видео с впечатляющим контекстным окном в 1 миллион токенов, обеспечивая высокую производительность в сложных задачах.
Вход: 39 ₽/MВыход: 234 ₽/M
ТехнологииПрограммирование+2
Читать →
Qwen27 апреля 2026 г.Qwen: Qwen3.6 27B
Qwen3.6 27B — это продвинутая мультимодальная модель от Alibaba, способная обрабатывать текст, изображения и видео. Благодаря внушительному контекстному окну в 262 тысячи токенов, она эффективно справляется с анализом длинных документов и сложных медиафайлов.
Вход: 35 ₽/MВыход: 240 ₽/M
ТехнологииПрограммирование+2
Читать →
Qwen25 февраля 2026 г.Qwen: Qwen3.5-122B-A10B
Qwen3.5-122B-A10B — это продвинутая мультимодальная модель на базе гибридной архитектуры с линейным вниманием и MoE, обеспечивающая высокую эффективность инференса. Она превосходит предыдущие флагманы Qwen3 по текстовым и визуальным возможностям, занимая второе место в линейке по общей производительности.
Вход: 32 ₽/MВыход: 249 ₽/M
ТехнологииНаука+2
Читать →
Aion-labs23 февраля 2026 г.
AionLabs: Aion-2.0
Aion-2.0 — это специализированная версия DeepSeek V3.2, созданная для глубокого погружения в ролевые игры и сторителлинг. Модель мастерски создает напряжение и конфликты, обеспечивая высокую вовлеченность в повествование даже при работе со сложными и мрачными темами.
Вход: 96 ₽/MВыход: 192 ₽/M
Ролевые сценарииТехнологии+1
Читать →
Moonshotai27 января 2026 г.
MoonshotAI: Kimi K2.5
Kimi K2.5 — это передовая мультимодальная модель от Moonshot AI, обученная на колоссальном массиве данных в 15 триллионов токенов. Она выделяется исключительными способностями к визуальному программированию и поддержкой парадигмы автономных агентских систем.
Вход: 45 ₽/MВыход: 243 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai16 июня 2026 г.
Z.ai: GLM 5.2
GLM-5.2 — это флагманская модель от Z.ai, специально разработанная для выполнения сложных задач с длительным горизонтом планирования. Благодаря контекстному окну в 1 миллион токенов, она эффективно справляется с анализом масштабных инженерных проектов и надежным следованием инструкциям.
Вход: 60 ₽/MВыход: 237 ₽/M
ПрограммированиеТехнологии+2
Читать →
Moonshotai12 июня 2026 г.
MoonshotAI: Kimi K2.7 Code (batch)
Kimi K2.7 Code — это специализированная модель из семейства Kimi K2, оптимизированная для решения сложных задач программирования. Благодаря архитектуре Mixture-of-Experts и поддержке длинного контекста, она эффективно справляется с написанием кода и анализом мультимодальных данных.
Вход: 57 ₽/MВыход: 240 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai11 февраля 2026 г.
Z.ai: GLM 5
GLM-5 от Z.ai — это флагманская open-source модель, специально разработанная для проектирования сложных систем и длительных агентных рабочих процессов. Она ориентирована на экспертную разработку ПО, предлагая возможности автономного планирования и глубокого логического обоснования бэкенд-задач.
Вход: 72 ₽/MВыход: 230 ₽/M
ПрограммированиеТехнологии+2
Читать →
Thinkingmachines17 июля 2026 г.
Thinking Machines: Inkling (batch)
Inkling (batch) — это мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для пакетной обработки данных. Она обладает внушительным контекстным окном в 524 288 токенов и специализируется на сложных рассуждениях, программировании и работе с мультимедийным контентом.
Вход: 60 ₽/MВыход: 243 ₽/M
ТехнологииПрограммирование+2
Читать →
Openai17 марта 2026 г.OpenAI: GPT-5.4 Mini
GPT-5.4 Mini — это высокопроизводительная модель, оптимизированная для быстрой обработки больших объемов данных с поддержкой текста и изображений. Она сочетает в себе продвинутые возможности рассуждения и кодинга с низкой задержкой, что делает её идеальной для масштабируемых производственных решений.
Вход: 45 ₽/MВыход: 270 ₽/M
ПрограммированиеТехнологии+2
Читать →
Nvidia04 июня 2026 г.
NVIDIA: Nemotron 3 Ultra
NVIDIA Nemotron 3 Ultra — это передовая модель с архитектурой Mixture-of-Experts (MoE), сочетающая трансформеры и Mamba для эффективного рассуждения. Благодаря контекстному окну в 1 миллион токенов, она отлично справляется со сложной оркестрацией и анализом масштабных данных.
Вход: 60 ₽/MВыход: 264 ₽/M
ТехнологииНаука+2
Читать →
Amazon02 декабря 2025 г.Amazon: Nova 2 Lite
Amazon Nova 2 Lite — это высокопроизводительная мультимодальная модель, оптимизированная для быстрой обработки текста, изображений и видео. Благодаря контекстному окну в 1 миллион токенов, она эффективно справляется с анализом объемных документов и длинных видеороликов.
Вход: 36 ₽/MВыход: 299 ₽/M
ТехнологииМаркетинг и SEO+2
Читать →
Z-ai16 июня 2026 г.
Z.ai: GLM 5.2 (batch)
GLM 5.2 от Z.ai — это мощная модель для сложных рассуждений с внушительным контекстным окном до 512 000 токенов. Она оптимизирована для длительных рабочих процессов, управления агентами и разработки программного обеспечения на уровне целых проектов.
Вход: 84 ₽/MВыход: 264 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed12 августа 2026 г.
ByteDance Seed: Seed 2.1 Turbo
Seed 2.1 Turbo от ByteDance — это мощная мультимодальная модель, оптимизированная для написания кода и выполнения сложных многоэтапных задач. Благодаря поддержке контекста до 262 144 токенов, она эффективно справляется с анализом длинных документов и визуального контента.
Вход: 60 ₽/MВыход: 299 ₽/M
ПрограммированиеТехнологии+2
Читать →
X-ai20 мая 2026 г.SpaceXAI: Grok Build 0.1
Grok Build 0.1 — это специализированная модель от xAI, оптимизированная для агентной разработки программного обеспечения и интерактивного кодинга. Она поддерживает мультимодальный ввод данных и обладает внушительным контекстным окном в 256 000 токенов для работы со сложными проектами.
Вход: 120 ₽/MВыход: 240 ₽/M
ПрограммированиеТехнологии+1
Читать →
Openai19 января 2026 г.OpenAI: GPT Audio Mini
GPT Audio Mini — это оптимизированная версия мультимодальной модели от OpenAI, предназначенная для эффективной обработки аудио и текста. Обновленный декодер обеспечивает естественное звучание голоса и высокую стабильность вокальных характеристик при сохранении внушительного контекстного окна.
Вход: 72 ₽/MВыход: 288 ₽/M
ТехнологииПеревод+2
Читать →
Moonshotai20 апреля 2026 г.
MoonshotAI: Kimi K2.6
Kimi K2.6 — это мультимодальная модель нового поколения от Moonshot AI, оптимизированная для сложного программирования и создания UI/UX. Она поддерживает контекст до 262 тысяч токенов и эффективно справляется с многоагентной оркестрацией и долгосрочными задачами разработки.
Вход: 70 ₽/MВыход: 302 ₽/M
ПрограммированиеТехнологии+2
Читать →
Bytedance-seed12 августа 2026 г.
ByteDance Seed: Seed-2.0-Code
Seed-2.0-Code от ByteDance — это специализированная модель, оптимизированная для агентного программирования и сложных рабочих процессов. Она отлично справляется с фронтенд-разработкой и многоязычными задачами, поддерживая огромный контекст для анализа целых репозиториев.
Вход: 60 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+1
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Terra Pro (batch)
GPT-5.6 Terra Pro (batch) — это продвинутая мультимодальная модель, работающая в режиме глубокого рассуждения для решения сложнейших задач. Благодаря огромному контекстному окну в 1,05 млн токенов и пакетной обработке, она идеально подходит для анализа массивов данных с высочайшей точностью.
Вход: 60 ₽/MВыход: 359 ₽/M
ТехнологииНаука+3
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Terra Pro
GPT-5.6 Terra Pro — это продвинутая версия модели Terra с активированным режимом глубокого рассуждения для решения сложнейших задач. Она поддерживает мультимодальный ввод данных, включая изображения и файлы, и обладает внушительным контекстным окном в 1 миллион токенов.
Вход: 60 ₽/MВыход: 359 ₽/M
ТехнологииНаука+3
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Terra (batch)
GPT-5.6 Terra (batch) — это сбалансированная модель среднего уровня, предназначенная для эффективной обработки больших объемов данных в отложенном режиме. Она сочетает в себе продвинутые возможности рассуждения и программирования, занимая нишу между флагманскими и максимально упрощенными решениями серии.
Вход: 60 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+2
Читать →
Openai09 июля 2026 г.OpenAI: GPT-5.6 Terra
GPT-5.6 Terra представляет собой сбалансированное решение в линейке OpenAI, сочетающее высокую производительность с продвинутыми возможностями рассуждения. Модель оптимизирована для повседневного программирования, работы с мультимодальными данными и выполнения сложных агентских задач.
Вход: 60 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+2
Читать →
Google18 июня 2026 г.Google: Nano Banana 2 (Gemini 3.1 Flash Image)
Gemini 3.1 Flash Image, известная как Nano Banana 2, представляет собой передовую модель Google для генерации и редактирования изображений. Она сочетает в себе визуальное качество профессионального уровня с высокой скоростью работы и поддержкой длинного контекста.
Вход: 60 ₽/MВыход: 359 ₽/M
МаркетингТехнологии+2
Читать →
Google26 февраля 2026 г.Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)
Gemini 3.1 Flash Image Preview (Nano Banana 2) — это передовая модель Google для генерации и редактирования изображений, сочетающая качество уровня Pro с высокой скоростью работы. Она обеспечивает глубокое понимание контекста и позволяет гибко настраивать соотношение сторон через API, оставаясь при этом экономически эффективным решением.
Вход: 60 ₽/MВыход: 359 ₽/M
ТехнологииМаркетинг+2
Читать →
Kwaipilot10 июля 2026 г.
Kwaipilot: KAT-Coder-Pro V2.5
KAT-Coder-Pro V2.5 — это флагманская агентная модель, специально разработанная для решения сложных задач программирования. Она способна автономно анализировать целые рабочие процессы, находить ошибки и вносить исправления в код проекта.
Вход: 89 ₽/MВыход: 355 ₽/M
ПрограммированиеТехнологии+1
Читать →
X-ai30 апреля 2026 г.SpaceXAI: Grok 4.3
Grok 4.3 — это продвинутая мультимодальная модель от xAI, специализирующаяся на сложных рассуждениях и работе с контекстом до 1 миллиона токенов. Она отлично справляется с агентными сценариями, строгим следованием инструкциям и анализом визуальных данных.
Вход: 150 ₽/MВыход: 299 ₽/M
ТехнологииПрограммирование+3
Читать →
X-ai31 марта 2026 г.SpaceXAI: Grok 4.20 Multi-Agent
Grok 4.20 Multi-Agent — это продвинутая мультиагентная система от xAI, предназначенная для глубоких исследований и параллельной обработки сложных задач. Модель способна задействовать до 16 агентов одновременно для координации инструментов и синтеза информации в рамках огромного контекстного окна.
Вход: 150 ₽/MВыход: 299 ₽/M
ТехнологииНаука+2
Читать →
X-ai31 марта 2026 г.SpaceXAI: Grok 4.20
Grok 4.20 — это флагманская модель от xAI, выделяющаяся рекордной скоростью работы и минимальным уровнем галлюцинаций. Она поддерживает контекстное окно до 2 миллионов токенов и обладает продвинутыми возможностями вызова инструментов для создания автономных агентов.
Вход: 150 ₽/MВыход: 299 ₽/M
ТехнологииПрограммирование+3
Читать →
Openai10 декабря 2025 г.OpenAI: GPT-5.2 (batch)
GPT-5.2 (batch) — это флагманская модель нового поколения, оптимизированная для работы с длинным контекстом и сложными агентскими задачами. Благодаря адаптивному мышлению и поддержке мультимодальных входных данных, она эффективно справляется с глубоким анализом информации в пакетном режиме.
Вход: 53 ₽/MВыход: 419 ₽/M
ТехнологииПрограммирование+3
Читать →
Relace08 декабря 2025 г.
Relace: Relace Search
Relace Search — это специализированная агентная модель, предназначенная для глубокого исследования кодовой базы. В отличие от стандартных RAG-систем, она использует параллельный запуск инструментов поиска и анализа файлов для предоставления максимально релевантных фрагментов кода.
Вход: 120 ₽/MВыход: 359 ₽/M
ПрограммированиеТехнологии+1
Читать →
Z-ai07 апреля 2026 г.
Z.ai: GLM 5.1
GLM-5.1 представляет собой значительный скачок в области генерации кода и решения долгосрочных задач. Модель способна работать автономно над сложными проектами, выходя за рамки простых коротких взаимодействий благодаря расширенному контекстному окну.
Вход: 116 ₽/MВыход: 364 ₽/M
ПрограммированиеТехнологии+2
Читать →
Moonshotai12 июня 2026 г.
MoonshotAI: Kimi K2.7 Code
MoonshotAI: Kimi K2.7 Code — это специализированная мультимодальная модель, оптимизированная для решения сложных задач программирования и работы с длинным контекстом. Благодаря архитектуре Mixture-of-Experts, она эффективно справляется с написанием кода и анализом визуальных данных.
Вход: 81 ₽/MВыход: 407 ₽/M
ПрограммированиеТехнологии+2
Читать →
Openai05 марта 2026 г.OpenAI: GPT-5.4 (batch)
GPT-5.4 (batch) — это флагманская модель от OpenAI, объединяющая возможности Codex и GPT в единую систему с огромным контекстным окном более 1 миллиона токенов. Она поддерживает мультимодальный ввод и расширенные функции рассуждения, что делает её идеальной для обработки сверхбольших объемов данных в пакетном режиме.
Вход: 75 ₽/MВыход: 449 ₽/M
ТехнологииПрограммирование+3
Читать →
Google21 июля 2026 г.Google: Gemini 3.6 Flash (batch)
Gemini 3.6 Flash (batch) — это высокоэффективная мультимодальная модель от Google, оптимизированная для пакетной обработки данных и сложных рабочих процессов. Она отличается высокой точностью в программировании и веб-разработке, предлагая чистый результат с минимальным количеством правок.
Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+2
Читать →
Google21 июля 2026 г.Google: Gemini 3.6 Flash
Gemini 3.6 Flash — это высокоэффективная мультимодальная модель от Google, оптимизированная для программирования и создания автономных агентов. Она отличается высокой скоростью работы и способностью обрабатывать огромные объемы данных благодаря контекстному окну в 1 миллион токенов.
Вход: 90 ₽/MВыход: 449 ₽/M
ПрограммированиеТехнологии+2
Читать →
Qwen09 февраля 2026 г.Qwen: Qwen3 Max Thinking
Qwen3 Max Thinking — это флагманская модель с продвинутыми возможностями рассуждения, предназначенная для решения сложнейших когнитивных задач. Благодаря масштабированию вычислительных мощностей и обучению с подкреплением, она демонстрирует высокую точность в многошаговых логических цепочках.
Вход: 94 ₽/MВыход: 467 ₽/M
ТехнологииНаука+2
Читать →
Sakana11 августа 2026 г.
Sakana: Sakana Namazu
Sakana Namazu — это специализированная рассуждающая модель, оптимизированная для работы с японским языком и бизнес-контекстом. Основанная на архитектуре Kimi K2.6, она отлично справляется с анализом мультимодальных данных и сложным следованием инструкциям.
Вход: 114 ₽/MВыход: 479 ₽/M
ТехнологииПеревод+2
Читать →
Thinkingmachines17 июля 2026 г.
Thinking Machines: Inkling
Inkling — это мощная мультимодальная модель с архитектурой Mixture-of-Experts, оптимизированная для сложных рассуждений и программирования. Благодаря поддержке текста, изображений и аудио, а также огромному контекстному окну, она эффективно справляется с ролью автономного агента.
Вход: 114 ₽/MВыход: 485 ₽/M
ПрограммированиеТехнологии+2
Читать →
Z-ai01 апреля 2026 г.
Z.ai: GLM 5V Turbo
GLM-5V-Turbo — это первая нативная мультимодальная модель от Z.ai, разработанная специально для работы в качестве ИИ-агента. Она эффективно обрабатывает текст, изображения и видео, демонстрируя высокие результаты в долгосрочном планировании и написании кода на основе визуальных данных.
Вход: 144 ₽/MВыход: 479 ₽/M
ПрограммированиеТехнологии+1
Читать →
Z-ai15 марта 2026 г.
Z.ai: GLM 5 Turbo
GLM-5 Turbo от Z.ai — это высокопроизводительная модель, оптимизированная для работы в агентных средах и сценариях OpenClaw. Она демонстрирует исключительную стабильность в длительных рабочих процессах, эффективно справляясь с декомпозицией сложных инструкций и использованием инструментов.
Вход: 144 ₽/MВыход: 479 ₽/M
ТехнологииПрограммирование+1
Читать →
Google19 мая 2026 г.Google: Gemini 3.5 Flash (batch)
Gemini 3.5 Flash (batch) — это высокоэффективная мультимодальная модель от Google, оптимизированная для пакетной обработки данных и параллельного выполнения агентских задач. Она сочетает в себе продвинутые навыки программирования и логического вывода с огромным контекстным окном в 1 миллион токенов.
Вход: 90 ₽/MВыход: 539 ₽/M
ПрограммированиеТехнологии+2
Читать →
Google19 мая 2026 г.Google: Gemini 3.5 Flash
Gemini 3.5 Flash — это высокоэффективная мультимодальная модель от Google, сочетающая скорость работы с продвинутыми навыками программирования и логического вывода. Она оптимизирована для параллельного выполнения агентских задач и обработки огромных объемов данных благодаря контекстному окну в 1 миллион токенов.
Вход: 90 ₽/MВыход: 539 ₽/M
ПрограммированиеТехнологии+2
Читать →