Модель устарела
Из-за низкой популярности эта модель устарела и была удалена из API 5 мая 2026 г..
google/gemma-3n-e2b-it:freeGemma 3n E2B IT — это мультимодальная модель с инструктивной настройкой, разработанная Google DeepMind. Она спроектирована для эффективной работы с фактическим размером в 2 миллиарда параметров при использовании архитектуры на 6 миллиардов параметров. Благодаря архитектуре MatFormer модель поддерживает вложенные подмодели и модульную композицию через фреймворк Mix-and-Match. Модели серии Gemma 3n оптимизированы для развертывания в условиях ограниченных ресурсов, предлагают контекстное окно объемом 32K токенов и демонстрируют высокие показатели мультиязычности и логического вывода в стандартных тестах. Данная версия обучена на разнообразном корпусе данных, включающем программный код, математические вычисления, веб-контент и мультимодальную информацию.
Параметры, которые поддерживает эта модель в API-запросах
Система автоматически выбирает оптимального провайдера и переключается на резервный при сбоях.
Сравните разных провайдеров на AllTokens
Оценки модели из Artificial Analysis
Эта модель больше недоступна в API, поэтому использовать ее через AllTokens не получится. Быстрый старт для устаревшей модели скрыт, чтобы не вводить в заблуждение.
Google: Gemma 3n 2B (Бесплатно) от провайдера google доступна через OpenAI-совместимый API AllTokens.
Страница агрегирует практические параметры для интеграции: стоимость входа и выхода, рабочий контекст, набор поддерживаемых параметров и сигналы для выбора модели под конкретные продакшн-сценарии.
Контекст
8 192 токенов
Цена входа
— / 1M токенов
Цена выхода
— / 1M токенов
Входные модальности
Выходные модальности
Добавлена в каталог
06.02.2026
Google: Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google с общедоступным выпуском, оптимизированная для задач с низкой задержкой и высокой нагрузкой. Модель поддерживает ввод текста, изображений, видео, аудио и PDF, и предназначена для использования в легких агентских приложениях.
Google: Gemini Embedding 2 Preview
Gemini Embedding 2 Preview — это первая мультимодальная модель векторных представлений от Google, которая отображает текст, изображения, видео, аудио и PDF-файлы в единое векторное пространство для семантического поиска и генерации с расширением через поиск (RAG).
Google: Gemma 4 26B A4B (Бесплатно)
Подробный обзор модели
Новости, изменения цены, ключевые обновления и практические рекомендации по интеграции.
Открыть обзор
Google Gemini модели
Подборка Google Gemini моделей: мультимодальность, контекст и сравнение стоимости.
Смотреть подборку
Модели для программирования
Выборка кодинг-моделей для разработки: инструменты, reasoning, качество генерации и скорость.
Смотреть подборку
Недорогие модели
Подборка доступных моделей ИИ с низкой стоимостью входных токенов и практичной производительностью.
Смотреть подборку
Gemma 4 26B A4B IT — это модель с инструкционной настройкой Mixture-of-Experts (MoE) от Google DeepMind. Несмотря на 25,2 млрд общих параметров, при инференции активируется только 3,8 млрд на токен — обеспечивая качество, близкое к 31-миллиардной модели.