google/gemma-3n-e4b-itGemma 3n E4B-it оптимизирована для эффективной работы на мобильных и маломощных устройствах, таких как смартфоны, ноутбуки и планшеты. Модель поддерживает мультимодальные входные данные, включая текст, изображения и аудио, что позволяет выполнять широкий спектр задач: генерацию текста, распознавание речи, перевод и анализ изображений. Благодаря внедрению таких инноваций, как кэширование эмбеддингов на каждом слое (PLE) и архитектура MatFormer, Gemma 3n динамически управляет использованием памяти и вычислительной нагрузкой, выборочно активируя параметры модели, что значительно снижает требования к ресурсам во время работы.
Модель поддерживает более 140 языков и обладает гибким контекстным окном в 32 000 токенов. Gemma 3n способна выборочно загружать параметры, оптимизируя потребление памяти и вычислительную эффективность в зависимости от конкретной задачи или возможностей устройства. Это делает ее отличным решением для приложений, ориентированных на конфиденциальность, работу в автономном режиме и локальное использование ИИ на устройствах через alltokens.
Параметры, которые поддерживает эта модель в API-запросах
Система автоматически выбирает оптимального провайдера и переключается на резервный при сбоях.
Сравните разных провайдеров на AllTokens
Оценки модели из Artificial Analysis
curl https://api.alltokens.ru/api/v1/chat/completions \
-H "Authorization: Bearer $ALLTOKENS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemma-3n-e4b-it",
"messages": [
{"role": "user", "content": "Привет! Кратко объясни, что умеешь."}
]
}'Google: Gemma 3n 4B от провайдера google доступна через OpenAI-совместимый API AllTokens.
Страница агрегирует практические параметры для интеграции: стоимость входа и выхода, рабочий контекст, набор поддерживаемых параметров и сигналы для выбора модели под конкретные продакшн-сценарии.
Контекст
32 768 токенов
Цена входа
8 ₽ / 1M токенов
Цена выхода
15 ₽ / 1M токенов
Входные модальности
Выходные модальности
Google: Gemini 3.7 Flash
Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.
Google: Gemini 3.7 Flash (batch)
Gemini 3.7 Flash — мультимодальная модель от Google, предназначенная для быстрого выполнения агентных рабочих процессов, программирования и сложного многоэтапного рассуждения. Модель разработана для задач, требующих высокой отзывчивости и надежного выполнения многошаговых операций.
Google: Gemini 3.6 Flash (batch)
Gemini 3.6 Flash — это высокоэффективная модель от Google, предназначенная для программирования, агентных рабочих процессов, а также разработки веб-сайтов и приложений. Модель создана для генерации качественных результатов с минимальным количеством лишних правок и...
Подробный обзор модели
Новости, изменения цены, ключевые обновления и практические рекомендации по интеграции.
Открыть обзор
Google Gemini модели
Подборка Google Gemini моделей: мультимодальность, контекст и сравнение стоимости.
Смотреть подборку
Недорогие модели
Подборка доступных моделей ИИ с низкой стоимостью входных токенов и практичной производительностью.
Смотреть подборку
Добавлена в каталог
06.02.2026