deepseek/deepseek-r1-distill-llama-70bDeepSeek R1 Distill Llama 70B — это дистиллированная большая языковая модель, созданная на базе Llama-3.3-70B-Instruct с использованием выходных данных DeepSeek R1. Модель сочетает в себе передовые методы дистилляции для достижения высокой производительности в различных тестах, включая:
Благодаря тонкой настройке на результатах DeepSeek R1, модель демонстрирует конкурентоспособную эффективность, сопоставимую с крупнейшими флагманскими моделями. На alltokens вы можете получить доступ к возможностям этой модели через API.
Параметры, которые поддерживает эта модель в API-запросах
Система автоматически выбирает оптимального провайдера и переключается на резервный при сбоях.
Сравните разных провайдеров на AllTokens
Оценки модели из Artificial Analysis
curl https://api.alltokens.ru/api/v1/chat/completions \
-H "Authorization: Bearer $ALLTOKENS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek/deepseek-r1-distill-llama-70b",
"messages": [
{"role": "user", "content": "Привет! Кратко объясни, что умеешь."}
]
}'DeepSeek: R1 Distill Llama 70B от провайдера deepseek доступна через OpenAI-совместимый API AllTokens.
Страница агрегирует практические параметры для интеграции: стоимость входа и выхода, рабочий контекст, набор поддерживаемых параметров и сигналы для выбора модели под конкретные продакшн-сценарии.
Контекст
8 192 токенов
Цена входа
100 ₽ / 1M токенов
Цена выхода
100 ₽ / 1M токенов
Входные модальности
Выходные модальности
Добавлена в каталог
06.02.2026
DeepSeek: DeepSeek V4 Flash Vision Exp
deepseek
DeepSeek V4 Flash Vision Exp — экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой обработки изображений, которая добавляет возможности понимания изображений при сохранении базовых текстовых функций модели, включая работу с агентами.
DeepSeek: DeepSeek V4 Pro 0813
deepseek
DeepSeek V4 Pro 0813 — это крупномасштабная модель с архитектурой mixture-of-experts от DeepSeek. Это стабильный релиз DeepSeek V4 Pro.
DeepSeek: DeepSeek V4 Flash 0731
deepseek
DeepSeek V4 Flash 0731 — это модель с разреженной смесью экспертов от DeepSeek, содержащая 13 миллиардов активных параметров из общего числа 284 миллиарда. Эта версия с повторным обучением подходит для программирования, логического мышления и работы с агентами.