Модель
Для чего
Ling-3.0-flash — это высокоэффективная модель на архитектуре Mixture-of-Experts с 124 миллиардами параметров, из которых активно используется лишь 5.1 миллиарда на токен. Она оптимизирована для масштабного развертывания ИИ-агентов и обеспечивает высокую скорость генерации при работе с контекстом до 128k токенов.
Контекст
131k
Цена ₽
10 / 28
Ling-3.0-flash — это высокоэффективная модель на архитектуре Mixture-of-Experts с 124 миллиардами параметров, из которых активно используется лишь 5.1 миллиарда на токен. Она оптимизирована для масштабного развертывания ИИ-агентов и обеспечивает высокую скорость генерации при работе с контекстом до 128k токенов.
131k
10 / 28