Скоростная версия флагманской языковой модели, обеспечивающая высокую точность ответов при значительно сниженной задержке генерации. Оптимальна для задач, требующих быстрого анализа данных и оперативного отклика.
Контекст: 1 048 576 токенов.