Быстрая и экономичная модель, оптимизированная для работы под высокой нагрузкой с минимальной задержкой отклика. Эффективно справляется с ведением диалогов, обработкой больших объемов текста и базовыми агентными сценариями.
Контекст: 1 050 000 токенов.