Роутер моделей: сам подбирает модель под запрос — быструю для коротких вопросов, сильную для сложной работы. Списание по фактически выбранной модели, она видна в ответе.
Контекст: 1 000 000 токенов.