Mercury 2.5 — диффузионная языковая модель Inception: токены не выдаются по одному подряд, а вырабатываются и уточняются пачками параллельно. Отсюда скорость ответа при сохранении рассуждений. Контекст 260k токенов.
Контекст: 260 000 токенов.