Архитектура Mixture-of-Experts с 3 млрд активных параметров из 30 млрд обеспечивает высокую скорость обработки при низких вычислительных затратах. Модель оптимизирована для высоконагруженных агентных систем и выполнения специализированных задач.
Контекст: 1 000 000 токенов.