Inference-команда отвечает за рантайм генеративных моделей GigaChat. Именно здесь разрабатываются архитектура высоконагруженного сервиса и проводится глубокая оптимизация инференса, чтобы модели работали максимально быстро. Благодаря этому GigaChat способен принимать на вход текст, картинки и аудио, а в ответ генерировать текст или звуковое сообщение, решая широкий спектр пользовательских задач.