Мы — команда, которая занимается обучением LLM, VLM и CV моделей. Создаем нативные омнимодальные архитектуры, новые способы кодирования и совместного обучения в доменах изображений, аудио, видео и т.д.
Наши основные направления: обучение LLM и VLM с нуля, разработка новых архитектур, Computer Vision research, создание opensource инструментов, сбор и подготовка данных, деплой моделей для MVP. Работаем на кластере с GPU уровня H100.
Ищем сильного инженера в направление Embodied AI, который будет связывать омнимодальные наблюдения с VLA-моделями и превращать их выходы в осмысленное поведение реального робота.