Разработка и обучение фундаментальных моделей Vision-Language-Action (VLA) для управления промышленными гуманоидными роботами. Работа над полным циклом создания моделей, от подготовки данных до деплоя в реальные системы.
что делать
Pre-training и fine-tuning VLA-моделей на мультимодальных датасетах
Разработка пайплайнов обработки данных и генерация синтетических данных
Проектирование инфраструктуры для распределенного обучения моделей
Валидация политик через sim-to-real перенос в симуляторах
Внедрение моделей для управления реальными роботами в продакшене
требования
5+ лет опыта создания систем deep learning в индустрии или исследованиях
Опыт работы с LLM, VLM или VLA-моделями
Глубокие знания распределенного обучения: PyTorch DDP, чекпоинтинг