Что произошло
Команда Generalist AI представила GEN-1.5 — модель, которая кардинально меняет подход к обучению роботов. Если раньше для каждой новой задачи требовались часы тренировок, теперь достаточно один раз показать действие, и робот его повторяет. Это как если бы вы научили человека завязывать шнурки, просто продемонстрировав движение один раз.
Модель анализирует 30-секундное «окно контекста» — видеопоток с демонстрацией плюс данные сенсоров. После этого сразу начинает выполнять задачу на физическом роботе без дополнительного программирования.
Детали
- Скорость обучения: от 3 до 12 секунд демонстрации достаточно для освоения простых манипуляций (открыть банку, расстегнуть молнию)
- Точность: 59% успешных попыток после одного показа, 83% — после 5 минут практики (~50 повторов)
- Импровизация: использует непредусмотренные инструменты (например, берет кисточку вместо щетки)
- Перенос навыков: демонстрация в симуляторе работает на реальном роботе, хотя модель никогда не тренировали на симулированных данных
«Мы не ожидали, что вставка одного примера в контекст даст хоть какую-то измеримую компетентность» — отмечают разработчики
Почему это важно
- Практический выигрыш: теперь для обучения робота не нужны инженеры — достаточно любого человека, который может показать задачу
- Гибкость: модель адаптируется к изменениям в реальном времени (например, если объект сместился)
- Экономия ресурсов: минуты вместо часов обучения для каждой новой операции
Домашние помощники, склады, мелкосерийное производство — везде, где роботу нужно быстро осваивать разнообразные задачи.
Что дальше
Сейчас GEN-1.5 справляется только с короткими одноэтапными действиями. Но технология открывает путь к:
- Обучению сложным многошаговым процессам через комбинацию простых демонстраций
- Созданию «библиотек навыков», которые робот будет комбинировать самостоятельно
- Развитию настоящего общего интеллекта для физического мира
Источники
- Оригинал: generalistai.com — © generalistai.com