Повторить за 3 секунди. Роботи від Generalist AI навчилися копіювати рухи людини з одного короткого відео
Стартап Generalist AI презентував нову базову модель штучного інтелекту GEN-1.5, яка здатна навчати роботів нових фізичних завдань усього після однієї демонстрації тривалістю від 3 до 12 секунд.
Система не потребує повторного перенавчання чи коригування алгоритмів під кожен новий процес. Робот зчитує сенсорні та візуальні підказки людини й одразу намагається самостійно повторити побачене.
У ході випробувань на 10 базових побутових завданнях система показала 59% успішних спроб лише після одного показу, пише Іnteresting Еngineering.
Якщо ж надати моделі п’ять хвилин додаткових даних і провести 10 кроків донавчання, ефективність виконання зростає до 83 відсотків. ШІ вже випробували на відкручуванні кришок з банок, складанні стаканчиків, розстібанні блискавок та прибиранні сміття.
GEN-1.5 є мультимодальною системою, яка одночасно обробляє відео, мовні команди, сенсорні показники та дані про положення власного тіла на частоті 100 Гц. Модель здатна об'єднувати окремі підказки у складні послідовності. Наприклад, побачивши два окремі покази розстібання пенала та витягування грошей, робот самостійно з'єднав ці дії у єдиний процес.
«Модель здатна адаптуватися до нових умов та імпровізувати на ходу. Побачивши, як людина замітає блок пензлем, за відсутності потрібного інструменту робот використав як щітку банан», — зазначають розробники.
Окрім цього, система здатна копіювати рухи звичайної людської руки, спостерігаючи за ними через камери, та переносити навички із віртуальної симуляції у реальний світ.
Источник: techno.nv.ua