20 августа 2026 г.
Робот перенимает навык с одного показа: GEN-1.5 нужно 3–12 секунд видео
Одна демонстрация даёт роботу 59% успешных попыток, пять минут записи поднимают до 83%.

Человек снимает крышку с банки. Робот смотрит 12 секунд и делает то же самое.
Так же он расстёгивает молнию на пенале и достаёт купюры из кошелька. По одной демонстрации на каждый навык, без дообучения и обновления весов. Американский стартап Generalist AI называет это physical prompting: пример просто лежит в контексте модели, как текстовая подсказка у GPT.
Раньше и теперь. Прежним моделям на такой результат нужны были тысячи шагов обучения и часы размеченных данных. GEN-1.5 берёт 3–12 секунд видео и держит пример в памяти на 30 секунд. На десяти разных задачах одна демонстрация даёт 59% успешных попыток, а пять минут записи и десять шагов дообучения поднимают точность до 83% (блог Generalist AI, 19.08.2026).
Демонстрацию записывают не пультом, а ручным захватом: человек делает задачу сам. В контекст годится и запись из симулятора — реальный робот повторяет её, хотя данных из симуляции в предобучении не было вовсе.
Способность учиться с одного примера в модель не закладывали. Предобучение шло больше восьми месяцев в три фазы, без правок архитектуры под in-context learning. Авторы пишут, что специально этому GEN-1.5 не учили, а задачи в тесте называют короткими и простыми.
Взять негде. У Generalist AI нет ни API, ни списка ожидания, ни открытых весов: на сайте только блог, вакансии и форма для связи.
Деньги на продолжение есть: $400 млн Generalist AI подняла 4 июня 2026 при оценке $2 млрд.
Первоисточник