Многие опасаются будущего, в котором созданное искусственным интеллектом станет неотличимым от сделанного человеком. Ошеломляющие успехи генеративных нейросетей в области «компиляции» текстов или изображений — лишь первый шаг. В самое ближайшее время их возможности пополнятся созданием видео.
Хелен Пауэр (Helen Power) и Крис Бойл (Chris Boyle) из английской компании privateisland.tv создали сюрреалистичный рекламный ролик, который мгновенно завирусился в социальных сетях. Особенность ролика состоит в том, что видеоряд полностью создан с помощью новой модели искусственного интеллекта Runway Gen-2, создающей короткие видеоклипы на основе текста.
Читайте также
Silent Hill возвращается — снова будет туманно и страшно
В клипе, можно увидеть симулякры людей, веселящихся на стереотипном американском барбекю. Достаточно реалистичные модели людей иногда сливаются с невообразимыми сосудами для пива. Женщины смеются, выпячивая челюсти. Пивные бокалы превращаются в пивные банки или сливаются с головами. Пылающие грили превращаются в огненное торнадо и описывают дугу по всему двору. Это видение сюрреалистического ада, одновременно знакомого и впечатляюще чуждого.
Кажется, что это, скорее, видение сумасшедшего художника, а не «творение» ИИ — настолько сильное впечатление оставляет 30-секундный клип. Но все же пока для получения приемлемого результата требуется вмешательство человека: необходимо отсмотреть, отобрать и склеить множество «сгенерированного мусора». Хелен и Крис не скрывают, что отобрали лучшие фрагменты и соединили их в правильной последовательности, добавив музыку и звуковые эффекты.
Чуть ранее некто под ником «Pizza Later» опубликовал видео, в значительной степени сгенерированное ИИ для вымышленного ресторана под названием «Pepperoni Hug Spot». Для его создания также использовалась нейросеть Runway Gen-2. Говорится, что сценарий был сгенерирован с помощью GPT-4, исходные изображения воплотила нейросеть Midjourney, а голос синтезировался нейросетью Eleven Labs. На этапе монтажа пригодился и автор видео. Это дает некоторые основания для оптимизма — еще есть место художнику.

Однако, нужно помнить как быстро нейросети эволюционируют. Да, генерирующему видео ИИ предстоит пройти долгий путь, но уже даже условно-бесплатные нейросети создают приемлемые изображения, избавившись от синдрома «шестипалой ладони». Возможно, после расширения набора данных для обучения, и создание полноценных видео станет рутинной задачей для нейросетей.





