Вы, вероятно, слышали много шума за последние несколько месяцев о стабильном спреде. Выпущена новая версия (v2), в которой помимо стандартных режимов «Картинка-в-изображение» и «Текст-в-изображение» есть еще и глубина «Картинка-в-изображение», которая может оказаться невероятно полезной. [Andrew] у него есть Написание инструкций по использованию этого режима.
Основная идея заключается в том, что вы можете фиксировать глубину и глубину модели, что позволяет вам контролировать то, что происходит. Стабильный спред немного озадачивает, но у нас уже есть некоторые Отличные ресурсы для передвижения. Что касается ввода, вы можете использовать карту глубины с камеры с лидаром (многие последние телефоны включают это) или использовать другую модель (например, MiDaS) для оценки ее по 2D-изображению. Это становится мощным, когда вы можете удержать определенную композицию, например, культовую сцену из известного фильма. Вы можете оставить формы персонажей на экране, но вы можете изменить стиль сцены на любой другой (как показано выше).

Однако единственным недостатком является то, что перспектива создает ощущение кукольного домика. Помогает изменение фокусного расстояния и отдаление. В целом, это разумное использование возможностей новой модели ИИ. Это быстро развивающееся пространство, поэтому через несколько месяцев оно, скорее всего, устареет.


More Stories
Amazon: рост цен на консоли нового поколения может ускорить переход игроков к облачному геймингу
Отказ от физических дисков для PlayStation назвали закономерным этапом развития игровой индустрии
REDMI Note 17 получит 7-дюймовый OLED-дисплей, а версия Pro — аккумулятор на 9000 мА·ч