#генерация видео

8 постов
пост №1984ИИ и машинное обучение

Новая версия сервиса Kling не работает в риалтайме, ей нужно время, чтобы сгенерировать видео, но она идет дальше лица — тут заменяется все тело целиком и совсем другое качество картинки.

Все шутят, что профессия e-girl — девушки-стримерши, которая зарабатывает рекламой в интернете, становится ультра демократичной и её наверняка целиком и полностью заполнят индусы и пакистанцы. Ничего личного, там просто дешевле рабочая сила.

пост №1905ИИ и машинное обучение

OpenAI представил новую модель по генерации видео Sora 2. Она сильно лучше, чем Sora 1, научилась аудио, сравнима с ведущими моделями от bytedance и гугла.

Интереснее, что вместе с моделью они запустили приложение Sora (только iOS, только в США), что-то типа тиктока для подростков, но все видео из нейросети; идея в том, что можно представлять себя и друзей в разных ситуациях.

Занимательно, что Альтман запостил в своем личном блоге про кембрийский взрыв творчества и трепет (trepidation). Подозреваю, что промпт был «напиши текст, чтобы умный, будем жарить мозги подросткам через видео».

Прикладываю видео-анонс сего события.

пост №1887ИИ и машинное обучение

Обратите внимание, лиса и дерево на фоне — те же самые, просто с разных углов.

Или лицо мужчины, в двух разных планах.

Рама зеркала — в кадре с невестой она не в фокусе, а в начале кадра с женихом её можно рассмотреть в деталях. 🤯

На официальной странице ещё куча примеров и главное — ей можно пользоваться любому хоть сегодня, минимальная подписка — от 15 долларов в месяц.

Виртуальные миры Genie с качеством Seedance — только вопрос времени. 🙈

пост №1886ИИ и машинное обучение

Ещё больше меня поразила модель Seedance 1 от ByteDance (компании-создателя ТикТока). Лично я не отличу этот ролик от современной дорогой рекламы, напичканной 3D-эффектами.

Только в отличие от профессионального видео стоимостью десятки тысяч долларов за минуту, этот ролик продолжительностью 10 секунд стоит от 50 центов до доллара и готов за пару минут. (пока, в отличие от Veo3, без аудио)

пост №1885ИИ и машинное обучение

Другая свежая модель от гугла — Veo3, научилась делать видео вместе с аудио. Моряк на приложенном ролике — говорит! Можно попробовать самому за деньги хоть сегодня.

пост №1730ИИ и машинное обучение

День ИИ-анонсов.

OpenAI представили модель для генерации видео (максимальная длина — минута). Жутко от реалистичности, конечно, как всегда.

Прикольно, что модель не просто генерирует картинки, но и «понимает, как устроен мир, как взаимодействуют объекты в нем».

Там куча примеров внутри, рекомендую покликать.

Попробовать самому пока нельзя — доступ дали только белым хакерам, которые пытаются сломать модель и использовать её для всякого плохого, чтобы эти дырки залатали. Ну и доверенным художникам, чтобы те рекламировали её применения бесплатно. А ещё можно попросить уволенного и восcтановленного в должности директора OpenAI в твиттере, что хочешь получить и он иногда отвечает видосом.

А гугл день-в-день наконец-то представил нормального конкурента ChatGPT — Gemini 1.5; во всяком случае, так говорят программисты, которые уже успели им попользоваться. У модели гораздо больше память, чем у всех других публичных ИИ. Она может съесть аж до 700 тысяч слов (11 часов аудио) и выполнять задания оперируя всей этой информацией. Доступ тоже хитро ограничен, разработчикам оставить заявку можно тут.

пост №1289ИИ и машинное обучение

Представляете себе зум или вацап созвоны, которые идеально работают на ОЧЕНЬ плохом интернете? А вот ученые из NVIDIA не только представили, но и придумали, как это сделать.

Они передают по интернету только первый кадр вашего лица на видео-звонке, а дальше перестают транслировать видео созвона и вместо него транслируют специальные сигналы о том, как вы двигаете головой и меняете выражение лица во время разговора. Алгоритм машинного обучения генерирует очень похожее на оригинал видео из этого сигнала прямо в реальном времени.

Такой способ передачи видео головы говорящего человека требует в десять (!) раз меньше трафика. WinRAR!

Ах да, ещё они, конечно же, могут поворачивать голову и вообще менять выражение лица на лету программно. 2021 же.

Спасибо ютуб-каналу two minute papers за офигенные обзоры интересных научных статей (название врет, конкретно этот обзор аж семь минут 11 секунд).

пост №6ИИ и машинное обучение

Новая версия сервиса Kling не работает в риалтайме, ей нужно время, чтобы сгенерировать видео, но она идет дальше лица — тут заменяется все тело целиком и совсем другое качество картинки.

Все шутят, что профессия e-girl — девушки-стримерши, которая зарабатывает рекламой в интернете, становится ультра демократичной и её наверняка целиком и полностью заполнят индусы и пакистанцы. Ничего личного, там просто дешевле рабочая сила.