This media is not supported in your browser
VIEW IN TELEGRAM
А вот и веб-приложение "Erase and Replace" (сотри и замени) подоспело от стартапа runwayml.
Та же механика, что и в приложении из предыдущего поста — выделяем регион, пишем текстовый запрос и вуа-ля, магия! Картинка меняется. Фотошоп для безрукого.
Промо-ролик получился эффектный, нравится.
@ai_newz
Та же механика, что и в приложении из предыдущего поста — выделяем регион, пишем текстовый запрос и вуа-ля, магия! Картинка меняется. Фотошоп для безрукого.
Промо-ролик получился эффектный, нравится.
@ai_newz
👍82🔥44😱3❤2
This media is not supported in your browser
VIEW IN TELEGRAM
Веб-фотошоп с текстовым интерфейсом (powered by Stable Diffusion)
Наткнулся на такое приложение, которое позволяет менять выбранный регион картинки в соответствии с текстовым запросом. Прямо в браузере!
А теперь представьте его применение для инста-блогерок, которые, к примеру, фотошопят лицо и уменьшают свою талию (или что-то другое), и то как это упростит их рутину 🌚
Все это, конечно, можно сделать и в Google Colab на коленке, если знаете как писать код на Python и понимаете, как работает нейронка Stable Diffusion. А тут все готово уже, только меняй монеты на кредиты и печатай запросы.
Осталось дождаться пока в официальный Photoshop встроят что-то настолько удобное. Я уже писал про плагин со Stable Diffusion за $89, но в нём не такой удобный интерфейс, и он скорее предназначен для экстраполяции картинок.
https://imgeditor.zmo.ai/
@ai_newz
Наткнулся на такое приложение, которое позволяет менять выбранный регион картинки в соответствии с текстовым запросом. Прямо в браузере!
А теперь представьте его применение для инста-блогерок, которые, к примеру, фотошопят лицо и уменьшают свою талию (или что-то другое), и то как это упростит их рутину 🌚
Все это, конечно, можно сделать и в Google Colab на коленке, если знаете как писать код на Python и понимаете, как работает нейронка Stable Diffusion. А тут все готово уже, только меняй монеты на кредиты и печатай запросы.
Осталось дождаться пока в официальный Photoshop встроят что-то настолько удобное. Я уже писал про плагин со Stable Diffusion за $89, но в нём не такой удобный интерфейс, и он скорее предназначен для экстраполяции картинок.
https://imgeditor.zmo.ai/
@ai_newz
🔥36👍12💯3
This media is not supported in your browser
VIEW IN TELEGRAM
Тут человек разговаривает с роботом. А тот, бедняга, исполняет распоряжения кожаного мешка.
Кроме шуток, здесь от робота требуется серьезный интеллект и понимание окружения.
❱❱ Arxiv
❱❱ Project page
@ai_newz
Кроме шуток, здесь от робота требуется серьезный интеллект и понимание окружения.
❱❱ Arxiv
❱❱ Project page
@ai_newz
👍78🔥15🤡12❤🔥3❤2😢2
This media is not supported in your browser
VIEW IN TELEGRAM
Принёс вам новую аппку для сканирования объектов LumaLabs. Она даже дорисовывает недостающие части.
Приложение пока в бете, но можно получить доступ по запросу.
@ai_newz
Приложение пока в бете, но можно получить доступ по запросу.
@ai_newz
🔥42👍9👏1
This media is not supported in your browser
VIEW IN TELEGRAM
Майкрософт анонсировал новый продукт на базе Dalle-2: Microsoft Designer
Трепещите дизайнеры и дизайнерессы! Генеративные нейронные сетки добрались и до профессиональных дизайнерских инструментов. Вот Майкрософт выкатывает новый продукт с Dalle-2 под капотом, а недавно Stable Diffusion пробрался в Photoshop.
В MS Designer'e обещают удобную генерацию контента от визиток до логотипов и визуалов для презентаций в PowerPoint.
Пока не понятно, где будет крутиться модель, но скорее всего, пока диффузия не бегает на среднем CPU, работать будет в облаке и только для платной версии office. Запись на бету уже открыли, налетай!
У майкрософта свои рычаги влияния на OpenAI – они проинвестировали в AI стартап $1 млрд в 2019, и теперь имеют эксклюзивные привилегии. Думаю, что и доступ к Dalle-2 им дают по более выгодному тарифу.
@ai_newz
Трепещите дизайнеры и дизайнерессы! Генеративные нейронные сетки добрались и до профессиональных дизайнерских инструментов. Вот Майкрософт выкатывает новый продукт с Dalle-2 под капотом, а недавно Stable Diffusion пробрался в Photoshop.
В MS Designer'e обещают удобную генерацию контента от визиток до логотипов и визуалов для презентаций в PowerPoint.
Пока не понятно, где будет крутиться модель, но скорее всего, пока диффузия не бегает на среднем CPU, работать будет в облаке и только для платной версии office. Запись на бету уже открыли, налетай!
У майкрософта свои рычаги влияния на OpenAI – они проинвестировали в AI стартап $1 млрд в 2019, и теперь имеют эксклюзивные привилегии. Думаю, что и доступ к Dalle-2 им дают по более выгодному тарифу.
@ai_newz
🔥55👍8🤡6🌚6❤3🥰1
Пара хайлайтов с Meta Connect:
👉 Xbox's cloud gaming platform появится на хедсетах Quest.
👉 Партнёрство с Майкрософтом по продуктам в метаверсе.
👉 Крутое примение VR для фитнеса. Очень много приложений для геймификации спорта.
👉 Марк пообещал приделать ноги для аватаров.
👉 Показали, как круто можно будет управлять интерфейсом в AR очках с помощью браслета с ЭМГ датчиками.
👉 Нет, Марк не робот. Это просто демонстрация фотореалистичных Codec Avatars.
@ai_newz
👉 Xbox's cloud gaming platform появится на хедсетах Quest.
👉 Партнёрство с Майкрософтом по продуктам в метаверсе.
👉 Крутое примение VR для фитнеса. Очень много приложений для геймификации спорта.
👉 Марк пообещал приделать ноги для аватаров.
👉 Показали, как круто можно будет управлять интерфейсом в AR очках с помощью браслета с ЭМГ датчиками.
👉 Нет, Марк не робот. Это просто демонстрация фотореалистичных Codec Avatars.
@ai_newz
🔥25👍7👎3😁2🤡2❤🔥1🤣1
Через 20 минут начнётся ежегодная презентация Meta Connect 2022. Смотреть ее можно даже в VR, если у вас есть Meta Quest.
Будет много интересного, в том числе анонсируют новый VR шлем.
@ai_newz
Будет много интересного, в том числе анонсируют новый VR шлем.
@ai_newz
🔥13🤣6😁3👍2🤡2
This media is not supported in your browser
VIEW IN TELEGRAM
Сон наяву через VR passthrough
Это безумие! Примерно так ты видишь мир во сне, когда все постоянно меняется при малейшем переводе взгляда.
Чел создал демку, где, с его слов, в риалтайме крутится Stable Diffusion и меняет то, что ты видишь у себя вокруг через очки виртуальной реальности.
Мощное демо! А если представить побольше стабильности, то это – нереальная стилизация любых объектов и интерьеров в AR/VR. Интересно тоже, насколько действительно демка работает в Real-time. Уверен, что как минимум от шлема идёт провод к карточке уровня A100.
Тулзы, которые автор использовал:
❱❱ Deforum Stable Diffusion colab для моушена и переходов
❱❱ TouchDesigner
Кудос за ссылку – @monkeyinlaw
@ai_newz
Это безумие! Примерно так ты видишь мир во сне, когда все постоянно меняется при малейшем переводе взгляда.
Чел создал демку, где, с его слов, в риалтайме крутится Stable Diffusion и меняет то, что ты видишь у себя вокруг через очки виртуальной реальности.
Мощное демо! А если представить побольше стабильности, то это – нереальная стилизация любых объектов и интерьеров в AR/VR. Интересно тоже, насколько действительно демка работает в Real-time. Уверен, что как минимум от шлема идёт провод к карточке уровня A100.
Тулзы, которые автор использовал:
❱❱ Deforum Stable Diffusion colab для моушена и переходов
❱❱ TouchDesigner
Кудос за ссылку – @monkeyinlaw
@ai_newz
🔥61👍11❤4
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Чуваки примастырили Stable Diffusion к Фотошопу. Карл, к Фотошопу!
Вот чему теперь будут учить на курсах дизайнеров? Думаю, что промпт-инженирингу, и будут произведения классической литературы читать.
Плагин уже можно купить в Adobe маркете за $89. Нужна только видеокарточка по-жирнее, как на картинке выше 😅, либо свой сервачок, с апишкой. Хотя, можно и довольствоваться чипом M1, на нем тоже работает.
❱❱ Сайт проекта
@ai_newz
Вот чему теперь будут учить на курсах дизайнеров? Думаю, что промпт-инженирингу, и будут произведения классической литературы читать.
Плагин уже можно купить в Adobe маркете за $89. Нужна только видеокарточка по-жирнее, как на картинке выше 😅, либо свой сервачок, с апишкой. Хотя, можно и довольствоваться чипом M1, на нем тоже работает.
❱❱ Сайт проекта
@ai_newz
🔥80👍13❤1😢1
Диффузия оптимизирует нейронки
А вот тут вышла статья, где с помощью диффузионной модели заменяют традиционные оптимизаторы типа SGD или ADAM.
На вход поступают текущие веса оптимизируемой нейронки, текущий лосс, желаемый лосс, и параметр шага диффузии. А диффузионная модель предсказывает новые веса нейросети. Ускорение по сравнению с традиционной оптимизацией в ≈1000 раз.
@ai_newz
А вот тут вышла статья, где с помощью диффузионной модели заменяют традиционные оптимизаторы типа SGD или ADAM.
На вход поступают текущие веса оптимизируемой нейронки, текущий лосс, желаемый лосс, и параметр шага диффузии. А диффузионная модель предсказывает новые веса нейросети. Ускорение по сравнению с традиционной оптимизацией в ≈1000 раз.
@ai_newz
Telegram
DL in NLP
Learning to Learn with Generative Models of Neural Network Checkpoints
Peebles, Radosavovic, et al. [Berkeley]
Статья: arxiv.org/abs/2209.12892
Код: github.com/wpeebles/G.pt
Блог: тык
Помните про парадигму learning to learn и всякие оптимитзаторы на основе…
Peebles, Radosavovic, et al. [Berkeley]
Статья: arxiv.org/abs/2209.12892
Код: github.com/wpeebles/G.pt
Блог: тык
Помните про парадигму learning to learn и всякие оптимитзаторы на основе…
🔥89🤯69👍9🤔2👎1
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🧠 Imagen Video
[Google Brain]
Ответ Гугла на Make-a-Video от Меты не заставил себя долго ждать. Результаты кайфовые. Но и супервижена эта модель потребовала больше. Make-a-scene использовала неразмеченные видео для обучения, а вот для Image Video индусам пришлось попотеть, размечая видео текстовыми описаниями.
В подробности архитектуры вдаваться смысла нет, это нужно читать в статье. Скажу только, что там сначала из текстового эмбеддинга энкодера T5 получается 16 фреймов в разрешении 48×24 с 3 fps, а затем это апскейлится целой серией диффузионных моделей в итоговое видео из 128 фреймов 1280×768 и 24 fps.
То есть на выходе – 5.4 сек видео в высоком разрешении!
Ваши ставки господа: когда мы будем генерировать ролики в диффузионном тиктоке по заказу? "Девочка танцует в стиле техно. Сделай чтобы было красиво. Пожалуйста."
❱❱ Сайт проекта
@ai_newz
[Google Brain]
Ответ Гугла на Make-a-Video от Меты не заставил себя долго ждать. Результаты кайфовые. Но и супервижена эта модель потребовала больше. Make-a-scene использовала неразмеченные видео для обучения, а вот для Image Video индусам пришлось попотеть, размечая видео текстовыми описаниями.
В подробности архитектуры вдаваться смысла нет, это нужно читать в статье. Скажу только, что там сначала из текстового эмбеддинга энкодера T5 получается 16 фреймов в разрешении 48×24 с 3 fps, а затем это апскейлится целой серией диффузионных моделей в итоговое видео из 128 фреймов 1280×768 и 24 fps.
То есть на выходе – 5.4 сек видео в высоком разрешении!
Ваши ставки господа: когда мы будем генерировать ролики в диффузионном тиктоке по заказу? "Девочка танцует в стиле техно. Сделай чтобы было красиво. Пожалуйста."
❱❱ Сайт проекта
@ai_newz
🔥52👍11
Loading…
