Нейронавт | Нейросети в творчестве – Telegram
Нейронавт | Нейросети в творчестве
10.6K subscribers
4.46K photos
3.73K videos
41 files
4.76K links
Канал про нейросети в компьютерной графике, в кино и вообще

В папках не участвую

для связи @Neuronauticus

Заявка на регистрацию в РКН № 6309426111
Download Telegram
Media is too big
VIEW IN TELEGRAM
Runway Aleph

RunwayML тизерит новый видеогенератор редактор видео

- создает новые ракурсы
- создает следующий шот
- переносит на видео любой стиль
- меняет погоду, локацию
- добавляет объекты в сцену
- удаляет объекты из сцены
- изменяет объект на видео
- копирует траекторию камеры
- перекрашивает объекты
- меняет внешку персонажей
- релайтинг - меняет освещение
- обратный хромакей - заменяет фон на зеленый экран

Ждем

#videoediting
10👍6🔥6
Ultra3D: Efficient and High-Fidelity 3D Generation with Part Attention

Волшебный 3D генератор, который всех поразил деталями. И даже дают попробовать чуть-чуть

#3d #imageto3d
5👍5
DesignLab: Designing Slides Through Iterative Detection and Correction

Итеративный улучшайзер слайдов.
Смотрит на недостатки в ваших слайдах по дизайну, улучшает. И так по кругу.

Код ждем

#design
👍81
WAN 2.2 показывает свое видео

Прислал @m_franz

#text2video #news
4👍1💯1
HunyuanWorld-1.0

"Первый опенсорсный генератор 3D миров, полностью совместимый с графическими пайплайнами"


Создает сцены и 360-градусные панорамы по тексту и по картинке.

В основе работы модели - алгоритм представления и генерации 3D-сцен с семантической иерархией.

В интерактивной демке панорамы на сайте проекта при попытке погулять в генерации очень быстро наталкиваешься на границу, за которую не пускают, как будто там не честное 3D, а картинка натянутая на карту глубины. Так что не вижу в чем он тут "первый", разве что в том что опенсорс. Ну да ладно, это первое впечатление.

Предлагают использовать в VR, геймдеве, физической симуляции, задачах с взаимодействием с объектами

Код
Веса
Попробовать - вход через WeChat. Я залогинился, но дальше сайт не прогружается

Спасибо @iNevestenko

#text2world #image2world #text2panorama #image2panorama #360 #text2scene #image2scene #world
👍1021😱1
Large Visual Memory Model

Large Visual Memory Model (#LVMM) — это первая в мире модель, которая даёт мультимодальным большим языковым моделям практически неограниченную визуальную память. Она способна не просто хранить, но и эффективно извлекать визуальные данные, анализируя намерения пользователя, находя релевантные фрагменты «памяти» для глубокого анализа и ответов на запросы

Возможности модели:

- хорошо классифицирует видео;

- хорошо ищет видео по запросам;

- отвечает на вопросы про видео;

- создает видео;

- ставит новые рекорды в разных тестах;

- подходит для сложных запросов, где надо накопать много информации.

Есть бесплатный тариф с 500 кредитов в месяц, агентами для создания (!!!) и продвижения видео, плейграундом с загрузкой видео и аудио

Попробовать

#vlmm #assistant #chat #agent #video2text #text2video
👍101