Нейронавт | Нейросети в творчестве – Telegram
Нейронавт | Нейросети в творчестве
10.6K subscribers
4.44K photos
3.71K videos
41 files
4.75K links
Канал про нейросети в компьютерной графике, в кино и вообще

В папках не участвую

для связи @Neuronauticus

Заявка на регистрацию в РКН № 6309426111
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
Audio2Face-3D

NVIDIA выпустила в опенсорс свой аниматор говорящих 3D голов по звуку из 2022 года

Насколько помню, раньше она была доступна в Onmiverse
Видимо, технология уже не сильно актуальна?

В SDK есть плагины для #Maya и #UE

HF

#talkinghead #audio2animation #head #speech2animation #lipsync
3😁2👍1
Опубликованы модели и код видеоперсонализатора Lynx

Репозиторий содержит два варианта модели:

Модель Lynx Full (lynx_full): полная версия со всеми расширенными функциями и наилучшей производительностью

Модель Lynx Lite (lynx_lite): Облегченная версия, оптимизированная для сред с ограниченными ресурсами, с поддержкой видео со скоростью 24 кадра в секунду.

Гитхаб
HF

#personalization #referenceing #text2video #imge2video
5🔥1
Diffusion-Pipe In ComfyUI Custom Nodes

Кастом ноды для тренировки лор прямо в #ComfyUI

Список поддерживаемых моделей на скрине

#lora #finetuning #tools
🔥21👍3
Pocket Comfy

Еще один интерфейс для удобного запуска генераций в #ComfyUI ориентированный на мобилки

Предусмотрена авторизация

#gui #tools #mobile
👍5
VibeVoice-ComfyUI 1.5.0

Добавлена поддержка лор и контроль скорости речи: можно немного изменять скорость исходного аудио для приближения к желаемому темпу при клонировании голоса. Для лучших результатов рекомендуются образцы звука длиннее 20 секунд.

#podcast #voicecloning #tts #text2speech #text2podcast #comfyui
🔥14
Media is too big
VIEW IN TELEGRAM
ByteDance опубликовали ресерч Seedream 4.0

А на сайте добавился видеоролик (его же раньше не было или я туплю?)

На арене открыли возможность сделать 5 генераций в день, но не факт что хоть в одну из них выпадет Seedream 4
Ну я поголосовал и на мой взгляд Seedream 4 уделывает всех по послушности, и картинка хорошая

#text2image #news
👍6
HunyuanImage 3.0

Самый мощный опенсорсный генератор картинок

Иолее чем 80B параметров, из которых 13B активных

Под капотом совет экспертов #MoE

— может обрабатывать сложные промпты длиной до тысячи слов

— генерирует точный текст внутри изображений

— создаёт детальные комиксы

— формирует выразительные эмодзи

— разрабатывает живые и привлекательные иллюстрации

Обещают выпустить Instruct- версию, дистиллированные чекпойнты, поддержку VLLM, генерацию по картинке, пошаговое редактирование

Готовьте 170 ГБ на диске и ≥3×80 ГБ VRAM (для лучшей производительности рекомендуется 4×80 ГБ)

Пишут что совместим с Flashattention и FlashInfer

Гитхаб
HF
Попробовать

#text2image
😁19🔥9😱7😐3👍2
Воскресный опрос. Сколько у вас VRAM?
Anonymous Poll
11%
0-6 ГБ
17%
8-10 ГБ
20%
12 ГБ
23%
16 ГБ
0%
20ГБ
17%
24 ГБ
12%
Больше. Я олигарх
😭9😁8🤔1🌚1
This media is not supported in your browser
VIEW IN TELEGRAM
OmniInsert: Mask-Free Video Insertion of Any Reference via Diffusion Transformer Models

Вставляет что угодно на видео из одного или нескольких источников

генерация одного 5-секундного видео (121 кадр) в разрешении 480p занимает примерно 90 секунд при использовании 8 видеокарт NVIDIA A100

Код ждем

Спасибо @m_franz

#videoediting #video2video #videoinpainting
🔥8👍3😁1
This media is not supported in your browser
VIEW IN TELEGRAM
А что если настанет светлое будущее, мы все переедем в светлый VR. Как в Матрице только светлый. Но там также как и во сне для справления естественных нужд придется выходить в реал. Кто не вышел - тот обосрамился

#оффтоп #humor
😁20