Нейронавт | Нейросети в творчестве – Telegram
Нейронавт | Нейросети в творчестве
10.6K subscribers
4.43K photos
3.7K videos
41 files
4.74K links
Канал про нейросети в компьютерной графике, в кино и вообще

В папках не участвую

для связи @Neuronauticus

Заявка на регистрацию в РКН № 6309426111
Download Telegram
Postshot v1

Вышел из беты инструмент полного цикла для работы с полями света (нерфы, гауссианы)

Бета лицензия превратится в бесплатный тариф 26 сентября. На бесплатном тарифе рендер с вотермаком, входные изображения ограничены 8 бит.

На двух платных тарифах предлагают экспорт в .PLY, поддержку исходников 4K и HDR (16bit or 32bit) и прочие плюшки.

Так что бежим пользоваться всеми плюшками бесплатно - осталась неделя.

#gui #tools #gaussian #nerf #windows #desktop
👍42😭1
Media is too big
VIEW IN TELEGRAM
MapAnything: Universal Feed-Forward Metric 3D Reconstruction

Реконструкция 3D сцены с камерой по разным входным данным - изображениям, позиции камеры, глубине или даже по частичной реконструкции.

Напрямую вычисляет 3D геометрию сцены и параметры камер

Код
Демо

#3d #image2scene #any2scene #imageto3d #3dto3d #image2normal #image2depth
👍5🔥1
Qwen3-ASR-Toolkit

Официальный Python-инструмент для транскрибации длинных аудио и видео по API Qwen3-ASR

— обходит ограничение API в 3 минуты, транскрибируя файлы любой длины

— разделяет аудио на фрагменты с помощью Voice Activity Detection (VAD), чтобы не разрезать фразы и предложения

— обрабатывает фрагменты параллельно, сокращая время транскрипции длинных файлов

— автоматически устраняет распространённые ошибки и артефакты распознавания речи

— конвертирует аудио в нужный формат (16 кГц, моно) без необходимости предварительной обработки

— поддерживает практически любые аудио- и видеоформаты благодаря использованию FFmpeg

#ASR #speech2text #stt #russian
9👍1😁1
ComfyUI Deadline

#ComfyUI прикрутили к Deadline

Deadline это менеджер рендер-фермы, распределяющий задачи на подключенные к ферме машины.
Теперь можно делать распределенный инференс на ферме, работающей на Deadline

ComfyUI Deadline Plugin
ComfyUI-Deadline-Distributed
Youtube разработчика

#tools #farm
6👍3
Ray 3

Lumalabs обновили свой видеогенератор. Новая версия - рассуждающая

Она способна генерировать видео студийного качества в 16-bit HDR (примеры на сайте), поддерживает новый режим Draft Mode для быстрой итерации идей в творческих рабочих процессах. Понимает визуальные аннотации. Есть экспорт в .EXR

Предлагают попробовать бесплатно - но это будет Draft Mode. Полный платно

Полюбуйтесь на моего Рыба. Сделано за минуту. Я впечатлен если не смотреть на фон

#text2video #image2video #reasoning #hdr #exr
10👎3🔥3
Wan-Animate: Unified Character Animation and Replacement with Holistic Replication

Анимация и замена персонажей на видео затюненным #wan22 !

Под капотом совет экспертов

Создает видео 720p, 24fps с фокусом на кинематографичное качество

Воспроизводит оригинальное освещение и цветовую гамму для интеграции анимированного персонажа в сцену. Включает вспомогательный модуль Relighting LoRA для улучшения интеграции персонажа с новой средой.

Использует скелетные сигналы для управления движениями тела и скрытые черты лица, извлечённые из исходных изображений, для воспроизведения выражений. Короче, контролнет. Интересно чем отличается от Fun / VACE

Кванты сегодня будут, полагаю?

Гитхаб
HF
Демо

#moe #image2video #video2video #characteranimation #chracterswap #faceswap
1🔥98🤯2👀1
This media is not supported in your browser
VIEW IN TELEGRAM
Lucy Edit

Редактор видео по тексту от Decart.ai
Опенсорсный Nano-Banana для видео

В основе - архитектура Wan2.2 5B. Унаследовал VAE + DiT, что должно упростить адаптацию существующих скриптов и воркфлоу WAN.

Модель доступна в двух версиях: Dev — открытая версия для сообщества, и Pro — более детализированная и надёжная версия для создателей контента. Обе версии доступны через API и платформу, поддерживают редактирование видео в разрешении 480p и 720p

Недавно Decart показали быстрый видеогенератор Lucy, который доступен только на платных сервисах. Интересно, коммерческая модель у них тоже на базе открытого WAN?

Теперь же открытая редактирующая модель. Выглядит слабее WAN, шакально. Но может окажется быстрее или умнее?

Попробовать - на страте дают 2000 кредитов
HF - всего около 32Гб
ComfyUI - зато уже можно пользоваться

#videoediting #video2video #videoinpainting
7😁2👍1🔥1🥴1
Media is too big
VIEW IN TELEGRAM
Tencent's Hunyuan 3D Studio

ИИ-платформа для создания 3D-контента. Собрали наработки по 3D в кучу

Может:

- создавать 3D-модели из текста и картинок

- разбивать модели на редактируемые части

- автоматически создавать UV-развертку

- настраивать PBR текстуры

- добавлять скелетную анимацию персонажам.

Записаться в вейтлист

#3d #3dediting #texture #pbr #uvmpping #characteranimation #animation
👍81
This media is not supported in your browser
VIEW IN TELEGRAM
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation (SP4D)

Сегментатор кинематических частей на картинках и видео. Stability AI выступают одним из двух соавторов

В отличие от методов, которые генерируют только внешний вид, SP4D фиксирует как визуальную структуру, так и сочлененную геометрию, создавая 3D-объекты, готовые к ригу с учетом частей и анимации

Код ждем

#segmentation #segmentation3D #3d #imageto3d #videoto3d
👍6
ComfyUI-VoxCPM

Кастом нода контекстной бестокеновой думающей говорилки VoxCPM

#comfyui #tts #text2speech #realtime #voicecloning
🔥9