NEW BOT Телеграм, страница

Ray 3

Lumalabs обновили свой видеогенератор. Новая версия - рассуждающая

Она способна генерировать видео студийного качества в 16-bit HDR (примеры на сайте), поддерживает новый режим Draft Mode для быстрой итерации идей в творческих рабочих процессах. Понимает визуальные аннотации. Есть экспорт в .EXR

Предлагают попробовать бесплатно - но это будет Draft Mode. Полный платно

Полюбуйтесь на моего Рыба. Сделано за минуту. Я впечатлен если не смотреть на фон

#text2video #image2video #reasoning #hdr #exr

❤10👎3🔥3

2.34K views16:04

Нейронавт | Нейросети в творчестве

Wan-Animate: Unified Character Animation and Replacement with Holistic Replication

Анимация и замена персонажей на видео затюненным #wan22 !

Под капотом совет экспертов

Создает видео 720p, 24fps с фокусом на кинематографичное качество

Воспроизводит оригинальное освещение и цветовую гамму для интеграции анимированного персонажа в сцену. Включает вспомогательный модуль Relighting LoRA для улучшения интеграции персонажа с новой средой.

Использует скелетные сигналы для управления движениями тела и скрытые черты лица, извлечённые из исходных изображений, для воспроизведения выражений. Короче, контролнет. Интересно чем отличается от Fun / VACE

Кванты сегодня будут, полагаю?

Гитхаб
HF
Демо

#moe #image2video #video2video #characteranimation #chracterswap #faceswap

1🔥9❤8🤯2👀1

2.3K views06:15

Нейронавт | Нейросети в творчестве

0:17

This media is not supported in your browser

VIEW IN TELEGRAM

Lucy Edit

Редактор видео по тексту от Decart.ai

Опенсорсный Nano-Banana для видео

В основе - архитектура Wan2.2 5B. Унаследовал VAE + DiT, что должно упростить адаптацию существующих скриптов и воркфлоу WAN.

Модель доступна в двух версиях: Dev — открытая версия для сообщества, и Pro — более детализированная и надёжная версия для создателей контента. Обе версии доступны через API и платформу, поддерживают редактирование видео в разрешении 480p и 720p

Недавно Decart показали быстрый видеогенератор Lucy, который доступен только на платных сервисах. Интересно, коммерческая модель у них тоже на базе открытого WAN?

Теперь же открытая редактирующая модель. Выглядит слабее WAN, шакально. Но может окажется быстрее или умнее?

Попробовать - на страте дают 2000 кредитов
HF - всего около 32Гб
ComfyUI - зато уже можно пользоваться

#videoediting #video2video #videoinpainting

❤7😁2👍1🔥1🥴1

8.07K views09:09

Нейронавт | Нейросети в творчестве

1:23

Media is too big

VIEW IN TELEGRAM

Tencent's Hunyuan 3D Studio

ИИ-платформа для создания 3D-контента. Собрали наработки по 3D в кучу

Может:

- создавать 3D-модели из текста и картинок

- разбивать модели на редактируемые части

- автоматически создавать UV-развертку

- настраивать PBR текстуры

- добавлять скелетную анимацию персонажам.

Записаться в вейтлист

#3d #3dediting #texture #pbr #uvmpping #characteranimation #animation

👍8❤1

2.21K views10:13

Нейронавт | Нейросети в творчестве

4:31

This media is not supported in your browser

VIEW IN TELEGRAM

Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation (SP4D)

Сегментатор кинематических частей на картинках и видео. Stability AI выступают одним из двух соавторов

В отличие от методов, которые генерируют только внешний вид, SP4D фиксирует как визуальную структуру, так и сочлененную геометрию, создавая 3D-объекты, готовые к ригу с учетом частей и анимации

Код ждем

#segmentation #segmentation3D #3d #imageto3d #videoto3d

👍6

1.92K views11:14

Нейронавт | Нейросети в творчестве

ComfyUI-VoxCPM

Кастом нода контекстной бестокеновой думающей говорилки VoxCPM

#comfyui #tts #text2speech #realtime #voicecloning

🔥9

1.9K views13:06

Нейронавт | Нейросети в творчестве

воркфлоу WanAnimate
Scaled веса
GGUF - даже есть Q8 на ~20Гб

Спасибо @J_Jordan

#image2video #video2video #characteranimation #chracterswap #faceswap #workflow #gguf

GitHub

ComfyUI-WanVideoWrapper/example_workflows/wanvideo_WanAnimate_example_01.json at main · kijai/ComfyUI-WanVideoWrapper

Contribute to kijai/ComfyUI-WanVideoWrapper development by creating an account on GitHub.

🔥13

2.23K viewsedited 16:04

Нейронавт | Нейросети в творчестве

SongBloom-Safetensors

Веса незаслуженно забытого открытого генератора музыки в формате .safetensors
Оригинальные веса были в формате .pt

#text2music #music #musicediting

huggingface.co

fredconex/SongBloom-Safetensors at main

We’re on a journey to advance and democratize artificial intelligence through open source and open science.

👍11🤯1

1.67K views10:13

Нейронавт | Нейросети в творчестве

Moondream 3 Preview

Превью 3 версии VLM для описания (и не только) изображений

— может отвечать на открытые вопросы об изображениях

— создаёт описания изображений разной длины: короткие, стандартные и длинные

— определяет координаты конкретных объектов на изображении

— предоставляет bounding boxes (ограничивающие рамки) для объектов на изображении

— поддерживает предварительное кодирование изображений для ускорения многократных запросов

— работает как с изображениями, так и как универсальная текстовая модель

Плейграунд попробовать
Демо HF
API

#vlm #captioning #detection #moe #cv #image2text

👍7❤3🔥1

2.17K views11:14

Нейронавт | Нейросети в творчестве

Wan 2.2 Animate in ComfyUI

Вчерашний стрим #ComfyUI по Wan 2.2 Animate

Воркфлоу тот который вчера выкладывал

#image2video #video2video #characteranimation #chracterswap #faceswap

YouTube

Wan 2.2 Animate in ComfyUI with Flipping Sigmas

Special Guest: @FlippingSigmas

Join us live as we explore Wan2.2-Animate inside ComfyUI—a unified model designed for character animation and replacement, complete with naturalistic movement and expression replication.

We’ll dive into how Animate lets you…

👍17

1.72K viewsedited 12:16

Нейронавт | Нейросети в творчестве

ARC-Qwen-Video

Версия ARC-Hunyuan-Video-7B с Qwen2.5-VL-7B-Instruct в качестве базовой модели.

Мультимодальная модель для понимания коротких видеороликов из реального мира. Обрабатывает визуальные, аудио- и текстовые сигналы

Синхронизирует визуальные и аудиосигналы, что позволяет отвечать на сложные вопросы, которые невозможно решить, используя только один тип данных

Определяет не только, что происходит в видео, но и когда это происходит, поддерживает детализированную временную разметку и обобщение событий

Знает китайский и английский

На скриншоте транскрибация демонстрационного видео (перевод с китайского)

ARC-Qwen-Video-7B

ARC-Qwen-Video-7B-Narrator - выдает описания видео с таймкодами, определяет личности говорящих в видео, распознаёт и транскрибирует речь

Гитхаб
Демо - вход по китайскому телефону

#vlm #assistant #video2text #asr #speech2text #stt

👍10

2.03K views14:17

Нейронавт | Нейросети в творчестве

0:55

Media is too big

VIEW IN TELEGRAM

Vidu Q1 Reference to Image

Давно не заглядывали в Vidu?

Они прокачали генерацию видео по референсам. Чего-то там больше, что-то там лучше

Функция доступна на сайте и в мобильном приложении

#referencing #image2video #text2video

👍9🍾1

1.91K views08:06

Нейронавт | Нейросети в творчестве

0:07

This media is not supported in your browser

VIEW IN TELEGRAM

Давно не заглядывали в Morphic?

А у них теперь есть генерация видео по аннотациям на картинке

#annotate2video #image2video #sketch2video

👍14😁1

1.93K views09:12

Нейронавт | Нейросети в творчестве

Вот куда вы точно давно не заглядывали так это на Artbreeder

Они там конечно наплодили инструментов похожих один на другой для смешивания персонажей

Даже какой-то оживлятор персонажей есть

#referencing #inage2image #characteranimation

👀6❤4

1.75K views11:25

About

Blog

Apps

Platform