NEW BOT Телеграм, страница

Wan 2.5-Preview

Мульитмодальный, сочетает в себе не только генерацию, но и понимание видео

генерирует синхронизированный аудио-видео контент

1080p, 10 секунд

Умеет создавать и редактировать изображения и видео, упомянут диалоговый режим - привет банан, реве и компания.

Попробовать на офсайте

PS прощай опенсорс???

#text2video #image2video #text2image #imageediting #text2speech

🔥12🤔3❤1

2.04K views09:13

Нейронавт | Нейросети в творчестве

0:23

This media is not supported in your browser

VIEW IN TELEGRAM

Rodin Gen-2

Rodin разродился Gen-2

- качество сетки улучшено вчетверо
- рекурсивная генерация частей
- запекание тяжелых мешей в лоуполи с нормалями
- HD текстуры (Бета)

Ну и никуда не делись PBR, 3D контролнеты, T/A позы

#3d #imageyo3d #textto3d #3dediting

❤3👍2😁1

2.24K views10:13

Нейронавт | Нейросети в творчестве

0:45

Media is too big

VIEW IN TELEGRAM

VideoFrom3D: 3D Scene Video Generation via Complementary Image and Video Diffusion Models

Создает видео 3D сцен по грубой геометрии, траектории камеры и референсной картинке. Этакий ИИ-рендер 3D.

Под капотом зафантюненный CogVideoX и для начального кадра Flux ControlNet и еще набор каких-то методов.

Код

#3d2video #rendering

🤷‍♂3👍3🔥1

1.95K views11:14

Нейронавт | Нейросети в творчестве

1:33

This media is not supported in your browser

VIEW IN TELEGRAM

А вот и официальный метод файнтюна говорилки VibeVoice

При файнтюне на один голос можно отключить возможность клонирования голоса, тогда результаты для этого голоса будут лучше. Но клонирование уже не будет работать на инференсе

#podcast #voicecloning #tts #text2speech #text2podcast #finetuning #lora

❤5

1.72K viewsedited 12:16

Нейронавт | Нейросети в творчестве

0:07

This media is not supported in your browser

VIEW IN TELEGRAM

0:06

This media is not supported in your browser

VIEW IN TELEGRAM

WAN2.2 Animate & Qwen-Image-Edit 2509 Native Support in ComfyUI

Поддержка последних новинок.
Wan 2.5 поддерживается по API

Всякие воркфлоу по ссылке в заголовке

#workflow #referencing #imageediting #image2video

🔥8

2.59K views13:16

Нейронавт | Нейросети в творчестве

0:03

This media is not supported in your browser

VIEW IN TELEGRAM

1:00

This media is not supported in your browser

VIEW IN TELEGRAM

Moving by Looking: Towards Vision-Driven Avatar Motion Generation (CLOPS)

Позволяет аватару двигаться в 3D сцене, ориентируясь на визуальные наблюдения от первого лица.
Система создаёт цикл визуального восприятия и человекоподобного движения.

Вероятно, применимо в играх и роботах

Код ждем

#animation #humananimation

👍7

1.69K views16:46

Нейронавт | Нейросети в творчестве

Чекните Hunyuan 3D Studio если вписывались в вейтлист

Мне выдали доступ, может и вам тоже

https://3d.hunyuan.tencent.com/studio/creation/prop/concept

#3d #3dediting #texture #pbr #uvmpping #characteranimation #animation

👍4

1.87K views17:31

Нейронавт | Нейросети в творчестве

#humor

😁33

1.8K views18:21

Нейронавт | Нейросети в творчестве

Hyper-Bagel: A Unified Acceleration Framework for Multimodal Understanding and Generation

Метод ускорения мультимодального понимания, генерации и редактирования от ByteDance.

— ускоряет понимание контента более чем в 2 раза

— ускоряет генерирацию по тексту в 16,67 раз

— ускоряет редактирование изображения в 22 раза с сохранением качества

Прикручивали видимо к BAGEL

Кода нет, есть надежда что применят в будущих моделях или что метод реализуют энтузиасты.

#optimization #news #research

🔥9❤1

1.6K views06:09

Нейронавт | Нейросети в творчестве

0:31

This media is not supported in your browser

VIEW IN TELEGRAM

Qwen3‑LiveTranslate-Flash

И еще одна новинка от Qwen

Модель для перевода аудио и видео контента на разные языки в реальном времени

Знает 18 языков, в том числе русский (и текст и аудио)

Использует визуальные подсказки для улучшения качества перевода и справляется с трудными условиями, например, с шумом или неоднозначными словами.

Демо
API

#translation #dubbing #realtime #assistant

👍12❤1

2.16K views07:11

Нейронавт | Нейросети в творчестве

1:33

This media is not supported in your browser

VIEW IN TELEGRAM

Предатели учат роботов выживать и адаптироваться

#robot #яниначтоненамекаю

😭8🔥3😁1🌚1

1.93K views09:12

Нейронавт | Нейросети в творчестве

CozyGen

Кастом нода для ComfyUI для доступа к вашему серверу ComfyUI с мобилок через удобный интерфейс. Позволяет загружать заранее подготовленные воркфлоу, крутить рульки и создавать изображения с любого устройства с веб-браузером

#ComfyUI #GUI #tools

🔥14👀5⚡1

2.13K views10:13

Нейронавт | Нейросети в творчестве

В OneTrainer появилась поддержка дообучения #QwenImage

#finetuning #tools

GitHub

GitHub - Nerogar/OneTrainer: OneTrainer is a one-stop solution for all your stable diffusion training needs.

OneTrainer is a one-stop solution for all your stable diffusion training needs. - Nerogar/OneTrainer

👍7

2K views11:13

About

Blog

Apps

Platform