NEW BOT Телеграм, страница

Forwarded from Метаверсище и ИИще (Sergey Tsyptsyn ️️)

Ух ты, Хуньяньский опенсорснул часть Hunyuan Studio ответственную за сегментацию полигональных объектов.

Там два метода:
P3-SAM: модель сегментации деталей в формате 3D.
X-Part: модель генерации деталей, обеспечивающая топовые результаты в области управляемости и качества формы.
Код https://github.com/Tencent-Hunyuan/Hunyuan3D-Part
Веса: https://huggingface.co/tencent/Hunyuan3D-Part

Подробнее тут:
https://murcherful.github.io/P3-SAM/
https://yanxinhao.github.io/Projects/X-Part/

@cgevent

👍7

1.17K views09:27

Нейронавт | Нейросети в творчестве

This media is not supported in your browser

VIEW IN TELEGRAM

Video models are zero-shot learners and reasoners

Выяснилось что Veo 3 способен решать многие визуальные задачи без дообучения

— может сегментировать объекты

— обнаруживает края

— редактирует изображения

— понимает физические свойства объектов

— распознаёт возможности использования объектов

— симулирует использование инструментов

— решает лабиринты

— определяет симметрию

— выявляет свойства материалов (например, воспламеняемость)

— моделирует преобразования жёстких и мягких тел

— работает с оптическими свойствами материалов (стекло, зеркала)

— удаляет фон

— выполняет перенос стиля

— раскрашивает изображения

— занимается дорисовкой и созданием новых видов сцен

— синтезирует новые ракурсы

— управляет манипуляциями с объектами (например, с банкой, при броске и ловле, с шарами Баодинг)

— распознаёт действия по визуальным инструкциям

Примеры по ссылке

Выходит, видеогенераторы могут стать базовой визуальной моделью подобно тому как LLM стали основой для обработки естественного языка

Исследование от Deepmind

#news #research

❤11👍2

2.09K views11:51

Нейронавт | Нейросети в творчестве

0:21

This media is not supported in your browser

VIEW IN TELEGRAM

Audio2Face-3D

NVIDIA выпустила в опенсорс свой аниматор говорящих 3D голов по звуку из 2022 года

Насколько помню, раньше она была доступна в Onmiverse
Видимо, технология уже не сильно актуальна?

В SDK есть плагины для #Maya и #UE

HF

#talkinghead #audio2animation #head #speech2animation #lipsync

❤3😁2👍1

2.27K viewsedited 12:36

Нейронавт | Нейросети в творчестве

#humor

😁80🍌2🍾2🌚1

3.12K views13:20

Нейронавт | Нейросети в творчестве

Опубликованы модели и код видеоперсонализатора Lynx

Репозиторий содержит два варианта модели:

Модель Lynx Full (lynx_full): полная версия со всеми расширенными функциями и наилучшей производительностью

Модель Lynx Lite (lynx_lite): Облегченная версия, оптимизированная для сред с ограниченными ресурсами, с поддержкой видео со скоростью 24 кадра в секунду.

Гитхаб
HF

#personalization #referenceing #text2video #imge2video

0:35

Нейронавт | Нейросети в творчестве

Lynx: Towards High-Fidelity Personalized Video Generation

ByteDance никак не угомонятся.
Видеогенератор с фокусом на персонализации на базе Wan 2.1, может быть интегрирован в существующие экосистемы

Сохраняет идентичность человека, используя два лёгких…

❤5🔥1

2.18K views14:17

Нейронавт | Нейросети в творчестве

8:17

Media is too big

VIEW IN TELEGRAM

Diffusion-Pipe In ComfyUI Custom Nodes

Кастом ноды для тренировки лор прямо в #ComfyUI

Список поддерживаемых моделей на скрине

#lora #finetuning #tools

🔥21👍3

2.49K views15:17

Нейронавт | Нейросети в творчестве

Pocket Comfy

Еще один интерфейс для удобного запуска генераций в #ComfyUI ориентированный на мобилки

Предусмотрена авторизация

#gui #tools #mobile

👍5

2.43K views07:11

Нейронавт | Нейросети в творчестве

VibeVoice-ComfyUI 1.5.0

Добавлена поддержка лор и контроль скорости речи: можно немного изменять скорость исходного аудио для приближения к желаемому темпу при клонировании голоса. Для лучших результатов рекомендуются образцы звука длиннее 20 секунд.

#podcast #voicecloning #tts #text2speech #text2podcast #comfyui

🔥14

2.48K views09:12

Нейронавт | Нейросети в творчестве

2:02

Media is too big

VIEW IN TELEGRAM

ByteDance опубликовали ресерч Seedream 4.0

А на сайте добавился видеоролик (его же раньше не было или я туплю?)

На арене открыли возможность сделать 5 генераций в день, но не факт что хоть в одну из них выпадет Seedream 4
Ну я поголосовал и на мой взгляд Seedream 4 уделывает всех по послушности, и картинка хорошая

#text2image #news

👍6

1.78K viewsedited 10:13

Нейронавт | Нейросети в творчестве

Postshot v1 Вышел из беты инструмент полного цикла для работы с полями света (нерфы, гауссианы) Бета лицензия превратится в бесплатный тариф 26 сентября. На бесплатном тарифе рендер с вотермаком, входные изображения ограничены 8 бит. На двух платных тарифах…

Был недавно в Музее Арктики и Антакртики, снял модель медведя.
Запилил реконструкцию в PostShot, почистил в SuperSplat и там опубликовал

Делитесь своими поделками-экспериментами

#Neuronaut_art

🔥23👍3❤2

1.96K views14:17

Нейронавт | Нейросети в творчестве

2:09

Media is too big

VIEW IN TELEGRAM

HunyuanImage 3.0

Самый мощный опенсорсный генератор картинок

Иолее чем 80B параметров, из которых 13B активных

Под капотом совет экспертов #MoE

— может обрабатывать сложные промпты длиной до тысячи слов

— генерирует точный текст внутри изображений

— создаёт детальные комиксы

— формирует выразительные эмодзи

— разрабатывает живые и привлекательные иллюстрации

Обещают выпустить Instruct- версию, дистиллированные чекпойнты, поддержку VLLM, генерацию по картинке, пошаговое редактирование

Готовьте 170 ГБ на диске и ≥3×80 ГБ VRAM (для лучшей производительности рекомендуется 4×80 ГБ)

Пишут что совместим с Flashattention и FlashInfer

Гитхаб
HF
Попробовать

#text2image

😁19🔥9😱7😐3👍2

2.39K views06:09

Нейронавт | Нейросети в творчестве

Воскресный опрос. Сколько у вас VRAM?

Anonymous Poll

😭9😁8🤔1🌚1

643 voters1.7K views07:48

Нейронавт | Нейросети в творчестве

1:06

This media is not supported in your browser

VIEW IN TELEGRAM

OmniInsert: Mask-Free Video Insertion of Any Reference via Diffusion Transformer Models

Вставляет что угодно на видео из одного или нескольких источников

генерация одного 5-секундного видео (121 кадр) в разрешении 480p занимает примерно 90 секунд при использовании 8 видеокарт NVIDIA A100

Код ждем

Спасибо @m_franz

#videoediting #video2video #videoinpainting

🔥8👍3😁1

2K views08:11

About

Blog

Apps

Platform