NEW BOT Телеграм, страница

HYWorld-1.5

Tencent обновил генератор миров HunyuanWorld

— от первого и от третьего лица

— умеет в 3D-реконструкцию и стилизацию

— запускает события по текстовому запросу

— контролирует действия с высокой точностью

Пробовать на офсайте
Гитхаб
HF

#text2world #image2world #text2panorama #image2panorama #360 #text2scene #image2scene #world #realtime

🔥8❤2👍2😁1

1.15K views06:39

Нейронавт | Нейросети в творчестве

0:35

This media is not supported in your browser

VIEW IN TELEGRAM

0:32

This media is not supported in your browser

VIEW IN TELEGRAM

0:35

This media is not supported in your browser

VIEW IN TELEGRAM

0:23

This media is not supported in your browser

VIEW IN TELEGRAM

0:13

This media is not supported in your browser

VIEW IN TELEGRAM

0:31

This media is not supported in your browser

LongCat-Video-Avatar

Генератор на базе LongCat-Video создаёт реалистичные длительные видеоролики с липсинком и сохранением идентичности персонажа

Генерирует видео на основе аудио и текста или аудио, текста и изображения

Умеет петь, продлять видео, делать мультидиалог, видеоподкасты, продающие видео

Гитхаб
HF
MS

#ati2v #at2v #avatar #longvideo #characteranimation #speech2animation #image2video

🔥10❤1

970 views07:11

Нейронавт | Нейросети в творчестве

0:15

This media is not supported in your browser

VIEW IN TELEGRAM

Seedance 1.5

Еще одна обновка видеогенератора от ByteDance

Заявлены естественные диалоги и качественный липсинк
Ежедневные бесплатные генерации в СapCut

https://www.capcut.com/tools/seedance-1-5-ai-video-generator
https://dreamina.capcut.com/ai-tool/generate - Model 3.5

#text2video #image2video

👍5😁2

950 views07:41

Нейронавт | Нейросети в творчестве

DistillPatch LoRA

Восстанавливает истинную 8-шаговую скорость Turbo для любой LoRA, обученной на Z-Image Turbo

решает проблему ухудшения качества изображений (размытие) при использовании стандартной тренировки LoRA в Z-Image Turbo при параметрах steps=8 и cfg=1

HF
Демо
MS
MS Демо
Гитхаб

#lora #zimage #optimization

🔥5😁1

949 views09:12

Нейронавт | Нейросети в творчестве

0:59

Media is too big

VIEW IN TELEGRAM

TRELLIS.2

А вот и треллис обновился.

Генератор текстурировапнных PBR 3D моделей по картинке, разрешение до 1536³

4B параметров.
Обрабатывает сложные структуры: открытые поверхности, nonmanifold-геометрию, внутренние структуры

SC-VAE: Sparse Compression VAE - придумали 3D-VAE для сжатия воксельных данных.

Гитхаб
Демо
HF

#imageto3d #pbr

❤5🔥4👍3

897 views10:13

Нейронавт | Нейросети в творчестве

0:01

This media is not supported in your browser

VIEW IN TELEGRAM

0:01

This media is not supported in your browser

VIEW IN TELEGRAM

0:01

This media is not supported in your browser

VIEW IN TELEGRAM

0:01

This media is not supported in your browser

VIEW IN TELEGRAM

EgoX: Egocentric Video Generation from a Single Exocentric Video

Еще одна работа на субъективный вид от первого лица (POV), от KAIST

Превращает видео с видом со стороны в видео от лица одного из персонажей

Лора на базе Wan 2.1 14B i2v

Код ждем

#video2pov #pov #video2video #cameracontrol #lora

😱2🔥1

789 views11:14

Нейронавт | Нейросети в творчестве

chatterbox-turbo

Новая версия голосовой модели от Resemble AI, всего 350М параметров

Для естественности можно добавлять паралингвистические теги, например [cough], [laugh], [chuckle]

В аудиофайлы, созданные с помощью Chatterbox, встраиваются незаметные нейронные водяные знаки Perth, которые сохраняются при сжатии MP3, редактировании аудио и других манипуляциях

Ну и главное - есть мультиязычная версия модели на 500М параметров, поддерживающая более 23 языков, в том числе русский

HF
Демо
Демо мультиязычный - спасибо @Black_human

#voicecloning #tts #russian

🔥6

622 views12:16

Нейронавт | Нейросети в творчестве

1:26

This media is not supported in your browser

VIEW IN TELEGRAM

Molmo 2: State-of-the-art video understanding, pointing, and tracking

Семейство пониматоров видео и изображений от AI2 (Allen AI)

#SOTA среди открытых моделей

— обгоняет Gemini 3 Pro и другие открытые модели в отслеживании объектов в видео

— поддерживает работу с одиночными изображениями, несколькими изображениями и видеоклипами разной длины

— указывает конкретные события и объекты в видео, а не просто даёт описательные ответы

— выполняет подсчёт объектов с указанием их местоположения, отслеживание нескольких объектов, плотную разметку видео, обнаружение аномалий и артефактов, работает с субтитрами в видео

Molmo 2 (8B) — лучшая общая модель для работы с видео
Molmo 2 (4B) — оптимизирована для эффективности

Эти две модели на базе Qwen 3

Molmo 2-O (7B) — полностью открытая модель с контролем над всеми компонентами

Playground
HF

#vlm #multimodal

👍2🔥1

325 views13:16

About

Blog

Apps

Platform