NEW BOT Телеграм, страница

Нейронавт | Нейросети в творчестве

Reve Обновился сервис создания и редактирования изображений. Теперь это контекстный редактор, конкурент Банана, QIE и иже с ними. Умеет все то что умеют конкуренты, но у него еще есть GUI — создаёт и ремиксит изображения — редактирует изображения через…

Reve милашка
Прошу его изобразить персонажей Футурамы, стиль Ложкина - сам ищет референсы, показывает.
В целом на уровне конкурентов. Если не считать режима редактирования, где он сам семантически выделяет слои/объекты для изменений. И все это бесплатново.

Очень понравилась картина с оглядывающейся девочкой. Но как и остальные генерилки, Reve ставит ее в центр проезжей части, никак не хочет перенести действие к одной или другой стороне улицы. А если переносит то меняет и персонажей или кринж какой-то добавляет вроде бомжовских штанов или иначе портит композицию. Тут понадобится сторонний инпейнт. Но в целом он хорош.

Короче, неидеально, но отличная бесплатная альтернатива.
Остальное закину туда которое нельзя рекламировать

Накидывайте свои эксперименты

#neuronaut_art

👍7😁2

1.96K views08:11

Нейронавт | Нейросети в творчестве

1:25

Media is too big

VIEW IN TELEGRAM

Hunyuan3D 3.0

Только что запустили новую версию 3D генератора

- точность повышена в три раза

- геометрическое разрешение составляет 1536 x 1536 x 1536

- используется 3,6 миллиарда вокселей для ультра-HD моделирования

- создание лиц с реалистичными контурами и естественными позами

- точная интерпретация входных изображений для реконструкции сложных структур

- генерация ультрачётких деталей профессионального уровня с улучшенной точностью текстур и их выравниванием

Доступен бесплатно через Hunyuan 3D AI Engine (20 генераций) и через Tencent Cloud API

Попробовать

#imageto3d #textto3d

🔥17👍4❤2😱1

3.12K viewsedited 08:54

Нейронавт | Нейросети в творчестве

0:42

This media is not supported in your browser

VIEW IN TELEGRAM

ComfyUI Cloud

#ComfyUI анонсировали облачный сервис

Обещают топовые GPU, обмазаться VRAM, топовые модели

Сейчас он в приватной бете, можно записаться в вейтлист

👍7❤1👎1

1.86K views09:41

Нейронавт | Нейросети в творчестве

S²-Guidance: Stochastic Self-Guidance for Training-Free Enhancement of Diffusion Models

Замена CFG от Alibaba под названием S2-Guidance обещает более богатую детализацию, превосходную временнУю динамику и улучшенную когерентность объектов.

Метод помогает избежать семантической несогласованности и низкого качества выходных данных, которые часто возникают при использовании техники Classifier-free Guidance (CFG)

Код ждем
Wan 2.3 ждем?

#research #optimization

👍10🔥3❤1

1.93K views12:16

Нейронавт | Нейросети в творчестве

Musicarena

Арена музыкальных моделей - с вокалом и без.
Пока вижу 4 модели: Suno 4.5+, Mureka 7.5, Ruffuision Fuzz1.1 Pro, Udio 1.5
Можно выбрать язык текстов

#text2music #leaderboard #arena

🔥8❤1

1.9K views13:16

Нейронавт | Нейросети в творчестве

InfGen: A Resolution-Agnostic Paradigm for Scalable Image Synthesis

Адаптер к диффузным генераторам для генерации изображений произвольного разрешения от китайцев. Модель решает проблему высокой вычислительной сложности и долгого времени генерации изображений высокого разрешенияю

Заменяет VAE декодеры на одношаговый генератор

— сокращает время генерации 4K-изображений до менее чем 10 секунд.

— может генерировать изображения любого разрешения из фиксированного латентного кода

— не требует переобучения диффузионных моделей для работы с новым разрешением

— упрощает процесс генерации изображений и снижает вычислительную нагрузку;

— применим к любым моделям, использующим одинаковое латентное пространств

Код ждем наверно

#adapter #text2image #optimization #research

👍10🤯2❤1

1.72K views14:17

Нейронавт | Нейросети в творчестве

0:16

This media is not supported in your browser

VIEW IN TELEGRAM

#яниначтоненамекаю #robot

👍5🔥1

2.16K views15:18

Нейронавт | Нейросети в творчестве

0:18

This media is not supported in your browser

VIEW IN TELEGRAM

Meshy 6 Preview

Обновка 3D генератора с PBR текстурами
Выглядит получше чем Hunyuan3D 3.0

#textto3d #imageto3d #texturing #3d2texture #pbr

👍7

2.1K views06:14

Нейронавт | Нейросети в творчестве

0:20

This media is not supported in your browser

VIEW IN TELEGRAM

StableMotion: Training Motion Cleanup Models with Unpaired Corrupted Data

Нейрочистка мокапа (данных с захвата движения) от Electronic Arts / NVIDIA

Находит и исправляет испорченные кадры

Снижает количество артефактов, например, «попсы» движения уменьшаются на 68%, а «замороженные» кадры — на 81%

Код

#mocap

❤5👍3🔥2

1.86K views07:11

Нейронавт | Нейросети в творчестве

0:27

This media is not supported in your browser

VIEW IN TELEGRAM

0:21

This media is not supported in your browser

VIEW IN TELEGRAM

VoxCPM: Tokenizer-Free TTS for Context-Aware Speech Generation and True-to-Life Voice Cloning

Голосовая модель с клонированием голоса на основе MiniCPM-4

— создаёт выразительную речь, подстраивая стиль под содержание

— клонирует голос по короткому аудио, передавая тембр, акцент и эмоции

— синтезирует речь в реальном времени на обычном GPU

— работа с монолингвальным и кросс-лингвальным клонированием голоса: модель способна работать с различными языками и диалектами

— учитывает эмоции и условия записи голоса

— генерирует речь в разных стилях (рассказ, новость, реклама)

— распознаёт математические символы в китайском

— контролирует фонемы

— ⚡️поддерживает китайский и английский языки. Но русский смог с горем пополам. Английский гораздо лучше. Выходит, может чтото на языках которым не обучался ‼️

Код
HF
Демо1
Демо2

#tts #text2speech #realtime #voicecloning

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

🔥10😁3❤1👎1

1.68K views08:11

Нейронавт | Нейросети в творчестве

VibeVoice-finetuning

Неофициальный способ файнтюна топовой говорилки VibeVoice
В процессе разработки

Для 1.5B LoRa рекомендовано минимум 16gb VRAM
Для 7B LoRa - минимум 48gb VRAM

#podcast #voicecloning #tts #text2speech #text2podcast #finetuning #lora

GitHub

GitHub - voicepowered-ai/VibeVoice-finetuning: Unofficial WIP LoRa Finetuning repository for VibeVoice

Unofficial WIP LoRa Finetuning repository for VibeVoice - voicepowered-ai/VibeVoice-finetuning

👍5

1.63K views09:12

Нейронавт | Нейросети в творчестве

marble

Генератор миров по картинке и по тексту от worldlabs.ai
По тексту - сначала генерит картинку

Работает на гауссианах. По сути это генератор 3D сцен на гауссианах под соусом навигабельных миров.
Есть две модели: Marble 01-mini и Marble 01-Plus. Вторая качественнее, медленнее и впятеро дороже по кредитам. Но все генерации сейчас бесплатные

Работает в том числе и на VR гарниртурах

Можно экспортировать сцену в файл.

Говорят что доступ через вейтлист но я свободно зашел и нагенерил немножко, см второе видео

Попробовать

#image2world #image2scene #gaussian #world

👍12👎3❤1

2.1K views10:13

Нейронавт | Нейросети в творчестве

HuMo GGUF + workflow

Кванты HuMo на Wan2.1:

https://huggingface.co/Alissonerdx/Wan2.1-HuMo-GGUF/tree/main/GGUF

https://huggingface.co/Kijai/WanVideo_comfy/tree/main/HuMo

воркфлоу - официальный в ComfyUI-WanVideoWrapper, на сейфтензорах

воркфлоу GGUF от LateInClass

говорилка в воркфлоу: https://huggingface.co/Kijai/MelBandRoFormer_comfy/tree/main

Видео от автора вф

#referencing #text2video #image2video #audio2video #gguf #workflow

Нейронавт | Нейросети в творчестве

HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning

Видеогенератор при участии Bytedance

— генерирует видео на основе текста, изображений и аудио

— удерживает идентичность и характеристики изображаемого субъекта

— синхронизирует…

👍7🔥1

2.08K views11:14

Нейронавт | Нейросети в творчестве

Higgsfield Soul бесплатно с лимитами

Впервые за долгое время Хиггс не обманывает, а действительно дает что-то бесплатно

Генератором фотографий Soul можно пользоваться бесплатно, дают 30 кредитов в день на это дело
Но только по входной картинке или тексту. Бесплатно создать персонажа не дадут.

Генерим здесь

#personalization #referencing #photoreal

👍5❤2😁1

1.81K views12:30

About

Blog

Apps

Platform