Нейронавт | Нейросети в творчестве – Telegram
Нейронавт | Нейросети в творчестве
10.6K subscribers
4.47K photos
3.73K videos
41 files
4.77K links
Канал про нейросети в компьютерной графике, в кино и вообще

В папках не участвую

для связи @Neuronauticus

Заявка на регистрацию в РКН № 6309426111
Download Telegram
Qwen3‑LiveTranslate-Flash

И еще одна новинка от Qwen

Модель для перевода аудио и видео контента на разные языки в реальном времени

Знает 18 языков, в том числе русский (и текст и аудио)

Использует визуальные подсказки для улучшения качества перевода и справляется с трудными условиями, например, с шумом или неоднозначными словами.

Демо
API

#translation #dubbing #realtime #assistant
👍121
CozyGen

Кастом нода для ComfyUI для доступа к вашему серверу ComfyUI с мобилок через удобный интерфейс. Позволяет загружать заранее подготовленные воркфлоу, крутить рульки и создавать изображения с любого устройства с веб-браузером

#ComfyUI #GUI #tools
🔥14👀51
Да сколько ж можно!

Хунь готовит
самую мощную открытую модель генерации картинок


Стрим назначен на воскресенье 28 сентября 14:30

Спасибо @iNevestenko

#news
🔥21😱7😁4
This media is not supported in your browser
VIEW IN TELEGRAM
FLUX.1 Kontext now in Adobe Photoshop: Powering Every Pixel

FLUX.1 Kontext [Pro] теперь доступен в бета-версии Adobe Photoshop. С 25 сентября в инструменте Generative Fill.

Утверждают что во время бета-тестирования модель можно будет использовать бесплатно. Как долго - непонятно.

#imageediting #photoshop #news
😱9👍21🥴1😈1
Forwarded from Метаверсище и ИИще (Sergey Tsyptsyn ️️)
Media is too big
VIEW IN TELEGRAM
Мы еще не отошли от новых возможностей Suno V5, как они бахнули Suno Studio

И это уже серьезно.
Музыкальная монтажка в вашем браузере, но даже это не главное.

Теперь треки различных инструментов и вокала генерятся по отдельности, их видно, их можно резать и монтировать индивидуально.
Но даже это не главное.

Все это можно экспортировать в DAW.
Но даже это не главное.

Треки можно конвертировать в MIDI формат!!!
И вот это уже бомба.

Не секрет, что многие композиторы и аранжировщики уже используют Суно в качестве источника музыкальных идей и просто тырят оттуда мелодии, чтобы переаранжировать их.
Теперь это сделать совсем просто.

И вообще, теперь вы можете вытворять со своими генерациями, что хотите в плане дальнейшей доработки.

Знающие люди в коментах уже пишут, что конвертация в MIDI делает минимальное количество ошибок, и правится руками очень быстро.

Suno - продукт у которого просто нет конкуренции.

Для начала просто посмотрите, что они сами вытворяют:
https://www.youtube.com/watch?v=c8qNYyeAQBs
https://www.youtube.com/watch?v=KFfrcPmzSSo&t=998s

Пока раскатали в плане за 30 долларов в месяц, ждем дальнейших послаблений.

https://suno.com/studio-welcome

@cgevent
🤯9👍3👎1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
LongSplat: Robust Unposed 3D Gaussian Splatting for Casual Long Videos

Реконструкция 3D-сцен от NVIDIA на гауссианах из длинных видео, снятых в обычных условиях - с тряской камеры и т д

Справляется с дрейфом поз, неточной инициализацией геометрии и ограничениями по памяти.

Пригоден для стабилизации видео

Под капотом MASt3R

Код

Спасибо @m_franz

#gaussian #videoto3d #stabilization #novelview
👍6🔥5
HuMo & Chroma1-Radiance Native Support in ComfyUI

HuMo и Chroma1-Radiance завезли в #ComfyUI

Обычно диффузные модели используют латентное пространство для генерации изображений, а VAE - для кодирования/декодирования изображений из/в пиксельное пространство. Radiance генерирует изображение непосредственно в пиксели. То есть, VAE не требуется. Модели VAE оценивают, как должно выглядеть изображение при декодировании, что означает неизбежные потери. При генерации сразу в пиксели этого не происходит. Предварительный просмотр в реальном времени также будет более точным по мере создания изображения.

Воркфлоу по ссылке в блоге

#workflow #image2video #text2image
👍131🤔1😈1
4KAgent: Agentic Any Image to 4K Super-Resolution

Думающий агентный апскейл изображений до 4K при участии Topaz Labs

Анализирует изображение, создает его детальное описание и выбирает стратегию в зависимости от домена, типа и степени повреждений.

Природа выглядит так себе, как фрактальный апскейл

Аэрофотосъемка - линии кривые, в остальном хорошо

Фэнтези - норм

Для установки требуется 50 ГБ на диске. От 2 GPU (>=24 GB VRAM - непонятно каждый или всего)

Код

#upscale #agent
😁7👍3😱1
This media is not supported in your browser
VIEW IN TELEGRAM
TinyWorlds

Чел водиночку попытался воспроизвести архитектуру Genie в минималистичном виде. Потратил на это месяц. Вот что получилось.

С ним уже хотят пообщаться люди из команд разрабатывающих генераторы миров.

Твиттер
Гитхаб

#text2world #research #text2game
🔥81