This media is not supported in your browser
VIEW IN TELEGRAM
А вот и официальный метод файнтюна говорилки VibeVoice
При файнтюне на один голос можно отключить возможность клонирования голоса, тогда результаты для этого голоса будут лучше. Но клонирование уже не будет работать на инференсе
#podcast #voicecloning #tts #text2speech #text2podcast #finetuning #lora
При файнтюне на один голос можно отключить возможность клонирования голоса, тогда результаты для этого голоса будут лучше. Но клонирование уже не будет работать на инференсе
#podcast #voicecloning #tts #text2speech #text2podcast #finetuning #lora
❤5
WAN2.2 Animate & Qwen-Image-Edit 2509 Native Support in ComfyUI
Поддержка последних новинок.
Wan 2.5 поддерживается по API
Всякие воркфлоу по ссылке в заголовке
#workflow #referencing #imageediting #image2video
Поддержка последних новинок.
Wan 2.5 поддерживается по API
Всякие воркфлоу по ссылке в заголовке
#workflow #referencing #imageediting #image2video
🔥8
Moving by Looking: Towards Vision-Driven Avatar Motion Generation (CLOPS)
Позволяет аватару двигаться в 3D сцене, ориентируясь на визуальные наблюдения от первого лица.
Система создаёт цикл визуального восприятия и человекоподобного движения.
Вероятно, применимо в играх и роботах
Код ждем
#animation #humananimation
Позволяет аватару двигаться в 3D сцене, ориентируясь на визуальные наблюдения от первого лица.
Система создаёт цикл визуального восприятия и человекоподобного движения.
Вероятно, применимо в играх и роботах
Код ждем
#animation #humananimation
👍7
Чекните Hunyuan 3D Studio если вписывались в вейтлист
Мне выдали доступ, может и вам тоже
https://3d.hunyuan.tencent.com/studio/creation/prop/concept
#3d #3dediting #texture #pbr #uvmpping #characteranimation #animation
Мне выдали доступ, может и вам тоже
https://3d.hunyuan.tencent.com/studio/creation/prop/concept
#3d #3dediting #texture #pbr #uvmpping #characteranimation #animation
👍4
Hyper-Bagel: A Unified Acceleration Framework for Multimodal Understanding and Generation
Метод ускорения мультимодального понимания, генерации и редактирования от ByteDance.
— ускоряет понимание контента более чем в 2 раза
— ускоряет генерирацию по тексту в 16,67 раз
— ускоряет редактирование изображения в 22 раза с сохранением качества
Прикручивали видимо к BAGEL
Кода нет, есть надежда что применят в будущих моделях или что метод реализуют энтузиасты.
#optimization #news #research
Метод ускорения мультимодального понимания, генерации и редактирования от ByteDance.
— ускоряет понимание контента более чем в 2 раза
— ускоряет генерирацию по тексту в 16,67 раз
— ускоряет редактирование изображения в 22 раза с сохранением качества
Прикручивали видимо к BAGEL
Кода нет, есть надежда что применят в будущих моделях или что метод реализуют энтузиасты.
#optimization #news #research
🔥9❤1
Qwen3‑LiveTranslate-Flash
И еще одна новинка от Qwen
Модель для перевода аудио и видео контента на разные языки в реальном времени
Знает 18 языков, в том числе русский (и текст и аудио)
Использует визуальные подсказки для улучшения качества перевода и справляется с трудными условиями, например, с шумом или неоднозначными словами.
Демо
API
#translation #dubbing #realtime #assistant
И еще одна новинка от Qwen
Модель для перевода аудио и видео контента на разные языки в реальном времени
Знает 18 языков, в том числе русский (и текст и аудио)
Использует визуальные подсказки для улучшения качества перевода и справляется с трудными условиями, например, с шумом или неоднозначными словами.
Демо
API
#translation #dubbing #realtime #assistant
👍12❤1
🔥14👀5⚡1
Да сколько ж можно!
Хунь готовит
Стрим назначен на воскресенье 28 сентября 14:30
Спасибо @iNevestenko
#news
Хунь готовит
самую мощную открытую модель генерации картинок
Стрим назначен на воскресенье 28 сентября 14:30
Спасибо @iNevestenko
#news
🔥21😱7😁4
This media is not supported in your browser
VIEW IN TELEGRAM
FLUX.1 Kontext now in Adobe Photoshop: Powering Every Pixel
FLUX.1 Kontext [Pro] теперь доступен в бета-версии Adobe Photoshop. С 25 сентября в инструменте Generative Fill.
Утверждают что во время бета-тестирования модель можно будет использовать бесплатно. Как долго - непонятно.
#imageediting #photoshop #news
FLUX.1 Kontext [Pro] теперь доступен в бета-версии Adobe Photoshop. С 25 сентября в инструменте Generative Fill.
Утверждают что во время бета-тестирования модель можно будет использовать бесплатно. Как долго - непонятно.
#imageediting #photoshop #news
😱9👍2❤1🥴1😈1
Forwarded from Метаверсище и ИИще (Sergey Tsyptsyn ️️)
Media is too big
VIEW IN TELEGRAM
Мы еще не отошли от новых возможностей Suno V5, как они бахнули Suno Studio
И это уже серьезно.
Музыкальная монтажка в вашем браузере, но даже это не главное.
Теперь треки различных инструментов и вокала генерятся по отдельности, их видно, их можно резать и монтировать индивидуально.
Но даже это не главное.
Все это можно экспортировать в DAW.
Но даже это не главное.
Треки можно конвертировать в MIDI формат!!!
И вот это уже бомба.
Не секрет, что многие композиторы и аранжировщики уже используют Суно в качестве источника музыкальных идей и просто тырят оттуда мелодии, чтобы переаранжировать их.
Теперь это сделать совсем просто.
И вообще, теперь вы можете вытворять со своими генерациями, что хотите в плане дальнейшей доработки.
Знающие люди в коментах уже пишут, что конвертация в MIDI делает минимальное количество ошибок, и правится руками очень быстро.
Suno - продукт у которого просто нет конкуренции.
Для начала просто посмотрите, что они сами вытворяют:
https://www.youtube.com/watch?v=c8qNYyeAQBs
https://www.youtube.com/watch?v=KFfrcPmzSSo&t=998s
Пока раскатали в плане за 30 долларов в месяц, ждем дальнейших послаблений.
https://suno.com/studio-welcome
@cgevent
И это уже серьезно.
Музыкальная монтажка в вашем браузере, но даже это не главное.
Теперь треки различных инструментов и вокала генерятся по отдельности, их видно, их можно резать и монтировать индивидуально.
Но даже это не главное.
Все это можно экспортировать в DAW.
Но даже это не главное.
Треки можно конвертировать в MIDI формат!!!
И вот это уже бомба.
Не секрет, что многие композиторы и аранжировщики уже используют Суно в качестве источника музыкальных идей и просто тырят оттуда мелодии, чтобы переаранжировать их.
Теперь это сделать совсем просто.
И вообще, теперь вы можете вытворять со своими генерациями, что хотите в плане дальнейшей доработки.
Знающие люди в коментах уже пишут, что конвертация в MIDI делает минимальное количество ошибок, и правится руками очень быстро.
Suno - продукт у которого просто нет конкуренции.
Для начала просто посмотрите, что они сами вытворяют:
https://www.youtube.com/watch?v=c8qNYyeAQBs
https://www.youtube.com/watch?v=KFfrcPmzSSo&t=998s
Пока раскатали в плане за 30 долларов в месяц, ждем дальнейших послаблений.
https://suno.com/studio-welcome
@cgevent
🤯9👍3👎1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
LongSplat: Robust Unposed 3D Gaussian Splatting for Casual Long Videos
Реконструкция 3D-сцен от NVIDIA на гауссианах из длинных видео, снятых в обычных условиях - с тряской камеры и т д
Справляется с дрейфом поз, неточной инициализацией геометрии и ограничениями по памяти.
Пригоден для стабилизации видео
Под капотом MASt3R
Код
Спасибо @m_franz
#gaussian #videoto3d #stabilization #novelview
Реконструкция 3D-сцен от NVIDIA на гауссианах из длинных видео, снятых в обычных условиях - с тряской камеры и т д
Справляется с дрейфом поз, неточной инициализацией геометрии и ограничениями по памяти.
Пригоден для стабилизации видео
Под капотом MASt3R
Код
Спасибо @m_franz
#gaussian #videoto3d #stabilization #novelview
👍6🔥5