Media is too big
VIEW IN TELEGRAM
Blocky: AI-Powered Agent Builder (Beta)
Голосовой сервис Ultravox представил Blocky - ИИ-конструктор голосовых агентов по промпту. Доступно в бета-тесте.
Ultravox n8n
Примеры на гитхабе
#voiceassistant #assiatant #voicecloning #translation #LLM #realtime #online
Голосовой сервис Ultravox представил Blocky - ИИ-конструктор голосовых агентов по промпту. Доступно в бета-тесте.
Ultravox n8n
Примеры на гитхабе
#voiceassistant #assiatant #voicecloning #translation #LLM #realtime #online
👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Higgsfield Records
Higgsfield представил ИИ-рекорд лейбл.
И ИИ-идола - Kion
Хвастаются многомиллионными контрактами и предлагают раскрутить вас
#news
Higgsfield представил ИИ-рекорд лейбл.
И ИИ-идола - Kion
Хвастаются многомиллионными контрактами и предлагают раскрутить вас
#news
👍8😁3😭3❤1
Qwen Image ControlNet & LoRA, EasyCache and Context Window in ComfyUI
Обновки в #ComfyUI :
- поддержка Qwen Image с ControlNet и LoRA
- нода EasyCache ускоряет генерацию на 20 % для видеокарт Blackwell
- возможность последовательно подключать стили LoRA в рабочих процессах Qwen-Image
- работа со скользящими контекстными окнами
#qwenimage #lora #controlnet #optimization
Обновки в #ComfyUI :
- поддержка Qwen Image с ControlNet и LoRA
- нода EasyCache ускоряет генерацию на 20 % для видеокарт Blackwell
- возможность последовательно подключать стили LoRA в рабочих процессах Qwen-Image
- работа со скользящими контекстными окнами
#qwenimage #lora #controlnet #optimization
❤6👍6
This media is not supported in your browser
VIEW IN TELEGRAM
Intent: Next-Gen AI Messenger
ИИ-мессенджер с встроенными фичами для которых вы обычно переключаетесь в эти ваши разные ИИшки
Записаться в вейтлист
#assistant #messenger #news
ИИ-мессенджер с встроенными фичами для которых вы обычно переключаетесь в эти ваши разные ИИшки
Записаться в вейтлист
#assistant #messenger #news
👍6👎2👀1
This media is not supported in your browser
VIEW IN TELEGRAM
Turntable in Illustrator (beta)
Adobe включили в иллюстраторе в бета-режиме инструмент Turntable, позволяюший вращать 2D векторный арт в 3D пространстве
#news #design
Adobe включили в иллюстраторе в бета-режиме инструмент Turntable, позволяюший вращать 2D векторный арт в 3D пространстве
#news #design
👍7🤯3
This media is not supported in your browser
VIEW IN TELEGRAM
VibeVoice: A Frontier Open-Source Text-to-Speech Model
Голосовая модель от Microsoft для выразительных диалогов и подкастов.
Может синтезировать речь продолжительностью до 90 минут.
Поддерживает работу с 4 разными голосами в одной генерации, это на 2-3 голоса больше чем в ведущих моделях.
Есть китайский и английский. Надеемся на дообучение
На примере женский голос норм, мужской эмоционально пустой. Послушайте примеры на сайте для общей картины
Код
HF - модель на 1.5 млрд. параметров + токенизатор Обещают 7B и 0.5B
Демо
#podcast #voicecloning #tts #text2speech #text2podcast
Голосовая модель от Microsoft для выразительных диалогов и подкастов.
Может синтезировать речь продолжительностью до 90 минут.
Поддерживает работу с 4 разными голосами в одной генерации, это на 2-3 голоса больше чем в ведущих моделях.
Есть китайский и английский. Надеемся на дообучение
На примере женский голос норм, мужской эмоционально пустой. Послушайте примеры на сайте для общей картины
Код
HF - модель на 1.5 млрд. параметров + токенизатор Обещают 7B и 0.5B
Демо
#podcast #voicecloning #tts #text2speech #text2podcast
👍9❤2🤔1
Wan-S2V: Audio-Driven Cinematic Video Generation
Релиз обещанного видеогенератора, который принимает на вход картинку и звук
Архитектурно - совет экспертов ( #MoE )
Как видим, умеет работать с диалогами и пением
Гитхаб
HF
Демо
Офсайт - пока не вижу его там, ждем
До появления компактных версий и обновок от Kijai 5... 4... 3...
Спасибо @iNevestenko
#image2video #audio2video #referencing #wan22
Релиз обещанного видеогенератора, который принимает на вход картинку и звук
Архитектурно - совет экспертов ( #MoE )
Как видим, умеет работать с диалогами и пением
Гитхаб
HF
Демо
Офсайт - пока не вижу его там, ждем
До появления компактных версий и обновок от Kijai 5... 4... 3...
Спасибо @iNevestenko
#image2video #audio2video #referencing #wan22
🔥15👍2❤1😁1
Nano-banana только что релизнули в Gemini 2.5 Flash
Доступно для граждан правильной страны в gemini app и Google AI Studio
Бежим творить у кого есть доступ. Притворитесь что вы в США и ломитесь в студию
Спасибо @iNevestenko
#imageediting #sota
Доступно для граждан правильной страны в gemini app и Google AI Studio
Бежим творить у кого есть доступ. Притворитесь что вы в США и ломитесь в студию
Спасибо @iNevestenko
#imageediting #sota
🔥12👍2❤1
Нейронавт | Нейросети в творчестве
WAN тизерит WAN2.2-S2V - кинематографичный генератор видео по звуку Спасибо @iNevestenko #news
Nano-banana еще днем появился в списке моделей редактирования в Krea.ai
На бесплатном тарифе недоступен
В Fal.ai тоже есть
#news
На бесплатном тарифе недоступен
В Fal.ai тоже есть
#news
👍4
Нейронавт | Нейросети в творчестве
Nano-banana только что релизнули в Gemini 2.5 Flash Доступно для граждан правильной страны в gemini app и Google AI Studio Бежим творить у кого есть доступ. Притворитесь что вы в США и ломитесь в студию Спасибо @iNevestenko #imageediting #sota
В комментах есть способ получить доступ для рисковых, через hosts
Кидайте сюда свои нанобанановые тесты и творения. Он не всемогущ, найдем его слабости и сильности
#neuronaut_art
Кидайте сюда свои нанобанановые тесты и творения. Он не всемогущ, найдем его слабости и сильности
#neuronaut_art
👍9
Нейронавт | Нейросети в творчестве
5... 4... 3...
2... 1... 0...
Wan2_2-S2V-14B_fp8_e4m3fn_scaled_KJ
Забираем Wan-S2V, 18.5 Гб
#image2video #audio2video #referencing #wan22
Wan2_2-S2V-14B_fp8_e4m3fn_scaled_KJ
Забираем Wan-S2V, 18.5 Гб
#image2video #audio2video #referencing #wan22
huggingface.co
Kijai/WanVideo_comfy_fp8_scaled at main
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
🔥11😱2👍1