Нейронавт | Нейросети в творчестве – Telegram
Нейронавт | Нейросети в творчестве
10.6K subscribers
4.44K photos
3.71K videos
41 files
4.75K links
Канал про нейросети в компьютерной графике, в кино и вообще

В папках не участвую

для связи @Neuronauticus

Заявка на регистрацию в РКН № 6309426111
Download Telegram
WAN тизерит WAN2.2-S2V - кинематографичный генератор видео по звуку

Спасибо @iNevestenko

#news
7👍3🤔2
Media is too big
VIEW IN TELEGRAM
Blocky: AI-Powered Agent Builder (Beta)

Голосовой сервис Ultravox представил Blocky - ИИ-конструктор голосовых агентов по промпту. Доступно в бета-тесте.

Ultravox n8n
Примеры на гитхабе

#voiceassistant #assiatant #voicecloning #translation #LLM #realtime #online
👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Higgsfield Records

Higgsfield представил ИИ-рекорд лейбл.

И ИИ-идола - Kion

Хвастаются многомиллионными контрактами и предлагают раскрутить вас

#news
👍8😁3😭31
Qwen Image ControlNet & LoRA, EasyCache and Context Window in ComfyUI

Обновки в #ComfyUI :

- поддержка Qwen Image с ControlNet и LoRA

- нода EasyCache ускоряет генерацию на 20 % для видеокарт Blackwell

- возможность последовательно подключать стили LoRA в рабочих процессах Qwen-Image

- работа со скользящими контекстными окнами

#qwenimage #lora #controlnet #optimization
6👍6
This media is not supported in your browser
VIEW IN TELEGRAM
Intent: Next-Gen AI Messenger

ИИ-мессенджер с встроенными фичами для которых вы обычно переключаетесь в эти ваши разные ИИшки

Записаться в вейтлист

#assistant #messenger #news
👍6👎2👀1
Гугл тизерит релиз Nano-banana (в Gemini app?) на этой неделе

Спасибо @tripl3wave

#news
14👍3
This media is not supported in your browser
VIEW IN TELEGRAM
Turntable in Illustrator (beta)

Adobe включили в иллюстраторе в бета-режиме инструмент Turntable, позволяюший вращать 2D векторный арт в 3D пространстве

#news #design
👍7🤯3
This media is not supported in your browser
VIEW IN TELEGRAM
VibeVoice: A Frontier Open-Source Text-to-Speech Model

Голосовая модель от Microsoft для выразительных диалогов и подкастов.

Может синтезировать речь продолжительностью до 90 минут.

Поддерживает работу с 4 разными голосами в одной генерации, это на 2-3 голоса больше чем в ведущих моделях.

Есть китайский и английский. Надеемся на дообучение

На примере женский голос норм, мужской эмоционально пустой. Послушайте примеры на сайте для общей картины

Код
HF - модель на 1.5 млрд. параметров + токенизатор Обещают 7B и 0.5B
Демо

#podcast #voicecloning #tts #text2speech #text2podcast
👍92🤔1
Wan-S2V: Audio-Driven Cinematic Video Generation

Релиз обещанного видеогенератора, который принимает на вход картинку и звук

Архитектурно - совет экспертов ( #MoE )

Как видим, умеет работать с диалогами и пением

Гитхаб
HF
Демо
Офсайт - пока не вижу его там, ждем

До появления компактных версий и обновок от Kijai 5... 4... 3...

Спасибо @iNevestenko

#image2video #audio2video #referencing #wan22
🔥15👍21😁1
Nano-banana только что релизнули в Gemini 2.5 Flash

Доступно для граждан правильной страны в gemini app и Google AI Studio

Бежим творить у кого есть доступ. Притворитесь что вы в США и ломитесь в студию

Спасибо @iNevestenko

#imageediting #sota
🔥12👍21
Нейронавт | Нейросети в творчестве
WAN тизерит WAN2.2-S2V - кинематографичный генератор видео по звуку Спасибо @iNevestenko #news
Nano-banana еще днем появился в списке моделей редактирования в Krea.ai

На бесплатном тарифе недоступен

В Fal.ai тоже есть

#news
👍4