Suno Speech spojuje mluvené vyprávění a hudbu v jedné zvukové stopě

Suno Speech spojuje mluvené vyprávění a hudbu v jedné zvukové stopě

Ondřej Barták
Ondřej Barták
podnikatel a programátor
4. 10. 2026
2 minut čtení · 2 zhlédnutí
Poslechněte si článek
Audio verze článku
Suno Speech spojuje mluvené vyprávění a hudbu v jedné zvukové stopě

Suno zpřístupnilo otevřenou betaverzi Speech, modelu, který z textu vytváří mluvené vyprávění spolu s původním hudebním doprovodem. Obě složky vznikají společně jako jedna souvislá zvuková stopa. Přednes a hudba se tak mohou vzájemně sladit například v pauzách, přechodech nebo při změně intenzity hlasu.

Text, charakter hlasu a hudební směr

Zadání má tři části: text určený k přednesu, popis hlasu a instrukce pro hudební doprovod. Charakter hlasu lze vymezit přízvukem nebo historickým obdobím, ale také tónem a hlasovým rejstříkem. U hudby uživatel popisuje požadovaný žánr, náladu či dramatické vyznění.

Mezi popsané způsoby využití patří dramatizované čtení básní a příběhů nebo osobní zprávy doplněné hudbou. Dalšími náměty jsou hlasové ztvárnění postav a vedené nahrávky, například meditace. U krátkých mediálních výstupů se počítá s použitím tam, kde lze přijmout rozdíly mezi jednotlivými generováními.

Hudba může sledovat pauzy i dramatický přednes

Při společném generování může přestávka v řeči připadnout na hudební přechod a zesílení hlasu se spojit s gradací doprovodu nebo rytmickým akcentem. AlphaSignal v tom vidí možnost omezit následné úpravy povedených krátkých nahrávek, pokud jejich použití nevyžaduje přesné a opakovatelné časování.

Suno tento přístup předvedlo na pasáži z Odyssey převedené do slangu generace Z. Druhá ukázka pojala žádost spolubydlícímu o umytí nádobí jako přednes ve viktoriánské angličtině. V obou firemních demonstracích hudba sledovala tempo řeči a její dramatický průběh.

Přízvuk a časování zatím kolísají

Suno upozorňuje, že výsledky betaverze nejsou vyrovnané. Přízvuk se může během jedné nahrávky posouvat, například od britské výslovnosti směrem k australské. Pauzy mohou trvat déle, než uživatel požadoval, a opakované generování může přinést jiné tempo i interpretaci.

Mezi uváděnými možnostmi betaverze není ovládání přesné délky nahrávky ani časování jednotlivých slov. Speech také neinzeruje řízení umístění hudebních nástupů. V popisu chybí i deterministické opětovné generování a klonování hlasu podle referenční nahrávky.

Přístup v aplikaci Suno pro všechny uživatele

Speech je dostupné všem uživatelům přímo v aplikaci Suno. Širšímu zpřístupnění předcházela měsíční uzavřená beta s menší skupinou uživatelů. Funkce používá stejný pracovní postup jako zdejší generátor písní.

Generování využívá stávající kreditové tarify Suno; samostatný ceník pro Speech nebyl zveřejněn.

Přístup zatím zůstává omezený na aplikaci. Suno neoznámilo API, SDK ani jinou programovou cestu, takže vývojáři nemají oznámený způsob, jak automaticky zadávat scénáře nebo začlenit generování do produkčního procesu.

Reklama

S tvorbou obsahu pomáhá UpTier.

SEO a GEO na autopilota. Multiagentní systémy UpTier píší a optimalizují obsah pro vyhledávače i AI odpovědi.

Objevte UpTier ↗

Kategorie:AI
Líbil se vám tento článek?
Objevte další zajímavé příspěvky na blogu
Zpět na blog

Související články

Ideogram 4.5 přináší přesné úpravy obrázků i překlad nápisůIdeogram 4.5 přináší přesné úpravy obrázků i překlad nápisů
Ideogram vydal model zaměřený na navazující úpravy obrázků. Nabízí práci s referencemi, maskou i výřezem ve vysokém rozlišení a nástroje pro změnu či překlad textu přímo v obrázku.
3 min čtení
4. 10. 2026
Google přesouvá výpočty federovaného učení ze zařízení na serveryGoogle přesouvá výpočty federovaného učení ze zařízení na servery
Google Research představil systém federovaného učení založený na prostředích TEE. Gboard ho už využívá pro předpovídání dalšího slova v angličtině a japonštině; podle Googlu přináší přesnější modely a rychlejší trénování.
3 min čtení
4. 10. 2026
Shopify představilo Canvas: e-shop lze vytvářet přes chat s AIShopify představilo Canvas: e-shop lze vytvářet přes chat s AI
Nový Canvas propojuje tvorbu e-shopu s AI agentem Sidekick. Změny ukazuje v reálném čase a obchodníkům umožňuje zkoušet interaktivní prvky, animace i zobrazení na různých velikostech obrazovky.
1 min čtení
4. 10. 2026
Přihlaste se k odběru našeho newsletteru
Zůstaňte informováni o nejnovějších příspěvcích, exkluzivních nabídkách, a aktualizacích.
CodedTrip

Provozovatel: CodedTrip LLC, USA.

YouTube
TikTok