Puntata 139
Puntata 139 — Suno, Udio, musica AI
Livello: ✔️✔️ Doppie Spunte Blu · Capitolo 13 · Creatività multimodale
Trenta secondi per generare una canzone completa, testo compreso. Spotify ha già pubblicato linee guida. Le etichette discografiche fanno causa. La frontiera è confusa, e brucia.
Cos’è cambiato (di nuovo)
Prima del 2023, generare musica con AI era roba da paper accademici. Modelli come Jukebox (OpenAI 2020) producevano clip 4-8 secondi semi-ascoltabili.
Nel 2023-24 sono arrivati Suno e Udio: due servizi che generano brani completi (2-4 minuti) con strumenti, voci e testo, da un prompt testuale.
Quality 2026:
- ✅ Strumentali: indistinguibili da produzioni semi-professionali.
- ✅ Voci cantate: spesso convincenti, con vibrato, dinamica, accenti.
- ✅ Testo che si capisce: discreto-buono (ancora errori di pronuncia su parole rare).
- ⚠️ Stili specifici (jazz complex, classical): meno solidi del pop/rock.
- ⚠️ Coerenza in brani >3 minuti: a volte cade.
Suno vs Udio: confronto rapido
| Suno | Udio | |
|---|---|---|
| Lanciato | 2023 | 2024 |
| Specialità | Versatilità, UI semplice | Qualità audio leggermente superiore |
| Output max | Brani fino a 8 minuti | Brani fino a ~4 min (estendibili) |
| Voci | Buone, ampia varietà | Eccellenti, più espressive |
| Tooling editing | Migliore (sezioni, persona) | Più limitato |
| Lyrics generation | Sì, integrata | Sì, integrata |
| Pricing | $8–$30/mese | $10–$30/mese |
I professionisti spesso usano entrambi: Udio per il “suono”, Suno per il workflow.
Come si compone (workflow base)
Esempio Suno v4 (2026):
- Prompt di stile: “acoustic indie folk italian, malinconico, voce maschile baritono, 90 BPM, chitarra acustica e archi”
- Lyrics: scrivi tu il testo (italiano funziona) o lascia generare a Suno.
- Structure tags opzionali:
[Verse],[Chorus],[Bridge],[Outro]per controllare la struttura. - Genera: 2 varianti, ~30 secondi di attesa.
- Extend se ti piace l’inizio: continua il brano in modo coerente.
- Remix se vuoi variazioni di stile mantenendo la melodia.
Costo per brano: ~1-2 crediti. Piani da $8 a $30/mese coprono uso amatoriale a semi-professionale.
I prompt che funzionano
Tre approcci:
1. Stile + descrittore mood
“dream pop, dreamy, female ethereal voice, 80 BPM, reverbero, atmosfera sognante”
2. Stile + riferimenti
“in the style of italian indie 90s, simile a Battisti period libico” (I riferimenti a artisti specifici funzionano ma sono in zona grigia legale, vedi sotto.)
3. Prompt strutturato con tag
[Verse 1] (acoustic guitar arpeggio, soft)
[Pre-Chorus] (build up)
[Chorus] (full band, drums entrano, voce piena)
[Bridge] (strumentale, archi)
L’approccio strutturato dà risultati più consistenti ma richiede di sapere un minimo di terminologia musicale.
I limiti che ancora si sentono
❌ Specifici nomi di voce (“voce simile a De André”) → genera qualcosa di vagamente simile, non identico. E spesso è bloccato da filtri.
❌ Strumenti rari (theremin, oud, bouzouki) → l’output a volte non corrisponde, ripiega su strumenti più comuni.
❌ Cambi di tempo / metrica complessi → preferisce 4/4 stabile.
❌ Modulazioni armoniche sofisticate (es. brani jazz con riarmonizzazioni continue) → output spesso semplificato.
❌ Testo italiano cantato ancora con qualche pronuncia anglofona occasionale.
L’uso reale: che facciamo con la musica AI
Casi che funzionano:
| Caso d’uso | Verdict |
|---|---|
| Jingle pubblicitari brevi | ⭐⭐⭐⭐⭐ — perfetto per startup, podcast intro |
| Musica di sottofondo per video | ⭐⭐⭐⭐ — alternativa royalty-free imbattibile |
| Musica per giochi indie | ⭐⭐⭐⭐ — ottimo per prototipi e produzioni piccole |
| Brano per cerimonia personale (matrimonio, compleanno) | ⭐⭐⭐⭐⭐ — emotivamente forte, personalizzato |
| Album commerciale | ⭐⭐ — copyright incerto, accettazione pubblica limitata |
| Cover di artisti esistenti | ⭐ — quasi sempre legalmente problematico |
| Hit pop globale | ⭐ — non ancora competitivo con produttori top umani |
Spotify, etichette, copyright: lo stato 2026
Il quadro legale si è mosso ma è ancora non risolto.
Spotify (2024-2025):
- Ha pubblicato linee guida che richiedono dichiarazione se un brano contiene tracce AI.
- Ha rimosso oltre 75M brani AI-generated giudicati “spam” o di bassa qualità (2024).
- Permette pubblicazione di brani AI dichiarati, con royalty piene.
Etichette discografiche (RIAA, IFPI):
- Cause in corso contro Suno e Udio (giugno 2024) per uso non autorizzato di brani protetti nel training.
- Ancora pendenti nel 2026.
Cosa puoi fare oggi:
- ✅ Pubblicare brani Suno/Udio su Spotify come artista AI (DistroKid, TuneCore lo permettono).
- ✅ Usare in video YouTube/TikTok personali (royalty-free per uso non commerciale tipicamente OK).
- ⚠️ Uso commerciale (spot, cinema): leggere attentamente i ToS del servizio.
- ❌ “Cover” di brani esistenti (anche se “trasformative”): zona estremamente rischiosa.
Vedi puntata 142 per il quadro completo dei diritti d’autore.
Le alternative open source
Per chi vuole controllo totale o gira tutto in locale:
| Modello | Note |
|---|---|
| MusicGen (Meta, 2023) | Foundational, gira su GPU consumer |
| AudioCraft (Meta, 2024) | Stack completo, MusicGen + AudioGen + EnCodec |
| Stable Audio Open (Stability, 2024) | Open weights, generazione audio |
| YuE (2024) | Voci cantate open source |
Qualità ancora sotto Suno/Udio, ma in rapida crescita e self-hosted.
TEST pratico (15 minuti)
- Crea account gratis su suno.com (10 brani gratis/giorno).
- Genera 3 brani con prompt diversi:
- A: prompt vago: “una canzone allegra”.
- B: prompt stilistico: “acoustic indie folk italian, mid-tempo, voce maschile”.
- C: prompt strutturato: prompt B + sezioni
[Verse] [Chorus]con lyrics tue.
- Confronta: la C è quasi sempre la migliore. Più informazione → output più focalizzato.
- Domanda etica: useresti uno di questi brani in un tuo video monetizzato? Lo dichiareresti come AI? Discutilo con te stesso onestamente. Il “lato giusto” non è ancora codificato.
Glossario lampo
- BPM (Beats Per Minute): velocità di un brano. 60-90 ballate, 110-130 pop, 140+ dance.
- Structure tags: marcatori come
[Verse][Chorus]che dicono al modello dove sta dentro la struttura del brano. - Stem: la traccia separata di uno strumento (voce isolata, batteria isolata). Suno/Udio offrono stem export nei piani superiori.
- DistroKid/TuneCore: aggregatori che distribuiscono musica indipendente alle piattaforme (Spotify, Apple Music).
Take-away in una riga
Suno e Udio hanno reso un brano completo una commodity da pochi click. Spotify e le etichette stanno ridisegnando le regole in corsa — fino a sentenza, agisci con prudenza, dichiara sempre quando l’output è AI.
➡️ Prossima puntata: Whisper e la rivoluzione silenziosa della trascrizione automatica.