Recensione di Adobe Firefly: i tre nuovi strumenti audio basati sull'intelligenza artificiale sono validi?

Abbiamo testato i tre nuovi strumenti audio di Adobe Firefly basati sull'intelligenza artificiale. Scoprite quanto sono efficaci e se vale la pena provarli nella vostra azienda.

Le cose più importanti che devi sapere

  • Tra gli strumenti, Generate Music è il "vero vincitore", in grado di produrre brani inizialmente accettabili che migliorano drasticamente utilizzando comandi di testo precisi che definiscono atmosfera, stile, scopo e livello di energia.
  • Lo strumento Genera effetti sonori è molto utile, richiede precisi comandi di testo manuali e consente di aggiungere più tracce audio controllandone la posizione e il livello lungo una timeline.
  • Generate Speech 45 offre agli oratori opzioni di controllo della pausa, utili per i marketer e i creatori di contenuti per velocizzare la produzione video quotidiana, ma non sostituisce il doppiaggio professionale.

  • Adobe lancia tre nuovi strumenti audio Con intelligenza artificiale All'interno di Firefly
  • Ora i creatori possono utilizzare le funzioni Genera musica, Genera parlato e Genera effetti sonori.
  • L'ho testato per vedere come funziona nella creazione di video.

Dopo un periodo di beta testing, Adobe Firefly ha rilasciato tre nuovi strumenti audio basati sull'intelligenza artificiale, che promettono un "suono di qualità professionale" e sono ora disponibili per tutti i creatori. Li ho testati uno per uno per verificare se i risultati fossero all'altezza delle aspettative e, nel complesso, lo sono stati, a parte qualche piccolo problema.

Genera musica, Genera effetti sonori e Genera voce sono le ultime funzionalità audio arrivate sulla piattaforma di intelligenza artificiale di Adobe basata su browser (le loro funzioni sono chiare dai nomi).

Dalla mia esperienza con tutti e tre gli strumenti, Generate Music si distingue nettamente; è di gran lunga migliore di quanto mi aspettassi e credo che i professionisti del marketing e i creatori di contenuti ne trarranno grande beneficio. Puoi provarlo anche tu cliccando qui.

Allora, quali sono le novità?

Tre strumenti basati sull'intelligenza artificiale sono ora a disposizione di tutti. Le loro funzioni sono in gran parte intuitive, ma ecco cosa è importante sapere:

  • Genera musica Consente di creare brani musicali con licenza che si adattano alla durata e all'atmosfera dei video.
  • Genera discorso I testi scritti vengono convertiti in commenti vocali.
  • Genera effetti sonori Genera – come avrete intuito – effetti sonori che si adattano al movimento e al ritmo del video.

Ma è davvero così buono?

Ho già scritto in precedenza del mio scetticismo nei confronti dell'intelligenza artificiale in generale e delle mie preoccupazioni riguardo al suo utilizzo nelle opere creative. Si tratta semplicemente di una simulazione dell'arte.

Tuttavia, gli strumenti di Adobe hanno impressionato persino gli scettici più accaniti sull'IA nel mio team, soprattutto funzionalità come Generative Extend nel suo software di editing video. E io sono una persona di mentalità aperta, quindi ho deciso di provare questi strumenti di persona e vedere come funzionavano davvero.

L'obiettivo, almeno per il momento, è quello di accelerare il flusso di lavoro creativo sia per i professionisti del marketing che per i creatori di contenuti .

Creare musica con l'intelligenza artificiale

Adobe Firefly utilizza tre nuovi strumenti audio basati sull'intelligenza artificiale per generare musica, parlato ed effetti sonori.

Ho iniziato usando lo strumento Genera musica , dove è possibile inserire liberamente comandi di testo o caricare una clip video, e l'IA cercherà di indovinare il tipo di musica desiderata. Ho usato una breve clip di 27 secondi che avevo registrato per la mia recensione di reMarkable Paper Pure (perché era ancora nella mia cartella dei download).

Sulla base di ciò, Firefly ha suggerito un comando di script per "una canzone elettronica calma, profonda e d'atmosfera per la presentazione di un prodotto".

Ho premuto il pulsante Genera e, in pochi secondi (la velocità era davvero sorprendente), mi sono stati presentati quattro brani tra cui scegliere, tutti diversi ma con la stessa atmosfera. Erano... accettabili. Un po' generici, ma potrebbero andare bene in caso di necessità o per portare a termine un progetto velocemente. (Per saperne di più sull'impatto dell'IA sull'industria musicale, leggi il nostro articolo su Apple Music che impone agli artisti di taggare la musica generata dall'IA ).

Ho deciso di aggiungere altri termini al comando dello script, come "jazz" e "cinematic", da utilizzare nel "vlog" e nel "trailer". Ho modificato l'impostazione "Energia" da "bassa" a "media". I risultati sono stati decisamente migliori.

Come per tutti gli strumenti di intelligenza artificiale, più precisi sono i comandi testuali, migliore sarà il risultato. È inoltre possibile descrivere l'atmosfera, lo stile e lo scopo desiderati, qualora si abbia un'idea specifica.

Da qui è possibile scaricare musica e video, oppure solo musica.

Creazione di voci fuori campo generate dall'intelligenza artificiale

Adobe Firefly utilizza tre nuovi strumenti audio basati sull'intelligenza artificiale per generare musica, parlato ed effetti sonori.

Passando allo strumento Genera parlato , ho innanzitutto utilizzato la barra laterale per selezionare il modello di intelligenza artificiale da utilizzare; al momento della stesura di questo testo, erano disponibili il modello Firefly di Adobe, commercialmente sicuro, e il modello Multilingual V2 del partner ElevenLabs.

Ho quindi scelto un oratore da un elenco di 45 opzioni, ognuna delle quali veniva descritta in vari modi come uomo, donna, non binario, giovane, di mezza età, anziano e così via.

Infine, ho incollato il mio testo nel campo di testo; Firefly è in grado di rilevare la lingua che sto utilizzando, ma avete la possibilità di sceglierla voi stessi. Ho utilizzato la poesia "Ozymandias" (con le mie sincere scuse a Shelley).

Quello che mi è piaciuto qui è che, una volta inserito il testo, si può scegliere di aggiungere altro testo o di indicare all'IA di fermarsi in determinati punti.

Per ascoltare l'anteprima audio, ho dovuto selezionare l'intera clip e utilizzare il menu contestuale, dove è anche possibile correggere la pronuncia e regolare il tono della voce.

Con tutto il parlare di velocizzare i flussi di lavoro, questo mi sembra un errore. Basterebbe un pulsante di avvio in fondo allo schermo.

Ho dovuto regolare gli intervalli di pausa per dare respiro al testo e, una volta impostati, ho potuto modificarne la durata cliccando sul pulsante di pausa nella schermata di anteprima. Per qualche ragione, è stata la parola "land" a confondere l'IA, che l'ha pronunciata " lan ".

Creazione di effetti sonori (SFX) basati sull'intelligenza artificiale

Adobe Firefly utilizza tre nuovi strumenti audio basati sull'intelligenza artificiale per generare musica, parlato ed effetti sonori.

Per questo test, ho utilizzato nuovamente un video che avevo girato per la mia recensione di reMarkable: questa volta si trattava di una clip di 12 secondi che confrontava reMarkable 2 e Paper Pure.

Questo processo è molto più complesso, nel senso che l'IA non indovinerà quali sono i possibili effetti sonori (SFX). Ho dovuto descrivere manualmente ciò che volevo. Poi, ho cliccato su "Migliora prompt", che ha aggiunto ulteriori descrizioni.

E così, ci siamo ritrovati con un "fischio scorrevole che scende dolcemente con un debole tintinnio metallico". Cliccando su "Genera" sono apparse rapidamente quattro diverse varianti assordanti. Non vi mostrerò quei risultati. Non sarebbe giusto nei confronti di nessuno.

L'affermazione è stata invece modificata in un più sommesso "fruscio di grilli in un campo" della durata di 12 secondi, per riempire la durata del video.

La grande caratteristica dell'opzione Effetti sonori (SFX) è la possibilità di aggiungere più tracce audio e utilizzare le maniglie per regolarne la posizione.

Grazie alla timeline che scorre nella parte inferiore dello schermo, l'esperienza d'uso è più simile a quella di un vero editor audio (almeno in una certa misura). Trascinando le maniglie del volume è possibile regolare il volume o eliminare una traccia.

Ne vale la pena?

Nel complesso, ci sono alcune modifiche all'interfaccia utente che vorrei vedere implementate per velocizzare il flusso di lavoro di produzione.

Non credo che sostituirà presto sound designer, compositori e musicisti professionisti. Ma, dopo la mia esperienza nel marketing, ne vedo l'utilità per i professionisti del marketing e per la creazione di video in generale.

Il doppiaggio si è evoluto molto dai tempi delle voci robotiche simili a quelle di Microsoft Sam, ma per una resa vocale accurata, niente può eguagliare un doppiatore professionista in studio.

Tuttavia, gli effetti sonori (SFX) offrono un vantaggio di gran lunga maggiore. Attraverso un'ampia gamma di generazioni, non sono riuscito a distinguere tra i suoni generati dall'IA e quelli riprodotti su un vecchio disco di effetti sonori in mio possesso.

La vera caratteristica vincente è la funzione "Genera musica". Già la semplice riproduzione ha prodotto un suono perfettamente adatto a una dimostrazione di prodotto, una recensione, una presentazione aziendale o qualsiasi altro contesto simile. E la qualità è migliorata a ogni generazione effettuata.

Si tratta quindi di un aggiornamento che vale la pena esplorare per chi si occupa di produzioni video dai ritmi serrati.

 

 

I commenti sono chiusi.