L'IA audio e voce genera parlato e musica o ripulisce le registrazioni. Podcast, spot e audiolibri richiedono voce chiara e licenze chiare. Qui confronti strumenti IA per voce, trascrizione e musica con prezzi, limiti e fonti.
Piattaforma vocale IA: morphing speech-to-speech, clonazione, text-to-speech e un convertitore vocale in tempo reale per chiamate e giochi.
Accesso gratuitoPiano gratuito3 minuti di morphing online/mese; Token Free discordanti: scheda 10.000, tabella 1.000; Pubblicazione non commerciale con attribuzione; nessun riporto di token
A pagamento daAltered Studio - Creator (annuale) · 30 USD60 minuti di morphing online e 325.000 token IA/mese; token inutilizzati riportati
Studio: clonazione, speech-to-speech, TTS ed editing
Real-Time Pro Call Center: Accent Translation, Voice Skins e Isolate; elaborazione illimitata
Browser-based multitrack DAW con supporto VST3; l'assistente musicale, lo splitter fusto e il cambia voce sono riservati per un tier AI pagato separato.
Accesso gratuitonon pubblicatoProgetti 5, tracce 16, solo MP3, AI demo-only.
A pagamento daPremium · 5.99 USDProgetti 50, tracce e esportazioni illimitate
DAW basato sul browser senza installazione e cloud project storage
AudioPen trasforma note vocali personali in testo strutturato o trascrizione senza riscrittura. Non partecipa alle riunioni e non identifica i parlanti.
Accesso gratuitoPiano gratuito
A pagamento daPrime (3 mesi) · 33 USDRegistrazioni fino a 15 minuti; archiviazione illimitata delle note
Registrazioni fino a 15 minuti; archiviazione illimitata delle note
100 caricamenti audio ogni 4 settimane, massimo 100 MB per file
Auphonic automatizza normalizzazione sonora, livellamento, riduzione di rumore e riverbero, montaggio e pubblicazione podcast. I piani a pagamento aggiungono riconoscimento vocale e note automatiche.
Accesso gratuitoPiano gratuito
A pagamento daRecurring S · 13 USD9 ore/mese; le ore inutilizzate scadono ogni mese
Auphonic automatizza normalizzazione sonora, livellamento, riduzione di rumore e riverbero, montaggio e pubblicazione podcast. I piani a pagamento aggiungono riconoscimento vocale e note automatiche.
Senza jingle; riconoscimento vocale, note automatiche, cartelle monitorate e lotti
Generare musica di sottofondo personalizzata e effetti sonori con il modello Maestro interno; i prezzi correnti non sono raggiungibili sul sito ufficiale.
Accesso gratuitonon pubblicatoNon c'è alcun tier gratuito pubblicamente documentato poiché la pagina dei prezzi è irraggiungibile.
A pagamento dautilizzo · Non verificato per questo mercatoScarica in MP3 o WAV
Maestro Music: modello interno per musica di sottofondo personalizzata
Maestro Effetti Sonori: Effetti AI foley direttamente da una descrizione rapida
Trasforma audio e video in trascrizioni, note, contenuti e output IA.
Accesso gratuitoNessun piano gratuito pubblicatoNessun Free pubblico
A pagamento daHobby · 1930 ore di trascrizione totali (allocazione di libreria); 10 GB; 1 posti; trascrizione multilingue, output IA, Magic Chat e prompt
Tempo di trascrizione come prezzo, non output IA generici
30 ore di trascrizione totali (allocazione di libreria); 10 GB; 1 posti; trascrizione multilingue, output IA, Magic Chat e prompt
Costruire, remix e trasformare le canzoni in video musicali con Veo utilizzando un co-produttore AI costruito su Lyria 3.5; gratuito per iniziare con un account Google.
Accesso gratuitonon pubblicatoCrediti giornalieri gratuiti con un account Google, nessun prezzo dedicato Flow Music.
A pagamento daGoogle AI abbonamento · Non verificato per questo mercatoPiù quota giornaliera tramite Google AI Plus, Pro o Ultra
Co-produttore AI basato su chat che costruisce canzoni con ricca musicalità e voce dinamica in cima a Lyria 3.5
Remixing diretto delle tracce esistenti, con splitting di stelo e effetti audio controllabili in chat
Piattaforma IA per trascrizioni e sottotitoli con registrazione delle riunioni, riconoscimento vocale automatico in oltre 60 lingue, traduzione e revisione umana opzionale.
Accesso gratuitoPiano gratuito
A pagamento daBasic · 8,50 Euro / 17 Euro1.440 AI minuti/anno
Riconoscimento vocale automatico in oltre 60 lingue per trascrizione e sottotitoli
Registratore di riunioni senza bot con trascrizione in tempo reale e durata illimitata
Il modello musicale di Google DeepMind per canzoni complete con voci, accessibile tramite l'API Gemini, Vertex AI o incorporato in Google Flow Music.
Accesso gratuitonon pubblicatoNessun livello gratuito nell'API Gemini; accesso gratuito agli utenti finali solo tramite Google Flow Music con un account Google.
A pagamento daGemini API - Lyria 3 Clip Preview · 0.04 USD30-secondo clip per chiamata
Canzoni completi con voci multilingue, struttura del verso-chorus e lunghezza del brano fino a diversi minuti (Lyria 3.5)
Image-to-music: caricare un'immagine e trasformarla in una traccia corrispondente
Trasformare i testi o un prompt in canzoni complete con voci attraverso gli stili 70+, tra cui le copertine vocali AI; pacchetti di credito aggiuntivi non scadono mai.
Accesso gratuitonon pubblicatoNessun tier permanente indipendente documentato; ingresso tramite il pacchetto starter $9.90 una volta.
A pagamento daBasic · 9.90 USDCrediti 150 al mese, non cumulativo
Strumenti 21 per la creazione di canzoni, cover e testi in un'unica interfaccia
Canzoni da testi o un messaggio di testo in oltre stili musicali 70, compresi mix di stile
Generazione, musica senza royalty come API per applicazioni, giochi e livestream; Registrazione e distribuzione dei contenuti ID sono vietati su ogni livello.
Accesso gratuitonon pubblicatoNessun tier API gratuito; il punto di ingresso più economico è il Trial scontato a $49 / mese.
A pagamento daTrial · 49 USD100 ha generato tracce o minuti di streaming al mese
Generazione basata su BPM, basata su immagini, immagini e attività
WebRTC streaming con latenza subseconda per l'adattamento dal vivo
Generare canzoni, strumenti e discorsi dal testo, una traccia di riferimento, o humming, con la separazione dei fusti e il controllo DAW sul piano Premier.
Accesso gratuitonon pubblicatoLe canzoni 4 al giorno per la coda libera e condivisa.
A pagamento daPro · 10 USD5,000 Oro al mese
Mureka Co controlla un DAW e file locali attraverso il linguaggio naturale (solo Premier)
Stem separazione da qualsiasi canzone esistente fino a tracce 12
Mac-native dictation app che trasforma il discorso in testo direttamente in qualsiasi campo tramite una scorciatoia da tastiera, con l'elaborazione opzionale on-device.
Accesso gratuitoProva gratuita
A pagamento daMonthly · 14,99 $Trascrizioni illimitate
SDK AI on-device per il rilevamento delle parole di sveglia, discorso-to-text, text-to-speech, il riconoscimento dei diffusori e più che funzionano completamente on-device invece di nel cloud; prova gratuita disponibile, uso a pagamento solo su richiesta.
Accesso gratuitoProva gratuita
A pagamento daEnterprise / produzione · su richiestaIl venditore descrive un modello di abbonamento per le imprese tra cui supporto, aggiornamenti, aggiornamenti e monitoraggio dell'utilizzo; la …
SDK on-device per rilevamento wake word, STT, TTS e riconoscimento del parlante
Funziona interamente sul dispositivo senza connessione cloud
Piattaforma di hosting podcast tedesca con distribuzione, analisi e monetizzazione, estesa dal 2024/25 con crediti AI per trascrizione automatica, shownotes e copia sociale.
Piattaforma americana per AI e trascrizione umana, didascalie e traduzione, dal suo rilancio principalmente rivolto a squadre legali e investigative, con trascrizione classica / cattura ancora un'offerta di base.
Accesso gratuitoPiano gratuito
A pagamento daEssentials · 25,49 $ / 29,99 $5.000 AI trascrizione/caption minutes al mese (inglese & spagnolo)
Voce in testo, sottotitoli e traduzione, da IA o persone
Orientato a team legali e investigativi; il captioning classico resta nucleo
Piattaforma indiana di API IA per sintesi vocale, riconoscimento vocale, traduzione, IA documentale e modelli di chat multilingue, incentrata sulle lingue indiane.
Accesso gratuitoPiano gratuito
A pagamento daSarvam · TTS 3,00 Rupien pro 1.000 Zeichen; weitere Preise siehe Anbieter-WebsiteCopre TTS, STT, traduzione, IA documentale, doppiaggio e chat LLM in un’unica API
Text-to-speech (TTS) per le lingue indiane a 3,00 rupie per 1.000 caratteri
Speech-to-text (STT) da 30 rupie all'ora per la trascrizione delle lingue indiane
Produttore di musica AI agente per canzoni, clonazione vocale e separazione del fusto; almeno 1,000 crediti gratuiti, Creator e Pro pricing è attualmente inedito.
Accesso gratuitoQuota gratuita una tantumToken 1,000 su registrazione, non commerciale.
A pagamento daCreator · Non verificato per questo mercatoPer la pagina ufficiale: generazioni illimitate, studio multitrack access, stes export, licenze commerciali
L'assistente di musica agente "Agent One" guida la generazione rapida, la clonazione vocale e l'iterazione nel dialogo
Stem separazione e uno strumento Extend per allungare tracce o loop esistenti
La dittazione potenziata dall'intelligenza artificiale per macOS, Windows e iOS, funziona offline con i modelli Whisper locali e in modo facoltativo con i modelli AI cloud/bring-your-own.
Accesso gratuitoPiano gratuito
A pagamento daPro · 8,49 $Tutto in Gratis
Riconoscimento vocale IA per macOS, Windows e iOS con supporto offline per la privacy
Modalita di dettatura, modalita di trascrizione e creazione di memo IA in un'unica app
DAW basato sul browser con un AI CoProducer che costruisce le canzoni come MIDI modificabile invece di un file audio finito, tra cui la divisione del fusto e l'hosting VST/AU.
Accesso gratuitonon pubblicato5 CoProducer richiede al giorno gratuitamente, senza modelli premium.
A pagamento daPro · 20 USDCrediti 20,000 al mese
AI CoProducer costruisce canzoni strato per strato come MIDI modificabile: batteria, basso, accordi, melodia, effetti
Le tracce audio importate sono divise in gambi reali sulla linea temporale
Ordine alfabetico. Non è una classifica di qualità.
Criteri di confronto
Confrontiamo accesso gratuito, ingresso a pagamento, limiti del piano, funzioni e le fonti ufficiali indicate. I dati senza fonte restano non pubblicati.
Metodologia
Comparono solo voci confermate. Prezzi, piani e limiti vengono dalle pagine ufficiali indicate. Le assenze restano non pubblicate. Gli elenchi dei risultati sono alfabetici per impostazione predefinita e possono passare a Gratuito prima; nessuna opzione è una classifica di qualità. Prevale sempre la pagina del fornitore.
È una classifica?
No. Gli elenchi dei risultati sono alfabetici per impostazione predefinita e possono passare a Gratuito prima. Non assegniamo stelle né un vincitore di test.
Stimate i prezzi mancanti?
No. Le assenze restano non pubblicate. Prevale sempre la pagina attuale del fornitore.
Come ordinate gli strumenti?
Gli elenchi dei risultati sono alfabetici per impostazione predefinita e possono passare a Gratuito prima. Non è una classifica di qualità.