Vergleich KI Vergleich KI

Preise, Funktionen und Limits prüfen.

Preisregion
Automatisch
Sprache
DE

Audio & Voice

Audio- und Voice-KI erzeugt Stimmen und Musik oder bereinigt Aufnahmen. Podcasts, Spots und Hörbücher brauchen klare Sprache und Lizenzregeln. Hier vergleichst du KI-Tools für Stimme, Transkription und Musik mit Preisen, Limits und Quellen.

Nach Unterkategorie filtern

Sortieren

ACE Studio

Musikgenerierung

KI-Musikstudio für Gesang aus MIDI und Text, Stimmenklonen, Instrumente, Stem-Trennung sowie Musik und Effekte für Video.

KostenlosKostenloser Plan100 monatliche Credits für registrierte Konten, kein voller kostenloser Desktopzugang.
Bezahlt abArtist Rent-to-own · $16.58160+ lizenzfreie Stimmen und 40+ Instrumente; Gesangs- und Instrumentenerzeugung laut Tarif unbegrenzt
  • Editierbarer KI-Gesang aus MIDI und Text
  • KI-Instrumente und DAW-Anbindung über ACE Bridge

Details Zur Website (öffnet in neuem Tab)

AIVA

Musikgenerierung

KI-Instrumentalmusik erstellen, bearbeiten und mit tarifabhängigen Export- und Nutzungsrechten herunterladen.

KostenlosKostenloser Plan3 Downloads pro Monat, bis 3 Minuten je Titel; nur nicht kommerziell und mit AIVA-Nennung.
Bezahlt abStandard · Für diese Preisregion nicht verifiziert15 Downloads/Monat, bis 5 Minuten je Titel
  • KI-Komposition mit Bearbeitung und MIDI-Export
  • Downloads und Erzeugung getrennt begrenzt

Details Zur Website (öffnet in neuem Tab)

Altered AI

Stimmen & Sprachsynthese

Stimm-KI-Plattform mit Speech-to-Speech-Morphing, Klonen, Text-to-Speech und einem Echtzeit-Stimmwandler für Anrufe und Spiele.

KostenlosKostenloser Plan3 Minuten Online-Morphing/Monat; Free-Token widersprüchlich: Tarifkarte 10.000, Vergleichstabelle 1.000; Nur nichtkommerzielle Veröffentlichung mit Namensnennung; kein Token-Übertrag
Bezahlt abAltered Studio - Creator (jährlich) · 30 USD60 Minuten Online-Morphing und 325.000 AI-Tokens/Monat; ungenutzte Tokens werden übertragen
  • Studio: Klonen, Speech-to-Speech, TTS und Audiobearbeitung
  • Real-Time Pro Call Center: Accent Translation, Voice Skins und Isolate; unbegrenzte Verarbeitung

Details Zur Website (öffnet in neuem Tab)

Amberscript

Audio-Editing & Restaurierung

Automatische Transkription und Untertitel mit optionaler menschlicher Bearbeitung.

KostenlosEinmaliges Gratis-KontingentFür neue Konten: 10 Minuten automatische Transkription/Untertitel ohne Zahlungsdaten
Bezahlt abStarter · Für diese Preisregion nicht verifiziert5 Stunden pro Monat
  • Automatische Transkription und Untertitel in über 90 Sprachen; Online-Editor
  • Über 18 Sprachen; Nachbearbeitung durch Sprachexperten

Details Zur Website (öffnet in neuem Tab)

A

Amped Studio

Musikgenerierung

Browserbasierte Multitrack-DAW mit VST3-Support; Musikassistent, Stem-Splitter und Voice Changer sind einer eigenen bezahlten KI-Stufe vorbehalten.

Kostenlosnicht angegeben5 Projekte, 16 Spuren, nur MP3, KI nur als Demo.
Bezahlt abPremium · 5.99 USD50 Projekte, unbegrenzte Spuren und Exporte
  • Browserbasierte DAW ohne Installation mit Cloud-Projektspeicher
  • VST3-Plugin-Support ab dem Premium-Tarif

Details Zur Website (öffnet in neuem Tab)

Aqua Voice

Stimmen & Sprachsynthese

Cloudbasiertes Sprachdiktat für macOS, Windows und iOS sowie eine separat abgerechnete Avalon-API für Audiodateien.

KostenlosKostenlose Testphase
Bezahlt abPro (monatlich) · 10 USDUnbegrenztes Diktat
  • Cloudbasiertes Sprachdiktat für macOS, Windows und iOS sowie eine separat abgerechnete Avalon-API für Audiodateien.
  • Eigene Anweisungen und erweitertes Wörterbuch

Details Zur Website (öffnet in neuem Tab)

AssemblyAI

Audio-Editing & Restaurierung

Entwicklerplattform für Datei-, Streaming- und Kurzclip-Transkription, Sprachanalyse, LLM-Zugriff und verwaltete Voice Agents.

KostenlosEinmaliges Gratis-Kontingent
Bezahlt abPre-recorded / Universal-2 · 0.15 USD99 Sprachen; Keyterms enthalten
  • Datei-Transkription, Echtzeit-Streaming und Sync API für Kurzclips
  • Kostenlose Startcredits, kein dauerhaft kostenloser unbegrenzter API-Tarif

Details Zur Website (öffnet in neuem Tab)

Async

Audio-Editing & Restaurierung

Browserplattform für Audio- und Videoaufnahmen, Schnitt, KI-Generierung, Untertitel, Stimmen und Teamproduktion.

KostenlosKostenloser PlanGratiszugang. Free-Credits widersprüchlich: 10 unter Monatsüberschrift oder 150 einmalig
Bezahlt abEssentials / 450 / monatlich · 19.99 USD450 Credits pro Monat; monatlicher Reset ohne Übertrag
  • Aufnahmen und Audio-/Videoschnitt direkt im Browser
  • KI-Generierung und Chat-gestützte Bearbeitung mit planabhängigen Credits

Details Zur Website (öffnet in neuem Tab)

AudioPen

Audio-Editing & Restaurierung

AudioPen verwandelt persönliche Sprachnotizen in strukturierten Text oder ein unverändertes Transkript. Es tritt keinen Meetings bei und ordnet keine Sprecher zu.

KostenlosKostenloser Plan
Bezahlt abPrime (3 Monate) · 33 USDAufnahmen bis 15 Minuten; unbegrenzter Notizspeicher
  • Aufnahmen bis 15 Minuten; unbegrenzter Notizspeicher
  • 100 Audio-Datei-Uploads je 4 Wochen, maximal 100 MB pro Datei

Details Zur Website (öffnet in neuem Tab)

Audiostrip

Audio-Editing & Restaurierung

AudioStrip trennt Gesang und Instrumentalspuren, bearbeitet Rauschen und Mastering und bietet eine Tonart- und BPM-Suche.

KostenlosKostenloser Plan
Bezahlt abPremium Plan · 5.99 GBPUnbegrenzte Isolationen, Masterings und Enhancements; bis 200 MB und 20 Minuten je Upload
  • AudioStrip trennt Gesang und Instrumentalspuren, bearbeitet Rauschen und Mastering und bietet eine Tonart- und BPM-Suche.
  • Unbegrenzte Isolationen, Masterings und Enhancements; bis 200 MB und 20 Minuten je Upload

Details Zur Website (öffnet in neuem Tab)

Auphonic

Audio-Editing & Restaurierung

Auphonic automatisiert Lautheitsanpassung, Leveling, Rausch- und Hallreduktion, Schnitt und Podcast-Veröffentlichung. Bezahlte Pläne ergänzen Spracherkennung und automatische Shownotes.

KostenlosKostenloser Plan
Bezahlt abRecurring S · 13 USD9 Stunden/Monat; ungenutzte Stunden verfallen monatlich
  • Auphonic automatisiert Lautheitsanpassung, Leveling, Rausch- und Hallreduktion, Schnitt und Podcast-Veröffentlichung. Bezahlte Pläne ergänzen Spracherkennung und automatische Shownotes.
  • Kein Jingle; Spracherkennung, automatische Shownotes, Watch Folders und Batch-Verarbeitung

Details Zur Website (öffnet in neuem Tab)

B

Beatoven.ai

Musikgenerierung

Individuelle Hintergrundmusik und Sound-Effekte mit dem hauseigenen Maestro-Modell erzeugen; aktuelle Tarifpreise sind auf der offiziellen Seite nicht abrufbar.

Kostenlosnicht angegebenKein öffentlich dokumentierter kostenloser Tarif, da die Preisseite nicht erreichbar ist.
Bezahlt abNutzung · Für diese Preisregion nicht verifiziertDownload in MP3 oder WAV
  • Maestro Music: hauseigenes Modell für individuell beschriebene Hintergrundmusik
  • Maestro Sound Effects: KI-Foley-Effekte direkt aus Promptbeschreibung

Details Zur Website (öffnet in neuem Tab)

Bland AI

Stimmen & Sprachsynthese

Programmierbare KI-Telefonagenten für ein- und ausgehende Anrufe, mit minutenbasierter Abrechnung und separaten Telefoniekosten.

KostenlosEinmaliges Gratis-Kontingent
Bezahlt abStart · 0 USD + 0.14 USD/min0 USD monatliche Grundgebühr; 0.14 USD je verbundener Anrufminute
  • Mit Build und Scale steigen Parallelität und Tageslimits, während der Minutenpreis sinkt. Die Limits sind keine im Grundpreis enthaltenen Freiminuten.
  • 10 gleichzeitige Anrufe; 100 Anrufe pro Tag und 100 pro Stunde

Details Zur Website (öffnet in neuem Tab)

Boomy

Musikgenerierung

KI-Songs erstellen und bearbeiten; bezahlte Downloads kommerziell nutzen und über einen eigenen Distributor veröffentlichen.

KostenlosKostenloser Plan
Bezahlt abCreator · 9.99 USD500 Song-Speicherplätze insgesamt
  • Songs erstellen und mit Basiswerkzeugen bearbeiten
  • 500 Song-Speicherplätze insgesamt

Details Zur Website (öffnet in neuem Tab)

Cartesia

Stimmen & Sprachsynthese

Echtzeit-Text-zu-Sprache, Sprache-zu-Text und verwaltete Voice Agents über eine nutzungsbasierte API.

KostenlosKostenloser Plan20000 Credits/Monat, 1 USD Agentenguthaben; Sonic ~27 Min., Ink ~1h51; TTS 2, STT/Agenten 8/8 parallel
Bezahlt abPro · 5 USD100000 Credits/Monat, 5 USD Agentenguthaben; Sonic ~133 Min., Ink ~9h16; TTS 3, STT/Agenten 12/12 parallel
  • TTS, STT und Managed Voice Agents mit getrennten Verbrauchsarten
  • Zero Data Retention nur für Enterprise-TTS/STT

Details Zur Website (öffnet in neuem Tab)

Castmagic

Audio-Editing & Restaurierung

Audio und Video in Transkripte, Notizen, Inhalte und KI-Ausgaben für Creator-Workflows umwandeln.

KostenlosKein kostenloser Plan ausgewiesenKein Free-Plan öffentlich gelistet
Bezahlt abHobby · 1930 Transkriptionsstunden insgesamt (Library-Gesamtkontingent); 10 GB Speicher; 1 inklusive Sitze; mehrsprachige Transkription, KI-Ausgaben, Magic …
  • Transkriptionszeit als Preisdimension statt pauschaler KI-Outputs
  • 30 Transkriptionsstunden insgesamt (Library-Gesamtkontingent); 10 GB Speicher; 1 inklusive Sitze; mehrsprachige Transkription, KI-Ausgaben, Magic Chat und individuelle Prompts

Details Zur Website (öffnet in neuem Tab)

Cleanvoice

Audio-Editing & Restaurierung

Audio- und Video-Podcasts automatisch von Füllwörtern, Geräuschen, Pausen und Atemgeräuschen bereinigen.

KostenlosKostenlose Testphase
Bezahlt abPay as You Go 5h · $115 Stunden verarbeitetes Audio
  • 30 Minuten kostenlos testen
  • Einmalkredite für 5, 10 oder 30 Stunden

Details Zur Website (öffnet in neuem Tab)

Deepgram

Stimmen & Sprachsynthese

Entwickler-API-Plattform für Speech-to-Text, Text-to-Speech und Voice-Agents mit nutzungsbasierter Abrechnung.

KostenlosKostenloser Plan
Bezahlt abPay As You Go · auf Anfrage200 $ Startguthaben, keine Mindestabnahme
  • Echtzeit-Transkription (Nova-3) mit niedrigster Latenz für Live-Anwendungen
  • Batch-Transkription für aufgezeichnete Audio- und Videodateien

Details Zur Website (öffnet in neuem Tab)

ElevenLabs

Stimmen & Sprachsynthese

Sprache, Voiceovers, Dubbing und Voice Agents mit synthetischen Stimmen erzeugen.

KostenlosKostenloser Plan10.000 Credits/Monat; Preistabelle nennt ungefähr 10 TTS-Minuten in der Oberfläche.
Bezahlt abStarter · $6 / $530.000 Credits
  • Text-zu-Sprache (TTS) mit expressiven Stimmen in 70+ Sprachen ueber Web und API
  • Instant Voice Cloning und Professional Voice Cloning aus kurzen Audioaufnahmen

Details Zur Website. Werbelink: Wir erhalten bei einem Abschluss eine Provision. Für dich ändert sich der Preis nicht. (öffnet in neuem Tab)

Fish Audio

Stimmen & Sprachsynthese

KI-Plattform für Text-to-Speech und Stimmenklonen (inkl. Speech-to-Text und Voice Changer), positioniert als preisgünstigere Alternative zu ElevenLabs.

KostenlosKostenloser Plan
Bezahlt abPlus · 15 $250.000 Credits/Monat; bis zu 200 Generierungsminuten; unbegrenzte öffentliche und 10 private Voice-Slots
  • Text-zu-Sprache und Voice-Tools
  • Voice-Funktionen laut Produktangebot

Details Zur Website (öffnet in neuem Tab)

G

Google Flow Music

Musikgenerierung

Mit einem KI-Co-Producer Songs auf Basis von Lyria 3.5 erstellen, remixen und als Musikvideo mit Veo veröffentlichen; kostenlos startbar mit Google-Konto.

Kostenlosnicht angegebenTägliche Credits kostenlos mit Google-Konto, kein eigener Flow-Music-Preis.
Bezahlt abGoogle-KI-Abo · Für diese Preisregion nicht verifiziertmehr tägliches Kontingent über Google AI Plus, Pro oder Ultra
  • Chat-basierter KI-Co-Producer, der Songs mit reichhaltiger Musikalität und dynamischem Gesang auf Basis von Lyria 3.5 erstellt
  • Direktes Remixen bestehender Tracks, Stem-Trennung und Audioeffekte im Chat steuerbar

Details Zur Website (öffnet in neuem Tab)

HappyScribe

Audio-Editing & Restaurierung

KI-Transkriptions- und Untertitel-Plattform mit Meeting-Recorder, automatischer Spracherkennung in über 60 Sprachen, Übersetzung und optionalem menschlichem Korrektorat.

KostenlosKostenloser Plan
Bezahlt abBasic · 8,50 Euro / 17 Euro1.440 KI-Minuten/Jahr
  • Automatische Spracherkennung in ueber 60 Sprachen fuer Transkription und Untertitel
  • Botfreier Meeting-Recorder mit Echtzeit-Transkription und unbegrenzter Aufnahmedauer

Details Zur Website (öffnet in neuem Tab)

Kits.ai

Stimmen & Sprachsynthese

Gesangsstimmen konvertieren und klonen.

KostenlosKostenloser Plan15 Konvertierungsminuten, aber 0 Downloadminuten.
Bezahlt abStarter · $10unbegrenzte Konvertierungen unter Fair Use
  • Gesangsstimmen konvertieren (Voice Conversion)
  • Eigene Stimmen fuer Gesangsproduktion klonen

Details Zur Website (öffnet in neuem Tab)

Krisp

Audio-Editing & Restaurierung

Meetings transkribieren, Geräusche entfernen und Akzente umwandeln.

KostenlosKostenlose Testphase7 Tage alle Premium-Hauptfunktionen ohne Kreditkarte.
Bezahlt abCore · $16 / $8Notetaker, Transkription, Audio/Video-Recording und AI-Notizen unbegrenzt
  • Botfreie Meeting-Mitschrift und -Zusammenfassung ohne Konferenztool-Bot im Anruf
  • Geraeusch- und Echoentfernung fuer Mikrofon und Lautsprecher ohne Internetverbindung noetig

Details Zur Website (öffnet in neuem Tab)

LALAL.AI

Audio-Editing & Restaurierung

Vocals, Instrumente und Geräusche aus Audio oder Video trennen.

KostenlosEinmaliges Gratis-Kontingent10 Relaxed-Minuten zum Testen; keine Downloads.
Bezahlt abLite · $9090 Fast-Minuten/Monat
  • KI-Stem-Separation fuer Vocals, Drums, Bass, Piano, Gitarren und weitere Quellen
  • VST-Plugin fuer lokale Verarbeitung direkt in der DAW (Digital Audio Workstation)

Details Zur Website (öffnet in neuem Tab)

L

Loudly

Musikgenerierung

Royalty-freie Songs mit den Modellen VEGA und MANTA erzeugen und über die eigene Distribution auf mehr als 50 Plattformen veröffentlichen.

Kostenlosnicht angegebenNur 0,5-Minuten-Vorschauen, 1 Download pro Tag, nicht kommerziell.
Bezahlt abPersonal · 10 USDrund 2.500 Credits pro Monat
  • Zwei Generierungsmodelle: VEGA für schnelle Entwürfe, MANTA für veröffentlichungsreife Tracks
  • songDNA analysiert das Audioprofil eines generierten Tracks

Details Zur Website (öffnet in neuem Tab)

L

Lyria

Musikgenerierung

Google DeepMinds Musikmodell für Songs mit Gesang, per Gemini API, Vertex AI oder eingebettet in Google Flow Music.

Kostenlosnicht angegebenKein Free-Kontingent in der Gemini API; kostenloser Endnutzerzugang nur über Google Flow Music mit Google-Konto.
Bezahlt abGemini API - Lyria 3 Clip Preview · 0.04 USD30-Sekunden-Clip pro Aufruf
  • Volle Songs mit mehrsprachigem Gesang, Strophen-Refrain-Struktur und Songdauer bis zu mehreren Minuten (Lyria 3.5)
  • Bild-zu-Musik: ein Bild hochladen und in einen passenden Track umwandeln lassen

Details Zur Website (öffnet in neuem Tab)

M

MelodyCraft

Musikgenerierung

Aus Liedtext oder Prompt komplette Songs mit Gesang in über 70 Stilen erzeugen, inklusive KI-Voice-Covers; Zusatz-Credits verfallen nicht.

Kostenlosnicht angegebenKein eigener kostenloser Dauertarif dokumentiert; Einstieg über das einmalige 9,90-$-Starter-Pack.
Bezahlt abBasic · 9.90 USD150 Credits pro Monat, nicht kumulierend
  • 21 Werkzeuge für Song-, Cover- und Liedtexterstellung in einer Oberfläche
  • Songs aus Liedtext oder Textprompt in über 70 Musikstilen, auch Stilmischungen

Details Zur Website (öffnet in neuem Tab)

M

Mubert

Musikgenerierung

Generative, royalty-freie Musik als API für Apps, Spiele und Livestreams; Content-ID-Anmeldung und Streaming-Vertrieb sind auf jedem Tarif verboten.

Kostenlosnicht angegebenKein kostenloser API-Tarif; günstigster Einstieg ist der reduzierte Trial für 49 $/Monat.
Bezahlt abTrial · 49 USD100 generierte Tracks bzw. Streaming-Minuten pro Monat
  • Text-zu-Musik, Bild-zu-Musik, BPM-basierte und aktivitätsbasierte Generierung
  • WebRTC-Streaming mit Latenz unter einer Sekunde für Live-Anpassung

Details Zur Website (öffnet in neuem Tab)

M

Mureka

Musikgenerierung

Songs, Instrumentals und Speech aus Text, Referenztrack oder Gesang erzeugen, mit Stem-Trennung und DAW-Steuerung im Premier-Tarif.

Kostenlosnicht angegeben4 Songs pro Tag kostenlos, geteilte Warteschlange.
Bezahlt abPro · 10 USD5.000 Gold pro Monat
  • Mureka Co steuert eine DAW und lokale Dateien per natürlicher Sprache (nur Premier)
  • Stem-Trennung aus jedem bestehenden Song in bis zu 12 Spuren

Details Zur Website (öffnet in neuem Tab)

Murf AI

Stimmen & Sprachsynthese

Voiceovers mit vielen Stimmen, Sprachen und Studio-Editor erzeugen.

KostenlosEinmaliges Gratis-Kontingent10 Minuten Voice Generation einmalig; keine Downloads.
Bezahlt abCreator (Jahreszahlung) · $192 Stunden Voice Generation je Monatsplan oder 24 Stunden/Jahr
  • Skriptbasierte Voiceovers im Studio; Murf Dub als separates Angebot
  • Steuerung von Tempo, Tonhöhe, Pausen, Aussprache und Betonung im Skript

Details Zur Website. Werbelink: Wir erhalten bei einem Abschluss eine Provision. Für dich ändert sich der Preis nicht. (öffnet in neuem Tab)

M

Musely

Musikgenerierung

Songs, Videos und Bilder aus einem gemeinsamen Credit-Guthaben erzeugen, mit getrennten Reglern für Liedtext, Genre, Stimmung und BPM.

KostenlosEinmaliges Gratis-Kontingent10 einmalige Credits, keine Auffrischung, nur persönliche Nutzung.
Bezahlt abBasic · 19.90 USD500 Credits pro Monat
  • Getrennte Regler für Liedtext, Genre, Stimmung, BPM und Stimmgeschlecht statt eines Sammelprompts
  • Ein Credit-Guthaben deckt Musik-, Video- und Bildgenerierung gemeinsam ab

Details Zur Website (öffnet in neuem Tab)

M

Musicfy

Musikgenerierung

Eigene oder geklonte Stimmen in AI-Covers und Songs verwandeln; kommerzielle Lizenz erst ab Professional.

Kostenlosnicht angegebenKostenloser Einstieg ohne eigenes Voice Cloning; Kontingent auf offizieller Seite nicht einheitlich dokumentiert.
Bezahlt abStarter · 8 USD150 Songs pro Monat
  • Über 100.000 vorgefertigte KI-Stimmmodelle nach Genre und Charakter
  • Eigenes Voice Cloning aus hochgeladenem Audio, bis zu 30 Modelle im Studio-Tarif

Details Zur Website (öffnet in neuem Tab)

ParaSpeech

Stimmen & Sprachsynthese

Mac-native Diktier-App, die gesprochene Sprache per Tastenkuerzel direkt in beliebige Textfelder ueberfuehrt, mit optionaler On-Device-Verarbeitung.

KostenlosKostenlose Testphase
Bezahlt abMonthly · 14,99 $Unbegrenzte Transkriptionen
  • Gesprochene Nachrichten und Notizen in Text umwandeln
  • Mac und iPhone, Zugriff auf mehreren eigenen Geräten

Details Zur Website (öffnet in neuem Tab)

Picovoice

Stimmen & Sprachsynthese

On-Device-KI-SDKs für Wake-Word-Erkennung, Sprache-zu-Text, Text-zu-Sprache, Sprechererkennung und mehr, die vollständig lokal auf Geraeten laufen statt in der Cloud; kostenloser Test, bezahlte Nutzung nur auf Anfrage.

KostenlosKostenlose Testphase
Bezahlt abEnterprise / Production · auf AnfrageAnbieter beschreibt ein Subscription-Modell für Unternehmen mit Support, Updates, Upgrades und Nutzungs-Tracking; konkrete Preise nennt die …
  • On-Device-SDKs fuer Wake-Word-Erkennung, Sprache-zu-Text, Text-zu-Sprache und Sprechererkennung
  • Laeuft vollstaendig lokal auf Geraeten ohne Cloud-Verbindung

Details Zur Website (öffnet in neuem Tab)

Podigee

Audio-Editing & Restaurierung

Podcast-Hosting-Plattform aus Deutschland mit Distribution, Analytics und Monetarisierung, seit 2024/25 ergänzt um KI-Credits für automatische Transkription, Shownotes und Social-Media-Texte.

KostenlosKostenloser Plan
Bezahlt abStarter · 19 € / 210 €1 Podcast, unbegrenztes Audio
  • Podcast-Hosting mit automatischer KI-Transkription in ueber 30 Sprachen
  • Kapitelmarkierungen und automatische Shownote-Generierung per KI

Details Zur Website (öffnet in neuem Tab)

Resemble AI

Deepfake-Erkennung & Authentizität

Deepfakes in Audio, Bild und Video erkennen, Identitäten absichern und Medien wasserzeichnen.

KostenlosKostenloser Plan0 $ Grundgebühr; Credits kaufen, kein Ablauf; 1 Sitz.
Bezahlt abTeam · $350 / $2805 Sitze
  • Deepfake-Erkennung fuer Audio, Bilder und Video
  • C2PA-Wasserzeichnung und Identitaetsschutz

Details Zur Website (öffnet in neuem Tab)

Rev

Audio-Editing & Restaurierung

US-Plattform für KI- und Human-Transkription, Untertitel und Übersetzung, seit dem Relaunch primaer auf Justiz- und Ermittlungsteams zugeschnitten, mit klassischer Transkription/Captioning weiterhin als Kernangebot.

KostenlosKostenloser Plan
Bezahlt abEssentials · 25,49 $ / 29,99 $5.000 KI-Transkriptions-/Untertitelminuten je Sitz und Monat (Englisch & Spanisch)
  • Sprache in Text, Untertitel und Übersetzungen, per KI oder Mensch
  • Ausrichtung auf Justiz- und Ermittlungsteams; klassisches Captioning bleibt Kern

Details Zur Website (öffnet in neuem Tab)

Sarvam

Stimmen & Sprachsynthese

Indische KI-API-Plattform für Text-zu-Sprache, Spracherkennung, Übersetzung, Dokument-KI und mehrsprachige Chat-Modelle mit Schwerpunkt auf indischen Sprachen.

KostenlosKostenloser Plan
Bezahlt abSarvam · TTS 3,00 Rupien pro 1.000 Zeichen; weitere Preise siehe Anbieter-WebsiteDeckt TTS, STT, Übersetzung, Dokument-KI, Dubbing und LLM-Chat über eine API ab
  • Text-to-Speech (TTS) fuer indische Sprachen zu 3,00 Rupien pro 1.000 Zeichen
  • Speech-to-Text (STT) ab 30 Rupien pro Stunde fuer Transkription indischer Sprachen

Details Zur Website (öffnet in neuem Tab)

Smallest.ai

Stimmen & Sprachsynthese

Voice-AI-Plattform mit latenzarmer Text-to-Speech-API (unter 100 ms), Speech-to-Text und Sprachagenten für Unternehmen.

KostenlosKostenloser Plan
Bezahlt abEnterprise · auf Anfrage99,99 % SLA, On-Premise, SSO, SOC2/HIPAA
  • Text-to-Speech-API mit Latenz unter 100 Millisekunden fuer Echtzeit-Sprachanwendungen
  • Speech-to-Text-Transkription fuer Gespraeche und Aufnahmen

Details Zur Website (öffnet in neuem Tab)

Soundful

Musikgenerierung

Instrumentaltracks und Loops generieren, herunterladen und je Tarif lizenzieren.

KostenlosKostenloser PlanUnbegrenzte Generierung, 1 MP3-Download/Monat, persönliche Lizenz und Attribution.
Bezahlt abPlus · 9,99 $ pro Monat bei monatlicher Zahlung, 4,99 $ pro Monat bei jährlicher Zahlungunbegrenzte Generierungen
  • Instrumentaltracks und Loop-Pakete in verschiedenen Genres mit einem Klick generieren
  • Jeder generierte Track ist einzigartig und fuer kommerzielle Nutzung lizenziert

Details Zur Website (öffnet in neuem Tab)

SOUNDRAW

Musikgenerierung

Instrumentalmusik für Content oder eigene Releases erzeugen und lizenzieren.

KostenlosKostenloser PlanErzeugen und Vorschau möglich; kein lizenzierter Dateidownload ohne Abo.
Bezahlt abCreator · 5,83 € pro Monat bei Jahreszahlungunbegrenzte Trackdownloads/Monat
  • Instrumentale Musik in individueller Laenge und Stimmung generieren
  • Tempoweiser Remix und Arrangement direkt im Editor

Details Zur Website (öffnet in neuem Tab)

S

Soundverse

Musikgenerierung

Agentischer KI-Musikproduzent für Songs, Voice Cloning und Stem-Trennung; mindestens 1.000 Credits kostenlos, Preise für Creator und Pro sind aktuell nicht veröffentlicht.

KostenlosEinmaliges Gratis-Kontingent1.000 Tokens bei Registrierung, nicht kommerziell.
Bezahlt abCreator · Für diese Preisregion nicht verifiziertlaut offizieller Seite: unbegrenzte Generierungen, Studio-Multitrack-Zugriff, Stem-Export, kommerzielle Lizenz
  • Agentischer Musikassistent „Agent One" führt Prompt-zu-Song-Erzeugung, Voice Cloning und Iteration im Dialog
  • Stem-Trennung und ein Extend-Werkzeug zum Verlängern bestehender Tracks oder Loops

Details Zur Website (öffnet in neuem Tab)

Speechify Studio

Stimmen & Sprachsynthese

Voiceover, Dubbing und Avatare mit einem gemeinsamen Creditkonto.

KostenlosKostenloser Plan600 Credits = 10 Minuten Voiceover; keine kommerziellen Rechte oder Downloads.
Bezahlt abStudio Starter · $10086.400 Credits
  • Voiceover, Dubbing und Avatar-Generierung mit einem gemeinsamen Credit-Konto verwalten
  • Ueber 200 KI-Stimmen und Klonstimmen in 50+ Sprachen mit emotionalem Ausdruck

Details Zur Website (öffnet in neuem Tab)

S

Stable Audio

Musikgenerierung

Musik und Sound-Effekte mit Stable Audio 3.0 erzeugen, per Web-App, DAW-Plugin oder API, mit Audio-zu-Audio-Bearbeitung und Stem-Export.

KostenlosKein kostenloser Plan ausgewiesenKein kostenloser Tarif; günstigster Einstieg ist Solo für 12 $/Monat.
Bezahlt abSolo · 12 USD660 Credits pro Monat
  • Stable Audio 3.0 (Mai 2026) mit vollständig lizenzierten Trainingsdaten für kommerziell sichere Nutzung
  • Web-App mit konversationeller Steuerung, Audio-zu-Audio-Bearbeitung und Inpainting

Details Zur Website (öffnet in neuem Tab)

Suno

Musikgenerierung

Vollständige Songs mit Gesang, Instrumenten und Lyrics aus Textvorgaben erzeugen.

KostenlosKostenloser Plan50 Credits täglich; laut Preisseite bis zu 10 Songs, ohne kommerzielle Nutzung.
Bezahlt abPro · $10 / $82.500 Credits/Mo (bis 500 Songs)
  • Komplette Songs mit Gesang und Instrumenten aus Textprompt generieren
  • Custom Mode: eigene Liedtext-Eingabe und Stil-Tags für Musikgenre

Details Zur Website (öffnet in neuem Tab)

Superwhisper

Stimmen & Sprachsynthese

KI-gestützte Spracherkennung für macOS, Windows und iOS, funktioniert offline mit lokalen Whisper-Modellen und optional mit Cloud-/eigenen KI-Modellen.

KostenlosKostenloser Plan
Bezahlt abPro · 8,49 $Alles aus Free
  • KI-Spracherkennung fuer macOS, Windows und iOS mit Offline-Unterstuetzung fuer Datenschutz
  • Diktiermodus, Transkriptions-Modus und KI-Memo-Erstellung in einer App

Details Zur Website (öffnet in neuem Tab)

T

Treblo

Musikgenerierung

Kostenlose Songs mit Advanced Mode für Liedtext, Stil und Länge erzeugen; nur die Entwickler-API kostet nach Credits.

Kostenlosnicht angegebenConsumer-App unbegrenzt kostenlos ohne Wasserzeichen; nur die API ist kostenpflichtig.
Bezahlt abAPI Starter · 11 USD20.000 Credits pro Monat, rund 200 Songs
  • Advanced Mode mit Style-Strength-Regler, Rhythmus-Hilfe, Längensteuerung und freier Lyrics-/Tag-Eingabe
  • Consumer-App unbegrenzt kostenlos, ohne Wasserzeichen, mit vollen kommerziellen Rechten am Output

Details Zur Website (öffnet in neuem Tab)

Udio

Musikgenerierung

Songs generieren, erweitern und bearbeiten.

KostenlosKostenloser Plan10 tägliche plus 100 monatliche Credits; max. drei lange Songs pro Tag.
Bezahlt abStandard · 10 $ / Mo2.400 Credits/Monat
  • Song-Generierung aus Text mit Extend-, Remix- und Inpaint-Funktionen
  • 32-Sekunden-Song kostet 1 Credit; 130-Sekunden-Song kostet 2 Credits

Details Zur Website (öffnet in neuem Tab)

Vapi

Stimmen & Sprachsynthese

Entwicklerplattform zum Erstellen und Betreiben von Voice-AI-Agenten (Telefon-Bots) für Kundengespräche, Terminvereinbarung und Support.

KostenlosKostenloser Plan
Bezahlt abScale · auf AnfrageVolumenbasierte Minutenpreise, SOC 2, HIPAA, PCI, SSO
  • Pay-as-you-go-Gesprächsminuten ab 0,05 Dollar pro Minute
  • 10 gleichzeitige Anrufe ohne Aufpreis im Build-Plan

Details Zur Website (öffnet in neuem Tab)

V

Veena

Musikgenerierung

Browserbasierte DAW mit KI-CoProducer, der Songs als editierbares MIDI statt fertiger Audiodatei aufbaut, inklusive Stem-Trennung und VST/AU-Hosting.

Kostenlosnicht angegeben5 CoProducer-Anfragen pro Tag kostenlos, ohne Premium-Modelle.
Bezahlt abPro · 20 USD20.000 Credits pro Monat
  • KI-CoProducer baut Songs Schicht für Schicht als editierbares MIDI auf: Drums, Bass, Akkorde, Melodie, Effekte
  • Importierte Audiospuren werden in echte Stems auf der Timeline zerlegt

Details Zur Website (öffnet in neuem Tab)

Voice.ai

Stimmen & Sprachsynthese

TTS, Voice Agents und Audiowerkzeuge.

KostenlosKostenloser Plan5.000 Credits: 5 Minuten TTS oder 3 Audiowerkzeug-Nutzungen.
Bezahlt abStarter · $5 / $4.1715.000 Credits/Monat
  • Text-to-Speech und Voice-Agents in einem gemeinsamen Credit-System
  • Instant Voice Cloning ab Starter-Plan

Details Zur Website (öffnet in neuem Tab)

Wispr Flow

Stimmen & Sprachsynthese

Systemweite KI-Diktier-App, die gesprochene Sprache in jeder Anwendung auf Mac, Windows, iOS und Android in druckreifen Text verwandelt.

KostenlosKostenloser Plan
Bezahlt abPro · 12 € pro Monat bei jährlicher Zahlung (15 € bei monatlicher Zahlung)Unbegrenzte Diktate
  • Systemweites KI-Diktat in jeder App auf Mac, Windows, iOS und Android
  • Unbegrenzte Diktate mit erweiterten KI-Modellen ab Pro

Details Zur Website (öffnet in neuem Tab)

Alphabetische Reihenfolge. Das ist keine Qualitätsrangliste.

Vergleichskriterien

Wir vergleichen kostenlosen Zugang, bezahlten Einstieg, Planlimits, Funktionen und die genannten offiziellen Quellen. Unbelegte Angaben bleiben als nicht angegeben markiert.

Methodik

Nur bestätigte Einträge erscheinen im Katalog. Preise, Pläne und Limits kommen aus genannten offiziellen Anbieterseiten. Fehlt eine Angabe, bleibt sie als nicht angegeben markiert. Ergebnislisten sind standardmäßig alphabetisch und lassen sich auf Kostenlos zuerst umstellen; beides ist keine Qualitätswertung. Maßgeblich ist immer die Anbieterseite.

Ist das eine Rangliste?

Nein. Ergebnislisten sind standardmäßig alphabetisch und lassen sich auf Kostenlos zuerst umstellen. Wir vergeben keine Sterne und keinen Testsieger.

Schätzt ihr fehlende Preise?

Nein. Fehlende Angaben bleiben als nicht angegeben markiert. Maßgeblich ist immer die aktuelle Anbieterseite.

Wie sortiert ihr die Tools?

Ergebnislisten sind standardmäßig alphabetisch und lassen sich auf Kostenlos zuerst umstellen. Das ist keine Qualitätsrangliste.