




Die KI-Stimmklon-Technologie nutzt ausgefeilte Algorithmen, um eine digitale Kopie der Stimme einer Person zu erstellen. Anhand dieses neu erstellten Stimmabdrucks lassen sich die Sprache sowie ihre Feinheiten, Klangfarben und Stimmungen in verschiedenen Medien reproduzieren. Handelt es sich um die Stimme einer anderen Person, ist eine eindeutige Einwilligung unerlässlich, insbesondere bei kommerzieller Nutzung, die eine ausdrückliche Genehmigung und die Einhaltung gesetzlicher Vorschriften erfordert. Trotz zahlreicher Veränderungen bei der Umwandlung von menschlicher Sprache in synthetische Ausgabe können sich auch Hintergrundgeräusche verändern.
Das Klonen von Stimmen ist legal, wenn es mit der vollen Zustimmung des Eigentümers der Stimme erfolgt. Die Rechtmäßigkeit des Klonens von Stimmen hängt von der Beachtung des Urheberrechts und des Schutzes der Privatsphäre ab, und es ist zwingend erforderlich, dass die Technologie auf ethische Weise und im Einklang mit dem Gesetz eingesetzt wird.
Die heutigen, auf KI basierenden Technologien zur Stimmklonung sind äußerst präzise. Die erzeugten Klone lassen sich kaum von der Originalstimme unterscheiden. Die Qualität der geklonten Stimme hängt zu einem großen Teil davon ab, wie gut das für das Training verwendete Ausgangsmaterial ist, welche Audiosegmente für die Extraktion ausgewählt werden und wie hoch die Gesamtqualität dieses Materials ist. Bei der professionellen Stimmklonung liefern klarere Quellaufnahmen in der Regel eine bessere Klangtreue.
Die Dauer, die zum Klonen einer Stimme benötigt wird, hängt vom Klonverfahren, von der Komplexität der Merkmale sowie von der Qualität und Länge der als Vorlage dienenden Sprachprobe ab. In der Regel dauert der Vorgang nur 3–4 Sekunden.
Durch das Training mit mehrsprachigen Sprachdaten kann eine geklonte Stimme 32 verschiedene Sprachen sprechen. Diese Funktion ist besonders nützlich für internationale Anwendungen, bei denen die Kommunikation zwischen verschiedenen Sprachgruppen erforderlich ist.
Die Stimmklonierung unterstützt derzeit 32 Basisstimmmodelle, jeweils eines pro Sprache aus der folgenden Liste: Englisch, Arabisch, Bulgarisch, Chinesisch, Kroatisch, Tschechisch, Dänisch, Niederländisch, Philippinisch, Finnisch, Französisch, Deutsch, Griechisch, Hindi, Ungarisch, Indonesisch, Italienisch, Japanisch, Koreanisch, Malaiisch, Norwegisch (Bokmål), Polnisch, Portugiesisch, Rumänisch, Russisch, Slowakisch, Spanisch, Schwedisch, Tamil, Türkisch, Ukrainisch und Vietnamesisch.
Jedes Modell deckt zudem alle regionalen Sprachvarianten dieser Sprache ab; so umfasst beispielsweise Arabisch die Vereinigten Arabischen Emirate, Bahrain, Algerien, Ägypten, den Irak, Jordanien, Kuwait, den Libanon, Libyen, Marokko, Oman, Katar, Saudi-Arabien, Syrien, Tunesien und den Jemen, Englisch deckt die USA, Australien, Kanada, Großbritannien, Hongkong, Irland, Indien, Kenia, Nigeria, Neuseeland, die Philippinen, Singapur, Tansania und Südafrika ab, Spanisch deckt Spanien und ganz Lateinamerika ab und Portugiesisch deckt Brasilien und Portugal ab – insgesamt über 60 Sprachvarianten. Wenn Sie in eine Sprachversion übersetzen, die sich ein Basismodell mit einer anderen Region teilt – zum Beispiel britisches Englisch oder europäisches Portugiesisch –, richtet sich der Text nach der Rechtschreibung und Grammatik dieser Region, während die geklonte Stimme selbst den Akzent des Basismodells beibehält (US-Englisch, brasilianisches Portugiesisch usw.).
Nein. Das Klonen der Stimme erfolgt automatisch während der Synchronisation. Sie laden Ihr Video hoch, wählen eine Zielsprache aus und wählen „Stimmklonung“ als Sprachoption. Rask den Stimmabdruck anhand des bereits in Ihrem Quellvideo enthaltenen Audios – es ist kein separater Aufnahmeschritt erforderlich.
Ja. In den Spracheinstellungen stehen Ihnen zwei unabhängige Regler zur Verfügung: „Ausdrucksstärke“ und „Ähnlichkeit & Akzent“. Erhöhen Sie den Wert für „Ausdrucksstärke“, um eine emotionalere, abwechslungsreichere Sprachausgabe zu erhalten, oder verringern Sie ihn für eine gleichmäßigere, konsistentere Wiedergabe. Der Regler „Ähnlichkeit & Akzent“ steuert, wie stark die Ausgabe der Identität und dem Akzent des ursprünglichen Sprechers entspricht. Sie können diesen Wert also verringern, wenn Sie möchten, dass der emotionale Ton beibehalten wird, ohne dass die Stimme als die einer bestimmten Person erkennbar ist.
Nicht ganz. Bei der KI-Synchronisation handelt es sich um die Technologie und den Prozess der Erzeugung übersetzter Sprache, die mit den Originalszenen und Zeitcodes synchronisiert ist, sodass die neue Tonaufnahme Bild für Bild mit den Lippenbewegungen, Pausen und dem Sprechtempo des Schauspielers übereinstimmt. Dabei kann eine neutrale synthetische Stimme verwendet werden, für die keine Einwilligung erforderlich ist, da in der Ausgabe keine bestimmte reale Person erkennbar ist. Im Gegensatz dazu reproduziert das Stimmklonen die tatsächliche Stimme einer bestimmten Person – und in den meisten Rechtsordnungen genießt die Stimme einer Person denselben rechtlichen Schutz wie ihr Bildnis oder ihre Unterschrift, sodass man vor dem Klonen und der Veröffentlichung die Zustimmung des Stimminhabers benötigt.
Ja. Manche Teams müssen den Tonfall und das Sprechtempo einer Darbietung in eine andere Sprache übertragen, ohne dass die Stimme einer bestimmten Person zugeordnet werden kann – beispielsweise wenn biometrisches Stimmklonen nicht zulässig ist. Indem man die Ähnlichkeit und den Akzent verringert und gleichzeitig die Ausdruckskraft auf einem natürlichen Niveau hält, erhält man eine emotional originalgetreue Synchronisation, ohne die Identität des ursprünglichen Sprechers zu übertragen.
Technisch gesehen lässt sich zwar mit Hilfe von Technologie eine Vielzahl von Stimmen klonen, doch die Nutzung einer KI-Plattform zum Klonen von Stimmen, um die Stimme einer anderen Person zu kopieren, erfordert eine Genehmigung. Die Zustimmung des Inhabers der Stimme ist unerlässlich, und die Nutzung eines KI-Tools zum Klonen von Stimmen, um die Identität einer anderen Person ohne deren Einwilligung zu klonen, kann rechtliche Konsequenzen nach sich ziehen.
Ja. Anstatt zu klonen, können Sie für Ihre Synchronisation aus der Bibliothek mit voreingestellten Stimmen Rask wählen. Das ist nützlich, wenn Sie projektübergreifend eine einheitliche Stimme wünschen, ohne jedes Mal eine Quellaufnahme erstellen zu müssen.
Das Klonen von Stimmen kann das Nutzererlebnis erheblich personalisieren, indem es ermöglicht, individuelle Sprachassistenten zu erstellen, die auf den persönlichen Vorlieben oder spezifischen Stimmlagen einer Person basieren.
1 Minute KI-Sprechaufnahme entspricht 1 Minute des endgültigen übersetzten Video- bzw. Audiomaterials. Wenn Sie beispielsweise ein fünfminütiges Video haben, das in zwei neue Sprachen übersetzt werden soll, benötigen Sie 10 Minuten Sprechaufnahme. Je nach Ihrem Preisplan erhalten Sie monatlich automatisch eine bestimmte Anzahl von Minuten gutgeschrieben. Sollten die zugeteilten Minuten aufgebraucht sein, können Sie zusätzliche Minuten erwerben.
Die Anzahl der Minuten, die für das KI-Synchronisationstool benötigt werden, hängt von Ihren Anforderungen ab. Wenn Sie beispielsweise ein fünfminütiges Video haben, das in zwei neue Sprachen übersetzt werden soll, benötigen Sie 10 Minuten Sprachaufnahmen. Wenn Sie ein einstündiges Video haben, das Sie in drei Sprachen übersetzen lassen möchten, benötigen Sie 180 Minuten. Sollten die Ihnen zugewiesenen Minuten nicht ausreichen, können Sie zusätzliche Minuten erwerben.
Die Kosten für zusätzliche Minuten variieren je nach Tarif. Weitere Informationen finden Sie auf unserer Preisseite.
Ja, wir bieten eine kostenlose Testversion an. Während der Testphase haben Sie die Möglichkeit, Videos hochzuladen und aus jedem davon Clips mit verschiedenen Funktionsanpassungen zu erhalten. Die kostenlose Testversion umfasst den Zugriff auf die Stimmklonierungsfunktion sowie die Möglichkeit, das Transkript und die Übersetzung Ihrer Videos zu bearbeiten, sodass kostenlose Nutzer den Kern-Workflow vor einem Upgrade testen können.
Für Nutzer mit einem Abonnement gibt es keine besonderen Beschränkungen hinsichtlich der Dauer und Größe der hochgeladenen Videos. Wenn Sie jedoch Probleme mit Videos haben, die länger als 3 Stunden sind, empfehlen wir Ihnen, sie in zwei Teile aufzuteilen und diese getrennt zu übersetzen. Diese Vorgehensweise gewährleistet eine reibungslosere Verarbeitung und trägt zur Aufrechterhaltung einer optimalen Leistung bei.
Wir unterstützen verschiedene Zahlungsmethoden, darunter Kredit-/Debitkarten (Visa, Mastercard, American Express, UnionPay und andere) und Zahlungen über Apple Pay, Cash App Pay, Google Pay, Link, WeChat Pay. Alle Zahlungen werden sicher über Stripe, eine vertrauenswürdige Zahlungsplattform, abgewickelt.
Wir akzeptieren Kryptowährungen auch über sichere Direktüberweisungen von über 300 gängigen Wallets und Börsen.
Wir bieten zwei Arten von Abonnements an: Monats- und Jahresabonnements. Das Monatsabonnement beinhaltet eine wiederkehrende Zahlung, die jeden Monat in Rechnung gestellt wird. Das Jahresabonnement ist eine wiederkehrende Zahlung, die jährlich in Rechnung gestellt wird und sich automatisch um ein Jahr verlängert. Nachdem Sie ein Abonnement bezahlt haben, werden Sie so lange belastet, bis Sie Ihr Abonnement kündigen. Sie können Ihr Abonnement jederzeit kündigen.
Außerdem bieten wir unseren Unternehmenskunden maßgeschneiderte Zahlungsoptionen und -bedingungen an. Erfahren Sie hier, was unser Enterprise-Tarif umfasst.
Ja, Sie können Ihr Abonnement jederzeit kündigen. Klicken Sie dazu unten links auf Ihr Konto und anschließend auf „Abonnement kündigen“. Die Kündigung wird am Tag nach dem letzten Tag Ihres aktuellen Abonnementzeitraums wirksam.
Im Falle einer Kündigung des Abonnements werden alle verbleibenden Minuten am Ende des Abrechnungszyklus automatisch gelöscht und Ihr Zugang zum Dienst wird gesperrt.
Um Ihre verbleibenden Minuten zu behalten, sollten Sie erwägen, Ihr Abonnement zu pausieren, anstatt es zu kündigen. Ein Abonnement kann einmal alle 12 Monate für bis zu einem Monat pausiert werden. In diesem Fall fallen während der Pause keine Kosten an, und Ihre Minuten bleiben erhalten, können jedoch erst wieder genutzt werden, wenn Sie das Abonnement reaktivieren.
Wir verpflichten uns, Ihnen die verbrauchten Minuten zu erstatten, wenn die Erstellung Ihres Videos aufgrund eines technischen Fehlers unsererseits nicht abgeschlossen werden konnte. Um eine Rückerstattung von Minuten zu beantragen, wenden Sie sich bitte an unseren Support-Service. Wir werden Ihre Anfrage prüfen, und wenn bestätigt wird, dass ein technischer Fehler auf unserer Seite vorlag, werden wir Ihnen die verbrauchten Minuten auf Ihr Konto zurückerstatten.
Bitte beachten Sie, dass in den folgenden Fällen keine Erstattungen erfolgen können:
Jeder Antrag auf Rückerstattung wird individuell geprüft. Weitere Informationen zu unseren Rückerstattungsrichtlinien finden Sie in unseren Nutzungsbedingungen unter folgendem Link: rask.ai/terms-of-service
Wir nehmen die Sicherheit der Zahlungsdaten unserer Kunden sehr ernst. Um den Schutz Ihrer Zahlungsdaten zu gewährleisten, nutzen wir Stripe, einen der weltweit führenden Zahlungsdienstleister. Stripe ist als PCI-Level-1-Dienstleister zertifiziert – dies ist die höchste Sicherheitszertifizierungsstufe in der Zahlungsbranche. Stripe verschlüsselt Ihre Zahlungsdaten mithilfe der branchenüblichen SSL/TLS-Technologie und speichert sie auf seinen sicheren Servern. Wir speichern keinerlei Zahlungsdaten.