KI-Dubbing-API für Videos in über 135 Sprachen

Laden Sie Ihr Video hoch, wählen Sie eine Zielsprache und erhalten Sie das synchronisierte Video. Eine Anfrage an unsere KI-Dubbing-API übernimmt Transkription, Übersetzung, Sprechererkennung, Stimmenklonung sowie Sprachsynthese, behält die Originalstimme bei und liefert ein synchronisiertes Video, separate WAV-Audiospuren und Untertiteldateien.
Stimmklonierung
Integrierte Lippensynchronisation
REST + Python-SDK
three requests, start to finish
OAuth 2.0
# 1. exchange client credentials for a token (valid 1 hour)
curl -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials"# 2. upload by link - YouTube, Drive, S3, Vimeo or direct URL
curl -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/...", "name": "Q3 launch"}'# 3. create the dubbing project - this starts the dub
curl -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d '{
    "video_id": "b8f7835d-e8c9-4ff4-8e34-5c336d818319",
    "dst_lang": "es-mx",
    "name":     "Q3 launch"
  }'
GET /v2/projects/{project_id}
polling, 10s
# Poll the project until status is merging_done.while :; do
  curl -s https://api.rask.ai/v2/projects/$ID \
    -H "Authorization: Bearer $TOKEN" | jq .status
  sleep 10done
Von globalen Teams genutzt
Funktionen

Alles, was die Dubbing-API leistet, in einem einzigen Aufruf

Transkribieren, übersetzen und synchronisieren Sie Ihre Videos automatisch über eine einzige API. Passen Sie die Ergebnisse durch Stimmenauswahl, Glossare und Skriptbearbeitung an. Optional ist auch eine Lippensynchronisation verfügbar, die separat berechnet wird.

Synchronisation in über 135 Sprachen

Der gesamte Ablauf in nur einem Schritt: Transkribieren, übersetzen, synthetisieren, abmischen. Sie senden lediglich ein Video und die Zielsprache.

Sprechererkennung und individuelle Stimmen pro Sprecher

Sprecher werden automatisch vom Original-Audio getrennt und erhalten jeweils ihre eigene Stimme in der Zielsprache. Sie können jede Zuordnung manuell anpassen oder die Anzahl der Sprecher direkt angeben.

Stimmenklonung über Sprachgrenzen hinweg

Behalten Sie die einzigartige Stimme des Originalsprechers bei – so klingt der Moderator auch auf Spanisch, Hindi, Japanisch oder Koreanisch authentisch.

Lippensynchronisation

An Mundbewegungen angepasstes Audio als separate Aufgabe für jedes synchronisierte Projekt. Die Gesichtserkennung läuft vorab, sodass Sie nur zahlen, wenn es auch funktioniert.

Hintergrundaudio bleibt erhalten

Musik, Raumklang und Soundeffekte werden von der Sprache getrennt und unter die neue Tonspur gemischt. Das Ergebnis ist ein vollständig lokalisiertes Video, bei dem die Originalmusik und die Effekte unter der neuen Stimme erhalten bleiben.

Untertitel im .srt- und .vtt-Format

Beide Formate sind in jedem fertigen Projekt enthalten, zeitsynchron zum Dubbing und sofort einsatzbereit für Ihren Player.

Glossarkontrolle für Fachbegriffe

Markennamen, Produktnamen und Fachbegriffe werden stets einheitlich übersetzt oder bewusst im Original belassen. Dank Versionierung behält jedes fertige Projekt genau das Glossar, mit dem es synchronisiert wurde.

Skriptbearbeitung auf Segmentebene

Transkript abrufen, Zeile korrigieren, Zeitstempel anpassen, Segmente hinzufügen oder löschen und neu generieren. Ihre Sprachexperten korrigieren das Skript direkt, und die Synchronisation wird basierend auf diesen Änderungen neu erstellt.

Skalieren Sie ohne Grenzen

Senden Sie Ihren gesamten Katalog auf einmal und übersetzen Sie ihn parallel in alle Zielsprachen – ganz unabhängig vom Volumen.
In Aktion erleben

Was die KI-Dubbing-API tatsächlich ausgibt

Dasselbe Video, synchronisiert über genau die API, von der Sie gerade gelesen haben. Originalstimme im Quellvideo, geklonte Stimme auf Französisch, Deutsch, Portugiesisch und Spanisch, Hintergrundaudio intakt.
EN-Flagge
En
FR-Flagge
Fr
DE-Flagge
De
PT-Flagge
Pt
ES-Flag
Es
Workflow

Drei Schritte vom Quelldatei zum synchronisierten Video

Das Erstellen des Projekts startet die Synchronisation. Nutzen Sie /generate später, um ein Projekt nach Bearbeitungen erneut zu synchronisieren.
1

Lade dein Video hoch

Senden Sie eine Datei als Multipart-Formulardaten oder posten Sie einen Link. Unterstützte Link-Quellen sind YouTube, Google Drive, S3, Vimeo sowie jede direkte Download-URL. Sie erhalten eine Medien-ID und vollständige technische Metadaten, bevor Kosten anfallen.

POST /api/library/v1/media/link
2

Projekt erstellen

Übergeben Sie die Medien-ID als video_id und eine Zielsprache. Optional können Sie Ihr eigenes Transkript oder ein Glossar hinzufügen. Die Synchronisation startet sofort.

POST /v2/projects
3

Ergebnisse abrufen

Fragen Sie den status ab, bis dieser merging_done erreicht. Laden Sie anschließend das synchronisierte Video, die Audiospuren und die Untertiteldateien herunter.

GET /v2/projects/{project_id}
Die Bearbeitungszeit variiert je nach Projekt. Verfolgen Sie den Fortschritt über die API und laden Sie Ihre Dateien herunter, sobald die Synchronisation abgeschlossen ist.
Auf Ihre Bedürfnisse zugeschnitten

Nicht in der Liste? Wir entwickeln es.

Neue Sprachen, maßgeschneiderte Stimmen, Ihr eigener Bereitstellungsweg oder höherer Datendurchsatz: Wenn eine Integration Anforderungen hat, die über den Standard hinausgehen, entwickelt unser Team gemeinsam mit Ihnen eine passgenaue Lösung.

Sprachen und Stimmen

Benötigen Sie eine Sprache oder Stimme außerhalb des öffentlichen Katalogs? Sprechen Sie mit unserem Team über Ihre Anforderungen und die verfügbaren Optionen.

Bereitstellung und Integration

Webhooks, Einspeisung in Ihre eigene Warteschlange, direkte Bereitstellung auf Ihrem S3 oder benutzerdefinierte Endpunkte. Sagen Sie uns einfach, wie Ihre Pipeline Daten benötigt.

Volumen und Durchsatz

Batch-Größen, Zielsprachen pro Aktion und Verarbeitungspriorität werden in Ihrem Vertrag festgelegt, um perfekt zu Ihren Abläufen zu passen.

Sicherheit und Hosting

Datenspeicherung, SSO und SAML, Aufbewahrungsregeln und Support bei Sicherheitsprüfungen werden im Rahmen des Enterprise-Onboardings geregelt.
Anwendungsfälle

Wer eine KI-Dubbing-API nutzt

Plattformen mit integrierten Videos

LMS- und Kundenschulungsplattformen, Creator- und Videoplattformen, Webinar- und Event-Tools, Video-Hosting- und Workflow-SaaS, Digital-Adoption-Plattformen sowie Live-Shopping. Bildungsinhalte, Produktdemos und Creator-Videos werden direkt in Ihrem Produkt synchronisiert, sodass globale Zielgruppen sie in ihrer eigenen Sprache erleben und KI-Dubbing zu einem Ihrer Features wird.

Lokalisierungs- und Produktionsagenturen

Verbinden Sie KI-Dubbing mit Ihren bestehenden Abläufen und behalten Sie die manuelle Qualitätskontrolle bei. Die KI erstellt die erste synchronisierte Version, und Ihre Experten bearbeiten das Skript, anstatt das Studio für neue Aufnahmen zu buchen.

Interne, kontinuierliche Videoproduktion

Internationaler Handel und E-Commerce, globale Franchise-Unternehmen, Medienverlage und Unternehmensakademien. Integrieren Sie die Lokalisierung in Ihren Publishing-Workflow, damit Ihr Team Sprachversionen jederzeit einfach neu generieren kann, sobald sich das Quellvideo ändert.
Kundenreferenzen

Echte Teams, messbare Ergebnisse

Wie Unternehmen mit Rask Videos lokalisieren – in konkreten Zahlen.
Pfeil
Pfeil
Code

Code-Beispiele für die KI-Dubbing-API

Ein vollständiger Durchlauf in jeder Sprache: Authentifizierung, Upload, Synchronisierung, Warten, Download.
# pip install git+https://github.com/braskai/rask-sdk
import asyncio
from rask_sdk import RaskSDKClient

async def main():
    client = RaskSDKClient(client_id=CLIENT_ID, client_secret=CLIENT_SECRET)

    media   = await client.upload_media_link(link="https://youtu.be/...")
    project = await client.create_project(video_id=media.id, dst_lang="es-mx")

    while project.status != "merging_done":
        await asyncio.sleep(10)
        project = await client.get_project(project.id)

    print(project.translated_video, project.translation_srt_path)

asyncio.run(main())
github.com/braskai/rask-sdk
Python 3.8+, async
import os, time, requests

AUTH = "https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token"
API  = "https://api.rask.ai"

token = requests.post(AUTH, auth=(CLIENT_ID, CLIENT_SECRET),
                      data={"grant_type": "client_credentials"}).json()["access_token"]
h = {"Authorization": f"Bearer {token}"}

media = requests.post(f"{API}/api/library/v1/media/link", headers=h,
                      json={"link": "https://youtu.be/..."}).json()

project = requests.post(f"{API}/v2/projects", headers=h,
                        json={"video_id": media["id"], "dst_lang": "es-mx"}).json()

while project["status"] != "merging_done":
    time.sleep(10)
    project = requests.get(f"{API}/v2/projects/{project['id']}", headers=h).json()

print(project["translated_video"])
requests + polling
no SDK required
// no dependencies, Node 18+ global fetch
const API = 'https://api.rask.ai';

const auth = await fetch('https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token', {
  method: 'POST',
  headers: { Authorization: 'Basic ' + btoa(`${CLIENT_ID}:${CLIENT_SECRET}`) },
  body: new URLSearchParams({ grant_type: 'client_credentials' }),
}).then(r => r.json());

const h = { Authorization: `Bearer ${auth.access_token}`, 'Content-Type': 'application/json' };

const media = await fetch(`${API}/api/library/v1/media/link`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ link: 'https://youtu.be/...' }),
}).then(r => r.json());

let project = await fetch(`${API}/v2/projects`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ video_id: media.id, dst_lang: 'es-mx' }),
}).then(r => r.json());

while (project.status !== 'merging_done') {
  await new Promise(r => setTimeout(r, 10000));
  project = await fetch(`${API}/v2/projects/${project.id}`, { headers: h }).then(r => r.json());
}

console.log(project.translated_video);
fetch, Node 18+
plain HTTP
# 1. token (valid 1 hour - cache and reuse it)
TOKEN=$(curl -s -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials" | jq -r .access_token)

# 2. upload by link
VIDEO_ID=$(curl -s -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/..."}' | jq -r .id)

# 3. create the dubbing project
ID=$(curl -s -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d "{\"video_id\": \"$VIDEO_ID\", \"dst_lang\": \"es-mx\"}" | jq -r .id)

# 4. poll, then download
while [ "$(curl -s https://api.rask.ai/v2/projects/$ID -H "Authorization: Bearer $TOKEN" | jq -r .status)" != "merging_done" ]; do
  sleep 10
done
POST /v2/projects
OAuth 2.0 client credentials
<?php
use GuzzleHttp\Client;

$http = new Client(['base_uri' => 'https://api.rask.ai']);

$auth = json_decode((new Client)->post(
    'https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token',
    ['auth' => [$clientId, $clientSecret],
     'form_params' => ['grant_type' => 'client_credentials']]
)->getBody(), true);

$h = ['Authorization' => 'Bearer ' . $auth['access_token']];

$media = json_decode($http->post('/api/library/v1/media/link',
    ['headers' => $h, 'json' => ['link' => 'https://youtu.be/...']])->getBody(), true);

$project = json_decode($http->post('/v2/projects',
    ['headers' => $h, 'json' => ['video_id' => $media['id'], 'dst_lang' => 'es-mx']])->getBody(), true);

while ($project['status'] !== 'merging_done') {
    sleep(10);
    $project = json_decode($http->get("/v2/projects/{$project['id']}",
        ['headers' => $h])->getBody(), true);
}
Guzzle 7
plain HTTP
Python ist das offizielle SDK. Die Registerkarten für Node, PHP und cURL zeigen einfache HTTP-Beispiele für dieselben Endpunkte.
Fortschritt

Wie der Fortschritt eines Dubbing-Projekts übermittelt wird

Ein Projekt durchläuft einen klar dokumentierten Status, sodass Sie Ihren eigenen Nutzern einen echten, detaillierten Fortschrittsbalken anzeigen können. Sie müssen sich nur um drei Bereiche kümmern.

Erfolgreich, hier stoppen

merging_done
Die Synchronisation ist abgeschlossen. Rufen Sie das Projekt noch einmal auf, um die Download-Links für Ihre Dateien abzurufen.

Wird ausgeführt, Status weiter abfragen

created
uploading
transcription_started
separate_background_started
determine_speakers_started
translation_started
voiceover_started
merging_started
Plus das passende _done Diese lassen sich perfekt in einer Benutzeroberfläche für den Fortschritt darstellen.

Fehler, Stopp und Meldung

failed
upload_failed
transcription_failed
translation_failed
voiceover_failed
merging_failed
no_audio
no_words
forbidden_link
no_audio, no_words und forbidden_link sind aussagekräftig genug, um sie direkt Ihren eigenen Nutzern zu zeigen.
Typical run, 4 minute source video
GET /v2/projects/{project_id}
   0s  created
  12s  transcription_started
  70s  translation_started
  95s  voiceover_started
 150s  merging_started
 170s  merging_done

Oder das Abfragen ganz überspringen

Verweisen Sie auf einen Webhook-Endpunkt, und jeder Statusübergang kommt als POST an, sodass Ihre Warteschlange im Moment des Geschehens auf jede Änderung reagiert. Die Webhook-Bereitstellung ist Teil des Enterprise-Onboardings.
Dokumentation lesen
preserveAspectRatio="xMidYMid meet" aria-hidden="true" role="img">
Ausgabe

Synchronisiertes Video, Audio und Untertitel

Laden Sie Ihr synchronisiertes Video und die übersetzten Untertitel im SRT- und VTT-Format herunter. Bei entsprechenden Tarifen können Sie auch die übersetzte Tonspur separat oder zusammen mit dem Original-Hintergrundton herunterladen.
Feld
Format
Was es ist
translated_video
MP4
Das synchronisierte Video, bereit zur Veröffentlichung
voiceover
WAV
Nur übersetzte Sprache, kein Hintergrund, direkt für Ihre eigene Abmischung
translated_audio
WAV
Übersetzte Sprache gemischt mit dem Original-Hintergrundaudio
translation_srt_path
.srt
Untertitel in der Zielsprache
translation_vtt_path
.vtt
Dieselbe Untertiteldatei als WebVTT für Webplayer
original_video
MP4
Ihre Quelldatei zur Referenz
Steuerung

Skript bearbeiten und nur den geänderten Teil neu synchronisieren

Die automatische Übersetzung bringt Sie fast ans Ziel. Wenn das nicht reicht, können Sie das Transkript Segment für Segment bearbeiten und neu generieren lassen. Dabei werden Ihnen nur die Teile berechnet, die Sie geändert haben.

Bearbeitung auf Segmentebene

Bearbeitung auf Segmentebene
Jedes Projekt stellt sein Transkript als bearbeitbare Segmente bereit, sodass das Korrigieren einer fehlerhaften Zeile nur eine kurze Anfrage erfordert.
Das Transkript und seine Segmente abrufen
Den Quelltext anpassen, damit wir ihn neu übersetzen
Den übersetzten Text direkt anpassen, um Ihre eigenen Formulierungen beizubehalten
Zeitstempel anpassen, Segmente hinzufügen oder löschen
Sprechern eine neue Stimme zuweisen

Glossare für Fachbegriffe

Glossare für Fachbegriffe
Verknüpfen Sie ein Glossar mit einem Projekt, damit Markennamen, Produktnamen und Fachbegriffe jedes Mal exakt gleich übersetzt werden oder absichtlich unübersetzt bleiben.

Ein Glossar deckt ein Sprachpaar ab und gilt für alle regionalen Varianten dieser Zielsprache, sodass ein einziges spanisches Glossar es-mx und es-es gleichermaßen dient. Das Projekt speichert glossary_version, sodass spätere Änderungen bereits fertiggestellte Arbeit nicht unbemerkt verändern.
Eingabe

Unterstützte Dateiformate

Sieben Video- und vier Audioformate sowie der direkte Import über eine URL. Wenn Sie eine nicht unterstützte Datei hochladen, lehnt die API diese anhand des Dateityps ab, bevor Minuten berechnet werden.

Video

7 Formate
.mp4
.mov
.mkv
.avi
.webm
.m4v
.3gp

Audio

4 Formate
.mp3
.wav
.flac
.m4a

Metadaten, bevor Kosten entstehen

Der Media-Endpunkt liefert Informationen zu Dauer, Dateigröße, Video-Codec, Bildrate, Auflösung, Audio-Codec, Samplerate und Kanal-Layout. Überprüfen Sie Dateien im Voraus und schätzen Sie die Kosten ab, da das Synchronisieren minutenbasiert abgerechnet wird.
Sicherheit und Compliance

Geprüft und freigegeben für die Sicherheitsabteilung

Brask Inc erfüllt die Standards von SOC 2 Type II, arbeitet im Einklang mit der DSGVO und veröffentlicht den Live-Status im Trust Center.

Zertifizierungen

SOC 2 Type II
DSGVO
Mitglied bei CAI und C2PA

Verschlüsselung

TLS 1.2 während der Übertragung
AES-256 im Ruhezustand
Verwaltete SSE-S3-Schlüssel
Schlüsselrotation mindestens alle 12 Monate

Ihre Inhalte

Geschlossene KI-Umgebung
Niemals zum Trainieren allgemeiner Modelle verwendet
Vollständiger Export, keine Bindung an einen Anbieter

Zugang

SSO und SAML
Rollenbasierte Zugriffskontrolle
OAuth 2.0-Client-Anmeldeinformationen

Enterprise

Optionen für den Speicherort der Daten
Individuelle SLAs
Dedizierter Ansprechpartner

Stimmrechte

Synthetische Stimmen mit Nutzungsrechten
Einwilligungsbasierte Stimmklonung
KI-Sicherheitskontrollen, menschliche Überprüfung
Vergleich

Rask API im Vergleich zur Eigenentwicklung

Dieselbe Synchronisationsfunktion, auf zwei verschiedene Arten umgesetzt. Eine Spalte ist ein Vertrag, die andere ein Fahrplan.
Was Sie benötigen
Rask API
Aus Einzelteilen zusammengesetzt
Transkription, Übersetzung, Synthese, Abmischung
Ein Aufruf
Drei bis vier Anbieter und die Verbindung dazwischen
Sprechererkennung und individuelle Stimmen pro Sprecher
Im Lieferumfang enthalten
Ein Sprechererkennungsanbieter plus eigene Stimmzuweisungslogik
Hintergrundmusik und Effekte bleiben erhalten
Im Lieferumfang enthalten
Ein von Ihnen entwickelter und optimierter Quellentrennungsschritt
Stimmenklonung über Sprachgrenzen hinweg
Im Lieferumfang enthalten
Ein separater Anbieter und ein separater Einwilligungsprozess
Lippensynchronisation
Im Lieferumfang enthalten
Ein fünfter Anbieter
Untertitel im .srt- und .vtt-Format
Im Lieferumfang enthalten
Aus Ihren eigenen Timing-Daten generiert
Eine fehlerhafte Zeile korrigieren
Diesen Abschnitt neu synchronisieren und nur diesen bezahlen
Den Prozess erneut starten und für die Datei bezahlen
Einheitliche Terminologie
Glossare mit Versionsverwaltung
Vor- und Nachbereitung, die Sie selbst verwalten
Ratenlimits
Keine
Was auch immer Ihr schwächster Anbieter vorschreibt
Eine Sprache, die noch niemand unterstützt
Wir entwickeln sie
Nicht verfügbar
Häufig gestellte Fragen

KI-Dubbing-API: Häufig gestellte Fragen

Sie finden nicht, wonach Sie suchen? Wenden Sie sich an den Vertrieb.

Wie erhalte ich API-Zugriff und einen API-Schlüssel?

Wie authentifiziere ich mich bei der KI-Dubbing-API?

Ist die API synchron oder asynchron?

Wie hoch sind die Limits für Anfragen?

In wie viele Sprachen kann ich synchronisieren?

Wie funktioniert die Stimmklonung mit der API?

Wie lange dauert das KI-Dubbing?

Welche Dateiformate werden unterstützt?

Wie geht die API mit einem Video mit mehreren Sprechern um?

Kann ich mein eigenes Skript oder Transkript bereitstellen?

Erhalte ich neben einem synchronisierten Video auch Untertitel?

Gibt es ein SDK?

Was kostet eine erneute Synchronisation nach einer Bearbeitung?

Starten Sie noch heute Nachmittag mit der Synchronisation

Starten Sie noch heute Ihre erste Anfrage und sprechen Sie mit uns, wenn Sie Großkundenkonditionen oder eine seltene Sprache benötigen.