API di doppiaggio AI per video in oltre 135 lingue

Caricate il vostro video, scegliete la lingua di arrivo e scaricate il video doppiato. Una singola richiesta all'API di doppiaggio IA gestisce trascrizione, traduzione, rilevamento dei parlanti, clonazione vocale e sintesi vocale, mantenendo l'identità vocale del parlante originale e restituendo un video doppiato, tracce audio WAV separate e file di sottotitoli.
Clonazione della voce
Sincronizzazione labiale inclusa
REST + SDK Python
three requests, start to finish
OAuth 2.0
# 1. exchange client credentials for a token (valid 1 hour)
curl -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials"# 2. upload by link - YouTube, Drive, S3, Vimeo or direct URL
curl -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/...", "name": "Q3 launch"}'# 3. create the dubbing project - this starts the dub
curl -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d '{
    "video_id": "b8f7835d-e8c9-4ff4-8e34-5c336d818319",
    "dst_lang": "es-mx",
    "name":     "Q3 launch"
  }'
GET /v2/projects/{project_id}
polling, 10s
# Poll the project until status is merging_done.while :; do
  curl -s https://api.rask.ai/v2/projects/$ID \
    -H "Authorization: Bearer $TOKEN" | jq .status
  sleep 10done
Utilizzato da team in tutto il mondo
Funzionalità

Tutto ciò che fa l'API di doppiaggio, in un'unica chiamata

Trascrivete, traducete e doppiate automaticamente i vostri video tramite un'unica API. Ottimizzate i risultati scegliendo le voci, usando i glossari e modificando i testi. Aggiungete la sincronizzazione labial opzionale, fatturata separatamente.

Doppiaggio in oltre 135 lingue

L'intero processo dietro a una sola richiesta: trascrizione, traduzione, sintesi e mix. Tutto ciò che dovete inviare è un video e la lingua di arrivo.

Riconoscimento dei parlanti e voci personalizzate

I parlanti vengono separati automaticamente dall'audio originale e ciascuno riceve la propria voce nella lingua di arrivo. Puoi modificare qualsiasi assegnazione o indicare il numero di persone, se lo conosci.

Clonazione della voce tra le lingue

Mantenete l'identità vocale del parlante originale nel doppiaggio, in modo che suoni naturale anche in spagnolo, hindi, giapponese o coreano.

Sincronizzazione labiale

Movimento della bocca sincronizzato con l'audio doppiato, disponibile come operazione aggiuntiva per qualsiasi progetto. Il rilevamento dei volti viene eseguito per primo, così paghi solo quando è possibile farlo.

Audio di sottofondo preservato

Musica, rumori ambientali ed effetti sono separati dalla voce e miscelati nuovamente sotto il doppiaggio. Il risultato è una traccia completamente localizzata che mantiene la musica originale, i rumori ambientali e gli effetti sotto la nuova voce.

Sottotitoli in formato .srt e .vtt

Entrambi i formati sono inclusi in ogni progetto completato, sincronizzati con il doppiaggio e pronti per il vostro lettore.

Controllo della terminologia con glossari

Nomi di marchi, prodotti e termini tecnici vengono tradotti sempre nello stesso modo o lasciati invariati di proposito. Il sistema è organizzato per versioni, in modo che ogni progetto finito conservi il glossario con cui è stato doppiato.

Modifica del testo a livello di singolo segmento

Recuperate la trascrizione, correggete una riga, regolate un timestamp, aggiungete o eliminate un segmento e rigenerate. I vostri linguisti correggono direttamente il testo e il doppiaggio si aggiorna di conseguenza.

Cresci senza limiti

Inviate l'intero catalogo in una sola volta e doppiatelo in tutte le lingue di arrivo in parallelo, a qualsiasi volume.
Guardalo in azione

Cosa restituisce effettivamente l'API di doppiaggio AI

Lo stesso clip, doppiato tramite la chiamata API che avete appena letto. Voce originale sulla sorgente, voce clonata in francese, tedesco, portoghese e spagnolo, con audio di sottofondo intatto.
Bandiera EN
En
Bandiera della Francia
Ven
Bandiera della Germania
Da
Bandiera del PT
Pt
Bandiera ES
Es
Flusso di lavoro

Tre passaggi dal file di origine al video doppiato

La creazione del progetto avvia il doppiaggio. Usate /generate in un secondo momento per doppiare nuovamente un progetto dopo averlo modificato.
1

Carica il tuo video

Invia un file come dati di modulo multipart o pubblica un link. Le origini di link supportate sono YouTube, Google Drive, S3, Vimeo e qualsiasi URL di download diretto. Restituisce un ID multimediale e metadati tecnici completi prima di spendere qualsiasi cosa.

POST /api/library/v1/media/link
2

Crea il progetto

Passa l'ID multimediale come video_id e una lingua di arrivo. Facoltativamente, allega la tua trascrizione o un glossario. Il doppiaggio si avvia immediatamente.

POST /v2/projects
3

Raccogli il risultato

Leggi lo status finché non raggiunge merging_done, quindi scarica il video doppiato, le tracce audio e i file dei sottotitoli.

GET /v2/projects/{project_id}
Il tempo di elaborazione varia in base al progetto. Monitorate i progressi tramite l'API e scaricate i file una volta completato il doppiaggio.
Creato intorno a te

Non è nella lista? Lo creiamo noi.

Nuove lingue, voci personalizzate, il vostro metodo di consegna e maggiore capacità: quando un'integrazione di doppiaggio richiede qualcosa che non è nel catalogo pubblico, il nostro team lo progetta insieme a voi e lo realizza.

Lingue e voci

Hai bisogno di una lingua o di una voce non presenti nel catalogo pubblico? Parla con il nostro team per esporre le tue esigenze e scoprire le opzioni disponibili.

Consegna e integrazione

Webhook, invio nella tua coda, consegna diretta al tuo S3, endpoint personalizzati. Diteci come il vostro sistema si aspetta di ricevere i dati.

Volume e capacità

Le dimensioni dei lotti, le lingue di arrivo per azione e la priorità di elaborazione sono configurate nel contratto per adattarsi al vostro flusso di lavoro.

Sicurezza e hosting

La residenza dei dati, l'SSO e SAML, le regole di conservazione e il supporto per la revisione della sicurezza vengono gestiti durante l'attivazione per le aziende.
Casi d'uso

Chi utilizza un'API di doppiaggio IA

Piattaforme con video integrati

Piattaforme LMS e di formazione clienti, piattaforme per creatori e video, strumenti per webinar e eventi virtuali, SaaS per l'hosting video e flussi di lavoro, piattaforme di digital adoption e live shopping. Contenuti formativi, demo di prodotti e video per creatori vengono doppiati direttamente all'interno del vostro prodotto, consentendo al pubblico globale di ascoltarli nella propria lingua e trasformando il doppiaggio IA in una delle vostre funzioni.

Agenzie di localizzazione e produzione

Collegate il doppiaggio IA al flusso di consegna che già utilizzate e mantenete la fase di revisione umana. L'intelligenza artificiale genera la prima versione doppia e i vostri linguisti modificano il testo senza dover prenotare uno studio di registrazione.

Produzione video interna e continua

Retail internazionale e e-commerce, franchising globali, editori multimediali e università aziendali. Integrate la localizzazione nel vostro flusso di pubblicazione, così il vostro team potrà rigenerare le versioni in altre lingue ogni volta che il video di origine cambia.
Storie di clienti

Squadre vere, risultati tangibili

Come le aziende localizzano i video con Rask, attraverso i loro numeri.
freccia
freccia
Codice

Esempi di codice per l'API di doppiaggio AI

Un ciclo completo in ogni lingua: autenticazione, caricamento, doppiaggio, attesa e download.
# pip install git+https://github.com/braskai/rask-sdk
import asyncio
from rask_sdk import RaskSDKClient

async def main():
    client = RaskSDKClient(client_id=CLIENT_ID, client_secret=CLIENT_SECRET)

    media   = await client.upload_media_link(link="https://youtu.be/...")
    project = await client.create_project(video_id=media.id, dst_lang="es-mx")

    while project.status != "merging_done":
        await asyncio.sleep(10)
        project = await client.get_project(project.id)

    print(project.translated_video, project.translation_srt_path)

asyncio.run(main())
github.com/braskai/rask-sdk
Python 3.8+, async
import os, time, requests

AUTH = "https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token"
API  = "https://api.rask.ai"

token = requests.post(AUTH, auth=(CLIENT_ID, CLIENT_SECRET),
                      data={"grant_type": "client_credentials"}).json()["access_token"]
h = {"Authorization": f"Bearer {token}"}

media = requests.post(f"{API}/api/library/v1/media/link", headers=h,
                      json={"link": "https://youtu.be/..."}).json()

project = requests.post(f"{API}/v2/projects", headers=h,
                        json={"video_id": media["id"], "dst_lang": "es-mx"}).json()

while project["status"] != "merging_done":
    time.sleep(10)
    project = requests.get(f"{API}/v2/projects/{project['id']}", headers=h).json()

print(project["translated_video"])
requests + polling
no SDK required
// no dependencies, Node 18+ global fetch
const API = 'https://api.rask.ai';

const auth = await fetch('https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token', {
  method: 'POST',
  headers: { Authorization: 'Basic ' + btoa(`${CLIENT_ID}:${CLIENT_SECRET}`) },
  body: new URLSearchParams({ grant_type: 'client_credentials' }),
}).then(r => r.json());

const h = { Authorization: `Bearer ${auth.access_token}`, 'Content-Type': 'application/json' };

const media = await fetch(`${API}/api/library/v1/media/link`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ link: 'https://youtu.be/...' }),
}).then(r => r.json());

let project = await fetch(`${API}/v2/projects`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ video_id: media.id, dst_lang: 'es-mx' }),
}).then(r => r.json());

while (project.status !== 'merging_done') {
  await new Promise(r => setTimeout(r, 10000));
  project = await fetch(`${API}/v2/projects/${project.id}`, { headers: h }).then(r => r.json());
}

console.log(project.translated_video);
fetch, Node 18+
plain HTTP
# 1. token (valid 1 hour - cache and reuse it)
TOKEN=$(curl -s -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials" | jq -r .access_token)

# 2. upload by link
VIDEO_ID=$(curl -s -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/..."}' | jq -r .id)

# 3. create the dubbing project
ID=$(curl -s -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d "{\"video_id\": \"$VIDEO_ID\", \"dst_lang\": \"es-mx\"}" | jq -r .id)

# 4. poll, then download
while [ "$(curl -s https://api.rask.ai/v2/projects/$ID -H "Authorization: Bearer $TOKEN" | jq -r .status)" != "merging_done" ]; do
  sleep 10
done
POST /v2/projects
OAuth 2.0 client credentials
<?php
use GuzzleHttp\Client;

$http = new Client(['base_uri' => 'https://api.rask.ai']);

$auth = json_decode((new Client)->post(
    'https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token',
    ['auth' => [$clientId, $clientSecret],
     'form_params' => ['grant_type' => 'client_credentials']]
)->getBody(), true);

$h = ['Authorization' => 'Bearer ' . $auth['access_token']];

$media = json_decode($http->post('/api/library/v1/media/link',
    ['headers' => $h, 'json' => ['link' => 'https://youtu.be/...']])->getBody(), true);

$project = json_decode($http->post('/v2/projects',
    ['headers' => $h, 'json' => ['video_id' => $media['id'], 'dst_lang' => 'es-mx']])->getBody(), true);

while ($project['status'] !== 'merging_done') {
    sleep(10);
    $project = json_decode($http->get("/v2/projects/{$project['id']}",
        ['headers' => $h])->getBody(), true);
}
Guzzle 7
plain HTTP
Python è l'SDK ufficiale. Le schede Node, PHP e cURL mostrano semplici esempi HTTP sugli stessi endpoint.
Avanzamento

Come viene mostrato l'avanzamento di un progetto di doppiaggio

Un progetto attraversa una serie di stati documentati, permettendovi di mostrare ai vostri utenti una barra di avanzamento reale e dettagliata. Dovrete intervenire solo su tre gruppi.

Operazione riuscita, fermati qui

merging_done
Il doppiaggio è completato. Recuperate il progetto un'altra volta per ottenere i link di download disponibili.

In corso, continua a verificare

created
uploading
transcription_started
separate_background_started
determine_speakers_started
translation_started
voiceover_started
merging_started
In più la corrispondenza _done stati. Questi si adattano perfettamente a un'interfaccia a fasi.

Errore, interruzione e segnalazione

failed
upload_failed
transcription_failed
translation_failed
voiceover_failed
merging_failed
no_audio
no_words
forbidden_link
no_audio, no_words e forbidden_link sono abbastanza specifici da poter essere mostrati direttamente ai vostri utenti.
Typical run, 4 minute source video
GET /v2/projects/{project_id}
   0s  created
  12s  transcription_started
  70s  translation_started
  95s  voiceover_started
 150s  merging_started
 170s  merging_done

Oppure salta del tutto il controllo

Indica un endpoint webhook e ogni transizione di stato arriverà come richiesta POST, così la tua coda potrà reagire a ogni cambiamento nel momento stesso in cui si verifica. La consegna tramite webhook fa parte dell'onboarding per le aziende.
Leggi la documentazione
preserveAspectRatio="xMidYMid meet" aria-hidden="true" role="img">
Output

Video, audio e sottotitoli doppiati

Scarica il tuo video doppiato e i sottotitoli tradotti in formato SRT e VTT. Con i piani idonei, puoi anche scaricare la voce tradotta da sola o unita all'audio di sottofondo originale.
Campo
Formato
Cosa contiene
translated_video
MP4
Il video doppiato, pronto per essere pubblicato
voiceover
WAV
Solo la voce tradotta, senza sottofondo, pronta per essere integrata nel tuo mix
translated_audio
WAV
Voce tradotta unita all'audio di sottofondo originale
translation_srt_path
.srt
Sottotitoli nella lingua di arrivo
translation_vtt_path
.vtt
Gli stessi sottotitoli in formato WebVTT, per lettori web
original_video
MP4
Il file di origine salvato, come riferimento
Controllo

Modifica il testo e ridoppia solo la parte modificata

La traduzione automatica fa gran parte del lavoro. Quando non basta, puoi modificare la trascrizione una sezione alla volta e rigenerarla, pagando solo per le parti che hai modificato.

Modifica per singoli segmenti

Modifica per singoli segmenti
Ogni progetto mostra la sua trascrizione divisa in parti facili da modificare, così basta una sola richiesta per correggere una frase errata.
Scarica la trascrizione e i suoi segmenti
Modifica il testo originale e noi penseremo a ritradurlo
Modifica direttamente il testo tradotto per usare le parole che preferisci
Modifica i tempi, aggiungi segmenti o cancellane altri
Cambia la voce associata a qualsiasi speaker

Glossari per la terminologia

Glossari per la terminologia
Collega un glossario al tuo progetto per fare in modo che i nomi dei tuoi prodotti, del tuo brand e i termini tecnici vengano tradotti sempre allo stesso modo, o rimangano invariati se lo desideri.

Un glossario copre una coppia di lingue e si applica a tutte le varianti regionali di quella lingua, così un unico glossario in spagnolo è utile per es-mx e es-es allo stesso modo. Il progetto registra glossary_version, così le modifiche successive non alterano mai inaspettatamente il lavoro completato.
Input

Formati di file supportati

Sette formati video e quattro formati audio, oltre alla possibilità di caricare file direttamente da un indirizzo web. Se provi a inviare un file non supportato, il sistema lo rifiuta subito in base al formato, senza scalare minuti dal tuo saldo.

Video

7 formati
.mp4
.mov
.mkv
.avi
.webm
.m4v
.3gp

Audio

4 formati
.mp3
.wav
.flac
.m4a

Tutte le informazioni prima di iniziare

Il sistema ti mostra la durata, la dimensione del file, il formato video, i fotogrammi al secondo, la risoluzione, il formato audio, la frequenza di campionamento e la disposizione dei canali. Controlla il file e calcola una stima della spesa in anticipo, dato che il servizio di doppiaggio viene fatturato al minuto.
Sicurezza e conformità

Approvato da chi se ne intende

Brask Inc possiede la certificazione SOC 2 Type II, rispetta le normative GDPR e pubblica lo stato dei controlli in tempo reale nel suo Trust Center.

Certificazioni

SOC 2 Tipo II
GDPR
Membro CAI e C2PA

Crittografia

TLS 1.2 in transito
AES-256 a riposo
Chiavi gestite SSE-S3
Rotazione delle chiavi almeno ogni 12 mesi

I tuoi contenuti

Ambiente di intelligenza artificiale chiuso
Mai utilizzato per addestrare modelli generali
Esportazione completa, senza vincoli

Accesso

SSO e SAML
Controllo degli accessi basato sui ruoli
Credenziali client OAuth 2.0

Enterprise

Opzioni di localizzazione dei dati
SLA personalizzati
Account manager dedicato

Diritti sulle voci

Voci sintetiche con diritti di utilizzo
Clonazione vocale basata sul consenso
Controlli di sicurezza dell'IA, supervisione umana
Confronto

Rask API rispetto alla creazione autonoma

La stessa capacità di doppiaggio, assemblata in due modi diversi. Una colonna è un contratto; l'altra è una tabella di marcia.
Ciò di cui hai bisogno
Rask API
Assemblato da componenti
Trascrizione, traduzione, sintesi, missaggio
Una sola chiamata
Da tre a quattro fornitori e i sistemi per collegarli
Riconoscimento dei parlanti e voci personalizzate
Incluso
Un fornitore di diarizzazione più la tua logica di assegnazione delle voci
Musica di sottofondo ed effetti preservati
Incluso
Un passaggio di separazione delle sorgenti da creare e ottimizzare
Clonazione della voce tra le lingue
Incluso
Un fornitore separato e un flusso di consenso separato
Sincronizzazione labiale
Incluso
Un quinto fornitore
Sottotitoli in formato .srt e .vtt
Incluso
Generato dai tuoi dati di tempistica
Correggere una singola riga errata
Doppia di nuovo quel segmento e paga solo per quella parte
Riavvia il processo e paga per il file
Coerenza della terminologia
Glossari con versioni
Pre e post-elaborazione gestiti da te
Limiti di velocità
Nessuno
Qualsiasi sia il limite imposto dal tuo fornitore meno attrezzato
Una lingua che nessuno supporta ancora
Lo creiamo noi
Non disponibile
Domande frequenti

API di doppiaggio AI: domande frequenti

Non riesci a trovare quello che cerchi? Contatta l'ufficio vendite.

Come posso ottenere l'accesso alle API e una chiave API?

Come posso autenticarmi con l'API di doppiaggio AI?

L'API è sincrona o asincrona?

Quali sono i limiti di frequenza?

In quante lingue posso doppiare?

Come funziona la clonazione della voce con le API?

Quanto tempo ci vuole per il doppiaggio con l'intelligenza artificiale?

Quali formati di file sono supportati?

Come gestisce l'API un video con più di un parlante?

Posso fornire un mio script o una mia trascrizione?

Ricevo anche i sottotitoli oltre al video doppiato?

È disponibile un SDK?

Quanto costa doppiare nuovamente dopo una modifica?

Inizia a doppiare in un solo pomeriggio

Fai la tua prima prova oggi e contattaci se hai bisogno di tariffe per grandi volumi o di una lingua che nessun altro offre.