---
title: "Come tradurre i sottotitoli di YouTube in più lingue"
description: "YouTube richiede un file di sottotitoli per ogni lingua. Ecco come trasformare un singolo SRT in otto, tramite browser o lasciando che il tuo agente AI gestisca l'intero set."
date: 2026-09-07
language: it
canonical: https://ai-glot.com/it/blog/translate-youtube-subtitles-multiple-languages
source: AI Glot blog
---
**YouTube richiede un file di sottotitoli per ogni lingua, quindi un video in otto lingue richiede otto file.** La traduzione è la parte facile. Ripetere l'operazione otto volte è ciò che spinge molti a mollare intorno alla terza lingua.

Questa guida illustra entrambi i metodi: l'esecuzione manuale, ideale per una o due lingue, e l'affidamento dell'intero set a un agente AI che esegue il nostro strumento a riga di comando per te. Il secondo metodo richiede lo stesso sforzo sia per otto lingue che per due.

## Cosa ti fornisce YouTube e cosa richiede in cambio

Apri YouTube Studio, vai ai sottotitoli del video e **scarica la traccia già esistente**. Puoi scegliere tra vari formati: seleziona `.srt`, poiché è il formato di sottotitoli che AI Glot legge.

Ciò che YouTube richiede in cambio è la stessa cosa, una volta per lingua: un file `.srt` caricato per ogni lingua che aggiungi al video. Non esiste un campo che permetta di caricare otto lingue contemporaneamente.

**Se l'unica traccia disponibile sono le didascalie automatiche di YouTube, correggile prima di tradurre.** La trascrizione automatica spesso sbaglia i nomi dei prodotti, i nomi delle persone e tutto ciò che viene detto velocemente. Tradurre tali errori significa trasformare una parola sbagliata in inglese nella stessa parola sbagliata in otto lingue, costringendoti a correggerla otto volte invece di una.

## L'unico dettaglio di un file di sottotitoli che determina l'intero lavoro

Un SRT è un elenco numerato di cue. Ogni cue contiene un numero, un timecode di inizio e fine e il testo da visualizzare a schermo.

*Illustration: Un cue prima e dopo la traduzione. Cambia solo la riga di testo, quindi il file torna sullo stesso video in sincrono.*

Il numero e il timecode costituiscono la struttura. Vengono copiati integralmente: un cue in entrata genera un cue in uscita, senza fusioni o divisioni. Così, il file tradotto si sincronizza perfettamente con lo stesso video.

**Ed ecco il vincolo che condiziona tutto il resto: il file contiene esattamente una traccia di testo.** Non esiste una seconda colonna per lo spagnolo, né un modo per aggiungerne una. Tradurre un SRT sostituisce il testo di ogni cue nella sua posizione originale: è esattamente per questo che i player e YouTube utilizzano un file per lingua.

Quindi, otto lingue non corrispondono a un unico lavoro con otto output. Sono otto lavori distinti.

*Illustration: Ogni file di sottotitoli contiene una lingua, quindi otto lingue corrispondono a otto traduzioni separate degli stessi cue.*

## Due assi, di cui le lingue sono solo uno

La maggior parte degli utenti gestisce entrambi gli aspetti contemporaneamente: diversi video e diverse lingue. Questi due elementi si comportano in modo diverso, e capire la distinzione permette di risparmiare molti clic.

| Cosa hai | Struttura del lavoro | Come eseguirlo |
| --- | --- | --- |
| Un video, otto lingue | Otto file, otto lavori | Un lavoro per lingua, in loop |
| Dodici episodi, una lingua | Dodici file, un lavoro | Inseriscili in un unico ZIP |
| Dodici episodi, otto lingue | Otto ZIP, otto lavori | Un ZIP per lingua, in loop |

**Il file ZIP è l'elemento che spesso sfugge.** Un'intera serie in una sola lingua può essere caricata come archivio unico: fino a 200 file, 20 MB per l'archivio e 4 MB per file, tradotti in un unico passaggio con un'unica istruzione e un solo glossario applicato a ogni episodio. I file di sottotitoli non hanno uno schema condiviso da violare, quindi episodi di diversa durata possono convivere tranquillamente nello stesso archivio.

Le lingue non possono essere accorpate in questo modo. Qualunque strada tu scelga, il numero di lavori coinciderà con il numero di lingue.

## Il metodo tramite browser e quando è quello giusto

Carica il file nella [pagina del traduttore SRT](/it/file-formats/srt-translation) o nell'app, scrivi una frase con le tue istruzioni, leggi il piano, approvalo e scarica il risultato. Poi ripeti l'operazione per la lingua successiva.

Per una o due lingue questa è decisamente la soluzione più rapida, e non c'è motivo di aprire un terminale. Con otto lingue si trasformano in otto upload, otto istruzioni, otto piani, otto approvazioni e otto download, e gli errori diventano di natura amministrativa: il file tedesco salvato sopra quello francese, una lingua che scompare silenziosamente.

## La strada dell'agente: un prompt per l'intero set

Se lavori già con Claude, ChatGPT, Cursor o qualsiasi altro agente AI in grado di eseguire comandi sulla tua macchina, non devi toccare il browser. Il nostro strumento a riga di comando effettua l'accesso una sola volta e gestisce il file direttamente, così un agente può eseguire l'intero set e lasciarti una cartella con un file di sottotitoli per ogni lingua.

*Illustration: Le stesse otto lingue, gestite una alla volta o inviate a un agente in un unico prompt.*

Installalo ed effettua l'accesso una sola volta:

```bash
npm install --global @ai-glot/cli
aiglot auth login
```

Questo aprirà il browser per autorizzare la macchina. Su un server senza browser, `aiglot auth login --device` attiva il flusso tramite codice dispositivo, mentre `aiglot auth login --key <key>` funziona in CI.

### Il prompt da dare al tuo agente

Incolla questo testo, modificando il percorso e l'elenco delle lingue. È scritto per essere consegnato a un agente, non per essere eseguito manualmente.

```
My English subtitles are at ~/Videos/episode-04.srt, exported from YouTube.

Translate them into Spanish, Portuguese, French, German, Italian, Japanese,
Hindi and Indonesian using the aiglot CLI. Read `aiglot batches create --help`
and `aiglot batches approve --help` first so you use the real flags, and run
`aiglot languages` to confirm each language tag before you start.

An SRT holds one language, so create ONE batch per target language, eight in
total. The source language is English: say so explicitly in every instruction
rather than letting it be inferred.

Use the lite quality tier. Add "keep every subtitle line under 42 characters
and never merge or split cues" as the string-level instruction at approval.

Show me all eight plans and the total word count and cost BEFORE you approve
anything. Then wait for me to confirm.

After I confirm, approve them, poll until each one reaches a terminal status,
and download the results into ~/Videos/subtitles/ as episode-04.<lang>.srt
using the two-letter code for each language. Tell me if any batch failed.
```

Quattro elementi di quel prompt svolgono il lavoro reale, e sono le parti che vale la pena copiare nelle tue istruzioni.

**Dice all'agente di leggere prima l'aiuto.** Un agente che indovina i nomi dei flag fallisce alla prima chiamata e poi inventa una ragione plausibile. Leggere l'aiuto reale, o `aiglot help --json` per l'intero albero dei comandi in una volta sola, elimina completamente il problema.

**Specifica chiaramente un batch per lingua.** Un agente che presume un unico lavoro con otto target scriverà un'istruzione che il formato non può rispettare, e un file di sottotitoli che doveva essere in giapponese tornerà in un'altra lingua.

**Indica la lingua di partenza.** Senza di essa, il motore deduce la lingua dal contenuto, e tale deduzione è meno affidabile proprio dove conta di più: righe brevi, file che contengono già una frase tradotta casuale e testi pieni di nomi.

**Mette un freno prima della spesa.** `aiglot batches approve` è l'unico comando che consuma crediti. Tutto ciò che precede è gratuito e ripetibile, quindi chiedere di vedere prima otto piani non costa nulla e previene malintesi costosi.

### Cosa esegue effettivamente l'agente, per lingua

*Illustration: I quattro passaggi, ripetuti per ogni lingua. Solo l'approvazione consuma crediti, quindi ogni piano permette la lettura gratuita.*

Quattro comandi, ripetuti per ogni lingua. Come ciclo shell appare così, che è all'incirca ciò che il tuo agente finirà per fare:

```bash
# "code:Language" pairs, so the filename gets the code and the instruction
# gets the language name.
for pair in es:Spanish pt:Portuguese fr:French de:German \
            it:Italian ja:Japanese hi:Hindi id:Indonesian; do
  code=${pair%%:*}
  lang=${pair#*:}

  id=$(aiglot batches create ~/Videos/episode-04.srt \
        --instruction "The source language is English. Translate the text of every cue into ${lang}. Leave cue numbers and timecodes exactly as they are." \
        --json | jq -r '.data.id')

  # Read the plan for free, and only then commit.
  aiglot batches get "$id" --json | jq '.data.plan'

  aiglot batches approve "$id" --quality lite \
    --instructions "Keep every subtitle line under 42 characters. Never merge or split cues."

  # Wait for a TERMINAL status, not for a specific one.
  until status=$(aiglot batches get "$id" --json | jq -r '.data.status'); \
    [ "$status" = "completed" ] || [ "$status" = "failed" ] || [ "$status" = "cancelled" ]; do
    sleep 5
  done

  [ "$status" = "completed" ] && \
    aiglot batches download "$id" --output ~/Videos/subtitles/episode-04.${code}.srt
done
```

C'è un dettaglio in questo passaggio che vale la pena rubare anche se non traduci mai un sottotitolo. **Il ciclo attende qualsiasi stato del terminale invece di monitorare solo `completed`.** Uno script che attende solo lo stato sperato rimarrà in attesa all'infinito in caso di errore, perché un confronto con un valore che non arriva mai non è un errore. È semplicemente sempre falso.

Esiste anche un server MCP, `aiglot mcp`, se il tuo agente preferisce gli strumenti al shell. La CLI è il punto di partenza migliore: funziona in uno script, funziona in CI e puoi leggere esattamente cosa è stato eseguito.

## Le due istruzioni che spesso vengono confuse

Questa distinzione è l'unica cosa in tutto il flusso di lavoro che può fallire silenziosamente, quindi merita trenta secondi di attenzione.

**L'istruzione del piano decide cosa viene tradotto.** Viene letta una sola volta, in base alla struttura del file, ed è qui che va inserita la lingua di destinazione. "Traduci il testo di ogni cue in tedesco".

**Le istruzioni a livello di stringa vengono applicate mentre ogni riga viene scritta.** Il motore vede una riga di sottotitoli alla volta, quindi queste possono descrivere solo elementi visibili all'interno di una riga. Lunghezza della riga, tono, un nome che non deve essere toccato.

Una regola sulla lunghezza delle righe inserita nel piano non serve a nulla, e un'istruzione come "traduci solo la seconda metà del file" inserita a livello di stringa non ha alcun effetto, perché in quel momento non c'è alcun file visibile. Non riceverai errori: otterrai semplicemente un risultato che ignora le tue indicazioni.

## Mantenere i nomi identici in un'intera serie

Otto lingue per dodici episodi significano novantasei file, e il problema non è la grammatica. Il problema è che il tuo prodotto si chiama in un modo nell'episodio due e in un altro nell'episodio nove.

*Illustration: Un glossario definisce i termini che non devono cambiare e applica la stessa scelta a ogni file.*

Inserisci una sola volta in un workspace [glossario](/it/blog/build-translation-glossary-brand) i termini che non devono cambiare: nomi di prodotti, nomi di personaggi, la traduzione ufficiale di una frase che ripeti in ogni intro. Verrà quindi applicata a ogni file in ogni lingua, incluso l'episodio che pubblicherai il mese prossimo.

È qui che un traduttore automatico generico fatica, e il motivo è meccanico. Il suo glossario sostituisce un termine ovunque corrisponda, quindi la frase intorno alla sostituzione non viene riconsiderata. In questo caso, il glossario viene integrato come significato durante la scrittura della riga, così il termine si flette all'interno della frase invece di essere semplicemente calato al centro di essa.

## Caricare il set su YouTube

In Studio, aggiungi una lingua al video, quindi carica il relativo file. Fallo per il primo, guarda trenta secondi del video con quella traccia attiva e controlla due cose: che una riga lunga non sia diventata un muro di testo e che il timing sia ancora corretto anche se il testo si è allungato. Il testo tradotto è solitamente più lungo del 15-30% rispetto all'inglese, ed è esattamente ciò da cui ti protegge l'istruzione sulla lunghezza della riga.

Poi carica tutto il resto.

## Cosa ottieni concretamente

Due cose separate, ed è opportuno distinguerle perché le prove a supporto sono diverse.

### La scopribilità, che è il motivo per tradurre

Questo dato arriva direttamente da YouTube. **"In media, oltre i due terzi del tempo di visualizzazione del pubblico di un creator provengono da aree esterne a quella di origine."** È un dato di YouTube, riportato nella sua [pagina sugli strumenti di traduzione](https://support.google.com/youtube/answer/4792576), ed è il numero più utile di questo articolo: la maggior parte del tuo pubblico si trova già altrove.

Il meccanismo è spiegato nella stessa pagina. Titoli e descrizioni tradotti **possono apparire nei risultati di ricerca di YouTube per gli spettatori che parlano quelle lingue**, e un utente che cerca nella propria lingua può trovare e guardare qualsiasi video che abbia sottotitoli leggibili. Un video con una sola traccia inglese è scopribile in una lingua. Un video con nove tracce è scopribile in nove.

Quindi traduci anche il titolo e la descrizione, non solo i sottotitoli. Sono gli elementi che compongono il risultato di ricerca, e sono solo tre righe di testo a fronte di un'ora di parlato.

### L'accessibilità, che è il motivo per aggiungere i sottotitoli

I sottotitoli non sono un optional per molte persone. L'Organizzazione Mondiale della Sanità riferisce che **più di 1,5 miliardi di persone convivono con un certo grado di perdita dell'udito**, di cui 430 milioni hanno una perdita tale da richiedere riabilitazione, con previsioni di [2,5 miliardi entro il 2050](https://www.who.int/news/item/02-03-2021-who-1-in-4-people-projected-to-have-hearing-problems-by-2050), ovvero una persona su quattro.

Poi c'è chi sente perfettamente ma preferisce leggere. In un [sondaggio YouGov](https://yougov.com/en-us/articles/45987-american-adults-under-30-watching-tv-subtitles) condotto a luglio 2023 su 1.000 adulti statunitensi, **il 63% degli under 30 ha dichiarato di preferire i sottotitoli attivi** anche guardando contenuti in una lingua che già conoscono. La preferenza aumentava al diminuire dell'età: è il gruppo più giovane quello che li desiderava di più.

E poi c'è chi guarda i video senza audio. In uno studio condotto da Verizon Media e Publicis Media nell'aprile 2019 su 5.616 adulti statunitensi, **l'80% ha dichiarato di essere più propenso a guardare un intero video se i sottotitoli sono disponibili**, e la metà ha affermato che i sottotitoli sono fondamentali perché solitamente guardano i contenuti con il volume spento.

**Sii preciso su cosa provino questi ultimi due numeri**, perché è facile forzarne l'interpretazione. Misurano l'uso dei sottotitoli in una lingua che lo spettatore già parla, quindi sono l'argomento a favore dell'esistenza stessa di una traccia di sottotitoli, non la prova che una traccia in giapponese ti faccia acquisire spettatori giapponesi. Il dato di YouTube citato sopra è quello che riguarda la traduzione. Insieme, concludono semplicemente che una traccia testuale attira l'attenzione, e una traccia testuale nella propria lingua attira l'attenzione in un mercato in cui attualmente non sei presente.

Altri due dati utili, provenienti da ricerche sugli acquisti piuttosto che sulla visione: [CSA Research](https://csa-research.com/Blogs-Events/CSA-in-the-Media/Press-Releases/Consumers-Prefer-their-Own-Language) ha scoperto che il 76% degli acquirenti online preferisce comprare prodotti con informazioni nella propria lingua, e il 40% non acquisterebbe affatto da siti in altre lingue. Se i tuoi video vendono qualcosa, è lo stesso argomento applicato alla fase di pagamento.

## E la traduzione automatica di YouTube?

YouTube può tradurre automaticamente una traccia di sottotitoli per lo spettatore direttamente nel player. È gratuito ed è un'opzione accettabile per tutte quelle lingue di nicchia che non pubblicherai mai in modo professionale.

Tuttavia, non ne hai il controllo. Non scegli le parole, non puoi correggere un termine errato, il risultato non è lo stesso per ogni spettatore e il file non esiste in un formato che puoi riutilizzare. Una traccia caricata funziona diversamente: appare nel menu dei sottotitoli del tuo video, dice esattamente ciò che hai deciso tu e lo stesso file funziona su ogni altra piattaforma dove pubblichi il video.

Usa la traduzione automatica per le lingue su cui non stai investendo. Carica tracce reali per quelle su cui stai puntando.

## L'ambito reale di questo strumento

Per un singolo video breve in una sola lingua, una persona che parla quella lingua farà un lavoro migliore di qualsiasi strumento: rivolgiti a lei.

Per otto lingue distribuite su un intero catalogo, la gestione dei file rappresenta il costo maggiore, e non si tratta di lavoro linguistico. Elabora il grosso con AI Glot, poi concentra la revisione dove è davvero utile: sulle lingue più importanti per il tuo pubblico e sui video che vendono effettivamente qualcosa. Molti team lo usano per una prima bozza e poi fanno leggere il risultato a un madrelingua: è un ottimo modo di impiegare un esperto, invece di sprecare un pomeriggio a rinominare file.

Se vuoi provarlo su un singolo episodio prima di procedere con l'intera serie, il [traduttore di sottotitoli](/it/file-formats/srt-translation) accetta file anche senza account. Poi [crea un account gratuito](https://app.ai-glot.com/signup) quando sarai pronto a elaborare l'intero set.

---

*I limiti indicati qui sono quelli in vigore al momento della stesura: 4 MB per file SRT e, per gli archivi di file di sottotitoli, 200 file e 20 MB. Il conteggio delle parole, dei cue e i costi dipendono sempre dal piano per il tuo file, che è gratuito da produrre e gratuito da correggere.*