Problemen oplossen 6 min. leestijd

Waarom je audio niet synchroon loopt met je video

Een audiotrack die uitloopt is een lengteprobleem, geen sync-fout. Dezelfde zin duurt in elke taal langer, en schuiven in de tijdlijn lost dat niet op.

Je nagesynchroniseerde audio is waarschijnlijk niet verkeerd uitgelijnd. Het heeft gewoon een andere lengte dan je origineel, en dat is een vertaalprobleem in plaats van een technische fout.

Dezelfde zin neemt in verschillende talen een verschillende hoeveelheid tijd in beslag. Vertaal een Engelse zin van 12 seconden getrouw naar het Duits en je krijgt geen Duitse zin van 12 seconden, maar iets dat langer is. Doe dat vijftig keer in een video en het verschil loopt op, waardoor de eerste minuut prima klinkt en de laatste minuut zichtbaar achterloopt.

Daarom helpt het nooit om het audiofragment op een tijdlijn naar links te slepen. Je kunt het begin uitlijnen of het einde, maar niet allebei, omdat de twee bestanden niet even lang zijn.

Waarom heeft de nagesynchroniseerde audio een andere lengte?

Talen verschillen in de tijd die ze nodig hebben om dezelfde betekenis over te brengen. Sommige talen verpakken informatie heel compact, terwijl andere meer woorden nodig hebben. Een vertaling die trouw is aan de betekenis, is zelden trouw aan de tijdsduur.

Duits is de taal waarbij dit het meeste opvalt, omdat de zinsbouw en werkwoordplaatsing vaak leiden tot langere gesproken versies van hetzelfde idee. Japans werkt weer heel anders, met een lettergreepstructuur en spreektempo dat een eigen relatie heeft met de timing van het Engels. De richting en de grootte van het verschil hangen af van het specifieke taalpaar en het register: technische uitleg gedraagt zich anders dan een informeel gesprek.

Dit effect stapelt zich op. Een halve seconde extra lengte bij elk van de veertig zinnen zorgt voor twintig seconden verschil aan het einde van de video.

Een audiotrack die met een andere lengte terugkomt, is dus geen foutmelding. Het is het verwachte resultaat van het vertalen van spraak. Elke tool die een nasynchronisatie levert die exact even lang is als je origineel, heeft ergens een keuze gemaakt om dat te bereiken: meestal door de spraak te versnellen, inhoud te schrappen of pauzes in te korten.

Wordt mijn audio ergens in de pipeline opnieuw getimed?

Niet aan onze kant, en het is goed om dit uit te sluiten omdat veel mensen dit aannemen.

We sturen je hele bestand en drie zaken mee: het bestand, de doeltaal en één vinkje. Dat is de volledige aanroep. Geen starttijd, geen eindtijd, geen aantal sprekers, geen splitsing in segmenten, geen trimming per regel. Niets in onze code opent je audio om stukjes ervan te verplaatsen.

Nasynchronisatie is bovendien volledig geautomatiseerd en er wordt achteraf niets met de hand bewerkt. Onze supportpagina vermeldt dit expliciet, wat betekent dat individuele regels niet op verzoek kunnen worden aangepast. Dat is een ongebruikelijke bekentenis voor een leverancier, maar het is wel de eerlijke context voor een pagina als deze: als de timing van één zin verkeerd is, is er geen menselijke stap waarbij iemand dit handmatig corrigeert.

Hoe kan ik zien hoeveel verloop ik werkelijk heb?

Je kunt dit simpelweg aflezen van je eigen factuur, een diagnostisch middel dat de meeste tools je niet geven.

Credits zijn minuten, altijd naar boven afgerond op hele getallen, met een minimum van één per bestand. De functie is: max(1, math.ceil(seconds / 60)). Een bestand van 61 seconden kost dus 2 credits.

Het handige hiervan is wat er gebeurt nadat je een taak bevestigt. We geven je een prijs op basis van de duur die we uit je bestand lezen. Vervolgens geeft de nasynchronisatiedienst de werkelijke gemeten duur terug, en deze twee worden met elkaar verrekend. Als hun versie langer is, wordt het verschil in rekening gebracht; is het korter, dan krijg je het verschil terug. Het aantal credits dat uiteindelijk is afgeschreven, weerspiegelt dus de gemeten audio en niet onze schatting.

Vergelijk dat eens met de lengte van je bronbestand. Een bestand waarvan je dacht dat het 5 minuten zou kosten maar dat uiteindelijk op 6 minuten uitkomt, vertelt je iets over de lengte van de output nog voordat je ernaar hebt geluisterd.

Wat helpt er echt?

Drie dingen, waarbij de eerste vaak wordt overgeslagen.

Zorg voor schone bronaudio met één spreker tegelijk. Dit is het advies op onze supportpagina en dat staat er niet voor niets. Door elkaar pratende mensen, harde achtergrondmuziek en rumoer verslechteren de transcriptie waar alles van afhangt. Een vertaling op basis van een rommelig transcript levert een timing op die slechter is dan wat je op basis van het taalverschil alleen zou verwachten.

Werk in kortere segmenten als timing kritiek is. Verloop stapelt zich op over de lengte van de video. Een segment van 90 seconden kan nooit zoveel uit de pas lopen als een video van 40 minuten. Voor cursusmodules of video's die strak op beeld zijn gemonteerd, houdt het nasynchroniseren per sectie het verloop klein genoeg om op te vangen. Elke taak is één bestand en één doeltaal, dus dit is een bewuste afweging tussen credits en inspanning.

Accepteer dat de track niet op de frame nauwkeurig identiek zal zijn. Als er in je video om 4:12 tekst in beeld verschijnt en de nagesynchroniseerde stem bereikt dat punt pas om 4:19, dan lost geen enkele nasynchronisatietool dat voor je op. Of de montage moet hierop worden aangepast, of de content moet vanaf het begin worden geschreven met nasynchronisatie in het achterhoofd. Content die is gebouwd voor lokalisatie laat meestal wat ademruimte tussen de verschillende punten in plaats van alles strak op de spraak te monteren.

Waar dit het hardst aankomt

Er zijn twee situaties die extra aandacht verdienen. Cursusmateriaal is de meest voor de hand liggende, omdat e-learningmodules vaak strak zijn afgestemd op slides en schermopnames: onze gids over het nasynchroniseren van e-learning van het Nederlands naar het Duits behandelt een taalpaar waar het lengteverschil groot is. Interne communicatie is de andere, en nasynchroniseren van bedrijfsvideo's van het Nederlands naar het Japans behandelt een paar waarbij de timingrelatie weer heel anders is. De volledige set vind je in het overzicht van use-cases.

Veelgestelde vragen

Waarom is mijn nagesynchroniseerde audio langer dan het origineel?

Omdat een getrouwe vertaling van een zin zelden evenveel tijd kost om uit te spreken als het origineel. Het verschil hangt af van het taalpaar en stapelt zich op gedurende de video. Hierdoor kan een track die synchroon begint, aan het einde merkbaar achterlopen.

Kunnen jullie de dub inkorten om bij mijn video te passen?

Nee. De nasynchronisatie verloopt automatisch en er wordt achteraf niets handmatig bewerkt. Individuele regels kunnen daarom niet op verzoek worden ingekort of getimed. Als je video een exacte tijdsduur vereist, is de beste methode om in kortere segmenten te werken en het verschil op te vangen in de videomontage.

Lost lipsynchronisatie dit op?

Lipsynchronisatie zorgt ervoor dat de mondbewegingen overeenkomen met de klanken. Dat is een ander probleem dan de totale lengte van de track. Een nagesynchroniseerde track van een langere vertaling blijft langer, ook met lipsynchronisatie. De lengte van de audio is het probleem dat je als eerste moet oplossen.

Moet ik mijn video splitsen voor het nasynchroniseren?

Ja, als de timing ten opzichte van de beelden belangrijk is. Verloop stapelt zich op bij langere bestanden; kortere fragmenten wijken minder af en kunnen onafhankelijk van elkaar worden gecontroleerd. Houd er rekening mee dat elk segment een aparte taak is. Omdat credits per bestand naar boven worden afgerond, kosten tien korte segmenten meer dan één lang bestand van dezelfde totale lengte.

Lees verder

Klaar om wereldwijd te gaan?

Begin vandaag nog met het vertalen van je audio- en videobestanden naar 32 talen.

Start nu met nasynchroniseren