Kapitel 3 von 3

KI-Influencer-Video schneiden, Stimme bei Bedarf

geprüft am 9 Oktober 2026 · 3 Min.

Schnelle Antwort

Eine Stimme ist optional. Wir stellen die Dateien mit Codex fertig: Originalton behalten oder wieder einsetzen, Clips bei Bedarf verbinden und das Ergebnis prüfen. Die nächsten Abschnitte helfen bei einer neuen Sprechzeile oder einer anderen Stimme.

Am Ende dieses Kapitels, kannst du deinen Clip schneiden und exportieren sowie bei Bedarf eine Stimme ergänzen.

Transparenz: Einige Links in diesem Tutorial sind Affiliate-Links. Wenn du darüber ein Abonnement abschließt, kann ich eine Provision erhalten. Die Beispiele und Grenzen stammen aus unseren dokumentierten Versuchen.

Eine Stimme ist optional. Wir stellen die Dateien mit Codex fertig: Originalton behalten oder wieder einsetzen, Clips bei Bedarf verbinden und das Ergebnis prüfen. Die nächsten Abschnitte helfen bei einer neuen Sprechzeile oder einer anderen Stimme.

Höre zuerst ohne Bild zu und prüfe danach mit Bild die Übergänge. Bei Sprache muss der Satz vollständig und über der Musik verständlich sein. Prüfe die Lippen nur, wenn die Figur sichtbar spricht.

Verwende für diese Stufe den Clip nach dem Genjutsu-Austausch.


Die Methode: jede Stufe mit einem geprüften Ergebnis abschließen

Stufe Vorbereitung Wann du weitergehst
Schnitt, optionale Stimme Eine fertige Datei mit Codex und dem gewählten Ton Schnitte, Ton und Export sind geprüft. Spricht die Figur im Bild, prüfe auch den Satz und die Lippen

Die fertige Datei mit Codex vorbereiten

Bei unseren Versuchen half Codex, Originalton wieder einzusetzen und Dateien zusammenzufügen. Wir übernahmen den Ton für Glens kleines Auto und prüften die Dauer. Für die Kussszene verbanden wir eine Verlängerung von fünf Sekunden mit der Musik. Beschreibe deine Dateien und das gewünschte Ergebnis für solche Arbeiten.

  1. Lege Quelle und ausgewähltes Ergebnis mit unterschiedlichen Namen in einen für Codex zugänglichen Ordner.
  2. Lass Dauer und Tonspuren vergleichen. Bitte bei passendem Originalton um dessen Übernahme und um eine Erklärung nötiger Verschiebungen oder Schnitte.
  3. Sieh dir die gesamte MP4 an. Prüfe Anfang, Ende und Übergänge. Bewahre die Quellen für Korrekturen auf.

Passe diese Anweisung an deine Dateinamen an. Codex wählt die nötigen lokalen Arbeitsschritte.

code
Vergleiche source.mp4 und result.mp4 in meinem Ordner. Nenne Dauer, Abmessungen und Tonspuren. Erstelle final.mp4 aus dem ausgewählten Ergebnis mit gleichem Bildausschnitt. Übernimm den Ton von source.mp4, falls er fehlt oder falsch übernommen wurde. Erkläre bei unterschiedlicher Dauer den nötigen Schnitt oder Übergang vorher, ohne die Stimme zu dehnen. Füge keine neue Stimme und keinen Text hinzu. Prüfe Anfang, Ende, Tonsynchronisation und Übergänge. Bewahre die Quellen auf.

Passt der Ton, bist du hier fertig. ElevenLabs ist eine Option für eine neue Stimme oder eine geänderte Sprechzeile. Die nächsten Abschnitte erklären diese Fälle.

Die passende Funktion wählen

Sprachsynthese liest Text vor. Eine Stimmänderung verändert eine Aufnahme. Lippensynchronisation passt die sichtbaren Mundbewegungen an. ElevenLabs bietet Sprachsynthese und Voice Changer. Eine neue Audiospur synchronisiert nicht automatisch das Video.

  1. Schreibe einen kurzen Satz.
  2. Wähle eine Stimme und teste einen Satz.
  3. Prüfe Aussprache, Namen und Pausen.
  4. Wenn der Mund sichtbar ist, synchronisiere und prüfe ihn separat.

Gérards Stimmen vergleichen

Gérards Parodie über KI-Influencer | YouTube

Französischer Dialog, Originalvideo.

Wir testeten Jayce, Jean Maurice und Zion Aquila mit mehreren Fassungen für Timing und Lippen. Die erste öffentliche Parodie kombiniert Genjutsu, erzeugte Sprache und Synchronisation. Jede Stufe hat ihre eigene Aufgabe.

Das spätere fiktive Interview entstand mit Seedance 2.5, Figurenreferenz und eigenem Dialog. Eine lokale VoiceStudio-Aufnahme diente als Stimmreferenz. Die native Sprache des Modells blieb erhalten. Das ist ein anderer Ablauf als nachträglich vertonte Bilder.

Den Schnitt fertigstellen

Behalte nützlichen Umgebungston und senke Musik unter dem Dialog ab. Bei Glens Auto wurde Text mit FLUX entfernt und die Szene für den Kuss verlängert. Die Retusche änderte Auflösung und Dauer. Der Boxfortsatz verwendete nativen Ton. Der gewünschte Ruf blieb ungefähr.

Prüfe die fertige Datei: Gesicht und bei sichtbarer Sprache auch Lippen, Schnitte, Lautstärke, unerwünschten Text, Länge und Hochformat. Naïlas wiederhergestellter Ton lief 0,168 Sekunden über das letzte Bild hinaus. Auch solche kleinen Unterschiede verdienen eine Kontrolle.

Zurück zum Tutorial oder zu den Genjutsu-Prüfungen.

ÜbungExportiere den Clip und sieh ihn vollständig an. Notiere drei Bild- und Tonprüfungen. Teste bei zusätzlicher Sprache zuerst einen kurzen Satz und prüfe die Lippen, wenn die Figur im Bild spricht. Bewahre die ausgewählte Version auf und dokumentiere nötige Korrekturen.
Newsletter

Neue Tests, Tutorials und Projekte, per E-Mail.

Reproduzierbare Tests, versionierter Code, datierte Ergebnisse. Niemals Spam.