Alle Beiträge
ProduktVeröffentlicht

KI-Voice-over in LectureGuru: Stimmwahl und Anpassung

Erfahren Sie, wie KI-Voice-over in LectureGuru funktioniert — von Sprechertexten pro Folie über Stimmwahl und Sprachunterstützung bis zur Anpassung.

LectureGuru TeamLectureGuru Team
8 Min. Lesezeit

Ein Voice-over aufzunehmen bedeutete früher, ein Studio zu buchen, eine Sprecherin oder einen Sprecher zu engagieren oder einen Nachmittag lang Aufnahme um Aufnahme vor dem Mikrofon zu machen. Änderte sich der Quellinhalt — etwa durch eine aktualisierte Richtlinie, eine Überarbeitung der Softwareoberfläche oder eine regulatorische Änderung — musste der Kommentar vollständig neu aufgenommen werden. KI-Voice-over verändert diese Gleichung grundlegend. In LectureGuru ist das Voice-over eine Stufe einer automatisierten Produktionskette: Sobald sich Ihr Quellinhalt ändert, kann der Kommentar automatisch neu erzeugt werden. Keine erneuten Aufnahmetermine. Keine Studiozeit.

Dieser Leitfaden erklärt, wie KI-Voice-over in LectureGuru funktioniert, wie Sie eine Stimme auswählen und anpassen und wie Sie mit automatisch erzeugten Sprechertexten die besten Ergebnisse erzielen.

Was ist KI-Voice-over bei der Videogenerierung?

KI-Voice-over bei der Videogenerierung ist die automatische Umwandlung eines geschriebenen Sprechertexts in gesprochene Audiodaten mithilfe hochwertiger neuronaler Sprachsynthese. Der Sprechertext wird aus Ihrem Quellinhalt erstellt — einem Dokument, einer URL oder einer Gliederung — und die Sprach-Engine wandelt ihn in natürlich klingende Sprache um, die mit der zugehörigen Folie synchronisiert ist. Das Ergebnis ist ein vertontes Video ohne menschliche Aufnahme.

In LectureGuru hat jede Folie einer Präsentation ihren eigenen Sprechertext. Die Sprach-Engine verarbeitet die Texte nacheinander und erzeugt eine fertige Audiospur, die im exportierten MP4-Video synchron zu den Folieninhalten abgespielt wird.

So funktioniert das Voice-over in LectureGuru

Der Sprechertext ist in LectureGuru in die Produktionskette integriert und wird nicht erst nach dem Erstellen der Präsentation als separater Schritt hinzugefügt. Wenn Sie eine Präsentation aus einem Dokument, einer URL oder über die KI-Chatoberfläche erzeugen, erhält jede Folie neben ihrem visuellen Inhalt einen eigenen Sprechertext.

Die Produktionskette funktioniert so:

  1. Sie stellen eine Quelle bereit — eine PDF-Datei, eine DOCX-Datei, eine URL oder eine Textanweisung im Chat.
  2. Die KI von LectureGuru erstellt eine strukturierte Gliederung mit Folien. Jede Folie enthält sowohl visuellen Inhalt (Titel, Fließtext, visuelle Elemente) als auch ein Skriptfeld — den gesprochenen Kommentar für diese Folie.
  3. Die Sprach-Engine wandelt jeden Sprechertext mit der von Ihnen gewählten Stimme in Audio um. Dies geschieht im Hintergrund, sodass Sie weiterarbeiten können, während das Audio erzeugt wird.
  4. Die Audiospuren werden mit den Folien synchronisiert und in das exportierte MP4-Video eingebettet.

Der entscheidende Unterschied zu eigenständigen Text-zu-Sprache-Videotools besteht darin, dass der Sprechertext kein Nachbearbeitungsschritt ist, den Sie auf eine fertige Präsentation anwenden. Er wird im selben KI-Durchlauf wie die Folieninhalte erstellt. Dadurch sind gesprochener und visueller Inhalt von Anfang an darauf ausgelegt, einander zu ergänzen.

Wenn Sie die Webüberwachung für eine Quell-URL aktivieren, kann LectureGuru Änderungen an der Quelle erkennen und sowohl Folien als auch Sprechertext automatisch neu erzeugen. Der aktualisierte Videoentwurf steht dann zur Prüfung bereit — ohne erneute Aufnahme und ohne manuelle Synchronisierung. Weitere Einzelheiten zu diesem Aktualisierungszyklus finden Sie unter So halten Sie Schulungsvideos automatisch aktuell.

Voice-over aktivieren

Voice-over wird beim Erstellen konfiguriert, entweder über den KI-Chat oder über die Präsentationseinstellungen. Wenn Sie eine neue Präsentation beginnen, können Sie festlegen, dass Voice-over aktiviert werden soll. Die KI erzeugt dann im selben Durchlauf Sprechertexte für jede Folie.

Im Format für interaktive Folien lässt sich Voice-over in den Präsentationseinstellungen ein- und ausschalten. Bei aktiviertem Voice-over startet nach Abschluss der Foliengenerierung im Hintergrund die Aufgabe zur Audioerzeugung. Der Editor zeigt den Audiostatus an, sodass Sie wissen, wann der Kommentar für Wiedergabe oder Export bereit ist.

Eine Stimme auswählen

LectureGuru stellt eine kuratierte Auswahl von Sprecherstimmen mit unterschiedlichen Eigenschaften bereit. Jede Stimme ist für professionelles Voice-over statt für allgemeine Sprachausgabe ausgelegt. Daher bewältigen sie Tempo, Betonung und längere Inhalte besser als einfache Text-zu-Sprache-Stimmen.

Berücksichtigen Sie bei der Stimmwahl den Ton, der zu Ihrem Inhalt passt:

Arabella — eine weibliche Stimme mit britischem Akzent. Sie wird als geheimnisvoll und emotional beschrieben und eignet sich gut für Inhalte, die von einer autoritativeren oder fesselnden Darbietung profitieren. Dies ist die Standardstimme der Plattform.

Bradley — eine männliche Stimme mit amerikanischem Akzent. Ein aufrichtiger, warmer Bariton, der sich für längere Kommentare wie Schulungsmodule oder detaillierte Schritt-für-Schritt-Anleitungen eignet.

Nichalia — eine weibliche Stimme mit amerikanischem Akzent. Ihr Ton ist sanft und zugänglich; damit passt sie natürlich zu Onboarding-Inhalten und Erklärvideos, bei denen sich die Zuschauenden wohlfühlen sollen.

Chris Brift — eine männliche Stimme mit britischem Akzent, beschrieben als vielseitiger mehrsprachiger Sprecher mit einem konsistenten Ton über unterschiedliche Inhaltstypen hinweg.

Die Stimmwahl gilt auf Präsentationsebene, das heißt, alle Folien einer Präsentation verwenden dieselbe Sprecherstimme. Sie können jede Stimme vor Ihrer Entscheidung vorhören. Für den Workflow Magic Demo Video — bei dem der KI-Agent von LectureGuru Ihre Anwendung automatisch durchläuft und den Ablauf aufzeichnet — steht eine separate Stimmwahl zur Verfügung, deren Stimmen nach Sprachen geordnet sind.

Sprachunterstützung

Die Sprach-Engine von LectureGuru nutzt ein mehrsprachiges Synthesemodell. Das heißt, dieselben Stimmen können Kommentare in mehreren Sprachen erzeugen, ohne dass für jedes Gebietsschema eine eigene sprachspezifische Stimme erforderlich ist. Die Sprach-Engine erkennt die Sprache anhand des Sprechertexts und verwendet die passende Aussprache.

Die Plattform unterstützt Englisch und Slowakisch ausdrücklich, einschließlich eigener slowakischer Stimmen (Sara und Marek), die im Workflow Magic Demo Video verfügbar sind. Für die interaktiven Stimmen stehen ebenfalls slowakische Vorschauen zur Verfügung. Tschechisch, Türkisch und weitere Sprachen, die das zugrunde liegende mehrsprachige Modell unterstützt, können in derselben Produktionskette vertont werden.

Diese Mehrsprachigkeit ist besonders für Organisationen in mitteleuropäischen Märkten relevant: Compliance-Inhalte, Onboarding-Materialien und Produktdokumentationen können auf Slowakisch oder Tschechisch erstellt werden, ohne muttersprachliche Sprecher oder Lokalisierungsagenturen zu beauftragen. Die Umwandlung von Dokumenten in Videos folgt in diesen Sprachen demselben Ablauf wie bei englischen Inhalten. Den allgemeinen Prozess finden Sie unter So wandeln Sie eine PDF-Datei in ein Video um.

Den Text des Sprecherkommentars anpassen

Der KI-generierte Sprechertext für jede Folie lässt sich bearbeiten. Wenn der automatisch erstellte Text zu dicht ist, nicht den richtigen Stil verwendet oder die Terminologie Ihrer Organisation berücksichtigen muss, können Sie ihn direkt im Editor anpassen.

Das Skriptfeld ist im Eigenschaftenbereich der Folie sichtbar, sobald Sie eine Folie ausgewählt haben. Änderungen am Text werden wirksam, wenn das Audio für diese Folie das nächste Mal erzeugt wird.

Im Magic-Demo-Video-Editor hat jedes Segment der Bildschirmaufnahme einen eigenen Sprechertext. Der Segmenteditor zeigt den Kommentar zusammen mit dem entsprechenden Bildschirminhalt. So können Sie prüfen und anpassen, was bei jedem Schritt der Anleitung gesprochen wird.

Audio nach Änderungen neu erzeugen

Nachdem Sie einen Sprechertext bearbeitet haben, können Sie das Audio für diese einzelne Folie oder dieses Segment neu erzeugen, ohne die ganze Präsentation erneut auszuführen. Das ist für die schrittweise Verfeinerung wichtig: Sie passen den Wortlaut einer Folie an, erzeugen ihr Audio neu und exportieren das Ergebnis, ohne den Rest der Präsentation anzutasten.

Für Magic Demo Video steht im Segmenteditor eine Option zur Neugenerierung pro Segment ("Regen Audio") zur Verfügung. Damit können Sie den Sprechertext schrittweise verfeinern, statt bei jeder Änderung den gesamten Ablauf erneut zu erzeugen.

Wenn sich der Quellinhalt ändert und LectureGuru über die Webüberwachung eine Aktualisierung erkennt, wird das Voice-over im Rahmen der Aktualisierungspipeline automatisch neu erzeugt. Das neu erzeugte Audio basiert auf dem aktualisierten Sprechertext, der zum neuen Quellinhalt gehört.

Praxistipps für bessere Sprechertexte

Halten Sie Sprechertexte pro Folie kurz. Der Sprechertext einer Folie sollte den Kernpunkt dieser Folie abdecken, nicht die gesamte Präsentation zusammenfassen. Kürzere, fokussierte Texte führen zu prägnanterem Audio, das mit dem Folieninhalt synchron bleibt.

Schreiben Sie fürs Hören, nicht fürs Lesen. Automatisch erzeugte Texte übernehmen manchmal die Förmlichkeit schriftlicher Dokumente. Lesen Sie die Texte bei der Bearbeitung gedanklich laut: Entfernen Sie Passivkonstruktionen, kürzen Sie Sätze und verwenden Sie, wo passend, natürliche verkürzte Formen. Audio, das beim Sprechen natürlich klingt, bindet Zuschauende wirksamer.

Passen Sie den Stimmton dem Inhaltstyp an. Onboarding-Inhalte und Erklärvideos profitieren von den wärmeren Tönen von Nichalia oder Bradley. Für Compliance- und regulatorische Inhalte kann die autoritativere Darbietung von Arabella oder Chris Brift geeigneter sein. Hören Sie die Stimmen vor der endgültigen Wahl anhand eines Beispieltexts aus Ihrem tatsächlichen Inhalt an.

Nutzen Sie das mehrsprachige Modell für nicht englische Inhalte. Wenn Ihre Organisation Inhalte auf Slowakisch, Tschechisch oder in einer anderen unterstützten Sprache erstellt, legen Sie vor der Generierung die Standardsprache des Projekts fest. Die KI erstellt Folieninhalte und Sprechertexte in der Zielsprache, und die Sprach-Engine gibt sie natürlich wieder.

Lassen Sie das Audio im Hintergrund erzeugen. Die Sprachausgabe läuft als Hintergrundaufgabe. Sie müssen nicht warten, bis das Audio fertig ist, bevor Sie Folien oder visuelle Inhalte weiterbearbeiten. Der Editor zeigt den Audiostatus, während die Erzeugung läuft.

Häufig gestellte Fragen

Welche Sprachen werden für Voice-over unterstützt?

Englisch und Slowakisch werden vollständig und mit eigenen Stimmen unterstützt. Das mehrsprachige Synthesemodell, auf dem die Sprach-Engine von LectureGuru basiert, unterstützt eine große Bandbreite europäischer und globaler Sprachen. Wenn Ihr Quellinhalt in einer unterstützten Sprache vorliegt, wird der Kommentar in dieser Sprache mit der ausgewählten Stimme erzeugt.

Kann ich für verschiedene Folien derselben Präsentation verschiedene Stimmen verwenden?

Die Stimmwahl gilt derzeit auf Präsentationsebene — dieselbe Sprecherstimme vertont alle Folien. Wenn Sie für unterschiedliche Inhaltsbereiche verschiedene Stimmstile benötigen, sollten Sie diese als getrennte Präsentationen strukturieren.

Was geschieht mit dem Sprechertext, wenn sich der Quellinhalt ändert und die Webüberwachung eine Aktualisierung erkennt?

Wenn LectureGuru eine Änderung an einer überwachten Quelle erkennt, erstellt es einen aktualisierten Foliensatz mit neuen Sprechertexten und rendert das Audio erneut. Die aktualisierte Version wird vor der Veröffentlichung als Entwurf zur Prüfung vorgelegt. Das erspart die erneute Aufnahme bei Inhalten, die sich regelmäßig ändern: Ihre Richtlinie, Ihre Produktdokumentation oder Ihre regulatorischen Referenzen sind die maßgebliche Quelle, und das vertonte Video bildet sie automatisch ab.

Kann ich das vertonte Video für ein LMS exportieren?

Ja. Der MP4-Export erzeugt eine vertonte Videodatei, die sich zum Hochladen in jedes LMS oder auf jede Video-Hosting-Plattform eignet. Der Export der interaktiven Webpräsentation enthält ebenfalls Voice-over und eignet sich für selbstgesteuerte Lernszenarien mit Foliennavigation und optionalen Quiz-Elementen.


Erstellen Sie vertonte Videos aus Ihren Inhalten

KI-Voice-over ist eine Stufe der vollständigen Dokument-zu-Video-Produktionskette von LectureGuru. Laden Sie eine PDF-Datei, ein Richtliniendokument, einen Foliensatz oder eine URL hoch. LectureGuru erstellt die Folien, schreibt die Sprechertexte, synthetisiert das Audio und exportiert ein fertiges MP4 — ohne Aufnahmetermin. Ändern sich Ihre Inhalte, kann auch das Voice-over automatisch aktualisiert werden.

Testen Sie LectureGuru kostenlos und erstellen Sie aus Ihrem ersten Dokument innerhalb weniger Minuten ein vertontes Video. Oder erfahren Sie, was KI-Videogenerierung für Ihr Team leisten kann, und erhalten Sie einen umfassenderen Blick auf die gesamte Produktionskette.

Verwandte Artikel

KI-Voice-over in LectureGuru: Stimmwahl und Anpassung