Wszystkie artykuły
ProduktOpublikowano

Lektor AI w LectureGuru: wybór i dostosowanie głosu

Dowiedz się, jak działa oprogramowanie lektora AI w LectureGuru — od skryptów narracji dla poszczególnych slajdów, przez wybór głosu i obsługę języków, po dostosowanie.

LectureGuru TeamLectureGuru Team
7 min czytania

Nagranie narracji lektorskiej oznaczało kiedyś rezerwację studia, zatrudnienie narratora albo spędzenie całego popołudnia na nagrywaniu kolejnych dubli przed mikrofonem. Gdy zmieniał się materiał źródłowy — aktualizacja polityki, zmiana interfejsu oprogramowania czy nowelizacja przepisów — narrację trzeba było nagrywać od początku. Oprogramowanie lektora AI całkowicie zmienia tę sytuację. W LectureGuru narracja jest jednym z etapów zautomatyzowanego procesu: gdy tylko zmieni się Twój materiał źródłowy, narracja może zostać wygenerowana ponownie automatycznie. Bez kolejnych sesji nagraniowych. Bez spędzania czasu w studiu.

Ten przewodnik wyjaśnia, jak działa lektor AI w LectureGuru, jak wybrać i dostosować głos oraz jak osiągać najlepsze rezultaty dzięki automatycznie generowanej narracji.

Czym jest lektor AI w generowaniu wideo?

Lektor AI w generowaniu wideo to proces automatycznego przekształcania pisemnego skryptu narracji w nagranie głosowe z wykorzystaniem wysokiej jakości neuronowej syntezy mowy. Skrypt powstaje na podstawie Twojego materiału źródłowego — dokumentu, adresu URL lub konspektu — a silnik głosowy zamienia go w naturalnie brzmiącą mowę zsynchronizowaną z odpowiednim slajdem. Rezultatem jest wideo z narracją, niewymagające nagrania przez człowieka.

W LectureGuru każdy slajd prezentacji ma własny skrypt narracji. Silnik głosowy przetwarza skrypty kolejno i tworzy gotową ścieżkę dźwiękową, która jest odtwarzana synchronicznie z elementami wizualnymi slajdu w wyeksportowanym wideo MP4.

Jak działa narracja w LectureGuru

Narracja w LectureGuru jest wbudowana w proces produkcji, zamiast być dodawana jako osobny krok po utworzeniu prezentacji. Gdy generujesz prezentację z dokumentu, adresu URL lub za pomocą interfejsu czatu AI, każdy slajd otrzymuje dedykowany skrypt narracji obok swojej zawartości wizualnej.

Proces wygląda tak:

  1. Przekazujesz źródło — plik PDF, plik DOCX, adres URL albo polecenie w zwykłym tekście na czacie.
  2. AI LectureGuru generuje uporządkowany konspekt ze slajdami. Każdy slajd zawiera zarówno zawartość wizualną (tytuł, tekst główny, elementy graficzne), jak i pole skryptu — mówioną narrację do tego slajdu.
  3. Silnik głosowy zamienia każdy skrypt w audio przy użyciu wybranego przez Ciebie głosu. Dzieje się to w tle, więc możesz dalej edytować prezentację podczas generowania audio.
  4. Ścieżki audio są synchronizowane ze slajdami i wbudowywane w wyeksportowane wideo MP4.

Kluczowa różnica względem samodzielnych narzędzi wideo zamieniających tekst na mowę polega na tym, że narracja nie jest etapem postprodukcji nakładanym na gotową prezentację. Powstaje w tym samym procesie generowania przez AI co zawartość slajdów, dzięki czemu treść mówiona i wizualna są od początku projektowane tak, aby się uzupełniały.

Jeśli włączysz monitorowanie stron internetowych dla źródłowego adresu URL, LectureGuru może wykryć zmianę źródła i automatycznie wygenerować ponownie zarówno slajdy, jak i narrację. Zaktualizowany szkic wideo będzie gotowy do Twojej oceny — bez ponownego nagrywania i ręcznej synchronizacji. Więcej o tym cyklu aktualizacji przeczytasz w artykule jak automatycznie utrzymywać aktualność filmów szkoleniowych.

Włączanie lektora

Lektora konfiguruje się w momencie tworzenia, przez czat AI lub ustawienia prezentacji. Rozpoczynając nową prezentację, możesz wskazać, że chcesz włączyć lektora. AI wygeneruje skrypty narracji dla każdego slajdu w ramach tego samego procesu generowania.

W formacie interaktywnych slajdów lektora można włączyć lub wyłączyć w ustawieniach prezentacji. Gdy lektor jest włączony, zadanie generowania audio uruchamia się w tle po zakończeniu generowania slajdów. Edytor pokazuje stan audio, dzięki czemu wiesz, kiedy narracja jest gotowa do odtworzenia lub eksportu.

Wybór głosu

LectureGuru oferuje starannie dobrany zestaw głosów lektorskich o różnych cechach. Każdy głos jest przeznaczony do profesjonalnej narracji, a nie do ogólnego zastosowania w syntezie mowy, dlatego lepiej radzi sobie z tempem, akcentowaniem i dłuższą treścią niż standardowe głosy syntezy mowy.

Wybierając głos, weź pod uwagę ton odpowiedni dla Twojej treści:

Arabella — żeński głos z brytyjskim akcentem. Opisywany jako tajemniczy i emocjonalny, dobrze sprawdza się w treściach, którym służy bardziej autorytatywny lub angażujący sposób przekazu. To domyślny głos platformy.

Bradley — męski głos z amerykańskim akcentem. Szczery, ciepły baryton odpowiedni do dłuższej narracji, na przykład modułów szkoleniowych lub szczegółowych instrukcji proceduralnych.

Nichalia — żeński głos z amerykańskim akcentem. Łagodny i przystępny ton sprawia, że jest naturalnym wyborem do materiałów wdrożeniowych i filmów wyjaśniających, których celem jest zapewnienie widzowi poczucia komfortu.

Chris Brift — męski głos z brytyjskim akcentem, opisywany jako wszechstronny wielojęzyczny narrator o spójnym tonie w różnych rodzajach treści.

Wybór głosu jest stosowany na poziomie prezentacji, co oznacza, że wszystkie slajdy danej prezentacji korzystają z tego samego narratora. Przed podjęciem decyzji możesz odsłuchać próbkę każdego głosu. W procesie Magic Demo Video — w którym agent AI LectureGuru porusza się po Twojej aplikacji i automatycznie nagrywa demonstrację — dostępny jest osobny selektor głosów uporządkowanych według języków.

Obsługa języków

Silnik głosowy LectureGuru korzysta z wielojęzycznego modelu syntezy, co oznacza, że te same głosy mogą tworzyć narrację w wielu językach bez potrzeby używania osobnego głosu dla każdego języka. Silnik głosowy wykrywa język na podstawie tekstu skryptu i stosuje odpowiednią wymowę.

Platforma zapewnia wyraźnie określoną obsługę języka angielskiego i słowackiego, w tym dedykowane słowackie głosy Sara i Marek dostępne w procesie Magic Demo Video. Dla głosów używanych w interaktywnych prezentacjach dostępne są również próbki w języku słowackim. W tym samym procesie można tworzyć narrację po czesku, turecku i w innych językach obsługiwanych przez bazowy model wielojęzyczny.

Ta wielojęzyczna funkcja jest szczególnie istotna dla organizacji działających na rynkach Europy Środkowej — treści dotyczące zgodności z przepisami, materiały wdrożeniowe i dokumentacja produktu mogą powstawać po słowacku lub czesku bez zatrudniania rodzimych lektorów ani agencji lokalizacyjnych. Konwersja dokumentów na wideo w tych językach przebiega tak samo jak w przypadku treści angielskich. Ogólny proces opisuje artykuł jak przekonwertować PDF na wideo.

Dostosowywanie tekstu narracji

Skrypt narracji wygenerowany przez AI dla każdego slajdu można edytować. Jeśli automatycznie wygenerowany skrypt jest zbyt przeładowany informacjami, używa niewłaściwego rejestru lub powinien odzwierciedlać terminologię charakterystyczną dla Twojej organizacji, możesz zmienić go bezpośrednio w edytorze.

Pole skryptu jest widoczne w panelu właściwości slajdu po wybraniu slajdu. Zmiany w skrypcie zaczną obowiązywać przy kolejnym generowaniu audio dla tego slajdu.

W edytorze Magic Demo Video każdy segment nagrania ekranu ma własny tekst narracji. Edytor segmentu pokazuje narrację obok odpowiadającej jej zawartości ekranu, dzięki czemu możesz przejrzeć i dostosować to, co jest mówione na każdym etapie demonstracji.

Ponowne generowanie audio po zmianach

Po edycji skryptu narracji możesz wygenerować ponownie audio dla konkretnego slajdu lub segmentu bez ponownego uruchamiania całej prezentacji. Jest to istotne przy iteracyjnym dopracowywaniu: zmień brzmienie jednego slajdu, wygeneruj ponownie jego audio i wyeksportuj rezultat, nie dotykając reszty prezentacji.

Dla Magic Demo Video w edytorze segmentu dostępna jest opcja ponownego generowania dla każdego segmentu ("Regen Audio"). Pozwala ona stopniowo dopracowywać narrację zamiast generować całą demonstrację od nowa przy każdej zmianie.

Gdy zawartość źródłowa się zmienia, a LectureGuru wykryje aktualizację dzięki monitorowaniu stron internetowych, ponowne generowanie narracji uruchamia się automatycznie jako część procesu aktualizacji. Ponownie wygenerowane audio odzwierciedla zaktualizowany skrypt odpowiadający nowej zawartości źródłowej.

Praktyczne wskazówki dla lepszej narracji

Utrzymuj zwięzłość skryptów dla każdego slajdu. Skrypt narracji slajdu powinien obejmować główny punkt tego slajdu, a nie streszczać całą prezentację. Krótsze, skoncentrowane skrypty dają bardziej zwarte audio, które pozostaje zsynchronizowane z zawartością slajdu.

Pisz z myślą o słuchaniu, a nie czytaniu. Automatycznie generowane skrypty czasem zachowują formalność dokumentów pisanych. Edytując je, przeczytaj je w myślach na głos — usuń stronę bierną, skróć zdania i stosuj skrócone formy tam, gdzie to właściwe. Audio brzmiące naturalnie w mowie skuteczniej zaangażuje widzów.

Dopasuj ton głosu do rodzaju treści. Materiały wdrożeniowe i filmy wyjaśniające korzystają z cieplejszych tonów Nichalii lub Bradleya. Treści dotyczące zgodności z przepisami i regulacji mogą skorzystać z bardziej autorytatywnego przekazu Arabelli lub Chrisa Brifta. Przed ostatecznym wyborem odsłuchaj głosy na przykładowym skrypcie z rzeczywistej treści.

Korzystaj z modelu wielojęzycznego dla treści innych niż angielskie. Jeśli Twoja organizacja tworzy treści po słowacku, czesku lub w innym obsługiwanym języku, ustaw domyślny język projektu przed generowaniem. AI przygotuje zawartość slajdów i skrypty narracji w języku docelowym, a silnik głosowy wytworzy je z naturalną wymową.

Pozwól, aby audio generowało się w tle. Synteza głosu jest zadaniem wykonywanym w tle. Nie musisz czekać na zakończenie generowania audio, aby dalej edytować slajdy lub zawartość wizualną. Edytor będzie pokazywać stan audio w trakcie generowania.

Najczęściej zadawane pytania

Jakie języki są obsługiwane dla narracji lektorskiej?

Angielski i słowacki mają pełną natywną obsługę, w tym dedykowane głosy. Wielojęzyczny model syntezy, na którym opiera się silnik głosowy LectureGuru, obsługuje szeroką gamę języków europejskich i globalnych. Jeśli Twój materiał źródłowy jest w obsługiwanym języku, narracja zostanie wygenerowana w tym języku przy użyciu wybranego głosu.

Czy mogę używać różnych głosów dla różnych slajdów w tej samej prezentacji?

Wybór głosu jest obecnie stosowany na poziomie prezentacji — ten sam narrator mówi na wszystkich slajdach. Jeśli potrzebujesz różnych stylów głosu dla różnych części treści, należy utworzyć je jako oddzielne prezentacje.

Co dzieje się z narracją, gdy zmienia się zawartość źródłowa, a monitorowanie stron internetowych wykryje aktualizację?

Gdy LectureGuru wykryje zmianę w monitorowanym źródle, generuje zaktualizowany zestaw slajdów z nowymi skryptami narracji i ponownie syntetyzuje audio. Zaktualizowana wersja jest przedstawiana jako szkic do Twojej oceny przed publikacją. To właśnie eliminuje konieczność ponownego nagrywania materiałów, które regularnie się zmieniają — Twoja polityka, dokumentacja produktu lub odniesienia regulacyjne są źródłem prawdy, a wideo z narracją odzwierciedla je automatycznie.

Czy mogę wyeksportować wideo z narracją do użycia w systemie LMS?

Tak. Eksport MP4 tworzy plik wideo z narracją, który nadaje się do przesłania do dowolnego systemu LMS lub platformy hostingowej wideo. Eksport interaktywnej prezentacji internetowej także zawiera lektora i sprawdza się w nauce we własnym tempie, z nawigacją po slajdach i opcjonalnymi elementami quizu.


Zacznij tworzyć filmy z narracją na podstawie swojej treści

Lektor AI jest jednym z etapów kompletnego procesu LectureGuru przekształcającego dokumenty w wideo. Prześlij PDF, dokument polityki, prezentację slajdów lub adres URL, a LectureGuru wygeneruje slajdy, napisze skrypty narracji, zsyntetyzuje audio i wyeksportuje gotowy plik MP4 — bez potrzeby organizowania sesji nagraniowej. Gdy Twoja treść się zmienia, narracja może aktualizować się automatycznie.

Wypróbuj LectureGuru za darmo i w kilka minut utwórz wideo z narracją na podstawie pierwszego dokumentu. Możesz też sprawdzić, co generowanie wideo przez AI może zrobić dla Twojego zespołu, aby szerzej poznać cały proces.

Powiązane artykuły

Lektor AI w LectureGuru: wybór i dostosowanie głosu