Generator napisów
Wczytaj wideo i pozwól, aby rozpoznawanie mowy przygotowało napisy za Ciebie — potem popraw dowolną linijkę ręcznie, pobierz wynik jako plik .srt lub .vtt albo wypal tekst prosto w obrazie. Wszystko dzieje się na Twoim własnym urządzeniu; Twoje wideo nigdy nie opuszcza komputera.
Jak działa ten generator napisów
Model rozpoznawania mowy działa w Twojej przeglądarce i odsłuchuje ścieżkę dźwiękową Twojego wideo — nic nie jest przesyłane, więc wywiad, wykład czy film rodzinny zostaje na Twoim komputerze. Model zapisuje pierwszy szkic z gotowymi czasami początku i końca; Ty go czytasz, poprawiasz w razie potrzeby nazwisko lub termin techniczny i wybierasz, jak napisy mają wyjść: jako osobny plik .srt lub .vtt, który platformy takie jak YouTube przyjmują bezpośrednio, albo wypalone w obrazie, dzięki czemu tekst odtwarza się wszędzie — także w aplikacjach, które ignorują pliki z napisami. Odtwarzacz podglądu nad edytorem pokazuje Twoje linijki dokładnie tak, jak wyrenderuje je prawdziwy odtwarzacz, i aktualizuje się na żywo podczas pisania.
Jak dobre są automatyczne napisy?
Wystarczająco dobre, by naprawdę oszczędzać czas, i na tyle niedoskonałe, że trzeba je przeczytać. Wyraźna mowa wychodzi w dużej mierze słowo w słowo, z użytecznymi czasami; nazwiska, żargon i osoby mówiące jedna przez drugą częściej wychodzą błędnie. Traktuj wynik jak solidny pierwszy szkic: przejrzyj każdą linijkę przed publikacją — dokładnie do tego służy edytor pod odtwarzaczem.
Jakie języki rozumie?
Model mowy rozumie kilkadziesiąt języków mówionych — lista obejmuje popularne języki europejskie, a jeśli zostawisz pole wyboru bez zmian, język zostanie rozpoznany automatycznie. Jest też opcja tłumaczenia, która zamienia dowolny język mówiony bezpośrednio na angielskie napisy w jednym przebiegu. Sam tekst napisów możesz oczywiście przepisać na dowolny język.
SRT czy VTT — którego potrzebuję?
SRT to starszy, uniwersalny format: przyjmują go odtwarzacze wideo, programy do montażu i większość formularzy przesyłania. VTT to format natywny dla sieci, używany przez odtwarzacze HTML5 i przeglądarki. W obu przypadkach treść to te same napisy, więc w razie wątpliwości wybierz SRT — a jeśli strona wyraźnie prosi o WebVTT, wybierz VTT. Oba pliki do pobrania powstają z dokładnie tych samych linijek, które edytujesz.
Wypalić napisy czy zostawić je w osobnym pliku?
Osobny plik to elastyczny wybór: widzowie mogą włączać i wyłączać napisy, platformy indeksują tekst, a literówkę poprawisz bez ponownego kodowania wideo. Wypalenie sprawia, że tekst staje się częścią obrazu — odtwarza się absolutnie wszędzie, dlatego klipy do mediów społecznościowych są zwykle wypalane. Wielu twórców robi jedno i drugie: przesyłają plik tam, gdzie się da, a wypalają dla platform, które pliki ignorują.
Czy moje wideo jest gdzieś przesyłane?
Nie. Rozpoznawanie mowy, edycja i wypalanie odbywają się w Twojej przeglądarce, na Twoim własnym urządzeniu. Gdy pierwszy raz naciśniesz przycisk generowania, model mowy pobierze się jednorazowo (około 77 MB) i przeglądarka go potem zachowa — to model przychodzi do Twojego wideo, a Twoje wideo nigdzie nie wychodzi.
Czy mogę zrobić napisy w kilku językach do jednego wideo?
Taki tryb pracy mieszka w CBCOM Video Studio: tam jeden zestaw czasów obsługuje dowolną liczbę języków, więc transkrybujesz raz i wpisujesz tłumaczenia do tych samych czasów. Ta strona celowo trzyma się jednej ścieżki napisów — jedno wideo, jeden język, gotowe.
Jak dodać napisy do filmu, krok po kroku
Tworzenie napisów oznaczało kiedyś albo płacenie usłudze za każdą minutę, albo ręczne wpisywanie znaczników czasu do pliku tekstowego. Rozpoznawanie mowy to zmieniło: dziś uczciwy sposób pracy to wygeneruj, popraw, wyeksportuj — niech maszyna wykona żmudne dziewięćdziesiąt procent roboty, a własną uwagę poświęć tym dziesięciu procentom, w których się myli. Dokładnie tak, od góry do dołu, ułożona jest ta strona.
Dlaczego napisy są warte zachodu
Zdecydowana większość krótkich filmów w mediach społecznościowych jest oglądana bez dźwięku — bez tekstu Twój przekaz po prostu nie dociera. Napisy otwierają też Twoje wideo dla widzów niesłyszących i słabosłyszących, dla każdego, kto ogląda w drugim języku, oraz dla wyszukiwarek, które potrafią czytać wyłącznie tekst. Film z napisami jest oglądany dłużej, rozumiany lepiej i znajdowany częściej; kilka minut pracy zwraca się przy każdym pojedynczym wyświetleniu.
Jak uzyskać czysty pierwszy szkic
Jeśli znasz język mówiony, wybierz go samodzielnie, zamiast polegać na automatycznym rozpoznawaniu — to usuwa jedno źródło błędów. Mowa na tle głośnej muzyki, kilka osób mówiących naraz i mocny dialekt to trudne przypadki; spodziewaj się tam większej liczby poprawek. Jeśli Twoje wideo jest w innym języku, a chcesz angielskich napisów, zaznacz opcję tłumaczenia — model wykona obie prace w jednym przebiegu.
Edytuj jak profesjonalista
Trzymaj linijki krótkie — jedna do dwóch linijek na ekranie, mniej więcej czterdzieści znaków w linijce — i nie pozwól, by którakolwiek wisiała krócej niż sekundę, bo oko nie zdąży jej uchwycić. Czytaj tekst na odtwarzaczu nad edytorem: renderuje on Twoje linijki dokładnie tak, jak zrobi to prawdziwy odtwarzacz. Najpierw popraw nazwiska i terminy techniczne (to najczęstsze błędy), a potem sprawdź, czy zdania nie łamią się w niezręcznych miejscach. Pola czasu przyjmują zarówno zapis 1:23.45, jak i zwykłe sekundy, a przecinek działa jako znak dziesiętny.
Wybierz właściwy eksport
Przesyłasz na YouTube lub inną platformę z obsługą napisów? Pobierz plik .srt i prześlij go obok wideo — widzowie zachowują możliwość włączania i wyłączania napisów, a Ty możesz w każdej chwili podmienić plik. Publikujesz na platformie, która ignoruje pliki z napisami, albo wysyłasz klip bezpośrednio? Użyj przycisku wypalania: narzędzie odtworzy Twoje wideo raz w czasie rzeczywistym i nagra tekst prosto w obrazie, dzięki czemu będzie widoczny wszędzie, na każdym ekranie, na zawsze.
