Lokalne środowisko audio

Twórz audiobooki, napisy i dubbing bez ukrywania kolejnych etapów.

Pandrator to lokalne środowisko w przeglądarce do przygotowania źródeł, generowania mowy, przeglądu wyników pośrednich oraz eksportu audio lub wideo.

Windows · Linux · interfejs w przeglądarce

Modele lokalne zachowują źródła i wygenerowane media na Twoim komputerze. Dostawcy zewnętrzni są opcjonalni.

Trzy punkty wyjścia

Wybierz rezultat. Zachowaj możliwość przeglądu etapów.

Pandrator układa proces wokół oczekiwanego wyniku. Pośrednie teksty, audio, napisy i wersje pozostają dostępne do kontroli i ponownego uruchomienia.

Audiobooki

Importuj dokumenty, oczyść i podziel tekst, wygeneruj mowę do przeglądu i wyeksportuj M4B z rozdziałami albo popularny format audio.

Napisy

Transkrybuj audio lub wideo, popraw i przetłumacz wynik, edytuj czas oraz tekst, a następnie wyeksportuj SRT lub ścieżkę napisów.

Dubbing

Twórz mowę z napisów, synchronizuj ją z obrazem i wybieraj dźwięk oryginalny, mieszany lub wyłącznie dubbing.

Widoczny proces

Przygotowanie i generowanie to osobne kroki.

  1. 01

    Przygotuj

    Importuj tekst, dokument, napisy, audio, wideo lub obsługiwany publiczny adres mediów.

  2. 02

    Sprawdź

    Skontroluj ekstrakcję, transkrypcję, korektę, tłumaczenie, czasy i plan mowy.

  3. 03

    Generuj

    Użyj lokalnej usługi mowy, skonfigurowanego komercyjnego API lub zgodnego endpointu.

  4. 04

    Porównaj i eksportuj

    Generuj segmenty ponownie, porównuj wersje i warianty RVC, a potem złóż potrzebne media.

Lokalnie i przez dostawców

Dobierz sposób przetwarzania do materiału.

Pandrator nie wymaga konta w chmurze. Może też używać usług komercyjnych, gdy ich jakość, języki lub wygoda są przydatne.

W pełni samodzielnie

  • Lokalna mowa i transkrypcja zarządzane przez instalator
  • Lokalne serwery LLM zgodne z OpenAI, takie jak LM Studio
  • Pliki, zadania, głosy i wyniki w wybranym katalogu danych
  • Brak wymogu Docker lub WSL w pakietowym procesie dla Windows

Połączeni dostawcy

  • Usługi mowy OpenAI i Google Gemini
  • Obsługiwani dostawcy LLM do korekty i tłumaczenia
  • Własne endpointy mowy zgodne z OpenAI lub Gemini
  • Opcjonalne, ograniczone wyszukiwanie Jina dla niepewnej terminologii

Dostawcy zewnętrzni mogą otrzymywać tekst, napisy, audio lub próbki głosu i pobierać opłaty. Sprawdź ich warunki przed włączeniem.

Głosy i języki

Gotowe głosy, klonowanie i konwersja to różne narzędzia.

Wybierz gotowy głos, jeśli nie potrzebujesz próbki. Użyj modelu klonującego dla nagrania referencyjnego. RVC to późniejsza konwersja mowy, a nie model TTS.

Typowe wejścia i wyjścia

Dokumenty, SRT oraz popularne formaty audio i wideo; M4B i zwykłe audio; dubbing MP4 z wyborem ścieżek.

Otwórz macierz możliwości

Zacznij od najmniejszej użytecznej instalacji.

Launcher może później dodawać, aktualizować, naprawiać i usuwać opcjonalne usługi. Nie potrzebujesz wszystkich modeli.

Wybierz pierwszy zestaw