Zamień audio na tekst
Transkrybuj wywiady, wykłady, notatki głosowe i spotkania. Model mowy Whisper działa na Twoim urządzeniu, więc nagranie nigdy go nie opuszcza, a po jednorazowej konfiguracji działa nawet offline.
Zawsze za darmo · Działa na Twoim urządzeniu · 0 bajtów wysłanych
Szybkość zależy od urządzenia; duże pliki na telefonie trwają dłużej. Działa wolno lub wcale? Zgłoś to na GitHubie
Jak korzystać z narzędzia Audio na tekst
- Wybierz plik audio lub wideo (MP3, M4A, WAV, OGG, MP4 lub WebM).
- Wybierz język mówiony albo zostaw automatyczne wykrywanie, a potem wybierz tekst lub napisy.
- Uruchom. Za pierwszym razem model mowy pobiera się jednorazowo; potem przeczytaj tekst i go pobierz.
Przyda się też do
- zamiana audio na tekst za darmo
- mowa na tekst online
- nagranie głosowe na tekst
- transkrypcja wywiadu lub wykładu
- transkrypcja bez przesyłania plików
Prywatność zaprojektowana od podstaw — a Ty możesz to sprawdzić
Twoje pliki nigdy nie są przesyłane, bo nie ma dokąd ich przesłać.
- Nie istnieje krok przesyłaniaPliki są odczytywane i zapisywane wewnątrz tej karty przeglądarki. Nie ma serwera, który mógłby je odebrać.
- Przeglądarka to wymuszaPolityka bezpieczeństwa treści (CSP) tej strony zezwala na połączenia tylko z powrotem do tej witryny, która nie serwuje niczego poza samą aplikacją.
- Sprawdź samOtwórz narzędzia deweloperskie, obserwuj zakładkę Sieć i uruchom zadanie: żadne żądanie nie przenosi Twojego dokumentu.
- Open sourceKażda linia kodu jest dostępna na GitHub, zbudowana na qpdf, pdf.js & pdf-lib.
Najczęściej zadawane pytania
Czy moje pliki są gdzieś przesyłane?
Nie. Fizzdoc wykonuje całą pracę w karcie przeglądarki, korzystając z otwartoźródłowych silników skompilowanych do WebAssembly i JavaScript. Twój plik jest odczytywany z urządzenia, przetwarzany lokalnie, a wynik trafia od razu z powrotem na Twoje urządzenie. Możesz to sam sprawdzić: otwórz narzędzia deweloperskie przeglądarki, przejdź do zakładki Sieć i uruchom zadanie — żadne żądanie nie przenosi Twojego pliku.
Jak dokładna jest transkrypcja?
Fizzdoc używa modelu Whisper tiny, małej wersji otwartego modelu mowy OpenAI, który działa w całości w przeglądarce. Wyraźna angielska mowa wychodzi dobrze; nagrania z szumem, mocnym akcentem i inne języki wypadają gorzej, więc przeczytaj tekst, zanim na nim polegasz.
Dlaczego pierwsze uruchomienie jest wolniejsze?
Za pierwszym razem przeglądarka pobiera model mowy (około 58 MB) i go zachowuje, dzięki czemu kolejne uruchomienia startują w kilka sekund, nawet offline. Transkrypcja długich nagrań chwilę trwa: tempo zależy od urządzenia, a laptop jest znacznie szybszy niż telefon.
Czy Fizzdoc jest darmowy?
Tak, i zawsze będzie za darmo: bez rejestracji, bez znaku wodnego, bez dziennego limitu i bez płatnej wersji. Fizzdoc jest open source na licencji Apache-2.0, więc każdy może uruchomić własną kopię.
Więcej prywatnych narzędzi
- Przytnij audioPrzytnij plik MP3 lub M4A albo podziel go na części. Odsłuchaj przed zapisaniem.
- Połącz audioPołącz pliki MP3 lub M4A w jeden, w wybranej przez Ciebie kolejności.
- MP3 na tekstZamień nagranie MP3 na tekst.
- Wideo na tekstTranskrybuj mowę z filmu MP4 lub WebM na tekst.
- Generator napisówUtwórz napisy SRT lub VTT z pliku wideo lub audio.
- Scal PDFPołącz kilka plików PDF w jeden, w wybranej przez Ciebie kolejności.
- Podziel PDFWyodrębnij potrzebne strony do nowego pliku PDF.
- Obróć PDFUstaw strony we właściwej pozycji, na stałe.