whspr
Přepis zvukových nahrávek pomocí lokálního Whisper (large-v3 model). Výstup jako .md soubor ve stejné složce. Po přepisu text vyčistí – odstraní balast, opakování, hezitační zvuky – a lehce stylisticky upraví (minimální zásahy, zachování obsahu).
Transcribe – přepis nahrávek v1.0
Kdy použít
- Uživatel chce přepsat audio/video nahrávku do textu
- Trigger fráze: "přepiš nahrávku", "transcribe", "/transcribe", "přepis zvuku"
Vstup
- Cesta k audio/video souboru (mp3, wav, m4a, mp4, webm, ogg, flac…)
- Volitelně: jazyk (default: cs), výstupní cesta
Workflow
1. Ověř vstup
- Zkontroluj, že soubor existuje
- Zjisti formát a délku nahrávky (
ffprobe) - Informuj uživatele o očekávané době zpracování
2. Spusť Whisper
Příkaz:
whisper "<cesta_k_souboru>" \
--model large-v3 \
--language cs \
--output_format txt \
--output_dir "<složka_souboru>"
Poznámky:
- Pro jiný jazyk než češtinu uprav
--language - Model
large-v3je nejpřesnější, ale pomalejší - Pokud nahrávka trvá déle než 30 minut, upozorni uživatele na delší dobu zpracování
- Whisper vytvoří
.txtsoubor – ten použij jako základ pro markdown
3. Načti surový přepis
- Přečti vygenerovaný
.txtsoubor - Smaž
.txtsoubor (nepotřebujeme ho, finální výstup bude.md)
4. Vyčisti a uprav text
Aplikuj tyto úpravy (minimální zásahy, zachování obsahu a významu):
Odstranit:
- Hezitační zvuky: "ehm", "ééé", "hmm", "jako", "prostě" (pokud jsou výplňová)
- Opakující se věty/fráze (když řečník řekne totéž dvakrát)
- Nedokončené věty které řečník opravil a řekl znovu
- Zbytečné výplňové fráze: "takže v podstatě", "řekněme", "dá se říct"
Upravit:
- Rozdělit do logických odstavců (podle témat/myšlenek)
- Přidat výstižné mezititulky (## nadpisy) pro navigaci
- Opravit zjevné chyby v přepisu (špatně rozpoznaná slova)
- Základní interpunkce a formátování
Zachovat:
- Autentický jazyk mluvčího
- Všechny věcné informace, čísla, jména
- Přirozenou strukturu myšlenek
- Hovorový tón (nepřepisovat do "spisovné" češtiny)
Lehké stylistické úpravy:
- Krátké věty, krátké odstavce
- Aktivní slovesa místo trpného rodu
- Žádné buzzwordy a prázdné fráze
- Konkrétní > abstraktní
- NEpřidávej nic co řečník neřekl
- NEměň význam ani strukturu argumentace
5. Ulož výstup
- Ulož jako
.mdsoubor ve stejné složce jako originál - Název: stejný jako originál, jen s příponou
.md- Příklad:
rozhovor.mp3→rozhovor.md
- Příklad:
- Formát markdown souboru:
# [Název odvozený z obsahu nebo názvu souboru]
> Přepis nahrávky: `původní_soubor.mp3`
> Délka: XX:XX | Datum přepisu: YYYY-MM-DD
---
[Vyčištěný text s mezititulky]
6. Shrnutí
- Vypiš cestu k výstupnímu souboru
- Krátké shrnutí obsahu (3-5 vět)
- Počet slov v přepisu
Tipy
- U dlouhých nahrávek (60+ min) může Whisper běžet i desítky minut
- Pokud je kvalita přepisu špatná, nabídni zkusit s
--languageauto-detect - Pro angličtinu nebo mix jazyků uprav
--languageparametr