whspr

Přepis zvukových nahrávek pomocí lokálního Whisper (large-v3 model). Výstup jako .md soubor ve stejné složce. Po přepisu text vyčistí – odstraní balast, opakování, hezitační zvuky – a lehce stylisticky upraví (minimální zásahy, zachování obsahu).

Transcribe – přepis nahrávek v1.0

Kdy použít

  • Uživatel chce přepsat audio/video nahrávku do textu
  • Trigger fráze: "přepiš nahrávku", "transcribe", "/transcribe", "přepis zvuku"

Vstup

  • Cesta k audio/video souboru (mp3, wav, m4a, mp4, webm, ogg, flac…)
  • Volitelně: jazyk (default: cs), výstupní cesta

Workflow

1. Ověř vstup

  • Zkontroluj, že soubor existuje
  • Zjisti formát a délku nahrávky (ffprobe)
  • Informuj uživatele o očekávané době zpracování

2. Spusť Whisper

Příkaz:

whisper "<cesta_k_souboru>" \
  --model large-v3 \
  --language cs \
  --output_format txt \
  --output_dir "<složka_souboru>"

Poznámky:

  • Pro jiný jazyk než češtinu uprav --language
  • Model large-v3 je nejpřesnější, ale pomalejší
  • Pokud nahrávka trvá déle než 30 minut, upozorni uživatele na delší dobu zpracování
  • Whisper vytvoří .txt soubor – ten použij jako základ pro markdown

3. Načti surový přepis

  • Přečti vygenerovaný .txt soubor
  • Smaž .txt soubor (nepotřebujeme ho, finální výstup bude .md)

4. Vyčisti a uprav text

Aplikuj tyto úpravy (minimální zásahy, zachování obsahu a významu):

Odstranit:

  • Hezitační zvuky: "ehm", "ééé", "hmm", "jako", "prostě" (pokud jsou výplňová)
  • Opakující se věty/fráze (když řečník řekne totéž dvakrát)
  • Nedokončené věty které řečník opravil a řekl znovu
  • Zbytečné výplňové fráze: "takže v podstatě", "řekněme", "dá se říct"

Upravit:

  • Rozdělit do logických odstavců (podle témat/myšlenek)
  • Přidat výstižné mezititulky (## nadpisy) pro navigaci
  • Opravit zjevné chyby v přepisu (špatně rozpoznaná slova)
  • Základní interpunkce a formátování

Zachovat:

  • Autentický jazyk mluvčího
  • Všechny věcné informace, čísla, jména
  • Přirozenou strukturu myšlenek
  • Hovorový tón (nepřepisovat do "spisovné" češtiny)

Lehké stylistické úpravy:

  • Krátké věty, krátké odstavce
  • Aktivní slovesa místo trpného rodu
  • Žádné buzzwordy a prázdné fráze
  • Konkrétní > abstraktní
  • NEpřidávej nic co řečník neřekl
  • NEměň význam ani strukturu argumentace

5. Ulož výstup

  • Ulož jako .md soubor ve stejné složce jako originál
  • Název: stejný jako originál, jen s příponou .md
    • Příklad: rozhovor.mp3rozhovor.md
  • Formát markdown souboru:
# [Název odvozený z obsahu nebo názvu souboru]

> Přepis nahrávky: `původní_soubor.mp3`
> Délka: XX:XX | Datum přepisu: YYYY-MM-DD

---

[Vyčištěný text s mezititulky]

6. Shrnutí

  • Vypiš cestu k výstupnímu souboru
  • Krátké shrnutí obsahu (3-5 vět)
  • Počet slov v přepisu

Tipy

  • U dlouhých nahrávek (60+ min) může Whisper běžet i desítky minut
  • Pokud je kvalita přepisu špatná, nabídni zkusit s --language auto-detect
  • Pro angličtinu nebo mix jazyků uprav --language parametr