Přeskočit na hlavní obsah

Nahrávání zvuku

Zvuk se hodí, když je mluvení rychlejší než psaní nebo když záleží na tónu a podrobnostech. Nahrávka může stát samostatně nebo být součástí úkolu.

Zachyť nahrávku

  1. Otevři deník nebo úkol, který má nahrávku vlastnit.
  2. Použij akci + a zvol Zvuková nahrávka.
  3. Zkontroluj dostupné možnosti zpracování.
  4. Spusť nahrávání, mluv zřetelně a po dokončení ho zastav.
Všechny snímky
Snímek obrazovkyMobilní pohled
Aktivní panel zvukového nahrávání s živou vizualizací, uplynulým časem a ovládáním pozastavení, zahození, zastavení a volbou Speech Recognition

Během zachycení zůstává vidět uplynulý čas i živá vizualizace vstupu. Nahrávku můžeš pozastavit a obnovit bez ukončení, zahodit nebo uložit tlačítkem STOP. Pokud je dostupný přepis s kontextem úkolu, možnost Speech Recognition (rozpoznání řeči) určuje, zda má zpracování začít po uložení nahrávky.

Když je nastaven profil inference a dovednost přepisu, Lotti může nahrávku po zachycení přepsat. Nahrávky uvnitř úkolu mohou nabídnout také zpracování s jeho kontextem, například návrhy kontrolního seznamu nebo aktualizaci shrnutí.

Diktuj užitečný kontext úkolu

Pro zpracování s kontextem úkolu nejdřív řekni výsledek a pak jmenuj konkrétní akce, lidi, termíny nebo omezení. „Potvrď páteční nákladní okno a pak se zeptej Řízení mise na schválení startu“ dává Lotti mnohem užitečnější kontext než „vyřeš tu věc s tučňáky“. Krátká pauza mezi jednotlivými akcemi navíc usnadní kontrolu výsledného přepisu.

Zpracování s kontextem úkolu může z nahrávky udělat přepis, aktualizovanou zprávu nebo návrhy kontrolního seznamu. Jsou to výstupy AI ke kontrole, ne tvrzení, že se úkol změnil sám: před přijetím zkontroluj jména, termíny a navržené změny. U obtížného zvuku se přesuň na tišší místo, drž mikrofon rozumně blízko a mluv přirozeným, rovnoměrným tempem.

Kontroluj uložené přepisy

Otevři zvukový záznam, použij nabídku a zvol Speech Recognition. Kontrolní panel uchovává u nahrávky každý uložený přepis, místo aby starší výsledek nahradil. Každý řádek ukazuje dobu zpracování, jeho délku, rozpoznaný jazyk a poskytovatele i model, které ho vytvořily.

Všechny snímky
Zdrojová nahrávka zůstává vidět za panelem a každý výsledek rozpoznání si uchovává vlastní původ.
Snímek obrazovkyMobilní pohled
Panel Speech Recognition nad zvukovým záznamem Project Waddle s vybranou volbou English a dvěma výsledky přepisu od Mistralu a Whisperu

Výběr jazyka nabízí volbu auto a za ní každý jazyk, který Lotti podporuje pro přepis — více než čtyřicet, každý uvedený ve tvém jazyce. Volbu auto použij, když má jazyk určit poskytovatel, nebo před spuštěním rozpoznávání vyber známý jazyk. Volba se ukládá ke zvukovému záznamu.

Výběrem dvojité šipky u výsledku zobrazíš úplný text, který lze označit. Rozbalením řádku se zobrazí také akce smazání. Smazání přepisu odstraní jen daný výsledek rozpoznání, ne zdrojovou nahrávku ani ostatní přepisy.

Všechny snímky
Než vygenerovaný text použiješ jako kontext úkolu, zkontroluj celé znění i to, který poskytovatel a model ho vytvořily.
Snímek obrazovkyMobilní pohled
Rozbalený přepis Project Waddle popisující sardinkový náklad u Europy, 37 tučňáků císařských a krmítko pro ryby v beztíži

Automatizaci vybírej záměrně

Možnosti zpracování jsou požadavky na nastavené dovednosti AI. Vybraný poskytovatel může být místní nebo vzdálený, proto před použitím citlivého materiálu ověř aktivní profil inference. Vygenerovaný text i navržené změny úkolu kontroluj a nepovažuj je automaticky za spolehlivý podklad.

V části Nastavení poskytovatele AI určíš, kde inference probíhá.