Brezplačno · brez registracije

Govor v besedilo (prepis posnetka)

Posnetek sestanka, intervjuja, predavanja ali glasovnega sporočila prepišite v besedilo. Model umetne inteligence Whisper teče v vašem brskalniku.

Posnetek ne zapusti vaše naprave

Prepis poteka v vašem brskalniku. Iz spleta se ob prvi uporabi prenese le model umetne inteligence (s strežnikov Hugging Face), vaš posnetek pa nikamor.

Kako prepisati posnetek v besedilo

  1. Izberite posnetek

    Zvočna ali video datoteka, na primer posnetek sestanka ali glasovno sporočilo.

  2. Izberite jezik in model

    Osnovni model je hitrejši, natančnejši model pa bolje prepozna slovenščino, a je večji in počasnejši.

  3. Počakajte na prepis

    Prepis se sproti prikazuje. Na koncu ga kopirate ali prenesete kot TXT ali podnapise SRT.

Whisper je model za prepoznavo govora podjetja OpenAI, ki podpira več kot 90 jezikov, tudi slovenščino. Različica v brskalniku je počasnejša od plačljivih storitev v oblaku, zato pa je zasebna: posnetek zaupnega sestanka ne potuje na tuje strežnike.

Na sodobnem računalniku prepis ene minute posnetka traja približno 20 sekund do dve minuti, odvisno od modela. Prepis preglejte, saj model pri imenih, strokovnih izrazih in slabem zvoku dela napake.

Pogosta vprašanja

Ali se moj posnetek pošlje na strežnik?

Ne. Posnetek obdela vaš brskalnik. S spleta se prenese le model umetne inteligence.

Kako natančen je prepis v slovenščini?

Pri jasnem govoru je prepis dober, pri narečjih, hrupu in več govorcih hkrati pa je napak več. Natančnejši model da boljše rezultate.

Zakaj prvi prepis traja dlje?

Ob prvi uporabi brskalnik prenese model (80–250 MB) in ga shrani za naslednjič.