Siirry sisältöön
helpyself

Litteroi video

Vain paikallisesti — mitään ei ladata, ellet tallenna tai jaa sitä.

Muunna video tai äänitallenne tekstiksi lähettämättä sitä minnekään

Näin litteroit videon tekstiksi

  1. Pudota video tai äänitiedosto — se pysyy laitteellasi
  2. Valitse puhuttu kieli tai anna sen päätellä se äänestä
  3. Paina Litteroi ja katso tekstin ilmestyvän
  4. Kopioi teksti tai lataa se muodossa TXT, Word, PDF, SRT tai VTT

    Toimii omalla koneellasi. Tallennettasi ei lähetetä.

    Jaa linkki

    Tallentaa tämän tiedostoihisi ja antaa osoitteen, jonka kuka tahansa voi avata. Se lakkaa toimimasta itsestään.

    Linkki on voimassa
    Tallenna tämä työkalu

    Pidä Litteroi video käden ulottuvilla

    Lisää kirjanmerkkeihin

    Tietoa työkalusta

    Pudota videotiedosto tai äänitallenne, niin tämä kirjoittaa ylös, mitä siinä sanotaan. Se sopii juuri niihin tallenteisiin, jotka oikeasti pitää litteroida — haastatteluun, luentoon, palaveriin, podcastiin, ääniviestiin — ja osaa yli kaksikymmentä kieltä, muun muassa suomen, tanskan, hollannin, saksan ja puolan. Epätavallista on se, missä työ tapahtuu. Puhemalli ladataan selaimeesi ensimmäisellä kerralla, ja kaikki muu tapahtuu omalla koneellasi: tallennettasi ei koskaan lähetetä, sitä ei säilytetä palvelimella eikä kukaan muu kuule sitä. Tämänkaltaisissa tiedostoissa se painaa enemmän kuin yleensä — nauhoitettu palaveri tai potilashaastattelu on juuri sellainen, jota ei liitetä verkkosivulle ja toivota parasta. Ensimmäinen kerta kestää hetken, koska malli ladataan. Sen jälkeen työ on nopeaa: näytönohjaimella varustetulla kannettavalla kymmenminuuttinen video litteroituu noin puolessatoista minuutissa, ja vanhemmallakin koneella ilman näytönohjainta se valmistuu nopeammin kuin tallenne kestää. Näet tekstin ilmestyvän sitä mukaa, ja voit keskeyttää ja pitää sen, mikä on jo valmista. Lopuksi voit kopioida tekstin tai tallentaa sen muodossa TXT, Word-asiakirja, PDF, Markdown, taulukko tai SRT- ja VTT-tekstityksinä, jotka videosoitin osaa lukea.

    Usein kysyttyä

    Lähetetäänkö videoni jonnekin?

    Ei. Puhemalli ladataan selaimeesi ja litterointi tapahtuu omalla koneellasi — tallenne ei tule meille eikä kenellekään muulle. Voit katkaista verkkoyhteyden mallin latauduttua, ja työ jatkuu silti.

    Osaako se päätellä itse, mitä kieltä puhutaan?

    Kyllä, ja se kysyy sitä puhemallilta itseltään — sama malli, joka litteroi, myös tunnistaa kielet. Hollantilaisella testitallenteellamme se nimesi hollannin 96 %:n varmuudella. Valittu kieli ilmestyy valikkoon heti kun se on tiedossa, joten näet sen osuneen oikeaan — tai keskeytät sekunneissa. Jos tiedät kielen, sen valitseminen itse on silti varmin tapa.

    Kauanko videon litterointi kestää?

    Vähemmän aikaa kuin tallenne itse, jokaisella mittaamallamme koneella. Kymmenminuuttinen video vei noin 100 sekuntia näytönohjaimellisella kannettavalla ja noin kuusi ja puoli minuuttia ilman. Työn aikana näkyy arvio, joka tarkentuu, koska se mittaa konettasi eikä arvaa.

    Mitä kieliä se osaa litteroida?

    Yli kaksikymmentä: suomi, englanti, tanska, hollanti, saksa, ranska, espanja, italia, puola, ruotsi, norja, portugali, venäjä, ukraina, turkki, arabia, hindi, japani, korea ja kiina. Valitse se ennen aloitusta tai anna kielen päätellä äänestä — katso alta.

    Osaako se kääntää kuulemansa?

    Englanniksi kyllä, siihen on asetus. Malli osaa kirjoittaa ylös kuulemansa tai kääntää sen englanniksi, muita kielipareja se ei osaa. Suomesta saksaksi se ei taivu, ja mieluummin jätämme sen tarjoamatta kuin tarjoamme sen huonosti.

    Mitä tiedostomuotoja se hyväksyy?

    Kaiken, mitä selaimesi osaa toistaa: MP4, MOV, WebM, MKV ja AVI videolle sekä MP3, M4A, WAV, FLAC, OGG ja Opus äänelle. Se poimii äänen videosta itse, joten sitä ei tarvitse erottaa etukäteen.

    Missä muodoissa litteroinnin voi tallentaa?

    Pelkkänä tekstinä, Word-tiedostona (.docx), PDF:nä, Markdownina, CSV:nä taulukkolaskentaan, JSON:na sekä SRT- tai VTT-tekstityksinä. Asiakirjamuotoihin voi liittää aikaleiman kappaleittain, ja tekstitystiedostot kantavat ajat, joita videosoitin tarvitsee.

    Kuinka tarkka se on?

    Hyvä, ja rehellisen epätäydellinen. Yhdeksänminuuttisessa hollantilaisessa haastattelussa se osui lähes sanasta sanaan työpöytäohjelman kanssa; virheet koskevat enimmäkseen erisnimiä, joissa puheentunnistus on yleisestikin heikoimmillaan. Lue teksti läpi ennen kuin luotat siihen.

    Onko pituudelle rajaa?

    Kaksikymmentä minuuttia tiedostoa kohti. Se on muistiraja eikä sääntö — purettu ääni on selaimen muistissa, ja kahdenkymmenen minuutin jälkeen välilehti ottaa riskin koneellasi. Pilko pitkä tallenne ensin äänileikkurillamme.

    Miksi ensimmäinen kerta on hitaampi?

    Silloin ladataan puhemalli. Näytönohjaimellisella koneella se on noin 920 Mt, koska vain täysi tarkkuus litteroi oikein — mittasimme pienemmät versiot: toinen oli kymmenen kertaa hitaampi, toinen tuotti hiljaa puutaheinää. Ilman näytönohjainta se on noin 240 Mt. Selain säilyttää sen kummassakin tapauksessa, joten toinen tiedosto alkaa heti, ja ”Nopeampi, karkeampi” käyttää noin kuudesosan kokoista mallia.

    Mistä puhemalli tulee?

    Se ladataan Hugging Facesta, julkisesta hakemistosta, johon malli on julkaistu. Se on ainoa pyyntö, jonka tämä sivu tekee ulkopuoliselle, ja se kulkee toiseen suuntaan: tiedostoja tulee alas, mitään ei lähde ylös. Tallenteesi ei ole siinä koskaan mukana — se annetaan mallille omassa selaimessasi eikä se kosketa verkkoa. Kaikki muu, myös mallin ajava koodi, tarjoillaan osoitteesta helpyself.com.

    Tallentuuko koneelleni jotain?

    Ei evästeitä eikä mitään tallenteestasi tai litteroinnistasi. Sivusto muistaa muutaman yleisen asetuksen — teeman ja sen, oletko kirjautunut — ja tämä työkalu lisää yhden asian: itse puhemallin, selaimesi muistiin, jotta toinen tiedosto alkaa heti. Kyse on yllä mainitusta 920 megatavusta (tai 240 megatavusta ilman näytönohjainta). Se säilyy, kunnes tyhjännät tämän sivuston tiedot selaimestasi, jolloin se poistuu kokonaan.

    Miksi litteroinnissani on aukkoja?

    Koska jokin kohta tallenteesta ei ollut puhetta. Musiikki, aplodit, pitkä sävel tai huone jossa hurisee tuuletin vievät minkä tahansa puhemallin silmukkaan — se kirjoittaa saman lauseen yhä uudelleen, sujuvasti ja oikealla kielellä, eikä tuloksesta näe että se on keksitty. Silloin kohta puretaan muutaman kerran uudelleen suuremmalla satunnaisuudella; jos silmukka jatkuu, kohta jätetään pois ja yhteenveto kertoo siitä. Näkyvä aukko on parempi kuin kappale vuoropuhelua, jota kukaan ei sanonut.

    Auta parantamaan tätä työkalua

    Löysitkö virheen, kaipaatko muutosta vai puuttuuko jokin työkalu?

    /transcribe-video

    ↑↓ liikkuminen · Enter avaa · Esc sulkee