Transkribering av Lydfil — AI-transkribering på 50+ språk
Last opp en lydfil eller ta opp direkte i nettleseren, og få teksten på noen minutter — med talere, tidsstempler og 95 %+ nøyaktighet.
- Ingen kort nødvendig
- Ingen registrering nødvendig
Vurdert 4,9/5 av brukerne våre
Hundrevis av raskt voksende selskaper stoler på oss
Slik fungerer det
Slik gjør du transkribering av lydopptak i tre steg
- 01

Last opp lydfilen
Dra inn en fil eller ta opp direkte i nettleseren. Fungerer med MP3, WAV, M4A, FLAC, MP4, MOV og over 25 andre formater.
- 02

AI-en transkriberer lyden
Talegjenkjenningen oppdager språket, skiller talerne fra hverandre og setter tegnsetting og tidsstempler. En time med lyd er klar på noen minutter.
- 03

Rediger og eksporter
Rett teksten ved siden av opptaket og last ned som TXT, DOCX eller PDF — eller som SRT og VTT for undertekster.
Språk og formater
Tale til tekst på disse språkene og formatene
Over 50 språk med nøyaktighet på morsmålsnivå
Engelsk
Spansk
Tysk
Fransk
Italiensk
Rumensk
Portugisisk
Polsk
Indonesisk
Malayisk
Svensk
Dansk
Nederlandsk
Finsk
Norsk
RussiskKatalansk
Tyrkisk
Koreansk
Thai
Japansk
Tsjekkisk
Ukrainsk
Kroatisk
Gresk
Arabisk
Bosnisk
Ungarsk
Bulgarsk
Serbisk
MakedonskGalisisk
Kantonesisk
Slovakisk
Hindi
Slovensk
Latvisk
Urdu
Aserbajdsjansk
Estisk
Vietnamesisk
Hebraisk
Litauisk
Lydformater for transkribering
Videoformater for transkribering
Uavhengig benchmark
Uavhengig testet mot Microsoft, Google og Whisper
- ~95%
Nøyaktighet på Antena 1-nyheter
95,6 % på Antena 1-nyhetssettet — høyest av alle sju testede systemer, foran Microsoft, Google og hver Whisper-modell.
- ~90%
Nøyaktighet på podkaster
89,8 % på podkaster — igjen først i uskriptet samtale, og over 12 poeng foran Google på samme lyd.
- 6 of 6
Datasett foran Google
Vatis transkriberte hvert datasett i studien mer nøyaktig enn Googles Chirp, fra studionyheter til overlappende filmdialog.
| Modell | Innenfor domenet | Utenfor distribusjonen | ||||
|---|---|---|---|---|---|---|
| ProTV — TV-nyheter | Antena 1 — TV-nyheter | Audiobooks — Opplest skjønnlitterær prosa | Films — Overlappende filmdialog | Stories — Barnefortellinger | Podcasts — Spontan samtale | |
| Wav2Vec 2.0 | 27.7 | 25.6 | 40.8 | 75.4 | 54.1 | 36.3 |
| Whisper Small | 31.6 | 26.8 | 40.0 | 60.0 | 41.1 | 31.9 |
| Whisper Large | 12.3 | 5.9 | 14.8 | 27.3 — best i kolonnen | 10.9 — best i kolonnen | 11.7 |
| Whisper Small + Echo | 9.4 | 10.1 | 18.8 | 54.1 | 21.0 | 21.6 |
| Microsoft Transcribe | 2.9 — best i kolonnen | 4.8 | 10.6 — best i kolonnen | 31.1 | 17.6 | 11.5 |
| Google Chirp (USM) | 12.1 | 11.3 | 20.2 | 37.6 | 22.4 | 22.4 |
| Vatis | 5.2 | 4.4 — best i kolonnen | 13.0 | 31.2 | 16.0 | 10.2 — best i kolonnen |
Tallene er word error rate (%) — andelen ord et system gjenkjenner feil, så lavere er bedre. Det er målet studien rapporterer, beholdt her slik at tabellen kan kontrolleres rad for rad mot den; de uthevede tallene over er motstykket, nøyaktigheten. Med 4,4 WER på Antena 1 gjenkjenner Vatis 95,6 % av ordene riktig. Alle verdier er zero-shot: ingen systemer ble tilpasset disse opptakene før målingen.
Innrammede verdier er best i sin kolonne.
Vatis is a Romanian commercial ASR service known for its strong transcription accuracy in Romanian. Its models are trained on proprietary data and optimized for production use.
Funksjoner
Hvorfor velge Vatis til transkribering?
- Vatis Tech v5
- Azure
- Speechmatics
- Whisper
- 95% av menneskelig nivå
95 %+ nøyaktighet på over 50 språk
Modeller trent per språk, ikke én generisk modell — norsk har sin egen. Ved vanlig lydkvalitet blir over 95 % av ordene riktige i transkriberingen.
Prøv gratis
Talere, kapitler og sammendrag — automatisk
Hver replikk får talerens navn og et tidsstempel. Be om et sammendrag, de viktigste punktene eller et ordrett sitat, og hopp til nøyaktig riktig sekund i opptaket.
Prøv gratis
Alle formater, fra MP3 til MP4
Lyd i MP3, WAV, M4A, FLAC, AAC og OGG; video i MP4, MOV, MKV, AVI og WebM. Filer på opptil 5 GB og 10 timer i Pro-planen.
Prøv gratis- I tråd med GDPR
- ISO 27001-sertifisert
- SOC 2 Type II pågår
Sikkert og i tråd med GDPR
I tråd med GDPR og ISO 27001-sertifisert, med SOC 2 Type II som pågår. Opptakene dine behandles på europeiske servere, og du sletter dem når du vil.
Prøv gratis
Flerspråklige opptak
Oppdager språket i opptaket automatisk og henger med når deltakerne i samme møte veksler mellom norsk og engelsk.
Prøv gratis
Undertekster og oversettelse med ett klikk
Eksporter transkriberingen som SRT eller VTT og oversett den til over 50 språk, slik at samme video kan vises med norske, engelske eller tyske undertekster.
Prøv gratis

In a world full of unsearchable but crucial information living on TikTok, Instagram Reels, Facebook and YouTube lives, Vatis gave us, as journalists, the opportunity to collect, transcribe and search that information.
Without it, I would have to listen to thousands of hours of interviews, debates and streamed video with nothing but two ears, ten fingers and a headset.

For utviklere som leser dokumentasjonen før markedsføringssiden
Les dokumentasjonen, prøv gratis og fortell oss hva du synes.
Vanlige spørsmål
Vanlige spørsmål om transkribering
Finner du ikke svaret? Kontakt supportteamet vårt.
Hvordan transkribere en lydfil?
Last opp filen eller ta opp direkte i nettleseren, vent noen minutter og last ned teksten. Vatis gjør tale til tekst med tegnsetting, tidsstempler og navn på hver taler.
Hva er transkribering?
Transkribering er å skrive ned innspilt tale som tekst. Før var det håndarbeid som tok flere timer per opptak; med AI-transkribering blir en time med lyd tekst på noen minutter, til en brøkdel av prisen for en transkriptør.
Hva koster transkribering?
Pro-planen faktureres per time med lyd, med rabatt ved større volumer. De første 10 minuttene kan du prøve uten registrering eller kort.
Hvor nøyaktig er AI-transkribering?
Ved vanlig lydkvalitet over 95 % på norsk. Bakgrunnsmusikk, folk som snakker i munnen på hverandre eller hardt komprimert lyd trekker ned resultatet, men også da er det konkurransedyktig.
Hvordan transkribere et intervju?
Last opp opptaket fra diktafonen eller mobilen. Taleridentifiseringen skiller intervjueren fra den intervjuede, og du får hver replikk med tidsstempel — klart til sitering i en masteroppgave eller en artikkel.
Hvilke lydformater kan jeg transkribere?
MP3, WAV, M4A, FLAC, OGG, AAC, AIFF og WMA for lyd; MP4, MOV, MKV, WebM, AVI og FLV for video. Over 25 formater til sammen.
Kan jeg transkribere video også?
Ja. Last opp videofilen, så henter Vatis ut lyden selv. Eksporter deretter som SRT eller VTT for å tekste videoen.
Kan jeg transkribere lyd på engelsk?
Ja. Vatis gjenkjenner over 50 språk, blant annet engelsk, tysk, fransk og spansk, og oppdager språket automatisk. Den ferdige teksten kan du oversette til norsk med ett klikk.
Hvor lang tid tar transkriberingen?
Mye kortere enn opptaket: en time med lyd er som regel klar på noen minutter. API-et støtter også transkribering i sanntid (strømming) for direktesendinger.
Er dataene mine trygge?
Ja. Vatis er i tråd med GDPR, ISO 27001-sertifisert, og SOC 2 Type II pågår. Opptakene behandles på europeiske servere, kryptert under overføring og lagring, og du sletter dem når du vil fra kontoen din.
Hvordan eksporterer jeg teksten?
Last ned som TXT, DOCX, PDF, SRT, VTT eller JSON. SRT og VTT er formatene for undertekster; JSON inneholder tidsstempelet for hvert ord.
Finnes det et API?
Ja. Et REST-API med SDK-er for Python, Node.js, Go og flere, for både batch og sanntid. Hver ny API-konto starter med 10 € i kreditt til testing.
Hvor stor kan filen være?
Opptil 5 GB og opptil 10 timer per fil i Pro-planen.






