Tekstanalyse - Gratis Ordteller & Tegntellingsverktøy
Øyeblikkelig tekstanalyse med ordtelling, tegntelling (med/uten mellomrom), setningsantall, lesetid og frekvensanalyse. Perfekt for essays, SEO og sosiale medier.
Tekstanalyse
Dokumentasjon
En tekstanalyse er et verktøy som måler en tekst. Denne tekstanalysen teller ord, tegn, setninger og avsnitt, anslår lesetid og viser ordene som brukes oftest i et tekstutdrag.
Slik bruker du tekstanalysen
- Lim inn eller skriv tekst i inntastingsfeltet. Tekst fra Word, Google Dokumenter, e-poster eller nettsider fungerer.
- Velg Analyser. Verktøyet kjører i sin helhet i nettleseren, så ingen tekst sendes til en server.
- Les resultatene. Hver statistikk vises som et tall med en etikett.
- Rediger teksten og analyser på nytt så mange ganger du trenger, for eksempel når du korter ned en stiltekst til en bestemt ordgrense.
Slik beregnes ordtallet
Verktøyet deler teksten ved mellomrom, tabulatorer og linjeskift i separate token. Et token telles som et ord bare hvis det inneholder minst én bokstav eller ett tall, så et enkelt tegn eller en rekke bindestreker telles ikke. Denne kontrollen fungerer for alle skriftsystemer, blant annet latinske, kyrilliske, greske, arabiske og CJK-tegn, ikke bare det engelske alfabetet.
Et ord med bindestrek som "well-known" og en sammentrekning som "don't" telles hver som ett ord, fordi ingen av dem inneholder et mellomrom.
Slik beregnes tegntallet
Verktøyet viser to tegntall:
- Tegn (med mellomrom): alle tegn i teksten, inkludert mellomrom og tegnsetting.
- Tegn (uten mellomrom): det samme antallet etter at all blanktegn er fjernet.
Begge tellingene måler grafemklynger, enhetene en leser oppfatter som ett enkelt tegn, i stedet for rå kodeenheter i datamaskinen. Dette er viktig for emojier og andre symboler som lagres som mer enn én kodeenhet. For eksempel har teksten "Hi 👍🏽 there" 10 tegn med denne metoden, selv om den samme tekststrengen måler 13 rå kodeenheter, fordi tommel opp-emojien med hudtonemarkør er ett synlig tegn, men flere kodeenheter. Den lille telleren under inntastingsfeltet bruker samme metode, så den stemmer alltid med resultatet "Characters (with spaces)".
Slik beregnes setningstallet
Setninger identifiseres ved hjelp av Unicode-standardens regler for setningsgrenser (Unicode Text Segmentation, UAX #29), ikke ved et enkelt søk etter punktum, spørsmålstegn eller utropstegn. Det betyr at verktøyet ikke deler en setning ved et desimalpunktum eller etter en vanlig forkortelse. Setningen "The U.S. economy grew 2.5%." telles som én setning, ikke tre, fordi reglene gjenkjenner "U.S." som en forkortelse og "2,5" som et desimaltall.
Slik beregnes avsnittstallet
Et avsnitt er en tekstblokk som er skilt fra den neste blokken med minst én tom linje. Et enkelt linjeskift inne i en blokk starter ikke et nytt avsnitt, så tekst som er linjebrutt uten tomme linjer mellom linjene, telles fortsatt som ett avsnitt.
Formel for gjennomsnittlig antall ord per setning
1average words per sentence = word count ÷ sentence count
2Resultatet vises avrundet til én desimal. Tallet gir en grov pekepinn på hvor lett teksten er å lese: kortere setninger i gjennomsnitt er vanligvis lettere å lese enn lengre setninger.
Formel for lesetid
1reading time (minutes) = word count ÷ 225
2Verktøyet antar en lesehastighet på 225 ord per minutt, et vanlig angitt tall for gjennomsnittlig stillelesingshastighet hos voksne, og avrunder resultatet til én desimal. En tekst på 450 ord gir for eksempel en lesetid på nøyaktig 2,0 minutter.
Slik finner verktøyet de mest brukte ordene
Verktøyet konverterer hvert ord til små bokstaver og fjerner tegnsetting fra begynnelsen og slutten av ordet, slik at «Dog,» og «dog» telles som samme ord. Tegnsetting inne i et ord beholdes, så "don't" og "well-known" vises i listen slik de ble skrevet. En typografisk apostrof behandles som en vanlig apostrof, så "don’t" og "don't" er samme ord. Deretter teller verktøyet hvor mange ganger hvert unike ord forekommer, og viser de fem vanligste fra høyest til lavest antall. Når to ord har samme antall, vises ordet som forekom først i teksten først.
Regneeksempel
Eksempel 1
Tekst: "The quick brown fox jumps over the lazy dog. This sentence contains every letter of the alphabet."
| Måltall | Resultat |
|---|---|
| Ord | 17 |
| Tegn (med mellomrom) | 97 |
| Tegn (uten mellomrom) | 81 |
| Setninger | 2 |
| Avsnitt | 1 |
| Gjennomsnittlig antall ord per setning | 8,5 |
| Lesetid | 0,1 minutter |
| Mest brukte ord | the (3), quick (1), brown (1), fox (1), jumps (1) |
Kontroll av ordtallet: 17 blanktegnseparerte token inneholder en bokstav, så ordtallet er 17. Kontroll av setningstallet: 17 ÷ 2 = 8,5, noe som samsvarer med gjennomsnittet som vises.
Eksempel 2
Tekst: "Hello world! This is the first paragraph.\n\nThis is the second paragraph with more content. It has multiple sentences to demonstrate the analyzer."
| Måltall | Resultat |
|---|---|
| Ord | 23 |
| Tegn (med mellomrom) | 145 |
| Tegn (uten mellomrom) | 122 |
| Setninger | 4 |
| Avsnitt | 2 |
| Gjennomsnittlig antall ord per setning | 5,8 |
| Lesetid | 0,1 minutter |
| Mest brukte ord | the (3), this (2), is (2), paragraph (2), hello (1) |
Den tomme linjen mellom de to tekstlinjene markerer et avsnittsskille, så avsnittstallet er 2. Unicode-reglene for setninger deler teksten i fire setninger: "Hello world!", "This is the first paragraph.", "This is the second paragraph with more content." og "It has multiple sentences to demonstrate the analyzer." Det gir 23 ÷ 4 = 5,75, som avrundes til 5,8.
Særtilfeller
- Tom inntasting: Verktøyet viser en kort melding som ber om tekst, i stedet for en tabell med tall.
- Bare blanktegn: Behandles på samme måte som tom inntasting.
- Bare tegnsetting: Tekst som «--- ...» inneholder ingen ord, så den samme meldingen vises.
- Ingen tomme linjer: Hele teksten telles som ett avsnitt, selv om den går over mange linjer.
- Språk uten mellomrom: Ordopptellingen avhenger av mellomrom mellom ord, så den gir ikke et meningsfullt resultat for språk som kinesisk, japansk eller thai, der ord ikke skilles med mellomrom. Tegntelling fungerer fortsatt for alle språk.
Ofte stilte spørsmål
Samsvarer ordtallet med Microsoft Word?
Vanligvis, ja, for vanlig tekst. Begge teller blanktegnseparerte token som ord. Små forskjeller kan forekomme rundt bindestrekord eller uvanlig tegnsetting, siden ulike programmer behandler disse tilfellene litt forskjellig.
Hvorfor finnes det to tegntall?
Ulike plattformer teller forskjellig. De fleste sosiale medier, inkludert Twitter/X, teller mellomrom med i tegngrensen. Noen systemer for akademisk innlevering og meldingssystemer utelater mellomrom. Ved å vise begge tallene unngår man overraskelser når tekst flyttes mellom plattformer.
Telles en emoji som ett tegn?
Ja. Verktøyet teller grafemklynger, enhetene en leser ser som ett tegn, så en emoji telles som ett enkelt tegn selv om den kan lagres internt som mer enn én kodeenhet.
Hvor nøyaktig er setningstallet?
Verktøyet bruker Unicode-standardens regler for setningsgrenser, som håndterer vanlige tilfeller som desimaltall («2,5») og forkortelser ("U.S.", «Dr.») korrekt. Ingen automatisk metode er perfekt for alle mulige setninger, men denne metoden unngår de vanligste feilene ved et enkelt søk etter punktum og spørsmålstegn.
Fungerer dette for andre språk enn engelsk?
Tegntelling fungerer for alle språk. Ordopptelling fungerer for språk som skiller ord med mellomrom, for eksempel spansk, fransk eller tysk. Den gir ikke et meningsfullt ordtall for språk som ikke bruker mellomrom mellom ord, for eksempel kinesisk eller japansk.
Finnes det en grense for hvor mye tekst jeg kan analysere?
Det finnes ingen fast grense, og behandlingen skjer umiddelbart for vanlige dokumenter som stiler, blogginnlegg og e-poster. Svært lange dokumenter, som en hel roman, bruker litt lengre tid på å behandles fordi teksten analyseres i sin helhet i nettleseren.