Hopp til hovudinnhald
Nasjonalbiblioteket

NST N-gram - bokmål

Skildring

N-grammene er laget med utgangspunkt i deler av tekstkorpuset etter Nordisk språkteknologi AS (NST). Datagrunnlaget for materialet er 510 millioner ord løpende tekst.

Materialet er også tilgjengelig som en oversikt over de 1000 mest frekvente n-grammene (n=1-6).

I den komplette versjonen er alle-n-grammene sortert henholdsvis alfabetisk og etter frekvens. Det er også laget frekvenslister over enkeltordene i materialet (unigram).

Distribusjonar
1

Last ned
Skildring:
Ikkje oppgitt
Tilgjengeleg URL:
https://hdl.handle.net/21.11146/3
Direkte nedlasting:
  1. https://www.nb.no/sbfil/tekst/ngram_nob_avis.tar.gz
    Genererer førehandsvising...
  2. https://www.nb.no/sbfil/tekst/ngram_nob_avis_1000.zip
    Genererer førehandsvising...
API:
Ikkje oppgitt
Dokumentasjon:
Ikkje oppgitt
Lisens:
I samsvar med:
Ikkje oppgitt

API-ar som tilbyr dette datasettet
0

Ingen registrerte API-ar tilbyr dette datasettet.

Liknande datasett

Norsk ordbank - nynorsk 2005-2012Nasjonalbiblioteket
Allmenn tilgang
ONOMASTICA uttaleleksikon 2Nasjonalbiblioteket
Allmenn tilgang
Omsetjingsminne frå Semantix ASNasjonalbiblioteket
Allmenn tilgang
Grafem-til-fonem-modeller for norskNasjonalbiblioteket
Allmenn tilgang
SCARRIE LeksikonNasjonalbiblioteket
Allmenn tilgang