Datakällor
Ordlista samlar flera språkmaterial. Här beskriver vi vad de används till och hur uppgifterna ska tolkas.
SAOL-baserad ordlista
Avdelningen Ord använder den utvalda lista som drev motsvarande sidor på den äldre webbplatsen. Den innehåller 122 282 unika grundformer, sammansättningar och andra etablerade ordformer. Materialets exakta SAOL-upplaga är inte dokumenterad i den gamla databasen och ska därför betraktas som ett äldre listmaterial, inte som en återgivning av den aktuella SAOL.
Listan används endast för bokstavs- och längdlistor. Betydelser hämtas från våra andra ordbokskällor. Svenska Akademiens aktuella ordlista finns på svenska.se ↗.
Svensk ordbok 2009
Vårt importerade material innehåller betydelser, ordklasser, böjningsuppgifter, uttryck och historiska uppgifter. SO 2009 prioriteras för ordens betydelser. Det är en äldre utgåva, inte en direktanslutning till en löpande uppdaterad ordbok.
Wiktionary via DBnary
DBnary är en maskinell extraktion av Wiktionary. Vi använder materialet för bland annat böjningar, översättningar och betydelser där SO-uppslag saknas. Betydelseindelningen skiljer sig mellan källorna; vi kopplar därför inte automatiskt Wiktionarys översättningar till SO:s betydelsenummer.
Omvända översättningar visar källans ordkopplingar, inte en garanti för att alternativen passar i alla sammanhang.
LEXIN
LEXIN används som reservkälla för betydelser när varken Svensk ordbok 2009 eller Wiktionary-materialet ger en definition. Importen bevarar uppslagsform, uttalsnotation, böjning, ordklass, flera betydelser, användnings- och grammatikkommentarer, exempel, idiom och sammansättningar.
Ett tilde-tecken i källan markerar gränsen i ett sammansatt ord. Det bevaras i råmaterialet men tas bort ur den sökbara formen, så exempelvis bytes~rätt hittas som bytesrätt. Kontrollera rättighets- och hänvisningskraven för den aktuella LEXIN-filen innan publicering.
Synonymordbok och motsatsord
Synonymerna kommer från vår importerade synonymordbok. Källans betydelse- och synonymgrupper bevaras. Motsatsord är ordkopplade uppgifter ur samma material. Ord som ligger nära varandra i en betydelse behöver inte kunna ersätta varandra i andra betydelser.
FLEX – hur ordformer används
FLEX anger förekomster per miljon ord i romaner, tidningar och webbforum. Staplarna skalas mot det högsta värdet för det aktuella ordet. De visar inte procentandelar av samtliga förekomster.
Ordlista räknar ett oviktat medel av de tre medietyperna. Ordformer rangordnas efter detta medel, avrundat till sex decimaler; lika värden delar plats. Böjningar räknas var för sig. Rankningen är alltså inte en rangordning av alla svenska uppslagsord och inte ett mått på sökningar här på sajten.
Vår femgradiga presentationsskala
- Mycket vanligt: minst 100 per miljon.
- Vanligt: minst 10 men under 100.
- Medelvanligt: minst 1 men under 10.
- Ovanligt: minst 0,1 men under 1.
- Mycket ovanligt: under 0,1.
Gränserna gäller medelfrekvensen och är Ordlistas presentationsval, inte officiella FLEX-nivåer eller en klassificering av språklig svårighet.
Kelly och CEFR
Kelly-materialet kopplar ord och ordklasser till nivåerna A1–C2: från nybörjarnivå till mycket avancerad språknivå. Klassificeringen gäller källans post, inte nödvändigtvis alla betydelser av ordet. Frekvens, grammatik och eventuella Saldo-kopplingar har också bevarats i importen.
Blingbring – ord ordnade efter begrepp
Blingbring används för att placera ord i begreppsklasser: större grupper av ord som anknyter till ett visst ämne eller en idé. Detta är något annat än synonymgrupper. Två ord i samma begreppsklass kan ha olika betydelse eller till och med uttrycka motsatser.
Vi använder svenska kategorinamn från materialets B-poster, kopplade till respektive begreppsklass. Etiketterna är källans klassificering, inte automatiskt framtagna förklaringar till ordets alla betydelser.
Braxen – uttal
Braxen är vår aktiva uttalskälla. Importen bevarar originalnotation och en IPA-konvertering för visning. Flera uttalsvarianter kan förekomma. En texttranskription är inte samma sak som en ljudinspelning; vi erbjuder inte uppspelning när ljud saknas.
Importens versionsuppgift är Braxen 1.0 och licensuppgiften är Apache-2.0. NST/OpenSLR används inte längre som uttalskälla på ordsidorna.
Idiom och ordspråk från flera källor
En del idiom kommer från NEO-databasen (CC BY 4.0). Andra är sammanställda från olika källor, såsom Wiktionary och Wikipedia.
Ordspråken kommer från Wiktionary ↗ och inskickat material från våra användare.
Äldre material från Ordlista.se
Exempelmeningar, korsordsfrågor, äldre användarsvar och länkkatalogen har hämtats från den tidigare webbplatsen. Uppgifternas ålder och ursprung varierar. Korsordssvar är lösningsförslag, inte bevis för att en fråga förekommit i en viss publikation.
Exempelmeningar väljs maskinellt med längdgränser, ordmatchning och dubblettkontroll. Länkkatalogen visar endast godkända, publicerade resurser; ett godkännande garanterar inte att den externa webbplatsen är oförändrad eller fortfarande tillgänglig.
Nyord från ISOF-materialet
Importen bevarar nyord med årtal, förklaringar, exempel och övriga källfält där de finns. Ett nyordsår anger materialets årstillhörighet, inte säkert första gången ordet användes.
SweSAT Synonyms – högskoleprovets ORD-del
Quizmaterialet bygger på SweSAT Synonyms från Språkbanken Text, Göteborgs universitet, med Yvonne Adesam och Lars Borin angivna som skapare i importens metadata. Både test- och train-filerna har importerats. Materialets angivna licens är CC BY 4.0.
Nya prov kan även läggas till redaktionellt och har då en separat källangivelse. Vi sparar anonyma provförsök samt bekräftade rätt/fel-svar per ord för statistik. Ingen personlig historik kopplas till ett konto eller en e-postadress. Statistiken räknar försök, inte unika personer. Ordlista sammanför delprov per provtillfälle. Övningsresultat är inte ett officiellt normerat högskoleprovsresultat.
Granskade läsarbidrag
Besökarnas kompletteringar blir synliga först efter godkännande och märks separat från ordbokskällorna. E-postadresser och interna granskningsanteckningar visas aldrig offentligt.
Populärt just nu
När insamlingen är aktiverad summerar vi sidvisningar för uppslag under de senaste sju kalenderdagarna. Listorna uppdateras ungefär var tionde minut. Du kan också välja de senaste 24 eller 4 timbucketarna, inklusive pågående timme. Endast dag, uppslag och antal sparas – inga IP-adresser, användarkonton eller identifierande kakor.
Kända robotar filtreras bort, men måttet är ungefärligt: upprepade besök kan räknas och all robottrafik kan inte identifieras. Det mäter inte unika personer och ska inte blandas ihop med FLEX-frekvens. ”Ökar snabbt” kräver minst 8 visningar under de senaste fyra timbucketarna och minst tre gånger tidigare timtakt, med minst 12 visningar under de föregående 24 timbucketarna. ”Nytt intresse” kräver minst 20 nya visningar och ingen trafik under jämförelseperioden. Perioderna följer UTC och den pågående timmen är ofullständig. Lokala utvecklingstester räknas inte när insamlingen är avstängd.