Hvor mange ord jeg lÊrte pÄ et Är
Mange danske voksne har et ordforrĂ„d pĂ„ ca. 50.000â70.000 danske ord. Et barn i fĂžrste klasse kender ca. 5.000â10.000 danske ord.
â sproget.dk
For et Är siden, den 9. september 2017, begyndte jeg en daglig aktivitet, som jeg har udfÞrt hver eneste dag siden. Hver dag, uden nogen ferier eller pauser, lÊrte jeg nye danske ord.
For at gÞre det skrev jeg en lille app, der tilfÊldigt viser mig et dansk ord, og sÄ skal jeg huske, hvad ordet betyder:
Derefter Äbner jeg beskrivelsen og tjekker, om jeg huskede ordets betydning korrekt:
Hvis jeg havde ret, udskydes ordet til gentagelse om nogle dage. Jo flere gange jeg gĂŠtter betydningen, jo lĂŠngere interval til nĂŠste gentagelse. Jeg bruger Fibonacci-tallene til at beregne den nĂŠste dato.
Hvis jeg glemte betydningen, nulstiller jeg antallet af vellykkede gentagelser, og ordet skal gentages igen senere samme dag.
Denne teknik kaldes spaced repetition. Den mest populÊre algoritme pÄ dette omrÄde er SM2 fra den tidlige SuperMemo. SM2-implementeringen ligner Fibonacci-tallene meget, sÄ til mine formÄl holdt jeg mig bare til sidstnÊvnte.
Jeg begrÊnsede ogsÄ antallet af gentagelser til 10, sÄ et ord efter den 10. vellykkede gentagelse betragtes som lÊrt og dukker aldrig op igen. Med Fibonacci-tal fÄr et ord sin 10. gentagelse pÄ den 143. dag efter den fÞrste:
Og her er jeg sÄ:
Ordbogen, jeg bruger, indeholder 94.137 danske ord.
PÄ et Är har jeg set 3.881 ord og lÊrt 2.556 af dem.
Her kan man se, hvordan min lÊring forlÞb. Den Þverste kant af det rÞde omrÄde er sete ord, og den nederste kant er de lÊrte:
Her er, hvordan mĂŠngden af "working set" (sete â lĂŠrte) har ĂŠndret sig over tid:
SÄdan er antallet af gentagelser fordelt over alle ordene i min database:
Og her er, hvor mange ord der er planlagt til hver dag fremover. Jo grÞnnere, jo lavere er det gennemsnitlige antal vellykkede gentagelser for hvert ord den pÄgÊldende dag:
I nÊste skridt planlÊgger jeg at tage ordenes popularitet i betragtning, sÄ de mest brugte ord vil dukke op med hÞjere sandsynlighed.