Research / Lexa 3.0
Lexa
Mibukis egen modell för spaced repetition (SRS). På tre offentliga benchmarks slår den standardinställningarna i branschstandarden FSRS-7 med bred marginal — och levererar stark personaliserad precision redan innan någon optimering per användare.
← Tillbaka till LangDictPublicerad 21 juni 2026 · Senast uppdaterad 28 juli 2026 · Benchmark körd juni 2026 · Modellversion Lexa 3.0
- 3
- public benchmarks
- +0.095
- Duolingo
- 0
- per-user fitting
Cross-card in-context
Dina minnesmönster är gemensamma för korten — därför är dina andra kort den bästa ledtråden.
Kärnan i en schemaläggare för spaced repetition är att prediktera hur väl du kommer att minnas ett kort, vilket avgör när det ska repeteras. Branschstandarden FSRS personaliserar genom att anpassa parametrar per användare (per-user fitting) — kraftfullt, men det kräver justering för varje användare.
Lexa går motsatt väg. Egenskaper som hur snabbt du glömmer, hur du betygsätter och din repetitionsrytm är gemensamma för dina kort. Lexa läser inte bara målkortet utan repetitionshistoriken för dina andra kort som in-context-indata, så att en enda gemensam modell personaliserar utan någon justering per användare.
Med andra ord — i stället för att lära sig ”andra användares tendenser” läser den av hur du glömmer direkt ur resten av dina egna kort. Det är det nya med Lexa.
Så fungerar den
Den läser historiken för dina andra kort, uppskattar hur väl varje kort sitter och bestämmer nästa repetitionsdatum.
- 01
Repetitionshistoriken för dina andra kort (kronologisk)
banana · cat · apple ?
- 02
Lexa Transformer
En global modell · ~19K parametrar
- 03
Uppskatta minnesstyrka
hur svårt varje kort är att glömma
- 04
Nästa repetitionstillfälle
visas precis innan du skulle glömma
Precision
Lexa slår FSRS-7 direkt ur lådan (standardinställningar) på alla tre offentliga benchmarks — innan någon optimering per användare.
Anki
Duolingo
maimemo
Lexa behöver ingen justering eller träning per användare och är träffsäker utan en anpassningsfas per användare. Direkt ur lådan — innan någon av modellerna har anpassats till dig — slår den redan standardinställningarna i FSRS-7 på alla tre dataseten. Marginalen är inte jämn: +0.095 på Duolingo, +0.050 på maimemo, +0.036 på Anki.
FSRS rör sig snabbt. Det som publiceras här är jämförelsen per datumen ovan; en nyare FSRS kan ge andra poäng. Jämförelsebasen är standardkonfigurationen av FSRS-7, och basvärdena nedan har räknats om från den sparade körningen i LangDict-repot (research/srs-benchmark/result) och stämmer överens.
| Dataset | FSRS-7 (default) | Lexa 3.0 |
|---|---|---|
| Anki | 0.646 (.3543) | 0.682 (.3184) |
| Duolingo | 0.577 (.4231) | 0.672 (.3280) |
| maimemo | 0.488 (.5121) | 0.538 (.4621) |
Så utvärderar vi
Utvärderad på tre dataset från verkligheten.
- 01Anki
- ~727M repetitioner / 10 000 användareVanliga ordkort
- 02maimemo
- ~226M repetitioner / ordförrådKinesisk ordförrådsapp
- 03Duolingo
- ~13M repetitioner / sessionsbaseratHLR-datasetet
Mått: per-user weighted Log Loss (lägre är bättre).
Vad det här betyder för LangDicts användare
Precision är inte bara en siffra i en benchmark — den formar ditt lärande direkt.
- 01
Färre inplanerade repetitioner
Lexa pekar ut precis den stund då du är på väg att glömma. För tidigt och repetitionerna blir tråkiga; för sent och du måste lära om. Lexa smalnar av det fönstret. I appen visar rapporten hur mycket den minskade antalet inplanerade repetitioner de senaste 7 dagarna. Den siffran kommer från att samma studiehistorik spelas upp igen genom SM-2 och jämförs — den är en uppskattning av schemaläggningsbördan, inte en mätning av inlärningsresultat.
- 02
Noll konfiguration, fungerar från dag ett
Inga parametrar att justera och ingen väntan på inlärning per användare. Öppna appen och plugga — den schemalägger efter dig från första början.
- 03
På enheten och privat
Personaliseringen körs helt på din enhet. Integritet och precision samtidigt.
- 04
Förbättras löpande
Vi fortsätter experimentera i vår egen benchmark-pipeline och förbättrar löpande modellen vi levererar.
References
- 01
open-spaced-repetition. FSRS: Free Spaced Repetition Scheduler. GitHub ↗
- 02
open-spaced-repetition. srs-benchmark: Benchmark of Spaced Repetition Algorithms. GitHub ↗
- 03
open-spaced-repetition. anki-revlogs-10k: Anki review logs from 10,000 users. Hugging Face ↗
- 04
Settles, B., & Meeder, B. (2016). A Trainable Spaced Repetition Model for Language Learning. Proceedings of the 54th Annual Meeting of the ACL.
- 05
Ebbinghaus, H. (1885). Über das Gedächtnis: Untersuchungen zur experimentellen Psychologie. Leipzig: Duncker & Humblot.