PROT. 2026/27:1·SPRÅKANALYS AV RIKSDAGENS PROTOKOLL
Hur något sägs avslöjar , inte bara .
Jag har finjusterat en språkmodell på riksdagens debatter tills den lärt sig partiernas retoriska fingeravtryck: inte vad en politiker talar om, utan hur. Klistra in valfri text nedan, utan att ange källa, och se vilket parti modellen tror att den kommer från.
Texten skickas till modellen och sparas inte.
Åtta partier, ett protokoll
- Anföranden
- 75 148
- Macro-F1, ohörda talare
- 0.619
Varje vecka hämtas nya protokoll från Riksdagens öppna API. Tvåspaltiga PDF:er läses kolumnvis, sidhuvuden rensas bort och varje anförande knyts till rätt talare, även repliker och talare utan partibeteckning.
Modellen finjusterades en gång, på anföranden från 2015 och framåt. Den tränas alltså inte om vecka för vecka; det är korpusen som växer, inte modellen. Valideringen är talar-oberoende: 15 % av politikerna hölls helt utanför träningen, så siffran mäter om modellen fångar ett partis sätt att argumentera, inte om den känner igen enskilda talare.
Resultatet är ett verktyg som läser politisk text och visar vilket parti den mest liknar retoriskt, och en öppen redovisning av var modellen är säker och var den gissar.