Textlikhetskontroll

Ange text i båda fälten för att jämföra dem.

Vad är Textlikhetskontroll

Textlikhetskontrollen jämför två textblock och beräknar hur väl de överensstämmer med hjälp av cosinuslikhet över ordfrekvensvektorer. Den delar upp båda texterna i ord, tar bort vanliga småord (som 'och' och 'är'), och mäter sedan överlappet i det som blir kvar. Resultatet är en procentandel, plus de exakta ord som texterna delar och de ord som är unika för varje text. Allt sker lokalt i din webbläsare, så ingen text lämnar din enhet.

Så använder du

  1. Klistra in eller skriv den första texten i det vänstra fältet.
  2. Klistra in eller skriv den andra texten i det högra fältet.
  3. Läs av likhetsprocenten och listorna med gemensamma och unika ord nedan.
  4. Redigera någon av texterna och se poängen uppdateras direkt.

När du använder det

Jämför du två versioner av samma stycke för att se hur mycket du faktiskt ändrat? Klistra in före och efter och du kanske ser 62 % likhet, där ord som 'intäkter' och 'kvartal' delas men 'tillväxt' bara finns i den nya versionen. Fungerar även bra för att upptäcka nästan identiska produktbeskrivningar, kontrollera hur nära en omskrivning håller sig till originalet, eller se om två enkätsvar egentligen säger samma sak med olika ord.

Vanliga frågor

Hur beräknas likhetspoängen?

Verktyget delar upp båda texterna i ord, tar bort vanliga småord som 'och' och 'är', bygger en ordfrekvensvektor för varje text och mäter cosinuslikheten mellan dem. Resultatet är en procentandel från 0 % (inget gemensamt ordförråd) till 100 % (identisk ordanvändning).

Spelar ordföljden någon roll?

Nej. Cosinuslikhet över ordfrekvensvektorer ignorerar ordföljd och grammatik, så 'katten jagade hunden' och 'hunden jagade katten' får full poäng. Den mäter överlapp i ordförråd, inte meningsbyggnad eller betydelse.

Varför får två liknande texter ibland lägre poäng än väntat?

Poängen räknar bara ord som överlever filtreringen av vanliga småord, så två omskrivningar som använder olika ord för samma idé, till exempel 'bil' och 'fordon', delar färre termer trots att de betyder samma sak. Se procentandelen som ett mått på ordförrådsöverlapp, inte betydelseigenkänning.

Är det här samma sak som en plagiatkontroll?

Inte riktigt. Det här verktyget mäter ordförrådsöverlapp mellan två texter du anger, användbart för att jämföra utkast, omskrivningar eller duplicerat innehåll. En plagiatkontroll söker även på webben eller i en dokumentdatabas efter träffar, vilket det här verktyget inte gör.

Kan jag dela verktyget med mina värden ifyllda?

Ja. Webbadressen uppdateras automatiskt medan du skriver. Kopiera den från adressfältet eller använd Dela-knappen, och den som öppnar länken ser båda texterna redo att användas.

Relaterade verktyg