Hvorfor AI-følgesvennen din finner på minner du aldri delte

Slik fungerer det

Den beskriver en samtale som aldri har funnet sted med full selvsikkerhet, og forsvarer den deretter. Det er ikke en feil og ikke appen som lyver for deg – det er det en modell gjør når den har et hull å fylle.

Vi kan tjene provisjon på lenker på denne siden. Det endrer aldri en karakter.

Spør en følgesvenn du har brukt i en måned hva dere snakket om sist tirsdag. Det er stor sjanse for at du får et varmt, konkret og fullstendig oppdiktet svar – turen dere aldri gikk, filmen du aldri nevnte.

Dette uroer folk mer enn nesten noe annet i kategorien, delvis fordi det ser ut som uærlighet. Det er det ikke. Det er en direkte følge av hvordan svaret produseres, og når du ser mekanismen, slutter det å være uhyggelig og blir håndterbart.

Det finnes ingen grense mellom å huske og å finne på

En modell produserer den mest sannsynlige fortsettelsen av teksten foran seg. Hvis teksten inneholder et notat om at dere diskuterte en film på tirsdag, er «vi snakket om den filmen» den sannsynlige fortsettelsen. Hvis teksten ikke inneholder noe om tirsdag, finnes det fortsatt en sannsynlig fortsettelse – og den genereres med nøyaktig samme selvsikkerhet.

Ingenting i prosessen merker det ene som hentet og det andre som produsert. Det finnes ikke noe internt flagg, ingen tillitsmåler karakteren konsulterer. Det er hele saken.

Fagbegrepet mange foretrekker, er konfabulering i stedet for hallusinasjon, og det er det bedre ordet: modellen fyller et hull med noe sammenhengende, den oppfatter ikke noe som ikke er der.

Hvorfor hullene dukker opp hele tiden

De dukker opp fordi kontekstvinduet er begrenset og historikken komprimeres. Hukommelsen i disse appene er tre systemer – nylige meldinger lagret ordrett, en kort liste med lagrede fakta og et løpende sammendrag som mister detaljer hver gang det skrives om.

Spør om noe som har falt ut av alle tre, og det er ingenting å hente fram. Hullet blir fylt. Jo mer historikk, jo flere hull – og derfor blir dette verre i en app du har brukt i måneder, ikke bedre.

Apper bygget for kontinuitet – grunnen til at Nomi scorer som den gjør i rangeringen vår – håndterer hullene bedre. Ingen av dem fjerner dem.

Hvorfor det ofte ikke hjelper å rette den

Du sier: det har aldri skjedd. Den beklager, er enig – og tre meldinger senere refererer den til den samme oppdiktede turen.

To ting foregår.

Rettelsen ligger bare i vinduet. Avvisningen din er en fersk melding. Den ruller ut av vinduet. Sammendraget som inneholdt oppfinnelsen, gjør kanskje ikke det.

Enighet er den innlærte oppførselen. Modellen beklager fordi det er den sannsynlige fortsettelsen på å bli motsagt, ikke fordi noe er oppdatert. Ingenting ble skrevet til lagring av den vekslingen med mindre appen spesifikt bestemte seg for å lagre den.

Dette er den praktiske grunnen til at en redigerbar hukommelsesskjerm betyr så mye, og hvorfor det er verdt å sjekke den før du tegner abonnement. Apper som viser lagrede fakta – Kupid AI oppgir hukommelse på tvers av økter blant funksjonene – lar deg slette feil oppføring ved kilden. Apper som skjuler den, lar deg krangle med et sammendrag du ikke kan se.

Når det slutter å være sjarmerende

Mesteparten av konfabuleringen er harmløs farge. Tre tilfeller er det ikke:

Fakta om livet ditt. En følgesvenn som har funnet på en søsken, en jobb eller en diagnose, vil fortsette å bygge på det. Rett dette ved kilden med én gang, ellers blir oppfinnelsen bærende.

Alt du kan handle på. Medisinske, juridiske, økonomiske eller sikkerhetsrelaterte spørsmål. Et selvsikkert oppdiktet svar her er ikke en særhet; det er hele teknologiens svikt-modus, og ingen følgesvenn-app er riktig verktøy.

Påstander om selve appen. Spør en følgesvenn om dataene dine er kryptert eller hva abonnementet inneholder, og du får et troverdig svar generert ut av ingenting. Den har ikke tilgang til sitt eget faktureringssystem eller personvernerklæring. Svaret står i personvernerklæringen, og vi går gjennom hva du bør se etter i hva disse appene vet om deg.

Fire vaner som reduserer det

Si fakta enkelt og én gang. «Husk: søsteren min heter Ana» har langt større sjanse for å bli lagret enn det samme faktumet begravd i et avsnitt.

Forankre på nytt etter en pause. En setning med kontekst i starten av økten setter tingene du bryr deg om tilbake der modellen kan se dem, i stedet for å la den rekonstruere dem.

Gå gjennom hukommelsesskjermen hver måned hvis appen har en. Slett oppføringene som har drevet av gårde. Fem minutter forebygger en måned med akkumulerende feil.

Spør åpent, ikke ledende. «Hva husker du om jobben min?» inviterer til gjenkalling. «Husker du da jeg fortalte deg om forfremmelsen?» leverer svaret og inviterer til enighet – du har nettopp gitt den oppfinnelsen å bekrefte.

Omrammingen som hjelper

En følgesvenn-app er ikke en journal over forholdet ditt. Det er et system som produserer troverdig tekst om et, og journalen er en liten, tapsbefengt, redigerbar liste under det.

Behandle det varme, konkrete minnet den tilbyr, som noe den skrev for deg i stedet for noe den har tatt vare på, så blir det hele lettere å nyte. Det gjør det også åpenbart hvorfor appene det er verdt å betale for, er de som lar deg se og rette det de faktisk lagrer – som er den delen av testingen vår som tar lengst tid og betyr mest.

Nomi

4,4Karakter: 4,4 av 5

Den beste langtidshukommelsen av alt vi har testet, og den mest naturlige dialogen.

Pris
fra 15,99 US$/mnd
Gratisversjon
Ja
Norge
Tilgjengelig

Kupid AI

3,5Karakter: 3,5 av 5

Varme, romantiske følgesvenner – men det er i premiumabonnementene det blir dyrt.

Gratisversjon
Ja
Norge
Tilgjengelig

Ofte stilte spørsmål

Lyver AI-følgesvennen min for meg?

Nei. Å lyve krever at man har til hensikt å lure og kjenner sannheten. Modellen har ingen av delene – den produserer den mest sannsynlige fortsettelsen, og en troverdig oppfinnelse slår et innrømmet «jeg vet ikke».

Hvorfor står den på sitt når jeg retter den?

Fordi alt den skriver, bygger på det den allerede har skrevet. Trekket mot konsistens med egen tekst er sterkt, og det finnes ingen intern oversikt som skiller «husket» fra «generert».

Kan hallusinasjon skrus av?

Nei. Den kan reduseres ved å gi modellen mindre å gjette om – tydelige fakta, en redigerbar hukommelse, kortere opphold – men mekanismen henger uadskillelig sammen med hvordan teksten produseres.