Å kjøre din egen AI-følgesvenn lokalt: hva som skal til

Velg riktig app

Hver samtale du har med en nettbasert følgesvenn-app, ligger på en annens server. Å kjøre en hjemme er den eneste måten å endre det helt på. Det er også gratis, ufiltrert som standard og faktisk bra nå, og det krever mer av deg enn de fleste guider innrømmer.

Vi kan tjene provisjon på lenker på denne siden. Det endrer aldri en karakter.

Uttrykket «kjør din egen AI-kjæreste» får det til å høres ut som ett program. I praksis er det tre deler som snakker sammen, og å forstå hvilken del som gjør hva, sparer deg for det meste av frustrasjonen.

De tre delene

Diagram av et lokalt AI-følgesvenn-oppsett: en SillyTavern-frontend i nettleseren sender prompter til en backend som KoboldCpp eller Ollama, som kjører en GGUF-modellfil på skjermkortet

Hva som snakker med hva i et typisk lokalt oppsett.

Frontenden er det du ser: chatvinduer, karakterer, avatarer, innstillinger. SillyTavern er standardvalget for karakterchat. Den kjører i nettleseren din, lagrer karakterer og chatter som filer på disken din, og kan kobles til nesten hvilken som helst backend. Den genererer ikke tekst selv.

Backenden laster modellen og genererer svarene. KoboldCpp er ett enkelt program uten installasjon som er populært til rollespill fordi det viser alle genereringsinnstillingene. Ollama er den enkleste måten å få en modell i gang på med noen få kommandoer. LM Studio er en skrivebordsapp med en brukervennlig modellleser. Alle tilbyr modellen på en lokal adresse som frontenden kobler seg til.

Modellen er en stor fil, vanligvis i GGUF-formatet, lastet ned fra Hugging Face. Størrelsen i parametere – 8B, 12B, 24B – og kvantiseringen avgjør hvor god den er og hvilken maskinvare den trenger.

Spørsmålet om maskinvare

Det som avgjør om en modell kjører godt, er grafikkminnet (VRAM). Modellen må få plass, pluss rom til selve samtalen. Kvantisering krymper modeller så de passer: «Q4_K_M» er det vanlige kompromisset mellom størrelse og kvalitet.

ModellstørrelseOmtrentlig minne ved Q4Typisk maskinvareHva du kan forvente
7–8B5–6 GBSkjermkort med 8 GBSammenhengende, raskt, glemmer detaljer i lange scener
12–14B9–10 GBKort med 12 GBMerkbart bedre karakterer og språk
22–24B14–16 GBKort med 16–24 GBNær gode nettbaserte apper til rollespill
70B40 GB+To kort eller en Mac med mye minneUtmerket, tregt og dyrt

Tallene er omtrentlige: lengre kontekst trenger mer minne i tillegg. Apple Silicon-Mac-er deler minne mellom prosessor og grafikk, så en MacBook med 32 GB kan kjøre modeller et skjermkort med 12 GB ikke klarer. En modell som ikke får plass, flyter over på hovedprosessoren og går i sneglefart. Hvis svarene kommer med noen få ord i sekundet, bør du gå ned til en mindre modell før du prøver en hardere kvantisering. En mindre modell i god kvalitet slår vanligvis en større som er presset for hardt.

Hva du vinner

  • Personvern som ikke avhenger av en erklæring. Ingenting forlater maskinen. Ingen lagringstid, ingen trening, ingen tilgang for ansatte, ingenting å slette senere.
  • Ingen filtre utover modellens egne. Du velger modell, også de som er finjustert spesielt for rollespill. Lovens minstegrenser for innhold gjelder fortsatt deg, men ingen aktør legger regler oppå.
  • Ingen abonnement og ingen kreditter. Generer så mye du vil.
  • Karakterer du eier. Karakterkort er vanlige PNG-bilder med karakterarket innebygd. De kan flyttes mellom frontends og kan ikke tas fra deg av en oppdatering.
  • Stabilitet. En modell som fungerer i dag, fungerer på samme måte om fem år. Ingen kan bytte den ut under deg – risikoen som er beskrevet i når AI-følgesvennen din endres over natten.

Hva du gir fra deg

  • Oppsettstid. Regn med en kveld for den første fungerende chatten, og uker med tuslete hvis du liker det.
  • Hukommelse er din jobb. Nettbaserte apper oppsummerer og lagrer fakta om deg i det stille. Lokalt styrer du dette med SillyTaverns lorebooks, sammendrag og karakternotater – de samme tre mekanismene som er forklart i slik fungerer hukommelsen til en AI-følgesvenn, bare med kontrollene synlige.
  • Bilder og stemme er egne prosjekter. Bildegenerering trenger sin egen modell og vanligvis mer grafikkminne, og stemme krever verktøy for talegjenkjenning og talesyntese. Alt er mulig, ingenting er automatisk.
  • Mobil er tungvint. Du kan åpne frontenden fra telefonen på hjemme-wifi. Å bruke den borte betyr å eksponere datamaskinen mot internett, og det krever forsiktighet.
  • Kvalitetstak. De beste nettbaserte modellene er større enn alt de fleste kan kjøre hjemme, særlig når det gjelder konsistens over tid.

Mellomveien og haken ved den

Mange kjører SillyTavern på egen maskin, men kobler den til et betalt sky-API i stedet for en lokal modell. Da får du frontendens kontroll og karakterfiler, mye større modeller, og betaling per melding som kan bli billig ved lett bruk.

Det er derimot ikke privat. Hver melding går til API-leverandøren, under dens logging, lagring og innholdsregler, ofte strengere om rollespillinnhold enn dedikerte følgesvenn-apper. Det er en annen avveining, ikke et lokalt oppsett.

Grunnleggende sikkerhet

  • Last bare ned programvare fra de offisielle prosjektsidene på GitHub eller prosjektets egen nettside.
  • Last ned modeller fra kjente opplastere på Hugging Face, og foretrekk GGUF-filer, som inneholder modelldata og ikke kode.
  • Les modellens lisens. Noen begrenser kommersiell bruk, og noen få begrenser visse typer innhold.
  • La SillyTavern være bundet til din egen maskin eller ditt hjemmenettverk med mindre du har satt opp passord og forstår hva du eksponerer.

SillyTaverns prosjektside på GitHub

SillyTavern utvikles åpent på GitHub.

Hvem det passer for

Kjør en følgesvenn lokalt hvis personvern er hovedhensikten din, du allerede har kraftig maskinvare, eller du liker å sette opp ting like godt som å bruke dem. Hold deg til en nettbasert app hvis du vil ha stemme, bilder og lang hukommelse som fungerer ut av boksen, eller mest chatter på mobilen. Guiden vår for å velge første app tar for seg den veien. Mange ender opp med begge deler: en nettbasert app for bekvemmelighetens skyld og et lokalt oppsett til samtalene de helst ikke vil lagre andre steder.

Ofte stilte spørsmål

Er det gratis å kjøre en AI-følgesvenn lokalt?

Programvaren er gratis og åpen kildekode, og det er ikke noe abonnement. Kostnadene er maskinvare, i hovedsak et skjermkort med nok minne, og strøm. Hvis du allerede har en gaming-PC eller en nyere Mac, kan tilleggskostnaden være nær null.

Kan jeg bruke en lokal AI-følgesvenn på mobilen?

Ikke realistisk for selve modellen, men du kan kjøre alt på datamaskinen og åpne chatgrensesnittet fra mobilens nettleser på samme hjemmenettverk. SillyTavern støtter dette med en endring i innstillingene.

Er et lokalt oppsett helt privat?

Bare hvis modellen kjører på din egen maskin. Mange bruker SillyTavern med et betalt sky-API i stedet, og da går hver melding til API-leverandøren, med dens egen logging og innholdsregler.