Så ”tränar” du en AI-kompanjon - vad din feedback egentligen ändrar

Så fungerar det

Många användare betygsätter varje svar i tron att de lär upp sin kompanjon. För det mesta gör de inte det - åtminstone inte på det sätt de tror. Här är vad varje sorts feedback faktiskt gör.

Vi kan få provision för länkarna på den här sidan. Det påverkar aldrig ett betyg.

”Träning” av en AI-kompanjon antyder att programmet gradvis lär sig dina preferenser, som ett husdjur. Verkligheten har fler delar: ett fåtal spakar ändrar beteendet direkt, några ändrar det långsamt för alla, och några får mest dig att känna dig delaktig.

Vad som faktiskt formar ett svar

Varje svar genereras ur det modellen kan se just då - mekanismen finns i hur en AI-kompanjon skriver sitt svar:

  1. Karaktärens beskrivning och inställningar.
  2. Lagrade minnen och sammanfattningar som hämtats för det här samtalet.
  3. Själva det senaste samtalet.
  4. Den underliggande modellen, som bolaget senast uppdaterade den.

Din feedback spelar roll i den mån den ändrar något av de fyra.

Spakarna, från starkaste till svagaste

Spakarna för att forma en AI-kompanjon rangordnade efter hur snabbt och starkt de verkar: redigera karaktären, redigera svar, minnesanteckningar, generera om, anteckningar utanför rollen och betyg

Ändra det modellen läser, inte hur den känner för dig.

SpakVad den ändrarHur snabbtHur starkt
Redigera karaktärsbeskrivningenInstruktioner som läses före varje svarDirektStarkt och varaktigt
Redigera ett svarSamtalet som modellen kopierar frånNästa svarStarkt så länge det syns
MinnesanteckningarFakta som hämtas in i framtida chattarFrån nästa hämtningStarkt för fakta, svagt för stil
Anteckningar utanför rollenDen pågående scenenDirektBleknar när chatten växer
Generera omBara det här svaretDirektIngen utöver det här svaret
Betyg (tummar, stjärnor)Oftast data för framtida modelluppdateringarVeckor eller månader, om allsSvagt för din karaktär

Redigera, gräl inte

Att gräla i rollen - ”du beter dig inte som dig själv” - fungerar sällan, eftersom själva grälet blir en del av samtalet som modellen kopierar. Att redigera ett svar till det karaktären borde ha sagt ger modellen ett korrekt exempel att följa. Om din app tillåter redigering är det den mest användbara vana du kan bygga.

Lägg stilen i beskrivningen, fakta i minnet

  • Stil - ton, meningslängd, humor, hur tillgiven hon är - hör hemma i karaktärsbeskrivningen, eftersom den måste gälla varje svar. Vår guide till karaktärsskapare går igenom vilka fält som spelar roll.
  • Fakta - ditt jobb, hundens namn, vad som hände förra veckan - hör hemma i minnet, som hämtas när det är relevant.

Om man blandar ihop dem uppstår problem: stilanteckningar i minnet hämtas inkonsekvent, och långa listor med fakta i beskrivningen trycker undan personligheten.

Vad betygen egentligen är till för

I de flesta appar matar betygen bolagets data för att förbättra modeller, ofta över alla användare. Det kan vara värt att göra - du hjälper framtida versioner - men det är ingen direkt linje till din karaktär. Vissa appar säger att betyg påverkar just din kompanjon; även där är effekten gradvis och mycket svagare än en redigerad beskrivning.

Kolla integritetspolicyn om du bryr dig: att betygsätta ett svar kan markera samtalet för granskning eller träning, vilket är en integritetsavvägning. Se vem som läser dina chattar med AI-kompanjoner.

En veckovis justering

  1. Notera två saker du gillade och en sak som irriterade dig den här veckan.
  2. Gör om irritationen till en positiv instruktion i beskrivningen (”Hon svarar med korta, torra meningar” snarare än ”Rabbla inte”).
  3. Lägg till nya viktiga fakta i minnet.
  4. Starta en ny chatt om den gamla har glidit iväg - långa samtal samlar på sig vanor, som personlighetsglidning förklarar.

Kompanjonen lär sig inte dig som en människa gör. Men den läser dig varje gång - genom sin beskrivning, sitt minne och dina senaste ord. Ändra det den läser, och du ändrar vem den är.

Vanliga frågor

Ändrar tumme upp och tumme ned min AI-kompanjon?

Sällan direkt, och ofta inte just din kompanjon. I de flesta appar samlas betygen in för att förbättra modellen för alla i framtida uppdateringar. Några få appar använder dem för att justera din karaktär, men effekten är liten och långsam jämfört med att redigera beskrivningen.

Vad är det snabbaste sättet att ändra hur min AI-kompanjon pratar?

Redigera karaktärens beskrivnings- eller personlighetsfält, och rätta svar genom att redigera dem i stället för att gräla. Modellen kopierar det som finns i dess instruktioner och i det senaste samtalet - de två spakarna fungerar direkt.

Lär sig min AI-kompanjon av våra samtal?

Den lagrar fakta och sammanfattningar i ett minnessystem, så att den kan minnas detaljer. Den tränar vanligtvis inte om sin underliggande modell på dina chattar i realtid. Om dina chattar används för att träna framtida versioner beror på bolagets policy.