Een AI-companion "Trainen" - Wat Je Feedback Echt Verandert

Hoe het werkt

Veel gebruikers beoordelen elk antwoord in de overtuiging dat ze hun companion iets leren. Meestal doen ze dat niet - althans niet zoals ze denken. Hier lees je wat elke vorm van feedback werkelijk doet.

We kunnen een commissie ontvangen via de links op deze pagina. Dit beïnvloedt onze beoordelingen nooit.

Een AI-companion "trainen" suggereert dat de software geleidelijk je voorkeuren leert, zoals een huisdier. De werkelijkheid heeft meer onderdelen: een paar hefbomen veranderen gedrag direct, sommige veranderen het langzaam voor iedereen en sommige geven je vooral het gevoel erbij betrokken te zijn.

Wat een antwoord werkelijk vormt

Elk antwoord wordt gegenereerd uit wat het model op dat moment kan zien - het mechanisme uit hoe een AI-companion zijn antwoord schrijft:

  1. De beschrijving en instellingen van het personage.
  2. Opgeslagen herinneringen en samenvattingen die voor dit gesprek worden opgehaald.
  3. Het recente gesprek zelf.
  4. Het onderliggende model, zoals het bedrijf het voor het laatst bijwerkte.

Je feedback doet ertoe voor zover ze een van die vier verandert.

De hefbomen, van sterkst naar zwakst

De hefbomen om een AI-companion te vormen, gerangschikt naar hoe snel en sterk ze werken: het personage bewerken, antwoorden bewerken, geheugennotities, opnieuw genereren, notities buiten het verhaal en beoordelingen

Verander wat het model leest, niet wat het van je vindt.

HefboomWat het verandertHoe snelHoe sterk
De personagebeschrijving bewerkenInstructies die vóór elk antwoord worden gelezenDirectSterk en blijvend
Een antwoord bewerkenHet gesprek waaruit het model kopieertVolgende antwoordenSterk zolang het in beeld blijft
GeheugennotitiesFeiten die in toekomstige chats worden opgehaaldVanaf de volgende keer ophalenSterk voor feiten, zwak voor stijl
Notities buiten het verhaalDe huidige scèneDirectVervaagt naarmate de chat groeit
Opnieuw genererenAlleen dit ene antwoordDirectGeen buiten dit antwoord
Beoordelingen (duimpjes, sterren)Meestal data voor toekomstige modelupdatesWeken of maanden, als het al gebeurtZwak voor jouw personage

Bewerk, maak geen ruzie

Ruzie maken in het verhaal - "je doet niet zoals jezelf" - werkt zelden, omdat de ruzie zelf onderdeel wordt van het gesprek waaruit het model kopieert. Een antwoord bewerken tot wat het personage had moeten zeggen geeft het model een correct voorbeeld om te volgen. Als je app bewerken toestaat, is het de nuttigste gewoonte die je kunt opbouwen.

Zet stijl in de beschrijving, feiten in het geheugen

  • Stijl - toon, zinslengte, humor, hoe liefdevol ze is - hoort in de personagebeschrijving, omdat het voor elk antwoord moet gelden. Onze gids over personagebouwers behandelt welke velden ertoe doen.
  • Feiten - je baan, de naam van je hond, wat er vorige week gebeurde - horen in het geheugen, dat wordt opgehaald wanneer het relevant is.

Door ze te verwarren ontstaan problemen: stijlnotities in het geheugen worden inconsistent opgehaald, en lange lijsten feiten in de beschrijving verdringen de persoonlijkheid.

Waar beoordelingen echt voor zijn

In de meeste apps voeden beoordelingen de data van het bedrijf om modellen te verbeteren, vaak over alle gebruikers heen. Dat kan de moeite waard zijn - je helpt toekomstige versies - maar het is geen directe lijn naar jouw personage. Sommige apps zeggen dat beoordelingen specifiek jouw companion beïnvloeden; ook daar is het effect geleidelijk en veel zwakker dan een bewerkte beschrijving.

Controleer het privacybeleid als je erom geeft: een antwoord beoordelen kan dat gesprek markeren voor controle of training, en dat is een privacyafweging. Zie wie jouw AI-companion-chats leest.

Een wekelijkse afstelling

  1. Noteer twee dingen die je leuk vond en één ding dat je irriteerde deze week.
  2. Zet de irritatie om in een positieve instructie in de beschrijving ("Ze antwoordt in korte, droge zinnen" in plaats van "Dwaal niet af").
  3. Voeg nieuwe belangrijke feiten toe aan het geheugen.
  4. Begin een nieuwe chat als de oude is afgedreven - lange gesprekken verzamelen gewoonten, zoals persoonlijkheidsafdrijving uitlegt.

De companion leert je niet zoals een mens dat doet. Maar hij leest je elke keer - via zijn beschrijving, zijn geheugen en je recente woorden. Verander wat hij leest, en je verandert wie hij is.

Veelgestelde vragen

Veranderen duimpjes omhoog en omlaag mijn AI-companion?

Zelden meteen, en vaak niet jouw companion in het bijzonder. In de meeste apps worden beoordelingen verzameld om het model voor iedereen te verbeteren in toekomstige updates. Een paar apps gebruiken ze om jouw personage aan te passen, maar het effect is klein en traag vergeleken met het bewerken van de beschrijving.

Wat is de snelste manier om te veranderen hoe mijn AI-companion praat?

Bewerk het beschrijvings- of persoonlijkheidsveld van het personage en corrigeer antwoorden door ze te bewerken in plaats van er ruzie over te maken. Het model kopieert wat in zijn instructies en in het recente gesprek staat - dat zijn de twee hefbomen die direct werken.

Leert mijn AI-companion van onze gesprekken?

Hij slaat feiten en samenvattingen op in een geheugensysteem, zodat hij details kan terughalen. Hij traint zijn onderliggende model meestal niet in realtime opnieuw op jouw chats. Of je chats worden gebruikt om toekomstige versies te trainen, hangt af van het beleid van het bedrijf.