Jak „trénovat“ AI společníka: co tvoje zpětná vazba skutečně mění

Jak to funguje

Mnoho uživatelů hodnotí každou odpověď v domnění, že svého společníka učí. Většinou ne, aspoň ne tak, jak si myslí. Tady je, co každý druh zpětné vazby skutečně dělá.

Za odkazy na této stránce můžeme dostat provizi. Hodnocení to nikdy nezmění.

„Trénování“ AI společníka naznačuje, že se software postupně učí tvoje preference jako domácí mazlíček. Skutečnost má víc částí: několik pák mění chování okamžitě, některé ho mění pomalu pro všechny a některé většinou jen způsobují, že se cítíš zapojený.

Co skutečně formuje odpověď

Každá odpověď se generuje z toho, co model v tu chvíli vidí. Mechanismus je v článku jak AI společník píše odpověď:

  1. Popis postavy a nastavení.
  2. Uložené vzpomínky a shrnutí vybrané pro tuto konverzaci.
  3. Samotná nedávná konverzace.
  4. Základní model, tak jak ho firma naposledy aktualizovala.

Tvoje zpětná vazba má význam do té míry, do jaké mění jednu z těchto čtyř věcí.

Páky od nejsilnější po nejslabší

Páky pro formování AI společníka seřazené podle toho, jak rychle a silně fungují: úprava postavy, úprava odpovědí, poznámky v paměti, opětovné generování, poznámky mimo roli a hodnocení

Měň to, co model čte, ne to, co k tobě cítí.

PákaCo měníJak rychleJak silně
Úprava popisu postavyPokyny čtené před každou odpovědíOkamžitěSilně a trvale
Úprava odpovědiKonverzaci, ze které model kopírujeDalší odpovědiSilně, dokud zůstává na očích
Poznámky v pamětiFakta vybíraná do budoucích chatůOd dalšího vybráníSilně u faktů, slabě u stylu
Poznámky mimo roliAktuální scénuOkamžitěSlábne, jak chat roste
Opětovné generováníJen tuto jednu odpověďOkamžitěŽádná nad rámec této odpovědi
Hodnocení (palce, hvězdy)Obvykle data pro budoucí aktualizace modeluTýdny nebo měsíce, pokud vůbecSlabě pro tvou postavu

Upravuj, nehádej se

Hádat se v roli („nechováš se jako ty“) málokdy funguje, protože samotná hádka se stane součástí konverzace, kterou model kopíruje. Úprava odpovědi na to, co postava měla říct, dá modelu správný příklad, který má následovat. Pokud to aplikace umožňuje, je to nejužitečnější návyk, který si můžeš vybudovat.

Styl dej do popisu, fakta do paměti

  • Styl: tón, délka vět, humor, jak je láskyplná. Patří do popisu postavy, protože musí platit pro každou odpověď. Náš průvodce tvůrcem postav pokrývá, na kterých polích záleží.
  • Fakta: tvoje práce, jméno tvého psa, co se stalo minulý týden. Patří do paměti, ze které se vybírají, když jsou relevantní.

Zaměňování obojího působí problémy: poznámky o stylu v paměti se vybírají nekonzistentně a dlouhé seznamy faktů v popisu vytlačují osobnost.

K čemu hodnocení skutečně slouží

Ve většině aplikací hodnocení putují do dat firmy pro zlepšování modelů, často napříč všemi uživateli. Může stát za to je dávat: pomáháš budoucím verzím, ale není to přímá linka k tvé postavě. Některé aplikace říkají, že hodnocení ovlivňují konkrétně tvého společníka, ale i tam je účinek postupný a mnohem slabší než upravený popis.

Pokud ti na tom záleží, zkontroluj zásady soukromí: ohodnocení odpovědi může označit tu konverzaci ke kontrole nebo trénování, což je kompromis v soukromí. Viz kdo čte chaty s AI společníky.

Týdenní ladění

  1. Poznamenej si dvě věci, které se ti tento týden líbily, a jednu, která tě otravovala.
  2. Změň to otravné na pozitivní pokyn v popisu („Odpovídá krátkými, suchými větami“ místo „Nerozvláčni“).
  3. Přidej do paměti nová důležitá fakta.
  4. Začni nový chat, pokud ten starý zabloudil: dlouhé konverzace nabírají zlozvyky, jak vysvětluje článek posun osobnosti.

Společník se tě neučí tak jako člověk. Ale čte tě pokaždé: skrze popis, paměť a tvoje nedávná slova. Změň, co čte, a změníš, kým je.

Časté dotazy

Mění palec nahoru a dolů mého AI společníka?

Zřídka hned a často ne konkrétně tvého společníka. Ve většině aplikací se hodnocení sbírají, aby se v budoucích aktualizacích zlepšil model pro všechny. Několik aplikací je používá k úpravě tvé postavy, ale účinek je malý a pomalý ve srovnání s úpravou popisu.

Jaký je nejrychlejší způsob, jak změnit, jak můj AI společník mluví?

Uprav popis nebo pole osobnosti postavy a opravuj odpovědi jejich úpravou, ne hádkou. Model kopíruje to, co je v jeho pokynech a v nedávné konverzaci: to jsou dvě páky, které fungují okamžitě.

Učí se můj AI společník z našich konverzací?

Ukládá fakta a shrnutí do systému paměti, takže může vybavit detaily. Svůj základní model obvykle nepřetrénovává na tvých chatech v reálném čase. Zda se tvoje chaty používají k trénování budoucích verzí, závisí na zásadách firmy.