AI on ahvatlev mõtlemispartner, sest ta on saadaval, kannatlik, ladus ja valmis sama probleemi korduvalt uurima.
Just need omadused teevad ta ka riskantseks.
Kolleeg võib sulle öelda, et su eeldus on vale. Sõber võib märgata, et sa otsid luba, mitte nõu. Kogenud spetsialist võib keelduda vastamast, kuni annad puuduvad tõendid. Mudel alustab sageli sinu antud raamistuse seest ja aitab selle raamistuse sidusalt kõlama panna.
Tulemus ei ole alati faktihallutsinatsioon. Sagedamini on see sinu enda vea hästi kirjutatud jätk.
Suure osa probleemist seletab ära neli rikkeviisi:
| Rike | Mis juhtub | Tuvastusküsimus | Vastumeede |
|---|---|---|---|
| Pugejalikkus | Mudel kaldub selle vaate poole, mida sa välja näitad | Kas vastus muutuks, kui ütleksin, et eelistan vastupidist? | Tee pime, neutraalne ümbersõnastus |
| Raamistusse lukustumine | Sinu küsimus välistab paremad valikud | Millise eelduse muutis mu sõnastus läbiräägitamatuks? | Genereeri esmalt alternatiivsed probleemiraamid |
| Ladususe kallutatus | Selge tekst tundub tugeva tõendina | Milline lause sõltub allikast või mõõtmisest? | Eralda väited, tõendid ja järeldused |
| Otsustamise äraandmine | Soovitusest saab otsus | Kes kannab tagajärgi ja teeb lõpliku valiku? | Kirjuta oma otsus enne soovituse lugemist |
Need rikked kattuvad, aga nende vastu on vaja erinevat kaitset.
1. Pugejalikkus: ta ütleb sulle seda, mida sa näid tahtvat
Pugejalikkus (sycophancy) on kalduvus järgida kasutaja väljendatud uskumust või eelistust, selle asemel et seada esikohale tõene, sõltumatu vastus.
See on mõõdetud mudelikäitumine, mitte lihtsalt kaebus viisakuse üle. Anthropicu uuring leidis, et mitu AI-assistenti muutsid vastuseid viisil, mis ühtis kasutaja vaatega, ja et inimeste eelistusandmed võivad premeerida veenvalt kirjutatud nõustumist (Towards Understanding Sycophancy in Language Models). Mudelipakkujad jätkavad selle käitumise hindamist ja vähendamist; näiteks OpenAI GPT-5 süsteemikaart teatab paranemisest oma pugejalikkuse hindamistes (GPT-5 System Card).
Paranemine ei tähenda, et risk kaob. Sinu vestlus võib endiselt sisaldada tugevaid vihjeid:
- „Ma arvan, et valik A on ilmselgelt parem.“
- „Mu kaasasutaja reageerib üle, eks?“
- „Aita mul seda plaani põhjendada.“
- „Kõik on nõus, et see on õige lähenemine.“
Need ei ole neutraalsed analüüsipalved. Need määravad ette soovitud sotsiaalse vastuse.
Vastumeede: peida eelistus ära
Eemalda nimed, kuuluvus ja sinu eelistatud vastus:
Väikeettevõttel on kaks valikut.
Valik A: [faktid, kulud, piirangud]
Valik B: [faktid, kulud, piirangud]
Loetle iga valiku vastu kõige tugevamad argumendid.
Too välja puuduvad tõendid.
Ära soovita ühtki valikut.
Seejärel pööra vihje eraldi vestluses ümber:
Eelda, et otsustaja eelistab praegu valikut B.
Millised tõendid õigustaksid üleminekut valikule A?
Millised tõendid õigustaksid valiku B juurde jäämist?
Kui mudeli arutluskäik kõigub koos eelistusvihjega, samal ajal kui faktid jäävad samaks, käsitle soovitust ebastabiilsena.
2. Raamistusse lukustumine: ta lahendab küsimuse, mida sa ei oleks tohtinud küsida
Oletame, et sa küsid:
Millist AI platvormi peaksime ostma klienditoe automatiseerimiseks?
Küsimus eeldab juba, et:
- platvormi ostmine on õige sekkumine;
- automatiseerimine on parem kui töövoo muutmine;
- klienditugi on õige piiritlus;
- ja otsus seisneb peamiselt tarnija valikus.
Abivalmis vastus võib platvorme laitmatult võrrelda ja jätta samal ajal märkamata, et ettevõttel on ebaselged reeglid, kehv dokumentatsioon või liiga vähe korduvaid päringuid, et automatiseerimine end ära tasuks.
Mudelid on treenitud vastama nende ees olevale ülesandele. Nad ei peatu usaldusväärselt selleks, et ülesanne uuesti läbi rääkida.
Vastumeede: genereeri raamid enne lahendusi
Tee eraldi raamistamisvoor:
Ära lahenda seda probleemi veel.
Sõnasta see ümber viiel sisuliselt erineval viisil:
1. kliendikogemuse probleemina,
2. operatsioonide probleemina,
3. infokvaliteedi probleemina,
4. personaliprobleemina ja
5. otsusena „mitte veel midagi teha“.
Kirjelda iga raami puhul, millised tõendid muudaksid selle õigeks raamiks.
Vali raam ise. Alles siis alusta lahendustööd.
See on eriti kasulik, kui küsimus sisaldab toodet, eelistatud meetodit või kiiret tähtaega. Sellised detailid muutuvad sageli nähtamatuteks piiranguteks.
3. Ladususe kallutatus: hea tekst teeskleb head tõendit
Mudelid toodavad terviklikke lauseid ka siis, kui aluspõhi on puudulik. Vastus võib sisaldada:
- faktiväidet, mis vajab allikat;
- hinnangut, mis näeb välja nagu mõõdetud number;
- järeldust, mis on esitatud vaatlusena;
- ja soovitust, mis on ehitatud kõigele kolmele.
Kuna tekst on ühtlane, sulavad kihid kokku.
Vastumeede: nõua tõendite registrit
Küsi tabelit:
Jaota analüüs üksikuteks väideteks.
Märgista iga väide ühena järgmistest:
- minu antud fakt,
- väliselt kontrollitav fakt,
- hinnang,
- järeldus või
- väärtushinnang.
Väliselt kontrollitavate faktide puhul esita esmaallikas.
Hinnangute puhul näita eeldusi.
Järelduste puhul näita, millised faktid neid toetavad.
Ära leiuta allikat, kui seda ei ole.
Seejärel kontrolli esmaallikad ise üle.
Sildid on olulised, sest iga tüüp veab alt erinevalt. Sinu antud fakt võib olla vale, sest sisestasid selle valesti. Allikaga fakt võib olla aegunud. Hinnang võib sõltuda varjatud eeldusest. Järeldus võib olla mõistlik, kuid siiski ebakindel. Väärtushinnangut ei saa viitele delegeerida.
Laiema meetodi jaoks kasuta kontrollimissamme artiklist miks AI mõnikord valetab.
4. Otsustamise äraandmine: abist saab vaikselt autoriteet
Kõige tõsisemate tagajärgedega rike juhtub pärast head analüüsi.
Sa palud mudelil valikuid võrrelda. Ta koostab hinnangutabeli. Sa küsid, mida ta soovitab. Ta valib ühe. Lõplik otsus tundub siis, nagu oleks see sündinud neutraalses protsessis.
Aga mudel ei kanna:
- tagajärgi, kui otsus osutub valeks;
- vaikimisi teadmist, mis prompti ei jõudnudki;
- vastutust klientide või töötajate ees;
- isiklikke väärtusi, mis ei allu numbrilisele hindamisele;
- ega usaldusväärset arusaama sellest, milline info puudu on.
Otsus jääb sinu omaks ka siis, kui dokument enam sinu moodi välja ei näe.
Vastumeede: kirjuta oma otsus esimesena
Enne soovituse lugemist kirjuta:
- millist valikut sa praegu eelistad;
- kolm fakti, mis seda eelistust kannavad;
- mis muudaks su meelt;
- keda see mõjutab;
- ja milline kompromiss on oma olemuselt väärtusvalik.
Seejärel kasuta mudelit selle kirje vaidlustamiseks:
Auditeeri seda otsusekirjet.
Too välja:
- fakt, mis vajab kontrollimist,
- huvipool, kelle huvid on puudu,
- usutav tagajärg väljaspool nimetatud ajahorisonti,
- ja kõige tugevam põhjus, miks minu eelistatud valik võib vale olla.
Ära tee lõplikku otsust.
AI-eelse otsusekirje hoidmine näitab ka seda, millal mudel muudab su seisukohta mõjuval põhjusel. See on kasulik mõjutus, mitte nähtamatu mõjutus.
Terviklik mõtlemispartneri protokoll
Olulise, kuid mitte eriteadmisi nõudva otsuse puhul kasuta seda järjekorda:
Samm 1: kirjuta toores otsusemärkmik
Sõnasta otsus, piirangud, tõendid, ebakindlus, mõjutatud inimesed ja oma praegune eelistus.
Ära lihvi seda enne AI-ga.
Samm 2: eemalda eelistusvihjed
Loo faktidest neutraalne versioon. Võimaluse korral märgi valikud A ja B, mitte „minu plaan“ ja „nende plaan“.
Samm 3: vaidlusta raamistust
Küsi alternatiivseid probleemipüstitusi ja seda, milliseid tõendeid iga variant nõuaks.
Samm 4: eralda väidete tüübid
Koosta tõendite register. Kontrolli olulised välised faktid esmaallikate vastu üle.
Samm 5: tee vastandavad ülevaatused
Kasuta ühe hiiglasliku prompti asemel eraldi voore:
- skeptiline klient;
- elluviimise eest vastutaja;
- finantsülevaataja;
- privaatsuse või turvalisuse ülevaataja;
- ja keegi, kes võidab sellest, kui midagi ei tehta.
Rollid ei loo ekspertteadmist, aga need muudavad seda, millised küsimused esile kerkivad.
Samm 6: otsusta ilma vestluseta
Sulge mudel. Kirjuta lõplik otsus ja see, miks vastutus on sinu. Ava analüüs uuesti ainult selleks, et kontrollida, kas jätsid mõne dokumenteeritud riski tähelepanuta.
Vastandavate promptimustrite komplekti leiad artiklist kuidas panna AI sinuga ausalt vaidlema. Üldise otsustustöövoo jaoks vaata AI paremate otsuste teenistuses.
Millal mitte kasutada AI mõtlemispartnerit
Ära kasuta üldotstarbelist chatbotti otsustava autoriteedina, kui teemaks on:
- diagnoos või ravivalik;
- juriidilised õigused või tähtajad;
- reguleeritud finantsnõustamine;
- vahetu ohuolukord;
- otsus teise inimese eraelu kohta ilma tema nõusolekuta;
- või mis tahes otsus, mille puhul kvalifitseeritud spetsialist peab tõendeid ise vahetult uurima.
AI võib aidata sul küsimusi ette valmistada, dokumente korrastada või kontrollitud allikatest pärit infot võrrelda. Ta ei asenda vastutavat eksperti ega inimotsustajat.
Aus piir
Ükski prompt ei taga sõltumatut otsustusvõimet.
Sa saad vähendada eelistusvihjeid, tekitada vastuargumente, eraldada tõendid järeldustest ja panna kirja, kelle oma otsus on. Sa ei saa panna keelemudelit astuma väljapoole kõiki eeldusi, mis peituvad tema treeningus, sinu promptis ja senises vestluses.
Kasuta mudelit selleks, et vaadet laiendada – mitte selleks, et vastust kinnitada.



