Kolme tutkittua kehote- ja hakumenetelmää ovat päättelyketju, itsekritiikki ja ajatuspuu. Päättelyketjua arvioitiin tutkimuksessa Wei ym., 2022 ja ajatuspuuta tutkimuksessa Yao ym., 2023 tietyillä malleilla ja vertailutehtävillä. Tutkimukset eivät osoita yleispätevää parannusta nykyisille malleille tai liiketoimintatehtäville. Käsittele jokaista menetelmää hypoteesina, jota vertaat suoraan kehotteeseen omalla arviointiaineistollasi.
Tässä artikkelissa käsitellään kunkin tekniikan toimintaperiaate, sopivat käyttökohteet ja kustannus-hyötylaskelma.
Minkä ongelman nämä tekniikat ratkaisevat
Kaikki kolme tekniikkaa ratkaisevat samaa perusongelmaa: kielimalli tuottaa vastauksen tavallisesti autoregressiivisesti, token kerrallaan. Ilman erillistä harkinta- tai hakuvaihetta ensimmäiset tokenit rajaavat nopeasti jatkoa ja voivat lukita vastauksen heikkoon johtopäätökseen. Yksinkertaisissa tehtävissä tämä on toimivaa ja tehokasta. Monivaiheisessa päättelyssä, vaativassa analyysissa ja tehtävissä, joissa oikea vastaus edellyttää usean välivaiheen onnistumista, oletustapa voi kuitenkin tuottaa itsevarmasti esitettyjä vääriä vastauksia.
Kehotteet pyytävät välivaiheita tai lisäkierroksia. Näkyvän tekstin tai mallikutsujen lisääminen kasvattaa kustannusta todistamatta vielä, että lopullinen vastaus on oikein.
Päättelyketju (CoT)
Alkuperäisessä menetelmässä mallia pyydetään tuottamaan välivaiheita ennen johtopäätöstä. Todellisessa työnkulussa kannattaa pyytää tarvittavat tarkistettavat tuotokset, kuten yhtälöt, oletukset, lähteet, testitulokset tai tiivis päätösperustelu. Vapaamuotoista sisäisen päättelyn selostusta ei pidä käsitellä näyttönä.
Käytännön esimerkki. Vertaa seuraavia:
Peruskehote: Juna lähtee Tallinnasta klo 9:00 nopeudella 80 km/h. Toinen juna lähtee Tartosta klo 9:30 kohti Tallinnaa nopeudella 100 km/h. Kaupunkien välinen etäisyys on 190 km. Mihin aikaan junat kohtaavat?
ja:
CoT-kehote: Sama kysymys. Ajattele vaihe vaiheelta. Laske ensin matka, jonka ensimmäinen juna kulkee ennen toisen lähtöä. Muodosta sitten yhtälö junien kohtaamishetkelle. Näytä laskelmasi ja anna lopuksi vastaus.
Vuoden 2022 tutkimuksessa riittävän suuret mallit paranivat useissa laskennallisen, arkijärkisen ja symbolisen päättelyn vertailutehtävissä, mutta tulokset vaihtelivat olennaisesti tehtävän ja mallin mukaan. Historiallisia tuloksia ei pidä siirtää suoraan nykyiseen malliin, eri kehotteeseen tai tuotantodataan. Aja molemmat kehoteversiot ja pisteytä sekä lopullinen vastaus että tarkistettavat välituotokset.
Käytä päättelyketjua seuraavissa tilanteissa:
- Monivaiheinen laskenta, etenkin kun mukana on yksiköitä, päivämääriä tai tarkkaa pyöristystä. Vahvatkin mallit tekevät näissä virheitä.
- Logiikkatehtävät ja muut ongelmat, joissa vastaus on päättelyketjun lopputulos.
- Koodin virheenkorjaus, kun vastaus edellyttää tilan muutosten seuraamista.
- Strateginen analyysi, kun johtopäätös edellyttää useiden tekijöiden punnitsemista.
Älä käytä tekniikkaa turhaan seuraavissa tilanteissa:
- Yksinkertainen tiedon palauttaminen. Kysymys ”Mikä on Viron pääkaupunki?” ei tarvitse CoT:tä.
- Sisällöntuotantotehtävät. Kirjoittaminen, tiivistäminen ja luonnostelu. CoT kuluttaa vain lisää tokeneita parantamatta laatua.
- Päättelymallit. o3, Claude Extended Thinking ja DeepSeek R1 käyttävät jo CoT:tä sisäisesti. Kehotteen ”ajattele vaihe vaiheelta” lisääminen on parhaimmillaan tarpeetonta ja pahimmillaan haitallista.
Viimeinen kohta on ratkaisevan tärkeä, ja palaamme siihen myöhemmin.
Itsekritiikki
Kaksivaiheinen tekniikka. Pyydä mallia ensin tuottamaan vastaus. Pyydä sitä sitten arvioimaan omaa vastaustaan kriittisesti ja tuottamaan korjattu versio.
Kehotteen rakenne:
Vaihe 1: [Alkuperäinen kysymyksesi]
Vaihe 2: Arvioi yllä oleva vastauksesi. Etsi virheet, heikkoudet ja kohdat, joissa olet tehnyt oletuksia, jotka eivät ehkä pidä paikkaansa. Arvioi omaa työtäsi tiukasti.
Vaihe 3: Tuota arviosi perusteella korjattu vastaus.
Kritiikkikierros voi löytää joitakin virheitä, mutta sama malli voi myös toistaa tai puolustella alkuperäistä virhettään. Käsittele itsekritiikkiä yhtenä erehtyvänä arvioijana muiden joukossa. Käytä deterministisiä tarkistuksia, haettua näyttöä, testejä tai riippumatonta pätevää katselmointia, kun seuraukset sitä edellyttävät.
Edistyneempi muunnelma on konstitutionaalinen eli periaatteisiin perustuva itsekritiikki. Määritä periaatteet, jotka vastauksen pitää täyttää, ja pyydä mallia arvioimaan vastausta jokaisen periaatteen perusteella.
Tällaisen kysymyksen hyvän vastauksen periaatteet:
- Vastaus käsittelee esitettyä kysymystä eikä sen yleisluontoista muunnelmaa.
- Vastaus lainaa täsmällistä näyttöä sen sijaan, että se vain viittaisi epämääräisesti lähteisiin.
- Vastaus ilmaisee epävarmuuden selvästi silloin, kun sitä on.
- Vastauksen varmuusaste on kalibroitu: vahvat kohdat esitetään varmasti ja heikot varauksin.
Tuota vastaus. Arvioi se sitten jokaisen periaatteen perusteella. Korjaa vastaus lopuksi.
Tämä tekniikka on Anthropicin Constitutional AI -työn ja vastaavien nykyisten tekoälyn linjausta koskevien tutkimusmenetelmien taustalla.
Käytä itsekritiikkiä seuraavissa tilanteissa:
- Kirjoitustehtävät, joissa haluat toisen kierroksen poistumatta keskustelusta.
- Analyyttinen työ, jossa malli on todennäköisesti liian itsevarma.
- Päätöksenteon tuki, jossa haluat mallin löytävän oman perustelunsa aukot.
- Koodi, jolle haluat tarkistuskierroksen tuottamiskierroksen jälkeen.
Älä käytä tekniikkaa turhaan seuraavissa tilanteissa:
- Tehtävät, joissa ei ole ”oikeaa” vastausta, jota kohti korjata (luova ideointi ja ajatusten tuottaminen).
- Tehtävät, joiden kritiikin haluat tehdä itse (kaikki tilanteet, joissa juuri oma harkintasi tuottaa arvon).
- Nopeat keskusteluvastaukset, joissa viiveen kustannus ylittää laadun paranemisen.
Ajatuspuu (ToT)
Kallein tekniikka. Yhden päättelyketjun sijaan malli tarkastelee nimenomaisesti useita etenemisreittejä, arvioi ne ja valitsee lupaavimman.
Käytännön esimerkkirakenne:
Vaihe 1: Tuota kolme erilaista lähestymistapaa tähän ongelmaan.
Vaihe 2: Käy läpi kunkin lähestymistavan ensimmäiset vaiheet sitoutumatta lopulliseen vastaukseen.
Vaihe 3: Arvioi, mikä lähestymistapa onnistuu todennäköisimmin ja miksi. Kuvaa vahvuudet ja heikkoudet täsmällisesti.
Vaihe 4: Valitse paras lähestymistapa ja ratkaise ongelma loppuun.
Puumainen haku on ehdokas tilanteisiin, joissa ongelmaan on useita uskottavia lähestymistapoja ja työnkulku pystyy arvioimaan osittaisia etenemisreittejä. Kolmen vaihtoehdon tuottaminen ei takaa todellista monipuolisuutta eikä poista yhteisen väärän oletuksen riskiä. Määritä arviointiperusteet ja säilytä valitun reitin näyttö.
Käytännön esimerkki vaikeasta kehotteesta:
Minulla on monimutkainen SQL-kysely, joka toimii liian hitaasti. Auta minua optimoimaan se.
Vaihe 1: Tuota kolme erilaista optimointistrategiaa. Vaihe 2: Määritä jokaiselle strategialle sen ratkaisema pullonkaula ja kustannus. Vaihe 3: Arvioi, mikä strategia tuottaa todennäköisimmin suurimman hyödyn pienimmällä riskillä. Vaihe 4: Toteuta valittu lähestymistapa.
Saat yhden uudelleenkirjoitetun kyselyn sijasta kolme lähestymistapaa, niiden vertailun, suosituksen ja toteutuksen. Tarkista silti, ovatko lähestymistavat aidosti erilaisia ja perustuuko valinta mitattavaan näyttöön.
Käytä ajatuspuuta seuraavissa tilanteissa:
- Ongelmat, joihin on useita uskottavia ratkaisuja. Arkkitehtuuripäätökset, algoritmien valinta ja strategiset valinnat.
- Optimointiongelmat. Ensimmäinen yritys on harvoin paras.
- Luovat tehtävät, joissa vaihtoehtojen tutkiminen on tavoite. Nimeäminen, kehystäminen ja asemointi.
- Kaikki tilanteet, joissa epäilet ilmeisen vastauksen olevan väärä.
Älä käytä tekniikkaa turhaan seuraavissa tilanteissa:
- Tehtävät, joihin on yksi oikea lähestymistapa. Älä pyydä kolmea SQL-kyselyä, jos yksi toimiva kysely riittää.
- Yksinkertaiset faktakysymykset. Tekniikka on ylimitoitettu.
- Useimmat päättelymalleille annettavat tehtävät — mallit tekevät nykyään tällaista vaihtoehtojen tarkastelua sisäisesti.
Käytännöllinen päätöspuu
Kun edessäsi on vaikea ongelma, oikea kysymys ei ole ”käytänkö CoT:tä, itsekritiikkiä vai ToT:tä”. Oikea kysymys on ”millainen tämä ongelma on?”
- Lineaarinen monivaiheinen ongelma (laskenta, logiikkatehtävä tai tiukkaa päättelyä vaativa tehtävä) → päättelyketju.
- Ongelma, jossa liiallinen itsevarmuus on riski (analyysi, suositus tai tarkistettava koodi) → itsekritiikki.
- Ongelma, johon on useita uskottavia lähestymistapoja (optimointi, strateginen valinta tai luova tarkastelu) → ajatuspuu.
- Keskusteleva, yksinkertainen tai tuottava tehtävä → ei mitään näistä. Ohita lisätyö.
Älä pinoa menetelmiä oletusarvoisesti. Vertaa suoraa kehotetta, yhtä jäsentävää menetelmää ja mahdollista yhdistelmää samoilla tapauksilla. Säilytä yksinkertaisin versio, joka täyttää julkaisukriteerit.
Miten päättelymallit muuttavat laskelmaa
Päättelykykyisten mallien ohjaimet ja käyttäytyminen vaihtelevat toimittajan ja version mukaan. Mallinimet, poistumispäivät, päättelyasetukset ja välivaiheiden näkyvyys muuttuvat, joten tarkista ajantasaiset tiedot toimittajan dokumentaatiosta artikkelin jäädytetyn luettelon sijasta.
Tämä muuttaa kehotteiden laatimista kolmella tärkeällä tavalla:
1. Aloita tavoitellusta lopputuloksesta. Kuvaa tavoite, olennainen tausta, rajoitteet, näyttövaatimukset ja valmistumisen kriteeri. OpenAI:n nykyinen GPT-5.6-kehoteohje suosittelee tavoitetilan kuvaamista ja kehotteen yksinkertaistusten testaamista edustavilla tehtävillä.
2. Tarkista tulos, älä päättelyn määrää. Suurempi päättelypanos tai pidempi viive ei todista oikeellisuutta. Vaadi tehtävään sopivia lähteitä, laskelmia, skeemavalidointia, testejä tai muuta näyttöä ja mittaa lopputulos.
3. Vertaa suoraa kehotetta vain tarpeelliseen rakenteeseen. Poista tarpeettomia ohjeita ryhmä kerrallaan, mutta säilytä todelliset rajoitteet ja vaadittu tulosskeema. Lyhyempi kehote on parempi vain, jos se läpäisee samat arvioinnit.
Käytännön esimerkki. Vertaa näitä kahta päättelymallille annettavaa kehotetta:
Kehote A: ”Ajattele seuraavaa kysymystä vaihe vaiheelta. Tunnista ensin keskeiset rajoitteet. Luettele sitten vaihtoehdot. Arvioi seuraavaksi jokainen vaihtoehto rajoitteiden perusteella. Valitse lopuksi. Näytä päättelysi jokaisessa vaiheessa. Kysymys: pitäisikö meidän siirtyä nelipäiväiseen työviikkoon?”
Kehote B: ”Pitäisikö meidän siirtyä nelipäiväiseen työviikkoon? Tausta: 80 henkilön B2B SaaS -yritys, jonka asiakastukitiimi työskentelee ma-pe.”
Kehote B on hyödyllinen lähtötaso, mutta siitä puuttuvat päätösperusteet, näyttö, sidosryhmien vaikutukset ja valmistumisen kriteeri. Vertaa sitä tiiviiseen jäsenneltyyn kehotteeseen ja pisteytä molemmat. Pelkän pituuden perusteella ei voi julistaa voittajaa.
Eri mallit ja asetukset voivat reagoida jäsentämiseen eri tavoin. Tallenna kehote yhdessä mallin, version ja arviointitulosten kanssa ja testaa se uudelleen päivitysten yhteydessä.
Kustannus-hyötylaskelma
Menetelmät voivat lisätä tuotettuja tokeneita, mallikutsuja ja viivettä. Yleispätevää kerrointa ei ole ilman kiinteää mallia, tehtävää, kehotetta, päättelyasetusta ja pysäytysehtoa:
| Tekniikka | Mitä mitataan | Mahdollinen käyttötapa |
|---|---|---|
| Pyydetyt välivaiheet | lopullinen tarkkuus, tuotosten oikeellisuus, tokenit, viive | tehtävät, joissa välituotokset voi tarkistaa |
| Itsekritiikki | löydetyt ja lisätyt virheet, väärä varmuus, toisen kierroksen kustannus | korjaus eksplisiittisen arviointiperusteen avulla |
| Usean reitin haku | reittien erilaisuus, arvioijan tarkkuus, kutsujen määrä, pisimmät viiveet | ongelmat, joissa on aidosti erilaisia lähestymistapoja |
| Toimittajan päättelytila | tehtävän läpäisyaste eri panoksilla, tokenit, viive, hinta | vain kun suurempi panos parantaa julkaisuportin tulosta |
Käytä suoraa kehotetta lähtötasona. Lisää jäsentävä menetelmä tai päättelyasetus vain, kun mitattu laadun paraneminen on kyseisessä tehtävässä lisäkustannuksen ja viiveen arvoinen.
Käytännöllinen sääntö: kysy ennen tekniikan valintaa, onko virheen hinta tässä tehtävässä niin merkittävä, että tekniikan lisäkustannus on perusteltu. Jos on, käytä oikeaa tekniikkaa. Jos ei, lähetä tavallinen kehote.
Käytännön esimerkki aidosti vaikeasta tehtävästä
Oletetaan, että arvioit kahden toimittajan tarjouksia ja haluat tasapainoisen vertailun.
Ilman tekniikkaa (peruskehote):
Vertaa näitä kahta toimittajan tarjousta [liitä]. Kumpi meidän pitäisi valita?
Saat varovaisen vastauksen, joka esittelee molemmat puolet. Hyödyllinen lähtökohta, mutta ei riittävä.
CoT:n avulla:
Vertaa näitä kahta toimittajan tarjousta. Ajattele vaihe vaiheelta:
- Luettele päätöksemme kannalta tärkeät arviointiperusteet.
- Anna kummallekin toimittajalle pisteet jokaisesta arviointiperusteesta.
- Tunnista arviointiperusteet, joissa pisteet poikkeavat eniten.
- Anna sitten suosituksesi.
Saat huomattavasti jäsennellymmän analyysin. Jokainen vaihe on näkyvissä, joten voit tarkistaa tai korjata sen.
Lisäämällä itsekritiikin:
[sama kuin yllä]
Arvioi suosituksen jälkeen oma analyysisi kriittisesti:
- Mitkä arviointiperusteet olen saattanut painottaa väärin?
- Mitä sellaista oletin, mitä minun ei olisi pitänyt olettaa?
- Mikä on vahvin uskottava perustelu toisen toimittajan puolesta?
Tuota sitten tarvittaessa korjattu suositus.
Kriittinen arviointi antaa mahdollisuuden löytää katvealueita. Tarkista, löysikö se niitä todella.
ToT:n avulla:
Vertaa näitä kahta toimittajan tarjousta.
Vaihe 1: Tuota kolme erilaista päätöksentekokehystä tällaiselle valinnalle (esimerkiksi riskin minimointi, arvon maksimointi ja kyvykkyyksiin sovittaminen). Vaihe 2: Sovella jokaista kehystä. Tuota kolme suositusta. Vaihe 3: Mistä kehykset ovat samaa mieltä? Missä niiden tulokset eroavat? Vaihe 4: Mikä kehys sopii parhaiten todellisiin rajoitteisiimme? Anna lopullinen suositus.
Kehote pyytää kolme näkökulmaa. Tarkista, ovatko ne sisällöllisesti erilaisia ja näyttöön perustuvia eivätkä saman oletuksen eri sanamuotoja.
Päättelymallin avulla:
Vertaa näitä kahta toimittajan tarjousta. Kumpi meidän pitäisi valita ja miksi? Kerro myös, mitkä seikat muuttaisivat vastaustasi.
Tämä on suora lähtötaso. Näkyvä vastaus ei todista, millainen sisäinen prosessi sitä edelsi. Vertaa sen oikeellisuutta, näyttöä, tokenien käyttöä ja viivettä jäsenneltyihin versioihin.
Vaikeassa analyyttisessa työssä arvioi ensin nykyinen päättelykykyinen malli ja suora, tavoitelähtöinen kehote. Säilytä lisärakenne vain, jos se parantaa tehtävän arviointitulosta.
Muutama käytännöllinen tapa
Tee käyttämäsi tekniikka itsellesi näkyväksi. Merkitse kehotteeseen käyttämäsi tekniikka. Se auttaa kehittämään tuntumaa siihen, mikä toimii.
Vertaa tuloksia. Aja samat edustavat tapaukset menetelmän kanssa ja ilman sitä aina olennaisen malli-, kehote-, tieto- tai käytäntömuutoksen jälkeen. Pisteytä tulos arviointiperusteilla, sillä pelkkä näkyvä ero ei tarkoita parempaa laatua.
Älä pinoa tekniikoita harkitsematta. CoT:n, itsekritiikin, ToT:n ja päättelymallin yhdistäminen on harvoin parempi vaihtoehto kuin yhden sopivan menetelmän valitseminen. Jokainen kerros lisää kustannuksia, joten lisää vain kerroksia, jotka aidosti parantavat juuri kyseisen tehtävän vastausta.
Säilytä tekniikat kirjastossasi. Tallenna katkelmat ”CoT:n avulla”, ”itsekritiikin avulla” ja ”ToT:n avulla” ja sovella niitä kulloiseenkin tehtävään. Näin säästät aikaa verrattuna siihen, että kirjoittaisit vaiheistuksen joka kerta uudelleen.
Valitse tekniikka, joka ansaitsee kustannuksensa
Menetelmät ovat ehdokkaita, eivät takeita: pyydetyt välituotokset sopivat tarkistettavaan monivaiheiseen työhön, itsekritiikki arviointiperusteisiin pohjautuvaan toiseen kierrokseen ja usean reitin haku aidosti erilaisten lähestymistapojen vertailuun. Päättelykykyiset mallit muuttavat asetelmaa, joten vertailu on tehtävä uudelleen vanhan kehoteperinteen toistamisen sijasta.
Valitse ongelmaan sopiva tekniikka. Ohita tekniikat, jos niiden hyöty ei kata kustannusta. Sisäistä ero ”vaikeamman ongelman” ja ”erilaisen ongelman” välillä — kaikki muu seuraa siitä.



