Oheisvideot

Valitse tehtävään oikea malli — saatevideot

Artikkeli on päätöksenteon muistilista: mikä palveluntarjoaja, mikä taso, mikä "ajattelu"-kytkin mihinkin tehtävään. Alla oleva valinta näyttää, miten joku siirtyy näiden mallien välillä näytöllä, jotta näet, miksi kokenut tekijä tarttuisi yhteen eikä toiseen juuri sillä hetkellä.

Päävalinta

2:11:12
Miten käytän LLM:iä

Andrej Karpathy

Karpathy käyttää erillisiä lukuja aiheisiin "Ole tietoinen käyttämästäsi mallista ja hinnoittelutasoista" sekä "Ajattelumallit ja milloin niitä kannattaa käyttää", ja vaihtaa sen jälkeen ChatGPT:n, Clauden, Geminin, Grokin ja Perplexityn välillä läpi muun walkthrough'n. Se on lähin asia artikkelin muistilistan live-soveltamiselle — jonkun tekemänä, jolla on selkeät näkemykset siitä, milloin kukin taso ansaitsee paikkansa.

Mitä sinun pitäisi oppia tästä: Opit ohjaamaan työtä nopeiden, edullisten, syväpäättelyyn ja lähteisiin perustuvien työkalujen välillä sen sijaan, että käyttäisit yhtä mallia kaikkeen.

Katso tai hallitse ensin: Osaat käyttää ainakin yhtä valtavirran chatbotia ja vertailla tuloksia samassa tehtävässä.

AI Expert -huomio: Mallinvalinnan tavat ovat arvokkaita; tarkat mallinimet, hinnat, kontekstirajat ja sijoitukset eivät ole vakaita. Tee vertailu uudelleen omilla tehtävilläsi ennen kuin vakioit tiimin suosituksen.

Avaa videosivu

Kannattaa katsoa myös

16:50
Uusi, älykkäin tekoäly: Claude 3 – testattu Gemini 1.5:tä ja GPT-4:ää vastaan

AI Explained

Vanhempi kuin artikkeli (maaliskuu 2024), mutta hyödyllinen on metodologia: yksi huolellinen arvioija ajaa samat vaikeat tehtävät — OCR, theory of mind, ohjeiden noudattaminen, matematiikka — kolmen frontier-mallin läpi rinnakkain ja näyttää tarkalleen, missä kukin murtuu. Mallinimet ovat vanhentuneita, mallien vertailukehys ei.

Mitä sinun pitäisi oppia tästä: Näet jäsennellyn vertailumenetelmän, jota voit käyttää uudelleen, kun päätät, mikä malli on riittävän hyvä tehtävään.

Katso tai hallitse ensin: Tiedä, että Claude 3, Gemini 1.5 ja GPT-4 eivät enää ole frontier-perustaso.

AI Expert -huomio: Käsittele tätä testausmenetelmän videona, et nykyisenä sijoituslistana. Konkreettiset voittajat ovat historiaa; hyödyllinen osa on ajaa samat esimerkit, tarkistaa epäonnistumistavat ja vastustaa epämääräisiä "paras malli" -väitteitä.

Avaa videosivu