Mąstymas prieš atsakymą: Google rodo, kaip modeliai prisimena geriau
·

DI modelių mąstymas skamba kaip techninis terminas. Bet kai pažiūri praktiškai, čia yra labai žemiškas klausimas: kiek darbo darome rankomis tik todėl, kad niekas neprisėdo sutvarkyti proceso?
Google Research paskelbė darbą „Thinking to recall“, kuriame nagrinėja, kaip reasoning gali padėti dideliems kalbos modeliams geriau pasiekti savo vidines žinias.
Man tokiose naujienose visada įsijungia mažas vidinis buhalteris. Ne tas, kuris skaičiuoja sąskaitas, o tas, kuris klausia: kiek tai kainuos, kas prižiūrės ir kur gali lūžti?
KAS NUTIKO
Tyrimo kryptis paprasta: modelio atsakymo kokybė gali priklausyti ne tik nuo to, ką modelis „žino“, bet ir nuo to, kaip jis priverčiamas iki tos žinios nueiti.
Žmogui čia labai pažįstama. Kartais klausimą išgirsti ir sakai „nežinau“. O tada pagalvoji per aplink: kur buvau, kas sakė, kokia buvo situacija. Ir staiga prisimeni.
KODĖL TAI SVARBU
DI modeliams tai svarbu, nes jie ne visada iš karto ištraukia teisingą informaciją. Reasoning gali veikti kaip kelias iki atsakymo, bet kartu reikia saugotis gražiai sugalvotos logikos.
DI jau nebe vien langelis, į kurį įmetame tekstą. Jis jungiasi prie įrankių, moka kviesti servisus, gali veikti keliais žingsniais ir pradeda liesti tikrus verslo pinigus. Čia romantika baigiasi. Prasideda tvarka.
KĄ TAI REIŠKIA VERSLUI
Verslui tai reiškia, kad užduočių formulavimas vis dar svarbus. Kartais geresnis atsakymas ateina ne iš brangesnio modelio, o iš aiškesnio prašymo: parodyk žingsnius, patikrink prielaidas, atskirk faktus nuo spėjimų.
- užduoti klausimus su kontekstu
- prašyti atskirti faktus nuo prielaidų
- tikrinti svarbius atsakymus šaltiniais
- nemaišyti mąstymo žingsnių su garantuota tiesa
Pavyzdys: vietoje „parašyk strategiją“ verta klausti: „išvardink prielaidas, surask silpnas vietas, tada pasiūlyk tris veiksmus“.
KUR PASISLĖPUSI RIZIKA
Rizika – manyti, kad ilgesnis paaiškinimas automatiškai yra teisingesnis. Kartais modelis tiesiog ilgiau eina blogu keliu.
Blogiausia DI klaida dažnai neatrodo kaip klaida. Ji ateina gražiai parašytu sakiniu, mandagiu tonu ir labai užtikrintu veidu. Todėl verslui reikia ne tik įrankių, bet ir įpročio tikrinti.
KĄ PASIDARYTI ŠIĄ SAVAITĘ
Šią savaitę išbandykite vieną DI užduotį dviem būdais: tiesiogiai ir su prašymu pirma išvardyti prielaidas. Palyginkite rezultatą.
Šaltinis: Google Research.
DUK
Kas yra DI modelių mąstymas?
Tai modelio gebėjimas atlikti tarpinius samprotavimo žingsnius prieš pateikiant atsakymą.
Ar reasoning visada pagerina atsakymą?
Ne. Jis gali padėti, bet svarbius faktus vis tiek reikia tikrinti.
Ką tai keičia darbe?
Geriau suformuluotos užduotys gali duoti tikslesnius ir praktiškesnius DI atsakymus.
Jei norite DI naudoti ne dėl mados, pradėkite nuo vieno proceso. Paimkite užduotį, kuri kartojasi kas savaitę, susirašykite žingsnius ir tik tada junkite įrankį. Daugiau praktinių DI taikymo pavyzdžių rasite MasterSprint.


