Autor

Shunyu Yao et al.

1 fișă de lectură din 1 carte · 2022.

1 fișă

  1. ReAct: Synergizing Reasoning and Acting in Language Models · 2022

    Gând, acțiune, observație: fiecare rotire a buclei e un loc de verificat și un loc de atacat.

    ReAct întrețese Gând / Acțiune / Observație. Azi e bucla nativă de unelte a oricărui API: modelul emite un apel de unealtă, runtime-ul îl execută, adaugă rezultatul, modelul continuă. Ce a măsurat lucrarea: mai puține halucinații decât lanțul de gândire singur, fiindcă faptele vin din mediu, nu din memorie. Consecințe de inginerie: observația e locul pe unde intră conținutul neverificat (lecția 17); plafonezi numărul de iterații; fiecare unealtă e idempotentă sau confirmabilă; jurnalizezi fiecare triplet ca să-l poți rejuca. Variante: Reflexion (autocritică între episoade), plan-și-execută (planifici o dată, apoi acționezi).

    În această lucrare explorăm folosirea LLM-urilor pentru a genera atât urme de raționament, cât și acțiuni specifice sarcinii, într-o manieră întrețesută, permițând o sinergie mai mare între cele două: urmele de raționament ajută modelul să inducă, să urmărească și să actualizeze planuri de acțiune și să trateze excepțiile, în timp ce acțiunile îi permit să interacționeze cu surse externe, cum ar fi baze de cunoștințe sau medii, pentru a aduna informații suplimentare.

    Deschide fișa