REASONING MODELS / LRM
Definiție
Modelele de raționament sunt LLM-uri care, înainte de a da răspunsul final, parcurg intern un proces de „gândire” pas cu pas: descompun problema, explorează variante, își verifică propriile calcule și abia apoi formulează concluzia. Diferența față de un LLM clasic e ca între un coleg care răspunde din reflex și unul care ia o foaie de hârtie și face calculul înainte să se pronunțe.
Practic, aceste modele „cheltuiesc” tokeni suplimentari pe raționament intern; de aceea sunt mai lente și mai scumpe per cerere, dar semnificativ mai precise la matematică, cod, analiză multi-pas și probleme cu multe constrângeri. Capcana de evitat: pentru întrebări simple, modelul de raționament e risipă, fiindcă plătești minute de „gândire” pentru un răspuns pe care un model rapid îl dă în 2 secunde.
În practica financiară, modelele de raționament strălucesc exact acolo unde LLM-urile clasice greșeau: calcule fiscale în mai mulți pași, reconcilieri cu multe excepții, verificarea coerenței între documente. Regula de rutare: sarcini de extragere și redactare → model rapid; sarcini cu calcul și logică înlănțuită → model de raționament.
Exemple practice
- Calculul impactului fiscal al unei restructurări cu 5 scenarii alternative: modelul de raționament parcurge fiecare scenariu pas cu pas și compară rezultatele coerent.
- Reconcilierea unui sold divergent: modelul „gândește” prin cele 12 tranzacții suspecte, elimină ipotezele una câte una și identifică dubla înregistrare.
- Workflow optimizat: modelul rapid extrage datele din documente, apoi modelul de raționament face doar verificarea aritmetică și logică finală, deci precizie mare, cost controlat.