Недавні дослідження вказують на те, що ланцюжок міркувань у великих мовних моделях часто не відображає внутрішній процес прийняття рішень. Ці недостовірні обґрунтування створюють значні ризики для агентних систем, де прозорість і точність є критично важливими для безпеки.