В общем агенты - не те за кого они себя выдают :)
Особенно плохо то, что они действуют исходя из своё мировоззрения, которое складывается из системного промпта и инструкций полученных в процессе диалога.
Наполнение диалога, тоже не зависимая от пользователя работа. Его наполняют результаты работы вызовов инструментов, т.е. большая не определенность.
По итогу получаем неуправляемый набор логических размышлений.
Вот чтобы это все хоть как-то поддавалось управлению - объем руководства в системном промпте должен быть предметно направленным.
И данные окружающие модель - релевантными, тогда мы получим правильные ответы и размышления в нашей предметной области!