Це ж статистична модель ймовірності наступного токена. ЛЛМ не міряє істину. Можна покращити РАГом. Але тут теж свої проблеми є. До прикладу: а чи всі твердження в документах істинні?
Тому певно наступні ллм будуть більше в сторону того щоб зрозуміти де починається галюн. А «істину» покладуть на відповідальність користувача.