Alexander VlasovSO это решает, ты гарантированно получаешь валидный жсон
Не верю я в такую гарантию - если ллм стримит тебе генерацию. То она не может гарантировать что json будет валидным
Sorville VladimirНе верю я в такую гарантию - если ллм стримит тебе генерацию. То она не может гарантировать что json будет валидным
так там парсер стоит и отбрасывает невалидные токены
Sorville VladimirА если llm подготавливает ответ - потом вадидирует его по представленной схеме, что она делает при неудаче? Перегенирует? Или чинить опять же другим вызовом другой ллмкой? Или детерминирвоанно скрпты проганяет чтобы починить json? интересненько
берет другой по вероятности токен, пока не попадет
Alexander Vlasovберет другой по вероятности токен, пока не попадет
То есть это json lora работает поверх ллм)
там еще особенности что каждый провайдер поразному поддерживает это и поразному следует структурам описанным
вот тут думаю норм, все не читал, но про то что у провайдеров поразному
https://habr.com/ru/articles/1033478/
а вот хайповавший подход от ру комунити, как через so заставить llm думать в нужном направлении, без промптов
https://abdullin.com/schema-guided-reasoning/