Erik CoelhoСсылка
Doidera isso ai, eu fui pedir para o Gemini editar e migrar uma parte do código do Intel Optimum para OpenVINO GenAI, porém com bastante informação da documentação e links com thinking no High, opção de coded, google search e URL links ativada. E o bicho usou quase 200.000 Tokens para implementar.
O Claude já estourou o limite gratuito sem escrever uma palavra. Tem que ficar pedindo para eles não gastarem tokens com a resposta em texto...
O negócio é rodar local com modelos open source, o problema é conseguir configurar bem os agentes nativos de um modelo ou implementar um de terceiros que rode no mesmo backend ou otimização do seu hardware.