Tem empresa pagando três assinaturas de IA e usando a mais cara até para procurar informação básica. O limite acaba rápido, mas a decisão não fica melhor.
Vi no Hacker News um relato da Quesma sobre isso. Eles gastaram o limite do Claude em 30 minutos pesquisando como economizar tokens. A saída foi simples: um modelo mais barato procura, um mais preciso confere e a pesquisa profunda entra só no fim, quando ainda existe dúvida importante.
Eu faria esse teste na próxima pesquisa de mercado ou fornecedor. O modelo mais barato vira a ferramenta para testar a busca; o Claude só confere e decide. Compare o gasto com a qualidade antes de contratar outra assinatura. Sua IA mais cara está pensando ou só carregando caixa? Modelo caro fazendo trabalho braçal é estagiário com salário de diretor.
https://quesma.com/blog/custom-deep-research-pipeline/
Vi no Hacker News um relato da Quesma sobre isso. Eles gastaram o limite do Claude em 30 minutos pesquisando como economizar tokens. A saída foi simples: um modelo mais barato procura, um mais preciso confere e a pesquisa profunda entra só no fim, quando ainda existe dúvida importante.
Eu faria esse teste na próxima pesquisa de mercado ou fornecedor. O modelo mais barato vira a ferramenta para testar a busca; o Claude só confere e decide. Compare o gasto com a qualidade antes de contratar outra assinatura. Sua IA mais cara está pensando ou só carregando caixa? Modelo caro fazendo trabalho braçal é estagiário com salário de diretor.
https://quesma.com/blog/custom-deep-research-pipeline/
Quesma
I burned all my tokens researching how to save tokens - Quesma Blog
How I burned a full Claude limit in 30 minutes and built my own deep research pipeline instead: 3 subscriptions, shared memory, a clear role for each model. You can build the same from what you already pay for.