root@construct:~/logs/quando-a-ferramenta-troca-o-modelo$
<-- voltar para /logs
2026-08-08//LOG

Se a ferramenta trocou de modelo, mostra a troca

Quero saber qual modelo respondeu antes de elogiar ou reclamar dele. Parece uma exigência básica, mas o nome no seletor pode esconder uma execução que passou por outro caminho. Comparar modelos sem enxergar essa troca dá uma confiança que os dados não sustentam.

Em 7 de agosto de 2026, a Anthropic anunciou novas salvaguardas biológicas para Fable 5. Segundo seus testes, a mudança reduziu em aproximadamente 85% os fallbacks relacionados a biologia. Pedidos em determinadas áreas continuariam indo para Opus 5. O percentual descreve o resultado interno da empresa; o detalhe que me interessa como dev é conseguir identificar quem produziu cada resposta.

Em julho, eu questionei por que estavam escolhendo Sol no Cursor quando havia Codex disponível. Também pedi uma comparação pra entender qual modelo serviria melhor numa função. Era uma conversa sobre escolha concreta de ferramenta, e os nomes já se misturavam: modelo de um lado, aplicativo e seus recursos do outro. Acrescentar fallback sem mostrar a execução só deixa essa conversa mais confusa.

Uma resposta fraca pode vir do modelo selecionado ou de uma alternativa acionada no caminho. Também pode refletir uma restrição do produto. Se eu registro tudo com o primeiro nome que apareceu na tela, a análise começa errada. Depois nasce uma regra de roteamento em cima daquela impressão, e o erro ganha um arquivo de configuração pra chamar de casa.

O usuário continua tendo razão de reclamar da experiência ruim. Descobrir a origem da resposta ajuda a resolver a reclamação. Quero conseguir distinguir um pedido mal formulado de uma limitação de acesso ou uma troca de modelo. Cada diagnóstico leva a uma alteração diferente; mandar reescrever o prompt por hábito é perder tempo.

A interface pode mostrar a troca junto do resultado e deixar detalhes disponíveis quando necessário. Numa tarefa com várias chamadas, preciso reconstruir a sequência sem caçar identificadores espalhados em outro painel. O custo acompanha essa mesma história: misturar preços de um modelo com respostas de outro estraga qualquer comparação, por mais bonita que fique a tabela.

Minha regra pra essa avaliação é simples de aplicar: registrar o modelo selecionado, o que efetivamente respondeu e as restrições ativas. Se a ferramenta não oferece essa informação, a conclusão fica sobre o produto inteiro. Não vou dar crédito nem culpa individual a um modelo que talvez nem tenha feito aquela parte do trabalho.

The Broad Way | Kinho.dev