root@construct:~/logs/agente-botoes-aplicativo$
<-- voltar para /logs
2026-03-25//LOG

De que serve o modelo se ele não alcança o app?

Um modelo melhor precisa conseguir chegar ao trabalho, inclusive aos botões do aplicativo. É por isso que o anúncio de computer use da Anthropic me interessa. Em março de 2026, a empresa apresentou controle do computador no Cowork e no Claude Code, em preview. A proposta preferia conectores e recorria à tela quando faltava um caminho mais direto.

Revisitando isso em outubro de 2026, lembro do incômodo que expressei em setembro: Claude conseguia fazer coisas com as quais Codex ainda encontrava dificuldade. Ao mesmo tempo, eu considerava o modelo do Codex melhor. Pedi que essa capacidade aparecesse na experiência prática. Ter uma preferência pelo modelo e outra pela ferramenta era frustrante pra caramba.

Aquela comparação não identifica computer use como causa. Ela deixa clara a cobrança: o aplicativo precisa dar meios de execução ao modelo. Entender perfeitamente um pedido ajuda pouco quando a informação está do outro lado de um acesso que a ferramenta não oferece. Posso passar a tarde refinando a instrução e continuar com a mesma porta fechada.

Um conector que entrega o dado certo resolve uma parte desse caminho. Operar a tela amplia o alcance para aplicativos sem integração específica, mas acrescenta trabalho: encontrar o lugar e interpretar o que apareceu. O próprio anúncio reconhece que esse percurso pode ser mais lento e exigir outra tentativa. Eu prefiro a passagem direta quando ela existe.

Pra comparar produtos, quero começar com uma tarefa curta que atravesse esse limite. Localizar uma configuração e relatar seu estado, por exemplo, é um teste que eu proporia sem precisar alterar nada. O resultado esperado fica claro. Dá pra olhar como o agente chegou lá e conferir a evidência da resposta.

Também quero contar o preparo humano. Se eu tiver que abrir cada tela e organizar tudo antes de pedir ajuda, essa parte pertence ao custo da tarefa. A demonstração pode ficar bonita depois que alguém ajeitou o cenário inteiro. No trabalho, esse alguém sou eu, com outras coisas pra fazer.

Minha decisão é examinar o acesso antes de culpar o raciocínio. Quando o agente emperrar, quero saber qual ferramenta tinha e onde o caminho acabou. A comparação seguinte precisa manter o resultado desejado e mostrar quanto trabalho voltou pra mim. Só depois disso faz sentido trocar o modelo e ver o que muda.

Retrospectiva escrita em outubro de 2026. A data do post identifica a semana revisitada; as opiniões incorporam experiências posteriores.

Fontes: Anthropic

The Broad Way | Kinho.dev