Atualmente, a capacidade de Computer Use da GPT 6 Astra é o que mais me impressiona. Diferente da GPT 5.6, que exigia esperar um pouco antes de executar várias operações, agora ela consegue testar um app de forma rápida e precisa. Ver enquanto ela clica ao lado é realmente uma experiência prazerosa https://x.com/victornunez/status/2095975651094261777/video/1

Na verdade, isso traz uma grande melhoria: permite que o agente forme um ciclo completo, indo do desenvolvimento à validação.

Imagine que agora, ao desenvolver, mesmo quando a implementação está concluída, ainda é inevitável ter muitas etapas para validar manualmente. Isso inclui testes dos sistemas em produção, que dependem cada vez mais de frameworks de teste ponta a ponta como o PlayWright para executar as verificações. Antes, o Computer Use também não era impossível, mas o custo era relativamente alto, a taxa de acerto era menor e a velocidade não era tão rápida.

Mas talvez a GPT 6 tenha cruzado um “ponto de virada” do Computer Use: alta precisão, velocidade e rapidez. Em termos de custo, ainda não é baixo, mas é possível imaginar que no futuro ele continue a cair.

Eu sugiro que, quando você for atribuir tarefas à GPT 6, deixe que ela use o Computer Use para testar e validar por conta própria — isso pode reduzir bastante o seu trabalho de validação manual.

Além disso, alguns testes automatizados de apps também podem tentar fazer com a GPT-6 chamando o Computer Use, para cobrir cenários que antes não eram cobertos por frameworks de testes ponta a ponta ou em que o custo era alto.