A OpenAI lançou o ChatGPT Agent, uma inteligência artificial revolucionária que executa tarefas complexas de forma autônoma, utilizando um “computador virtual”. Anunciado em 17 de julho de 2025, o sistema foi apresentado por Yash Kumar e Isa Fulford, líderes do projeto, em demonstração ao The Verge. Disponível inicialmente para assinantes dos planos Pro, Plus e Team, o agente opera em modo autônomo, acessando ferramentas como navegadores e terminais para realizar ações como agendar reuniões, planejar refeições ou criar apresentações. A ferramenta, que combina tecnologias do Operator e Deep Research, promete otimizar rotinas pessoais e profissionais, mas enfrenta desafios como latência e restrições em transações financeiras.
A nova ferramenta marca um avanço significativo na automação impulsionada por inteligência artificial. Diferentemente de chatbots tradicionais, o ChatGPT Agent não se limita a responder perguntas, mas executa ações práticas em ambientes digitais. Ele pode, por exemplo, consultar calendários, reservar restaurantes ou sintetizar dados de sites em relatórios detalhados. A integração com conectores, como Gmail e GitHub, permite acesso a informações contextuais, ampliando sua utilidade.
O desenvolvimento do agente envolveu a fusão das equipes de Operator e Deep Research, unindo capacidades de navegação web e análise profunda de dados. A tecnologia, baseada em aprendizado por reforço, permite ao sistema escolher as melhores ferramentas para cada tarefa, seja um navegador visual para interações gráficas ou um terminal para manipulação de dados.
- Funcionalidades principais do ChatGPT Agent
- Navegação autônoma em sites para realizar tarefas como reservas ou pesquisas.
- Integração com aplicativos externos, como Google Calendar e OpenTable.
- Geração de relatórios e apresentações com base em análise de dados.
- Automação de tarefas repetitivas, como agendamento semanal de compromissos.
Capacidades inovadoras do agente
O ChatGPT Agent se destaca por sua capacidade de operar como um assistente digital completo, indo além de interações conversacionais. Yash Kumar, líder do produto, demonstrou como o agente automatiza tarefas rotineiras, como reservas de estacionamento na sede da OpenAI em San Francisco. Já Isa Fulford destacou sua eficácia em compras online, combinando pesquisa detalhada com ações práticas, como selecionar produtos em sites. A ferramenta utiliza um modelo treinado especificamente para tarefas complexas, alcançando desempenho de ponta em testes como o Humanity’s Last Exam, com pontuação de 41,6%.
O sistema opera em um ambiente virtual próprio, permitindo que manipule dados sem interferir diretamente no dispositivo do usuário. Isso garante maior segurança e preserva o contexto das tarefas, mesmo quando múltiplas ferramentas são usadas. Por exemplo, o agente pode baixar um arquivo, editá-lo em um terminal e exibir o resultado em um navegador visual, tudo de forma integrada.
A flexibilidade do agente permite que ele se adapte a imprevistos, como erros em sites ou mudanças nos requisitos da tarefa. Usuários podem ajustar solicitações em tempo real, como mudar o tipo de restaurante durante o planejamento de um jantar, e o sistema reconfigura o processo automaticamente.
Saiba mais: ChatGPT libera app para computadores, prometendo revolucionar o uso do sistema operacional
Limitações e desafios operacionais
Apesar de suas capacidades, o ChatGPT Agent enfrenta limitações significativas. A latência é um dos principais entraves, com tarefas complexas podendo levar de 15 a 30 minutos, como apontado por Kumar e Fulford. A prioridade da equipe é otimizar a execução de tarefas difíceis, não a velocidade de resposta. Isso torna o agente mais adequado para processos em segundo plano, onde o usuário inicia uma tarefa e retorna mais tarde para verificar o resultado.
- Principais desafios do ChatGPT Agent
- Latência em tarefas extensas, como geração de apresentações (até 25 minutos).
- Restrições em transações financeiras, bloqueadas por segurança.
- Necessidade de confirmação do usuário para ações irreversíveis, como envios de e-mails.
- Modo Watch, que interrompe operações se o usuário mudar de aba em sites financeiros.
Outro ponto é a ausência temporária do recurso de memória, desativado por precauções de segurança contra ataques como injeção de prompts. A OpenAI também implementou salvaguardas para mitigar riscos em áreas sensíveis, como biologia e química, embora não haja evidências de que o agente possa ser usado para criar armas.
Aplicações práticas no dia a dia
O ChatGPT Agent foi projetado para atender tanto usuários individuais quanto empresas. Na esfera pessoal, ele pode planejar viagens, reservar jantares ou encontrar especialistas para consultas médicas. Em contextos profissionais, o agente é capaz de criar relatórios financeiros, gerenciar agendas corporativas ou automatizar fluxos de trabalho repetitivos. Um exemplo prático é a geração de apresentações baseadas em análises de concorrentes, uma tarefa que combina pesquisa web com formatação de dados.
Empresas como a OpenAI já utilizam o agente internamente. Kumar, por exemplo, automatizou suas reservas semanais de estacionamento, eliminando a necessidade de realizar a tarefa manualmente. A ferramenta também permite agendamentos recorrentes, como relatórios semanais de métricas, que são gerados automaticamente.
- Exemplos de uso prático
- Planejamento de eventos, como jantares, com base em disponibilidade de agenda.
- Criação de slides com análise de dados financeiros de empresas concorrentes.
- Automação de reservas, como estacionamento ou passagens aéreas.
- Resumo de e-mails e organização de compromissos via conectores como Gmail.
Segurança e controle do usuário
A OpenAI priorizou a segurança no desenvolvimento do ChatGPT Agent. Antes de realizar ações irreversíveis, como enviar e-mails ou fazer reservas, o sistema solicita confirmação do usuário. Além disso, o modo Watch impede interações em sites financeiros se o usuário alternar abas, reduzindo riscos de uso indevido.
A empresa também implementou defesas contra ataques de injeção de prompts, nos quais instruções maliciosas poderiam ser inseridas em conteúdos online. Um modelo de monitoramento atua em tempo real, pausando tarefas se detectar comportamentos suspeitos. Essas medidas visam equilibrar a autonomia do agente com o controle do usuário, garantindo que ele permaneça uma ferramenta segura e confiável.
No mesmo tema: Google Gemini Spark otimiza tarefas e integra serviços na rotina dos usuários
Integração com ferramentas externas
A capacidade do ChatGPT Agent de se conectar a aplicativos externos é um de seus maiores diferenciais. Ele pode acessar o Google Calendar para verificar compromissos, usar o OpenTable para encontrar reservas ou integrar-se ao GitHub para gerenciar projetos. Essa interoperabilidade é possibilitada por conectores que permitem ao agente extrair informações contextuais e agir com base nelas.
- Ferramentas integradas ao ChatGPT Agent
- Google Calendar: verifica disponibilidade para eventos e reuniões.
- OpenTable: busca e reserva mesas em restaurantes.
- Gmail: resume e-mails e organiza comunicações.
- GitHub: acessa repositórios para tarefas de desenvolvimento.
A integração com APIs e terminais também permite que o agente manipule dados personalizados, como planilhas ou arquivos importados pelo usuário. Essa funcionalidade é especialmente útil para profissionais que lidam com grandes volumes de informações, como analistas financeiros ou gerentes de projeto.
Futuro da automação com IA
O lançamento do ChatGPT Agent reflete uma tendência crescente na indústria de tecnologia, com empresas como Google, Salesforce e HubSpot investindo em agentes de IA. A OpenAI planeja expandir o acesso ao agente para usuários Enterprise e Education nas próximas semanas, embora a disponibilidade em regiões como a União Europeia ainda não tenha data definida.
A ferramenta representa um passo em direção a assistentes digitais mais próximos de sistemas fictícios como o J.A.R.V.I.S., do Homem de Ferro, capazes de gerenciar tarefas complexas com mínima intervenção humana. No entanto, a empresa reconhece que o agente ainda está em fase inicial e planeja aprimorar sua eficiência e versatilidade com base em feedback dos usuários.
Mais sobre o assunto: Google acelera IA com lançamento do Gemini 3.7 Flash para desenvolvedores
- Próximos passos da OpenAI
- Expansão do acesso para usuários corporativos e educacionais.
- Melhorias na latência para tarefas mais rápidas.
- Integração de recursos de memória, quando considerados seguros.
- Aumento da variedade de conectores para novas plataformas.

