ChatGPT Work vs Claude Cowork: qual agente vence?

O ChatGPT Work é grátis pra testar; o Claude Cowork manda seu e-mail. Comparativo de preço, modelos, benchmarks e confiança — e qual serve pra você.

Quarenta e oito horas. É esse o intervalo entre a Anthropic empurrar o Claude Cowork pra web e pro celular (7 de julho) e a OpenAI lançar o ChatGPT Work junto com o GPT-5.6 (9 de julho). Os dois maiores laboratórios de IA soltaram a mesma categoria de produto na mesma semana, e nenhum dos dois tá fingindo que é coincidência.

Então agora existem duas ferramentas sérias de “entrega um projeto inteiro pra IA”, e todo mundo tentando escolher entre elas fica comparando post de lançamento escrito por time de marketing. Esse é o comparativo que esses posts não vão te dar — incluindo os números onde cada lado perde.

Um aviso honesto de cara: é semana 1 do ChatGPT Work e semana 1 da era mobile do Cowork. Os detalhes abaixo vão envelhecer. O formato da escolha, não.

O veredito em 30 segundos

ChatGPT WorkClaude Cowork
Plano grátis✓ Sim — GPT-5.6 Terra, sem cartão✗ Não — só planos pagos
Melhor emProduzir entregas: planilhas, slides, docs, apps pequenosAgir nas suas ferramentas reais: arquivos, e-mail, agenda
Manda e-mail / marca reuniãoHoje não✓ Sim, pelas ferramentas de escrita do Microsoft 365
MobileAinda não (web + app de desktop)✓ iPhone e Android (desde 7 de julho)
ModelosGPT-5.6 Sol / Terra / Luna, modos max e ultraClaude Fable 5 / Opus 4.8
Recursos novos chegam emTodo plano (até o grátis leva Terra)Plano Max primeiro, os outros “nas próximas semanas”
Roda depois que você fecha o notebook✓ Tarefas em segundo plano✓ Segundo plano + tarefas agendadas
Ansiedade de usoReal — divide o limite com o CodexReal — um slide teria custado ~US$ 45 de uso

Se você só queria a resposta: grátis ou orçamento curto → ChatGPT Work. Seu trabalho vive no Microsoft 365 → Cowork. Você quer uma fábrica de artefatos → Work. Você quer um executor com mãos → Cowork. O resto do texto é o porquê — e onde cada resposta quebra.

O que cada um é de verdade

ChatGPT Work é o espaço de trabalho com agente que a OpenAI soltou com o GPT-5.6: passa um briefing de projeto, ele trabalha em segundo plano — de minutos a horas — e devolve um arquivo pronto. Planilhas com fórmulas de verdade, slides formatados, documentos longos, até pequenos apps web que funcionam. Roda na mesma infraestrutura do Codex, o agente de código da OpenAI, apontada pro trabalho de escritório. A gente escreveu um guia completo pra iniciante se você tá começando do zero.

Claude Cowork é a versão da Anthropic, e ela vem amadurecendo desde janeiro — e isso aparece. Desde 7 de julho ele roda em desktop, web e celular; continua trabalhando na nuvem depois que você fecha o notebook; roda em horário agendado se você pedir; e (a manchete) as ferramentas de escrita do Microsoft 365 deixam ele mandar e-mail, cuidar da sua agenda, organizar a caixa de entrada e editar arquivos no SharePoint. Nosso guia de como usar cobre o básico.

Mesma categoria. Filosofia genuinamente diferente — e essa é a parte que vale entender antes de qualquer ficha técnica.

A divisão real: criadores vs. executores

Duas teorias sobre o que um agente de IA deveria ser
📦 ChatGPT Work
O criador
produz artefatos: uma planilha, um slide, um doc, um app · você revisa a saída e aí VOCÊ age em cima dela · raio de dano = um arquivo ruim
✉️ Claude Cowork
O executor
age dentro das suas contas: manda o e-mail, marca a reunião, edita o arquivo no SharePoint · você define as permissões e aí ele MOVE as coisas
Peraí — isso merece uma linguagem mais direta, porque é a decisão inteira.

Quando o ChatGPT Work termina, você recebe uma coisa. A pior falha realista é uma coisa errada, que você pega (ou não) quando abre. Nada saiu do prédio. Quando o Cowork termina, algo pode ter acontecido — uma mensagem enviada do seu endereço, uma reunião na agenda de alguém, um arquivo alterado onde o seu time trabalha. A maioria das ações do Cowork pede permissão pelo caminho, mas a permissão de envio do connector do Microsoft 365 se chama literalmente Mail.Send, e a documentação não promete um “tem certeza?” final antes de uma mensagem sair da sua caixa.

Nenhuma das duas filosofias é “a certa”. Um agente que não toca nas suas ferramentas reais faz de você o entregador de tudo que ele produz. Um agente que toca nelas faz da sua atenção a única rede de segurança. Escolhe pelo tipo de falha que você prefere gerenciar — não pela demo que parece mais legal.

Preço e acesso: um deles é grátis

O ChatGPT Work vem incluído em todo plano — inclusive no grátis. Free e Go recebem o GPT-5.6 Terra dentro do Work (um modelo que bate o carro-chefe da geração passada em vários benchmarks), planos pagos escolhem entre Sol, Terra e Luna, e Pro/Enterprise liberam o ultra, que joga quatro agentes em paralelo numa tarefa só. Esse grátis não é uma demo capada; é um agente de verdade com o modelo mais novo de porte médio da OpenAI. Mapa completo dos planos aqui.

O Cowork não tem porta grátis. Precisa de um plano Claude pago — funciona no Pro por US$ 20/mês, mas tem um detalhe fácil de perder: os recursos novos chegam primeiro nos planos Max de US$ 100+. Os recursos de mobile e segundo plano de 7 de julho foram Max primeiro, com os outros planos prometidos “nas próximas semanas”. No Claude, a coisa brilhante do anúncio geralmente não é a coisa que o seu plano de US$ 20 tem hoje.

As plataformas cortam pro outro lado: o Cowork tá no seu celular; o ChatGPT Work ainda não. As sessões do Cowork seguem rodando na nuvem e te cutucam no celular quando o Claude precisa de uma decisão. Se o seu dia de trabalho acontece entre reuniões em vez de numa mesa, essa não é uma diferença pequena. Um asterisco: o Cowork no mobile e na web não alcança seus arquivos locais como o Cowork de desktop alcança — mesmo nome, menos alcance.

Modelos e músculo: a questão dos benchmarks

Por baixo do capô é GPT-5.6 contra a família Claude 5, e dessa vez a gente tem os números dos dois vendors mais um juiz neutro.

Da própria tabela de lançamento da OpenAI — que, crédito onde é devido, inclui linhas em que a OpenAI perde:

Benchmark (o que mede)GPT-5.6 SolMelhor Claude
Agents’ Last Exam (workflows profissionais longos)52,7%45,2% (Opus 4.8)
OSWorld 2.0 (operar um computador)62,6%54,8% (Opus 4.8)
Terminal-Bench 2.1 (trabalho de linha de comando)88,8% (91,9% no ultra)88% (Mythos 5)
SWE-Bench Pro (correções de software reais)64,6%80,3% (Mythos 5)
GDPval-AA (especialistas avaliam a qualidade do trabalho pronto)1.747,81.759,6 (Fable 5)
Índice de Inteligência (Artificial Analysis)58,959,9 (Fable 5)

E o juiz: a Cursor — o editor de código com IA, sem lealdade a nenhum dos dois labs — roda o CursorBench sobre sessões reais de usuário: tarefas ambíguas, multiarquivo, mal especificadas. O oposto de condição de prova. Placar atual: Claude Fable 5 Max na frente com 70,5%, GPT-5.6 Sol Max logo atrás com 67,2% — mas a rodada do Sol custou US$ 5,22 contra US$ 17,32 do Fable. A Claude mantém uma vantagem de qualidade pequena e real; a OpenAI ganha no preço por umas 3×.

Agora o disclaimer, e lê duas vezes, porque tabela de benchmark decide mais compra do que deveria. Número de vendor vem de post de lançamento de vendor — eles escolhem os testes, os concorrentes e as configurações (aquele 91,9% é o ultra, um modo de quatro agentes de uma vez que você não roda por acaso). Benchmark é condição de prova: entrada limpa, meta definida, sem política de escritório, sem “na verdade o prazo mudou”. O seu trabalho é ambíguo, meio documentado e cheio de contexto que ranking nenhum enxerga. Uma diferença de três pontos num gráfico não diz nada sobre qual agente lida com o tom do seu cliente, as convenções da sua planilha, a sua caixa de entrada. As notas acima te dizem que as duas ferramentas são de fronteira e que nenhuma zera o placar. Elas não têm como te dizer qual é melhor pra você — só uma semana das suas próprias tarefas tem.

A conta que ninguém mostra nas demos

Os dois agentes dividem uma verdade incômoda: trabalho de agente queima cota de uso num ritmo que o chat nunca queimou.

Do lado do ChatGPT, o Work divide os limites com o Codex, e na semana de lançamento a galera viu tarefas pesadas comerem boa parte de uma janela de uso — o ultra multiplica a queima de propósito. Do lado do Claude, um usuário relatou que uma única tarefa do Cowork — montar uma apresentação — consumiu mais ou menos US$ 45 de uso, e um assinante Pro descobriu que uma sessão de cinco horas do Cowork comeu cerca de 15% de uma cota semanal. A Anthropic dobrou o limite de cinco horas do Cowork até 5 de agosto, mas os tetos semanais não mudaram: você queima mais rápido, e não ganha mais.

A regra prática é idêntica nos dois: trata rodada de agente como reunião, não como mensagem. Agenda as que pagam o próprio custo. Escreve o briefing direito de primeira — cinco rodadas mal feitas custam cinco vezes uma boa.

Confiança, segurança e quem tá sendo cuidadoso

O discurso da Anthropic sempre foi o do cuidado, e o modelo de permissão do Cowork em boa parte cumpre isso: o Claude usa as suas credenciais do Microsoft em vez de ter as próprias, só enxerga o que você enxerga, os envios ficam atribuídos a você, e um admin da organização precisa consentir antes de qualquer ferramenta de escrita existir. É um design genuinamente sólido — com a única brecha apontada lá em cima (sem confirmação garantida no envio de e-mail pelo connector) e o risco de sempre que todo agente ligado à caixa de entrada carrega: prompt injection por e-mail que chega.

A resposta da OpenAI é mais arquitetônica que processual: o ChatGPT Work em geral não age nos seus sistemas — ele faz coisas e te entrega. Menos permissão pra auditar porque tem menos coisa que ele pode tocar. Você é o mecanismo de deploy, o que é mais lento e mais seguro.

Pra um usuário solo, sinceramente, dá pra gerenciar as duas posturas. Pra um admin de TI, as perguntas mudam: com o Cowork você audita permissões (Mail.Send, Calendars.ReadWrite); com o ChatGPT Work você audita o que os funcionários colam nele e pra onde vão os artefatos. Escolhe a sua papelada.

Então, qual deles, pra você?

Você tá com orçamento curto ou só curioso → ChatGPT Work, e nem é perto. Acesso grátis a um agente de fronteira sem cartão é o presente de verdade desse lançamento. Aprende a passar briefing no Terra; decide sobre pagar depois.

Seu trabalho roda em Outlook, Teams e SharePoint → o Cowork tá jogando um jogo em que o ChatGPT Work nem entrou: ele consegue de fato fazer coisas no Microsoft 365, não só rascunhar. Reserva orçamento pro Max se você quer os recursos novos agora, e pilota as ferramentas de escrita com as rodinhas de apoio postas.

Você produz documentos, slides e análises o dia todo → a fábrica de artefatos do ChatGPT Work foi feita pra você, e o Terra grátis significa que dá pra testar essa afirmação hoje.

Você é dev → cálculo diferente: a Claude ainda lidera os benchmarks de engenharia de software real por uma margem larga (SWE-Bench Pro: 80,3 vs 64,6), enquanto o modo ultra e o preço da OpenAI são agressivos. Roda os dois contra o seu repo; dá uma olhada também no comparativo Copilot Cowork se você tá na stack Microsoft.

Você lidera um time e tem que escolher UM → começa pelo que o time já paga. Essas ferramentas premiam contexto que já existe (contas conectadas, hábitos aprendidos) muito mais que diferença de benchmark. O custo de trocar é real; a diferença de três pontos na nota não é.

Você genuinamente não consegue decidir → roda as mesmas três tarefas reais nos dois essa semana. Uma vai precisar de menos babá no seu trabalho. Essa é a sua resposta, e blog nenhum — incluindo esse — consegue calcular pra você.

O que nenhum dos dois vai fazer

  • Saber os seus padrões. Os dois produzem um genérico competente; os últimos 20% que fazem o trabalho ser seu continuam sendo seus.
  • Conferir os próprios fatos. Os dois vão formatar um número errado lindamente. Verifica qualquer coisa que alimente uma decisão.
  • Ficar parado tempo suficiente pra esse comparativo ser final. A OpenAI soltou agente no grátis; a Anthropic vai responder. O Cowork ganhou ferramentas de escrita; espera o ChatGPT Work ganhar mãos em algum momento. Revisita daqui a um trimestre.
  • Substituir conhecer o trabalho. Você não revisa um modelo financeiro que não saberia esboçar. Agente aumenta o valor do julgamento; não aposenta ele.

Resumindo

ChatGPT Work contra Claude Cowork não é bem OpenAI contra Anthropic — é criador contra executor. Um monta artefatos pra você e deixa o agir por sua conta, com plano grátis incluído. O outro entra nas suas ferramentas de verdade, manda o seu e-mail de verdade, e te pede pra gerenciar a confiança que isso exige, num preço só pra quem paga. Os benchmarks dizem que os dois são de fronteira e que nenhum zera o placar; a avaliação-juiz diz que a Claude é um pouco melhor e a OpenAI é bem mais barata; e nenhum desses números conhece o seu trabalho.

A skill que atravessa os dois — e atravessa o que vier no próximo trimestre — é dirigir bem um agente de IA: passar briefing, revisar, corrigir. É exatamente isso que o nosso ChatGPT Agents e Projects constrói, e o Agentes de IA na Prática aprofunda no lado dos agentes sem código. Aprende a delegar; o logo no agente importa menos a cada mês.

Fontes

Build Real AI Skills

Step-by-step courses with quizzes and certificates for your resume