Quarenta e oito horas. É esse o intervalo entre a Anthropic empurrar o Claude Cowork pra web e pro celular (7 de julho) e a OpenAI lançar o ChatGPT Work junto com o GPT-5.6 (9 de julho). Os dois maiores laboratórios de IA soltaram a mesma categoria de produto na mesma semana, e nenhum dos dois tá fingindo que é coincidência.
Então agora existem duas ferramentas sérias de “entrega um projeto inteiro pra IA”, e todo mundo tentando escolher entre elas fica comparando post de lançamento escrito por time de marketing. Esse é o comparativo que esses posts não vão te dar — incluindo os números onde cada lado perde.
Um aviso honesto de cara: é semana 1 do ChatGPT Work e semana 1 da era mobile do Cowork. Os detalhes abaixo vão envelhecer. O formato da escolha, não.
O veredito em 30 segundos
| ChatGPT Work | Claude Cowork | |
|---|---|---|
| Plano grátis | ✓ Sim — GPT-5.6 Terra, sem cartão | ✗ Não — só planos pagos |
| Melhor em | Produzir entregas: planilhas, slides, docs, apps pequenos | Agir nas suas ferramentas reais: arquivos, e-mail, agenda |
| Manda e-mail / marca reunião | Hoje não | ✓ Sim, pelas ferramentas de escrita do Microsoft 365 |
| Mobile | Ainda não (web + app de desktop) | ✓ iPhone e Android (desde 7 de julho) |
| Modelos | GPT-5.6 Sol / Terra / Luna, modos max e ultra | Claude Fable 5 / Opus 4.8 |
| Recursos novos chegam em | Todo plano (até o grátis leva Terra) | Plano Max primeiro, os outros “nas próximas semanas” |
| Roda depois que você fecha o notebook | ✓ Tarefas em segundo plano | ✓ Segundo plano + tarefas agendadas |
| Ansiedade de uso | Real — divide o limite com o Codex | Real — um slide teria custado ~US$ 45 de uso |
Se você só queria a resposta: grátis ou orçamento curto → ChatGPT Work. Seu trabalho vive no Microsoft 365 → Cowork. Você quer uma fábrica de artefatos → Work. Você quer um executor com mãos → Cowork. O resto do texto é o porquê — e onde cada resposta quebra.
O que cada um é de verdade
ChatGPT Work é o espaço de trabalho com agente que a OpenAI soltou com o GPT-5.6: passa um briefing de projeto, ele trabalha em segundo plano — de minutos a horas — e devolve um arquivo pronto. Planilhas com fórmulas de verdade, slides formatados, documentos longos, até pequenos apps web que funcionam. Roda na mesma infraestrutura do Codex, o agente de código da OpenAI, apontada pro trabalho de escritório. A gente escreveu um guia completo pra iniciante se você tá começando do zero.
Claude Cowork é a versão da Anthropic, e ela vem amadurecendo desde janeiro — e isso aparece. Desde 7 de julho ele roda em desktop, web e celular; continua trabalhando na nuvem depois que você fecha o notebook; roda em horário agendado se você pedir; e (a manchete) as ferramentas de escrita do Microsoft 365 deixam ele mandar e-mail, cuidar da sua agenda, organizar a caixa de entrada e editar arquivos no SharePoint. Nosso guia de como usar cobre o básico.
Mesma categoria. Filosofia genuinamente diferente — e essa é a parte que vale entender antes de qualquer ficha técnica.
A divisão real: criadores vs. executores
Quando o ChatGPT Work termina, você recebe uma coisa. A pior falha realista é uma coisa errada, que você pega (ou não) quando abre. Nada saiu do prédio. Quando o Cowork termina, algo pode ter acontecido — uma mensagem enviada do seu endereço, uma reunião na agenda de alguém, um arquivo alterado onde o seu time trabalha. A maioria das ações do Cowork pede permissão pelo caminho, mas a permissão de envio do connector do Microsoft 365 se chama literalmente Mail.Send, e a documentação não promete um “tem certeza?” final antes de uma mensagem sair da sua caixa.
Nenhuma das duas filosofias é “a certa”. Um agente que não toca nas suas ferramentas reais faz de você o entregador de tudo que ele produz. Um agente que toca nelas faz da sua atenção a única rede de segurança. Escolhe pelo tipo de falha que você prefere gerenciar — não pela demo que parece mais legal.
Preço e acesso: um deles é grátis
O ChatGPT Work vem incluído em todo plano — inclusive no grátis. Free e Go recebem o GPT-5.6 Terra dentro do Work (um modelo que bate o carro-chefe da geração passada em vários benchmarks), planos pagos escolhem entre Sol, Terra e Luna, e Pro/Enterprise liberam o ultra, que joga quatro agentes em paralelo numa tarefa só. Esse grátis não é uma demo capada; é um agente de verdade com o modelo mais novo de porte médio da OpenAI. Mapa completo dos planos aqui.
O Cowork não tem porta grátis. Precisa de um plano Claude pago — funciona no Pro por US$ 20/mês, mas tem um detalhe fácil de perder: os recursos novos chegam primeiro nos planos Max de US$ 100+. Os recursos de mobile e segundo plano de 7 de julho foram Max primeiro, com os outros planos prometidos “nas próximas semanas”. No Claude, a coisa brilhante do anúncio geralmente não é a coisa que o seu plano de US$ 20 tem hoje.
As plataformas cortam pro outro lado: o Cowork tá no seu celular; o ChatGPT Work ainda não. As sessões do Cowork seguem rodando na nuvem e te cutucam no celular quando o Claude precisa de uma decisão. Se o seu dia de trabalho acontece entre reuniões em vez de numa mesa, essa não é uma diferença pequena. Um asterisco: o Cowork no mobile e na web não alcança seus arquivos locais como o Cowork de desktop alcança — mesmo nome, menos alcance.
Modelos e músculo: a questão dos benchmarks
Por baixo do capô é GPT-5.6 contra a família Claude 5, e dessa vez a gente tem os números dos dois vendors mais um juiz neutro.
Da própria tabela de lançamento da OpenAI — que, crédito onde é devido, inclui linhas em que a OpenAI perde:
| Benchmark (o que mede) | GPT-5.6 Sol | Melhor Claude |
|---|---|---|
| Agents’ Last Exam (workflows profissionais longos) | 52,7% | 45,2% (Opus 4.8) |
| OSWorld 2.0 (operar um computador) | 62,6% | 54,8% (Opus 4.8) |
| Terminal-Bench 2.1 (trabalho de linha de comando) | 88,8% (91,9% no ultra) | 88% (Mythos 5) |
| SWE-Bench Pro (correções de software reais) | 64,6% | 80,3% (Mythos 5) |
| GDPval-AA (especialistas avaliam a qualidade do trabalho pronto) | 1.747,8 | 1.759,6 (Fable 5) |
| Índice de Inteligência (Artificial Analysis) | 58,9 | 59,9 (Fable 5) |
E o juiz: a Cursor — o editor de código com IA, sem lealdade a nenhum dos dois labs — roda o CursorBench sobre sessões reais de usuário: tarefas ambíguas, multiarquivo, mal especificadas. O oposto de condição de prova. Placar atual: Claude Fable 5 Max na frente com 70,5%, GPT-5.6 Sol Max logo atrás com 67,2% — mas a rodada do Sol custou US$ 5,22 contra US$ 17,32 do Fable. A Claude mantém uma vantagem de qualidade pequena e real; a OpenAI ganha no preço por umas 3×.
Agora o disclaimer, e lê duas vezes, porque tabela de benchmark decide mais compra do que deveria. Número de vendor vem de post de lançamento de vendor — eles escolhem os testes, os concorrentes e as configurações (aquele 91,9% é o ultra, um modo de quatro agentes de uma vez que você não roda por acaso). Benchmark é condição de prova: entrada limpa, meta definida, sem política de escritório, sem “na verdade o prazo mudou”. O seu trabalho é ambíguo, meio documentado e cheio de contexto que ranking nenhum enxerga. Uma diferença de três pontos num gráfico não diz nada sobre qual agente lida com o tom do seu cliente, as convenções da sua planilha, a sua caixa de entrada. As notas acima te dizem que as duas ferramentas são de fronteira e que nenhuma zera o placar. Elas não têm como te dizer qual é melhor pra você — só uma semana das suas próprias tarefas tem.
A conta que ninguém mostra nas demos
Os dois agentes dividem uma verdade incômoda: trabalho de agente queima cota de uso num ritmo que o chat nunca queimou.
Do lado do ChatGPT, o Work divide os limites com o Codex, e na semana de lançamento a galera viu tarefas pesadas comerem boa parte de uma janela de uso — o ultra multiplica a queima de propósito. Do lado do Claude, um usuário relatou que uma única tarefa do Cowork — montar uma apresentação — consumiu mais ou menos US$ 45 de uso, e um assinante Pro descobriu que uma sessão de cinco horas do Cowork comeu cerca de 15% de uma cota semanal. A Anthropic dobrou o limite de cinco horas do Cowork até 5 de agosto, mas os tetos semanais não mudaram: você queima mais rápido, e não ganha mais.
A regra prática é idêntica nos dois: trata rodada de agente como reunião, não como mensagem. Agenda as que pagam o próprio custo. Escreve o briefing direito de primeira — cinco rodadas mal feitas custam cinco vezes uma boa.
Confiança, segurança e quem tá sendo cuidadoso
O discurso da Anthropic sempre foi o do cuidado, e o modelo de permissão do Cowork em boa parte cumpre isso: o Claude usa as suas credenciais do Microsoft em vez de ter as próprias, só enxerga o que você enxerga, os envios ficam atribuídos a você, e um admin da organização precisa consentir antes de qualquer ferramenta de escrita existir. É um design genuinamente sólido — com a única brecha apontada lá em cima (sem confirmação garantida no envio de e-mail pelo connector) e o risco de sempre que todo agente ligado à caixa de entrada carrega: prompt injection por e-mail que chega.
A resposta da OpenAI é mais arquitetônica que processual: o ChatGPT Work em geral não age nos seus sistemas — ele faz coisas e te entrega. Menos permissão pra auditar porque tem menos coisa que ele pode tocar. Você é o mecanismo de deploy, o que é mais lento e mais seguro.
Pra um usuário solo, sinceramente, dá pra gerenciar as duas posturas. Pra um admin de TI, as perguntas mudam: com o Cowork você audita permissões (Mail.Send, Calendars.ReadWrite); com o ChatGPT Work você audita o que os funcionários colam nele e pra onde vão os artefatos. Escolhe a sua papelada.
Então, qual deles, pra você?
Você tá com orçamento curto ou só curioso → ChatGPT Work, e nem é perto. Acesso grátis a um agente de fronteira sem cartão é o presente de verdade desse lançamento. Aprende a passar briefing no Terra; decide sobre pagar depois.
Seu trabalho roda em Outlook, Teams e SharePoint → o Cowork tá jogando um jogo em que o ChatGPT Work nem entrou: ele consegue de fato fazer coisas no Microsoft 365, não só rascunhar. Reserva orçamento pro Max se você quer os recursos novos agora, e pilota as ferramentas de escrita com as rodinhas de apoio postas.
Você produz documentos, slides e análises o dia todo → a fábrica de artefatos do ChatGPT Work foi feita pra você, e o Terra grátis significa que dá pra testar essa afirmação hoje.
Você é dev → cálculo diferente: a Claude ainda lidera os benchmarks de engenharia de software real por uma margem larga (SWE-Bench Pro: 80,3 vs 64,6), enquanto o modo ultra e o preço da OpenAI são agressivos. Roda os dois contra o seu repo; dá uma olhada também no comparativo Copilot Cowork se você tá na stack Microsoft.
Você lidera um time e tem que escolher UM → começa pelo que o time já paga. Essas ferramentas premiam contexto que já existe (contas conectadas, hábitos aprendidos) muito mais que diferença de benchmark. O custo de trocar é real; a diferença de três pontos na nota não é.
Você genuinamente não consegue decidir → roda as mesmas três tarefas reais nos dois essa semana. Uma vai precisar de menos babá no seu trabalho. Essa é a sua resposta, e blog nenhum — incluindo esse — consegue calcular pra você.
O que nenhum dos dois vai fazer
- Saber os seus padrões. Os dois produzem um genérico competente; os últimos 20% que fazem o trabalho ser seu continuam sendo seus.
- Conferir os próprios fatos. Os dois vão formatar um número errado lindamente. Verifica qualquer coisa que alimente uma decisão.
- Ficar parado tempo suficiente pra esse comparativo ser final. A OpenAI soltou agente no grátis; a Anthropic vai responder. O Cowork ganhou ferramentas de escrita; espera o ChatGPT Work ganhar mãos em algum momento. Revisita daqui a um trimestre.
- Substituir conhecer o trabalho. Você não revisa um modelo financeiro que não saberia esboçar. Agente aumenta o valor do julgamento; não aposenta ele.
Resumindo
ChatGPT Work contra Claude Cowork não é bem OpenAI contra Anthropic — é criador contra executor. Um monta artefatos pra você e deixa o agir por sua conta, com plano grátis incluído. O outro entra nas suas ferramentas de verdade, manda o seu e-mail de verdade, e te pede pra gerenciar a confiança que isso exige, num preço só pra quem paga. Os benchmarks dizem que os dois são de fronteira e que nenhum zera o placar; a avaliação-juiz diz que a Claude é um pouco melhor e a OpenAI é bem mais barata; e nenhum desses números conhece o seu trabalho.
A skill que atravessa os dois — e atravessa o que vier no próximo trimestre — é dirigir bem um agente de IA: passar briefing, revisar, corrigir. É exatamente isso que o nosso ChatGPT Agents e Projects constrói, e o Agentes de IA na Prática aprofunda no lado dos agentes sem código. Aprende a delegar; o logo no agente importa menos a cada mês.
Fontes
- ChatGPT is now a partner for your most ambitious work — OpenAI (9 de julho de 2026)
- GPT-5.6: Frontier intelligence that scales with your ambition — OpenAI (9 de julho de 2026)
- Claude Cowork on web and mobile: hand off work anywhere — Anthropic (7 de julho de 2026)
- Anthropic brings Claude Cowork to mobile and web — VentureBeat
- CursorBench: model evals on real Cursor sessions — Cursor
- OpenAI releases GPT-5.6 and ChatGPT Work tool — Axios