ChatGPT Work Hay Claude Cowork: Nên Chọn Gì?

ChatGPT Work miễn phí để thử; Claude Cowork gửi được email của bạn. So găng giá, model, benchmark và độ tin cậy — và cái nào hợp việc của bạn.

48 tiếng. Đó là khoảng cách giữa lúc Anthropic tung Claude Cowork lên web và điện thoại (7/7) với lúc OpenAI ra mắt ChatGPT Work cùng GPT-5.6 (9/7). Hai phòng lab AI lớn nhất đã giao cùng một loại sản phẩm trong cùng một tuần, và chẳng bên nào giả vờ rằng đây là trùng hợp ngẫu nhiên.

Giờ đây đã có hai công cụ “nghiêm chỉnh” thực thụ để giao nguyên cả dự án cho AI, và ai đang phân vân chọn bên nào cũng đang đau đầu so sánh các bài đăng ra mắt do đội marketing viết. Đây chính là bản so sánh mà những bài đăng đó sẽ không cho bạn thấy — kể cả những con số ở bên nào đang “thua cuộc”.

Một lời thành thật trước tiên: ChatGPT Work mới chỉ bước vào tuần đầu tiên, còn Cowork cũng mới bước vào kỷ nguyên di động của nó. Những chi tiết bên dưới có thể sẽ “cũ” đi theo thời gian, nhưng hình hài của lựa chọn thì vẫn giữ nguyên.

Bản tóm tắt 30 giây

ChatGPT WorkClaude Cowork
Gói miễn phí✓ Có — GPT-5.6 Terra, không cần thẻ✗ Không — chỉ gói trả phí
Giỏi nhất ởTạo sản phẩm: bảng tính, slide, tài liệu, app nhỏHành động trong công cụ thật: file, email, lịch
Gửi email / đặt lịch họpHiện chưa✓ Có, qua công cụ ghi Microsoft 365
Điện thoạiChưa (web + app desktop)✓ iPhone & Android (từ 7/7)
ModelGPT-5.6 Sol / Terra / Luna, chế độ max & ultraClaude Fable 5 / Opus 4.8
Tính năng mới về gói nào trướcMọi gói (kể cả free có Terra)Gói Max trước, gói khác “vài tuần tới”
Chạy tiếp sau khi bạn tắt máy✓ Tác vụ nền✓ Tác vụ nền + hẹn giờ
Nỗi lo hạn mứcCó thật — chung rate limit với CodexCó thật — một slide tốn ~$45 hạn mức

Nếu bạn chỉ muốn một câu trả lời nhanh: ưu tiên miễn phí hoặc ngân sách hạn hẹp → ChatGPT Work. Công việc của bạn “gắn bó” với Microsoft 365 → Cowork. Bạn muốn một “nhà máy” tạo sản phẩm → Work. Bạn cần một “cánh tay nối dài” biết hành động thực tế → Cowork. Phần còn lại của bài viết này sẽ giải thích tại sao — và ở đâu thì mỗi câu trả lời đó có thể “gãy gập”.

Thực chất mỗi bên là gì

ChatGPT Work là không gian làm việc của agent mà OpenAI giao cùng GPT-5.6: bạn đưa ra phác thảo dự án, nó sẽ âm thầm xử lý — từ vài phút đến vài giờ — rồi trả về một file hoàn chỉnh. Bảng tính với công thức thực, slide được định dạng chuẩn, tài liệu dài, thậm chí là các web app nhỏ chạy được. Nó chạy trên cùng hạ tầng với Codex (agent viết code của OpenAI), nhưng được “chĩa mũi dùi” vào công việc văn phòng. Nếu bạn đang từ con số 0, chúng tôi đã có hướng dẫn đầy đủ cho người mới bắt đầu.

Claude Cowork là bản của Anthropic, và nó đã được “nấu” từ tháng Giêng — điều này thể hiện rất rõ. Tính đến ngày 7/7, nó chạy trên desktop, web và điện thoại; vẫn tiếp tục xử lý trong đám mây sau khi bạn tắt laptop; chạy theo lịch hẹn nếu bạn yêu cầu; và — điểm nhấn — các công cụ ghi Microsoft 365 cho phép nó gửi email, quản lý lịch, sắp xếp hộp thư và chỉnh sửa file trên SharePoint. Bài hướng dẫn sử dụng cơ bản của chúng tôi đã cover những phần nền tảng.

Cùng một hạng mục. Nhưng triết lý vận hành thì khác biệt hoàn toàn — và chính điểm này đáng để bạn hiểu rõ trước khi nhìn vào bất kỳ bảng thông số kỹ thuật nào.

Điểm phân chia thực sự: Bên tạo sản phẩm vs Bên hành động

Hai quan niệm về việc một AI agent nên là gì
📦 ChatGPT Work
Người thợ làm ra sản phẩm
tạo ra sản phẩm: bảng tính, slide, tài liệu, app · bạn duyệt kết quả rồi CHÍNH BẠN hành động · rủi ro tối đa = một file sai
✉️ Claude Cowork
Người thực thi
hành động ngay trong tài khoản của bạn: gửi email, đặt lịch họp, sửa file trên SharePoint · bạn cấp quyền rồi nó DỊCH CHUYỂN mọi thứ

Chờ đã — cụm từ đó xứng đáng được diễn giải bằng ngôn ngữ đời thường hơn, vì nó chính là toàn bộ cốt lõi của quyết định này.

Khi ChatGPT Work hoàn tất, bạn nhận được một thứ gì đó. Rủi ro thực tế nhất là nó tạo ra một thứ sai lệch, và bạn sẽ phát hiện ra (hoặc không) ngay khi mở file ra. Không có gì “đi ra khỏi” hệ thống của bạn cả. Khi Cowork hoàn tất, một điều gì đó có thể đã diễn ra — một tin nhắn gửi từ địa chỉ của bạn, một cuộc hẹn xuất hiện trên lịch của đồng nghiệp, một file thay đổi ngay tại nơi team bạn làm việc. Phần lớn hành động của Cowork đều xin phép bạn dọc đường, nhưng quyền gửi của connector Microsoft 365 tên chính xác là Mail.Send, và tài liệu kỹ thuật không hề hứa hẹn một bước xác nhận cuối cùng kiểu “bạn có chắc không?” trước khi tin nhắn rời khỏi hộp thư của bạn.

Không có triết lý nào là “đúng tuyệt đối”. Một agent không chạm vào công cụ thực của bạn sẽ biến bạn thành người chuyển phát mọi thứ nó tạo ra. Một agent có thể chạm vào chúng thì lại khiến sự chú ý của bạn trở thành tấm lưới an toàn duy nhất. Hãy chọn dựa trên kiểu rủi ro nào bạn sẵn sàng quản lý — chứ không phải demo nào trông ngầu hơn.

Giá và quyền truy cập: Một bên có gói miễn phí

ChatGPT Work nằm trong mọi gói đăng ký — kể cả bản miễn phí. Người dùng Free và Go sẽ được dùng GPT-5.6 Terra bên trong Work (một model vượt trội so với flagship thế hệ trước trên nhiều benchmark), gói trả phí thì chọn giữa Sol, Terra và Luna, còn Pro/Enterprise sẽ mở khóa chế độ ultra, vốn “tung” bốn agent song song xử lý cùng một nhiệm vụ. Gói miễn phí này không phải bản demo “cụt lủn”; nó là một agent thực thụ chạy trên model mid-size mới nhất của OpenAI. Bảng ánh xạ gói chi tiết tại đây.

Cowork không có cửa miễn phí. Nó bắt buộc phải có gói Claude trả phí — chạy tốt trên gói Pro giá $20/tháng, nhưng có một điều dễ bỏ qua: các tính năng mới được triển khai ưu tiên cho gói Max từ $100+ trước. Tính năng di động và chạy nền từ 7/7 chỉ dành cho Max trước, các gói khác chỉ được hứa hẹn “trong vài tuần tới”. Trên Claude, thứ “bóng bẩy” nhất trong thông báo thường không phải thứ mà gói $20 của bạn có ngay hôm nay.

Chiều ngược lại nằm ở nền tảng: Cowork có trên điện thoại; ChatGPT Work thì chưa. Các phiên làm việc của Cowork vẫn tiếp tục chạy trên đám mây và thông báo điện thoại cho bạn khi Claude cần một quyết định. Nếu nhịp làm việc của bạn diễn ra giữa các cuộc họp chứ không phải ngồi bất động ở bàn, thì đây không phải là sự khác biệt nhỏ. Một lưu ý nhỏ: Cowork trên mobile và web không thể truy cập file cục bộ của bạn như Cowork trên desktop — cùng một cái tên, nhưng phạm vi tiếp cận hẹp hơn.

Model và “cơ bắp”: Câu chuyện benchmark

Đằng sau hậu trường, đây là cuộc so tài giữa GPT-5.6 và họ nhà Claude 5. Lần này, ta có cả số liệu từ chính hai bên cung cấp cộng thêm một “trọng tài” trung lập.

Từ bảng ra mắt của chính OpenAI — đáng khen là họ cũng ghi lại cả những dòng mà OpenAI “thua”:

Benchmark (đo lường điều gì)GPT-5.6 SolClaude mạnh nhất
Agents’ Last Exam (quy trình chuyên môn dài)52.7%45.2% (Opus 4.8)
OSWorld 2.0 (thao tác máy tính)62.6%54.8% (Opus 4.8)
Terminal-Bench 2.1 (việc dòng lệnh)88.8% (91.9% khi ultra)88% (Mythos 5)
SWE-Bench Pro (sửa lỗi phần mềm thật)64.6%80.3% (Mythos 5)
GDPval-AA (chuyên gia chấm chất lượng công việc)1,747.81,759.6 (Fable 5)
Chỉ số Trí tuệ Artificial Analysis58.959.9 (Fable 5)

Còn “trọng tài” kia là Cursor — trình soạn thảo code AI không đứng về phía phòng lab nào — họ chạy CursorBench trên các phiên làm việc thực tế của người dùng: nhiệm vụ mơ hồ, đa file, mô tả lủng củng. Đây là điều kiện đối lập hoàn toàn với các kỳ thi benchmark. Bảng xếp hạng hiện tại: Claude Fable 5 Max dẫn đầu ở 70.5%, GPT-5.6 Sol Max bám sát ở 67.2% — nhưng chi phí chạy của Sol chỉ $5.22 so với $17.32 của Fable. Claude vẫn giữ lợi thế nhỏ về chất lượng thực; còn OpenAI thắng về giá với mức rẻ hơn khoảng 3 lần.

Bây giờ là phần miễn trừ trách nhiệm, và hãy đọc kỹ hai lần, vì bảng benchmark quyết định nhiều đơn đặt hàng hơn mức đáng lẽ. Số liệu từ nhà cung cấp đều nằm trong bài đăng ra mắt của chính họ — họ là người chọn bài kiểm tra, đối thủ và cài đặt (con số 91.9% đó là chế độ ultra, dạng “tung 4 agent cùng lúc” mà bạn sẽ không dùng thường xuyên). Benchmark là điều kiện thi đấu: đầu vào sạch, mục tiêu rõ ràng, không có chính sách công ty, không có chuyện “à mà hạn chót dời rồi”. Công việc của bạn thì mơ hồ, tài liệu chỉ có một nửa, và chất đống ngữ cảnh mà không bảng xếp hạng nào thấy được. Chênh lệch 3 điểm trên biểu đồ chẳng nói lên điều gì về việc agent nào xử lý tốt giọng điệu khách hàng của bạn, thói quen bảng tính của bạn, hay hộp thư của bạn. Các điểm số trên chỉ cho bạn thấy cả hai công cụ đều ở đẳng cấp tiên phong và không bên nào “thắng tất”. Chúng không thể cho bạn biết cái nào tốt hơn cho bạn — chỉ một tuần trải nghiệm với task thật của chính bạn mới làm được điều đó.

Hóa đơn mà không ai nhắc đến trong bản demo

Cả hai agent đều chia sẻ một thực tế khó chịu: công việc dạng agent “đốt” hạn mức sử dụng nhanh hơn gấp bội so với chat thông thường.

Ở phía ChatGPT, Work dùng chung giới hạn tốc độ (rate limit) với Codex, và người dùng trong tuần ra mắt đã chứng kiến những nhiệm vụ lớn “nuốt” gần hết hạn sử dụng — chế độ ultra lại nhân tốc độ đốt này lên theo thiết kế. Ở phía Claude, một người dùng chia sẻ rằng một task Cowork duy nhất — xây dựng một bài thuyết trình — đã “ngốn” khoảng $45 hạn mức, và một tài khoản Pro phát hiện một phiên Cowork năm tiếng đã “hết” khoảng 15% hạn mức tuần. Anthropic đã nhân đôi giới hạn năm giờ của Cowork đến hết ngày 5/8, nhưng hạn mức hàng tuần thì không thay đổi: bạn đốt nhanh hơn, chứ không được cấp thêm.

Nguyên tắc thực chiến giống hệt nhau cho cả hai: hãy coi mỗi lần chạy agent như một cuộc họp, không phải một tin nhắn. Chỉ lên lịch cho những việc xứng đáng với cái giá của nó. Viết bản mô tả (brief) chuẩn ngay từ đầu — năm lần chạy cẩu thả sẽ tốn gấp năm lần so với một lần chạy chỉn chu.

Tin tưởng, an toàn và ai đang cẩn trọng hơn

Lời chào hàng của Anthropic luôn mang tính cẩn trọng, và mô hình quyền hạn của Cowork cũng xứng đáng với điều đó: Claude mượn đăng nhập Microsoft của chính bạn chứ không tự tạo tài khoản riêng, chỉ xem được những gì bạn xem, tin nhắn gửi đi đều gắn nhãn rõ ràng, và admin tổ chức phải chấp thuận trước khi các công cụ ghi được kích hoạt. Đây là thiết kế thực sự vững chắc — trừ một lỗ hổng đã nêu ở trên (không có bước xác nhận chắc chắn khi gửi email qua connector) và rủi ro thường trực mà mọi agent kết nối hộp thư đều mang theo: tấn công bằng prompt qua email nhận vào.

Còn câu trả lời của OpenAI thiên về kiến trúc hơn là thủ tục: ChatGPT Work chủ yếu không hành động trực tiếp trong hệ thống của bạn — nó chỉ tạo ra thứ rồi đưa cho bạn. Ít quyền hạn cần kiểm toán hơn vì khả năng tác động của nó bị giới hạn. Bạn chính là cơ chế triển khai, điều này chậm hơn nhưng an toàn hơn.

Với người dùng cá nhân, thành thật mà nói, cả hai cách tiếp cận đều dễ kiểm soát. Còn với admin IT, câu hỏi sẽ khác: với Cowork, bạn đang kiểm toán quyền hạn (Mail.Send, Calendars.ReadWrite); với ChatGPT Work, bạn đang kiểm tra nhân viên dán cái gì vào đó và file thành phẩm lưu ở đâu. Hãy chọn kiểu “giấy tờ” mà bạn sẵn sàng duyệt.

Vậy bên nào dành cho bạn?

Bạn đang tiết kiệm ngân sách hoặc chỉ muốn thử nghiệm → ChatGPT Work, và sự chênh lệch là rất rõ. Được truy cập miễn phí vào một agent đẳng cấp tiên phong mà không cần gắn thẻ là món quà thực sự từ đợt ra mắt này. Hãy học cách ra lệnh (briefing) trên mạng lưới Terra; việc có trả phí hay không hãy tính sau.

Công việc của bạn xoay quanh Outlook, Teams và SharePoint → Cowork đang đánh một trận mà ChatGPT Work chưa kịp tham gia: nó có thể thực sự thao tác trong Microsoft 365, chứ không chỉ soạn thảo nháp. Hãy cân đối ngân sách lên gói Max nếu muốn dùng tính năng mới ngay, và hãy “bay thử” các công cụ ghi với chế độ an toàn (training wheels) trước.

Bạn làm việc cả ngày với tài liệu, slide và báo cáo phân tích → “Nhà máy sản phẩm” của ChatGPT Work được sinh ra là để phục vụ bạn, và việc gói Terra miễn phí cho phép bạn kiểm chứng điều này ngay hôm nay.

Bạn là lập trình viên → phép tính sẽ khác: Claude vẫn dẫn đầu xa về các benchmark kỹ thuật phần mềm thực tế (SWE-Bench Pro: 80.3 so với 64.6), trong khi chế độ ultra và giá của OpenAI rất cạnh tranh. Hãy thử chạy cả hai trên repo của chính bạn trước khi chốt.

Bạn quản lý team và chỉ được chọn MỘT → hãy bắt đầu từ thứ team bạn đã trả tiền rồi. Các công cụ này “thưởng” cho ngữ cảnh sẵn có (tài khoản kết nối, thói quen học được) hơn nhiều so với chênh lệch điểm benchmark. Chi phí chuyển đổi là có thật; còn khoảng cách 3 điểm thì không.

Bạn thực sự không thể quyết định → hãy chạy cùng ba task thật vào cả hai bên trong tuần này. Một bên sẽ cần bạn “cầm tay chỉ việc” ít hơn trên công việc của bạn. Đó chính là câu trả lời, và không blog nào — kể cả bài này — có thể tính giùm bạn được.

Điều mà cả hai đều không làm được

  • Hiểu đúng tiêu chuẩn của bạn. Cả hai đều tạo ra kết quả “chuyên nghiệp nhưng chung chung”; 20% cuối cùng khiến công việc thành của riêng bạn vẫn sẽ do bạn xử lý.
  • Kiểm chứng dữ liệu của chính chúng. Cả hai đều sẽ định dạng một con số sai lệch trông rất đẹp mắt. Hãy xác minh mọi thứ trước khi dùng để ra quyết định.
  • Dừng đủ lâu để bản so sánh này trở thành cuối cùng. OpenAI đã tung agent gói miễn phí; Anthropic chắc chắn sẽ đáp trả. Cowork đã có công cụ ghi; hãy kỳ vọng ChatGPT Work cuối cùng cũng sẽ “lớn thêm bàn tay”. Hãy quay lại xem xét sau một quý.
  • Thay thế việc bạn hiểu rõ công việc. Bạn không thể kiểm duyệt một mô hình tài chính mà chính bạn không thể phác thảo ra. Agent nâng tầm giá trị của sự phán đoán; chứ không loại bỏ nó.

Tóm lại

So tài ChatGPT Work và Claude Cowork thực chất không phải là OpenAI vs Anthropic — đó là cuộc đối đầu giữa bên tạo sản phẩm và bên hành động. Một bên xây dựng cho bạn thành phẩm và phó mặc việc thực thi cho bạn, kèm gói miễn phí. Bên kia với tay vào đúng công cụ bạn đang dùng, gửi đúng email của bạn, và yêu cầu bạn quản lý phần tin tưởng đó, nhưng chỉ dành cho người trả phí. Benchmark cho thấy cả hai đều đẳng cấp tiên phong và không bên nào “thắng tất”; bài đánh giá của trọng tài nói Claude nhỉnh hơn một chút còn OpenAI rẻ hơn hẳn; và không con số nào trong đó biết công việc của bạn là gì.

Kỹ năng chuyển giao tốt nhất cho cả hai — và cho bất kỳ công cụ nào ra mắt quý tới — là điều khiển agent AI thật tốt: ra lệnh (briefing), xem lại, và chỉnh sửa. Đây chính xác là điều khóa học So Sánh ChatGPT, Gemini & Claude của chúng tôi rèn luyện đối đầu trực tiếp, còn AI Agent Thực Hành sẽ đào sâu vào khía cạnh agent không code. Nếu bạn mới bắt đầu, hướng dẫn ChatGPT Work bằng ngôn ngữ đời thường chính là bước đệm nhẹ nhàng nhất. Hãy học cách phân công; logo trên agent sẽ càng ít quan trọng hơn mỗi tháng.

Nguồn tham khảo

Build Real AI Skills

Step-by-step courses with quizzes and certificates for your resume