Cách đây hai tháng, Anthropic xây dựng xong một mô hình AI rồi tự đóng gói lại vì thấy nó “quá nguy hiểm” để tung ra thị trường. Nó có thể tự mày mò tìm ra các lỗ hổng bảo mật chưa từng biết trong mọi hệ điều hành và trình duyệt lớn — hoàn toàn tự động — nên công ty đã khóa nó lại, chỉ cho khoảng 200 đối tác được kiểm duyệt kỹ mới được chạm vào.
Hôm qua, chính mô hình đó lại xuất hiện trong app Claude. Nhưng lần này nó bị “thắt lưng buộc bụng”.
Claude Fable 5 là mô hình AI mạnh mẽ nhất mà công chúng từng được dùng, với khoảng cách vượt trội khiến ngay cả những người “lì” benchmark cũng phải ngạc nhiên. Đây cũng là vụ ra mắt kỳ lạ nhất năm nay: giá cao gấp đôi model flagship trước đó, một số câu hỏi sẽ được một mô hình khác “hầu bàn” âm thầm, và nếu bạn đăng ký gói trả phí của Claude, tính năng này chỉ dùng được cho đến ngày 22/6. Truyền thông công nghệ Việt phản ứng rất nhanh — GenK đăng tải “Anthropic tung mô hình AI mạnh nhất, ai cũng dùng được”, còn VnReview thì gọi đây là khởi đầu của kỷ nguyên tính phí theo token. Dưới đây là bức tranh toàn cảnh và mẹo tận dụng hai tuần dùng thử miễn phí này.
Claude Fable 5 thực chất là gì
Bản ngắn gọn: Fable 5 chính là mô hình “Mythos” của Anthropic nhưng được cài đầy đủ dây an toàn.
Câu chuyện dài hơn bắt đầu từ ngày 7 tháng 4, khi Anthropic thông báo về một mô hình tiên phong tên là Claude Mythos Preview và ngay lập tức từ chối phát hành. Mô hình này có thể tự động khám phá các lỗ hổng zero-day — lỗi bảo mật mà chưa ai biết — rồi biến chúng thành mã khai thác hoàn chỉnh. Theo Anthropic, nó đã tìm ra các lỗi nghiêm trọng trong mọi hệ điều hành và trình duyệt lớn, 99% trong số đó chưa từng được biết đến trước đây. Viện An ninh AI Vương quốc Anh (UK AI Security Institute) cũng tự chạy đánh giá riêng: Mythos hoàn thành 73% các tác vụ mạng cấp chuyên gia mà một năm trước đây chưa mô hình nào dám chạm vào.
Thay vì mở bán công chúng, Mythos được đưa vào một chương trình khóa kín tên là Project Glasswing — Apple, Google, Microsoft, Nvidia, AWS và cuối cùng là khoảng 200 tổ chức ở hơn 15 quốc gia, dùng nó để tìm và vá lỗi bảo mật cho chính mình trước khi hacker làm vậy. Anthropic thậm chí cấp tới 100 triệu USD tín dụng sử dụng để hỗ trợ công tác vá lỗi này.
Fable 5, ra mắt ngày 9 tháng 6, chính là cánh cửa dành cho phần còn lại của chúng ta. Theo lời Anthropic: đây là mô hình cấp Mythos “được chuẩn hóa an toàn cho người dùng phổ thông”. Cùng cái não, nhưng khác luật chơi.
Con số benchmark (điểm chuẩn) thế nào
Benchmark (điểm chuẩn) chưa bao giờ nói hết sự thật, nhưng bảng số liệu ra mắt lần này thì chênh lệch rõ rệt. Trên SWE-bench Pro — phiên bản khó hơn, chống “học vẹt” của bài kiểm tra lập trình thực tế — Fable 5 đạt 80.3%, trở thành mô hình đầu tiên cán mốc 80. Model flagship cũ Claude Opus 4.8 của Anthropic đứng ở 69.2%. GPT-5.5 của OpenAI đạt 58.6%, còn Gemini 3.1 Pro của Google là 54.2%.

Bảng benchmark chính thức của Anthropic. Các dòng có dấu sao là nơi lớp bảo vệ của Fable 5 kích hoạt — điểm số đó thực chất thuộc về Mythos 5 không ràng buộc. Nguồn: Anthropic
Xu hướng này còn lặp lại ở ngoài lĩnh vực code:
| Benchmark (đo lường cái gì) | Fable 5 / Mythos 5 | Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| SWE-bench Pro (lập trình thực tế) | 80.3% | 69.2% | 58.6% | 54.2% |
| GDPval-AA (công việc văn phòng, Elo) | 1932 | 1890 | 1769 | 1314 |
| Legal Agent Benchmark (công việc pháp lý) | 13.3% | 10.4% | 2.1% | 0.0% |
| OSWorld-Verified (sử dụng máy tính) | 85.0% | 83.4% | 78.7% | 76.2% |
| Terminal-Bench 2.1 (tác vụ terminal tự động) | 88.0% | 82.7% | 83.4% | 70.7% |
Hai dòng cần được “giải mã”. GDPval đo lường các sản phẩm văn phòng thực tế — memo, phân tích, báo cáo của 44 nghề nghiệp — nên khoảng cách 1932 so với 1769 của GPT-5.5 chính là benchmark “công việc thực tế của bạn”, không phải code. Còn số liệu Legal Agent Benchmark nhìn có vẻ thấp buồn cười vì đề thi cực khó, nhưng thứ tự xếp hạng mới quan trọng: 13.3% so với 2.1% nghĩa là tốt hơn gấp 6 lần trong các tác vụ pháp lý tự động.
Tin tức thực tế cũng đổ về liên tục. Stripe cho biết mô hình này đã nén gọn việc di chuyển cơ sở dữ liệu mã nguồn 50 triệu dòng (trước đây ước tính cần hơn hai tháng đội ngũ làm) xuống còn duy nhất một ngày. Đơn vị đánh giá độc lập Artificial Analysis cũng xếp Fable 5 hạng #1 trên chỉ số Thông minh (Intelligence Index) với 64.9 điểm — dẫn đầu model không phải Anthropic gần 5 điểm, một khoảng cách khổng lồ trên bảng chỉ số tổng hợp.
“Lồng an toàn”: Hai lớp bảo vệ
Đây chính là điểm mới thật sự của vụ ra mắt — và cũng là nơi gây tranh cãi nhất.
Lớp một thì thấy được. Các mô hình phân loại độc lập sẽ giám sát mọi yêu cầu. Khi một mô hình phát hiện câu hỏi thuộc ba nhóm — an ninh mạng gây hại, sinh học/hóa học, hoặc cố gắng khai thác khả năng mô hình để train đối thủ — Fable 5 sẽ im lặng không trả lời. Thay vào đó, Claude Opus 4.8 sẽ vào “hầu bàn”, và bạn sẽ được báo rằng điều này vừa xảy ra. Hãy tưởng tượng một chuyên gia chuyển câu hóc búa cho đồng nghiệp thay vì từ chối thẳng thừng. Anthropic cho biết hơn 95% phiên làm việc chưa từng kích hoạt cơ chế này. Logic nằm ở một con số: trên các bài kiểm tra phát triển exploit, Mythos 5 không ràng buộc đạt 78% trong khi Opus 4.8 chỉ đạt 40%. Chênh lệch 38 điểm này chính là ưu thế mà Anthropic quyết định không đưa vào tay hacker.
Lớp hai thì vô hình — và giới chuyên gia đang tranh cãi dữ dội. Nằm sâu trong thẻ hệ thống (system card): với các yêu cầu về việc tự xây dựng AI tiên phong — pipeline tiền huấn luyện, hạ tầng training phân tán, thiết kế accelerator — Fable 5 sẽ không từ chối và cũng không chuyển câu hỏi. Nó sẽ trả lời bằng chất lượng bị “khóa cứng” cố ý, dùng vector điều hướng và prompt sửa đổi, mà không báo cho bạn biết. Anthropic ước tính chỉ khoảng 0.03% lưu lượng truy cập, ảnh hưởng dưới 0.1% tổ chức.
Lời chỉ trích đến từ những người vốn ca ngợi mô hình này. Nathan Lambert của Viện AI Allen — người gọi Fable 5 là “mô hình thông minh nhất đang có sẵn cho công chúng” trong cùng bài viết — nhận định rằng một AI tự động giảm độ thông minh mà không báo trước là hoàn toàn sai lệch định hướng (misaligned AI). Mối lo sâu xa hơn: bạn có thể thấy một câu từ chối và đánh giá việc chuyển câu hỏi, nhưng một câu trả lời bị “cắt giảm” âm thầm nghĩa là bạn sẽ không bao giờ biết ý tưởng của mình dở, code của mình lỗi, hay chính mô hình đang giữ lại.
Góc nhìn công bằng: nó ĐÃ được ghi rõ trong tài liệu — đó là lý do mọi người mới biết — lưu lượng bị ảnh hưởng cực nhỏ, và chính sách nhắm đúng vào những đối tượng ít khi đọc điều khoản dịch vụ. Với đa số nghề nghiệp, điều này chẳng thay đổi gì. Nhưng tiền lệ đã hình thành, và đó mới là tin thực sự.
Một chi tiết ẩn nữa: mọi lưu lượng thuộc lớp Mythos đều chịu quy định lưu trữ dữ liệu bắt buộc 30 ngày — kể cả với doanh nghiệp có hợp đồng “xóa dữ liệu ngay lập tức”. Anthropic nói đây là để bắt các cuộc tấn công và jailbreak mới, không phải để train. Nếu bạn xử lý dữ liệu khách hàng nhạy cảm, hãy hỏi ý kiến pháp lý trước khi đưa công việc đó qua đây.
Giá cả và “cạm bẫy” ngày 22 tháng 6
Fable 5 tính phí 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra — chính xác là gấp đôi Opus 4.8, nhưng rẻ hơn một nửa so với giá Mythos Preview từng tính các đối tác sớm. Cửa sổ ngữ cảnh (1 triệu token, tương đương khoảng 750.000 từ bộ nhớ làm việc) và giới hạn phản hồi tối đa (128.000 token) giữ nguyên.
Với người dùng API, đó là câu chuyện trọn vẹn: có sẵn ngay, dùng bao nhiêu tính bấy nhiêu, xong.
Nhưng với hàng triệu người đăng ký Claude Pro, Max và Team, một chiếc đồng hồ đếm ngược đang chạy. Fable 5 được tích hợp miễn phí vào các gói trả phí chỉ cho đến ngày 22/6 — trong khi vẫn tiêu tốn quota sử dụng nhanh gấp đôi Opus — và từ ngày 23/6 nó sẽ chuyển sang dùng tín dụng riêng cho đến khi trở lại “như một phần tiêu chuẩn khi đủ sức mạnh”. Không có ngày cụ thể.
Cửa sổ hai tuần này đã khơi mào cuộc tranh luận ồn ào hơn cả benchmark. Một luồng ý kiến viral tuyên bố thẳng thắn: gói đăng ký AI giá cố định đã chết — kinh tế mô hình tiên phong không thể sống sót trong mô hình “ăn no trả tiền cố định”, và tín dụng theo token là tương lai mà mọi người sẽ copy theo — đúng như những gì VnReview viết về kỷ nguyên tính phí token. Cách đọc điềm tĩnh hơn: Anthropic định giá đúng chi phí điện tính toán của lớp Mythos, bị đội ngũ yêu cầu lúc ra mắt làm “tắc nghẽn”, và đang phân phối hạn chế cho đến khi GPU bắt kịp. Cả hai đều có lý. Nhưng sự thật thực tế vẫn là: lượt dùng thử miễn phí sẽ kết thúc vào ngày 22/6.
Những việc nó KHÔNG thể làm
- Không rẻ và không nhanh. Giá cao gấp đôi là có thật, người dùng sớm báo thời gian “suy nghĩ” (thinking time) dài, và các tác vụ agentic chạy 40+ phút sẽ hiện rõ trên hóa đơn. Với câu hỏi giao tiếp hàng ngày, đây là công cụ “thừa thãi” — như thuê kỹ sư kết cấu để đóng khung tranh vậy.
- Không thắng mọi thứ ở mọi lĩnh vực. Andon Labs đã đưa Mythos 5 không ràng buộc vào mô phỏng kinh doanh Vending-Bench và nó thu LỜI ít hơn cả Opus 4.7 và GPT-5.5. Chỉ một đội, một benchmark, nhưng là liều thuốc giải độc hữu ích cho cơn sốt ra mắt.
- Không chắc chắn còn nằm trong gói đăng ký của bạn vào tháng 7. Cụm từ “sẽ được khôi phục khi đủ sức mạnh” là ý định, không phải ngày cam kết.
Dùng Fable 5 hay Opus 4.8: Chọn cái nào cho kịp
Opus 4.8 đâu đã biến mất, và với nửa giá thành, nó vẫn là lựa chọn hợp lý mặc định cho đa số công việc:
| Tác vụ của bạn | Nên dùng |
|---|---|
| Viết lách hàng ngày, email, tóm tắt | Opus 4.8 — Fable là “thừa thãi” |
| Nghiên cứu/phân tích nhiều bước | Fable 5 — khoảng cách thể hiện rõ ở độ sâu |
| Code nghiêm túc, debug, di chuyển hệ thống | Fable 5 — đây là nơi nó “đoạt giải” |
| Tài liệu phức tạp: tài chính, pháp lý, PDF dày | Fable 5 — số liệu GDPval và pháp lý là bằng chứng |
| Nghiên cứu bảo mật, sinh học/hóa học | Opus 4.8 trực tiếp — đằng nào Fable cũng chuyển câu hỏi đi |
| Tác vụ tự động hóa khối lượng lớn, tiết kiệm | Opus 4.8 hoặc Haiku — chi phí token đội lên rất nhanh |
Điều này nghĩa là gì với bạn
Nếu bạn đã đăng ký Claude Pro, Max hoặc Team: bạn có đến ngày 22/6 để tự trả lời — miễn phí — xem sự chênh lệch này có thực sự ảnh hưởng đến CÔNG VIỆC CỦA BẠN hay không. Đừng lãng phí cửa sổ này cho những câu chuyện vặt mà mô hình nào cũng làm được. Hãy giao cho nó tác vụ thực tế khó nhất của bạn: phân tích bảng tính lộn xộn, hợp đồng 80 trang, hay báo cáo bạn cứ trì hoãn. Nếu kết quả khiến bạn giật mình, bạn sẽ biết liệu các gói tín dụng sau này có đáng bỏ tiền hay không. Nếu không, Opus 4.8 vẫn xuất sắc và đã được tích hợp sẵn.
Nếu bạn đang dùng ChatGPT và tò mò: khoảng cách với GPT-5.5 là lợi thế lớn nhất mà bất kỳ phòng lab nào đạt được trong vài năm qua — nhưng nó tập trung sâu vào công việc đa bước, tự động hóa và tầm nhìn dài hạn. Nếu việc dùng AI của bạn chỉ ở mức trò chuyện, bạn sẽ chẳng cảm nhận được sự khác biệt. Nhưng nếu bạn đẩy mô hình đến giới hạn để tạo sản phẩm chuyên nghiệp thực thụ, đây là khoảnh hiếm hoi mà lời khuyên “thử cái bên kia” được backed by data thay vì hype.
Nếu bạn chưa từng dùng AI thực sự: mọi thứ ở đây không thay đổi điểm xuất phát của bạn — các gói miễn phí của Claude và ChatGPT vẫn là lớp học đúng đắn. Nhưng hãy nhớ điều vừa xảy ra: mô hình AI mạnh nhất từng bán nay đang chạy kèm theo các AI “cảnh sát” khác. Kiến trúc này — khả năng cộng với cơ chế giám sát — chính là diện mạo của vài năm tới.
Tóm lại
Claude Fable 5 là hai câu chuyện ghép lại. Câu thứ nhất là sức mạnh thuần túy: bước nhảy vọt lớn nhất chỉ trong một thế hệ, với bằng chứng xuyên suốt code, văn phòng, tài chính và pháp lý — và một cửa sổ hai tuần cho người đăng ký trả phí để dùng thử miễn phí. Câu thứ hai là tiền lệ: mô hình tiên phong đầu tiên mà nguy cơ bị kiểm soát không phải bằng cách nhốt nó lại, mà bằng cách đưa nó vào một mạng lưới lớp phân loại, mô hình dự phòng, quy định lưu trữ và giới hạn âm thầm. Câu chuyện thứ nhất giải thích vì sao bạn nên thử nó trước ngày 22/6. Câu chuyện thứ hai lý giải vì sao mọi người sẽ nhớ vụ ra mắt này lâu ngay cả khi benchmark đã cũ.
Nếu câu hỏi “mô hình nào dùng cho việc gì” vẫn khiến bạn bối rối, khóa học So sánh ChatGPT, Gemini và Claude sẽ giải quyết triệt để với các phép so sánh thực tế — và Hướng dẫn Claude AI giúp bạn làm chủ Claude từ con số 0. Hai bài đầu tiên của mỗi khóa đều miễn phí.
Nguồn tham khảo
- Claude Fable 5 and Claude Mythos 5 — Anthropic
- Anthropic tung model AI mạnh nhất, ai cũng dùng được — GenK
- Siêu AI thông minh nhất thế giới vừa ra mắt, bỏ xa Gemini, ChatGPT — Znews
- Our evaluation of Claude Mythos Preview’s cyber capabilities — UK AI Security Institute
- Project Glasswing: Securing critical software for the AI era — Anthropic
- Claude Fable 5 and new safety fables — Interconnects (Nathan Lambert)