aitodayCập nhật xu hướng AI, chatbot, automation, đào tạo và công nghệ mới mỗi ngày
Tin mới AI

Claude mới nhất mạnh cỡ nào? Fable 5 và Opus 4.8 đang đẩy giới hạn AI đi xa hơn

Chỉ trong hai tháng, Anthropic tung ra hai thế hệ mô hình liên tiếp: Opus 4.8 hồi cuối tháng 5 và Fable 5 đầu tháng 6. Fable 5 mạnh tới mức bị chính phủ Mỹ áp kiểm soát xuất khẩu ngay sau khi ra mắt. Vậy Claude mới nhất thực sự mạnh ở đâu, và điều đó có ý nghĩa gì với người dùng Việt Nam?

15:28 - 21/07/2026 7 phút đọc 13 lượt xem

Ngày 20/7 vừa qua, Anthropic chính thức đưa Claude Fable 5 vào các gói Max và Team Premium ở mức 50% giới hạn sử dụng. Động thái tưởng như chỉ là thay đổi chính sách gói cước này lại khép lại một trong những chương kỳ lạ nhất lịch sử ngành AI: một mô hình mạnh đến mức từng bị chính phủ Mỹ áp kiểm soát xuất khẩu chỉ ba ngày sau khi ra mắt.

Vậy Claude thế hệ mới mạnh cỡ nào? Câu trả lời nằm ở hai mô hình rất khác nhau.

Claude Opus 4.8: bước nhảy về sự trung thực

Ra mắt ngày 28/5/2026, Opus 4.8 là mô hình chủ lực của Anthropic với giá 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra. Về mặt năng lực thuần túy, các bảng đo độc lập cho thấy Opus 4.8 đạt 69,2% trên SWE-Bench Pro — bài kiểm tra lập trình tự động ở cấp độ issue thực tế — so với 64,3% của Opus 4.7 và 58,6% của GPT-5.5. Trên Humanity's Last Exam, bài thi suy luận đa ngành khét tiếng khó, mô hình đạt 49,8% khi không dùng công cụ và 57,9% khi được phép tra cứu.

Nhưng con số đáng chú ý nhất lại không phải điểm benchmark.

Anthropic công bố Opus 4.8 ít hơn khoảng bốn lần khả năng để lọt lỗi trong chính đoạn code nó vừa viết mà không cảnh báo gì. Nói cách khác, khi mô hình làm sai, nó có xu hướng tự nói ra thay vì im lặng đi tiếp. Hãng gọi đây là cải thiện về “tính trung thực”: mô hình chủ động nêu chỗ mình không chắc chắn và hạn chế đưa ra khẳng định không có căn cứ.

Với người làm sản phẩm, đây là thay đổi quan trọng hơn vài phần trăm benchmark. Một AI giỏi 95% nhưng không bao giờ báo lỗi thì nguy hiểm hơn một AI giỏi 90% biết giơ tay nói “chỗ này tôi không chắc”. Sai sót được cảnh báo là sai sót sửa được; sai sót âm thầm là thứ đi thẳng vào production.

Claude Fable 5: mạnh đến mức phải kiểm soát

Ngày 9/6/2026, Anthropic giới thiệu Claude Fable 5 cùng phiên bản không giới hạn Claude Mythos 5, mô tả đây là mô hình mạnh nhất từng được phát hành rộng rãi, dẫn đầu gần như toàn bộ các bài benchmark đã thử nghiệm. Giá 10 USD đầu vào và 50 USD đầu ra cho mỗi triệu token — gấp đôi Opus 4.8, nhưng vẫn rẻ hơn đáng kể so với bản Mythos Preview trước đó.

Điểm mạnh của Fable 5 tập trung vào những việc mà các thế hệ trước làm chưa nổi: di chuyển toàn bộ codebase, phân tích chuyên sâu cấp chuyên gia, đọc hiểu hình ảnh dày đặc thông tin như biểu đồ khoa học hay ảnh chụp màn hình code, và đặc biệt là chạy tự chủ liên tục trong thời gian dài. Mô hình dẫn đầu bài đánh giá FrontierCode của Cognition về lập trình và Hebbia Finance Benchmark về suy luận tài chính cấp cao.

Rồi mọi thứ dừng lại.

Ngày 12/6, chính phủ Mỹ áp kiểm soát xuất khẩu lên Fable 5 và Mythos 5. Nguyên nhân: các nhà nghiên cứu của Amazon tìm ra cách vượt rào an toàn bằng cách yêu cầu mô hình tìm lỗ hổng phần mềm, và trong một trường hợp mô hình đã sinh ra đoạn code minh họa cách khai thác lỗ hổng đó. Đây có lẽ là lần đầu tiên một mô hình ngôn ngữ thương mại bị đối xử như công nghệ lưỡng dụng theo đúng nghĩa pháp lý.

Kiểm soát được gỡ bỏ ngày 30/6. Fable 5 trở lại toàn cầu từ 1/7 với một bộ phân loại an toàn mới, chuyên chặn các tác vụ an ninh mạng. Đánh đổi là một số việc thường ngày như lập trình có thể bị từ chối nhầm — cái giá Anthropic chấp nhận trả để đưa mô hình trở lại.

So sánh nhanh các mô hình Claude hiện tại

Mô hình Ngữ cảnh Giá vào / ra (USD/1M token) Dùng khi nào
Claude Fable 5 1 triệu token 10 / 50 Bài toán khó nhất, agent chạy dài hàng giờ
Claude Opus 4.8 1 triệu token 5 / 25 Chủ lực cho lập trình và công việc tri thức
Claude Sonnet 5 1 triệu token 3 / 15 Cân bằng tốc độ và chi phí ở quy mô lớn
Claude Haiku 4.5 200 nghìn token 1 / 5 Tác vụ đơn giản, cần phản hồi tức thì

Ba thay đổi kỹ thuật thực sự đáng chú ý

1. Suy nghĩ thích ứng thay cho ngân sách token cố định

Các thế hệ trước yêu cầu lập trình viên tự ấn định mô hình được “nghĩ” bao nhiêu token. Cách làm đó nay đã bị loại bỏ hoàn toàn. Thay vào đó, mô hình tự quyết định cần suy nghĩ sâu đến đâu cho từng yêu cầu, còn nhà phát triển chỉ điều chỉnh một tham số mức độ nỗ lực từ thấp đến tối đa. Riêng Fable 5 luôn bật chế độ suy nghĩ, không thể tắt.

2. Cửa sổ ngữ cảnh 1 triệu token, không phụ phí

Toàn bộ dòng Opus, Fable và Sonnet hiện tại đều có cửa sổ 1 triệu token với giá tiêu chuẩn. Về mặt thực tế, con số này đủ để nạp trọn một codebase cỡ vừa, hoặc vài trăm trang tài liệu, vào một lần gọi duy nhất mà không cần chia nhỏ.

3. Một lượt trả lời có thể kéo dài hàng chục phút

Đây là điều khiến nhiều đội phát triển bất ngờ nhất. Với Fable 5 ở mức nỗ lực cao, một yêu cầu duy nhất có thể chạy 15 phút hoặc hơn khi mô hình tự thu thập ngữ cảnh, xây dựng và tự kiểm chứng kết quả. Anthropic khuyến nghị các đội thiết kế lại thời gian chờ, dùng streaming và bố trí giao diện báo tiến độ thay vì để người dùng ngồi nhìn màn hình trắng.

Điều này có ý nghĩa gì với người dùng Việt Nam

Với đa số nhu cầu hằng ngày, Opus 4.8 mới là lựa chọn hợp lý, không phải Fable 5. Nó rẻ hơn một nửa, đủ mạnh cho gần như mọi tác vụ lập trình và phân tích, đồng thời có cải thiện về tính trung thực mà bản mạnh hơn chưa chắc bù đắp được bằng điểm benchmark.

Fable 5 xứng đáng khi bạn có bài toán mà các mô hình khác đã thử và thất bại: di chuyển hệ thống lớn, nghiên cứu chuyên sâu, hoặc agent phải chạy tự chủ qua đêm. Các đội đạt kết quả tốt nhất trong giai đoạn thử nghiệm sớm đều làm một việc giống nhau — đưa cho nó bài toán khó nhất chưa giải được, thay vì thử lại những việc mô hình cũ đã làm ổn.

Một lưu ý về chi phí: giá theo token của Fable 5 gấp đôi Opus 4.8, nhưng chi phí thực tế cho một công việc hoàn chỉnh không nhất thiết gấp đôi. Mô hình thông minh hơn thường cần ít lượt lặp lại hơn, ít lần sửa sai hơn. Cách duy nhất để biết là đo trên chính khối lượng công việc của bạn.

Còn một điểm hiếm ai để ý: Fable 5 không khả dụng với các tổ chức chọn chế độ không lưu trữ dữ liệu. Mô hình yêu cầu chính sách lưu trữ tối thiểu 30 ngày. Với doanh nghiệp có ràng buộc tuân thủ nghiêm ngặt về dữ liệu, đây có thể là yếu tố quyết định trước cả chuyện benchmark hay giá cả.


Nguồn tham khảo: thông báo chính thức từ Anthropic về Claude Opus 4.8 và Claude Fable 5, tài liệu Claude Platform, cùng các báo cáo benchmark độc lập từ Artificial Analysis và VentureBeat.

Chia sẻ bài viết
Tin mới
Đăng ký nhận bản tin AI hàng tuần
Luôn cập nhật những tin tức AI mới nhất, xu hướng công nghệ, hướng dẫn sử dụng AI và các bài phân tích chuyên sâu. Đăng ký để nhận những nội dung nổi bật được gửi trực tiếp đến email của bạn mỗi tuần.