Nên sử dụng mô hình Claude Opus 5 hay Claude Fable 5 của Anthropic?

Nếu đang cân nhắc chọn mô hình Anthropic nào cho agent của mình, giờ đây bạn có hai lựa chọn thuộc dòng cao cấp với năng lực tương đương nhưng mức giá chênh lệch đáng kể. Claude Opus 5 ra mắt vào ngày 24 tháng 7 năm 2026 với giá 5 USD cho mỗi triệu token đầu vào, trong khi Claude Fable 5 ra mắt ngày 9 tháng 6 năm 2026 với mức giá cao gấp đôi con số đó. Câu hỏi đặt ra là liệu phân khúc cao hơn của Fable 5 có mang lại lợi ích gì mà Opus 5 chưa đáp ứng được hay không.

Anthropic cho biết Opus 5 đang thiết lập chuẩn mực mới về khả năng lập trình và xử lý các tác vụ tri thức (thông qua các bài kiểm tra như Frontier-Bench và GDPval-AA); thậm chí ở một số tiêu chí đánh giá, nó còn vượt trội hoàn toàn so với Fable 5. Điều này đảo ngược quan niệm thông thường cho rằng mô hình đắt tiền hơn luôn là lựa chọn tốt nhất.

Bài viết này sẽ so sánh Opus 5 và Fable 5 trên các khía cạnh: Lập trình, tác vụ agentic, khả năng suy luận, cơ chế bảo vệ và giá cả, giúp bạn quyết định mô hình nào phù hợp với quy trình làm việc của mình.

Ngoài ra, bạn cũng nên tìm hiểu về phiên bản kế nhiệm của Fable 5 thông qua bài hướng dẫn về Claude Fable 5.1.

So sánh trực tiếp Claude Opus 5 và Claude Fable 5

Dưới đây là phần tóm tắt trước khi đi sâu vào từng khía cạnh. Tóm lại, Opus 5 và Fable 5 đạt kết quả tương đương nhau (sai số không đáng kể) ở hầu hết các bài kiểm tra hiệu năng, nhưng Opus 5 lại có mức giá chỉ bằng một nửa.

Tính năng Claude Opus 5 Claude Fable 5
Ngày phát hành Ngày 24 tháng 7 năm 2026 Ngày 9 tháng 6 năm 2026
Giá đầu vào (trên mỗi 1 triệu token) $5 $10
Giá đầu ra (trên mỗi 1 triệu token) $25 $50
SWE-bench Verified 96.0% * 95.0%
SWE-bench Pro 79.2% 80.3% *
Frontier-Bench v0.1 43.3% * 33.7%
ARC-AGI 3 30.2% * chưa được công bố
GDPval-AA v2 (Elo) 1,861 * 1,747
Tình trạng an ninh mạng Các bộ phân loại không gian mạng gọn nhẹ hơn Các bộ phân loại phạm vi rộng về lĩnh vực mạng, sinh học và chắt lọc
Có sẵn All platforms and tiers All platforms, phased consumer rollout

Lập trình và agentic workflow

Lập trình là lĩnh vực mà hầu hết người dùng sẽ thực sự triển khai các mô hình này, đồng thời cũng là nơi mà sự chênh lệch về giá cả dường như ít có cơ sở hợp lý nhất. Trên SWE-bench Verified, Opus 5 đạt điểm số 96,0% so với mức 95,0% của Fable 5; nghĩa là mô hình có chi phí thấp hơn lại dẫn trước một điểm. Tại Frontier-Bench v0.1 – bài kiểm tra đánh giá khả năng lập trình qua giao diện dòng lệnh (terminal) – Opus 5 nới rộng khoảng cách dẫn trước với tỷ lệ 43,3% so với 33,7%.

Tuy nhiên, Fable 5 đã giành lại chiến thắng sít sao trên SWE-bench Pro với điểm số 80,3%, trong khi Opus 5 đạt 79,2%. Khoảng cách một điểm theo chiều ngược lại này cho thấy hai mô hình có hiệu suất ngang ngửa nhau trong các tác vụ kỹ thuật phần mềm ở quy mô kho lưu trữ. Đội ngũ của Cognition báo cáo rằng trong bài kiểm tra FrontierCode 1.1, Opus 5 đạt hiệu suất tiệm cận mức của Fable với chi phí chỉ bằng một nửa; kết quả này hoàn toàn khớp với các số liệu công khai.

Benchmark Opus 5 Fable 5 Ghi chú
SWE-bench Verified 96.0% 95.0% Do nhà cung cấp báo cáo
SWE-bench Pro 79.2% 80.3% Điểm sáng duy nhất về mặt lập trình của Fable 5 ở đây
Frontier-Bench v0.1 43.3% 33.7% Lập trình terminal, Opus 5 +9,6 điểm
Terminal-Bench 2.1 Chưa được công bố 88.0% Điểm của Opus 5 chưa được công bố

Điểm mấu chốt là Opus 5 ngang bằng hoặc vượt trội hơn Fable 5 trong các bài kiểm tra hiệu năng (benchmark) về lập trình - nơi cả hai đều công bố số liệu - ngoại trừ duy nhất bài kiểm tra SWE-bench Pro. Theo cách đánh giá của chính Anthropic, Opus 5 đạt điểm số Frontier-Bench cao hơn gấp đôi so với Opus 4.8 với chi phí trên mỗi tác vụ thấp hơn, đồng thời cũng vượt qua Fable 5 ở hạng mục này. Đối với tác vụ lập trình, việc chọn mô hình đắt tiền hơn không mang lại thêm lợi ích nào.

So sánh Claude Opus 5 và Claude Fable 5 trong tác vụ lập trình
So sánh Claude Opus 5 và Claude Fable 5 trong tác vụ lập trình

Các tác vụ agentic và Computer-use 

Cả hai mô hình đều được thiết kế cho các tác vụ agentic đòi hỏi quy trình xử lý dài hơi; do đó, khía cạnh này rất quan trọng nếu bạn đang vận hành các quy trình tự động hóa (pipeline) thay vì chỉ sử dụng những câu lệnh đơn lẻ. Ở đây, cơ chế xác thực chủ động của Opus 5 chính là yếu tố tạo nên sự khác biệt mà các bài kiểm tra hiệu năng đã phần nào ghi nhận được.

Đối với ARC-AGI 3 - một bài kiểm tra đánh giá khả năng giải quyết các vấn đề mới lạ của mô hình - Opus 5 đã đạt mức 30,2%, tăng vọt từ con số 1,5% của Opus 4.8. Kết quả này cao gần gấp 4 lần so với mô hình xếp ngay sau đó (GPT-5.6 Sol với 7,8%). Đáng tiếc là Anthropic không công bố điểm số cho Fable 5, nên chúng ta không thể so sánh trực tiếp hai mô hình này.

Trên OSWorld 2.0 (bài kiểm tra khả năng Computer-use), Opus 5 (đạt 70,6%) đã soán ngôi Fable 5 (66,1%) để trở thành mô hình dẫn đầu tổng thể. Ngoài ra, trong bài kiểm tra AutomationBench của Zapier, Opus 5 đạt tỷ lệ hoàn thành 100% ở quy trình ngăn chặn khách hàng rời bỏ dịch vụ - một nhiệm vụ mà các mô hình trước đó hoàn toàn không thể thực hiện được.

Xét về hiệu quả chi phí, Opus 5 vượt trội hơn hẳn trong các tác vụ agentic.

Khả năng suy luận và xử lý công việc tri thức

Xử lý công việc tri thức vốn là thế mạnh được quảng bá của Fable 5, nên mô hình được kỳ vọng sẽ dẫn đầu ở mảng này, nhưng thực tế lại không phải vậy. Trên GDPval-AA v2 (bài kiểm tra Elo về khả năng xử lý công việc tri thức), Opus 5 đạt 1.861 điểm, trong khi Fable 5 đạt 1.747 điểm. Chênh lệch 114 điểm Elo này nghiêng về phía mô hình có chi phí thấp hơn. Fable 5 vẫn thực sự vượt trội trong các tác vụ suy luận khoa học đòi hỏi độ khó và thời gian xử lý cao nhất; Anthropic khẳng định rõ ràng rằng năng lực thuộc nhóm Mythos vẫn mạnh mẽ hơn đối với các nghiên cứu sinh học tự hành dài hạn. Tuy nhiên, đối với những tác vụ phân tích và xử lý kiến ​​thức mà hầu hết các nhóm thường thực hiện, điểm số GDPval-AA cao hơn của Opus 5 đồng nghĩa với việc bạn đang phải trả gấp đôi chi phí cho Fable 5 nhưng lại nhận được hiệu suất kém hơn.

Các biện pháp bảo vệ và cơ chế từ chối yêu cầu

Đây là khía cạnh mà hai mô hình thực sự khác biệt, và cũng là lý do chính khiến Fable 5 tồn tại như một sản phẩm riêng biệt. Đây cũng là khía cạnh dễ bị hiểu sai nhất, bởi vì thuật ngữ "an toàn" ở đây được dùng để chỉ hai khái niệm khác nhau, đại diện cho hai thái cực đối lập của vấn đề.

  • Khía cạnh thứ nhất là khả năng chống lạm dụng: Một hệ thống phân loại bên ngoài nằm trước mô hình, có nhiệm vụ chuyển hướng các yêu cầu nguy hiểm trước khi chúng kịp đến tay mô hình.
  • Khía cạnh thứ hai là độ an toàn: Cách thức mô hình tự vận hành, bao gồm việc liệu nó có hành vi lừa dối, thực hiện các hành động liều lĩnh không thể đảo ngược, hay bị thuyết phục để thực hiện những hành vi lạm dụng hay không.

Một mô hình có thể đạt điểm cao ở khía cạnh này nhưng vẫn cần sự hỗ trợ mạnh mẽ ở khía cạnh kia, bởi vì các hệ thống phân loại không có chức năng ngăn chặn mô hình tự ý hành động sai lệch (trở nên "nổi loạn"). Chúng chỉ có nhiệm vụ ngăn chặn người dùng khai thác các nội dung hoặc hành vi gây hại từ mô hình.

Fable 5 là mô hình thuộc nhóm Mythos và sở hữu hệ thống phân loại chặt chẽ hơn so với mô hình còn lại. Hệ thống phân loại của nó bao gồm ba lĩnh vực; khi các bộ lọc này được kích hoạt, yêu cầu sẽ được chuyển sang xử lý bởi Opus 4.8:

  • An ninh mạng: Cả hoạt động khai thác lỗ hổng lẫn các tác vụ tấn công mạng quy mô rộng hơn đều bị chặn, khiến hiệu suất của Fable 5 trong các bài kiểm tra về an ninh mạng giảm xuống mức 0% khi hệ thống phân loại hoạt động.
  • Sinh học và hóa học: Theo mặc định, hầu hết các yêu cầu liên quan đến sinh học và hóa học đều được chuyển sang Opus 4.8.
  • Chắt lọc tri thức: Các yêu cầu bị đánh dấu là nỗ lực trích xuất năng lực của Fable 5 sẽ bị chuyển hướng xử lý khác.

Anthropic đã thiết lập các cơ chế này theo hướng thận trọng: Dữ liệu ban đầu cho thấy hơn 95% các phiên làm việc với Fable 5 không hề kích hoạt cơ chế chuyển hướng nào.

Opus 5 sử dụng phiên bản nhẹ hơn của cùng hệ thống này. Các bộ lọc an ninh mạng của nó cho phép tìm kiếm lỗ hổng trong code nhưng chặn việc quét dựa trên file nhị phân, kiểm thử xâm nhập và tạo exploit; Anthropic dự kiến ​​tần suất kích hoạt của các bộ lọc này sẽ thấp hơn khoảng 85% so với trên Fable 5. Trong bài kiểm tra tự động về hành vi, Opus 5 đạt điểm 2,3 về mức độ lệch hành vi; Anthropic đánh giá đây là mô hình có độ tuân thủ tốt nhất tính đến thời điểm hiện tại, vượt trội hơn so với Opus 4.8, Sonnet 5 và Fable 5.

Vì vậy, đây là sự phân hóa về mục đích sử dụng chứ không phải là bảng xếp hạng đơn thuần. Đối với các tác vụ lập trình, công việc tri thức và sử dụng máy tính thông thường, Opus 5 là mô hình có độ tuân thủ tốt và ít gây trở ngại cho người dùng. Tuy nhiên, đối với các lĩnh vực chuyên biệt đòi hỏi sự kiểm soát chặt chẽ - chẳng hạn như nghiên cứu bảo mật tấn công hay nghiên cứu sinh học dài hạn - thì Fable 5 (hoặc Mythos 5 thông qua Cyber ​​Verification Program) lại là công cụ mạnh mẽ hơn; đổi lại, người dùng sẽ phải chấp nhận cơ chế từ chối phản hồi nghiêm ngặt hơn.

Chi phí thực tế

Chi phí cho Fable 5 cao gấp đôi so với Opus 5 ở cả hai khâu xử lý dữ liệu đầu vào và đầu ra. Chế độ "Fast" của Opus 5 - với tốc độ vận hành nhanh gấp khoảng 2,5 lần so với chế độ mặc định - có giá 10 USD cho dữ liệu đầu vào và 50 USD cho dữ liệu đầu ra; mức giá này tương đương chính xác với mức giá tiêu chuẩn của Fable 5.

Giá Opus 5 Fable 5
Đầu vào, trên mỗi 1 triệu token $5.00 $10.00
Đầu ra, trên mỗi 1 triệu token $25.00 $50.00
Đầu vào chế độ Fast, trên mỗi 1 triệu token $10.00 Không áp dụng
Đầu ra chế độ Fast, trên mỗi 1 triệu token $50.00 Không áp dụng

Chi phí thực tế cho khối lượng công việc

Cả hai mô hình đều sử dụng tokenizer mới hơn của Anthropic – vốn được giới thiệu cùng thế hệ Opus 4.7 – do đó, cùng một đoạn văn bản sẽ tiêu tốn số lượng token đầu vào như nhau trên cả hai mô hình; đồng thời, chưa có nhà cung cấp nào công bố kết quả so sánh có kiểm soát về số lượng token giữa hai mô hình này đối với cùng một tác vụ.

Khối lượng hàng tháng Opus 5 Fable 5 Khác biệt
Nhẹ: 1M vào / 250K ra $11.25 $22.50 Opus 5 tiết kiệm $11.25 (50%)
Nặng: 100M vào / 25M ra $1,125 $2,250 Opus 5 tiết kiệm $1,125 (50%)

Ở mức độ sử dụng cường độ cao, sự chênh lệch chi phí hàng tháng lên tới 1.125 USD cho một tính năng đang vận hành thực tế hoặc một agent hoạt động liên tục; trong khi đó, các kết quả đo hiệu năng cho thấy bạn không hề phải đánh đổi về khả năng lập trình hay chất lượng công việc chuyên môn để đạt được mức tiết kiệm này.

Tuy nhiên, hãy coi các con số tổng này là sự so sánh về mức giá hơn là một dự báo chính xác tuyệt đối. Trên thực tế, chi phí cho Opus 5 có thể cao hơn Opus 4.8 do xu hướng tạo ra nhiều "token tư duy" hơn; dù vậy, điều này không làm thay đổi thực tế chung là trong hầu hết các trường hợp, Opus 5 vẫn là mô hình có chi phí thấp hơn đáng kể so với Opus 4.8.

Chi phí của Opus 5 chỉ bằng một nửa so với Fable 5
Chi phí của Opus 5 chỉ bằng một nửa so với Fable 5

Khi nào nên chọn Claude Opus 5 thay vì Claude Fable 5?

Đối với đa số người dùng, việc lựa chọn khá đơn giản: Opus 5 là lựa chọn mặc định, còn Fable 5 là trường hợp ngoại lệ. Bảng dưới đây liệt kê các tình huống mà quy tắc này bị đảo ngược.

Trường hợp sử dụng Đề xuất Lý do
Các agent lập trình cấp kho lưu trữ Opus 5 Đạt kết quả ngang bằng hoặc vượt trội so với Fable 5 trên SWE-bench và dẫn đầu Frontier-Bench với chi phí chỉ bằng một nửa
Công việc tri thức và hoạt động phân tích thường nhật Opus 5 Chỉ số Elo GDPval-AA v2 cao hơn (1.861 so với 1.747) với mức giá chỉ bằng một nửa
Khối lượng công việc sản xuất quy mô lớn Opus 5 Khoản tiết kiệm 50% này tích lũy thành hơn 1.000 USD mỗi tháng ở mức sử dụng cao
Giải quyết vấn đề mới lạ và tư duy trừu tượng Opus 5 Điểm số ARC-AGI 3 đạt 30,2%, gấp 3 lần so với mô hình tốt thứ hai
Nghiên cứu sinh học tự hành dài hạn Fable 5 Năng lực của dòng Mythos vẫn vượt trội hơn đối với công việc cụ thể này
Các workflow cần phạm vi bảo vệ toàn diện Fable 5 Các bộ phân loại của nó bao gồm những lĩnh vực không gian mạng, sinh học và chắt lọc kiến thức theo phạm vi rộng hơn

Hãy chọn Opus 5 nếu...

  • Bạn đang phát triển các công cụ hỗ trợ lập trình hoặc agentic và muốn đạt hiệu năng tối ưu trên mỗi đơn vị chi phí, vì mô hình này vượt trội hơn Fable 5 trong bài kiểm tra Frontier-Bench và ngang bằng ở bài kiểm tra SWE-bench.
  • Bạn xử lý khối lượng công việc lớn, nơi việc giảm 50% chi phí mang lại lợi ích ngân sách đáng kể, trong khi các kết quả kiểm chuẩn xác nhận rằng chất lượng đầu ra không hề bị ảnh hưởng.
  • Bạn cần một mô hình có độ tuân thủ cao nhất (được căn chỉnh tốt nhất), với điểm số đánh giá về hành vi lệch chuẩn là 2,3 – mức tốt nhất mà Anthropic từng đạt được tính đến nay.
  • Bạn cần giảm thiểu tần suất từ ​​chối phản hồi khi thực hiện nghiên cứu bảo mật hợp pháp, vì các bộ phân loại của mô hình này kích hoạt ít hơn khoảng 85% so với Fable 5.

Hãy chọn Fable 5 nếu...

  • Công việc của bạn là nghiên cứu sinh học tự hành dài hạn – lĩnh vực duy nhất mà Anthropic cho biết năng lực thuộc nhóm Mythos vẫn chiếm ưu thế.
  • Bạn đặc biệt cần phạm vi bao phủ rộng hơn của các bộ phân loại trong những lĩnh vực an ninh mạng, sinh học và chắt lọc tri thức mà hệ thống bảo vệ của Fable 5 cung cấp.
Các trường hợp sử dụng Claude Opus 5 so với Fable 5
Các trường hợp sử dụng Claude Opus 5 so với Fable 5

Lời kết

Bạn nên sử dụng Opus 5 trừ khi có lý do cụ thể để không làm vậy. Nó ngang ngửa hoặc vượt trội hơn Fable 5 ở mảng lập trình, giành chiến thắng trong bài kiểm tra chuẩn Elo về công việc đòi hỏi kiến ​​thức chuyên môn, vượt xa các đối thủ về khả năng suy luận mới mẻ, và tất cả những điều này đạt được với mức giá chỉ bằng một nửa, đồng thời ghi nhận điểm số về độ an toàn tốt nhất của Anthropic.

Rõ ràng Fable 5 không phải là một mô hình tồi. Chỉ là nó không được thiết kế cho phần lớn những công việc thực tế mà các nhóm thường thực hiện. Nó sở hữu các cơ chế bảo vệ nghiêm ngặt hơn và thực sự chiếm ưu thế trong những tác vụ tự hành dài hơi như nghiên cứu sinh học; tuy nhiên, ngoài phạm vi hẹp đó, việc trả mức giá gấp đôi cho Fable 5 đồng nghĩa với việc chi trả nhiều hơn để rồi nhận lại kết quả thấp hơn một chút ở các bài kiểm tra chuẩn quan trọng đối với lập trình và phân tích.

Điều thú vị nhất là sự so sánh này đảo ngược logic thông thường về phân cấp mô hình. Thông thường, các mô hình mới hơn và rẻ hơn sẽ chấp nhận hy sinh một phần năng lực để đổi lấy khả năng tiếp cận dễ dàng hơn. Trong trường hợp này, Anthropic lại tung ra một mô hình rẻ hơn nhưng lại mạnh mẽ hơn trong hầu hết các tác vụ phổ biến; điều này cho thấy mức giá của Fable 5 chủ yếu chi trả cho cơ chế bảo vệ và dòng Mythos của nó, thay vì hiệu năng thuần túy.

Thứ Năm, 10/09/2026 16:05
51 👨
Xác thực tài khoản!

Theo Nghị định 147/2024/ND-CP, bạn cần xác thực tài khoản trước khi sử dụng tính năng này. Chúng tôi sẽ gửi mã xác thực qua SMS hoặc Zalo tới số điện thoại mà bạn nhập dưới đây:

Số điện thoại chưa đúng định dạng!
Số điện thoại này đã được xác thực!
Bạn có thể dùng Sđt này đăng nhập tại đây!
Lỗi gửi SMS, liên hệ Admin
0 Bình luận
Sắp xếp theo
❖ Claude