Ngày 24/07/2026, Anthropic ra mắt Claude Opus 5 với một thông điệp lạ đời cho một model đầu bảng: điểm nhấn không phải sức mạnh mà là giá. Opus 5 tiến sát trí tuệ của Fable 5 nhưng chỉ tốn một nửa chi phí, giữ nguyên mức giá của Opus 4.8. Với người Việt làm kinh doanh online, đây là lúc phải học cách “chọn đúng tầng model” thay vì mặc định dùng cái đắt nhất.

Opus 5 có gì mới, và vì sao nó khác lần ra mắt trước

Thông thường một model đầu bảng ra mắt sẽ khoe trần trí tuệ mới. Lần này Anthropic làm ngược. Họ dẫn đầu bằng kinh tế. Opus 5, theo mô tả của chính Anthropic, “tiến sát trí tuệ đỉnh cao của Fable 5 với một nửa giá” và được thiết kế để “dùng mỗi ngày” chứ không phải để dành cho những bài toán khó nhất.

Cụ thể hơn: Opus 5 giữ nguyên giá 5 USD mỗi triệu input token và 25 USD mỗi triệu output token, đúng bằng mức của Opus 4.8 mà nó thay thế, và đúng một nửa giá của Fable 5. Nó trở thành model mặc định trên gói Claude Max ngay trong ngày ra mắt, và là model mạnh nhất trên gói Pro. API model ID là claude-opus-5. Một chi tiết dễ bỏ qua nhưng quan trọng với công việc cần dữ liệu mới: mốc kiến thức đáng tin của Opus 5 kéo tới tháng 5/2026, trễ hơn bốn tháng so với Opus 4.8 và Fable 5.

“Opus 5 không đắt hơn để trở nên mạnh hơn rất nhiều. Nó chỉ đơn giản thay thế Opus 4.8 ở cùng mức giá 5 USD và 25 USD.”

Neo Zino, biên tập viên phân tích tại ClockedCode

Thang giá 3 tầng của Claude: hiểu để không đốt tiền oan

Điều nhiều người Việt bán hàng online chưa để ý là các model của Claude được xếp thành một thang giá rõ ràng. Bạn không cần dùng cái đắt nhất cho mọi việc. Bạn chọn tầng phù hợp với độ khó của tác vụ. Dưới đây là bốn tầng chính, tính theo giá mỗi triệu token.

1 / 5 USD
Haiku 4.5, tầng rẻ nhất, hợp việc phân loại tin nhắn, trả lời FAQ, chạy khối lượng lớn

3 / 15 USD
Sonnet 5, tầng giữa, viết nội dung, xử lý tác vụ hằng ngày cân bằng giá và chất lượng

5 / 25 USD
Opus 5, tầng dùng mỗi ngày, đủ mạnh cho việc khó, giờ chỉ bằng nửa giá Fable 5

10 / 50 USD
Fable 5, tầng đỉnh, để dành cho bài toán khó nhất như an ninh mạng, nghiên cứu sinh học

Một chi tiết kỹ thuật đáng tiền: prompt cache read chỉ bị tính 0,50 USD mỗi triệu token, tức khoảng 10% giá input. Với những công việc lặp đi lặp lại trên cùng một khối ngữ cảnh, ví dụ chatbot chăm sóc khách hàng đọc cùng một tài liệu sản phẩm cả nghìn lần, phần cache này giúp chi phí thực tế thấp hơn nhiều so với con số niêm yết. Ngoài ra còn có Fast mode chạy nhanh khoảng 2.5 lần với giá gấp đôi, dành cho lúc cần tốc độ.

📊 Bài toán tiền thật: Một khối lượng công việc đang tốn 4.000 USD mỗi tháng trên Fable 5 thì khi chuyển sang Opus 5 chỉ còn khoảng 2.000 USD, chưa tính bất kỳ tối ưu nào, chỉ đơn thuần vì giá niêm yết bằng một nửa. Với một shop online chạy AI cho content và chăm sóc khách, đây là khoản chênh đủ để trả một tháng quảng cáo.

Số liệu benchmark nói gì về sức mạnh thật

Giá rẻ mà yếu thì vô nghĩa. Điểm đáng chú ý là Opus 5 không chỉ rẻ, nó còn nhảy vọt về năng lực so với đời trước. Trên chỉ số độc lập Artificial Analysis Intelligence Index, Opus 5 ở mức effort tối đa đạt 61 điểm, nhỉnh hơn cả Fable 5 (60 điểm) và GPT-5.6 Sol (59 điểm), trong khi giá output chỉ bằng một nửa Fable 5. Ở mức effort trung bình, điểm là 56, nghĩa là bạn có một “núm vặn” để đánh đổi giữa trí tuệ và số token tiêu tốn.

43,3%
Frontier-Bench v0.1 (lập trình qua terminal), gấp đôi Opus 4.8 (21,1%)

30,2%
ARC-AGI-3 (giải bài toán mới lạ), trong khi Opus 4.8 chỉ đạt 1,5%

26,0%
AutomationBench (hoàn thành quy trình kinh doanh từ đầu tới cuối), cao nhất bảng

Con số ARC-AGI-3 là cú nhảy ấn tượng nhất: từ 1,5% của Opus 4.8 lên 30,2%, tức gấp ba lần model xếp thứ nhì. Đây là bài kiểm tra khả năng giải quyết vấn đề chưa từng gặp, không dựa vào mẫu đã học sẵn. Trên AutomationBench của Zapier, thứ đo xem model có tự chạy trọn một quy trình công việc thực tế hay không, Opus 5 đạt 26,0%, bỏ xa GPT-5.6 Sol (18,1%) và Fable 5 (17,4%). Ngay cả ở mức effort thấp nhất, Opus 5 vẫn vượt mọi model khác ở bài này. Trên OSWorld 2.0 đo khả năng dùng máy tính, điểm là 70,6%, tăng gần mười lăm điểm so với 55,7% của Opus 4.8.

🔵 Vì sao AutomationBench quan trọng với người bán hàng

Bài này không đo khả năng viết code lẻ mà đo việc chạy trọn một luồng như “nhận đơn, kiểm tồn kho, gửi xác nhận, cập nhật bảng tính”. Đó chính là loại việc một shop online muốn AI làm thay. Opus 5 dẫn đầu ở đây nghĩa là độ tin cậy khi giao một chuỗi nhiều bước cho nó cao hơn hẳn model cũ, và một thử nghiệm thực chiến xử lý đơn hàng ghi nhận độ tin cậy multi-step tốt hơn khoảng 20 tới 25%.

Những chỗ Opus 5 KHÔNG đứng nhất

Công bằng mà nói, Opus 5 không thắng ở mọi mặt trận, và biết điều này giúp bạn ra quyết định tỉnh táo hơn. Trên DeepSWE v1.1, một bài lập trình dạng agent, GPT-5.6 Sol dẫn với 72,7% so với 68,8% của Opus 5; đáng chú ý Fable 5 cũng nhỉnh hơn Opus 5 ở đây (69,7%). Trên FrontierCode v1.1, hai bên gần như hòa: 53,4% so với 53,5%, chênh lệch nằm trong sai số. Ở Legal Agent Benchmark, Opus 5 đạt 11,7% thua Fable 5 (13,3%), tuy điểm tuyệt đối của tất cả model đều thấp nên đây là mảng mọi model đều đang chật vật. Riêng lĩnh vực sức khỏe trên HealthBench Professional, ngôi đầu thuộc về Mythos 5 với 66,0%, còn Opus 5 chỉ 59,8%.

Nói cách khác, thông điệp của Anthropic chưa bao giờ là “Opus 5 đánh bại Fable 5 ở mọi thứ”. Thông điệp là khoảng cách đã thu hẹp tới mức, với đa số công việc, trả gấp đôi tiền cho Fable 5 không còn hợp lý. Fable 5 vẫn xứng đáng khi bạn đụng đúng những bài khó nhất mà Anthropic thừa nhận Opus 5 còn kém, như an ninh mạng và nghiên cứu sinh học.

Một điểm sáng khác về an toàn: Opus 5 đạt điểm hành vi lệch chuẩn 2,3 trong bài kiểm định tự động của Anthropic, mức thấp nhất trong các model gần đây của hãng, với tỷ lệ hành vi lừa dối thấp nhất và ít bị dụ dỗ dùng sai mục đích nhất.

Người Việt kinh doanh online nên làm gì với thông tin này

Bài học thực tế không nằm ở việc thuộc lòng bảng benchmark, mà ở tư duy “chọn đúng tầng”. Nếu bạn đang mặc định gọi model đắt nhất cho mọi tác vụ, bạn đang đốt tiền. Hãy chia việc theo độ khó. Phân loại tin nhắn khách, gắn nhãn bình luận, trả lời câu hỏi lặp lại thì để Haiku 4.5 làm với giá 1 USD và 5 USD. Viết caption, soạn email chăm sóc, dựng dàn ý nội dung thì Sonnet 5 ở mức 3 USD và 15 USD là đủ. Chỉ khi cần suy luận nhiều bước, chạy một quy trình tự động phức tạp, hay xử lý logic khó thì mới nâng lên Opus 5.

Với những ai trước đây phải cắn răng dùng Fable 5 cho mọi việc vì sợ chất lượng, đây là tin vui trực tiếp vào túi tiền. Opus 5 nhiều khả năng làm tốt 90% số việc đó với một nửa chi phí. Số tiền tiết kiệm được có thể đổ ngược vào quảng cáo, vào việc chạy nhiều thử nghiệm nội dung hơn, hay đơn giản là giữ lại làm lợi nhuận. Trong một thị trường mà biên lợi nhuận bán hàng online thường mỏng, việc cắt được một nửa chi phí AI mà không mất chất lượng là lợi thế cạnh tranh thật sự.

🔵 Gợi ý cách phân tầng model cho một shop online

Tầng rẻ lo khối lượng lớn và việc lặp: lọc comment, phản hồi tin nhắn cơ bản. Tầng giữa lo sản xuất nội dung hằng ngày: caption, email, mô tả sản phẩm. Tầng Opus lo việc cần “đầu óc”: xây quy trình tự động nhận đơn, phân tích số liệu bán hàng, xử lý tình huống khách phức tạp. Cùng một ngân sách, cách chia này cho ra nhiều đầu việc hơn hẳn so với việc dùng một model đắt cho tất cả.

Cảnh báo: đừng “thay model mù”

Có một cái bẫy mà nhiều người sẽ dính. Opus 5 không phải bản thay thế cắm vào là chạy y hệt code cũ. Anthropic đã thay đổi hai hành vi quan trọng: chế độ suy nghĩ adaptive giờ bật mặc định, thứ mà Opus 4.8 không có; và model mang theo một safety classifier cho nhóm an ninh mạng, có thể từ chối những yêu cầu mà Opus 4.8 chưa bao giờ từ chối.

⚠️ Cảnh báo: Vì Opus 5 tự verify, tự ủy quyền và tường thuật nhiều hơn, những prompt cũ vốn viết cho model đời trước có thể phản tác dụng. Một số chuyên gia đã ghi nhận rằng các câu như “dùng subagent để tự kiểm tra lại” nay khiến Opus 5 làm rối thêm, và Anthropic khuyên nên bỏ những chỉ dẫn kiểu đó đi.

Trước khi chuyển toàn bộ hệ thống sang Opus 5, hãy chạy thử trên một phần nhỏ, so sánh kết quả, rồi mới nhân rộng. Đừng đổi model rồi tưởng mọi thứ tự chạy trơn tru.

Tóm lại, Opus 5 là một trong những lần ra mắt hiếm hoi mà tiêu đề là giá chứ không phải sức mạnh. Nó giữ nguyên mức 5 USD và 25 USD của Opus 4.8, gấp đôi điểm lập trình dạng agent, vượt Fable 5 ở nhiều mảng như tri thức, dùng máy tính, tìm kiếm và quy trình kinh doanh. Với người làm kinh doanh online, đây là lời nhắc đúng lúc: sức mạnh AI đã đủ rẻ để dùng mỗi ngày, việc còn lại là chọn đúng tầng và đừng trả nhiều hơn mức cần thiết.


📚 Về bài viết này

Bài viết được đội ngũ Thiên Minh Quân tổng hợp từ thông báo chính thức của Anthropic, cùng phân tích độc lập từ Capital & Compute, Digital Applied, ClockedCode và chỉ số Artificial Analysis Intelligence Index.

Phần phân tích cách phân tầng model và bài toán chi phí là góc nhìn của chúng tôi từ thực tiễn thị trường kinh doanh online tại Việt Nam.