Trang chủ › AI › Claude Opus 5.5 mạnh ngang Fable 5.1, giá API giảm sâu
AI

Claude Opus 5.5 mạnh ngang Fable 5.1, giá API giảm sâu

Anthropic ra mắt Claude Opus 5.5 với hiệu năng lập trình nổi bật, tốc độ cao hơn Opus 5 và chi phí API thấp hơn đáng kể so với Fable 5.1.
Dũng Virgo Dũng Virgo
23/09/2026 13 phút đọc 14 lượt xem
Chia sẻ: f 𝕏
Tổng quan bài viết

Anthropic vừa giới thiệu Claude Opus 5.5, mẫu AI được hãng định vị là hệ thống mạnh nhất từng thử nghiệm. Điểm đáng chú ý không chỉ nằm ở kết quả benchmark, mà còn ở cách Anthropic đặt sản phẩm này trong danh mục của mình: hiệu năng được quảng bá gần tương đương Fable 5.1, trong khi chi phí sử dụng thấp hơn đáng kể.

Bảng thông tin giá API và các gói sử dụng Claude Opus 5.5
Màn hình minh họa tác vụ lập trình được xử lý bằng Claude Opus 5.5
Biểu đồ so sánh kết quả benchmark giữa Claude Opus 5.5 và các mô hình khác

Opus 5.5 đã được cung cấp trên Claude phiên bản web và di động. Doanh nghiệp, nhà phát triển cũng có thể tiếp cận mô hình thông qua API hoặc các nền tảng đám mây lớn gồm Amazon Web Services, Google Cloud và Microsoft Azure. Mã sử dụng qua API của mô hình là claude-opus-5-5.

Hiệu năng tiệm cận mẫu AI cao cấp hơn

Fable 5.1 mới là mô hình cao cấp dành cho người dùng phổ thông mà Anthropic ra mắt trước đó trong tháng 9. Tuy nhiên, Opus 5.5 tạo ra một sự phân tầng khá khác thường: hãng cho biết mẫu mới có thể xử lý phần lớn công việc ở mức tương đương Fable 5.1, nhưng chi phí vận hành lại thấp hơn.

So với Opus 5, Opus 5.5 giảm khoảng 40% chi phí trong các tác vụ thông thường và tạo phản hồi nhanh hơn trên 30%. Đây là thay đổi có ý nghĩa với các ứng dụng phải gọi mô hình liên tục, chẳng hạn công cụ hỗ trợ lập trình, hệ thống phân tích tài liệu hoặc quy trình tự động hóa nhiều bước.

Hiệu quả chi phí cũng là lý do Opus 5.5 có thể thu hút doanh nghiệp. Khi một hệ thống AI xử lý hàng triệu token mỗi ngày, chênh lệch vài USD trên mỗi triệu token có thể nhanh chóng chuyển thành khoản tiết kiệm lớn trong hóa đơn vận hành.

Giá API thấp hơn đáng kể so với Fable 5.1

Anthropic niêm yết Opus 5.5 ở mức 4 USD cho mỗi một triệu token đầu vào và 20 USD cho mỗi một triệu token đầu ra. Trong khi đó, Opus 5 có giá lần lượt là 5 USD và 25 USD.

Fable 5.1 đắt hơn nhiều, với 10 USD cho một triệu token đầu vào và 50 USD cho một triệu token đầu ra. Tính theo mức giá cơ bản, Opus 5.5 rẻ hơn Fable 5.1 khoảng 60%. Đây là khác biệt đáng cân nhắc đối với lập trình viên hoặc công ty triển khai chatbot, trợ lý nội bộ và các tác vụ xử lý mã nguồn trên quy mô lớn.

Mô hình Token đầu vào Token đầu ra
Claude Opus 5.5 4 USD/triệu token 20 USD/triệu token
Claude Opus 5 5 USD/triệu token 25 USD/triệu token
Claude Fable 5.1 10 USD/triệu token 50 USD/triệu token

Chi phí bộ nhớ đệm cũng được điều chỉnh. Một triệu token đọc từ cache có giá 0,2 USD, thấp hơn 60% so với Opus 5. Cơ chế này giúp giảm tiền khi ứng dụng phải gửi lại những phần chỉ dẫn hoặc dữ liệu nền giống nhau trong nhiều lượt tương tác.

Người dùng cần tốc độ cao hơn có thể chọn chế độ Fast. Mức giá của chế độ này tăng gấp đôi, lên 8 USD cho đầu vào và 40 USD cho đầu ra trên mỗi một triệu token.

Opus 5.5 nổi bật trong các bài kiểm tra lập trình

Lập trình là lĩnh vực cho thấy khoảng cách rõ nhất giữa Opus 5.5 và các phiên bản trước. Trong Terminal-Bench 4.0, bài đánh giá khả năng tự thao tác với dòng lệnh để hoàn thành nhiệm vụ, mô hình đạt 66,4%. Fable 5.1 đạt 55,8%, còn Opus 5 đạt 52,3%.

Trên CursorBench 4.0, Opus 5.5 đạt 57,8%, cao hơn mức 51,8% của Fable 5.1. Ở FrontierCode v1.1, kết quả lần lượt là 54,4% và 50,3%. Những con số này cho thấy mô hình mới có lợi thế trong các quy trình cần đọc dự án, lập kế hoạch, chỉnh sửa tệp và kiểm tra kết quả bằng công cụ.

Anthropic cũng đưa ra ví dụ từ các thử nghiệm nội bộ. Một tác vụ chuyển mã nguồn từ C sang Rust được Opus 5.5 hoàn thành trong 9,5 giờ, nhanh hơn Fable 5.1 vốn cần 12 giờ. Chi phí của tác vụ này thấp hơn 51% so với khi dùng Fable 5.1.

Trong một bài rà soát mã nguồn khác, Opus 5 cần hơn 20 giờ để hoàn thành, còn Opus 5.5 xử lý trong chưa đến 3 giờ. Dù đây là kết quả thử nghiệm nội bộ và không thể đại diện cho mọi dự án, nó phần nào cho thấy lợi ích của khả năng sử dụng công cụ và làm việc qua nhiều bước.

Không chỉ dành cho lập trình viên

Opus 5.5 cũng đạt kết quả tốt trong các tác vụ văn phòng. Trên GDPval-AA v2.1, mô hình đạt 1.846 điểm Elo, cao hơn Fable 5.1 với 1.735 điểm và Opus 5 với 1.708 điểm.

Ở những bài đánh giá khả năng điều khiển máy tính như OSWorld 2.0 hoặc đọc biểu đồ Chartography, cách biệt giữa các mô hình nhỏ hơn, chỉ khoảng một điểm phần trăm. Điều này cho thấy lợi thế của Opus 5.5 không xuất hiện đồng đều trong mọi loại tác vụ.

Khi so sánh với GPT-6 Astra của OpenAI theo tổng hợp từ OfficeChai, Opus 5.5 dẫn trước ở nhiều bài kiểm tra, trong đó có Terminal-Bench 4.0 với kết quả 66,4% so với 57,9%. Ở Humanity’s Last Exam khi được phép sử dụng công cụ, hai mô hình đạt lần lượt 67,7% và 57,2%.

Tuy nhiên, GPT-6 Astra vẫn dẫn đầu ở AutomationBench, bài kiểm tra tự động hóa quy trình doanh nghiệp, và Terminal-Bench-Science. Vì vậy, không nên xem Opus 5.5 là lựa chọn vượt trội tuyệt đối trong mọi tình huống.

Anthropic cũng lưu ý rằng khi các mô hình đã đạt trình độ cao, vài điểm phần trăm trên benchmark không phải lúc nào phản ánh đúng trải nghiệm thực tế. Khoảng cách giữa Opus 5.5 và Fable 5.1 trong công việc hằng ngày có thể hẹp hơn so với những gì bảng điểm thể hiện.

Mã nguồn ngắn hơn nhưng vẫn cần kiểm thử kỹ

Đánh giá độc lập từ Sonar cho thấy một bức tranh cân bằng hơn. Trong 544 tác vụ lập trình có kiểm thử, Opus 5.5 đạt tỷ lệ vượt qua 87,68%, gần với Opus 5 ở mức 88,6%.

Mô hình mới tạo ra ít hơn 27,5% số dòng mã và giảm 40% lượng token đầu ra. Tổng số vấn đề được phát hiện cũng giảm 42%. Với những dự án cần tiết kiệm thời gian đọc và bảo trì mã nguồn, kết quả này có thể mang lại lợi ích rõ rệt.

Dù vậy, mật độ lỗi lại tăng 12%, lên 644 lỗi trên mỗi triệu dòng mã. Đáng chú ý, lỗi liên quan đến xử lý đồng thời tăng 44% và trở thành nhóm lỗi lớn nhất. Đây là loại lỗi thường xảy ra khi nhiều luồng cùng truy cập tài nguyên, khó tái hiện và dễ bị bỏ sót trong các bài kiểm thử thông thường.

Ở chiều tích cực, số lỗ hổng bảo mật nghiêm trọng nhất giảm 53%. Tuy nhiên, kết quả này không có nghĩa mã do AI tạo ra có thể đưa thẳng vào sản phẩm. Lập trình viên vẫn cần kiểm thử đơn vị, kiểm tra quyền truy cập, đánh giá các luồng bất đồng bộ và rà soát thủ công trước khi triển khai.

Một số thay đổi kỹ thuật cần lưu ý

Opus 5.5 có chế độ suy luận luôn bật và không thể tắt. Các ứng dụng được xây dựng để điều khiển chặt chẽ quy trình gọi mô hình vì thế có thể cần điều chỉnh.

Anthropic cho biết việc buộc mô hình gọi một công cụ cụ thể có thể phát sinh lỗi. Ngoài ra, những giao diện hiển thị văn bản giữa các lần gọi công cụ nhằm báo tiến độ cũng cần được cập nhật để tương thích với cách phản hồi mới.

Đây là điểm quan trọng với doanh nghiệp đang tích hợp Claude vào hệ thống hiện có. Chi phí thấp hơn và điểm benchmark cao hơn không đồng nghĩa quá trình nâng cấp chỉ cần thay mã nhận diện mô hình. Nhóm kỹ thuật nên kiểm tra lại luồng gọi công cụ, cơ chế hiển thị trạng thái, giới hạn thời gian và cách ứng dụng xử lý phản hồi trung gian.

Những doanh nghiệp đang quan tâm tới hạ tầng phục vụ AI có thể tham khảo thêm câu chuyện FPT Cloud đưa Zone Thủ Đức vào vận hành, bởi năng lực hạ tầng là một phần quan trọng khi triển khai mô hình ngôn ngữ ở quy mô lớn.

Yêu cầu nhạy cảm vẫn được kiểm soát

Do có năng lực tương đương Fable 5.1 trong các lĩnh vực sinh học và an ninh mạng, Opus 5.5 sử dụng cơ chế bảo vệ tương tự. Một số yêu cầu liên quan đến an ninh mạng có thể được chuyển sang Opus 4.8 để xử lý.

Cách vận hành này giúp Anthropic duy trì lớp kiểm soát an toàn, nhưng cũng tạo ra một vấn đề cần tính đến: trong các quy trình tự động nhiều bước, ứng dụng có thể nhận kết quả từ những mô hình khác nhau mà không phải lúc nào cũng nhận biết rõ sự thay đổi đó.

Các nhà nghiên cứu về bảo mật và khoa học sự sống đáp ứng điều kiện có thể đăng ký chương trình xác minh riêng để được xem xét nới hạn chế. Dù vậy, quyền truy cập vẫn phụ thuộc vào quy trình đánh giá của Anthropic.

Người dùng trả phí được tăng hạn mức

Cùng thời điểm phát hành Opus 5.5, Anthropic điều chỉnh giới hạn sử dụng theo chu kỳ 5 giờ cho các gói Pro, Max, Team và Enterprise tính theo số lượng người dùng.

Người đăng ký cũng nhận thêm một lần đặt lại giới hạn, có thể sử dụng tùy thời điểm trước khi hết ngày 22/10. Chính sách này giúp người dùng thử nghiệm mô hình mới với cường độ cao hơn trong giai đoạn đầu, đặc biệt khi thực hiện các dự án lập trình hoặc phân tích tài liệu dài.

Anthropic cho biết Claude Sonnet 5.5 và Haiku 5.5 sẽ xuất hiện trong vài tuần tới. Nếu Opus 5.5 đảm nhiệm nhóm tác vụ đòi hỏi năng lực cao, Sonnet và Haiku có thể giúp hãng mở rộng lựa chọn về tốc độ, chi phí và quy mô triển khai.

Đánh giá nhanh

Claude Opus 5.5 nổi bật nhờ sự kết hợp giữa hiệu năng lập trình, tốc độ và giá API. Mức phí thấp hơn đáng kể so với Fable 5.1 khiến mô hình này trở thành lựa chọn đáng chú ý cho các nhóm phát triển phần mềm và doanh nghiệp muốn kiểm soát ngân sách AI.

Tuy nhiên, benchmark chỉ nên được xem là một trong nhiều yếu tố quyết định. Mật độ lỗi tăng trong đánh giá của Sonar, các vấn đề với mã đa luồng và thay đổi liên quan đến gọi công cụ cho thấy Opus 5.5 vẫn cần được kiểm thử trong môi trường thực tế. Với các hệ thống quan trọng, phương án phù hợp là triển khai từng bước, theo dõi chi phí, chất lượng đầu ra và tỷ lệ lỗi trước khi mở rộng.

Trong bối cảnh cuộc đua AI ngày càng tập trung vào hiệu quả vận hành, Opus 5.5 cho thấy một xu hướng rõ ràng: mô hình không chỉ cần thông minh hơn, mà còn phải tạo ra kết quả với ít token, thời gian ngắn và chi phí hợp lý hơn.

Có thể bạn quan tâm

Bài viết liên quan