Claude Opus 5 Ra Mắt: Gần Sức Mạnh Fable 5 Với Nửa Giá, Benchmark Và So Sánh Toàn Diện

Claude Opus 5 Ra Mắt: Gần Sức Mạnh Fable 5 Với Nửa Giá, Benchmark Và So Sánh Toàn Diện

Biểu tượng Claude AI chính thức của Anthropic.
Biểu tượng Claude AI. Nguồn: Anthropic, qua Wikimedia Commons, CC0.

Claude Opus 5 không phải model mạnh nhất của Anthropic, nhưng có thể là model quan trọng nhất với người dùng chuyên nghiệp

Anthropic chính thức giới thiệu Claude Opus 5 trong thông báo đề ngày 24/7/2026 theo giờ Mỹ. Bài đăng từ tài khoản Claude xuất hiện vào ngày 25/7 theo giờ Việt Nam, với thông điệp ngắn gọn nhưng rất đáng chú ý: đây là một model “thận trọng và chủ động”, tiến gần năng lực frontier của Claude Fable 5 nhưng chỉ có mức giá bằng một nửa.

HOAffmCWsAA1D X

Điểm quan trọng nằm ở cách Anthropic định vị sản phẩm. Fable 5 vẫn là model có năng lực tổng thể cao hơn, dành cho những dự án tham vọng nhất và các agent có thể hoạt động trong nhiều ngày. Opus 5 được thiết kế để trở thành lựa chọn sử dụng thường xuyên hơn: đủ mạnh cho coding, agent, nghiên cứu và công việc doanh nghiệp phức tạp, nhưng không buộc người dùng phải trả mức 10 USD cho một triệu token đầu vào và 50 USD cho một triệu token đầu ra như Fable 5.

Claude Opus 5 giữ nguyên mức giá của Opus 4.8 là 5 USD cho một triệu token đầu vào và 25 USD cho một triệu token đầu ra. Model có cửa sổ ngữ cảnh một triệu token, đầu ra tối đa 128.000 token trên Messages API đồng bộ, adaptive thinking, nhiều mức effort và API ID claude-opus-5. Anthropic đưa Opus 5 trở thành model mặc định trên Claude Max và model mạnh nhất dành cho người dùng Claude Pro.

Đây không chỉ là một lần tăng điểm benchmark. Anthropic đang cố giải quyết bài toán lớn hơn của thị trường AI năm 2026: làm thế nào để một model có thể suy nghĩ kỹ, tự kiểm tra, làm việc lâu và tạo sản phẩm hoàn chỉnh mà chi phí trên mỗi nhiệm vụ vẫn hợp lý. Nếu các tuyên bố được tái hiện ổn định trên workload thực tế, Opus 5 có thể trở thành “daily driver” của developer, AI Creator, nhóm phân tích và doanh nghiệp, trong khi Fable 5 được giữ lại cho những nhiệm vụ thực sự cần mức năng lực cao nhất.

Logo chữ Anthropic của công ty phát triển Claude.
Logo Anthropic. Nguồn: Anthropic, qua Wikimedia Commons.

Thông số chính thức của Claude Opus 5

Hạng mục

Claude Opus 5

Ý nghĩa thực tế

API ID

claude-opus-5

Model snapshot không ghi ngày nhưng được Anthropic mô tả là phiên bản cố định, không phải alias tự đổi âm thầm

Giá đầu vào

5 USD/triệu token

Bằng Opus 4.8 và bằng một nửa Fable 5

Giá đầu ra

25 USD/triệu token

Bằng Opus 4.8 và bằng một nửa Fable 5

Context window

1.000.000 token

Phù hợp codebase lớn, nhiều tài liệu, lịch sử agent dài và phân tích hồ sơ phức tạp

Đầu ra tối đa

128.000 token

Có thể tạo tài liệu, code hoặc artifact dài; Message Batches có beta output đến 300.000 token

Thinking

Adaptive thinking

Model tự điều chỉnh mức suy luận theo nhiệm vụ; không dùng cơ chế extended thinking cũ

Effort mặc định

High trên API và Claude Code

Có thể hạ hoặc tăng effort để tối ưu chi phí, độ trễ và chất lượng

Độ trễ tương đối

Moderate

Nhanh hơn Fable 5, chậm hơn Sonnet 5

Knowledge cutoff tin cậy

Tháng 5/2026

Mới hơn Fable 5 và Sonnet 5 theo bảng model chính thức

Fast mode

Khoảng 2,5 lần tốc độ mặc định

Tính giá gấp đôi mức cơ bản

US-only inference

1,1 lần giá cơ bản

Dành cho workload yêu cầu xử lý tại Mỹ

Ngoài giá tiêu chuẩn, Anthropic tiếp tục áp dụng prompt caching với khả năng tiết kiệm đến 90% cho phần input được tái sử dụng và Batch API giảm 50%. Điều này đặc biệt quan trọng với agent dài hạn, vì phần lớn chi phí có thể đến từ việc gửi lặp lại system prompt, tài liệu, quy tắc dự án, repository map và lịch sử công việc.

HOAdpjiXMAAhOPV

Claude Opus 5 khác Claude Fable 5 và Sonnet 5 như thế nào?

Model

Giá input/output

Context

Độ trễ

Vị trí phù hợp

Claude Fable 5

10/50 USD mỗi triệu token

1M

Chậm hơn

Nhiệm vụ frontier, agent nhiều ngày, dự án cần mức năng lực cao nhất

Claude Opus 5

5/25 USD mỗi triệu token

1M

Trung bình

Coding phức tạp, agent production, nghiên cứu và công việc doanh nghiệp dùng hằng ngày

Claude Sonnet 5

3/15 USD mỗi triệu token, có giá mở bán thấp hơn đến 31/8/2026

1M

Nhanh

Lưu lượng lớn, workflow cần tốc độ, chi phí và trí tuệ cân bằng

Claude Haiku 4.5

1/5 USD mỗi triệu token

200K

Nhanh nhất

Phân loại, trích xuất, hỗ trợ khách hàng và tác vụ khối lượng lớn

Thông điệp “gần Fable 5 với nửa giá” không có nghĩa Opus 5 ngang Fable 5 trong mọi lĩnh vực. Anthropic nói rõ Opus 5 vẫn đứng sau Mythos 5 ở cybersecurity và Fable 5 vẫn là lựa chọn khi người dùng cần năng lực cao nhất. Trên CursorBench 3.2 ở max effort, Opus 5 đạt điểm chỉ thấp hơn đỉnh của Fable 5 khoảng 0,5% nhưng chi phí trên mỗi nhiệm vụ bằng một nửa. Đây là một kết quả cụ thể trong một harness cụ thể, không phải bằng chứng Opus 5 thay thế Fable 5 trên mọi workload.

Điểm hấp dẫn thực tế là đường cong hiệu năng theo chi phí. Anthropic cho biết Opus 5 tạo ra kết quả tốt hơn tại cùng mức chi phí trên nhiều thiết lập high, xhigh và max effort. Người dùng có thể giữ max effort cho bug khó, migration lớn hoặc nghiên cứu nhiều bước, nhưng hạ effort cho code review thông thường, tóm tắt tài liệu hoặc tác vụ lặp lại.

Ảnh chụp giao diện ứng dụng Claude.ai trên web.
Giao diện Claude.ai trên web. Ảnh: Orwell reader/Wikimedia Commons.

Benchmark coding: Opus 5 tập trung vào độ tin cậy và chi phí trên mỗi nhiệm vụ

Frontier-Bench v0.1

Anthropic cho biết Opus 5 đứng đầu Frontier-Bench v0.1 và đạt hiệu năng hơn gấp đôi Opus 4.8 trong khi chi phí trên mỗi nhiệm vụ thấp hơn. Kết quả được chạy bằng mini-SWE-agent trên backend GKE, lấy mean reward từ năm lần thử cho mỗi nhiệm vụ. Opus 4.8 được dùng làm fallback khi bộ phân loại an toàn của Opus 5 hoặc Fable 5 từ chối yêu cầu.

HOAfFQSXEAALIkI

Chi tiết fallback cần được chú ý khi đọc benchmark. Một số lượt chạy mang nhãn Opus 5 có thể được hoàn thành bởi Opus 4.8 sau khi classifier kích hoạt. Điều này không làm benchmark vô nghĩa, nhưng cho thấy kết quả đo một hệ thống sản phẩm gồm model và guardrail, không chỉ trọng số model thuần túy.

CursorBench 3.2

Ở max effort, Opus 5 được Anthropic báo cáo chỉ kém mức điểm cao nhất của Fable 5 khoảng 0,5%, nhưng có chi phí trên mỗi nhiệm vụ bằng một nửa. Đại diện Cursor cho biết model có nhiều hành vi tương tự Fable 5 và phù hợp với workflow coding trong editor.

Đối với developer, “gần Fable” chỉ có giá trị khi kết quả ổn định giữa các lần chạy. Một model đạt điểm cao nhưng biến động mạnh sẽ khiến team phải review nhiều, retry nhiều và khó dự đoán chi phí. Các đối tác thử nghiệm như Lovable cho biết Opus 5 ít biến động hơn, đồng thời tăng 22% so với Opus 4.7 trên nhóm tác vụ agentic coding khó nhất của họ. Đây là đánh giá nội bộ của khách hàng sớm, nên nên được xem là tín hiệu triển khai chứ chưa phải benchmark độc lập.

Ảnh chụp giao diện Cursor AI Coding Agent trong quá trình làm việc với mã nguồn.
Giao diện Cursor AI Coding Agent. Ảnh: LrgFranzones/Wikimedia Commons.

Khả năng tự kiểm tra và tìm nguyên nhân gốc

Anthropic nhấn mạnh Opus 5 mạnh hơn ở việc xác minh công việc, tạo test harness và tiếp tục lặp cho đến khi kết quả đạt yêu cầu. Trong một tác vụ Frontier-Bench, model nhận bản vẽ chi tiết máy nhưng không có công cụ xem trực tiếp. Nó tự viết pipeline computer vision để đọc hình học từ pixel rồi dựng lại mô hình FreeCAD 3D. Trong một ví dụ khác, model tìm nguyên nhân gốc của bug trong package manager mã nguồn mở và sửa thêm một edge case mà patch cộng đồng bỏ sót.

HOAf6E WgAACCfD

Theo kiểm toán hành vi tự động của chúng tôi, Opus 5 là mô hình phù hợp nhất của chúng tôi cho đến nay. So với các mô hình khác của chúng tôi, nó thể hiện tỷ lệ hành vi liều lĩnh hoặc lừa dối thấp nhất, và sự tuân thủ mạnh mẽ nhất đối với Hiến pháp của Claude.

Những ví dụ này cho thấy thay đổi quan trọng trong coding agent: model không chỉ sinh patch đầu tiên mà còn tạo phương pháp kiểm chứng khi môi trường thiếu công cụ. Dù vậy, doanh nghiệp vẫn phải giữ test độc lập, review bảo mật và quy trình phê duyệt. Khả năng tự kiểm tra của model không nên trở thành lý do bỏ kiểm tra của con người.

Knowledge work và agent doanh nghiệp

So sánh với Opus 4.8

Opus 5 mạnh hơn Opus 4.8 trong các nhiệm vụ an ninh mạng. Nhưng nó vẫn còn kém xa Mythos 5 đáng kể trong việc phát triển các lỗ hổng khai thác. Các biện pháp bảo vệ của nó được thiết kế để cho phép các nhà phát triển xác định và sửa chữa các lỗ hổng phần mềm, đồng thời chặn các sử dụng có rủi ro cao.

HOAgFibXMAApxnu

ARC-AGI 3 và giải quyết vấn đề mới

Anthropic cho biết điểm ARC-AGI 3 của Opus 5 cao gấp ba lần model đứng thứ hai. ARC-AGI tập trung vào khả năng giải bài toán mới thay vì tái hiện kiến thức đã học. Nếu kết quả được xác nhận rộng hơn, đây là tín hiệu Opus 5 cải thiện ở việc hình thành giả thuyết, thử nghiệm và thay đổi chiến lược khi cách tiếp cận đầu tiên thất bại.

OSWorld 2.0 và computer use

Trên OSWorld 2.0, Anthropic nói Opus 5 vượt các model khác tại mọi mức chi phí được so sánh và vượt kết quả tốt nhất của Fable 5 với chi phí chỉ hơn một phần ba. Computer use là nhóm tác vụ dễ phát sinh lỗi vì model phải đọc giao diện, chọn đúng điều khiển, theo dõi trạng thái và phục hồi khi ứng dụng thay đổi. Do đó, hiệu quả trên mỗi nhiệm vụ có ý nghĩa hơn điểm một lượt đơn lẻ.

AutomationBench của Zapier

Trên Zapier AutomationBench, pass rate của Opus 5 được báo cáo cao khoảng 1,5 lần model đứng sau ở cùng chi phí trên mỗi nhiệm vụ. Ngay cả mức effort thấp nhất cũng hoàn thành nhiều tác vụ hơn các model khác. Zapier cho biết model đã nhận một workbook sức khỏe tài khoản thô, xác định khách hàng có nguy cơ churn, cảnh báo đúng người phụ trách và tạo phần tóm tắt cho nhóm retention. Opus 5 hoàn tất toàn bộ chuỗi với kết quả 100% trong benchmark nội bộ này.

Đối với doanh nghiệp, đây là loại năng lực có thể tạo ROI rõ hơn chatbot hỏi đáp. Một agent có thể nhận dữ liệu, phân tích, quyết định tuyến xử lý, cập nhật hệ thống và tạo báo cáo. Nhưng mức rủi ro cũng tăng: nếu model gắn sai nhãn khách hàng, gửi nhầm thông báo hoặc thay đổi dữ liệu không đúng, hậu quả xảy ra ngoài cửa sổ chat. Vì vậy, workflow production nên tách bước quan sát, đề xuất và hành động; những hành động có ảnh hưởng tài chính hoặc khách hàng cần approval.

Logo Zapier, nền tảng được Anthropic dùng để mô tả kết quả AutomationBench của Claude Opus 5.
Logo Zapier. Nguồn: Zapier, qua Wikimedia Commons.

Khoa học, tài chính, pháp lý và tài liệu chuyên nghiệp

Anthropic báo cáo Opus 5 vượt Opus 4.8 trên toàn bộ bộ đánh giá life sciences nội bộ. Mức tăng nổi bật gồm 10,2 điểm phần trăm trong bài toán suy luận cấu trúc phân tử từ dữ liệu phổ và 7,7 điểm phần trăm trong nhóm dự đoán ảnh hưởng của biến thể chuỗi protein đến chức năng.

Các khách hàng thử nghiệm cũng báo cáo tiến bộ ở phân tích tài chính, bảng tính, due diligence, legal redlining và xây slide. Box cho biết Opus 5 vượt Opus 4.8 khoảng 8% tổng thể, 11% ở data analysis và 17% ở due diligence trong eval nội bộ. Một nhóm tài chính nói model tăng trung bình chín điểm phần trăm về độ chính xác, dùng ít hơn một phần ba lượt trao đổi và tool call, đồng thời giảm 60% thời gian. Một nhóm pháp lý cho biết model tạo kết quả tương đương với ít hơn 26% token so với Opus 4.8 ở max reasoning.

Đây đều là lời chứng thực của khách hàng truy cập sớm, không phải đánh giá độc lập. Giá trị của chúng nằm ở việc mô tả loại workload mà model có thể cải thiện: bảng tính nhiều bước, tài liệu cần định dạng, nghiên cứu mở, redline hợp đồng và phân tích cần giữ logic xuyên suốt nhiều artifact.

Effort settings: tính năng quan trọng nhất để kiểm soát chi phí

Opus 5 hỗ trợ adaptive thinking và tham số effort. Trên Claude API và Claude Code, mức mặc định là high. Nhà phát triển có thể đặt effort rõ ràng để tránh việc cùng một loại tác vụ lúc dùng quá nhiều token, lúc lại suy luận chưa đủ.

Mức sử dụng gợi ý

Loại công việc

Cách vận hành

Effort thấp

Tóm tắt, phân loại, chỉnh sửa đơn giản, truy vấn có cấu trúc

Ưu tiên latency và chi phí; vẫn cần schema rõ và test đầu ra

Effort trung bình/cao

Code review, phân tích tài liệu, bug thông thường, automation nhiều bước

Dùng làm cấu hình mặc định cho phần lớn workflow chuyên nghiệp

Effort rất cao/max

Migration lớn, root-cause analysis, research mở, thiết kế kiến trúc

Chỉ dùng khi giá trị nhiệm vụ đủ bù token, thời gian và tool call

Một sai lầm phổ biến là dùng max effort cho mọi request rồi kết luận model quá đắt. Sai lầm ngược lại là hạ effort quá thấp cho nhiệm vụ cần lập kế hoạch dài, khiến model thất bại, retry nhiều và cuối cùng tốn hơn. Chỉ số nên theo dõi là chi phí hoàn thành một nhiệm vụ đạt tiêu chuẩn, không phải giá một triệu token hoặc số token của một lần gọi.

Cách triển khai Claude Opus 5 trên Claude, API và cloud

Opus 5 có mặt trên Claude cho người dùng Pro, Max, Team và Enterprise. Anthropic gọi đây là model mặc định mới trên Claude Max và model mạnh nhất trên Claude Pro. Nhà phát triển có thể dùng trực tiếp qua Claude Platform với API ID claude-opus-5, qua Amazon Bedrock với ID anthropic.claude-opus-5, qua Google Cloud với ID claude-opus-5 và qua Microsoft Foundry.

Các model ID không ghi ngày từ thế hệ 4.6 trở đi vẫn là snapshot cố định theo tài liệu Anthropic, không phải con trỏ evergreen tự đổi phiên bản. Điều này giúp doanh nghiệp kiểm soát thay đổi tốt hơn, nhưng cũng có nghĩa muốn nâng model phải thực hiện migration có chủ đích, chạy eval và cập nhật cấu hình.

Logo Amazon Web Services, một trong các nền tảng phân phối Claude Opus 5.
Amazon Web Services. Nguồn: AWS, qua Wikimedia Commons.
Biểu tượng Google Cloud năm 2026, một nền tảng cung cấp Claude Opus 5.
Google Cloud. Nguồn: Google, qua Wikimedia Commons.
Logo Microsoft Azure, hệ sinh thái Microsoft Foundry cung cấp Claude Opus 5.
Microsoft Azure. Nguồn: Microsoft, qua Wikimedia Commons.

Hai cập nhật API beta đi kèm Opus 5

Thay đổi công cụ giữa cuộc hội thoại

Claude Platform cho phép nhà phát triển thay đổi danh sách tool mà model có thể dùng ngay trong cuộc hội thoại mà không làm mất prompt cache. Đây là cải tiến đáng giá với agent dài hạn. Một agent có thể bắt đầu bằng quyền đọc, sau đó chỉ được cấp tool ghi khi người dùng phê duyệt; hoặc chuyển từ nhóm công cụ nghiên cứu sang công cụ triển khai mà không phải xây lại toàn bộ context.

Automatic fallbacks

API có beta automatic fallbacks. Nếu yêu cầu bị bộ phân loại an toàn của Opus 5 hoặc Fable 5 gắn cờ, hệ thống có thể tự chuyển sang model phù hợp khác thay vì trả lỗi chặn. Trên Claude.ai, Claude Code và Claude Cowork, những yêu cầu Opus 5 bị gắn cờ sẽ mặc định fallback về Opus 4.8.

Doanh nghiệp nên log rõ model thực tế đã xử lý từng request. Nếu chỉ nhìn model được yêu cầu ban đầu, team có thể hiểu sai chất lượng, chi phí hoặc nguyên nhân hành vi thay đổi. Với tác vụ được kiểm toán, model fallback cần xuất hiện trong trace và báo cáo.

An toàn và alignment: Opus 5 mạnh hơn nhưng không được định vị là model cyber frontier

Trong behavioral audit tự động của Anthropic, Opus 5 đạt điểm 2,3 về hành vi lệch chuẩn tổng thể, thấp nhất trong nhóm model gần đây của công ty. Anthropic nói model tuân thủ Claude’s Constitution tốt hơn Opus 4.8, Sonnet 5 và Fable 5, ít hành vi lừa dối hơn và ít bị dẫn dụ vào hành động có hậu quả khó đảo ngược.

Về dual-use, Anthropic cho biết Opus 5 không đẩy frontier về sinh học nguy hiểm hoặc tấn công mạng. Model vẫn đứng sau Mythos 5 trong nghiên cứu sinh học và offensive cybersecurity. Trên OSS-Fuzz, Opus 5 gần Mythos 5 ở việc phát hiện lỗ hổng nhưng kém đáng kể ở phát triển exploit. Anthropic chủ ý không huấn luyện Opus 5 chuyên sâu cho cyber, dù năng lực cyber vẫn tăng theo năng lực tổng quát.

Guardrail cyber của Opus 5 cho phép tìm lỗ hổng trong source code nhưng chặn một số hoạt động như quét lỗ hổng dựa trên binary, penetration testing và tạo exploit. Anthropic ước tính classifier can thiệp ít hơn khoảng 85% so với Fable 5. Khách hàng thuộc Cyber Verification Program có thể truy cập phiên bản ít hạn chế hơn cho nghiên cứu và công việc được xác minh.

Ai nên chuyển sang Claude Opus 5?

Developer và nhóm Vibe Coding

Opus 5 phù hợp khi dự án đã vượt giai đoạn tạo giao diện thử. Các nhiệm vụ như migration database, rearchitecture, điều tra bug không ổn định, viết test, review PR và thay đổi nhiều module cần khả năng lập kế hoạch và giữ context. Với landing page, CRUD đơn giản hoặc chỉnh CSS nhỏ, Sonnet 5 có thể kinh tế hơn.

AI Creator và solopreneur

Người vận hành nhiều website, nội dung, tài liệu và automation có thể dùng Opus 5 cho tác vụ đòi hỏi tổng hợp nhiều nguồn, lập kế hoạch dài, xây bảng tính, tạo slide, audit quy trình và giao việc cho agent. Model không tự biến dữ liệu kém thành kết quả tốt; creator vẫn cần tổ chức file, quyền truy cập, tiêu chí nghiệm thu và bước review.

Doanh nghiệp và nhóm chuyên môn

Opus 5 đáng thử cho finance, legal, research, due diligence, code modernization và tài liệu nhiều artifact. Trước khi migration, doanh nghiệp nên xây eval riêng, đo pass rate, chi phí trên mỗi task, số lượt tool call, thời gian con người review và tỷ lệ fallback.

Ảnh chụp Visual Studio Code với terminal và mã nguồn trong một quy trình phát triển phần mềm.
Visual Studio Code với terminal. Ảnh: Cycling2/Wikimedia Commons.

Quy trình migration từ Opus 4.8 sang Opus 5

  1. Đổi model ID trong môi trường thử nghiệm: sử dụng claude-opus-5, không thay trực tiếp ở production.

  2. Đặt effort rõ ràng: tránh phụ thuộc hoàn toàn vào mặc định nếu workload cần chi phí ổn định.

  3. Chạy lại eval thực tế: dùng codebase, tài liệu, ngôn ngữ và tool schema của doanh nghiệp.

  4. Đo cost per successful task: tính token, tool call, retry, latency và thời gian review.

  5. Kiểm tra structured output: model mới có thể thay đổi độ dài, cách giải thích và lựa chọn tool.

  6. Ghi nhận fallback: log model thực tế xử lý request khi bật automatic fallback.

  7. Canary rollout: chuyển một phần lưu lượng, theo dõi lỗi rồi mới mở rộng.

  8. Giữ rollback: Opus 4.8 vẫn cần tồn tại như phương án quay lại trong giai đoạn đầu.

Claude Opus 5 có đáng với mức giá 5/25 USD không?

Với tác vụ ngắn và đơn giản, câu trả lời thường là không. Sonnet 5 hoặc Haiku có thể hoàn thành nhanh hơn và rẻ hơn. Với nhiệm vụ khó, giá token không phải chỉ số quyết định. Nếu Opus 5 giảm số lần retry, tool call, vòng review và thời gian chuyên gia, tổng chi phí có thể thấp hơn model rẻ nhưng thất bại nhiều lần.

Thông điệp “nửa giá Fable 5” hấp dẫn, nhưng không nên hiểu rằng mọi người cần nâng lên Opus. Giá trị của Opus 5 nằm ở vùng giữa: năng lực gần frontier cho nhiều tác vụ coding và knowledge work, với chi phí đủ thấp để dùng thường xuyên hơn. Đây là chiến lược tương tự việc doanh nghiệp dùng model cao cấp cho bước lập kế hoạch, kiểm chứng và quyết định; dùng Sonnet hoặc Haiku cho phần thực thi lặp lại.

Kết luận

Claude Opus 5 là bước nâng cấp lớn của dòng Opus, giữ nguyên mức giá Opus 4.8 nhưng cải thiện rõ ở coding agent, computer use, nghiên cứu, bảng tính, tài liệu và khả năng tự kiểm tra. Model tiến rất gần Fable 5 trên một số benchmark như CursorBench nhưng vẫn không thay thế Fable trong mọi nhiệm vụ, đồng thời đứng sau Mythos 5 ở offensive cybersecurity và một số công việc sinh học dài hạn.

Đối với developer, AI Creator và doanh nghiệp, điểm đáng quan tâm nhất không phải một con số leaderboard mà là sự kết hợp giữa một triệu token context, adaptive thinking, effort control, độ tin cậy dài hạn và mức giá 5/25 USD. Opus 5 có tiềm năng trở thành model làm việc hằng ngày cho những nhiệm vụ mà Sonnet chưa đủ chắc chắn nhưng Fable quá đắt.

Nguồn chính: thông báo Claude Opus 5 của Anthropictrang sản phẩm Claude Opusbảng model và thông số Claude Platform, cùng trang Claude Fable 5.

© 版权声明
THE END
Thích thì ủng hộ nhé.
点赞1 分享
bình luận 抢沙发

请登录后发表评论

    暂无评论内容