Chuyển đến nội dung
tinAI
Quay lại

Claude Opus 5: model mới cho coding agent

anthropic.com · Loại nguồn: công ty/blog 2026-07-25T20:08:12.897Z
Bản dịch tiếng Việt của tinAI · Từ Introducing Claude Opus 5 (anthropic.com) · Ngày gốc: · Dịch ngày:

và giữ bối cảnh từ bản tin tinAI đã giới thiệu bài này .

Bài gốc: Introducing Claude Opus 5 (anthropic.com)

Tác giả: Anthropic

Ngày đăng: Dịch ngày:

TL;DR

Claude Opus 5 là model mới của Anthropic cho coding và agentic workflow, có API claude-opus-5, giá 5 USD cho mỗi triệu input token và 25 USD cho mỗi triệu output token. Điểm nên thử ngay là benchmark trên bug nhiều file, tool use dài hơi, Fast mode, mid-conversation tool changes và automatic fallbacks.

Ước tính đọc: 4 phút

Có gì mới

Claude Opus 5 là model mới của Anthropic cho coding, agentic workflow và knowledge work phức tạp. Anthropic đặt nó dưới Claude Fable 5 về một số năng lực frontier, nhưng nhấn mạnh rằng Opus 5 gần Fable ở nhiều tác vụ dev với chi phí thấp hơn.

Điểm chính cho dev:

Hiệu năng và coding

Anthropic nói Opus 5 hơn gấp đôi Opus 4.8 trên Frontier-Bench v0.1 với chi phí mỗi task thấp hơn. Trên CursorBench 3.2, ở max effort, model chỉ kém Fable 5 khoảng 0.5 điểm phần trăm nhưng chi phí mỗi task bằng khoảng một nửa.

Các ví dụ được Anthropic đưa ra tập trung vào tác vụ nhiều bước:

Với coding agent, thông điệp thực dụng là: Opus 5 đáng benchmark trên bug thật, repo nhiều file và task cần kiểm tra lại giả định. Đừng chỉ đo bằng prompt ngắn hoặc demo tạo UI.

Thay đổi API quan trọng

Anthropic phát hành thêm hai tính năng beta đi cùng Opus 5:

Hai điểm này quan trọng cho hệ thống agent production. Tool list thường thay đổi theo state của workflow: lúc đọc repo cần một nhóm tool, lúc deploy cần nhóm khác, lúc review lại cần giới hạn quyền. Nếu đổi tool mà vẫn giữ cache, chi phí và latency sẽ dễ kiểm soát hơn.

Safety và giới hạn

Anthropic nói Opus 5 không đẩy frontier rủi ro về biology hoặc offensive cybersecurity vượt Mythos 5. Model vẫn cải thiện ở khả năng tìm vulnerability vì năng lực chung tốt hơn, nhưng bị mô tả là kém Mythos 5 ở bước biến vulnerability thành exploit thực tế.

Cyber safeguard của Opus 5 cũng được chỉnh để ít chặn hơn Fable 5. Anthropic ước tính classifier sẽ can thiệp ít hơn khoảng 85% so với Fable 5, trong khi vẫn chặn một số lớp request như binary-based vulnerability scanning, penetration testing và exploit generation.

Cách nâng cấp

Nếu đang dùng Opus 4.8 cho coding agent, nên chạy A/B trên cùng bộ issue nội bộ:

Không nên đổi production agent chỉ vì một benchmark. Nên bắt đầu bằng workload khó nhưng có oracle rõ: failing test, regression cụ thể, hoặc task migration có checklist.


Đường dẫn nguồn

tinAI dịch bài này sang tiếng Việt từ Introducing Claude Opus 5 (anthropic.com) · Loại nguồn: công ty/blog và giữ bối cảnh từ bản tin tinAI đã giới thiệu bài này .

Bản tin này có 3 bài dịch liên quan từ cùng bản tin.

Đọc tiếp từ đây

Bạn có thể quay lại bản tin nguồn hoặc mở kho bài dịch để đọc tiếp.

Các bài bên dưới cùng xuất hiện trong bản tin nguồn, nên giữ chung bối cảnh đọc với bài này.

Các bài liên quan trong cùng bản tin trải trên 2 loại nguồn (2 bài). Loại nguồn: công ty/blog 1 Loại nguồn: web 1