Có gì mới
Claude Opus 5 là model mới của Anthropic cho coding, agentic workflow và knowledge work phức tạp. Anthropic đặt nó dưới Claude Fable 5 về một số năng lực frontier, nhưng nhấn mạnh rằng Opus 5 gần Fable ở nhiều tác vụ dev với chi phí thấp hơn.
Điểm chính cho dev:
- Model có sẵn qua Claude API với tên
claude-opus-5. - Giá niêm yết là $5 cho mỗi triệu input token và $25 cho mỗi triệu output token, ngang Opus 4.8.
- Fast mode chạy nhanh khoảng 2.5 lần so với chế độ mặc định, đổi lại giá gấp đôi trên Claude Platform.
- Opus 5 là model mạnh nhất trên Claude Pro và là default mới cho Claude Max.
- Claude Code, Claude.ai và Claude Cowork có fallback về Opus 4.8 khi request bị safety classifier chặn.
Hiệu năng và coding
Anthropic nói Opus 5 hơn gấp đôi Opus 4.8 trên Frontier-Bench v0.1 với chi phí mỗi task thấp hơn. Trên CursorBench 3.2, ở max effort, model chỉ kém Fable 5 khoảng 0.5 điểm phần trăm nhưng chi phí mỗi task bằng khoảng một nửa.
Các ví dụ được Anthropic đưa ra tập trung vào tác vụ nhiều bước:
- Tự viết pipeline computer vision để đọc bản vẽ rồi tạo lại một chi tiết máy bằng FreeCAD.
- Tìm root cause của bug trong package manager open-source và sửa cả edge case mà bản vá cộng đồng bỏ sót.
- Xây market data feed cho một sàn mới, kèm test harness để kiểm tra parser khi chưa có live feed.
Với coding agent, thông điệp thực dụng là: Opus 5 đáng benchmark trên bug thật, repo nhiều file và task cần kiểm tra lại giả định. Đừng chỉ đo bằng prompt ngắn hoặc demo tạo UI.
Thay đổi API quan trọng
Anthropic phát hành thêm hai tính năng beta đi cùng Opus 5:
- Mid-conversation tool changes: trong cùng một conversation, ứng dụng có thể thay đổi danh sách tool mà Claude được phép dùng mà không làm mất prompt cache.
- Automatic fallbacks: request bị classifier chặn trên Opus 5 hoặc Fable 5 có thể tự route sang model khác, thay vì trả về block ngay lập tức.
Hai điểm này quan trọng cho hệ thống agent production. Tool list thường thay đổi theo state của workflow: lúc đọc repo cần một nhóm tool, lúc deploy cần nhóm khác, lúc review lại cần giới hạn quyền. Nếu đổi tool mà vẫn giữ cache, chi phí và latency sẽ dễ kiểm soát hơn.
Safety và giới hạn
Anthropic nói Opus 5 không đẩy frontier rủi ro về biology hoặc offensive cybersecurity vượt Mythos 5. Model vẫn cải thiện ở khả năng tìm vulnerability vì năng lực chung tốt hơn, nhưng bị mô tả là kém Mythos 5 ở bước biến vulnerability thành exploit thực tế.
Cyber safeguard của Opus 5 cũng được chỉnh để ít chặn hơn Fable 5. Anthropic ước tính classifier sẽ can thiệp ít hơn khoảng 85% so với Fable 5, trong khi vẫn chặn một số lớp request như binary-based vulnerability scanning, penetration testing và exploit generation.
Cách nâng cấp
Nếu đang dùng Opus 4.8 cho coding agent, nên chạy A/B trên cùng bộ issue nội bộ:
- Tỉ lệ pass test sau lần sửa đầu tiên.
- Số lượt tool call và số token tiêu thụ.
- Khả năng giữ ngữ cảnh khi task kéo dài qua nhiều file.
- Tỉ lệ cần người review can thiệp vì model sửa lệch convention.
- Latency giữa default mode và Fast mode.
Không nên đổi production agent chỉ vì một benchmark. Nên bắt đầu bằng workload khó nhưng có oracle rõ: failing test, regression cụ thể, hoặc task migration có checklist.