Bài đăng phát hiện điều gì?
Một thread của @argofowl cho rằng thay đổi effort trong Claude Code đến từ phía server, không phải riêng ứng dụng. Theo bài đăng, Anthropic đưa một phần session dùng Fable 5 trên Claude Code 2.1.236 trở lên vào một experiment làm co thang effort. Các phiên bản cũ hơn và Opus 5 được nói là không nằm trong thử nghiệm, nên không phải người dùng nào cũng thấy cùng hành vi.
Tác giả mô tả dấu hiệu cụ thể: mức high được model đọc thành 10 trên 100, đúng con số từng dùng cho mức low. Bài đăng trước đó trong cùng thread nói thay đổi xuất hiện từ bản 2.1.237 và không được nêu trong changelog.
Những điểm chính
- Experiment được cho là bật theo từng session ở phía server.
- Đối tượng được nhắc tới là Fable 5 trong Claude Code 2.1.236 trở lên.
highbị cho là ánh xạ xuống 10/100, tương đươnglowtrước đây.- Phiên bản cũ và Opus 5 được nói là không bị ảnh hưởng.
- Vì đây có thể là A/B test, hai người dùng cùng version vẫn có thể thấy chất lượng khác nhau.
Nguồn tự dùng cả mốc “2.1.236+” và “từ 2.1.237”, nên ranh giới version chính xác chưa được làm rõ độc lập.
Vì sao dev nên quan tâm?
Tác giả kể rằng mình đã dành cả buổi chiều kiểm tra T3 Code và ứng dụng riêng vì tưởng chúng bị hỏng. Nếu một tham số có tên ổn định nhưng semantics được đổi ở backend, việc debug chỉ dựa vào tên mức effort rất dễ đi sai hướng.
Bài đăng này là quan sát độc lập trên X, không phải thông báo chính thức từ Anthropic. Cách dùng thông tin thận trọng là lưu version Claude Code, model, task đầu vào và output tham chiếu khi so sánh chất lượng. Một eval tái lập sẽ hữu ích hơn cảm giác rằng model “kém đi” trong một session.