Anthropic đã ra mắt Claude Opus 5 vào ngày 24 tháng 7, mở rộng cửa sổ ngữ cảnh lên một triệu token trong khi vẫn giữ nguyên mức giá của Opus 4.8. Các nhà phát triển đang xây dựng các quy trình tự động hóa cần lưu ý: bản cập nhật này bổ sung các kiểm soát mức độ nỗ lực (effort-level controls), một giai đoạn "suy nghĩ" (thinking) bắt buộc, tính năng lưu trữ đệm câu lệnh (prompt caching) cho các câu lệnh ngắn, và khả năng thay đổi công cụ ngay giữa cuộc hội thoại—những tính năng có thể định hình lại các mô hình tích hợp và cấu trúc chi phí.

Tại sao bản nâng cấp này lại quan trọng

Opus 5 tuyên bố có trí thông minh tương đương với điểm chuẩn “Fable 5” với mức chi phí chỉ bằng một nửa. Trên thực tế, mô hình này xử lý đầu vào lên đến một triệu token và tạo ra đầu ra lên đến 128k token mà không làm tăng phí.

Các tùy chỉnh mới tập trung vào nhà phát triển

Kiểm soát mức độ nỗ lực (Effort-level controls)

Mô hình mặc định ở cài đặt nỗ lực "cao" (high) nhưng cung cấp năm cấp độ: thấp (low), trung bình (medium), cao (high), cực cao (xhigh) và tối đa (max). Mỗi cấp độ sẽ đánh đổi thời gian tính toán và chi phí để lấy chất lượng câu trả lời. Các nhà phát triển có thể bắt đầu một tác vụ ở mức nỗ lực cao, hạ xuống cấp độ thấp hơn nếu tác vụ đó tỏ ra đơn giản, hoặc tăng lên xhigh/max khi gặp vấn đề khó.

Chế độ suy nghĩ bắt buộc (Mandatory thinking mode)

Claude hiện chạy một giai đoạn "suy nghĩ" (thinking) trước khi đưa ra bất kỳ đầu ra nào. Giai đoạn này là bắt buộc đối với hai cấp độ nỗ lực cao nhất (xhigh, max) và không thể tắt đi.

Lưu trữ đệm câu lệnh (Prompt caching) cho các câu lệnh 512 token

Tính năng lưu trữ đệm câu lệnh hiện đã hoạt động với các câu lệnh nhỏ chỉ từ 512 token.

Thay đổi công cụ giữa cuộc hội thoại (beta)

Một tính năng beta cho phép một phiên Claude đang diễn ra có thể thay đổi công cụ bên ngoài mà nó gọi—ví dụ, thay thế mô-đun tìm kiếm web bằng một truy vấn cơ sở dữ liệu—mà không cần phải khởi động lại cuộc hội thoại.

Những rủi ro đối với quy trình tích hợp

Các kiểm soát bổ sung giúp các kỹ sư có khả năng điều chỉnh chi tiết hơn về chi phí và hiệu suất, nhưng chúng cũng mang lại các kịch bản lỗi mới. Việc bắt buộc suy nghĩ ở mức xhigh/max có nghĩa là bất kỳ mã nguồn hiện có nào vô hiệu hóa khả năng lập luận nội bộ sẽ gặp lỗi. Việc thay đổi công cụ giữa cuộc hội thoại vẫn đang ở bản beta, vì vậy tính ổn định không được đảm bảo.

Quan điểm ngược lại

Anthropic giữ nguyên mức giá, nhưng các cấp độ nỗ lực cao hơn sẽ tiêu thụ nhiều tài nguyên tính toán hơn.

Những điều cần theo dõi tiếp theo

  • Các bản cập nhật cho bản xem trước “fast mode”, hứa hẹn độ trễ thấp hơn cho các khối lượng công việc nghiên cứu nhưng hiện chưa được phát hành rộng rãi.

Đối với các nhà phát triển có các đường ống (pipelines) chạy Claude tự động, Opus 5 cung cấp một bộ công cụ có thể khai thác nhiều trí thông minh hơn từ mỗi đô la chi tiêu—với điều kiện họ điều chỉnh mã nguồn để thích ứng với các giai đoạn suy nghĩ và kiểm tra các lộ trình lưu trữ đệm và chuyển đổi công cụ mới.