Trong 45 ngày qua, Anthropic gần như không ngừng tay.
Fable 5 và Mythos 5 đồng thời ra mắt, Sonnet 5 giảm giá để cạnh tranh thị trường, Claude Code gần như được cập nhật hàng ngày.
Hôm qua Cowork vừa được cập nhật, hôm nay Anthropic lại đồng thời ra mắt sáu bản cập nhật trên nền tảng tác nhân được lưu trữ (CMA):
- Nâng giới hạn kỹ năng từ 20 lên 500: Một phiên có thể chứa toàn bộ kho tri thức doanh nghiệp
- Điều chỉnh tốc độ năm cấp độ suy luận: Định tuyến đơn giản tiết kiệm token, suy luận sâu tối đa
- Tạo phiên hạt giống trong một bước: trực tiếp với 50 sự kiện ban đầu, khởi động lạnh về không
- Sub-agent streaming thực thời xuống cấp độ luồng: Bạn có thể thấy trực tiếp mỗi sub-agent đang chạy đến đâu và nghĩ đến đâu
- 7 loại webhook mới bao phủ toàn bộ vòng đời môi trường và lưu trữ bộ nhớ: Có thể ngừng sử dụng polling
- Cập nhật phiên bản agent: trường này trở thành tùy chọn, loại bỏ chi phí quản lý phiên bản trong quy trình đơn lẻ
Một phiên họp có thể treo 500 kỹ năng, chạy cả một kho tri thức doanh nghiệp, Anthropic đang định lắp hệ điều hành cho agent!


Giới hạn kỹ năng tăng vọt lên 500, một phiên trò chuyện có thể chứa cả bộ phận kinh doanh
Kỹ năng của CMA là các gói kiến thức chứa các lệnh chuyên môn được注入 vào agent, trước đây giới hạn tối đa là 20.
Tuy nhiên, một tác nhân dịch vụ tài chính chỉ riêng việc xử lý mở tài khoản, KYC, chống rửa tiền, giải quyết khiếu nại, miễn trừ trách nhiệm tuân thủ và chuyển đổi đa ngôn ngữ đã có tới七八 cái. Cộng thêm sự khác biệt về quy định và các phiên bản A/B testing, lập tức chạm phải trần giới hạn.
Con số này hiện đã tăng trực tiếp lên 500.
500 vị trí kỹ năng này được chia sẻ bởi tất cả các agent trong một phiên, chạy trong cùng một sandbox được quản lý, các agent chia sẻ bộ nhớ và biến môi trường, được bộ điều phối điều phối thống nhất—đủ để tương ứng với một đơn vị kinh doanh hoàn chỉnh.
Thậm chí, bạn còn có thể nhét toàn bộ quy chuẩn kho mã, cấu hình đường ống CI và mục tiêu triển khai vào một phiên làm việc, để agent hiểu rõ toàn bộ quy trình từ viết mã đến khi上线.

Điều chỉnh tốc độ tư duy năm cấp độ, bài đơn giản không dùng hết token
Tham số sức mạnh suy nghĩ (effort) đã có từ lâu ở cấp API, nhưng các agent trong CMA trước đây không thể thiết lập riêng biệt.
Nói cách khác, toàn bộ phiên sử dụng cùng một cấp độ mặc định; hỏi “Hôm nay là ngày mấy?” và “Kiểm toán báo cáo tài chính 500 trang” đều dùng cùng một mức độ sâu. Việc suy luận quá mức đối với các câu hỏi đơn giản chỉ làm lãng phí token.
Bây giờ mức độ suy nghĩ có thể được ghi trực tiếp vào cấu hình mô hình của từng agent, với năm cấp độ: low / medium / high / xhigh / max.
Bạn đang vận hành một hệ thống dịch vụ khách hàng đa tác nhân: phân luồng bằng low, giải đáp sản phẩm bằng medium, nâng cấp khiếu nại bằng high, tuân thủ pháp lý bằng max.
Trong cùng một phiên, các agent khác nhau có thể chạy ở các cấp độ khác nhau tùy theo độ khó của nhiệm vụ. Giữa chi phí và chất lượng, cuối cùng đã có một nút điều chỉnh liên tục.

Khởi động lạnh về không, các sub-agent trong hộp đen cũng đã được mở ra
Trước khi tạo phiên CMA, cần thực hiện hai bước: gửi một vỏ rỗng bằng POST, sau đó thêm từng sự kiện khởi đầu. Trong các tình huống có lưu lượng cao, độ trễ khứ hồi tích lũy dần, khiến thời gian khởi động lạnh kéo dài.
Bây giờ thực hiện một lần duy nhất. POST /v1/sessions kèm theo initial_events, tối đa 50 sự kiện ban đầu, phiên giao dịch ngay từ khi tạo đã biết mình cần làm gì.
Trong cùng đợt cập nhật này, trường version của giao diện cập nhật agent cũng trở thành tùy chọn.
Trước đây, mỗi lần cập nhật đều phải truyền số phiên bản để kiểm soát đồng thời, nếu phiên bản không khớp sẽ trả về lỗi 409. Bây giờ, trong các kịch bản quy trình đơn, bạn có thể bỏ qua bước này.
Khả năng quan sát của sub-agent cũng đã tiến một bước lớn.
Cuối tháng 6, CMA vừa ra mắt event_deltas ở cấp độ hội thoại, cho phép xem trước trực tiếp đầu ra văn bản của agent chính. Tuy nhiên, các sub-agent vẫn là hộp đen; dù bị lệch hướng hay bị treo, bạn chỉ có thể biết khi hết thời gian chờ.
Lần này hạ xuống cấp độ luồng. Đăng ký luồng riêng biệt của sub-agent, nghĩ đến đâu, viết đến đó, xem được ngay lập tức.


7 webhook mới đã được thêm vào, thời kỳ polling đã kết thúc
CMA đã triển khai webhook cho agent và vòng đời triển khai vào cuối tháng 6.
Lần này đã bổ sung hai phần còn lại: 4 loại sự kiện môi trường + 3 loại sự kiện lưu trữ bộ nhớ.
Tới nay, toàn bộ vòng đời của CMA — bao gồm thiết lập môi trường, triển khai agent, trạng thái vận hành và quản lý bộ nhớ — đều có thể được kết nối với các hệ thống bên ngoài thông qua sự kiện.
Tự động kích hoạt cảnh báo khi môi trường bị tạm dừng, đồng bộ cập nhật bộ nhớ lưu trữ vào cơ sở dữ liệu riêng, tự động gắn giám sát khi tạo môi trường mới.
Từ “sản phẩm API” đến “nền tảng có thể vận hành”, đây là mảnh ghép cuối cùng.
Anthropic đang đặt cược vào độ sâu cấp hệ điều hành
Đến tháng 7 năm 2026, cuộc cạnh tranh về cơ sở hạ tầng AI agent đã bước vào giai đoạn sâu, tần suất cập nhật gần như phải tính theo ngày.
OpenAI đặt cược vào lối vào. Gom tất cả các tính năng trò chuyện, lập trình và tự chủ vào một ứng dụng siêu ChatGPT, dùng lượng người dùng lớn nhất để giữ chân các nhà phát triển.
Google đầu tư vào hạ tầng. GCP + TPU + tiêu chuẩn giao thức, xây dựng hàng rào bảo vệ ở cấp cơ sở.
Anthropic đặt cược vào độ sâu cấp hệ điều hành. Tích hợp sandbox được quản lý + kiểm soát toàn bộ agent + điều chỉnh tốc độ suy nghĩ, tập trung vào mật độ năng lực của từng agent.
Từ 20 đến 500, Anthropic đang tính toán khi nào có thể biến agent thành một thứ cơ bản như hệ điều hành.
The speed has already answered: fast.
Tài liệu tham khảo: https://x.com/ClaudeDevs/status/2080009523952263295?s=20
Bài viết này đến từ tài khoản WeChat "New Intelligence Yuan", tác giả: Apocalypse of ASI; biên tập: Moses
