Nền tảng CMA của Anthropic công bố giới hạn 500 kỹ năng và các cải tiến lớn cho tác nhân

icon MarsBit
Chia sẻ
AI summary iconTóm tắt
Nền tảng CMA của Anthropic đã ra mắt sáu bản cập nhật lớn, bao gồm giới hạn 500 kỹ năng mỗi phiên và năm cấp độ nỗ lực suy luận. Khả năng hiển thị thực thời việc thực thi sub-agent và 50 sự kiện ban đầu giúp tăng tốc độ khởi động. Khả năng quan sát ở cấp độ thread và bảy webhook mới cải thiện khả năng tích hợp. Những bản cập nhật crypto này nhằm tăng hiệu quả của agent và giảm chi phí token. Các bản cập nhật của KuCoin có thể phản ánh các xu hướng rộng hơn trong ngành về tối ưu hóa AI và blockchain.

Trong 45 ngày qua, Anthropic gần như không ngừng tay.

Fable 5 và Mythos 5 đồng thời ra mắt, Sonnet 5 giảm giá để cạnh tranh thị trường, Claude Code gần như được cập nhật hàng ngày.

Hôm qua Cowork vừa được cập nhật, hôm nay Anthropic lại đồng thời ra mắt sáu bản cập nhật trên nền tảng tác nhân được lưu trữ (CMA):

  • Nâng giới hạn kỹ năng từ 20 lên 500: Một phiên có thể chứa toàn bộ kho tri thức doanh nghiệp
  • Điều chỉnh tốc độ năm cấp độ suy luận: Định tuyến đơn giản tiết kiệm token, suy luận sâu tối đa
  • Tạo phiên hạt giống trong một bước: trực tiếp với 50 sự kiện ban đầu, khởi động lạnh về không
  • Sub-agent streaming thực thời xuống cấp độ luồng: Bạn có thể thấy trực tiếp mỗi sub-agent đang chạy đến đâu và nghĩ đến đâu
  • 7 loại webhook mới bao phủ toàn bộ vòng đời môi trường và lưu trữ bộ nhớ: Có thể ngừng sử dụng polling
  • Cập nhật phiên bản agent: trường này trở thành tùy chọn, loại bỏ chi phí quản lý phiên bản trong quy trình đơn lẻ

Một phiên họp có thể treo 500 kỹ năng, chạy cả một kho tri thức doanh nghiệp, Anthropic đang định lắp hệ điều hành cho agent!

Agent Platform

Agent Platform

Giới hạn kỹ năng tăng vọt lên 500, một phiên trò chuyện có thể chứa cả bộ phận kinh doanh

Kỹ năng của CMA là các gói kiến thức chứa các lệnh chuyên môn được注入 vào agent, trước đây giới hạn tối đa là 20.

Tuy nhiên, một tác nhân dịch vụ tài chính chỉ riêng việc xử lý mở tài khoản, KYC, chống rửa tiền, giải quyết khiếu nại, miễn trừ trách nhiệm tuân thủ và chuyển đổi đa ngôn ngữ đã có tới七八 cái. Cộng thêm sự khác biệt về quy định và các phiên bản A/B testing, lập tức chạm phải trần giới hạn.

Con số này hiện đã tăng trực tiếp lên 500.

500 vị trí kỹ năng này được chia sẻ bởi tất cả các agent trong một phiên, chạy trong cùng một sandbox được quản lý, các agent chia sẻ bộ nhớ và biến môi trường, được bộ điều phối điều phối thống nhất—đủ để tương ứng với một đơn vị kinh doanh hoàn chỉnh.

Thậm chí, bạn còn có thể nhét toàn bộ quy chuẩn kho mã, cấu hình đường ống CI và mục tiêu triển khai vào một phiên làm việc, để agent hiểu rõ toàn bộ quy trình từ viết mã đến khi上线.

Agent Platform

Điều chỉnh tốc độ tư duy năm cấp độ, bài đơn giản không dùng hết token

Tham số sức mạnh suy nghĩ (effort) đã có từ lâu ở cấp API, nhưng các agent trong CMA trước đây không thể thiết lập riêng biệt.

Nói cách khác, toàn bộ phiên sử dụng cùng một cấp độ mặc định; hỏi “Hôm nay là ngày mấy?” và “Kiểm toán báo cáo tài chính 500 trang” đều dùng cùng một mức độ sâu. Việc suy luận quá mức đối với các câu hỏi đơn giản chỉ làm lãng phí token.

Bây giờ mức độ suy nghĩ có thể được ghi trực tiếp vào cấu hình mô hình của từng agent, với năm cấp độ: low / medium / high / xhigh / max.

Bạn đang vận hành một hệ thống dịch vụ khách hàng đa tác nhân: phân luồng bằng low, giải đáp sản phẩm bằng medium, nâng cấp khiếu nại bằng high, tuân thủ pháp lý bằng max.

Trong cùng một phiên, các agent khác nhau có thể chạy ở các cấp độ khác nhau tùy theo độ khó của nhiệm vụ. Giữa chi phí và chất lượng, cuối cùng đã có một nút điều chỉnh liên tục.

Agent Platform

Khởi động lạnh về không, các sub-agent trong hộp đen cũng đã được mở ra

Trước khi tạo phiên CMA, cần thực hiện hai bước: gửi một vỏ rỗng bằng POST, sau đó thêm từng sự kiện khởi đầu. Trong các tình huống có lưu lượng cao, độ trễ khứ hồi tích lũy dần, khiến thời gian khởi động lạnh kéo dài.

Bây giờ thực hiện một lần duy nhất. POST /v1/sessions kèm theo initial_events, tối đa 50 sự kiện ban đầu, phiên giao dịch ngay từ khi tạo đã biết mình cần làm gì.

Trong cùng đợt cập nhật này, trường version của giao diện cập nhật agent cũng trở thành tùy chọn.

Trước đây, mỗi lần cập nhật đều phải truyền số phiên bản để kiểm soát đồng thời, nếu phiên bản không khớp sẽ trả về lỗi 409. Bây giờ, trong các kịch bản quy trình đơn, bạn có thể bỏ qua bước này.

Khả năng quan sát của sub-agent cũng đã tiến một bước lớn.

Cuối tháng 6, CMA vừa ra mắt event_deltas ở cấp độ hội thoại, cho phép xem trước trực tiếp đầu ra văn bản của agent chính. Tuy nhiên, các sub-agent vẫn là hộp đen; dù bị lệch hướng hay bị treo, bạn chỉ có thể biết khi hết thời gian chờ.

Lần này hạ xuống cấp độ luồng. Đăng ký luồng riêng biệt của sub-agent, nghĩ đến đâu, viết đến đó, xem được ngay lập tức.

Agent Platform

Agent Platform

7 webhook mới đã được thêm vào, thời kỳ polling đã kết thúc

CMA đã triển khai webhook cho agent và vòng đời triển khai vào cuối tháng 6.

Lần này đã bổ sung hai phần còn lại: 4 loại sự kiện môi trường + 3 loại sự kiện lưu trữ bộ nhớ.

Tới nay, toàn bộ vòng đời của CMA — bao gồm thiết lập môi trường, triển khai agent, trạng thái vận hành và quản lý bộ nhớ — đều có thể được kết nối với các hệ thống bên ngoài thông qua sự kiện.

Tự động kích hoạt cảnh báo khi môi trường bị tạm dừng, đồng bộ cập nhật bộ nhớ lưu trữ vào cơ sở dữ liệu riêng, tự động gắn giám sát khi tạo môi trường mới.

Từ “sản phẩm API” đến “nền tảng có thể vận hành”, đây là mảnh ghép cuối cùng.

Anthropic đang đặt cược vào độ sâu cấp hệ điều hành

Đến tháng 7 năm 2026, cuộc cạnh tranh về cơ sở hạ tầng AI agent đã bước vào giai đoạn sâu, tần suất cập nhật gần như phải tính theo ngày.

OpenAI đặt cược vào lối vào. Gom tất cả các tính năng trò chuyện, lập trình và tự chủ vào một ứng dụng siêu ChatGPT, dùng lượng người dùng lớn nhất để giữ chân các nhà phát triển.

Google đầu tư vào hạ tầng. GCP + TPU + tiêu chuẩn giao thức, xây dựng hàng rào bảo vệ ở cấp cơ sở.

Anthropic đặt cược vào độ sâu cấp hệ điều hành. Tích hợp sandbox được quản lý + kiểm soát toàn bộ agent + điều chỉnh tốc độ suy nghĩ, tập trung vào mật độ năng lực của từng agent.

Từ 20 đến 500, Anthropic đang tính toán khi nào có thể biến agent thành một thứ cơ bản như hệ điều hành.

The speed has already answered: fast.

Tài liệu tham khảo: https://x.com/ClaudeDevs/status/2080009523952263295?s=20

Bài viết này đến từ tài khoản WeChat "New Intelligence Yuan", tác giả: Apocalypse of ASI; biên tập: Moses

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.