Anthropic vừa trang bị cho trợ lý AI của mình một cặp tay. Claude hiện có thể điều khiển trực tiếp các ứng dụng macOS, thực hiện các thao tác nhấp chuột, nhập phím và chụp màn hình trên các ứng dụng máy tính để bàn, tất cả đều chạy êm ái ở nền sau để người dùng có thể tiếp tục công việc của mình.
Tính năng này, có sẵn qua ứng dụng Claude Desktop dành cho người đăng ký Pro và Max, là một trong những bước tiến cụ thể nhất cho đến nay hướng tới các tác nhân AI không chỉ nói về việc thực hiện công việc mà còn thực sự làm nó.
Nó hoạt động như thế nào
Tính năng mới này chạy trên macOS 15 (Sequoia) trở lên, mặc định ở chế độ nền. Thay vì chiếm dụng chuột và bàn phím của bạn, Claude hoạt động trong các cửa sổ riêng biệt trong khi bạn tiếp tục sử dụng máy tính bình thường.
Khi các trình kết nối API truyền thống không khả dụng cho một ứng dụng nhất định, Claude sẽ chuyển sang sử dụng chụp màn hình và mô phỏng đầu vào để hoàn thành nhiệm vụ. Nó có thể đọc những gì hiển thị trên màn hình, xác định vị trí cần nhấp và nhập phản hồi vào các trường, về cơ bản là bắt chước cách con người tương tác với phần mềm không được thiết kế để tích hợp AI.
Hệ thống hoạt động trong hai bối cảnh: Claude Cowork, nhắm vào các tác vụ năng suất chung, và Claude Code, tập trung vào quy trình phát triển. Cả hai đều sử dụng cùng kiến trúc điều khiển máy tính nền tảng, nhưng được tối ưu hóa cho các trường hợp sử dụng khác nhau.
Cũng có tính năng Dispatch di động cho phép người dùng gán nhiệm vụ từ xa. Bắt đầu một công việc từ điện thoại của bạn, và Claude sẽ xử lý nó trên Mac của bạn.
Quyền và các biện pháp bảo vệ an toàn
Hệ thống yêu cầu sự cho phép rõ ràng từ người dùng trước khi Claude thực hiện bất kỳ hành động nào trong nhiệm vụ đầu tiên của mỗi phiên. Các thông báo quyền riêng tư sẽ xuất hiện trước các thao tác nhạy cảm, và các quyền ở cấp ứng dụng giúp người dùng kiểm soát chi tiết những gì Claude có thể và không thể truy cập.
Lần ra mắt đầu tiên chỉ dành cho các gói cá nhân trả phí. Các cấp đăng ký Nhóm và Doanh nghiệp chưa có quyền truy cập.
Một điểm cần lưu ý trung thực mà Anthropic tự công nhận: Claude chậm hơn con người khi thực hiện các tác vụ máy tính để bàn phức tạp. AI này tiếp cận từng tương tác một cách có phương pháp và cẩn trọng, đọc màn hình, lên kế hoạch hành động, sau đó thực hiện từng bước một.
Từ thí nghiệm beta đến sản phẩm chính thức
Việc ra mắt này không xảy ra một cách ngẫu nhiên. Anthropic lần đầu tiên giới thiệu các tính năng kiểm soát máy tính ở dạng beta vào tháng 10 năm 2024 như một phần của Computer Use API, đi kèm với Claude 3.5 Sonnet. Phiên bản đó chủ yếu là một minh chứng khái niệm, nhắm vào các nhà phát triển muốn thử nghiệm các quy trình agentic.
Điều này có nghĩa gì đối với cuộc đua AI agent
Các hạn chế hiện tại là có thật. Tốc độ thực thi chậm hơn con người có nghĩa là nó không thể thay thế ngay lập tức bất kỳ quy trình làm việc nào. Nó hữu ích hơn cho các tác vụ lặp đi lặp lại, khối lượng cao hơn là những việc yêu cầu phản hồi thời gian thực. Thiết kế chế độ nền cũng có nghĩa là Claude không thể tương tác với bất cứ điều gì bạn đang làm việc trực tiếp — nó bị giới hạn trong các cửa sổ riêng của mình.
Hiện tại, tính năng này vẫn chỉ dành riêng cho các thuê bao cá nhân trả phí trên macOS 15 trở lên, và chưa có lịch trình công bố cho phiên bản Team hoặc Enterprise.
