source avatarDr.R

Chia sẻ

Hôm nay, Anthropic đã ra mắt phiên bản mới nhất Claude Fable 5.1 / Mythos 5.1 (cùng một mô hình, mức độ bảo vệ khác nhau), bản cập nhật nhỏ giữa kỳ với cải thiện hiệu năng không đáng kể, nhưng đối với chúng ta, điểm quan trọng hơn là sự gia tăng độ ổn định và giảm giá. Cập nhật chính thức như sau: 1. Khả năng agentic trong lĩnh vực khoa học được cải thiện nhiều nhất Terminal-Bench-Science tăng từ 24,7% của Fable 5 lên 52,6%, gần như gấp đôi và vượt xa Opus 5 ở mức 29,0%. 2. Mã hóa và các tác vụ kéo dài không cần giám sát Terminal-Bench 4.0 tăng từ 42,0% lên 55,8% (Mythos 5.1 đạt 60,9%), CursorBench 3.2.0 đạt 73,4%. Millennium đã sử dụng nó để xác định lỗi sụp đổ với xác suất một phần triệu mà đội ngũ chưa tìm ra trong bốn đến năm năm qua và các mô hình khác đều bỏ sót. 3. Giá giảm khoảng 25% Giá đọc bộ nhớ đệm (cache read) giảm 75%, xuống còn $0,25/1 triệu token; chi phí tổng thể cho tải trọng điển hình giảm khoảng 25%, trong các kịch bản agentic nặng có thể giảm tới 45%. Giá đầu vào $10 và đầu ra $50/1 triệu token giữ nguyên. 4. Mức nỗ lực thấp cũng đủ dùng Khi đặt ở mức Low/Medium, hiệu suất đã đạt hoặc vượt Fable 5, nhưng chi phí thấp hơn nhiều — phù hợp để hạ cấp trực tiếp trong các kịch bản nhạy cảm về chi phí. 5. Giảm đáng kể các cảnh báo sai về an toàn Số lần chặn của các bộ lọc an toàn mạng trong Claude Code trung bình giảm khoảng 60%, và hiện tại cho phép sử dụng nó để phát hiện lỗ hổng (vẫn cấm viết exploit, kiểm thử xâm nhập, quét nhị phân — những tác vụ này sẽ được chuyển cho Opus). Các câu hỏi sinh học vô hại (sinh học cơ bản, câu hỏi y tế) bị kích hoạt sai giảm 85%. 6. Giải pháp lưu trữ dữ liệu doanh nghiệp Enterprise Frontier Safeguards (EFS) mới lưu trữ dữ liệu trên đám mây của khách hàng thay vì của Anthropic, tương đương với việc không lưu trữ dữ liệu nào — sẽ được triển khai từng giai đoạn vào mùa thu này; trước đó, khách hàng đủ điều kiện có thể sử dụng ngay với mức không lưu trữ dữ liệu. 7. Hiệu suất đồng bộ hóa tốt hơn thế hệ trước Ít có xu hướng thoát khỏi môi trường kiểm thử để truy cập tài nguyên, ít sử dụng các lập luận mang tính “đây là mô phỏng/đánh giá” để biện minh cho hành vi, nỗ lực và tỷ lệ thành công trong reward hacking đều thấp hơn, đồng thời là mô hình hiện nay ổn định nhất trước các cuộc tấn công prompt injection. Hai điểm khác cần lưu ý: - Tài khoản API mới không còn được phép chỉnh sửa thủ công lịch sử suy nghĩ của Claude trong các cuộc hội thoại đa vòng (để chống lại quá trình tinh luyện), và đầu ra sẽ chứa dấu nước invisibile theo yêu cầu của EU AI Act — không ảnh hưởng đến chất lượng nội dung và không chứa bất kỳ thông tin người dùng nào.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.