Anthropic cắt 80% các lời nhắc Claude Code, Opus 5 tăng 72%

icon MarsBit
Chia sẻ
AI summary iconTóm tắt
Anthropic gần đây đã loại bỏ hơn 80% các prompt hệ thống cho các mô hình Claude Code, bao gồm Opus 5 và Fable 5. Nhà phát triển Chen Cheng ghi nhận rằng các prompt của Opus 5 tăng 72% so với Opus 4.8. Công ty giải thích rằng sự giảm sút chủ yếu xảy ra từ Opus 4.7 đến 4.8, trong khi Opus 5 đã thêm các ràng buộc mới để quản lý hành vi của nó. Những thay đổi này nhằm đơn giản hóa hướng dẫn và giảm xung đột giữa các mô hình. Đồng thời, Proof of Work (PoW) và Proof of Stake (PoS) vẫn là các cơ chế đồng thuận chính trong phát triển blockchain.

Claude Code vừa thông báo đã cắt giảm đáng kể các lệnh nhắc, ngay sau đó Opus 5 đã bị bắt quả tang có "phản kích"!?

Và đợt phục hồi này, mức độ thật sự không nhỏ: 72%. (Cười)

Những con số dường như mâu thuẫn nhau này đến từ thử nghiệm chính thức của Anthropic và một người dùng mạng.

Hai ngày trước, Anthropic vừa thông báo xóa hơn 80% nội dung lời nhắc hệ thống của các mô hình như Opus 5 và Fable 5.

Ngay sau đó, cư dân mạng Trần Thành (@chenchengpro) đã vô tình “bắt gói tin” —

Anh ấy đã trích xuất và thống kê các lời nhắc hệ thống thực sự mà các mô hình nhận được, và phát hiện rằng Opus 5 lại dài hơn 72% so với Opus 4.8???

Opus 5

Một cái giảm 80%, một cái lại tăng 72%.

Công ty A, lời nhắc này rốt cuộc là đang giảm cân, hay đang lén ăn thêm khi mọi người không biết nhỉ...

Claude Code cập nhật hoàn toàn hướng dẫn, chính thức xóa 80%

Hãy cùng tìm hiểu xem Anthropic lần này đã xóa gì.

Theo bài viết chính thức, để ngăn mô hình mắc lỗi, Claude Code thời kỳ đầu đã đưa vào các hướng dẫn hệ thống rất nhiều quy tắc rõ ràng và thậm chí là tuyệt đối.

Ví dụ: đừng viết chú thích mặc định, đừng viết nhiều đoạn tài liệu mô tả, trừ khi người dùng yêu cầu, đừng tạo tài liệu kế hoạch và phân tích.

Nói cách khác, ở những nơi mô hình dễ mắc lỗi, con người sẽ đưa ra một quy định bổ sung ngay từ đầu!!

Lâu dần, các hướng dẫn hệ thống đằng sau Claude Code trở nên giống như một cuốn sổ tay hành vi nhân viên dày cộm.

Phương pháp này chắc chắn có hiệu quả với các mô hình sớm, nhưng khi khả năng của Claude được cải thiện, các vấn đề dần xuất hiện...

Đơn giản nhất là các lệnh từ các vị trí khác nhau dễ dàng xung đột với nhau.

Trước những thông tin chồng chéo甚至 mâu thuẫn này, Claude chưa bắt tay vào làm đã phải tốn công sức để phán đoán nên nghe theo ai!!

Opus 5

Vì vậy, Anthropic đã tiến hành một “ca phẫu thuật lớn” đối với các hướng dẫn của Claude Code.

Một trong những thay đổi trực quan nhất xảy ra ở các quy tắc ghi chú và tài liệu.

Dãy dài các quy định trước đây không được ghi chú, tuyệt đối không viết chuỗi tài liệu nhiều đoạn nay đã được rút gọn thành một câu —

Viết mã phù hợp với phong cách mã xung quanh, đảm bảo nhất quán về mật độ chú thích, cách đặt tên và cách viết thông dụng.

Dịch cho các bạn thân mến: Trước tiên hãy xem dự án này ban đầu được viết như thế nào, sau đó tự đánh giá dựa trên thực tế nhé~

Chắc chắn, còn rất nhiều thay đổi tương tự.

Cuối cùng, công ty A đã xóa hơn 80% nội dung hệ thống trong các mô hình thế hệ mới như Opus 5 và Fable 5...

Đáng chú ý là, theo đánh giá lập trình của Anthropic, việc xóa bỏ quy mô lớn này không gây ra sự suy giảm hiệu suất có thể đo lường được, vì vậy mọi người cũng không cần quá lo lắng.

(Nhưng tôi vẫn muốn hỏi một câu… đã cắt bỏ tới 80% prompt, vậy mà mô hình làm việc chẳng hề kém đi chút nào, thật sao???

Opus 5

Đi kèm với đợt "giảm cân" khổng lồ này, các quy tắc kỹ thuật ngữ cảnh của Claude Code đã gần như được sửa chữa lại hoàn toàn.

Đối với các nhà phát triển sử dụng Claude Code hoặc phát triển Agent dựa trên Claude, Anthropic cũng đưa ra một số đề xuất điều chỉnh cụ thể hơn.

Tôi cũng đã giúp các bạn tổng hợp sơ qua một chút—

Tối giản CLAUDE.md: chỉ giữ lại các quy tắc đặc biệt của dự án, có thể xóa đi những thông tin mà Claude có thể phát hiện từ mã nguồn.

Chia lệnh dài thành các kỹ năng: Lưu riêng các quy trình như xem xét mã, kiểm thử và phát hành, sau đó tải lại khi cần.

Xóa các lệnh lặp lại: chỉ viết một lần cho mỗi quy tắc, những nội dung đã được nêu trong phần hướng dẫn công cụ thì không cần lặp lại trong lời nhắc hệ thống và CLAUDE.md.

Giảm ví dụ gọi công cụ: làm rõ ý nghĩa tham số, các tùy chọn có thể chọn và kết quả trả về, giảm các ví dụ gọi cố định.

Cung cấp trực tiếp tài liệu tham khảo có thể thực thi: Các nhà phát triển có thể giao các trường hợp kiểm thử, mã hiện có, bản mẫu HTML hoặc các tệp dự án khác cho Claude tham khảo, giảm thiểu việc mô tả bằng văn bản dài dòng.

Tóm lại, ý tưởng mới của Anthropic có thể tóm gọn trong một câu —

Đừng gửi cho Claude một cuốn hướng dẫn nhân viên chi tiết đến từng chi tiết, hãy thiết kế rõ ràng các công cụ, môi trường và ranh giới nhiệm vụ!

Một cuộc sa thải lớn lao các prompt thật sự……

Người dùng bắt gói tin: Opus 5 sao lại tăng thêm 72%???"

Đến đây, cuộc cắt giảm lớn các prompt trong Claude Code dường như đã thành công khá tốt.

Nhưng có một nhà phát triển trên mạng để ý đến con số "hơn 80%" do Anthropic đưa ra, và đột nhiên nảy ra một câu hỏi rất đơn giản—

Đã xóa nhiều như vậy thật sao? (Câu hỏi hay đấy.jpg)

Đúng vậy, người dùng mạng Chen Cheng (@chenchengpro) đã trực tiếp chỉ định Claude Code CLI đến máy chủ cục bộ và thu thập toàn bộ các lời nhắc hệ thống mà các mô hình khác nhau thực sự nhận được.

Sau đó, một bộ dữ liệu khá kịch tính đã xuất hiện:

Opus 4.7: 15225 ký tự

Opus 4.8: 4467 ký tự

Opus 5: 7694 ký tự

Opus 5

Đúng vậy, khi nâng cấp từ Opus 4.7 lên Opus 4.8, hệ thống prompt của Claude Code đã trải qua một cuộc "cắt bỏ lớn".

Nội dung hướng dẫn ban đầu 15.225 ký tự đã bị giảm xuống còn 4.467 ký tự, rút gọn đáng kể.

Tuy nhiên, đến Opus 5 mới nhất, cốt truyện đột ngột đảo ngược—

Câu lệnh hệ thống thực sự nhận được đã tăng từ 4.467 ký tự lên 7.694 ký tự, dài hơn khoảng 72% so với Opus 4.8!!!

Vì vậy, việc tinh giản đáng kể các hướng dẫn của Claude Code thực sự tồn tại, nhưng cuộc xóa bỏ quy mô lớn này chủ yếu diễn ra ở giai đoạn Opus 4.8.

Sau khi Opus 5 được phát hành, Anthropic lại bổ sung lại nhiều nội dung vào phiên bản lời nhắc rút gọn...

Khám phá lại! Khai thác lại!

Tiếp tục cuộn xuống theo cách thực hiện của Claude Code, các cư dân mạng tinh ý lại phát hiện ra một chi tiết quan trọng—

Mỗi phiên bản thực chất đồng thời chứa hai bộ Prompt, và một hàm sẽ quyết định gửi bộ nào cuối cùng đến mô hình dựa trên ID mô hình.

Các mô hình Sonnet, Haiku, Claude 3 và một số phiên bản cũ của Opus sẽ sử dụng prompt cũ chi tiết hơn; các mô hình mới như Opus 5, Fable 5 sẽ sử dụng prompt mới đã được tinh giản đáng kể.

Opus 5

Nói cách khác, Claude Code đã loại bỏ rất nhiều quy tắc cũ khỏi mô hình mới.

Chỉ đến Opus 5, mô hình lại xuất hiện một số thói quen hành vi mới, Anthropic buộc phải bổ sung thêm các ràng buộc mang tính nhắm mục tiêu cao hơn.

Nói như vậy, thì việc chính thức "xóa hơn 80%" và kết quả do nhà phát triển phát hiện ra là "Opus 5 tăng 72%" thực ra cũng có thể cùng tồn tại.

Số đầu tiên mô tả sự thay đổi tổng thể của Claude Code khi chuyển từ hệ thống nhắc nhở cũ sang hệ thống mới; số thứ hai so sánh Opus 5 với Opus 4.8 ngay trước đó.

Mặc dù đã phục hồi một phần, 7694 ký tự của Opus 5 vẫn chỉ bằng khoảng một nửa của Opus 4.7.

Vậy vấn đề lại xuất hiện:

Opus 5 có thêm vài nghìn ký tự, Anthropic đã viết gì vào đó?

Sau khi phân tích kỹ hơn, các cư dân mạng tinh ý phát hiện rằng đã bổ sung chủ yếu hai nội dung độc quyền của Opus 5:

Giao việc: Quy định cách kiểm soát phạm vi công việc, báo cáo tiến độ và giao kết quả.

Sửa đổi: Hạn chế mô hình lặp lại việc giải thích và sửa chữa các lỗi trước đó của nó.

Hai phần cộng lại khoảng 3755 ký tự, cơ bản bao quát sự khác biệt giữa Opus 5 và Opus 4.8~

Về việc Opus 5 tại sao lại bổ sung lại những nội dung này, thực ra chủ yếu liên quan đến việc mô hình trở nên chủ động hơn—

Theo hướng dẫn của Anthropic, Opus 5 thích báo cáo tiến độ khi thực hiện nhiệm vụ, các câu trả lời và tài liệu được tạo ra thường dài hơn và sẵn sàng gọi các Sub-Agent, mở rộng phạm vi nhiệm vụ và xác minh kết quả lặp đi lặp lại.

Khi đối mặt với các nhiệm vụ dài và phức tạp, những thói quen này thực sự phát huy tác dụng.

Nhưng nếu người dùng chỉ muốn sửa vài dòng mã, Opus 5 vẫn sẽ khởi động một đội con Agent, đồng thời kiểm tra thêm vài vòng nữa, khiến lượng Token tiêu thụ và thời gian chờ cũng tăng theo…

Do đó, hướng dẫn mới đã bổ sung các yêu cầu cụ thể hơn: khi nào nên gọi sub-Agent, tần suất báo cáo tiến độ cần bao nhiêu, nên dừng ở phạm vi nào của nhiệm vụ, và làm thế nào để kiểm soát độ dài đầu ra cuối cùng.

Tới đây, bộ dữ liệu dường như mâu thuẫn trước đó đã trở nên hợp lý.

Claude Code lần này xóa bỏ chủ yếu là các quy định hành vi rườm rà dành cho mô hình cũ, trong khi 72% phần được thêm vào ở Opus 5 chủ yếu dùng để kiểm soát hành vi chủ động của mô hình mới sau khi được tăng cường.

Mô hình càng tự chủ trong công việc, con người càng ít cần phải hướng dẫn từng bước, nhưng khi mô hình ngày càng có tính tự chủ, vẫn cần xác định rõ ràng từ trước những việc nào có thể tự thực hiện và nên dừng lại ở bước nào.

Nhìn như vậy, các prompt của Claude Code thực sự đã gọn hơn, chỉ là Opus 5 đã chuyển chỗ để mọc mỡ.

Đúng vậy, ngay cả AI cũng không thể thoát khỏi quy luật này: bệnh cũ giảm đi, bệnh mới lại mọc chính xác ở nơi khác. (doge)

Liên kết tham khảo:

[1]https://x.com/chenchengpro/status/2081339012632215684

[2]https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models

Bài viết này đến từ tài khoản công chúng WeChat "Quantum Bit", tác giả: Quan tâm đến công nghệ tiên tiến

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.