Claude Code Creator Boris Cherny kêu gọi các nhà phát triển xóa 80% các prompt hệ thống

icon MarsBit
Chia sẻ
AI summary iconTóm tắt
Boris Cherny, người sáng tạo ra Claude Code, kêu gọi các nhà phát triển xóa 80% prompt hệ thống và công cụ mỗi sáu tháng. Ông nhấn mạnh các nghiên cứu ablation và việc Anthropic gần đây đã đơn giản hóa prompt hệ thống của Claude Code cho các mô hình như Opus 5 và Fable 5. Bản cập nhật chỉ giữ lại các yếu tố về an toàn, quyền và phân tích tĩnh. Cherny cũng thảo luận về “sản phẩm tồn đọng” và “giải phóng hạn chế”, nhấn mạnh nhu cầu điều chỉnh khả năng mô hình với mục đích sử dụng sản phẩm. Trong khi các hệ thống Proof of Work (PoW) đang chịu sự giám sát chặt chẽ, việc áp dụng Proof of Stake (PoS) đang gia tăng song song với những cải tiến về hiệu quả AI.

Mỗi sáu tháng, xóa file Claude.md, xóa các kỹ năng của bạn, xóa các hook của bạn.

Đây là lời khuyên từ Boris Cherny — cha đẻ của Claude Code dành cho người dùng sản phẩm.

Trong video phỏng vấn mới được phát hành vào ngày 28 tháng 7 của YC có tựa đề “Boris Cherny: We Cut 80% of Claude Code’s Prompt”, Boris nhiệt tình kêu gọi tất cả những người phát triển sản phẩm AI nên dũng cảm xóa bỏ các prompt, công cụ và mã harness trong sản phẩm mới của mình.

Opus 5

You should delete the entire system prompt and then add it back line by line to see what impact each line has.

Khái niệm đằng sau quan điểm này là nghiên cứu loại bỏ (ablation study), một khái niệm xuyên suốt cuộc phỏng vấn mới nhất của Boris Cherny, nhằm loại bỏ, thay thế hoặc tắt một mô-đun trong khi kiểm soát các điều kiện khác không đổi, để so sánh sự thay đổi về hiệu suất, độ ổn định, hiệu quả hoặc chi phí.

Trong cuộc phỏng vấn, Boris không giấu nổi sự tự hào khi tuyên bố: Thực tế, đối với Opus 5, chúng tôi thực sự khuyên mọi người nên xóa hết những thứ này, vì mô hình đã không còn cần chúng.

Mặc dù những sóng gió gần đây... người dùng cũng có thể tuyên bố, "Thực tế, đối với Claude, tôi thật sự khuyên nên xóa nó đi, vì chúng ta đã không còn cần nó nữa." (x)

Opus 5

Ngoài “xóa bỏ táo tợn”, Boris còn tiết lộ thêm nhiều suy nghĩ sâu sắc về giá trị của việc thiết kế sản phẩm, sử dụng mô hình và học lập trình trong cuộc phỏng vấn—

Quan điểm trong bài viết này được trích từ video phỏng vấn, các điểm chính cần chú ý: 1. Chiến lược cập nhật sản phẩm của Boris: Ít phán đoán hơn, tăng cường thử nghiệm 2. “Dư thừa sản phẩm”: Trong cùng một giai đoạn, năng lực mô hình luôn vượt quá ranh giới sản phẩm 3. “Giải phóng”: Để mô hình thực hiện các nhiệm vụ khó hơn, làm việc độc lập trong thời gian dài hơn 4. Người dùng Claude hàng đầu sử dụng AI như thế nào? 5. 3 lời khuyên dành cho người học lập trình

Mô hình là một sinh vật sống, nó có tính cách riêng của mình

Hôm nay, trong kho mã của Claude Code, gần như chỉ còn lại các phần về bảo mật, quyền và phân tích tĩnh.

Ngày 24 tháng 7, Anthropic đã công bố các quy tắc mới nhất về kỹ thuật ngữ cảnh của Claude 5, trong đó đối với các mô hình mới như Opus 5 và Fable 5, system prompt của Claude Code đã được rút gọn đáng kể, xóa bỏ hơn 80% các hướng dẫn ban đầu.

Có thể tham khảo bài viết của Quantum Bit: “Claude Code xóa 80% prompt, Opus 5 lại thêm trở lại”.

Về sự thay đổi này, Boris đã chia sẻ chiến lược lặp lại sản phẩm của mình trong cuộc phỏng vấn: Bạn đừng cố đoán mô hình cần những lệnh gì, vì bạn sẽ không bao giờ đoán đúng. Những gì bạn có thể làm là xóa từng dòng, kiểm thử, và tìm ra những điểm mà mô hình liên tục bị kẹt.

Bạn phải coi mô hình như một sinh vật sống, một thứ gì đó hữu cơ hơn. Hành vi của từng thế hệ mô hình đều khác nhau, tính cách cũng hơi khác biệt, bạn cần dành thời gian để hiểu nó, sau đó điều chỉnh harness dựa trên điều đó.

Opus 5

Do đó, đối với Boris, điều này mang tính chất “kinh nghiệm” nhiều hơn và cần được tiếp cận một cách khoa học: thử nghiệm mà không có định kiến, xem xét kết quả, lặp lại và cải tiến.

Trong một thế giới liên tục bị phá bỏ và xây dựng lại, Eval cũng chưa chắc có thể sử dụng ổn định. Mặc dù nó thực sự bền hơn harness và prompt, nhưng hiện nay mô hình tiến hóa quá nhanh, khiến nhiều bộ đánh giá bị đạt điểm tối đa rất nhanh. Do đó, cần quan sát xem mô hình đang gặp khó khăn ở đâu, sau đó thiết kế Eval mới.

Một cách tư duy: dư thừa, giải phóng

Trong cuộc phỏng vấn, Boris chia sẻ một khái niệm gọi là “Product Overhang”, và anh cho rằng đây là một cách suy nghĩ rất hữu ích cho công việc sản phẩm của anh.

Overhang, nghĩa là gì? Dư thừa.

Các mô hình lớn tiến hóa với tốc độ nhảy vọt không liên tục, trong khi tích hợp sản phẩm lại tiến triển theo nhịp độ tăng dần liên tục. Điều này dẫn đến khả năng của mô hình luôn vượt ra ngoài ranh giới mà các sản phẩm hiện tại có thể khai thác.

Boris đưa ra một ví dụ: Khi sonnet 3.5 vừa ra mắt vào cuối năm 2024, mô hình này đã có thể viết toàn bộ mã của một tệp tin trong một lần. Nhưng vào thời điểm đó, các sản phẩm lập trình như Copilot và phiên bản đầu tiên của Cursor vẫn đang thực hiện những việc nhỏ như hoàn thành mã.

Claude Code với quyền truy cập đầy đủ vào terminal phần nào bù đắp khoảng cách này. Đây cũng là khái niệm thứ hai mà Boris đưa ra: “Unhobbling” – gỡ bỏ hạn chế.

Opus 5

Anh ấy chia sẻ một trường hợp nội bộ của Anthropic: có người thử kết nối Opus 5 với OpenCV (thư viện thị giác máy tính mã nguồn mở lớn nhất thế giới), và phát hiện ra rằng mô hình có thể tự vẽ chân dung con người và cảnh vật động vật, trong khi trước đó họ chưa từng huấn luyện mô hình để vẽ.

Đây chính là “kích hoạt mô hình” (model elicitation), thông qua thiết kế lời nhắc, ngữ cảnh, công cụ hoặc hình thái sản phẩm mà không thay đổi trọng số mô hình, giúp mô hình thể hiện những khả năng vốn đã có nhưng trước đây chưa được kích hoạt.

Mặc dù vẫn còn một số câu hỏi ở đây: Làm thế nào để gán nguyên nhân? Liệu mô hình có đang thể hiện khả năng vốn đã có, hay nó đã học được kỹ năng mới nhờ vào thiết kế “giá đỡ”?

Tuy nhiên, có lẽ điều này không quan trọng lắm; dù sao đi nữa, Boris hoàn toàn tin tưởng rằng đây là cơ hội kinh doanh khổng lồ:

Tôi không nói rằng tất cả các công ty khởi nghiệp đều có thể nắm bắt được. Nhưng tôi biết có người đang suy nghĩ về những vấn đề này, và thực sự ở đây có cơ hội khổng lồ để khơi dậy những hành vi đáng kinh ngạc, thú vị và có giá trị thương mại từ các mô hình.

Để làm điều này, Boris đã đề xuất ba phương pháp "giải phóng" mô hình của chính ông.

Đầu tiên, giao cho mô hình những nhiệm vụ khó hơn bạn tưởng. Mô tả rõ ràng mục tiêu, ranh giới và điều kiện thoát, sau đó hãy buông tay.

Thứ hai, hãy thực hiện nhiều thí nghiệm hơn. Cho phép mô hình thực hiện những thử nghiệm vui vẻ nhưng không có mục đích thương mại rõ ràng, “tự do chơi đùa với mô hình và thực hiện những việc sáng tạo”.

Thứ ba, để mô hình tự xác minh kết quả. Hiện nay, trọng tâm đã không còn là “kỹ thuật prompt”, mà là “khi bạn giao cho Claude một nhiệm vụ rất khó, làm thế nào để nó tự xác minh công việc mình đang làm trong quá trình thực hiện?”

Boris cho rằng điểm thứ ba có thể là điều mà mọi người đang làm kém nhất hiện nay. Vì nếu mô hình không thể tự xác minh nhiệm vụ, nó sẽ không thể hoạt động độc lập trong thời gian dài.

Opus 5

Ví dụ của chính anh ấy có thể mang lại cảm hứng cho mọi người:

Boris: “Được, điều tôi muốn bạn làm là—viết lại ứng dụng Electron bằng Swift. Tôi muốn bạn chạy ứng dụng Electron trong máy ảo Mac, chụp màn hình, rồi so sánh từng pixel với phiên bản Swift, chưa hoàn thành thì đừng dừng lại.” Người dẫn chương trình: Đó là prompt của bạn sao? Boris: Đúng vậy, đó là prompt của tôi. Người dẫn chương trình: Nó đã chạy được bao lâu rồi? Boris: Vẫn đang chạy. Người dẫn chương trình: Nó bắt đầu từ khi nào? Boris: Đã chạy hơn hai tuần rồi, khoảng 14, 15 ngày… Claude còn quyết định phát trực tiếp, nó tạo một kênh Slack nội bộ và gửi ảnh chụp tiến độ mỗi vài phút.

Lời khuyên thực tế của Boris dành cho người dùng AI và doanh nhân

Ở cuối cuộc phỏng vấn, người dẫn chương trình đặt câu hỏi:

Vậy thì, Boris, làm thế nào chúng tôi có thể sử dụng Claude hiệu quả như bạn?

Opus 5

Boris cho biết, điều quan trọng nhất là đừng nghe theo những người nổi tiếng trên LinkedIn và đừng lướt Twitter.

Về việc sử dụng AI, "mọi người đều tìm kiếm những 'mẹo vặt kỳ diệu'. Nhưng chẳng có thứ đó tồn tại. Không có thứ đó."

Anh ấy khuyên mọi người nên tiếp cận mô hình theo cách chủ nghĩa kinh nghiệm, bỏ qua kinh nghiệm trước đây với các mô hình cũ và lý thuyết khoa học máy tính đã học ở trường, thay vào đó hãy quan sát trực tiếp xem mô hình bị kẹt ở đâu, sau đó điều chỉnh một cách nhắm mục tiêu.

Vì vậy, nó đã không còn là một khoa học lý thuyết nữa, mà đã trở thành một khoa học thực nghiệm. Tôi nghĩ những người đặc biệt giỏi trong việc buông bỏ các tiền đề của bản thân, từ bỏ những suy nghĩ “trước đây không được” và sẵn sàng thử lại một lần nữa — sẽ cực kỳ thành công.

Quan trọng hơn hết là duy trì một tâm thế, đó là buông bỏ sự kiểm soát đối với mô hình, đối xử với mô hình như một đồng nghiệp, không đưa ra quá nhiều hướng dẫn cụ thể, không yêu cầu quá chi tiết, và không cố gắng khiến mô hình thực hiện nhiệm vụ theo cách bạn sẽ làm. Vì “mô hình không hoạt động theo cách đó”.

Opus 5

Đối với những người đang học lập trình, Boris kêu gọi đừng chỉ học lý thuyết khoa học máy tính thuần túy, mà hãy học cách ứng dụng. Ví dụ, động lực ban đầu của chính anh ấy khi học lập trình là để gian lận trong các kỳ thi toán học.

Thông thường, điều này liên quan đến khởi nghiệp, phát triển sản phẩm, rèn luyện cảm giác thiết kế và kinh doanh của chính bạn, học cách thực hiện khoa học dữ liệu, học cách giao tiếp với người dùng... Khi bạn kết hợp chúng với khoa học máy tính và kỹ thuật, chúng mới thực sự trở nên có giá trị.

Tóm lại, “hãy làm điều bạn muốn trước, sau đó nâng cấp để làm điều người khác muốn”.

Bài viết này đến từ tài khoản chính thức WeChat “Quantum Bit” (ID: QbitAI), tác giả: Chú ý đến công nghệ tiên tiến

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.