Anthropic Mengurangkan 80% Promp Kod Claude, Opus 5 Menambah 72%

icon MarsBit
Kongsi
AI summary iconRingkasan
Anthropic baru-baru ini mengurangkan lebih daripada 80% prompt sistem untuk model Claude Code-nya, termasuk Opus 5 dan Fable 5. Pembangun Chen Cheng mencatat bahawa prompt Opus 5 meningkat 72% berbanding Opus 4.8. Syarikat tersebut menjelaskan bahawa penurunan berlaku terutamanya dari Opus 4.7 ke 4.8, manakala Opus 5 menambahkan batasan baharu untuk mengurus tingkah lakuannya. Perubahan ini bertujuan untuk menyederhanakan arahan dan mengurangkan konflik model. Sementara itu, Proof of Work (PoW) dan Proof of Stake (PoS) tetap menjadi mekanisme konsensus utama dalam pembangunan blok rantai.

Claude Code baru sahaja mengumumkan pengurangan besar dalam prompt, dan segera Opus 5 ditangkap sedang "memantul"!?

Dan pantulan ini, magnitudnya benar-benar tidak kecil: 72%. (tertawa)

Nombor-nombor yang kelihatan saling bertentangan ini datang dari ujian rasmi Anthropic dan seorang pengguna internet.

Dua hari yang lalu, Anthropic baru sahaja mengumumkan penghapusan lebih daripada 80% kandungan prompt sistem bagi model-model seperti Opus 5 dan Fable 5.

Selepas hasilnya, ia secara tidak sengaja ditangkap oleh pengguna internet Chen Cheng (@chenchengpro) —

Lelaki itu mengambil cuplikan dan mengira petunjuk sistem yang sebenarnya diterima oleh model yang berbeza, dan mendapati bahawa Opus 5 justru menjadi 72% lebih panjang berbanding Opus 4.8???

Opus 5

Satu dipotong 80%, satu lagi naik 72%.

Perusahaan A, petunjuk ini sebenarnya untuk menurunkan berat badan, atau sembunyi-sembunyi makan tambahan ya...

Claude Code mengalami perubahan besar pada petunjuk, pihak rasmi menghapus 80%

Mari kita bahas terlebih dahulu apa yang telah dihapus oleh Anthropic kali ini.

Menurut artikel rasmi, Claude Code awal memasukkan banyak peraturan yang jelas dan bahkan mutlak ke dalam petunjuk sistem untuk mencegah model membuat kesilapan.

Sebagai contoh, jangan tulis komen lalai, jangan tulis dokumen string berbilang baris, dan jangan buat dokumen perancangan dan analisis kecuali diminta oleh pengguna.

Dengan kata lain, di mana model cenderung gagal, manusia akan menambahkan peraturan terlebih dahulu!!

Seiring masa, petunjuk sistem di sebalik Claude Code menjadi semakin seperti buku tebal "Manual Perilaku Pekerja".

Metodologi ini memang berkesan apabila digunakan pada model awal, tetapi seiring dengan peningkatan kemampuan Claude, masalah-masalah mulai muncul…

Yang paling langsung ialah arahan dari lokasi yang berbeza mudah bertembung antara satu sama lain.

Menghadapi maklumat yang tumpang tindih dan bahkan bertentangan ini, Claude belum lagi memulakan kerja, tetapi terlebih dahulu perlu menghabiskan tenaga untuk menentukan siapa yang perlu didengar!!

Opus 5

Oleh itu, Anthropic melakukan "pembedahan besar" terhadap petunjuk Claude Code.

Salah satu perubahan yang paling intuitif berlaku pada komen dan peraturan dokumen.

Peraturan panjang sebelum ini yang tidak membenarkan komen, sama sekali tidak membenarkan dokumen string berbilang baris, kini diringkaskan menjadi satu ayat—

Tulis kod yang selari dengan gaya kod sekelilingnya, sama ada kepadatan komen, cara penamaan, dan gaya penggunaan yang lazim.

Terjemahkan untuk rakan-rakan: Lihat dahulu bagaimana projek ini ditulis sebelumnya, kemudian buat penilaian sendiri berdasarkan situasi sebenar~

Tentu, masih banyak perubahan serupa.

Hasilnya, A-company telah memadamkan lebih daripada 80% kandungan prompt sistem dalam model generasi baru seperti Opus 5 dan Fable 5...

Perlu ditekankan bahawa, berdasarkan penilaian pemrograman Anthropic, pengurangan besar-besaran ini tidak membawa penurunan prestasi yang boleh diukur, jadi anda tidak perlu terlalu risau.

(Tapi saya masih ingin bertanya... petunjuk telah dipotong hingga 80%, tetapi model tidak menjadi lebih buruk dalam melakukan tugasnya, betulkah???)

Opus 5

Seiring dengan penyusutan besar ini, peraturan rekabentuk konteks Claude Code hampir semuanya telah diperbaiki semula.

Bagi pembangun yang menggunakan Claude Code atau membangun Agent berdasarkan Claude, Anthropic juga memberikan beberapa cadangan penyesuaian yang lebih spesifik.

Saya juga telah menyusun sedikit untuk rakan-rakan saya—

Ringkas CLAUDE.md: hanya kekalikan peraturan khas projek, maklumat yang boleh ditemui oleh Claude daripada kod boleh dipadamkan.

Pisahkan arahan panjang menjadi Kemahiran: Simpan proses seperti semakan kod, ujian, dan pelancaran secara berasingan, dan muatkan semula apabila diperlukan.

Hapus arahan berulang: hanya tulis satu peraturan sekali sahaja, perkara yang telah dinyatakan dalam penerangan alat tidak perlu diulang dalam petikan sistem dan CLAUDE.md.

Contoh pengurangan panggilan alat: jelaskan maksud parameter, pilihan yang boleh dipilih, dan hasil yang dikembalikan, kurangkan contoh panggilan tetap.

Berikan rujukan yang boleh dilaksanakan secara langsung: Pembangun boleh memberikan kes ujian, kod sedia ada, prototaip HTML, atau fail projek lain kepada Claude untuk rujukan, mengurangkan keperluan untuk menggambarkan dalam teks panjang.

Secara ringkas, pendekatan baru Anthropic ini boleh diringkaskan dalam satu ayat—

Berikan Claude lebih sedikit manual staf yang terperinci, dan lebih banyak lagi alat, persekitaran, dan sempadan tugas yang direka dengan jelas!!

Pemotongan besar-besaran terhadap prompt yang hebat sekali...

Pengguna menangkap paket: Opus 5 kenapa naik lagi 72%???

Melihat di sini, pemotongan besar-besaran prompt untuk Claude Code tampaknya telah berjalan cukup berjaya.

Tetapi ada seorang pengembang di media sosial yang memperhatikan "lebih daripada 80%" yang diberikan oleh Anthropic, tiba-tiba muncul satu soalan yang sangat asas—

Adakah benar-benar dihapus sebanyak ini? (Soalan yang bagus.jpg)

Itu dia, pengguna internet Chen Cheng (@chenchengpro) secara langsung mengarahkan Claude Code CLI ke pelayan tempatan, dan mengambil semua petunjuk sistem yang sebenarnya diterima oleh model yang berbeza.

Kemudian, sekumpulan data yang agak dramatis muncul:

Opus 4.7: 15225 aksara

Opus 4.8: 4467 aksara

Opus 5: 7694 aksara

Opus 5

Ya, semasa meningkatkan dari Opus 4.7 ke Opus 4.8, prompt sistem Claude Code mengalami "pemotongan besar".

Kandungan arahan asal 15,225 aksara telah dipotong sehingga tinggal 4,467 aksara, mengurangkan secara besar-besaran.

Namun, pada Opus 5 terkini, alur cerita tiba-tiba berbalik—

Pesan sistem yang sebenarnya diterima telah meningkat dari 4,467 aksara menjadi 7,694 aksara, 72% lebih panjang berbanding Opus 4.8!!!

Jadi, penyusutan besar-besaran petunjuk Claude Code memang wujud, tetapi pengurangan besar ini berlaku terutama pada peringkat Opus 4.8.

Selepas Opus 5 dilancarkan, Anthropic kembali menambahkan banyak kandungan ke dalam petunjuk versi ringkas...

Jelajahi semula! Gali semula!

Terus gulir ke bawah mengikut pelaksanaan Claude Code, pengguna teliti sekali lagi menemui satu butir penting—

Setiap versi sebenarnya membawa dua set Prompt, dan satu fungsi akan menentukan set mana yang akan dihantar ke model berdasarkan ID model.

Sonnet, Haiku, Claude 3, dan sebahagian model Opus lama akan menggunakan Prompt lama yang lebih terperinci; model baru seperti Opus 5 dan Fable 5 akan menggunakan Prompt baru yang telah dipermudahkan secara besar-besaran.

Opus 5

Dengan kata lain, Claude Code benar-benar membuang banyak peraturan lama dari model baru tersebut.

Hanya sahaja pada Opus 5, model menunjukkan beberapa kebiasaan baru, sehingga Anthropic terpaksa menambah semula sekatan yang lebih terfokus.

Dengan kata lain, pernyataan rasmi "menghapus lebih daripada 80%" dan pengujian pembangun yang menunjukkan "peningkatan 72% pada Opus 5" boleh berlaku serentak.

Nombor sebelumnya menggambarkan peralihan keseluruhan Claude Code dari sistem petunjuk lama ke sistem baru; nombor selepas itu membandingkan Opus 5 dengan Opus 4.8 yang bersebelahan.

Walaupun telah pulih sebahagian, 7694 aksara Opus 5 masih hanya sekitar separuh daripada Opus 4.7.

Jadi, masalahnya datang lagi:

Berapa ribu aksara tambahan dalam Opus 5, apa yang Anthropic masukkan ke dalamnya?

Selepas dianalisis lebih lanjut, pengguna teliti mendapati bahawa dua kandungan eksklusif Opus 5 utama telah ditambahkan:

Menghantar kerja: Menentukan bagaimana mengawal lingkungan tugas, melaporkan kemajuan, dan menghantar hasil.

Pembaikan: Batasi model untuk mengulangi penjelasan dan memperbaiki kesalahan sebelumnya.

Jumlah dua bahagian adalah sekitar 3755 aksara, yang secara keseluruhan merangkumi perbezaan antara Opus 5 dan Opus 4.8~

Mengenai mengapa Opus 5 memulihkan kandungan ini, sebenarnya, ia berkaitan terutama dengan model yang menjadi lebih proaktif—

Menurut panduan petunjuk yang dikeluarkan oleh Anthropic, Opus 5 lebih suka melaporkan kemajuan semasa melaksanakan tugas, jawapan dan dokumen yang dihasilkan biasanya lebih panjang, dan lebih bersedia untuk memanggil Sub-Agent, memperluas lingkungan tugas, serta mengesahkan hasil secara berulang-ulang.

Dalam menghadapi tugas jangka panjang yang kompleks, kebiasaan-kebiasaan ini memang boleh berguna.

Namun, jika pengguna hanya ingin mengubah beberapa baris kod, Opus 5 masih akan memanggil pasukan Agent sementara, serta memeriksa beberapa putaran tambahan, menyebabkan penggunaan Token dan masa tunggu meningkat pula...

Oleh itu, petunjuk baru telah menambahkan keperluan yang lebih tepat: kapan sesuai untuk memanggil Sub-Agent, seberapa kerap perlu melaporkan kemajuan, sampai ke mana lingkup tugas harus dihentikan, dan bagaimana mengawal panjang output akhir.

Di sini, data sebelum ini yang kelihatan bertentangan menjadi masuk akal.

Yang dikeluarkan oleh Claude Code kebanyakan adalah butiran operasi rumit yang ditinggalkan untuk model lama, manakala 72% yang dipulihkan oleh Opus 5 terutamanya digunakan untuk mengawal tingkah laku aktif model baharu selepas ia menjadi lebih kuat.

Semakin mampu model bekerja sendiri, semakin kurang manusia perlu mengajarinya langkah demi langkah. Namun, semakin model menjadi berpendirian sendiri, kita masih perlu menetapkan garis batas sejak awal tentang perkara apa yang boleh dilakukan secara aktif dan di mana harus berhenti.

Dari pandangan ini, petunjuk Claude Code memang menjadi lebih ringkas, hanya sahaja Opus 5 bertambah berat di tempat lain.

Memanglah, AI pun tidak dapat melarikan diri dari hukum ini: masalah lama berkurang, tetapi masalah baru akan tumbuh tepat di tempat lain. (doge)

Pautan rujukan:

[1]https://x.com/chenchengpro/status/2081339012632215684

[2]https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models

Artikel ini berasal daripada akaun微信公众号 "Quantum Bit", penulis: Membincangkan teknologi terkini

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.