Claude Code, yeni bir uyarı açıkladı, hemen ardından Opus 5 bir 'geri tepme' ile yakalandı!?!
Ve bu geri tepme gerçekten de küçük değil: %72. (Gülümsedi)
Bu birbirine çelişen sayılar, Anthropic'in resmi kaynağından ve bir kullanıcı tarafından yapılan gerçek ölçümlerden gelmektedir.
İki gün önce Anthropic, Opus 5, Fable 5 gibi modellerin sistem uyarı metinlerinin %80'inden fazlasını birden kaldırarak duyuru yaptı.
Sonuçların hemen ardından, internet kullanıcıları Chen Cheng (@chenchengpro) tarafından bir paket yakalandı—
Küçük erkek, farklı modellerin gerçekten aldığı sistem talimatlarını alıp saydı ve Opus 5'in Opus 4.8'e göre %72 uzadığını gördü???

Biri %80 sildi, diğeri %72 arttı.
A şirketi, bu talimatlar gerçekten zayıflamak mı, yoksa arkadan gizlice yemek mi yiyorsunuz...
Claude Code için talimatlar tamamen değiştirildi, resmi olarak %80 silindi
Öncelikle Anthropic'in bu sefer tam olarak neyi sildiğini açıklayalım.
Resmi makaleye göre, Claude Code'un erken dönemlerinde modelin hatalar yapmasını önlemek için sistem uyarı metnine çok sayıda açık ve kesin kural eklenmişti.
Örneğin, varsayılan olarak yorum yazmayın, çoklu paragraf belge dizileri oluşturmayın, kullanıcı talep etmedikçe plan ve analiz belgeleri oluşturmayın.
Yani model nerede hata yapma eğilimindeyse, insanlar önceden bir kural ekliyor!!
Zamanla, Claude Code'in arkasındaki sistem talimatları, giderek kalın bir “Çalışan Davranış Kılavuzu” haline gelmeye başladı.
Bu yöntem, erken modellerde elbette işe yaradı, ancak Claude'in yetenekleri arttıkça sorunlar da yavaş yavaş ortaya çıktı...
En doğrusu, farklı konumlardan gelen emirlerin kolayca birbiriyle çatışmasıdır.
Bu çakışan ve hatta çelişkili bilgilerle karşılaşıldığında, Claude işe başlamadan önce kimin sözünü dinlemesi gerektiğini belirlemek için güç harcamak zorunda!!

Bu nedenle Anthropic, Claude Code'un ipuçlarını büyük bir operasyonla değiştirdi.
Bir diğer oldukça açık değişim, yorumlar ve belge kurallarında gerçekleşti.
Artık önceki uzun dizi varsayılan yorum yazma, kesinlikle çoklu satırlı belge dizisi yazma gibi kurallar bir cümleyle sadeleştirildi—
Çevre kod stiline uygun kod yazın, yorum yoğunluğuna, adlandırma biçimine ve yaygın kullanım kalıplarına uygun olarak.
Arkadaşlar için çeviri: Önce bu projenin orijinal yazımını inceleyin, ardından gerçek durumu göz önünde bulundurarak kendi kararınızı verin~
Elbette, benzer değişiklikler daha birçok tane var.
Sonuç olarak, A şirketi Opus 5, Fable 5 gibi yeni nesil modellerdeki %80'den fazla sistem talimatını sildi...
Anthropic'in programlama değerlendirmesine göre, bu büyük ölçekli azaltmanın ölçülebilir bir performans düşüşüne neden olmadığı belirtilmiştir, bu nedenle endişelenmenize gerek yok.
(Ama yine de sormak istiyorum… İpuçları sekizte birine indirildi, modelin çalışması neden hiç kötüleşmedi, gerçekten mi???)

Bu büyük ölçekli sadeleştirmeyle birlikte, Claude Code'un bağlam mühendisliği kuralları neredeyse tamamen yeniden inşa edildi.
Claude Code kullanıyor veya Claude tabanlı bir agent geliştiriyor olan geliştiriciler için Anthropic, birkaç daha spesifik ayar önerisi de sundu.
Dostlarım için hafifçe bir düzenlemeyi de yaptım—
CLAUDE.md'yi sadeleştirin: Projenin özel kurallarını yalnızca koruyun, Claude koddan çıkarabilecek bilgileri silin.
Uzun komutları şu becerilere ayırın: Kod incelemesi, test ve yayın süreçlerini ayrı ayrı kaydedin, gerektiğinde yükleyin.
Tekrarlayan talimatları kaldırın: Bir kural yalnızca bir kez yazılmalıdır; araç açıklamasında zaten belirtilen içerik, sistem ipucunda ve CLAUDE.md'de tekrarlanmamalıdır.
Araç çağrısı örneklerini azaltın: Parametrelerin anlamlarını, seçeneklerini ve dönüş sonuçlarını açıklayın, sabit çağrı örneklerini azaltın.
Doğrudan yürütülebilir referans sağlayın: Geliştiriciler, test senaryolarını, mevcut kodu, HTML prototipini veya diğer proje dosyalarını Claude'a referans olarak verebilir, uzun metin açıklamalarını azaltmak için.
Özetle, Anthropic'ın bu yeni yaklaşımı şu şekilde özetlenebilir—
Claude'ye ayrıntılı bir çalışan el kitabı vermek yerine, araçları, ortamı ve görev sınırlarını net bir şekilde tasarlayın!!
Harika bir dizi uyarı metni tasfiyesiydi...
Kullanıcı biri paket yakaladı: Opus 5 neden yine %72 arttı???
Buraya kadar geldiğinde, Claude Code'un bu talimat büyük kesimi oldukça başarılı görünüyor.
Ancak bir geliştirici kullanıcı, Anthropic'in sunduğu "%80'den fazla" ifadesine dikkat ederek çok basit bir soru sordu—
Bu kadarını gerçekten sildiniz mi? (Harika bir soru.jpg)
İşte tam da bu, internet kullanıcıları Chen Cheng (@chenchengpro), Claude Code CLI'yi yerel sunucuya yönlendirdi ve farklı modellerin gerçekten aldığı sistem uyarılarını tamamen çıkardı.
Ardından, oldukça dramatik bir veri kümesi ortaya çıktı:
Opus 4.7: 15225 karakter
Opus 4.8: 4467 karakter
Opus 5: 7694 karakter

Evet, Opus 4.7'den Opus 4.8'e yükseltildiğinde, Claude Code'un sistem talimatları büyük bir kesim yaşadı.
Orijinal 15.225 karakterlik uyarı içeriği, 4.467 karaktere kadar azaltıldı ve doğrudan büyük bir kısmını kaybetti.
Ancak en son Opus 5'te hikâye aniden tersine döndü—
Sistem talimatlarının gerçek uzunluğu 4.467 karakterden 7.694 karaktere yükseldi, bu da Opus 4.8'e göre yaklaşık %72 daha uzun!
Yani, Claude Code'in ipuçlarında büyük bir sadeleştirme gerçekten var, ancak bu büyük ölçekli silme işlemi çoğunlukla Opus 4.8 aşamasında gerçekleşti.
Opus 5 yayınlandıktan sonra Anthropic, basitleştirilmiş talimatlara birçok içerik ekledi...
Tekrar keşfedin! Tekrar kazın!
Claude Code uygulamasının devamında aşağıya doğru kaydırın, dikkatli kullanıcılar bir başka kritik *Ayrıntı* daha keşfetti—
Her sürümde aslında aynı anda iki set Prompt bulunur ve bir fonksiyon, model ID'ye göre nihai olarak modele hangi setin gönderileceğine karar verir.
Sonnet, Haiku, Claude 3 ve bazı eski Opus modelleri daha detaylı eski Prompt'u kullanacaktır; Opus 5, Fable 5 gibi yeni modeller ise büyük ölçüde sadeleştirilmiş yeni Prompt'u kullanacaktır.

Başka bir deyişle, Claude Code gerçekten yeni model için birçok eski kuralı kaldırdı.
Sadece Opus 5'e gelindiğinde model yeni davranış alışkanlıkları sergiledi ve Anthropic, daha hedefe yönelik kısıtlamalar eklemek zorunda kaldı.
Bu durumda, resmi olarak " %80'den fazlası silindi" ve geliştiricilerin ölçtüğü "Opus 5'te %72 artış" aynı anda geçerli olabilir.
İlk sayı, Claude Code'un eski uyarı sisteminden yeni sisteme geçişini açıklar; ikinci sayı, Opus 5 ile hemen öncesindeki Opus 4.8 arasındaki karşılaştırmayı gösterir.
Kısmen geri alınmasına rağmen, Opus 5'in 7694 karakteri, Opus 4.7'in yaklaşık yarısıdır.
O zaman soru tekrar ortaya çıkıyor:
Opus 5'in binlerce fazla karakteri, Anthropic bunun içine ne yazdı?
Daha ayrıntılı incelendikten sonra dikkatli kullanıcılar, bunun içinde özellikle iki Opus 5 özel içeriğinin eklendiğini fark etti:
Çalışma teslimi: Görev kapsamını nasıl kontrol edeceğiniz, ilerlemeyi nasıl raporlayacağınız ve sonuçları nasıl teslim edeceğiniz belirlenir.
Düzeltmeler: Modelin önceki hatalarını tekrar tekrar açıklamamasını ve düzeltmemesini sınırlayın.
İki bölüm toplamda yaklaşık 3755 karakterdir ve Opus 5 ile Opus 4.8 arasındaki farkı temel olarak kapsar~
Opus 5'in neden bu içerikleri tekrar eklediği konusunda, temel neden modelin daha aktif hale gelmesidir—
Anthropic tarafından yayınlanan yönergeler doğrultusunda, Opus 5, görevleri yürütürken ilerlemeyi rapor etmeyi tercih eder, ürettiği yanıtlar ve belgeler genellikle daha uzundur ve alt Agent'ları çağırma, görev kapsamını genişletme ve sonuçları tekrar tekrar doğrulama konusunda daha isteklidir.
Karmaşık uzun vadeli görevlerle karşılaşıldığında, bu alışkanlıklar gerçekten işe yarar.
Ancak kullanıcı yalnızca birkaç satır kodu değiştirmek istiyorsa, Opus 5 hâlâ bir alt Ajan ekibi başlatır ve birkaç tur daha kontrol eder; bu da Token tüketimini ve bekleme süresini de artırır...
Bu nedenle, yeni talimatlar, alt Agent'in ne zaman çağrılması gerektiği, ilerleme raporlamasının ne sıklıkla yapılması gerektiği, görevin hangi kapsamda durdurulması gerektiği ve nihai çıktı uzunluğunun nasıl kontrol edileceği gibi daha spesifik gereksinimler ekledi.
Buraya kadar, önceki gibi görünürde çelişkili veriler açıklandı.
Claude Code, bu sefer eski model için bırakılan karmaşık işlem detaylarını kaldırdı, ancak Opus 5'in geri kazandığı %72'si, yeni modelin güçlendikten sonraki aktif davranışlarını sınırlamak için kullanıldı.
Model ne kadar kendi başına iş yapabiliyorsa, insanlar ona adım adım öğretme ihtiyacı o kadar azalır; ancak model giderek daha fazla kendi kararını almaya başladıkça, hangi işleri önceden yapabileceği ve nerede durması gerektiği hâlâ önceden belirlenmelidir.
Buna göre Claude Code'un ipuçları gerçekten zayıflamış, sadece Opus 5 başka bir yerde yağlanmıştır.
Elbette, AI bile bu kuraldan kaçamıyor: Eski sorunlar azaldıkça, yeni sorunlar tam olarak başka bir yerde ortaya çıkıyor. (doge)
Referans bağlantısı:
[1]https://x.com/chenchengpro/status/2081339012632215684
[2]https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models
Bu yazı, WeChat hesabından "Quantum Bit" tarafından yazılmıştır, yazar: Önde gelen teknolojilere takip edin
