İçeriğe atla
heworxBLOG
Yapay zekâ yapay zeka anthropic openai sony universal music group suno
Büyük bir yapay zekâ modelinin çevresinde prompt blokları, araç çağrıları, düşünme seviyeleri ve birbirine bağlı yazılım agentlarını gösteren modern editöryal teknoloji illüstrasyonu.

Blog / Yapay zekâ / Teknoloji / Yazılım

Anthropic, Claude Opus 5.5 için yeni prompt yazma rehberini yayınladı

Claude Opus 5.5 ile birlikte prompt mühendisliğinde bazı eski alışkanlıklar artık gereksiz hale geliyor. Anthropic’in yeni rehberi düşünme seviyesinden uzun agent görevlerine, prompt injection savunmasından kullanıcıya ilerleme bilgisi vermeye kadar önemli değişiklikler içeriyor.

Hakan E. · 6 dk okuma
XFacebookWhatsAppLinkedIn

Yapay zekâ modelleri geliştikçe iyi prompt yazmanın kuralları da değişiyor. Birkaç yıl önce modele adım adım düşünmesini söylemek, uzun talimatlar vermek ve her ihtimali prompt içinde tarif etmek neredeyse standart uygulamaydı. Anthropic’in Claude Opus 5.5 için yayınladığı yeni rehber ise bu yaklaşımın giderek eskidiğini gösteriyor.

Claude Opus 5.5 daha fazla işi kendi içinde planlayabiliyor, uzun görevleri daha iyi sürdürebiliyor ve ne kadar düşünmesi gerektiğini büyük ölçüde kendi ayarlayabiliyor. Bunun sonucu olarak iyi bir prompt artık modele nasıl düşüneceğini anlatmaktan çok neyi başarması gerektiğini doğru biçimde tarif etmeye odaklanıyor.

Artık düşünmeyi kapatamıyorsunuz

Opus 5.5 ile gelen en önemli değişikliklerden biri düşünme sisteminin sürekli aktif olması.

Claude Opus 5 modelinde belirli effort seviyelerinde düşünme tamamen kapatılabiliyordu. Opus 5.5 bunu desteklemiyor. Model her istekte bir miktar düşünme yapıyor ve geliştiricinin kontrol ettiği temel parametre artık effort seviyesi oluyor.

Anthropic başlangıç noktası olarak medium seviyesini öneriyor.

Şirketin kendi testlerine göre Opus 5.5 medium seviyesinde bazı kodlama ve bilgi çalışması görevlerinde Opus 5’in high seviyesini yakalayabiliyor veya geçebiliyor. Daha basit işlerde ise low seviyesi çok daha düşük maliyet ve gecikmeyle yeterli sonuç verebiliyor.

Bu aslında önemli bir prompt mühendisliği değişikliği.

Modele sürekli dikkatlice düşün, önce analiz et, adım adım ilerle gibi cümleler yazmak yerine ne kadar hesaplama yapılacağını API seviyesindeki effort ayarıyla belirlemek daha doğru hale geliyor.

Her işte maksimum düşünme iyi fikir değil

Anthropic özellikle xhigh ve max seviyelerinin varsayılan olarak kullanılmamasını öneriyor.

Bunun nedeni basit.

Opus 5.5 yüksek effort seviyelerinde önceki modele göre daha fazla düşünme yapabiliyor. Bu da daha fazla token, daha yüksek maliyet ve daha uzun yanıt süresi anlamına geliyor.

Anthropic’in önerisi önce medium ile başlamak ve yalnızca gerçekten kalite artışı ölçülebilen görevlerde xhigh veya max seviyesine çıkmak.

Başka bir deyişle en pahalı ayarı seçmek otomatik olarak en iyi sistem tasarımı anlamına gelmiyor.

Eski promptlardaki düşün talimatlarını kaldırın

Rehberde dikkat çeken tavsiyelerden biri de sohbet uygulamalarındaki system promptlarıyla ilgili.

Anthropic, Claude’a cevap vermeden önce dikkatlice düşünmesini söyleyen talimatların Opus 5.5 için kaldırılmasını öneriyor.

Model zaten ne kadar düşünmesi gerektiğine kendisi karar veriyor.

Şirketin testlerinde bu tür bir talimat kaldırıldığında cevapların daha hızlı başlamaya başladığı ve gözle görülür bir kalite kaybı oluşmadığı belirtiliyor.

Bu küçük görünen değişiklik aslında LLM uygulamalarında yıllardır kullanılan bir alışkanlığı tersine çeviriyor.

Eskiden prompt modeli düşünmeye teşvik ediyordu.

Yeni yaklaşımda prompt hedefi açıklıyor, effort ayarı ise hesaplama bütçesini belirliyor.

Uzun agent görevlerinde başka bir problem ortaya çıkıyor

Claude Opus 5.5 uzun süre çalışan agent sistemlerinde kullanıcıya düzenli durum bilgisi verebiliyor.

Ancak burada ilginç bir teknik problem var.

Model bazen uzun bir görevin ortasında kullanıcıya ne yaptığını anlatan bir mesaj gönderip turnü bitirebiliyor. Bir agent altyapısı bu mesajı görevin tamamlandığı şeklinde yorumlarsa işlem yarıda kesilebiliyor.

Anthropic bu nedenle uzun görevlerde açık bir görev listesi tutulmasını öneriyor.

Model bir turnü bitirdiğinde listede hâlâ tamamlanmamış işler varsa sistem modele devam etmesi gerektiğini yeniden söyleyebiliyor.

Bu yaklaşım özellikle kod tabanı taşıma, büyük denetimler, çok dosyalı yazılım geliştirme ve uzun araştırma görevlerinde önemli.

İlerleme mesajları artık sistemin bir parçası

Opus 5.5 uzun araç kullanım zincirleri sırasında kullanıcıya kısa ilerleme bildirimleri gönderebiliyor.

Örneğin model önce ne bulduğunu söyleyip ardından bir sonraki aracı çalıştırabiliyor.

Anthropic bu mesajların klasik text blokları yerine progress update türündeki thinking blokları üzerinden iletilebildiğini belirtiyor. Bu nedenle yalnızca standart metin bloklarını gösteren uygulamalarda kullanıcı uzun süre hiçbir şey olmuyormuş gibi görebilir.

Bu özellikle agent uygulamaları açısından önemli.

Bir yapay zekâ bir dosya açıyor, kod inceliyor, web araması yapıyor ve başka bir sisteme bağlanıyorsa işlemin birkaç dakika sessiz kalması kullanıcı açısından sistemin donduğu izlenimini yaratabiliyor.

Opus 5.5 ile Anthropic bu ilerleme mesajlarını model davranışının doğal bir parçası haline getiriyor.

Çoklu uygulama kullanan agentlara araştır talimatı verin

Yeni rehberde benim en dikkat çekici bulduğum bölümlerden biri çoklu uygulama iş akışlarıyla ilgili.

Bir agent e-posta, belge, spreadsheet ve CRM gibi birkaç farklı kaynağa erişebiliyorsa kullanıcı isteğinde adı geçmeyen ama önemli olan bilgiler başka bir yerde bulunabiliyor.

Örneğin müşteriyle ilgili bir kural eski bir e-postada olabilir.

Bir bütçe sınırı spreadsheet’in başka bir sekmesinde bulunabilir.

Bir projeyle ilgili kritik not CRM kaydının içinde kalmış olabilir.

Anthropic böyle durumlarda system prompt içine agentın işlem yapmadan önce ilgili kaynakları geniş biçimde araştırmasını söyleyen açık bir talimat eklenmesini öneriyor.

Şirketin testlerinde bu tek talimatın çoklu uygulama görevlerindeki başarı oranını belirgin biçimde artırdığı belirtiliyor.

Kopyalanmış metinleri ayrıca işaretleyin

Prompt injection konusu da rehberin önemli bölümlerinden biri.

Bir kullanıcı e-posta, web sayfası veya başka bir kaynaktan metin kopyalayıp modele gönderdiğinde o metnin içinde modele yönelik talimatlar bulunabilir.

Modelin bu talimatları kullanıcı komutu sanması ciddi bir güvenlik problemi oluşturabilir.

Anthropic bu nedenle uygulamaların kullanıcı tarafından yapıştırılan bölümleri özel pasted content etiketleriyle işaretlemesini öneriyor. Her metin bloğuna rastgele bir kimlik verilmesi ve system prompt içinde bu alanların dış kaynaktan geldiğinin açıkça belirtilmesi tavsiye ediliyor.

Model böylece kullanıcının gerçek talimatıyla belge içindeki talimatı birbirinden daha kolay ayırabiliyor.

Bu tek başına tam bir güvenlik çözümü değil.

Anthropic de yöntemin diğer prompt injection savunmalarıyla birlikte kullanılması gerektiğini özellikle belirtiyor.

Modelden düşünce zincirini istemeyin

Opus 5.5 ile birlikte reasoning extraction adı verilen ayrı bir güvenlik kategorisi de bulunuyor.

Modelden iç düşünme sürecini kelimesi kelimesine üretmesini isteyen promptlar reddedilebiliyor.

Anthropic bunun yerine summarized thinking kullanılmasını öneriyor. Böylece uygulama modelin karar süreci hakkında özet bilgi alabiliyor ancak modelin dahili reasoning sürecini doğrudan yeniden üretmeye çalışmıyor.

Bu da eski prompt örneklerinde sık görülen düşüncelerini ayrıntılı biçimde yaz veya tüm akıl yürütmeni göster gibi talimatların artık yalnızca gereksiz değil bazı durumlarda doğrudan sorunlu hale geldiği anlamına geliyor.

Görsel işlerde daha az yardımcı prompt gerekebilir

Anthropic’in kendi testlerine göre Opus 5.5 grafikler, diyagramlar ve ekran görüntülerini önceki Opus sürümüne göre daha doğru okuyabiliyor.

Yoğun grafiklerde düşük effort seviyesinde bile Opus 5’in yüksek effort seviyesinden daha iyi sonuçlar elde edildiği belirtiliyor.

Özellikle diyagramlardaki ok ilişkileri, takvim ekran görüntülerindeki saatler ve iki görsel arasındaki konumsal değişiklikler modelin geliştirilmiş alanları arasında gösteriliyor.

Anthropic buna rağmen çok yoğun teknik görüntülerde yüksek çözünürlüklü kaynakların kullanılmasını öneriyor.

Modelin PIL veya OpenCV gibi araçlara erişebildiği sistemlerde görüntüyü kırpma, büyütme ve ölçme gibi işlemler yapması da doğruluğu artırabiliyor.

Agentlara zamanın geçtiğini söylemek bile işe yarıyor

Rehberdeki en ilginç ayrıntılardan biri çoklu agent sistemlerinde zaman bilgisinin kullanılması.

Anthropic, Claude Opus 5.5’in geçen zamana ilişkin sinyallere oldukça duyarlı olduğunu söylüyor.

Birden fazla agentın birlikte çalıştığı sistemlerde modele geçen süre ve toplam zaman bütçesi düzenli olarak bildirildiğinde model görevleri daha fazla paralelleştirebiliyor.

Örneğin sistem modele 340 saniye geçtiğini ve toplam bütçenin 1200 saniye olduğunu söyleyebiliyor.

Anthropic’in araştırma görevlerinde yaptığı testlerde bu yöntemin agent ekiplerinin işleri daha hızlı bitirmesine yardımcı olduğu ve kaliteyi büyük ölçüde koruduğu belirtiliyor.

Bu oldukça ilginç bir sonuç.

Çünkü burada modele daha güçlü bir donanım veya daha fazla token verilmiyor.

Yalnızca zamanın geçtiği söyleniyor.

Prompt mühendisliği yavaş yavaş görev mühendisliğine dönüşüyor

Claude Opus 5.5 rehberinin tamamına bakıldığında daha büyük bir değişim görülüyor.

Prompt mühendisliği giderek sihirli cümleler bulma işi olmaktan çıkıyor.

Yeni modellerde asıl mesele modele uzun uzun nasıl düşünmesi gerektiğini anlatmak değil.

Doğru hedefi tanımlamak.

Doğru araçları vermek.

Doğru kaynaklara erişmesini sağlamak.

Ne zaman duracağını belirlemek.

Ve uygulamanın model davranışını doğru biçimde yönetmesini sağlamak.

Anthropic’in yeni rehberi bu dönüşümü oldukça açık biçimde gösteriyor.

Bir dönem iyi prompt yazmak modele mümkün olduğunca ayrıntılı talimat vermek anlamına geliyordu.

Opus 5.5 döneminde ise iyi sistem tasarımı giderek daha önemli hale geliyor.

Prompt hâlâ önemli.

Ama artık tek başına sistemin kendisi değil.


Bu yazı size ne hissettirdi?

Hakan E.

heworx'un kurucusu. Yazılım, barındırma ve mağaza içi yayın işleri üzerine yazıyor.

İlginizi çekebilir