Claude Opus 5 vs Fable 5: Lider Ajanda Sıradaki Test

25 Temmuz 2026

AgentSpace’te lider ajan rolünü hangi modelin üstleneceğine karar vermek, tek başına çalışan biri için hafife alınacak bir iş değil: lider ajan sprint boyunca planlama yapıyor, worker’lara görev dağıtıyor, kararı zayıfsa sprint’in tamamı yamuk gidiyor. Şu an gündemde Claude Opus 5 vs Fable 5 kıyaslaması var ve elimde bu iddiayı doğrulayacak gerçek bir sprint verisi yok — sadece Anthropic’in kendi cümlesi var.

Ne oldu

Anthropic perşembe günü yeni modeli Claude Opus 5’i duyurdu; The Verge’e göre şirket, Opus 5’in çoğu alanda Fable 5’in yeteneklerine yakın olduğunu ve karmaşık kodlama görevlerinde belirgin şekilde daha iyi olduğunu söylüyor. Fiyatlandırma önceki model Opus 4.8 ile aynı kaldı — milyon token başına 5$ giriş / 25$ çıkış — ve Anthropic bunun Fable 5’in yarı fiyatı olduğunu vurguluyor. Ayrıca Opus 5’e, hükümetin siber güvenlik endişeleri sonrası Fable 5’te yapılan sıkılaştırmadan sonra, öncekinden daha fazla siber güvenlik önlemi eklendiği ve şirketin bu modeli “en hizalı Opus modeli” olarak tanımladığı belirtiliyor.

Bizim notumuz

Bizim için asıl soru worker havuzu değil — o kararı ayrı ele aldık ve burada tekrar açmıyorum. Asıl soru lider ajan rolü. AgentSpace’te Fable 5, Anthropic’in kendi tanımına göre de “uzun ufuklu ajan projeleri”nde en güçlü model, yani tam olarak lider ajanın işi. Opus 5’in buna “yakın” olması doğruysa, lider rolünü Fable 5’in yarı fiyatına karşılamak mümkün olabilir.

Ama “yakın” bir pazarlama cümlesi, ölçüm değil. Planım şu: aynı sprint tanımını önce mevcut lider modelle, sonra Opus 5 ile çalıştırıp çıkan planın netliğini ve worker’lara giden görev tanımlarının kalitesini karşılaştırmak. Şu an değiştirmeyeceğim şey de var: worker katmanının modeli, çünkü o zaten ayrı bir kararın konusu. “En az kötüye kullanıma açık model” iddiasını da olduğu gibi almıyorum; worker’lar gerçek Shopify ve WhatsApp aksiyonları tetiklediği için izin katmanımız zaten devrede — model tarafındaki hizalama iddiası bu katmanın yerini almıyor, sadece üstüne biniyor.

Kısacası: fiyat avantajı yazılı ve doğrulanabilir, kalite iddiası henüz değil.

Okuyucu için sonuç

Opus 5’in “Fable 5’e yakın” iddiasına, lider-ajan rolünde gerçek bir plan-kalitesi testinden geçmeden fiyat avantajı üzerinden karar vermeyin.

Bugün ne yapabilirsin

  • Çok-ajanlı bir sistemde lider ajan çalıştırıyorsan, model değişikliğini worker katmanından ayrı test et.
  • Aynı sprint tanımını eski ve yeni modelle çalıştırıp yalnızca plan çıktısının netliğini karşılaştır, token maliyetini bu testle karıştırma.
  • “Yakın” veya “karşılaştırılabilir” gibi pazarlama ifadelerini kendi ölçütünle (görev tamamlanma oranı, worker’a giden görev netliği) doğrulamadan lider modeli değiştirme.

Haftada 1 e-posta: AI otomasyon deneyleri

Denediğim ajan sistemleri, çalışan promptlar, batan denemeler — süzülmüş hâliyle.

Haftada 1 e-posta. Tek tıkla çıkabilirsin.