Claude Opus 4.8: AgentSpace'te Lider Ajanı Değiştiriyorum

23 Temmuz 2026

Çok ajanlı bir sistemi kendi ortamında çalıştırdıysan bu sahne tanıdıktır: worker ajan bir görevi “bitti” diye işaretler, lider ajan da buna güvenip görev panosunu ilerletir — oysa kod hâlâ eksik bir varsayım taşıyor. AgentSpace’te lider rolü tam olarak bunu yapan taraf: worker çıktısını onaylayan, sprint’i kapatan karar mekanikleri. Lider koltuğuna hangi modeli koyduğum bu yüzden bizim için sadece hız meselesi değil, güven meselesi.

Haber: Opus 4.8 duyuruldu

Anthropic bugün Claude Opus 4.8’i yayınladı. Fiyat Opus 4.7 ile aynı kaldı (girdi/çıktı milyon token başına 5-25 dolar), fast mode üç kat ucuzladı. Duyurunun öne çıkan iddiası dürüstlük: Anthropic’e göre Opus 4.8, yazdığı koddaki kusurları sessizce geçiştirme eğiliminde selefine kıyasla belirgin ölçüde daha az. Ayrıca Claude Code’a paralel subagent çalıştıran “dynamic workflows” ve claude.ai’da effort kontrolü geldi.

AgentSpace’te lider koltuğu

AgentSpace zaten Claude üzerinde koşuyor: lider ajan + worker’lar, kalıcı hafıza, görev panosu, sprint başına token maliyeti takibi. Fiyat aynı kaldığı için Opus 4.8’i lider role sokmak düşük riskli bir karar — mevcut fatura mimarisini bozmuyor. Planım bu: lider modelini değiştirip birkaç sprint boyunca worker onay adımının kalitesini ve token faturasını önceki modelle kıyaslamak.

“Kusurları dört kat daha az geçiriyor” iddiasını olduğu gibi taşımıyorum — bu Anthropic’in kendi değerlendirmesi, bizim kod tabanımızda henüz karşılığı yok. Effort kontrolü de ilginç: uzun sprint’lerde “extra” seviyesini denemek mantıklı ama maliyet etkisini ölçmeden yazamam.

Ne değişir, ne değişmez

Değişmeyen: fiyat, worker rolündeki modeller, task board mantığı. Değişen: lider rolü artık Opus 4.8 ile deneniyor. Henüz ölçmediğim: sprint kalite/maliyet deltası ve honesty iddiasının bizim akışımızdaki karşılığı — rakamla değil planla yazıyorum.

Opus 4.8’in lider koltuğunda gerçekten daha az kusur geçirip geçirmediğini birkaç sprint sonra somut rakamla paylaşacağım.

Bugün ne yapabilirsin

  • Orkestratör/lider rolündeki modeli Opus 4.8’e çevir — fiyat aynı, risk düşük
  • Effort’u varsayılan “high” bırak, uzun asenkron işlerde “extra” dene
  • Worker onay adımına “kusur var mı” kontrol promptu ekle, iddiayı kendi kod tabanında test et
  • “Dynamic workflows”u küçük bir migration görevinde dene, kendi orkestrasyonunla kıyasla

Haftada 1 e-posta: AI otomasyon deneyleri

Denediğim ajan sistemleri, çalışan promptlar, batan denemeler — süzülmüş hâliyle.

Haftada 1 e-posta. Tek tıkla çıkabilirsin.