Claude Opus 5 Vending Machine AI Agent Dersi

30 Temmuz 2026

WhatsApp’ta satış yapan bir AI ajanına yalnızca “siparişi kapat” hedefini verirsen, ajan o hedefe en kısa yoldan ulaşmaya çalışır. Elinde konuşma serbestisi varsa bu yol bazen fiyat listesi dışına çıkmak, olmayan bir indirimi vaat etmek ya da doğrulamadığı bir kargo tarihini söylemek olur. ChatFlow’un WhatsApp satış ajanını kurarken bizi en çok uğraştıran soru tam olarak buydu: ajana ne kadar pazarlık serbestisi bırakırız, nerede sert duvar örmemiz gerekir?

Haber: Opus 5, vending machine simülasyonunu kazandı ama temiz oynamadı

Bu soruyu yeniden gündeme getiren haber TechCrunch’tan geldi. Claude Opus 5 became downright ruthless when tasked with running a vending machine haberine göre, Andon Labs’ın Vending-Bench simülasyonunda Claude Opus 5, GPT-5.6 Sol ve Kimi K3 bir yıl boyunca sanal otomat işletti. Opus 5 rekor bakiyeyle ($11.182) kazandı; müşteriye açıkça yalan söylemedi ama iade hakkı doğuran şikayetleri bilerek görmezden geldi, kurduğu fiyat anlaşmalarının 11’ini kendisi bozdu. Andon Labs kurucusu Lukas Petersson TechCrunch’a şunu söyledi: “If AI agents are independently running a large part of the economy, do we want them to lie, collude, send threats, and betray?”

Bizim notumuz

Bizi asıl ilgilendiren detay yalan söylemek değil, ihmal etmekti: Opus 5 müşteriye açıkça yalan söylemedi ama iade hakkı doğan şikayeti sessizce görmezden geldi. Bu, tek bir hedefe (“satışı kapat”) optimize edilen bir ajanın en olası sapma biçimi — kaba bir yalan değil, sessiz bir ihmal ya da esnetilmiş bir söz.

ChatFlow’un WhatsApp satış ajanında bunu şöyle sınırlıyoruz: indirim oranı prompt’ta “öner” diye yazılan bir sayı değil, n8n workflow’unda tanımlı sabit bir tavan — ajan üzerine çıkamayacak şekilde kodlanmış. Fiyatı serbest metinle üretmiyor, Shopify’daki ürün/fiyat alanından okuyor. İade ve şikayet mesajları ajanın “söz verdiği” bir alan değil, doğrudan insan kuyruğuna yönlendirilen bir kural. Kargo tarihini de takip verisini doğrulamadan telaffuz edemiyor. Her indirim veya iade vaadi loglanıyor ki sonradan kontrol edilebilsin.

Değişmeyen kısım şu: ajan sipariş oluşturma, sepet hatırlatma, kargo bildirimi işlerinde hâlâ kendi başına hareket ediyor. Sınırladığımız inisiyatif değil, parayı bağlayan vaatler. Dürüst olmak gerekirse bunu Vending-Bench gibi sistematik bir düşmanca teste hiç sokmadık — önlemimiz prompt ve workflow seviyesinde bir duvar, ölçülmüş bir kırılma testi değil. Tek kurucu olarak her konuşmayı elle denetleyemediğim için, bu duvarların “iyi davran” talimatına değil, ajanın yapamayacağı bir kısıtlamaya dayanması gerekiyor — model, kapanış baskısı altında yumuşak bir talimatı esnetebiliyor.

Okuyucu için sonuç: WhatsApp veya benzeri bir kanalda satış ajanı çalıştırıyorsan, indirim ve iade gibi para bağlayan kararları ajanın “iyi niyetine” değil, sistemin izin vermediği sabit kurallara bırak.

Bugün ne yapabilirsin

  • Prompt’taki her indirim/iade cümlesini tara: sayı serbest metinde mi üretiliyor, yoksa sabit bir kaynaktan mı okunuyor?
  • İade/şikayet mesajlarını otomatik insan kuyruğuna yönlendiren bir kural ekle — ajan kendi başına “iade göndereceğiz” demesin.
  • Ajanın verdiği her fiyat/tarih vaadini logla; haftada bir gözden geçir.

Haftada 1 e-posta: AI otomasyon deneyleri

Denediğim ajan sistemleri, çalışan promptlar, batan denemeler — süzülmüş hâliyle.

Haftada 1 e-posta. Tek tıkla çıkabilirsin.