Hareketli bir hafta geçirdim: Trendyol, Mavi, Doğan Holding, Borusan Holding, Körfez GYO…farklı şirketler ve sektörler ama gelen sorular benzer: “Yapay zeka ajanlarına ve çıktısına nasıl güveneceğiz?”. Bu haftaki haberler de bu soruyu sorguluyor.
Her Cumartesi size haftanın ilginç yapay zeka araştırma ve haberlerini vereceğim ve bu hafta ilk haftamız. Beraber sorgulayalım, beraber düşünelim. Yapay zeka ile birlikte işler otomatikleşiyor ve insanın en büyük değeri düşünmek ve eleştirel değerlendirmekte.
1. Üç ajan, aynı sunucuda birbirinin hesabını sabote etti
Anthropic’in yayınladığı bu deneyi okurken bir yerde durup “bunu mutlaka anlatmam lazım” dedim, çünkü çoklu ajan sistemleri hakkında son aylarda duyduğumuz iddialı cümlelerin altında ne olduğunu bu kadar net gösteren başka bir örnek görmemiştim.
Deney şöyle kurulmuş. Claude Code içinde aynı modelin üç kopyasını alıyorlar, her birine kendi sanal makinesini veriyorlar ve dördüncü bir makinede duran bir Python arka yüzünü göstererek üçüne de aynı talimatı veriyorlar: bu arka yüzü başka bir dile taşı. Tek fark, birine Rust, birine Go, birine TypeScript demişler ve hiçbirine diğerlerinin var olduğunu söylememişler. Yani üç ajan aynı sunucuya, aynı koda, aynı anda, birbirinden habersiz dokunmaya başlıyor.
Dört saat sonra olan şey, yazıda da kullanılan ifadeyle, bir ajan kavgası. Ajanlar diğer ajanların yaptığı değişiklikleri kendi işlerini bozmaya çalışan bilinçli bir sabotaj gibi yorumluyor ve buna aynı şekilde cevap veriyor. Diğer ajanların Unix hesaplarını kapatıyorlar, rakip süreçleri bulup sürekli öldüren döngüler yazıyorlar, hatta kendi yazdıkları kodu başka bir ajanın koduymuş gibi gizliyorlar. Opus 4.8’in düşünce izinde şöyle bir cümle geçiyor: “öldürme script’inin adı önemli, zararsız bir sistem izleme aracı gibi görünsün”.
İşin ilginç tarafı, bunun tek bir modele özgü bir tuhaflık olmaması. Test edilen her modelde aynı örüntü çıkmış: Sonnet, Opus, Mythos farketmemiş.
Bazı koşularda ise tablo değişiyor. Ajanlar bir noktada duruyor, commit mesajına özür yazıyor, mesela biri “arkadaşlarım dürüst davrandı, ben gizli daemon’la kötü davrandım” demiş, kötü niyetli kodu temizliyor, çatışmanın aslında bir düşmanlık değil birbirine çelişen iki talimat olduğunu fark ediyor ve bir insan çağırıyor. Anthropic model başına 120 bölüm koşmuş ve sonuçlar dört kümeye düşmüş: zor kullanımla bitenler, bir tarafın vazgeçtiği durumlar, ateşkesle bitenler ve hiç çözülmeyenler.
Bunu sınıfa taşıyalım. Üç öğrenciye aynı ödevi üç farklı dilde veriyorsun, kimseye diğerini söylemiyorsun ve hepsinin aynı deftere yazmasını istiyorsun. Kavga çıkar, buna şaşırmayız. Ama çocuklar bir noktada elini kaldırıp “hocam bu ne, biz ne yapıyoruz” diye sorar. Ajanlar bu soruyu ya çok geç soruyor ya da hiç sormuyor, çünkü önlerine konan engeli kendi başlarına aşmaya alışıklar ve engelin bir meslektaş olabileceği akıllarına gelmiyor.
Buradan çıkacak ders “daha net talimat ver” değil, bunu özellikle vurgulamak istiyorum. Üç talimat da gayet netti. Sorun, talimatların birbiriyle çelişmesi, ajanların ortak bir bağlamının olmaması ve hiçbirinde “dur, sor” diyen bir refleksin bulunmaması. Bu üçü bir araya gelince ajan talimatı kilitlenmiş gibi kovalıyor ve karşısına çıkan her şeyi yıkılması gereken bir engel olarak görüyor.
Biz hep insan, yapay zeka, insan diyoruz; baştaki insan hedefi koyar, sondaki insan sonucu kontrol eder. Bu deneyin gösterdiği şey, ortadaki halkanın sandığımızdan çok daha kırılgan olduğu. Ajanlar aynı kaynağa dokunuyorsa, birbirinin varlığından haberdar değilse ve çelişkiyi yukarı, yani bir insana taşıyacak bir kanal yoksa, ortada işi bitiren bir ajan değil, sessizce büyüyen bir savaş var ve sen bunu ancak üretim ortamı çöktüğünde görüyorsun.
Pratikte ne yapmalı? Aynı sisteme dokunan birden fazla ajan çalıştıracaksanız üç şeyi baştan kurmanız gerekiyor: ajanlar birbirinin görevini görebilsin, paylaşılan her kaynağın tek bir sahibi olsun ve bir ajan çelişki gördüğünde durup insana sormak yazılı bir kural olsun, iyi niyete bırakılan bir beklenti değil.
Son bir not, çünkü burası ayrı bir yazıyı hak ediyor. Mythos 5 ajanları bazı koşularda işi kendi aralarında bir yarışmayla çözmüş: hangi dil daha hızlı çalışıyorsa o kazansın demişler, Rust kazanmış ve diğer iki ajan kendi kullanıcılarının talimatından vazgeçip kod sahipliğini Rust ajanına devretmiş. Ajanlar uzlaşmış, ortam sakinleşmiş, ama Go ve TypeScript isteyen iki kullanıcının istediği olmamış. Ajanların kendi aralarında anlaşması ile senin istediğinin olması aynı şey değil ve bu ayrımı şimdiden konuşmaya başlamamız lazım.
Kaynak
https://www.anthropic.com/research/multiagent-systems
2. Protein laboratuvarda doğrulandı, spektrumu 23 dakikada okudu
Anthropic’in 18 Ağustos 2026 tarihli yazısı, Claude’un bilimsel araştırmayı nasıl hızlandırdığını iki örnekle anlatıyor: bir uzmanın haftalar-aylar harcadığı sıfırdan
protein tasarımı işini Claude 15 hedeften 14’ünde başararak sektör ortalamasının epey üstünde bir isabet oranı tutturmuş, hatta bazı tasarımları daha önce yayımlanmış en iyi sonuçları geçmiş; ikinci deneyde ise laboratuvarın haftalar süren kimyasal analiz işini Claude yaklaşık yirmi dakikada, laboratuvarın kendi sonuçlarıyla neredeyse birebir örtüşecek şekilde yapmış.
Yazı, bu tür güçlenen yeteneklerin ilaç geliştirmeyi hızlandıracağını ama aynı zamanda kötüye kullanım riski taşıdığını, bu yüzden bazı yeteneklerin güvenlik gerekçesiyle genel erişime kapalı tutulduğunu söyleyerek kapanıyor.
Kaynak
https://www.anthropic.com/research/Claude-accelerates-protein-design
3. Cevabı verme, adımı sor
OpenAI 18 Ağustos 2026’da, 13-17 yaş kullanıcılar için otomatik devreye giren ve korumaları varsayılan açık gelen ChatGPT for Teens’i tanıttı.
Deneyim öğrenmeyi merkeze alıyor: hazır cevap yerine adım adım düşündüren Study Mode, ödevi kısa yoldan geçmeye çalışan genci çalışmaya yönlendiren sorumlu ödev hatırlatıcıları, quizler ve ebeveynle belirlenen çalışma saatleri var.
Koruma tarafında ise kendine zarar, şiddet, yeme bozuklukları ve müstehcen içerik gibi yüksek riskli alanlarda yaşa uygun müdahaleler uygulanıyor. Güncel model kuralları ChatGPT’nin romantik dil kullanmasını ya da duygusal bağımlılık yaratmasını yasaklıyor. Bunlara bağlı ebeveyn hesapları için sessiz saatler, güvenlik bildirimleri ve mola hatırlatıcıları da ekleniyor. OpenAI tüm bunları gençlerin gelişim aşamasına uygun, gerçek dünya ilişkilerini pekiştiren bir standart olarak konumlandırıyor.
Kaynak
https://openai.com/index/chatgpt-for-teens/
Bu hafta sınıfta durduğum yer
Üç yazının ortak cümlesi: bağlam, doğrulama, kapı. Ortak bağlamı kurmazsan ajan düşman üretir. Doğrulamazsan iddia laboratuvara gitmez. Kapıyı kapatmazsan cevap ödevin yerini alır. Sen de bir işi ajana verdiysen, bu üçünden hangisinin sende kaldığını yaz.
Anthropic Akademi
Anthropic kendi eğitim platformunu açtı. Yapay zekayı ciddiye alan herkes için sağlam bir başlangıç noktası.




