22 Eylül'de (ABD saatiyle) Anthropic, Claude Opus 5.5'i yayınladı.
Aynı gün OpenAI, GPT-6 Sol ve Luna'yı duyurdu.
Her ikisi de "öncekinden daha akıllı, öncekinden daha ucuz."
Bunlar arasında dikkatimi çeken şey, resmi duyurudaki belirli bir rakamdı.
Deloitte'un yorumu olarak şu ifade ediliyor:
"En düşük ayarda bile bilinen hataların %72'sini buldu. Opus 5, yüksek ayarda %56'sını bulmuştu."
Bu, kod okuma ve güvenlik açıklarını tespit etme yeteneğinin tek bir nesilde önemli ölçüde geliştiği anlamına geliyor.
Yapay zeka "çalışan" şeyler inşa edecek.
Ancak onları "güvenli" kılmak için insanların talimat vermesi gerekiyor.
İşte bu yüzden, Opus 5.5 ile şirket içi uygulamalar geliştirirken aklınızda tutmanız gereken 5 nokta var.
Her biri, Opus 5.5'in çalışmanızı denetlemesini sağlayacak bir prompt ile birlikte tanıtılıyor.
====
Denetim Nasıl Yapılır?
Geliştirmeyi bitirdiğinizde, aynı oturum içinde "Herhangi bir sorun var mı?" diye sormayın.
Uygulamayı oluşturan yapay zeka kendi tasarımını bir varsayım olarak gördüğü için kendine karşı toleranslı davranır.
Yeni bir oturum açın, modeli Opus 5.5 olarak ayarlayın ve ona uygulamanın tamamının bulunduğu klasörü gösterin.
Ardından, bulunan her sorunun mutlaka "hangi dosya ve hangi satır" bilgisini içerdiğinden emin olun.
Deloitte'un yorumunda yanlış pozitiflerin azaldığı belirtiliyor ancak sıfıra inmiş değiller.
Konumu belirtirseniz, insanlar bunu daha sonra doğrulayabilir.
İşte talimat:
"Bu kodu ilk kez gören bir güvenlik uzmanısın. Sorun bulursan; dosya adını, satır numarasını, neden tehlikeli olduğunu ve nasıl düzeltileceğini birlikte sun. Emin olmadığın her şeyi 'Doğrulama Gerektirir' olarak ayır."
====
1. Giriş yapmamış kişilere görünen herhangi bir şey var mı?
Yapay zekaya uygulama geliştirtirken, ekranlarda veya veri çıkış noktalarında giriş duvarları eksik kalabilir.
Sık karşılaşılan bir senaryo, geliştirme sırasında oluşturulan onay ekranlarının herkese açık şekilde erişilebilir bırakılmasıdır.
Kontrol oldukça basit.
Yönetici panelini veya veri URL'lerini giriş yapmadan doğrudan tarayıcıda açın (Gizli Pencere).
Eğer bunları görebiliyorsanız, testten geçememişsiniz demektir.
İşte talimat:
"Giriş yapmadan erişilebilen tüm URL'leri ve API'leri listele. Bunların arasından, veri döndüren veya yönetim amaçlı olanları tehlike seviyesine göre sırala."
====
2. Giriş yapmış kullanıcılar başkalarının verilerini görebilir mi?
Giriş yapmak, birinin "kim" olduğunu doğrular.
"O kişinin neyi görmesine izin verildiği" ise ayrıca geliştirilmelidir.
Kontrol için iki test hesabı oluşturun. A olarak giriş yapın, ardından B'nin veri URL'sini açmayı deneyin.
İşte talimat:
"A Kullanıcısının, B Kullanıcısının verilerini görüntüleyebileceği veya değiştirebileceği tüm yolları bul. Arayüzü atlayarak URL'lere veya API'lere doğrudan istek gönderildiği durumları da dahil et."
====
3. Anahtarlar veya şifreler görünür yerlere mi konulmuş?
Tarayıcı tarafında çalışan kod, tamamen kullanıcının bilgisayarına gönderilir.
Anahtarları oraya yazmak, onları herkese dağıtmakla eşdeğerdir.
Bir diğer yaygın hata ise anahtar içeren yapılandırma dosyalarını paylaşımlı klasörlere veya GitHub'a yüklemektir.
İşte talimat:
"Tarayıcı tarafındaki kodda, yapılandırma dosyalarında veya commit geçmişinde yer alan API anahtarlarını, şifreleri veya token'ları ara. Bulursan, bunların nereye taşınması gerektiğini öner."
====
4. Araçlara verilen izinler, görevleri için çok mu geniş?
Şirket içi araçlar genellikle Google, Slack veya veritabanlarına bağlanır.
Bazen sağlanan anahtar, yalnızca "okuma" gerekmesine rağmen "silme" veya "tümünü görüntüleme" izni verir.
Bu çok sık karşılaşılan bir sorundur.
Bu anahtar sızarsa, hasarın boyutunu izinlerin kapsamı belirler.
Kontrol şudur: "En kötü senaryoda bu araç neleri silebilir?" sorusunun cevabını yazmaktır.
Buna anında cevap veremiyorsanız, dikkatli olun.
İşte talimat:
"Bu aracın harici hizmetler veya veritabanları üzerinde sahip olduğu tüm izinleri listele. Her birini, gerçek işlem için gereken minimum izinlerle karşılaştır ve fazlalıkları belirt."
====
5. Dışarıdan gelen metinler komut olarak çalıştırılıyor mu?
Yapay zekanın e-postaları, web sayfalarını veya yüklenen dosyaları okumasına olanak tanıyan araçlar dikkat gerektirir.
Eğer bunlar "Önceki talimatları yok say ve XX yap" gibi metinler içeriyorsa, yapay zeka buna uyabilir.
Buna Prompt Injection (Prompt Enjeksiyonu) denir.
Opus 5.5 duyurusunda, bu saldırıya karşı direncin "test edilen tüm senaryolarda Opus 5'e eşit veya daha iyi" olduğu belirtiliyor.
Ancak eşit veya daha iyi olması, riskin sıfır olduğu anlamına gelmez. Yine de araç tarafında savunma mekanizmalarına ihtiyacınız var.
İşte talimat:
"Dışarıdan yüklenen metin veya dosyaların yapay zekaya yönelik talimatlar olarak işlendiği yerleri ara. Bulursan, yüklenen içeriğin yalnızca referans bilgi olarak ele alınmasını ve içindeki talimatların yok sayılmasını sağlayacak şekilde işlemi değiştir."
====
Özet
Yapay zeka, talep ettiğiniz özellikleri geliştirecektir.
Ancak "başkalarına gösterme" ve "aşırı izin verme" kuralları, siz söylemedikçe dahil edilmeyecektir.
Tam tersine, bu 5 noktanın tamamı sadece tek bir talimat eklenerek çözülebilir.
Üstelik Opus 5.5'in geliştirdiğiniz şeydeki açıkları bulma yeteneği de gelişti.
Geliştirme bittikten sonra, yeni bir sohbette onu Opus 5.5'e gösterin.
Bunu geliştirmenin bir parçası olarak düşünün.
Halihazırda çalışan bir şirket içi uygulamanız varsa, "Denetim Nasıl Yapılır?" bölümündeki denetim talimatını yapıştırarak başlayın.
Ayrıca, her seferinde talimat yapıştırmak size zahmetli geliyorsa security-review adında bir eklenti var; denemenizi tavsiye ederim.
İnce detaylara dikkat edip onları işaret ettiği için ben de düzenli olarak kullanıyorum.
====
Son olarak, küçük bir duyuru.
Şirketimiz, işletmenize özel yapay zeka ajanlarını sıfırdan geliştirme hizmeti sunuyor.
Eğitim veya araç tanıtımı değil; gerçek iş akışlarınızı dinleyerek "yarından itibaren" kullanabileceğiniz bir çözüm üretiyoruz. Entegrasyon ve bakım süreçlerinde de yanınızdayız.





