Bir AI güvenlik incelemesi, bir mühendisinin akıl yürütmesini yeniden üretebildiğinde faydalıdır. Uzun bir endişe verici bulgular listesi, bir ekibin hangi sürümü durduracağına, hangi değişikliği yapacağına veya hangi iddiayı reddedeceğine karar vermesine yardımcı olmaz. Cloudflare’ın security-audit-skill üzerindeki ilginç gelişme, bu kararın etrafındaki yapıdır.
Cloudflare, Haziran 2026’da daha geniş bir güvenlik açığı kullanma çalışmasını tanımladı. Kamuya açık depo, bir kod tabanını denetlemek için bir başlangıç noktasıdır. Mevcut iş akışı, keşif, kapsam odaklı avlanma, aday doğrulama, yapılandırılmış bulgular, bağımsız doğrulama ve raporlama aşamalarından geçmektedir. Bulguların ayrı onaylanmış, çözülmemiş ve reddedilmiş durumları vardır. Adayı keşfetmeyen bir inceleyici, kanıtları kontrol eder.
Bunu, belirli bir depo ve bir mühendislik sahibi ile inceleme sürecini iyileştirmenin bir yolu olarak değerlendireceğim. Sadece beceriyi yüklemek, bir uygulamanın güvenli olduğunu kanıtlamaz.
Yayınlanmanın bağlı olduğu soruyla başlayın
Hayali bir SaaS sürümünü düşünün; bu sürüm, organizasyonlar arasında geçiş yapma özelliği ekliyor. Her türlü güvenlik açığını bulmak için yapılan geniş bir talep, etkileyici bir rapor üretebilir ancak önemli olan bir soruyu atlayabilir: Bir kullanıcı, bağlamı değiştirdikten sonra başka bir organizasyonun kayıtlarını okuyabilir mi?
Bu sürüm için önce rotaları, önbellekleri, arka plan işlerini ve organizasyon kimliğini tüketen dışa aktarımları listeleyeceğim. İnceleme, bu yollar boyunca aynı iş nesnesini takip etmelidir. Bir denetleyici hakkında yapılan bir bulgu, daha önceki bir kontrol önerilen isteği imkansız hale getiriyorsa eksiktir. Eşit şekilde, doğru bir denetleyici, gecikmeli bir işin daha sonra ne okuyacağını açıklamaz.
Bu nedenle kapsamın bir anlamı olması gerekiyor. Bir dosyanın açılması dikkat göstergesi, her ilgili davranışın incelendiği anlamına gelmez. Raporun kontrol edilen sınırı ve inceleme dışında kalanları belirlemesini istiyorum.
Bir bulgu, sıradan bir mühendislik sohbetine dayanmalıdır.
Kod değiştirmeden önce, dört soruya yanıt verecek bir bulgu beklerim: hangi girdi kontrol ediliyor, hangi yol bunu kabul ediyor, hangi koruma başarısız oluyor ve hangi sonuç gözlemlendi? Bu yanıtlar kontrol edilen revizyona atıfta bulunmalıdır. O zamandan beri değişmiş bir işleve verilen bir bağlantı tartışmayı kapatmak için yeterli değildir.
| Bir raporda iddia | Talep edeceğim kanıtlar |
|---|---|
| Bir kayıt bir organizasyon sınırını geçebilir. | Arayan kimliği, ilgili kayıtlar ve geçişi gösteren yanıt. |
| Eksik bir kontrol, bir açığa neden olur. | Başka bir katmanın aynı kuralı zaten uygulamadığını onaylama. |
| Bir düzeltme sorunu kapatır. | Değişiklikten önce başarısız olan ve sonrasında başarılı olan odaklanmış bir kontrol. |
Bu standart, anlaşmazlıkları da daha ucuz hale getirir. Çözümlenmemiş bir talep, tanımlı bir eksik bilgi ile küçük bir araştırmaya dönüşebilir. Bu durum, ya bir acil durum ya da modelin genel olarak güvenilir olup olmadığına dair bir tartışma haline gelmek zorunda değildir.
Sürüm kapısı olmadan önce sınırlı bir pilot kullanın
Önerdiğim ilk çalışma, küçük, temsilci bir modülü kapsayacaktır. Üretim kimlik bilgilerini yürütme ortamından çıkarın ve sentetik kayıtlar kullanın. Depo, hedef kontrollü kodu çalıştırmak için bir işletim sistemi kumanda alanı gerektirir. “Dikkatli ol” diyen bir istem, eşdeğer bir kontrol değildir.
Pilot, gözden geçirme çabasını ve kabul edilen bulguları ölçmelidir. Bir mühendis her adayın doğrulanmasına ne kadar zaman harcıyor? İkinci bir mühendis önemli sonucu yeniden üretebilir mi? Çıktı, tamamlanan işi tamamlanamayan işten ayırabiliyor mu? Bu sorular, aracın değerini başka birinin kod tabanından başarı oranlarını ödünç almadan gözlemlenebilir hale getirir.
Bağımsız inceleme, uygulamadan önce de önemlidir. Claudex Loop ve çapraz model plan incelemesi konusundaki makalem, o önceki karar noktasına bakıyor. Hizmetleri ajanslara sunan ekipler için, değişen MCP taşıma modeli incelemeye dahil edilmesi gereken başka bir entegrasyon sınırı ekliyor.
Raporu sahipli çalışmaya dönüştürün
Faydalı bir devretme, her kabul edilen bulguyu bir sahip ile, dar bir kapsamda bir değişiklik ile ve bir doğrulama sonucu ile bağlar. Reddedilen adayları gerekçeleriyle birlikte saklayın, böylece bir sonraki çalışmada aynı yanlış anlamalar yeniden keşfedilmez. Takip çalışmalarını değişen davranış etrafında planlayın, rastgele bir temiz tarama sayısı yerine.
Eğer ekibiniz mevcut bir uygulamaya bir AI asistanı veya ajan entegrasyonu ekliyorsa, benim AI entegrasyon çalışmalarım bu inceleme sınırlarını ve yayın öncesi gereken kanıtları tanımlamayı içerebilir.
Kaynaklar 7 Ekim 2026’da kontrol edildi: bağlantılı depo README’si ve Cloudflare’ın harness makalesi. Bu, belgeler temelinde bir değerlendirmedir; bu makale için bir müşteri sisteminin kıyaslaması veya güvenlik denetimi yapılmamıştır.