🚨 Riskler & Yaygın Hatalar

Riskler & Yaygın Hatalar: Claude'un kendinden emin görünen çıktısına doğrulamadan güvenmek, şirketinde hiç çalışmamış ama tam bir özgüvenle konuşan, çok okumuş bir stajyere güven

Claude'un kendinden emin görünen çıktısına doğrulamadan güvenmek, şirketinde hiç çalışmamış ama tam bir özgüvenle konuşan, çok okumuş bir stajyere güvenmeye benzer — mekanizma birebirdir: stajyer her ders kitabını okumuştur (devasa bir eğitim korpüsü) ama SENİN spesifik kod tabanının tuhaflıkları hakkında hiçbir hafızası yoktur, yani kendinden emin verilmiş bir cevap ile DOĞRU bir cevap sık sık çakışan ama birbirinden BAĞIMSIZ iki özelliktir, aynı şey değildir. Üzerinde durulmaya değer soru şu: Claude çoğu zaman doğruysa, nadiren yanlış olduğu zamanlar etrafında bütün bir "riskler" sekmesi kurmaya neden zahmet edilsin? Çünkü hata modu, ortalamasını alabileceğin rastgele bir gürültü değildir — SİSTEMATİK OLARAK GÖRÜNMEZDİR: uydurulmuş bir metod gerçek bir metodla birebir aynı görünür, tautolojik bir assertion gerçek bir kontrolle birebir aynı görünür, ta ki production'da sessizce başarısız olana kadar. Java karşılaştırması: bu, bir derleyici hatası (gürültülü, build'i durdurur) ile derlenip aceleyle yapılan bir review'dan geçen bir mantık hatası (sessiz, yayına çıkar) arasındaki farktır — bu risklerin çoğu tam olarak sözdizimsel açıdan kusursuz oldukları için ikinci türdendir. QA tarafındaki bedel: bu sayfanın tamamı aktif doğrulama alışkanlıkları öğretti (çalıştır, tekrar üret, kabul kriterlerine karşı kontrol et) — bu sekme, o alışkanlıkların yakalamak için var olduğu somut hata şekillerini toplar, o yüzden bunu aracı kullanmaktan seni korkutmaya yönelik bir uyarı değil, kendine karşı tuttuğun bir referans kontrol listesi olarak ele al.

4 Risk Kategorisi, Tek Disiplin: Doğrula

Halüsinasyon: Claude, doğrulanmış bir gerçeği değil olası bir metni tahmin ettiği için var olmayan bir API veya metodu tam bir özgüvenle söyleyebilir — UI Otomasyonu sekmesinde ele alınan karşı önlem, çalıştırmadan önce her zaman derleyiciye, IDE'ye veya resmi dokümantasyona karşı doğrulamaktır. Gizlilik: müşteri verisini, token'ları veya kimlik bilgilerini herhangi bir AI konuşmasına yapıştırmak, gönderildiği an bir maruziyettir — Bug Analizi sekmesinde derinlemesine ele alınan karşı önlem, her seferinde yapıştırmadan önce temizlemektir.

Telif hakkı ve şirket politikası: bazı kurumlar üçüncü parti AI araçlarına ne tür kod veya verinin yapıştırılabileceğini kısıtlar veya AI destekli kodun yayına çıkmadan önce incelenmesini zorunlu kılar — karşı önlem, şirketinin gerçek AI kullanım politikasını bilmek ve ona uymaktır; "bilmiyordum" bir reviewer'ın kabul edeceği bir savunma değildir. Aşırı bağımlılık (beceri erimesi): her zaman önce Claude'a soran ve hiç kendi bağımsız debug içgüdülerini geliştirmeyen bir tester, yanlış bir assertion'ı veya kötü bir locator'ı kendi başına fark etme becerisini kaybeder — karşı önlem, Claude'u zaten anladığın işi hızlandırmak için kullanmak, henüz kurmadığın bir anlayışın yerine geçirmek için değil; önceki sekmelerdeki doğrulama alışkanlıkları pratikte tam olarak o anlayıştır.

Bir LLM, olası görünen API isimlerini tahmin eder; Selenium'un isimlendirme kuralına uyan bir metod tamamen uydurma (bir halüsinasyon) olabilir ve kendinden emin ifade tarzında bunu gösteren hiçbir işaret yoktur.

Claude, kararlı bir niteliğe öncelik vermesi söylenmeden dondurulmuş bir HTML anlık görüntüsünden pozisyonel bir XPath üretti (bkz. UI Otomasyonu sekmesi) — pozisyon, bir frontend ekibinin korumayı taahhüt ettiği bir kontrat asla değildir.

Üretilen bir assertion, gerçek beklenen değer yerine bir değeri kendisiyle veya önemsiz derecede doğru bir koşulla karşılaştırdı — gerçek davranıştan bağımsız olarak geçen bir tautoloji.

Ham log, önce hassas alanlar temizlenmeden yapıştırıldı — Bug Analizi sekmesinde ele alınan aynı hata, burada gerçek bir olay şekli olarak gösteriliyor.

LLM tarafından üretilen kimlik-şeklindeki sayılar, özellikle hacimde, tesadüfen gerçek geçerli bir kimlikle çakışabilir — "açıkça sahte yap" talimatı tek başına çakışmamayı garanti etmez.

Modelin eğitim verisi, birçok kütüphane sürümü boyunca yıllarca süren dokümantasyonu kapsar; tam olarak kurulu sürümün söylenmemesi halinde, en yaygın görülen (genellikle daha eski) API şeklini varsayar.

Çok uzun konuşmalar, özellikle birçok konu değişikliği boyunca, önceki bağlamı etkili odağın dışına itebilir — sert bir hafıza hatası görünmeden, önceki kararlar o zamandan beri söylenen her şeyle yarışır.

"Bir AI zaten kontrol etti" diyerek AI üretimi kodu ekibin normal inceleme sürecinden muaf tutmak — ama Claude'un kendi çıktısı hiç bağımsız olarak doğrulanmadı, bu da CI/CD sekmesinin ekip-kuralı disiplinini ihlal etti.

Adım Adım: Güvenmeden Önce Doğrulama

Halüsinasyonu kontrol et