Tek bir AI ajanının sessizce başarısız olduğu bir iş kategorisi vardır: yanlış bir varsayımın düzinelerce düzenleme boyunca biriktiği büyük, çok adımlı temizlikler. Benim cevabım hibrit AI kod incelemesi — döngü içinde, biri inşa eden diğeri inceleyen iki farklı sınır model — ve geçen hafta bu yaklaşım, dağınık bir SwiftUI prototipini öğleden sonra sıfır App Store engelleyicisine dönüştürdü; ben tek satır kod yazmadan.
İki model, mühendis olarak Claude Opus 4.8 ve inceleyici olarak Codex (GPT-5.5) idi; her görevi gerçek bir build'i geçene kadar AI köprüm üzerinden sektirdiler. Deneyimlerime göre bu hibrit AI kod incelemesi kurulumu, her iki modelin tek başına çalışmasından tutarlı bir şekilde daha iyi performans gösterir ve bu çalışma bunun en net kanıtı oldu. İşte tam olarak nasıl çalıştığı.
Bir hisle değil, bir planla başlayın
Bir ajana "bunu üretime hazır hale getir" demezsiniz. Böyle yaparsanız kendinden emin saçmalıklar elde edersiniz.
Bu yüzden bir planla başladım. Claude'dan repoyu klonlamasını (Kiddays adlı bebek hafızalı bir iOS uygulaması), tüm kod tabanını paralel alt-ajanlarla okumasını ve bir üretime hazırlık denetimi üretmesini istedim: 39 somut madde — 9'u sert App Store engelleyicisi, geri kalanı yüksek ve orta şiddette. Her maddenin bir dosyası, bir satırı, bir efor tahmini ve önerilen bir düzeltmesi vardı.
Bu denetim `PRODUCTION_READINESS.md` haline geldi — `- [ ]` kutucuklarına sahip, engelleyiciler önce gelecek şekilde sıralanmış bir markdown kontrol listesi. Tek dosya, tek gerçeklik kaynağı. İçindeki her görev küçük, spesifik ve *kontrol edilebilir* idi. Bu son kelime önemlidir: bir kutuyu işaretleyip kanıtlayamıyorsanız, bu bir görev değil, bir dilektir.
Hibrit AI kod incelemesi döngüsü, adım adım
Her şeyi kendi kendine çalışan bir döngüde (Claude Code'un /loop modu) çalıştırdım. Her yineleme bir görevi veya ilişkili görevlerin sıkı bir kümesini ele aldı ve her zaman aynı ritmi izledi.
Beş adımlı ritim
bash codex exec --sandbox read-only -o /tmp/answer.txt <<'PROMPT' Pair-reviewing a fix for this SwiftUI app. Here are the files... Recommend the idiomatic iOS 17 approach, flag pitfalls, validate the diff. PROMPT
Sonra döngü saatlerce, gözetimsiz olarak tekrar tekrar ateşlenir. Hibrit AI kod incelemesinin tüm amacı, bu döngünün benim başında beklememeden çalışmasıdır — her adımı benim dikkatim değil, build engeller.
Neden iki model birden daha iyidir
Büyü sihirli olan herhangi bir modelin tek başına mükemmelliği değildir — ikisi de mükemmeldir ve daha önce Claude Opus 4.8'in kendi kod tabanımda Codex'i nasıl yendiği→ hakkında yazmıştım. Sihir, farklı kör noktalara sahip olmaları ve kodu yazmamış bir inceleyicinin diff üzerinde yatırım yapmış bir egosu olmamasıdır.
Kurulumun karşılığını veren yakalamalar
Bu çalışmadan birkaç gerçek an:
Bu, bir kauçuk damga ile inceleme arasındaki farktır. Codex şeyleri çürüttü; Claude iyi çürütmeleri entegre etti ve geri kalanını savundu. Diff, ortak bir beyne sahip olmayan iki modelin sınırında daha iyi hale geldi — ki bu, yönetilen ajan iş akışlarının→ arkasındaki tüm pitchedir: yapılandırılmış devirler, bir modelin kendi kendine konuşmasından daha iyidir.
Dürüst kısım: ajanlar takılır, bu yüzden bir bekçi köpek inşa edin
İki kez, Codex CLI bana takıldı — düşünme sırasında değil, kapanış sırasında; arka plan MCP sunucuları temiz kapanamadığında. İlk takılmayı, süreç dakikalarca ölü oturduktan sonra MCP bootstrap'e kadar kendim izledim. Gözetimsiz bir döngüde, bir takılma her şeyi durdurur.
Çözüm sert bir bekçi köpekti: her danışma etrafında bir öldürme zamanlayıcısı ve takılacak hiçbir şey olmaması için çağrı için MCP'yi tamamen devre dışı bırakma (`-c mcp_servers={}`). Döngü takılmayı tespit etti, zombi süreci öldürdü, zaten yazılmış olan cevabı aldı ve devam etti. "Hiçbir şey takılmaz" otonom çalışmada bir lüks değil — oyunun tamamı budur.
Sonuç
Geriye kalan sadece hiçbir modelin sizin için yapamayacağı iştir: App Store Connect'te uygulama içi satın alma ürünlerini oluşturmak, gerçek backend'i ayağa kaldırmak, bir avukata gizlilik politikasını imzalatmak. Her biri kontrol listesinde tam olarak ne gerektiğiyle işaretlenmiştir.
Yöntem ve kaynaklar
Bu, kendi Kiddays kod tabanımdaki tek bir gerçek çalışmanın birinci elden hesabıdır. İnceleyici Codex CLI (GPT-5.5) idi; modelden modele devir benim açık kaynaklı ai-collab-bridge becerimi kullandı. iOS'a özgü kararlar Apple'ın kendi StoreKit, SwiftData ve dosya koruma dokümantasyonuna karşı kontrol edildi — ve daha da önemlisi, her tek değişiklik ben bitirmeden önce sıfırdan temiz bir `xcodebuild` ile onaylandı. Modellerin iddia ettiklerini raporlamıyorum; derlenenleri raporluyorum.
Çıkarım: bir asistan değil, bir ekip
Hibrit AI kod incelemesine dayandığım projeler boyunca, kilidi açan şey asla "her şeyi yapan tek modeli bulmak" olmadı. Bu bir yığındı:
Kod yazan tek bir model bir asistandır. Hayır diyebilen bir build'e karşı birbirini inceleyen iki model ise bir ekibe benzemeye başlar — ve bu çalışmada, bu ekip ben izlerken 39 üretim düzeltmesini sevkeddi.
