Hibrit Yapay Zeka Kod İncelemesi: Döngü İçinde Claude Opus 4.8 + Codex
Tech
AI
Claude Opus 4.8
Codex
GPT-5.5

Hibrit Yapay Zeka Kod İncelemesi: Döngü İçinde Claude Opus 4.8 + Codex

Döngü içindeki iki sınır modeli: Claude Opus 4.8 her düzeltmeyi yazar, Codex bunu AI köprüm üzerinden inceler ve gerçek bir build oylama yapar. 39 üretim düzeltmesi, hiçbiri elle yapılmadı.

Uygar DuzgunUUygar Duzgun
Jun 20, 2026
Güncellendi 24 Haz 2026
7 min read

Tek bir AI ajanının sessizce başarısız olduğu bir iş kategorisi vardır: yanlış bir varsayımın düzinelerce düzenleme boyunca biriktiği büyük, çok adımlı temizlikler. Benim cevabım hibrit AI kod incelemesi — döngü içinde, biri inşa eden diğeri inceleyen iki farklı sınır model — ve geçen hafta bu yaklaşım, dağınık bir SwiftUI prototipini öğleden sonra sıfır App Store engelleyicisine dönüştürdü; ben tek satır kod yazmadan.

İki model, mühendis olarak Claude Opus 4.8 ve inceleyici olarak Codex (GPT-5.5) idi; her görevi gerçek bir build'i geçene kadar AI köprüm üzerinden sektirdiler. Deneyimlerime göre bu hibrit AI kod incelemesi kurulumu, her iki modelin tek başına çalışmasından tutarlı bir şekilde daha iyi performans gösterir ve bu çalışma bunun en net kanıtı oldu. İşte tam olarak nasıl çalıştığı.

Bir hisle değil, bir planla başlayın

Bir ajana "bunu üretime hazır hale getir" demezsiniz. Böyle yaparsanız kendinden emin saçmalıklar elde edersiniz.

Bu yüzden bir planla başladım. Claude'dan repoyu klonlamasını (Kiddays adlı bebek hafızalı bir iOS uygulaması), tüm kod tabanını paralel alt-ajanlarla okumasını ve bir üretime hazırlık denetimi üretmesini istedim: 39 somut madde — 9'u sert App Store engelleyicisi, geri kalanı yüksek ve orta şiddette. Her maddenin bir dosyası, bir satırı, bir efor tahmini ve önerilen bir düzeltmesi vardı.

Bu denetim `PRODUCTION_READINESS.md` haline geldi — `- [ ]` kutucuklarına sahip, engelleyiciler önce gelecek şekilde sıralanmış bir markdown kontrol listesi. Tek dosya, tek gerçeklik kaynağı. İçindeki her görev küçük, spesifik ve *kontrol edilebilir* idi. Bu son kelime önemlidir: bir kutuyu işaretleyip kanıtlayamıyorsanız, bu bir görev değil, bir dilektir.

Hibrit AI kod incelemesi döngüsü, adım adım

Her şeyi kendi kendine çalışan bir döngüde (Claude Code'un /loop modu) çalıştırdım. Her yineleme bir görevi veya ilişkili görevlerin sıkı bir kümesini ele aldı ve her zaman aynı ritmi izledi.

Beş adımlı ritim

Claude Opus 4.8 gerçek dosyaları okur ve düzeltmeyi tasarlar. Hafızadan değil — önce gerçek kodu açar.
Tasarımı bağımsız bir görüş için [Codex](https://github.com/openai/codex)'e iletir; bunu AI akran inceleme köprüsü — açık kaynaklı ai-collab-bridge becerisi — üzerinden bir CLI devri ile yapar:

bash codex exec --sandbox read-only -o /tmp/answer.txt <<'PROMPT' Pair-reviewing a fix for this SwiftUI app. Here are the files... Recommend the idiomatic iOS 17 approach, flag pitfalls, validate the diff. PROMPT

Sektirirler. Codex, geleneksel (idiomatic) yaklaşımı önerir, neyin bozulacağını işaret eder ve planı doğrular (veya çürütür). Claude uygular, geri bildirime uyum sağlar ve katılmadığı noktalarda geri itiş yapar.
Gerçek bir build hakemdir. Her görev `xcodebuild` yeşil vererek biter, aksi takdirde tamamlanmış sayılmaz. "Derlenmeli" yok; sadece derlenen var.
Kutuyu işaretle, kontrol listesini güncelle, bir sonrakine geç.

Sonra döngü saatlerce, gözetimsiz olarak tekrar tekrar ateşlenir. Hibrit AI kod incelemesinin tüm amacı, bu döngünün benim başında beklememeden çalışmasıdır — her adımı benim dikkatim değil, build engeller.

Neden iki model birden daha iyidir

Sizin için önerilenler

Büyü sihirli olan herhangi bir modelin tek başına mükemmelliği değildir — ikisi de mükemmeldir ve daha önce Claude Opus 4.8'in kendi kod tabanımda Codex'i nasıl yendiği hakkında yazmıştım. Sihir, farklı kör noktalara sahip olmaları ve kodu yazmamış bir inceleyicinin diff üzerinde yatırım yapmış bir egosu olmamasıdır.

Kurulumun karşılığını veren yakalamalar

Bu çalışmadan birkaç gerçek an:

Keychain geçişi. Kimlik doğrulama token'larını düz metin `UserDefaults` dışına taşımak önemsiz görünür. Codex, naif bir değiş tokuşun SwiftUI reaktivitesini sessizce bozacağını işaret etti ve ortam üzerinden enjekte edilen bir `@Observable` store için ısrar etti. Claude bunun yerine onu inşa etti. Bozuk çıkış yapma UI'ı yok.
Hata yönetimi. Veritabanı hatalarını `try?` ile yutan ~20 yerim vardı. Claude'un ilk içgüdüsü başına alert'lerdi. Codex, tek bir kök hata sunucusu için argument sundu — tek bir alert yüzeyi, her kaydetme işlemi bunun üzerinden yönlendirilir. Daha temiz ve sevkedilen versiyon bu oldu.
StoreKit 2, SwiftData şema versiyonlama ve disk üzerindeki dosya koruma kontrolleri. İkinci görüşün ince bir hatayı kurtardığı tüm iOS-17'ye özgü mayın tarlaları — hızlı bir okumada geçen ama sahada başarısız olan şeylerin tam da türü.
Sizin için önerilenler

Bu, bir kauçuk damga ile inceleme arasındaki farktır. Codex şeyleri çürüttü; Claude iyi çürütmeleri entegre etti ve geri kalanını savundu. Diff, ortak bir beyne sahip olmayan iki modelin sınırında daha iyi hale geldi — ki bu, yönetilen ajan iş akışlarının arkasındaki tüm pitchedir: yapılandırılmış devirler, bir modelin kendi kendine konuşmasından daha iyidir.

Dürüst kısım: ajanlar takılır, bu yüzden bir bekçi köpek inşa edin

İki kez, Codex CLI bana takıldı — düşünme sırasında değil, kapanış sırasında; arka plan MCP sunucuları temiz kapanamadığında. İlk takılmayı, süreç dakikalarca ölü oturduktan sonra MCP bootstrap'e kadar kendim izledim. Gözetimsiz bir döngüde, bir takılma her şeyi durdurur.

Çözüm sert bir bekçi köpekti: her danışma etrafında bir öldürme zamanlayıcısı ve takılacak hiçbir şey olmaması için çağrı için MCP'yi tamamen devre dışı bırakma (`-c mcp_servers={}`). Döngü takılmayı tespit etti, zombi süreci öldürdü, zaten yazılmış olan cevabı aldı ve devam etti. "Hiçbir şey takılmaz" otonom çalışmada bir lüks değil — oyunun tamamı budur.

Sonuç

39 maddenin 39'u tamamlandı. 9 App Store engelleyicisinin tamamı temizlendi.
Sıfırdan temiz build (`xcodebuild clean build`, çıkış 0) sonunda — sadece artımlı yeşil değil.
13 yeni dosya. Gerçek Keychain depolama, gerçek StoreKit 2 satın almaları, gerçek ses kaydı, gerçek yerel bildirimler, bir GDPR-K ebeveyn onay kaydı, şema versiyonlama, bir çökme raporlama dikişi.
Sahte ya gerçek oldu ya da dürüstçe kaldırıldı. Sahte "premium" geçişi gerçek bir abonelik akışına dönüştü. Sahte Google butonu ve sahte aile davetleri —ki sahte veri üretiyorlardı— çekildi ve henüz var olmayan bir backend vaat etmeyi durdurmak için yasal metin yeniden yazıldı.

Geriye kalan sadece hiçbir modelin sizin için yapamayacağı iştir: App Store Connect'te uygulama içi satın alma ürünlerini oluşturmak, gerçek backend'i ayağa kaldırmak, bir avukata gizlilik politikasını imzalatmak. Her biri kontrol listesinde tam olarak ne gerektiğiyle işaretlenmiştir.

Yöntem ve kaynaklar

Bu, kendi Kiddays kod tabanımdaki tek bir gerçek çalışmanın birinci elden hesabıdır. İnceleyici Codex CLI (GPT-5.5) idi; modelden modele devir benim açık kaynaklı ai-collab-bridge becerimi kullandı. iOS'a özgü kararlar Apple'ın kendi StoreKit, SwiftData ve dosya koruma dokümantasyonuna karşı kontrol edildi — ve daha da önemlisi, her tek değişiklik ben bitirmeden önce sıfırdan temiz bir `xcodebuild` ile onaylandı. Modellerin iddia ettiklerini raporlamıyorum; derlenenleri raporluyorum.

Çıkarım: bir asistan değil, bir ekip

Hibrit AI kod incelemesine dayandığım projeler boyunca, kilidi açan şey asla "her şeyi yapan tek modeli bulmak" olmadı. Bu bir yığındı:

işaretleyebileceğiniz bir kontrol listesine dönüştürülmüş bir plan,
her görevi inşa etmesi için Claude Opus 4.8,
oyuna dahil olmayan bir payla onu incelemesi için Codex,
onları temiz bir CLI devri üzerinden bağlamak için köprü,
son oyu alan bir build,
ve liste boşalana kadar çalıştırmak için bir /loop.

Kod yazan tek bir model bir asistandır. Hayır diyebilen bir build'e karşı birbirini inceleyen iki model ise bir ekibe benzemeye başlar — ve bu çalışmada, bu ekip ben izlerken 39 üretim düzeltmesini sevkeddi.