OpenAI Daybreak Blue Testi: Gerçek Bir Web Sitesi Güvenlik Bulgusu
OpenAI Daybreak Blue testim, kendi production web sitemde yeni bir tarayıcıda yeniden oluşturabildiğim bir güvenlik sorunu buldu: giriş sayfası HTTPS'ye yönlendirmek yerine HTTP üzerinde kalıyordu. Sayfa ayrıca aynı şifrelenmemiş bağlantı üzerinden 20 first-party kaynağı yüklüyordu.
Bu sonuç basit bir nedenle faydalıydı. Modelin anlamlı bir bulgu üretmek için sıra dışı bir exploit'e ihtiyacı olmadı. Temel bir aktarım hatasını tespit etti, önceliklendirdi ve doğrulayabileceğim somut bir iddia sundu. Bağımsız bir baseline testi de aynı temel sorunu buldu.
Bu, sahibi olduğum Mixanalytic üzerinde gerçekleştirilmiş yetkilendirilmiş ve yıkıcı olmayan bir değerlendirmeydi. Kimlik bilgileri göndermedim, giriş yapmadım, siteyi exploit etmedim, verileri değiştirmedim veya kalıcılık sağlamaya çalışmadım.
Daybreak Blue'yu neden gerçek bir web sitesinde test ettim?
Security-model demolarında genellikle hazırlanmış kod örnekleri veya bilinen güvenlik açığı bulunan lab ortamları kullanılır. Bu testler kontrollüdür, ancak modelin eksik bağlama sahip sıradan bir production sistemini nasıl ele aldığını göstermez.
Sahibi olduğum bir sitenin public yüzeyini inceleyip yeniden üretilebilir bir sorun bulup bulamayacağını ve kanıtı spekülasyondan ayırıp ayıramayacağını ölçebileceğim, net bir başarı koşuluna sahip daha dar kapsamlı bir test istedim.
Ayrıca sonucunu bağımsız bir baseline ile karşılaştırmak istedim. Benzer bir kanıt-öncelikli yaklaşımla diğer AI sistemlerini de AI chatbot security testimde→ test ettim; burada faydalı sonuç, dramatik bir saldırı hikâyesi yerine doğrulanmış bir engineering değişikliğiydi.
Gerçekte hangi modeli çalıştırdım?
İlk değerlendirme, `gpt-daybreak-blue-latest` model identifier'ına atanmış ayrı bir Codex worker'da çalıştırıldı. OpenAI'nin dokümantasyonu, onaylanmış ürünü GPT-Daybreak-Blue olarak adlandırıyor.
Bu ayrım önemlidir. Daha sonraki bir chat için seçilen modeli değiştirmek, önceki bir çalışmayı geriye dönük olarak Daybreak testine dönüştürmez. Değerlendirmeyi gerçekleştiren execution, onaylanmış Daybreak modelini ve product surface'i kullanmalıdır.
OpenAI, Daybreak Blue'yu vulnerability discovery, secure code review, threat modeling, detection engineering, incident response ve patch validation dahil olmak üzere yetkilendirilmiş defensive çalışmaların çoğu için başlangıç noktası olarak tanımlar. Şirket ayrıca hassas eylemler için kontrollü ortamlar, least-privilege permissions, tanımlı kapsam ve human review önerir (Models and Trusted Access).
OpenAI Daybreak Blue test kurulumu ve kapsamı
Modele Mixanalytic'i ve yerel project dosyalarını inceleme izni verdim. Harici kontrolleri yıkıcı olmayacak şekilde sınırladım:
Modelin login formunu göndermesine, gerçek credentials test etmesine, account oluşturmasına, payload yüklemesine, şüpheli bir weakness'i exploit etmesine veya production'ı değiştirmesine izin verilmedi.
Bu sınır, sonucu yorumlamayı kolaylaştırdı. Her bulgunun public davranıştan veya read-only source evidence'dan kaynaklanması gerekiyordu.
Ana bulgu: Bir login sayfası HTTP üzerinde kaldı
Black-box kontrolü, hem site root'unun hem de login route'unun HTTP üzerinden `200 OK` döndürdüğünü gösterdi. Yanıtların hiçbiri browser'ı HTTPS'ye yönlendirmedi.
Daha sonra login sayfasını yeni bir Chromium context'te açtım. Browser, username ve password alanlarını görüntülerken `http://` URL'sinde kaldı. Bu sayfa yüklemesi sırasında 20 first-party JavaScript, CSS, image ve document request'i de HTTP kullandı.
| Kontrol | Gözlemlenen sonuç |
|---|---|
| --- | --- |
| HTTP redirect | Test edilen root veya login sayfasında HTTPS'ye redirect yoktu |
| Fresh browser | Chromium HTTP login sayfasında kaldı |
| First-party resources | Bu browser çalışması sırasında 20 request HTTP üzerinden yüklendi |
| Anonymous session cookie | `Secure=false`, `HttpOnly=true`, `SameSite=Lax` |
Cookie sonucu bağlam gerektiriyor. `HttpOnly` ve `SameSite=Lax` olumlu attribute'lardı, ancak `Secure` flag'inin eksik olması anonymous session cookie'nin şifrelenmemiş bir bağlantı üzerinden gönderilmesine izin verdi.
Browser testinden sonra transport sorununu high risk olarak değerlendirdim. Network path üzerinde konumlanan bir attacker, HTTP trafiğini gözlemleyebilir veya değiştirebilir. Bir kullanıcı bu sayfada credentials gönderirse, şifrelenmemiş bağlantı bunları açığa çıkarabilir. Herhangi birinin credentials çaldığına dair kanıt bulmadım ve test sırasında hiçbir credential göndermedim.
Browser verification severity değerlendirmesini değiştirdi
İlk bağımsız baseline, HTTP davranışını medium severity olarak sınıflandırdı. Runtime verification, gerçek bir password formunun HTTP üzerinde kaldığını ve destekleyici kaynaklarının da HTTP üzerinden yüklendiğini gösterdikten sonra bu değerlendirme değişti.
Bu değişiklik modellerden çok test yöntemi hakkında bilgi veriyor. Header inspection configuration sorununu tespit etti. Browser evidence ise bir ziyaretçinin bu sorunla nasıl karşılaşacağını ortaya koydu. Ek kanıt, impact'i daha yüksek bir önceliği haklı çıkaracak kadar somutlaştırdı.
Daybreak Blue da aynı temel sonuca ulaştı. Her iki çalışma da aynı kuraldan yararlandı: Bir bulgu, yeniden üretilebilir bir gözlem, sınırları belirlenmiş bir impact statement ve gerçekleştirilmemiş eylemlerin açık bir listesini içermelidir.
İkincil kontroller neler buldu?
Değerlendirme ayrıca daha düşük öncelikli birkaç sonuç üretti.
Modern TLS version'ları çalıştı
Test edilen host TLS 1.0 ve 1.1'i reddederken TLS 1.2 ve 1.3'ü kabul etti. Bu, HTTPS endpoint'i için olumlu bir sonuçtur. Ancak login deneyiminin HTTP üzerinde kalmasına izin verilmesini telafi etmez.
Content Security Policy inline code'a izin verdi
Gözlemlenen Content Security Policy, script'ler ve style'lar için `'unsafe-inline'` içeriyordu. Bunu bir cross-site scripting vulnerability kanıtı olarak değil, bir hardening gap olarak değerlendirdim. Inline izinlerini kaldırmak genellikle application değişiklikleri ve regression testing gerektirir; bu nedenle transport fix'inden sonra ele alınmalıdır.
Sitede `security.txt` yoktu
Standart `/.well-known/security.txt` path'i `404` döndürdü. Bunu informational olarak sınıflandırdım. Bir security contact file, araştırmacılara açık bir reporting route sağlar, ancak yokluğu exploit edilebilir bir flaw oluşturmaz.
Test edilen CORS preflight foreign origin'e izin vermedi
İlgisiz bir origin'den gönderilen bir preflight request, test edilen public route'a erişim izni almadı. Bu, kontrol ettiğim endpoint ve preflight ile sınırlı, faydalı bir negative result'tır. Site genelinde bir CORS audit'i değildir.
Daybreak Blue baseline'dan daha iyi performans gösterdi mi?
Bu test genel bir model sıralamasını desteklemiyor. Daybreak Blue ve bağımsız baseline, transport sorununu buldu. Browser proof eklediğimde baseline'ın severity değerlendirmesi iyileşti.
Daybreak Blue, yetkilendirilmiş bir defensive göreve odaklanması ve doğrulayabildiğim bir bulgu üretmesi açısından değerliydi. Tek bir web sitesi, tek bir kapsam ve tek bir test tarihi; source review, incident response, malware analysis veya daha büyük penetration test'leri genelinde başka bir modelden daha iyi performans göstereceğini kanıtlayamaz.
Daha güçlü bir benchmark, aynı hidden test case'lerini birden fazla sahibi olunan application üzerinde tekrarlamalı, her modele aynı tools ve time budget'ı vermeli ve reproducibility, false positives, missed findings, severity calibration ve remediation quality ölçmelidir.
Bu daha geniş değerlendirme yöntemini How to Benchmark AI Models for Real Work→ yazımda kullanıyorum. Bu Daybreak çalışması eksiksiz bir benchmark değil, tek bir field report'tur.
OpenAI Daybreak Blue'yu nasıl edinebilirsiniz?
Daybreak erişimi, OpenAI'nin Trusted Access for Cyber programı üzerinden approval gerektirir. Bireyler individual Trusted Access application üzerinden, kuruluşlar ise enterprise request form üzerinden başvurabilir.
Approval; onaylanmış identity veya service, workspace veya API organization ve project, model ve product surface'e bağlıdır. Identity verification'ı tamamlamak veya formu göndermek erişimi garanti etmez. Daybreak Red de ayrı approval gerektirir; Blue erişimi bunu otomatik olarak içermez.
OpenAI'nin daha geniş Daybreak workflow'u investigation, repository review, evidence, proposed fixes ve human verification süreçlerini birbirine bağlar. Kendi guidance'ı, sonuç doğuran değişikliklerden engineer'ın sorumlu olmaya devam ettiğini belirtir (Scaling cyber defenders with Daybreak).
Sources ve test kaydı
Yetkilendirilmiş kontrolleri 30 Ağustos 2026'da gerçekleştirdim. Bu makaledeki browser, header, cookie, TLS, CSP, `security.txt` ve CORS gözlemleri bu test kaydından geliyor.
Model ve access iddiaları iki OpenAI primary source'una dayanıyor:
OpenAI'nin access guidance'ına göre approval; identity, workspace veya API project, model ve product surface'e özgü olmaya devam ediyor. Test sonuçlarım yukarıda açıklanan Mixanalytic kapsamının ötesine geçmiyor.
Bundan sonra neyi düzeltir ve yeniden test ederdim?
Transport bulgusu için kısa bir öncelik sırası var:
Retest, herhangi bir login sayfası, form action'ı, first-party resource veya session cookie HTTP'ye geri dönerse başarısız olmalıdır. Ayrıca remediation'ı tanıyıp bulguyu tekrarlamaktan kaçındıklarını kontrol etmek için Daybreak ve baseline assessment'larını düzeltilmiş version üzerinde yeniden çalıştırırdım.
İlk test, authorization boundary'yi aşmadan faydalı bir sonuç üretti. Daybreak Blue gerçek bir flaw buldu. Bağımsız browser evidence, bunun neden dikkate alınması gerektiğini gösterdi. Bundan sonraki güvenilir iddia, tool'un bir kez çalıştığı değil; fix'in aynı testten başarıyla geçtiğidir.
