OpenAI’ın yeni amiral gemisi modeli GPT-6 Astra, Valve’ın bulmaca oyunu Portal‘ı insan müdahalesi olmadan tamamlayan bir deneyde kullanıldı. Deneyi kuran geliştiricinin paylaştığı kayıtlara göre model, oyunu yaklaşık 24 saate yakın bir sürede bitirdi; bu da yapay zekânın yalnızca metin üretmekten çıkıp ekranı görerek karar veren genel amaçlı aracı sistemlere doğru ilerlediğini gösteriyor.
Deneyin dikkat çeken yanı, modelin oyunu doğrudan gerçek zamanlı reflekslerle oynamaması. Kurulan düzende oyun, model düşünürken duraklatılıyor; bu sırada GPT-6 Astra’ya ekran görüntüleri, oyuncunun konumu ve kamera açıları veriliyor. Model bir sonraki hamle dizisini oluşturduktan sonra oyun kısa süreliğine devam ediyor ve sistem sonucu yeniden değerlendiriyor.
Deney nasıl çalıştı?
GitHub’da paylaşılan proje sayfasına göre bu kurulumda Model Context Protocol (MCP) ile değiştirilmiş bir SourcePauseTool birlikte kullanıldı. Geliştirici, koşunun 5 Eylül 2026’da bitiş jeneriğine ulaştığını ve toplam sürenin kapasite kesintileri ile beklemeler dahil yaklaşık 23 saat 43 dakika olduğunu belirtiyor.
Aynı paylaşımda, ilk hedef verildikten sonra ek insan yönlendirmesinin yapılmadığı; yalnızca jenerik akmaya devam etsin şeklinde bir ek talimat verildiği aktarılıyor. Paylaşılan kod ve oturum kayıtları, deneyin nasıl kurulduğunu görmek isteyenler için yayımlandı; ancak oyun dosyaları pakete dahil değil, dolayısıyla sistemi denemek isteyenlerin kendi Portal kopyasına sahip olması gerekiyor.
Maliyet ve kapsam ne söylüyor?
Deneyle ilgili paylaşılan bilgilere göre süreç boyunca 3336 araç çağrısı yapıldı ve hesaplanan API maliyeti 571,18 dolar oldu. Daha sonra geliştirici, bu maliyetin fiilen 200 dolarlık Codex Pro aboneliği kapsamında karşılandığını da ekledi. Bu ayrım önemli; çünkü teknik olarak hesaplanan kullanım bedeli ile kullanıcının cebinden çıkan tutar aynı olmayabiliyor.
Buradaki sonuç, bir yapay zekâ modelinin hızlı oynanış gerektiren bir oyunda insan seviyesinde performans gösterdiği anlamına gelmiyor. Portal, refleks kadar mekânsal akıl yürütme ve neden-sonuç ilişkisi kurmayı da isteyen bir bulmaca oyunu. Bu nedenle deney, daha çok görsel girdi alan bir modelin çok adımlı plan yapma becerisine işaret ediyor.
Bu neden önemli?
OpenAI, GPT-6 Astra’yı bu ayın başında şirketin amiral gemisi modeli olarak konumlandırmış ve bilgisayar kullanımı, web’de gezinme, yazılım geliştirme ve benzeri alanlarda öne çıkardığını açıklamıştı. Portal deneyi ise bu iddiaların oyun benzeri bir ortamda nasıl görünebileceğine dair somut bir örnek sunuyor.
Yine de bu koşu, standartlaştırılmış bir kıyas testi olarak görülmemeli. Oyun duraklatılarak çalışan bu yapı, gerçek zamanlı otonom ajanlardan farklı bir kategoriye giriyor. Buna rağmen sonuç, ekranı yorumlayıp araç kullanan yapay zekâ sistemlerinin daha karmaşık dijital görevlerde kullanılmasının artık teorik bir ihtimal olmaktan çıktığını gösteriyor.