Haberler

OpenAI GPT-6 Astra’yı Tanıttı: Yeni Model Bilgisayarı Kendi Başına Kullanabiliyor

OpenAI, bilgisayar kullanımı, yazılım geliştirme, bilimsel araştırma ve siber güvenlik alanlarında yeni yetenekler sunan GPT-6 Astra modelini kullanıma sundu. Model, bilgisayar başındaki çok aşamalı görevleri önceki nesillere göre daha hızlı tamamlayabilirken bazı güvenlik testlerinde yüzde 100 başarı oranına ulaştı. OpenAI Başkanı Greg Brockman, modelin yeteneklerini yapay genel zekâ döneminin başlangıcı olarak değerlendirdiğini belirtirken Astra’nın ilk aşamada sınırlı sayıda kuruluşa açılacağını açıkladı.

GPT-6 Astra Bilgisayar Başındaki Görevleri Kendi Başına Yürütebiliyor

Bilgisayar ekranında açılan bir CRM sistemi, takvim uygulaması veya çevrim içi form Astra’nın doğrudan çalışabildiği araçlar arasında yer alıyor. Model, kullanıcıdan aldığı talimat doğrultusunda müşteri kayıtlarını güncelleyebiliyor, formları doldurabiliyor, takvim üzerinde değişiklik yapabiliyor ve internet araştırmasından elde ettiği bilgileri belge ya da e-posta içerisine aktarabiliyor.

Yazılım geliştirme ortamında çalışan Astra, internet sitesi oluşturduktan sonra ortaya çıkan ürünün işlevlerini de test edebiliyor. Model, yazılım kurulumu gerçekleştirebildiği gibi ekranda karşılaştığı hataları inceleyerek sorunun giderilmesine yönelik işlemleri de uygulayabiliyor.

OSWorld 2.0 sonuçları, GPT-6 Astra’nın bilgisayar kullanımı alanındaki performans artışını ölçülebilir biçimde ortaya koyuyor. Astra, GPT-5.6 Sol’a kıyasla görevleri yaklaşık yüzde 47 daha kısa sürede tamamlarken daha yüksek bilgisayar kullanımı performansı elde etti.

Codex altyapısındaki hız iyileştirmeleri de yeni modelin çalışma süresini kısaltıyor. Mind2Web değerlendirmesinde Astra, mevcut GPT-5.6 Sol deneyimine kıyasla görevleri 1,9 kat daha hızlı tamamladı.

Elektronik mühendisliği alanındaki bir kullanım örneği, modelin yalnızca basit bilgisayar işlemleriyle sınırlı kalmadığını gösteriyor. Astra, KiCad üzerinde hazırlanan elektronik şemayı üretime uygun PCB tasarımına dönüştürebiliyor, bileşenleri yerleştirebiliyor ve devre üzerindeki bakır bağlantıları yönlendirebiliyor.

3D içerik üretiminde ise Blender ile Unreal Engine 5 birlikte kullanılabiliyor. Astra, Blender üzerinde bir yapı modeli oluşturduktan sonra modeli Unreal Engine 5 ortamına aktararak kullanıcıların içerisinde hareket edebileceği bir sahne hazırlayabiliyor.

Profesyonel bir çalışma ortamında aynı anda açılan belge, elektronik tablo ve sunum dosyaları Astra’nın tek bir iş akışı içinde değerlendirebildiği içerikler arasında bulunuyor. OpenAI, modeli yalnızca daha fazla bilgi işleyebilmesi için değil, verilen talimatları çalışma bağlamını koruyarak uygulayabilmesi için de eğitti.

Astra, eksik bırakılan rutin ayrıntıları görevin bağlamından çıkarabiliyor. Kararın sonucu önemli ölçüde değişebilecek bir belirsizlik ortaya çıktığında ise model kullanıcıdan açıklama isteyerek kendi başına kritik bir tercih yapmaktan kaçınıyor.

Codex ortamında kullanıcı yanıt vermek için beklerken bağımsız şekilde sürdürülebilecek işlemler de devam edebiliyor. Yeni bir talimat geldiğinde Astra, önceki görevi tamamen terk etmek yerine yeni isteği mevcut hedefle ilişkilendirerek çalışma planını değiştirebiliyor.

GPT-6 Astra’nın önemli özelliklerinden biri, uzun görevlerde önceki çalışma bağlamına yeniden erişebilmesi olarak öne çıkıyor. OpenAI, geleneksel bağlam sıkıştırma yöntemlerinde uzun oturumların özetlenmesi sırasında bazı ayrıntıların kaybolabildiğini belirtirken Astra için önceki notların farklı bağlam pencereleri arasında korunmasına yönelik deneysel bir sistem geliştiriyor.

Model, daha önceki mesajlarda veya araç çıktılarında bulunan gereksinimleri gerektiğinde yeniden arayabildiği için uzun süren yazılım projelerinde test sonuçlarının, kullanıcı talimatlarının veya teknik ayrıntıların tamamen unutulmasının önüne geçilmesi hedefleniyor. OpenAI, söz konusu bağlam koruma sistemini şu anda deneysel olarak kullanıyor ve özelliği ilerleyen haftalarda Astra için varsayılan hale getirmeyi planlıyor.

Bilimsel araştırma ortamında kullanılan Astra, yalnızca teorik sorulara yanıt vermek yerine uzmanlaşmış yazılımlarla doğrudan çalışabiliyor. Model, bilimsel verileri analiz ederek grafikler oluşturabiliyor ve elde edilen sonuçlardan hareketle araştırmacıların sonraki çalışma alanlarını belirlemesine yardımcı olabiliyor.

Matematik tarafında Astra’nın bazı uzun süredir açık kalan problemlerin çözümüne katkı sağladığı bildiriliyor. OpenAI, tanıtım sırasında asal sayılar arasındaki boşluklarla ilgili iki yeni sonucu da paylaşırken modelin farklı bilim ve matematik değerlendirmelerinde önceki rekorları aştığını açıkladı.

FrontierMath Tier 4 değerlendirmesinde yüzde 98, ARC-AGI-3 testinde yüzde 99,9, ExploitBench testinde ise yüzde 100 başarı elde edildi. Sonuçlar, modelin farklı görev türlerinde yüksek performans sergilediğini gösterirken OpenAI özellikle karmaşık matematik problemlerindeki ilerlemeyi öne çıkarıyor.

Astra’nın bilimsel yazılımları doğrudan kullanabilmesi, yapay zekânın araştırma süreçlerindeki rolünü de değiştiriyor. Araştırmacılar modeli yalnızca bilgi almak için kullanmak yerine veri hazırlama, hesaplama, görselleştirme ve sonuç değerlendirme gibi birbirine bağlı işlemlerde yardımcı bir çalışma aracı olarak kullanabilecek.

Siber güvenlik laboratuvarında gerçekleştirilen testler, Astra’nın en güçlü sonuçlarından bazılarını ortaya çıkardı. ExploitBench değerlendirmesinde bilinen yazılım açıklarının çalışan istismarlara dönüştürülmesi ölçülürken Astra yüzde 100 başarı elde etti ve GPT-5.6 Sol’un yüzde 78,5’lik sonucunu geride bıraktı.

ExploitGym testinde de yeni model yüzde 42,4 başarı oranına ulaşırken önceki model yüzde 30,3 seviyesinde kaldı. Astra, daha yüksek sonuçlara ulaşırken daha az çıktı tokenı kullandığı için performans artışı yalnızca başarı oranındaki yükselişten ibaret kalmadı.

OpenAI, modelin daha yeni güvenlik açıkları karşısındaki performansını ölçmek için Haziran-Ağustos 2026 dönemine ait verileri de değerlendirmeye aldı. Şirketin testlerinde Astra, önceki üç ay içerisinde ortaya çıkan açıklar üzerinde de GPT-5.6 Sol’a göre daha yüksek oranda keyfî kod çalıştırma başarısı gösterdi.

Siber güvenlik araştırmalarında iki sıfırıncı gün açığının bulunması ise testlerin en kritik sonuçlarından biri oldu. OpenAI, Astra’nın keşfettiği iki güvenlik açığını ilgili geliştiricilere bildirdiğini açıkladı.

SRE-Bench sonuçları da modelin kaynak koduna erişmeden yazılım davranışlarını analiz etme kabiliyetinin geliştiğini gösterdi. Astra görevlerin yüzde 88’ini ilk denemede, yüzde 99,2’sini dört denemede tamamlarken GPT-5.6 Sol aynı ölçümlerde sırasıyla yüzde 55,9 ve yüzde 68,7 seviyesinde kaldı.

Siber güvenlik alanındaki yüksek kapasite, Astra’nın kullanıma sunulmasında özel güvenlik önlemlerini gerekli kılıyor. Bugün kullanıma açılan model savunma amaçlı kod inceleme ve güvenlik açığı kapatma görevlerinde çalışabilirken açıkları istismar etmeye yönelik daha ileri işlemleri reddediyor.

OpenAI, modelin kendisine verilen yetkilerin dışına çıkıp çıkmadığını da ayrı güvenlik değerlendirmeleriyle test etti. GPT-5.6 Sol’un ek güvenlik önlemleri olmadan yapılan testlerde vakaların yüzde 48’inde belirlenen sınırların dışına çıktığı görülürken GPT-6 Astra aynı değerlendirmede hiçbir ihlal gerçekleştirmedi.

Modelin kendi yetenekleri hakkında yanlış bilgi verme eğilimi de ayrı bir testten geçirildi. Astra’nın yetenekleri konusunda hatalı açıklama yapma ihtimali GPT-5.6 Sol’a göre üç kat daha düşük ölçüldü.

OpenAI, yüksek yetenek seviyesine rağmen Astra’nın kusursuz olmadığını da kabul ediyor. Şirketin değerlendirmeleri, modelin özellikle basit görevlerde daha az yazılı adımla sonuca ulaşması nedeniyle çalışma sürecinin dışarıdan izlenmesini zorlaştırabildiğini gösteriyor.

GPT-6 Astra’da kullanılan yinelenen derinlik yaklaşımı da bu noktada önem kazanıyor. Model, bazı problemleri geleneksel akıl yürütme sistemlerindeki gibi tek yönlü adımlar halinde ilerletmek yerine aynı sorgu üzerinde birden fazla işlem döngüsü gerçekleştirebiliyor.

Yapay zekâ güvenliğinde zincirleme düşünce kayıtları olarak bilinen Chain of Thought yaklaşımı, modelin problem çözme sırasında oluşturduğu ara adımlar hakkında denetim ekiplerine çeşitli sinyaller sağlayabiliyor. Yinelenen işlemlerin ağırlık kazandığı mimarilerde dışarıdan görülebilen izlerin azalması, hatalı veya yetkisiz davranışların nedenini araştıran güvenlik ekiplerinin işini zorlaştırabiliyor.

OpenAI bu nedenle Astra’nın işlemlerini takip eden ek denetim sistemleri kullanıyor. Denetim katmanları, modelin verilen talimatların dışına çıktığını belirlediğinde işlemi durdurabiliyor ve özellikle siber güvenlik gibi yüksek riskli alanlarda modelin yetki sınırlarını korumasına yardımcı oluyor.

İlk aşamada sınırlı sayıda kuruluşa sunulan GPT-6 Astra’nın erişim alanı kısa süre içinde genişletilecek. OpenAI, modelin ChatGPT Plus, Pro, Business ve Enterprise abonelerine açılmasını planlarken geliştiriciler Astra’ya API üzerinden de erişebilecek.

API tarafında model “gpt-6-astra” adıyla sunulacak. Amazon Bedrock entegrasyonu da geliştiricilerin Astra’yı farklı kurumsal yapay zekâ uygulamalarına dahil edebilmesine olanak sağlayacak.

Astra’nın kullanım maliyeti, API tarafında 1 milyon giriş tokenı için 10 dolar ve 1 milyon çıkış tokenı için 50 dolar olarak belirleniyor. ChatGPT aboneliklerinde ise Astra kullanımı mevcut kullanım kotalarına dahil edilirken ihtiyaç duyan kullanıcılar ve işletmeler ek kullanım kredileri satın alabilecek.

GPT-6 Astra’nın sonraki dönemde yaratacağı asıl değişim, yapay zekânın yalnızca metin veya görsel üretmesiyle sınırlı kalmayabilir. Bilgisayar ekranında işlem yapabilen, yazılım geliştirebilen, bilimsel araçları kullanabilen ve uzun görevlerde önceki çalışma bağlamını koruyabilen modellerin yaygınlaşması, çalışanların dijital iş akışlarında yapay zekâdan aldığı desteğin kapsamını genişletebilir. OpenAI’nin önündeki temel sınav ise artan yetenekleri daha geniş kullanıcı kitlesine açarken siber güvenlik, yetki kontrolü ve davranış denetimi gibi alanlarda aynı güvenlik seviyesini korumak olacak.

İlgili Makaleler

Bir yanıt yazın

Başa dön tuşu