OpenAI’ın GPT 6 Astra modeli, DrivingBench’te denenen dört model arasında parkuru bitiren tek model oldu: 134,7 metreyi ikinci denemesinde 5 dakika 22 saniyede geçti.[14][15] Başarılı denemede 6,6 milyon token kullanıldı; kaydedilen model çalıştırma maliyeti 7,74 dolardı. Sonuç, genel amaçlı bir modelin kontrollü ko...
YayımlayanGPT-6 Sol ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: According to the DrivingBench report, how did OpenAI’s GPT-6View Astra become the first commercial large language model to steer a real car. Article summary: DrivingBench’s result was a narrow but notable proof of concept: OpenAI’s GPT-6 Astra—not “GPT-6View Astra” in the available sources—was the only tested model to complete a real-car cone course, succeeding on its second . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
Bir yapay zekâ modeli gerçek bir otomobille parkuru bitirdi. Fakat DrivingBench sonucunu anlamak için bitiş çizgisi kadar test koşullarına da bakmak gerekiyor. OpenAI’ın GPT-6 Astra modeli — bazı anlatımlarda geçen “GPT-6View Astra” değil — denenen dört model arasında boş bir otoparktaki konili parkuru tamamlayan tek modeldi. Bunu ilk denemesinde değil, hatalarına ilişkin geri bildirim aldıktan sonraki ikinci denemesinde başardı. Araç yürüme hızında ilerlerken sürücü koltuğunda, gerektiğinde fren yapmaya hazır bir insan bulunuyordu.14
15
5
Araştırmacılar Tobias Gessler, Simon Mahns ve Aditya Ramabadran, genel amaçlı yapay zekâ modellerini simülasyon yerine fiziksel bir sürüş görevinde sınamak için DrivingBench’i kurdu. Testte bir Toyota Corolla, Comma 4 donanımı ve openpilot üzerine kurulu bir kontrol sistemi kullanıldı. Her modele, önceki denemelerinden gelen bilgiyi aynı sohbet içinde değerlendirebilmesi için en fazla üç deneme hakkı tanındı.11
36
Model yolu iki kameradan gördü ve aracı her seferinde bir araç komutuyla yönetti: observe kamera görüntülerini ve araç verilerini almak, set_motion direksiyon ile hızı ayarlamak, stop_now ise aracı durdurmak içindi. DrivingBench, denemelerin video kayıtlarını ve komut izlerini yayımladı.5
11
Astra ilk denemesinde parkurun %49’una ulaştı. Araştırmacıların hataları üzerine düşünmesini istemesinin ardından ikinci denemede 134,7 metrelik parkuru 5 dakika 22 saniyede bitirdi.15
34 Duraklamalar dâhil ortalama hız yaklaşık 1,5 km/sa, yani 0,94 mil/sa ediyor. Bu ortalama, aracın hiçbir anda bu hızın üstüne çıkmadığı anlamına gelmiyor.
34
Diğer modeller parkuru tamamlayamadı. Claude Fable 5.1 en iyi denemesinde %45’e ulaşırken Grok 4.6 ve GPT-5.6 Sol çok daha az ilerledi. Teste ilişkin haberler, ilk virajı yaygın bir başarısızlık noktası olarak aktarıyor.4
40 Dolayısıyla Astra’nın başarısı, raporlanan bu dört modellik karşılaştırmada bir ilk; bütün ticari modellerin veya bütün sürüş koşullarının sınandığını göstermiyor.
11
14
DrivingBench’in başarılı ikinci denemeye ait kaydında 6,6 milyon token ve 7,74 dolar model çalıştırma maliyeti yer alıyor.34 Bu tutarı alınan mesafeye göre bir mile uyarlayınca yaklaşık 92,47 dolar/mil çıkıyor. Bu, tek bir kısa denemeden yapılan bir hesap: Uzun süreli sürüşte ölçülmüş bir maliyet değil; otomobili, donanımı veya insan gözetimini de kapsamıyor.
34
11
Başka bir karşılaştırmada geçen yaklaşık 9,75 dolar, Astra’nın iki denemesinin toplamı olarak veriliyor. DrivingBench’in 7,74 dolarlık kaydı ise yalnızca başarılı ikinci denemeye ait. İki rakam aynı sürüş için verilmiş farklı fiyatlar değil.8
34
DrivingBench, genel amaçlı bir modelin kamera gözlemlerini komutlara dönüştürerek geri bildirim sonrasında tek bir gerçek dünya sürüş görevini tamamlayabildiğini gösteriyor. Bu, simülasyondaki bir başarıdan daha somut; ancak trafiğe çıkmaya hazır olmakla aynı şey değil.36
15
Test kısa ve sabit bir rotada, boş bir otoparkta, yürüme hızında yapıldı; direksiyon başında fren için hazır bir insan vardı. Sonuç, modelin trafikte güvenilir davranacağını, operatör olmadan acil durumları yöneteceğini veya uzun mesafeyi ekonomik biçimde kat edeceğini ortaya koymuyor.5
11
34 En isabetli yorum, bunun sıkı biçimde kontrol edilen koşullarda gösterilmiş bir yetenek olduğu; sınanmış bir otonom sürüş sisteminin yerini aldığı değil.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OpenAI’ın GPT 6 Astra modeli, DrivingBench’te denenen dört model arasında parkuru bitiren tek model oldu: 134,7 metreyi ikinci denemesinde 5 dakika 22 saniyede geçti.[14][15]
OpenAI’ın GPT 6 Astra modeli, DrivingBench’te denenen dört model arasında parkuru bitiren tek model oldu: 134,7 metreyi ikinci denemesinde 5 dakika 22 saniyede geçti.[14][15] Başarılı denemede 6,6 milyon token kullanıldı; kaydedilen model çalıştırma maliyeti 7,74 dolardı.
Sonuç, genel amaçlı bir modelin kontrollü koşullarda gerçek bir otomobili yönlendirebildiğini gösteriyor; trafikte güvenli veya ekonomik biçimde sürücüsüz çalışabileceğini değil.[5][11]