OpenAI, yeni yapay zekâ modeli O3’ün ARC-AGI kıyaslama testini muvaffakiyetle aştığını açıkladı.

OpenAI, geliştirdiği yeni yapay zekâ modeli O3’ün “genel zeka” testlerinde insan düzeyine ulaştığını iddia ediyor.
20 Aralık’ta gerçekleştirilen ARC-AGI kıyaslama testinde OpenAI’ın yeni O3 modeli %85 puan almayı başardı. Bu, evvelki en iyi yapay zekâ puanı olan %55’i büyük bir farkla bırakırken, aynı vakitte ortalama bir insanın performansıyla denk bir muvaffakiyet sağladı. Üstelik model, hayli zorlu matematik sorunlarında de etkileyici sonuçlar elde etti.
AGI nedir ve neden bu kadar önemli?

Yapay Genel Zekâ (AGI), insani düşünebilen, öğrenebilen ve farklı durumlara ahenk sağlayabilen bir yapay zekâ manasına gelir. AGI’ın başarılması, yapay zekâ araştırmalarında uzun müddettir en çok önemli konulardan biri olarak kabul ediliyor.
ARC-AGI testi, yapay zekânın az sayıda örnekle genelleme yapabilme yeteneğini ölçüyor. Örneğin sistemden bir dizi küçük tablo üzerindeki deseni anlaması ve bu deseni yeni bir duruma uyarlaması bekleniyor. Bu, insan zekâsını ölçmek için kullanılan IQ testleriyle neredeyse aynı.
O3 modeli bu başarıyı kendi başına mı elde etti?

Tabii şimdi bu noktada O3 modelinin bu muvaffakiyete nasıl ulaştığı tam olarak bilinmiyor. OpenAI’ın yeni modelini test için özel olarak optimize ettiği düşünülüyor. Uzmanlar ise O3’ün sırf bu teste mahsus “sezgisel” bir yaklaşım geliştirmiş olabileceğini ve bu yeteneklerin gerçek dünyadaki kapasitesini tam manasıyla yansıtmayabileceğini belirtiyor.
Eğer O3, iddia edildiğii testi başarılı bir şekilde aştıysa bu durum yapay zekânın geleceği için bir dönüm noktası olabilir. Basitçe özetlemek gerekirse buna kendini geliştirebilen yapay zekâ çağının başlangıcı da diyebiliriz.
Peki siz bu mevzu hakkında ne düşünüyorsunuz? Fikirlerinizi aşağıdaki yorumlar kısmından bizimle paylaşabilirsiniz.