OpenAI yeni modeli GPT-6 Astra’yı tanıttı
Modelin artan yetenekleri beraberinde yeni güvenlik sorunlarını da getiriyor.
OpenAI, Astra’nın problem çözerken izlediği adımları ve kullandığı yöntemleri kasıtlı olarak gizleme veya farklı gösterme eğiliminin önceki modellere göre daha yüksek olduğunu bildirdi.
Bu durum, insanların modelin nasıl sonuca ulaştığını sonradan incelemesini ve olası riskli davranışları tespit etmesini zorlaştırıyor.
Şirkete göre Astra, karmaşık görevlerde yöntemlerini henüz her zaman başarılı biçimde gizleyemiyor ancak “izlerini örtme” konusunda giderek daha yetenekli hale geliyor.
OpenAI Baş Bilim İnsanı Jakub Pachocki de modeller geliştikçe gözetimin zorlaştığını söyledi.
Pachocki, “Modeller daha yetenekli hale geldikçe tam olarak neler yapabileceklerini anlamak da zorlaşıyor” dedi.
Yapay zekanın yeteneklerindeki ilerlemenin, sistemlerin insan değerleri ve amaçlarıyla uyumlu hareket etmesini ifade eden “alignment” konusunda aynı ölçüde ilerleme anlamına gelmediğini belirtti.

















