Yapay zeka araştırmacıları geçen yıl boyunca ilgi çekici bir öneriyle uğraştı: Modeller nasıl çalıştıkları hakkında daha az bilgi açıkladıklarında daha güçlü hale gelebilir ve çalıştırması daha ucuz olabilir. Bu dengeleme riskli, çünkü insanların sistemlerin zararlı bir şey yapmadığını denetlemesi zorlaşır. Öte yandan bu durum ticari bir avantaj da sağlar.
OpenAI İcra Kurulu Başkanı Sam Altman, bu avantajın peşinden gitmeye değer olduğuna karar vermiş gibi görünüyor. Güvenliği önceliklendireceğine dair yüksek sesli taahhütlere rağmen, yapay zeka geliştirmede daha tehlikeli bir yarışın startını verdi. OpenAI'nin yakın zamanda başlattığı yeni model Astra, akıl yürütmeyi insan dilinde açıkça yazmadan daha verimli kılabilen "recurrent depth" adı verilen bir yöntem kullandığı bildiriliyor. Şirket bir blog yazısında, Astra'yı izleme yeteneğinin önceki model GPT-5.6 Sol'a kıyasla "azaldığını" söyledi.
Mevcut modeller, bir isteği işlemek için attıkları adımlardan bazılarına dair bir pencere sunar. Gündelik dilde "düşünce zinciri" olarak bilinen bu mekanizma, araştırmacıların karar verme akışını anlamasına yardımcı olur. Bu yıl başlarında OpenAI ajanlarının Hugging Face sunucularına nasıl sızdığı da bu sayede ortaya çıktı. Bu içgörü olmadan bilim insanları, teknolojinin test cevaplarını nasıl çaldığını ya da davranışın nihayetinde ödül hileciliği tarafından yönlendirildiğini görmede çok daha zorlanırdı.