OpenAI, endişeler nedeniyle bazı ileri seviye “RL” eğitimlerini durdurdu
OpenAI, şirket içindeki modellerin siber güvenlik alanında tehlikeli derecede güçlü hale geldiğini görünce, gelişmiş modeller üzerinde yürüttüğü büyük RL (Reinforcement Learning yani en temel haliyle modele yaptığı davranışların sonucuna göre ödül veya ceza benzeri bir geri bildirim vererek hangi davranışların daha iyi olduğunu öğretmek) eğitim süreçlerinden bazılarını geçici olarak durdurma kararı aldı. Bu önemli adım hakkında yaptığı açıklamada OpenAI CEO’su Sam Altman, “Yeni modellerin kapasitesine uyum sağlayabilmek ve güvenlik standartlarını karşılayabildiğimizden emin olmak için bazı öncü RL eğitimlerini duraklattık. Gelişim artık çok hızlı ilerliyor ve model yeteneklerinin güvenlik ve uyum çalışmalarının ilerleme hızını aştığını düşündüğümüz takdirde harekete geçeceğimizi uzun zamandır söylüyoruz. Yapay zeka sistemlerinin güvenliğini son derece önemsiyoruz. Tüm sektörün ortak güvenlik standartları üzerinde bir araya gelmesi gerektiğine inanıyoruz ancak bu gerçekleşene kadar gerektiğinde tek taraflı olarak da harekete geçmekten çekinmeyeceğiz. Yürüttüğümüz uyum çalışmalarına iyimser yaklaşıyoruz ve öncü düzeydeki yetenekleri geniş çapta erişilebilir hale getirme konusundaki kararlılığımızı sürdürüyoruz.” ifadelerini kullandı. […]
DEVAMI












