Anthropic'tan bir güvenlik araştırmacısı, yapay zekanın bir onbaşı ihtimalle insanı yok etme riskine sahip olduğunu uyarıyor. Evan Hubinger, X paylaşımlarında mevcut modellerin riski düşük olsa da, teknoloji kendi kendini geliştirmeye başlayabildiğinde bu risk artacağını ifade etti.
Haber, Financial Times'in raporuyla pekişti; Anthropic'ın son modeli AI Güvenlik Enstitüsü'ne sunulmadı. Hubinger, AI'nın tür sonu riski oluşturduğunu vurgulayarak, şirketin hizmet sağlamaya çalışsa da superintelligence için hizmet uyumu sorununun çözülemediğini ve yol haritada ilerleme olmadığını söyledi.
Bu uyarı, OpenAI, Google Deepmind ve Anthropic başkanlarının 2023'te yaptığı uyarılardan daha somut hale geliyor. Yaz yazın, AI ajanları tarafından yapılan siber saldırılar ve OpenAI'nın chief scientist'ın 'humans remaining in control' uyarısı gibi gelişmeler, riskin artığını gösteriyor. 1300 personelin imzası olan bir açık mektup, US hükümetinin otomasyonun sınırlandırılması için girişim geliştirmesini istedi.
