Anthropic öncü güvenlik taahhüdünden vazgeçti: Neler değişti ve bu neden önemli?

özet

  • Anthropic güvenlik taahhüdünü yumuşattı.
  • Şirketin daha önce uyguladığı katı geliştirme yasağı, artırılmış şeffaflık vaadiyle değiştirildi.
  • Bu hamle, sektördeki güvenlik standartlarını düşürebilir.

Yapay zekâ ajanı Claude'un (bir tanesi) üreticisi Anthropic En sevdiğimiz verimlilik araçlarıEn önemli özelliklerinden biri, güvenliğe olan sarsılmaz bağlılığıdır. Blog yazısıŞirket, Sorumlu Genişleme Politikası'nı (RSP) ve 3.0 sürümünde yer alan değişiklikleri açıkladı.

Anthropic öncü güvenlik taahhüdünden vazgeçti: Neler değişti ve bu neden önemli?

Anthropic'in eski güvenlik politikası neydi?

Şirket, güvenlik garantileri konusunda sektörde bir standart belirlemiştir.

Anthropic'in yaptığı değişiklikleri anlamak için, şirketin orijinal Sorumlu Ölçeklendirme Politikası'nı (RSP) anlamanız gerekiyor. 2023 yılında Anthropic, yapay zeka modellerinin yetenekleri, şirketin bunların güvenli olduğunu kanıtlayabilme kapasitesini aşarsa, bu modellerin eğitimini durdurma sözü vermişti. Bu durdurmayı tetikleyebilecek güvenlik açısından kırmızı bayraklar şunlardı:

  • Kimyasal, biyolojik veya nükleer silahların üretilmesine veya konuşlandırılmasına yardımcı olabilecek modeller.
  • Kendilerini aşırı derecede geliştirebilen modeller.
  • Siber saldırılarda yardımcı olabilecek modeller.
  • İnsan müdahalesi olmadan belirli şekillerde davranabilen modeller, örneğin kapatılmaktan kaçınmak için ortamlarından "kaçabilenler".

Sorumlu Genişleme Politikası (RSP), bu modellere katı bir sınır getirdi; Anthropic, rakipleri tarafından geçilme pahasına bile olsa geliştirmeyi durduracaktı. Herkesin baş döndürücü bir hızla yarıştığı bir sektörde bu cesur bir duruştu.

Anthropic'in yeni Sorumlu Genişleme Politikası (RSP)

3.0 sürümü kuralları önemli ölçüde gevşetiyor.

Anthropic hâlâ sorumlu genişleme politikasına sahip, ancak 3.0 sürümüyle birlikte şirket, yalnızca rakiplerine göre önemli bir üstünlüğe sahip olduğuna inanırsa geliştirmeyi durduracak. Durdurma yönündeki bağlayıcı söz, şirketin güvenlik hedeflerine ulaşıp ulaşmadığı ve rakiplerinin güvenlik standartlarını karşılayıp karşılamadığı veya aşıp aşmadığı konusunda şeffaflık sözüyle değiştirildi. Başka bir deyişle, esasen bir güvenlik taahhüdünde bulundu.

Bu değişikliklere ne sebep oldu? Anthropic, orijinal Güvenlik Taahhüdü'nün (RSP) istenen etkiyi yaratmadığını söylüyor. RSP, diğer şirketlerin izleyeceği bir güvenlik örneği oluşturmayı amaçlıyordu. Ne yazık ki, rakipler bu sinyale kulak asmadı. Şirket, kendi çabalarını sınırlayarak, güvenlik konusunda daha az bilinçli rakiplerin pazara hakim olmasına ve gelişme hızını belirlemesine izin verdiğini düşünüyor.

Bu durum sektör için ne anlama geliyor?

Büyük bir geri adım

Ne yazık ki, bu değişiklikler yapay zeka alanında kötü bir emsal oluşturabilir. Anthropic, güvenlik uygulamaları konusunda altın standarttı ve bu değişikliklerle çıta önemli ölçüde düşürüldü. Bu, rakiplere güvenliğin inovasyondan sonra geldiği mesajını verebilir. Bu durum Claude'a yardımcı olabilirken... ChatGPT ile ilgili gelişmeleri takip etmekAncak bu yine de yanlış yönde atılmış bir adım gibi görünüyor.

Sonuç olarak, yapay zekâ kötümserlerinin korkularını gidermek istiyorsak, tek bir şirketin güvenlik taahhüdü yeterli olmayacak; tüm sektörün birleşmesi ve net bir tavır sergilemesi gerekiyor. Bu aşamada, bunun gerçekleşmesi giderek daha az olası görünüyor.

Üst düğmeye git