112dijital Gündem
yükleniyor…
TechCrunch·

Anthropic, yapay zeka ajanlarını güvenilir biçimde kontrol edemiyor; iç değerlendirmelerini canlı internetten kesiyor

Orijinal başlık: Anthropic can’t reliably control its AI agents. It’s cutting off its internal evals from the live internet instead

Kısaca

Anthropic, "tüm iç değerlendirmeleri" için "canlı internet erişimini kapattıklarını" ve bu kararın yeni bir duyuruya kadar geçerli olacağını açıkladı.

Ne oldu?

  • Şirket, ajanların canlı internete eriştiği iç değerlendirme (eval) süreçlerini süresiz olarak durdurdu.
  • Karar, ajan davranışlarının canlı ortamda güvenilir şekilde kontrol edilememesinden kaynaklanıyor.

Neden önemli?

Yapay zeka ajanları geliştiren veya üretimde kullanan ekipler, önde gelen bir laboratuvarın bile ajanları canlı ortamda tam kontrol edemediğini görerek test ve güvenlik politikalarını gözden geçirmeli.