Yapay Zeka

Anthropic'ten Geri Adım: Claude Code'daki Gizli Çinli Rakip Takip Kodları Kaldırılıyor!

Anthropic, kendi yapay zeka modellerinin kopyalanmasını önlemek amacıyla Claude Code'a gizlice entegre ettiği steganografik takip kodlarını, geliştirici topluluğunun tepkisi üzerine kaldırma kararı aldı.

Paylaş X'te paylaş

Yapay zeka geliştiricisi Anthropic, terminal tabanlı kodlama asistanı Claude Code içerisine gizlice yerleştirdiği ve modellerinin kopyalanmasını önlemeyi amaçlayan gizli takip kodlarını tamamen kaldıracağını açıkladı. Geliştirici topluluğu tarafından fark edilen bu gizli mekanizma, yazılımcıların güvenine dayalı bir araçta sinsi veri takibi yapıldığı gerekçesiyle sert eleştirilere maruz kalmıştı.

Anthropic'in Claude Code ekibinde yer alan mühendis Thariq Shihipar, bu özelliğin Mart ayında devreye alınan deneysel bir çalışma olduğunu belirterek, yetkisiz satıcıları engellemek ve model distilasyonunu (distillation - modellerin tekrarlı sorgularla kopyalanması) önlemek için tasarlandığını açıkladı. Mühendis, ekibin artık daha güçlü koruma mekanizmaları geliştirdiğini ve bu gizli kodları uzun süredir kaldırmayı planladıklarını ifade etti.

Steganografi ile Gizli Takip

"Thereallo" lakaplı bir yazılımcı tarafından ortaya çıkarılan detaylara göre Anthropic, Claude Code üzerinden sunucularına giden verilerin içine steganografi (plain text içine veri gizleme) yöntemiyle görünmez işaretçiler ekledi.

Söz konusu kodlar, kullanıcının API isteklerini yönlendirdiği proxy veya geçit (gateway) adreslerini ve sistem zaman dilimini gizlice kontrol ediyordu. Eğer varsayılan yönlendirme adresleri değiştirilmişse, sistem arka planda bu adreslerin bilinen Çinli yapay zeka laboratuvarları, hesap satıcıları veya yetkisiz aracı sitelerle eşleşip eşleşmediğini sorguluyordu. Bu sorguları yaparken de hedef listesini XOR ve base64 yöntemleriyle şifreleyerek geliştiricilerin gözünden kaçırmaya çalışmıştı.

Anthropic'in Model Kopyalamaya (Distilasyon) Karşı Savunma Yöntemleri

Her ne kadar Anthropic fikri mülkiyetini korumak istese de, geliştiriciler açık kaynaklı veya güven gerektiren araçlarda bu tür gizli yöntemlerin kullanılmasını kabul edilemez buldu. Sızan kaynak kodları, şirketin distilasyonla mücadele etmek için sadece steganografi değil, başka teknik bariyerler de kurduğunu gösteriyor:

Savunma Yöntemi Nasıl Çalışıyor? Amaç
Zehirli Veri Enjeksiyonu (Anti-Distillation Flag) Sorgu yapan şüpheli istemcilere kasıtlı olarak sahte/hatalı araç verileri enjekte eder. Kopyalanan modelin eğitim verisini bozmak (veri zehirleme).
Davranışsal Parmak İzi (Behavioral Fingerprinting) Kullanıcıların sorgu gönderme sıklığını ve modellerini analiz eder. Otomatik botları ve distilasyon yazılımlarını ayırt etmek.
Steganografik Unicode İşaretçileri Düz İngilizce cümlelerin içine görünmez karakterler yerleştirerek proxy durumunu sunucuya iletir. Yetkisiz aracı sunucuları (resellers) gizlice tespit etmek.

Son güncelleme ile steganografi kodlarının tamamen kaldırıldığı ve Claude Code istemcisinin artık kullanıcılarına karşı daha şeffaf bir yapıya kavuştuğu bildirildi. Ancak Anthropic, bulut sağlayıcıları ve hükümetleri yapay zeka modellerinin sınır ötesi kopyalanmasına karşı daha sıkı yasal önlemler almaya çağırmaya devam ediyor.

Kaynak: The Register

Mr.Nobody
Yazar

Mr.Nobody

Tüm yazılar Tüm yazılar
Haber Sayısı 275 haber
Görüntülenme Sayısı 9.284 görüntülenme
Okur katılımı

Yorumlar

Yorum İkonu Yorum Yazın

Bu habere henüz yorum yapılmadı.

Görünüm Okuma ayarları
Yazı boyutu