Yapay zeka dünyasının öncü isimlerinden Anthropic, orta segmentteki popüler modeli Claude Sonnet'in en son sürümü olan Sonnet 5.0'ı resmi olarak piyasaya sürdü. Şirket, yeni modelin şimdiye kadar geliştirdikleri en gelişmiş "aracı tabanlı" (agentic) yapay zeka modeli olduğunu iddia ediyor.
Yazılım geliştiriciler ve iş akışlarını otomatikleştirmek isteyen ekipler için tasarlanan Claude Sonnet 5.0; mantık yürütme (reasoning), araç kullanımı (tool use), kodlama (coding) ve profesyonel bilgi çalışmaları alanlarında devasa performans artışları vaat ediyor. Ayrıca modelin, Anthropic'i zor durumda bırakacak anlama hatalarından ve mantık boşluklarından büyük oranda arındırıldığı belirtiliyor.
Daha Güvenli, Daha Kararlı ve Daha Bağımsız
Anthropic tarafından yayınlanan sistem kartı (System Card) raporuna göre, Claude Sonnet 5.0 sürümü önceki 4.6 sürümüne kıyasla çok daha kararlı çalışıyor. Yapılan güvenlik testlerinde modelin, kötü niyetli istekleri reddetme ve komut enjeksiyonu (prompt injection) girişimlerine karşı direnç gösterme konusunda çok daha akıllı hale geldiği gözlemlendi.
Bununla birlikte, eski modellerde sıkça rastlanan ve kullanıcının fikirlerini sürekli onaylayarak yaranmaya çalışma davranışı (sycophancy) ile bilgi uydurma (hallucination) oranları da ciddi ölçüde düşürüldü.
Maliyet Etkinliğinde Opus Kalitesi
Kullanıcılar ve işletmeler için en büyük müjdelerden biri ise maliyet tarafında yaşandı. Yapılan testler, Claude Sonnet 5.0 modelinin performansının Anthropic'in en üst düzey kurumsal modeli olan Opus 4.8'e oldukça yaklaştığını, buna karşın görevleri çok daha düşük maliyetle tamamlayabildiğini gösteriyor.
Aşağıdaki tabloda Anthropic'in farklı modellerine ait token maliyetlerini inceleyebilirsiniz:
| Yapay Zeka Modeli | Girdi Token Maliyeti (1 Milyon Adet) | Çıktı Token Maliyeti (1 Milyon Adet) | Durum / Kampanya |
|---|---|---|---|
| Claude Opus 4.8 | $5.00 | $25.00 | Standart Fiyatlandırma |
| Claude Sonnet 5.0 (Ağustos Sonu) | $2.00 | $10.00 | Lansmana Özel İndirim |
| Claude Sonnet 5.0 (Eylül İtibarıyla) | $3.00 | $15.00 | Standart Fiyatlandırma |
Ayrıca yeni sürümle birlikte geliştiricilere modelin çalışma eforunu (effort settings) ayarlama seçeneği sunuluyor. Basit işler için düşük efor modları seçilerek token tasarrufu sağlanabilirken, uzun soluklu ve karmaşık aracı görevleri için model "xhigh" ya da "max" seviyede tam kapasite çalıştırılabiliyor.
Siber Güvenlik Tartışmalarından Kasıtlı Kaçış
San Francisco merkezli şirket, Washington'daki politika yapıcıların ve düzenleyici kurumların tepkisini çekmemek adına temkinli bir yol izliyor. Geçtiğimiz Haziran ayında ABD Ticaret Bakanlığı, ulusal güvenlik endişelerini gerekçe göstererek Anthropic'in en yeni Mythos 5 ve Fable 5 modellerine geçici ihracat kısıtlamaları getirmişti.
Benzer bir durumla karşılaşmak istemeyen Anthropic, Claude Sonnet 5.0 modelini siber güvenlik görevleri üzerine kasıtlı olarak eğitmediğini vurguladı. Model, rutin güvenlik kontrollerini gerçekleştirebilse de saldırgan exploit kodları (Firefox açığı gibi) üretmesi istendiğinde güvenlik bariyerlerine takılarak işlemi tamamlamayı reddediyor.
Claude Sonnet 5.0; Claude Free ve Pro kullanıcıları için varsayılan model haline gelirken, aynı zamanda Max, Team ve Enterprise kurumsal müşterilerinin de kullanımına açılmış durumda.
Kaynak: The Register
Bu habere henüz yorum yapılmadı.