Yapay zeka güvenliği ve büyük dil modelleri geliştiren Anthropic, amiral gemisi model ailesinin en yeni üyesi Claude 4.5 Sonnet'i tanıttı. Önceki sürümlere kıyasla mantık yürütme, matematiksel problem çözme ve otonom yazılım geliştirme performansında önemli bir sıçrama gerçekleştiren model, yapay zeka sektöründe yeni standartları belirliyor.

Kodlama ve Bilgisayar Kullanımında (Computer Use) Rekor Başarı

Claude 4.5 Sonnet, karmaşık yazılım projelerini analiz etme, hataları tespit edip düzeltme ve doğrudan işletim sistemi arayüzü üzerinden otonom görevler yürütme yetenekleriyle öne çıkıyor. Model, SWE-bench deneme testlerinde %68 başarı oranına ulaşarak liderliğini ilan etti.

  • Gelişmiş Mantık Yürütme: Çok adımlı stratejik karar alma ve bilimsel makale sentezi.
  • Doğrudan Bilgisayar Kontrolü: Ekran okuma, fare tıklamaları ve klavye girdileriyle masaüstü uygulamalarını çalıştırma.
  • Düşük Gecikmeli API: Kurumsal entegrasyonlar için yanıt sürelerinde %40 hızlanma.

Geliştiriciler ve İş Dünyası İçin Erişime Açıldı

Anthropic, Claude 4.5 Sonnet'in hem Claude.ai web arayüzü hem de API kanalından geliştiricilere sunulduğunu açıkladı. Şirket, modelin güvenilirlik ve halüsinasyon engelleme testlerinde en yüksek skoru aldığını belirtti.