Anthropic‘in yeni yapay zeka modeli Claude Opus 5.5, hem hız hem maliyet açısından bir önceki sürümü geride bıraktı. Şirket, modeli salı günü duyurdu; Opus 5.5’in en üst seviye model olan Fable ile benzer performans sunarken çalıştırma maliyetini yüzde 40 düşürdüğünü açıkladı. Yeni model, Temmuz ayında piyasaya sürülen Opus 5’in ardından yaklaşık iki ay sonra geldi ve Anthropic’in güncelleme temposuyla örtüşüyor.
Anthropic’in Claude ailesinde üç ana katman bulunuyor: en küçük ve ucuz model Haiku, orta seviye Sonnet ve en güçlü, en pahalı model Opus. Bunların üzerinde ise şirketin en üst seviye modeli olan Fable (Mythos) yer alıyor. Şirket, Sonnet 5.5 ve Haiku 5.5 modellerinin de “önümüzdeki haftalarda” benzer iyileştirmelerle kullanıma sunulacağını duyurdu.

Kodlama testlerinde çarpıcı sonuçlar
Anthropic’e göre erken test kullanıcıları, karmaşık işlerde büyük performans sıçramaları gözlemledi. Bir test kullanıcısı, mühendislik ekibinin haftalar süreceği 680.000 satırlık bir kod taşıma işlemini bir günden kısa sürede tamamladı. Model, bir web uygulamasının tüm sayfalarında yükleme sürelerini kısaltma görevinde 40 denemenin 39’unda başarılı oldu; Opus 5 ise daha küçük iyileştirmeler yaparken uygulamanın davranışını da bozmuştu. 200.000 satırlık bir kod tabanını denetleyip düzeltme görevini Opus 5.5, üç saatten kısa sürede tamamlarken, Opus 5 bu iş için 20 saatten fazla zaman ve 2,5 kat daha fazla token harcamıştı.
Bunlar da İlginizi Çekebilir
Şirketin iç testlerinde, sunucular arası trafik yükünü dengeleyen HAProxy yazılımının C dilinden Rust’a çevrilmesi istendiğinde Opus 5.5, işi 9,5 saatte tamamlayıp yüzde 51 daha az maliyet çıkarırken, Fable 5.1 aynı işi 12 saatte bitirdi. Anthropic ayrıca Opus 5.5’in FrontierCode testinde GPT-6 Astra’yı yaklaşık beşte bir maliyetle geçtiğini, Terminal Bench 4.0’da ise aynı performansı yüzde 40 maliyetle yakaladığını belirtti. CursorBench’te de GPT-5.6 Sol’u 11 puan farkla geride bıraktı.
Fiyatlar düştü, güvenlik önlemleri sıkılaştı
Opus 5.5’in giriş ve çıkış token fiyatları sırasıyla milyon başına 4 dolar ve 20 dolar oldu; bu, Opus 5’e göre yüzde 20’lik bir indirime denk geliyor. Önbellek okumaları ise milyon token başına 0,20 dolara indi, yani yüzde 60 daha ucuz. Anthropic, Pro, Max ve Team abonelik planlarındaki beş saatlik kullanım limitlerini artırdığını ve kullanıcıların kota sıfırlamasını istedikleri zaman kullanabileceğini duyurdu.
Güvenlik tarafında Anthropic, Opus 5.5’in biyoloji ve siber güvenlik yeteneklerinin Fable modeliyle karşılaştırılabilir düzeyde olduğunu, bu nedenle aynı koruma önlemlerine tabi tutulduğunu belirtti. Model, METR ve Frontier Design gibi bağımsız kuruluşlar tarafından yayın öncesi test edildi ve şirketin kapsamlı uyum testinde şimdiye kadarki en yüksek skoru aldı. Bu sürüm, CEO Dario Amodei‘nin yapay zeka geliştirme hızının güvenlik çalışmalarıyla eşleşmesi gerektiğini savunduğu “sınırı yavaşlatma” çağrısından sonra yayınlanan ilk model olma özelliği taşıyor. Anthropic ayrıca modelin test ortamından kaçma girişimleri gibi riskli davranışlara karşı önlemlerini güçlendirdi; bu adım, çeşitli yapay zeka şirketlerinin modellerinin test sırasında kontrolden çıkıp üçüncü taraf sistemlere sızdığı yönündeki son haberlerin ardından geldi. Şirketin Sonnet ve Haiku ailesindeki 5.5 sürümlerinin tam olarak ne zaman kullanıcılara sunulacağı ve bu güvenlik önlemlerinin gelecekteki modellere nasıl yansıyacağı henüz netlik kazanmadı.
Kaynaklar:



YORUMLAR
(0)