Anthropic Claude Fable 5.1 ve Mythos 5.1’i Duyurdu
Anthropic Claude Fable 5.1 ve Mythos 5.1’i Duyurdu!
Anthropic, Claude ailesinin yeni modelleri Fable 5.1 ve Mythos 5.1’i kullanıma sundu. Uzun süreli kodlama, agentic görevler, bilgi çalışmaları ve bilimsel araştırmalarda önemli performans artışları vadeden yeni nesilde Fable 5.1 genel kullanıma açılırken, Mythos 5.1 gelişmiş siber güvenlik ve yaşam bilimleri çalışmaları için doğrulanmış kurumlarla sınırlı tutuluyor. Anthropic ayrıca yoğun ajan iş yüklerinde maliyetin Fable 5’e kıyasla yüzde 45’e kadar azalabileceğini açıkladı.
Anthropic, yapay zeka modellerinin yalnızca bir soruyu yanıtlamaktan çıkıp saatlerce hatta günlerce süren görevleri kendi başına yürütebildiği yeni döneme yönelik iki modelini duyurdu.
Claude Fable 5.1 kodlama, kurumsal bilgi işleri, araştırma ve uzun süreli problem çözmeye odaklanırken, Claude Mythos 5.1 daha kontrollü erişim altında siber güvenlik ve yaşam bilimlerinin ileri kullanım alanlarına açılıyor.
Ancak iki model arasında klasik anlamda bir “daha güçlü model” ayrımı bulunmuyor. Anthropic, Fable 5.1 ile Mythos 5.1’in aynı temel model olduğunu, temel farkın uygulanan güvenlik kısıtlamalarının seviyesinden kaynaklandığını belirtiyor. Fable 5.1 genel kullanıma açıkken Mythos 5.1, belirli profesyonel araştırma çalışmalarına daha geniş erişim sağlayan güvenlik politikalarıyla yalnızca doğrulanmış kullanıcı ve kuruluşlara sunuluyor.
Uzun süreli görevlerde Fable 5.1 öne çıkıyor
Fable 5.1’in en dikkat çekici taraflarından biri, uzun süre boyunca kesintisiz çalışması gereken agentic görevlerdeki performansı.
Anthropic, modelin uzun ve çok adımlı görevlerde önceki Fable 5’e göre daha yüksek performans gösterdiğini, kendi ilerlemesini takip edebildiğini ve bir görevin farklı aşamalarını daha az insan müdahalesiyle sürdürebildiğini belirtiyor.
Erken erişim sürecinde modeli deneyen şirketlerin paylaştığı sonuçlar da bu kullanım alanına odaklanıyor.
Shopify, modelin uzun süre devam eden iş akışlarında kendi kayıtlarını tutabildiğini, değişen koşullara göre önceliklerini yeniden düzenleyebildiğini ve kaldığı noktadan devam edebildiğini aktardı.
Ramp ise bir makine öğrenmesi problemi üzerinde modelin 38 saat boyunca gözetimsiz çalıştığını, sorunu analiz edip paralel deneyler başlattığını ve sonuçlarla geri döndüğünü belirtti.
Bu örnekler, yapay zeka ajanlarında rekabetin yalnızca bir modelin tek soruya verdiği cevabın doğruluğundan uzaklaştığını gösteriyor. Yeni performans ölçütü giderek modelin bir işi ne kadar uzun süre kendi başına takip edebildiği, değişikliklere uyum sağlayabildiği ve çıktısını doğrulayabildiği üzerinden şekilleniyor.
Kodlamada CursorBench skoru yüzde 73,4’e çıktı
Anthropic’in yayımladığı testlerde Fable 5.1 kodlama alanında da önceki neslin üzerine çıkıyor.
Model, agentic coding performansını değerlendiren CursorBench 3.2.0’da yüzde 73,4 skor elde etti. Fable 5 aynı testte yüzde 70,5, Opus 5 ise yüzde 70 seviyesinde kaldı.
Terminal-Bench 4.0’da Fable 5.1 yüzde 55,8 sonuç verirken, daha esnek siber güvenlik politikalarıyla çalışan Mythos 5.1’in skoru yüzde 60,9’a ulaştı. Anthropic, iki model arasındaki farkın temel modelden değil, güvenlik filtrelerinin bazı görevlerde devreye girip girmemesinden kaynaklandığını belirtiyor.
Fable 5.1’in önemli değişikliklerinden biri de yazılım açıklarını tespit etmek amacıyla kullanılabilmesi.
Yeni güvenlik sistemi, savunma amaçlı yazılım güvenliği çalışmalarında önceki sürüme göre daha az müdahalede bulunuyor. Anthropic, Claude Code oturumlarında siber güvenlik filtrelerinin gereksiz devreye girme oranının yaklaşık yüzde 60 azalacağını açıkladı.
Penetrasyon testi, exploit geliştirme ve ikili dosyalarda ileri seviye açık taraması gibi çift kullanımlı görevler ise daha kontrollü modellere yönlendirilmeye devam edecek.
Agentic iş akışlarında maliyet yüzde 45’e kadar düşüyor
Fable 5.1 yalnızca performans artışıyla gelmiyor. Anthropic, özellikle uzun bağlam kullanan agentic sistemlerin maliyetini azaltacak yeni bir fiyatlandırma da devreye aldı.
Modelin standart API fiyatı değişmedi:
1 milyon input token için 10 dolar,
1 milyon output token için 50 dolar.
Ancak daha önce işlenmiş bağlamın tekrar kullanılmasını sağlayan cache read fiyatı yüzde 75 düşürülerek 1 milyon token için 0,25 dolara indirildi.
Anthropic’in hesaplamasına göre bu değişiklik tipik Fable iş yüklerinde toplam maliyeti yaklaşık yüzde 25, yoğun araç kullanımı ve uzun context gerektiren agentic işlerde ise yüzde 45’e kadar azaltabiliyor.
Bu maliyet değişimi özellikle sürekli doküman, kod tabanı veya kurumsal veri üzerinde çalışan AI ajanları için önemli. Çünkü ajanların uzun görevlerde aynı bağlamı tekrar tekrar okuması toplam token maliyetinin büyük bölümünü oluşturabiliyor.
Bilimsel araştırma Claude’un yeni kullanım alanlarından biri
Anthropic yeni modellerin duyurusunda bilimsel araştırmaya özel bir ağırlık verdi.
Fable 5.1’in NASA’nın yaklaşık 30 yıl önceki Magellan görevi sırasında topladığı radar verilerini kullanarak Venüs yüzeyinin yaklaşık üçte birine ilişkin yeni yüksek çözünürlüklü bir yükseklik haritası oluşturduğu açıklandı.
Anthropic’e göre mevcut haritalarda 10–20 kilometre seviyesinde görülebilen bazı ayrıntılar yeni çalışmada 2–3 kilometre seviyesine kadar indirildi ve yükseklik ölçümlerindeki doğruluk yüzde 25’e kadar artırıldı. Oluşturulan harita yaklaşan NASA VERITAS ve ESA EnVision görevleri öncesinde açık lisansla yayımlandı.
Mythos 5.1 ise protein tasarımı deneylerinde kullanıldı.
Anthropic, model tarafından tasarlanan bazı protein bağlayıcıların mevcut yarışmalardaki en iyi tasarımlardan 10 kat daha yüksek bağlanma afinitesi gösterdiğini ve 12 hedef üzerinde test edilen tasarımlarda başarılı bağlayıcı oranının yaklaşık yüzde 50’ye ulaştığını açıkladı.
Mythos 5.1 herkese açılmıyor
Anthropic, Mythos 5.1’in gelişmiş yetenekleri nedeniyle genel kullanıma sunulmamasına karar verdi.
Model şu anda doğrulanmış siber güvenlik uzmanları ile yaşam bilimleri araştırmacılarına yönelik iki kontrollü erişim programı üzerinden kullanılabilecek.
Cyber Verification Program, savunma amaçlı güvenlik çalışmalarında daha esnek siber güvenlik kısıtlamalarına erişim sağlıyor.
Life Sciences Verification Program ise profesyonel yaşam bilimleri araştırmalarına yönelik daha geniş model yeteneklerini açıyor.
Anthropic, ikinci programı ABD hükümetiyle birlikte geliştirdiğini ve ilk katılımcıların sisteme dahil edildiğini açıkladı. Mythos 5.1 şu aşamada belirli ABD merkezli kuruluşlarla sınırlı. Uluslararası erişimin ilerleyen dönemde genişletilmesi planlanıyor.
Şirketin kod tabanlarını güvenlik açıkları açısından tarayan Claude Security çözümü de artık Mythos 5.1 üzerinde çalışıyor.
Kurumsal veriler müşterinin kendi bulutunda tutulabilecek
Yeni model duyurusuyla birlikte Anthropic, kurumsal yapay zeka kullanımında uzun süredir tartışılan veri gizliliğine yönelik Enterprise Frontier Safeguards sistemini de açıkladı.
Bu modelde müşteri verileri Anthropic altyapısında tutulmak yerine kuruluşun kontrol ettiği kendi bulut ortamında saklanabilecek.
Anthropic, sistemi finansal hizmetler, sağlık, üretim, telekom, hukuk, perakende ve kamu sektörlerinden 100’den fazla kuruluşla birlikte geliştirdiğini belirtiyor.
Enterprise Frontier Safeguards’ın Claude Code, Claude Enterprise ve Claude Platform’un yanı sıra Amazon Bedrock, AWS, Google ve Microsoft’un kurumsal yapay zeka platformlarında aşamalı şekilde kullanıma açılması planlanıyor.
Fable 5.1 AWS, Google Cloud ve Microsoft üzerinden de sunuluyor
Claude Fable 5.1 kullanıma açılmış durumda.
Model Claude’un kendi ürünleri ve API’sinin yanında Amazon Web Services, Google Cloud ve Microsoft Azure üzerinden de erişilebilir durumda.
Geliştiriciler API tarafında claude-fable-5-1 modelini kullanabiliyor.
Fable 5.1 ayrıca Claude Pro, Max, Team ve Enterprise kullanıcılarının erişimine açıldı.
Bu dağıtım modeli özellikle kurumsal şirketler açısından önemli. Şirketler kendi bulut altyapılarındaki uygulamalara Claude’u entegre ederek yeni modeli mevcut veri ve güvenlik politikaları içerisinde çalıştırabilecek.
Yeni rekabet alanı uzun süre çalışan AI ajanları
Fable 5.1 duyurusundaki en önemli değişim, benchmark skorlarının ötesinde modelin nasıl konumlandırıldığı.
Anthropic yeni nesli tek seferlik soru-cevap modelinden çok uzun süre çalışan bir dijital çalışma sistemi olarak tasarlıyor.
Kod tabanını baştan sona inceleyen, farklı servislerdeki bağlantıları takip eden, saatler boyunca deney yürüten, kendi ilerlemesini kaydeden ve gerektiğinde önceliklerini değiştiren ajan kullanım senaryoları yeni modelin merkezinde.
Bu dönüşüm kurumsal yapay zeka pazarında da rekabeti değiştirebilir.
Şirketler açısından ölçüm giderek “en zeki model hangisi?” sorusundan bir işi ne kadar az insan müdahalesiyle, hangi maliyetle ve ne kadar güvenilir biçimde tamamlayabiliyor? sorusuna kayıyor.
Fable 5.1’de cache maliyetlerinin düşürülmesi de bu nedenle model performansı kadar önemli. Agentic sistemlerin ekonomik olarak ölçeklenebilmesi, uzun süreli görevlerin token maliyetinin kontrol altında tutulmasına bağlı.
Anthropic’in Fable 5.1 ile verdiği mesaj bu açıdan net: Bir sonraki model yarışı yalnızca daha iyi cevap üretmek üzerinden ilerlemeyecek. AI ajanlarının saatler ve günler boyunca gerçek işleri sürdürebilmesi, kurumsal yapay zekanın yeni rekabet alanlarından biri olacak.



