Anthropic’ten iki yeni Claude modeli: Fable 5.1 ve Mythos 5.1 sahnede

Haberler · Yapay Zeka

Anthropic’ten iki yeni Claude modeli: Fable 5.1 ve Mythos 5.1 sahnede

Admin · 02.09.2026 05:47 · 16 görüntülenme

Anthropic, Claude ailesini iki güçlü modelle genişletti. Claude Fable 5.1 kodlama, bilgi işleri ve uzun süreli agentic görevlerde ciddi performans artışı getirirken, Claude Mythos 5.1 aynı temel modeli daha farklı güvenlik katmanlarıyla siber güvenlik ve ileri bilimsel araştırmalara taşıyor. Üstelik iki model aslında aynı temel yapıyı kullanıyor; esas fark kullanım alanı ve güvenlik sınırlarında ortaya çıkıyor.

Anthropic Claude ailesine iki yeni model ekledi

Yapay zekâ yarışında modeller artık yalnızca daha iyi soru cevaplamak için geliştirilmiyor. Kod yazmak, araştırma yapmak, bilgisayar kullanmak ve saatler boyunca kendi başına çalışmak yeni rekabet alanına dönüşmüş durumda.

Anthropic de bu yarışın yeni oyuncularını Claude Fable 5.1 ve Claude Mythos 5.1 adıyla sahneye çıkardı.

Şirket Fable 5.1’i kodlama, bilgi işleri ve uzun süreli problem çözme tarafındaki en gelişmiş modellerinden biri olarak konumlandırıyor. Mythos 5.1 ise aynı temel modelin daha özel güvenlik mekanizmalarına sahip sürümü.

Buradaki önemli ayrıntı şu: Fable 5.1 ile Mythos 5.1 iki tamamen farklı temel model değil. Anthropic açıkça ikisinin aynı modeli kullandığını, farkın uygulanan güvenlik katmanlarından kaynaklandığını söylüyor.

Fable 5.1 kodlamada ciddi bir sıçrama yapıyor

Anthropic’in yayınladığı testlere göre Fable 5.1 özellikle agentic coding, yani modelin kendi başına plan yaparak terminal ve geliştirme araçlarını kullandığı görevlerde önceki sürümün belirgin şekilde önüne geçiyor.

Terminal-Bench 4.0 testinde Fable 5.1 yüzde 55,8 seviyesine ulaşırken, önceki Fable 5 yüzde 42 seviyesinde kalıyor. Mythos 5.1 ise aynı testte yüzde 60,9 skor elde ediyor.

Bilimsel araştırmayı terminal ve araç kullanımıyla birleştiren Terminal-Bench-Science 0.1 testindeki fark daha da büyük.

Fable 5.1 burada yüzde 52,6 başarı gösteriyor. Önceki Fable 5 yüzde 24,7, Claude Opus 5 ise yüzde 29 seviyesinde kalıyor.

Kısacası Fable 5.1’in asıl gücü kısa bir kod parçası üretmekten çok, uzun ve karmaşık görevleri baştan sona takip etmekte ortaya çıkıyor.

Yıllardır bulunamayan yazılım hatasını tespit etti

Anthropic’in paylaştığı gerçek kullanım örneklerinden biri oldukça dikkat çekici.

Yatırım şirketi Millennium’un sistemlerinde yaklaşık milyonda bir kez ortaya çıkan ve mühendislerin dört-beş yıldır nedenini açıklayamadığı nadir bir çökme bulunuyordu.

Şirkete göre Fable 5.1 dışarıdan kullanılan bir kütüphaneyi analiz etti, core dump verisini inceledi ve problemi söz konusu kütüphanedeki bir hataya kadar takip etmeyi başardı. Önceki modeller aynı problemi çözememişti.

Bu tarz örnekler benchmark puanlarından daha ilginç olabilir.

Çünkü gerçek dünyada geliştiricinin istediği şey modelin kod testi çözmesinden çok, yüz binlerce satırlık bir projede hatanın nereden çıktığını bulabilmesi.

AI ajanları saatler boyunca çalışabilecek

Fable 5.1’in öne çıkan diğer tarafı uzun süreli görevler.

Anthropic’in erken kullanıcılarından Ramp, modelin bir makine öğrenmesi problemi üzerinde 38 saat boyunca gözetimsiz çalıştığını belirtiyor.

Model bu süreçte önceki bir sonucun hatalı etiketlerden kaynaklandığını tespit etmiş, problemi düzeltmiş, altı farklı deneyi paralel olarak başlatmış ve sonunda elde ettiği sonuçlarla sonraki adımları raporlamış.

İşin mutfağında asıl değişim burada.

AI modelleri birkaç dakika içinde cevap veren araçlardan çıkıp saatler hatta günler süren görevleri kendi başına sürdürebilen yazılım ajanlarına dönüşüyor.

Fable 5.1 önceki modelden daha verimli

Anthropic yalnızca modelin gücünü artırmamış, uzun görevlerin maliyetini de düşürmeye çalışmış.

Fable 5.1’in standart API fiyatı önceki Fable 5 ile aynı tutuluyor: 1 milyon giriş tokenı için 10 dolar, 1 milyon çıkış tokenı için 50 dolar.

Asıl önemli değişiklik ise cache read tarafında.

Modelin daha önce işlediği bağlamı yeniden kullanması gerektiğinde cache okuma maliyeti yüzde 75 azaltılarak 1 milyon token başına 0,25 dolara düşürülmüş durumda.

Bu özellikle uzun süre çalışan AI ajanları için önemli.

Çünkü büyük bir kod tabanını veya uzun dokümanları her adımda yeniden işlemek ciddi token maliyetine yol açabiliyor. Cache kullanımının ucuzlaması uzun görevlerde toplam maliyeti aşağı çekebilir.

Claude Mythos 5.1 neden farklı?

Mythos 5.1 tarafında işler biraz daha ilginç.

Anthropic bu modeli herkese açık standart Claude modeli olarak sunmuyor. Mythos 5.1 yalnızca şirketin trusted access programları üzerinden erişilebiliyor.

Bunun nedeni modelin özellikle siber güvenlik ve yaşam bilimleri tarafındaki daha gelişmiş yetenekleri.

Normal Fable 5.1 güvenlik amacıyla yazılım açıklarını bulmaya yardımcı olabiliyor ancak exploit geliştirme gibi daha riskli kullanım alanlarında kısıtlamalar devreye giriyor.

Mythos 5.1 ise doğrulanmış kullanıcıların daha ileri düzey araştırmalar yapabilmesi için farklı güvenlik politikalarıyla çalışıyor.

Siber güvenlikte Anthropic’in en güçlü modeli

Anthropic’in kendi testlerine göre Mythos 5.1, şirketin bugüne kadar yayınladığı modeller arasında en güçlü siber güvenlik yeteneklerine sahip model konumunda.

Ancak şirket bu yeteneklerin halen kendi Frontier Compliance Framework sisteminde daha düşük risk kategorisinde kaldığını belirtiyor.

Fable 5.1’in siber güvenlik filtrelerinde de önemli bir değişiklik yapılmış.

Yeni koruma sistemi, zararsız güvenlik isteklerini yanlışlıkla engelleme oranını önceki yapıya kıyasla yüzde 60 azaltıyor. Böylece güvenlik araştırmacılarının meşru açık analizi yaparken modele takılması daha az olmalı.

Bu denge oldukça kritik.

Bir AI modeli güvenlik açığı bulabilecek kadar güçlü olmalı ancak aynı model saldırı aracına dönüşmemeli.

Mythos 5.1 protein tasarımında dikkat çekici sonuç verdi

Haberin en ilginç taraflarından biri de yapay zekânın bilimsel araştırmalardaki rolü.

Anthropic, Mythos 5.1’i protein tasarımı konusunda açık kaynaklı protein katlama ve tasarım araçlarıyla birlikte test etmiş.

Üç farklı hedefte modelin hazırladığı tasarımların bağlanma gücü, Adaptyv Bio yarışmalarındaki en iyi tasarımlardan 10 kata kadar yüksek çıkmış.

12 hedef üzerinde yapılan testlerde başarılı protein tasarımı oranı yaklaşık yüzde 50’ye yaklaşmış.

Anthropic’e göre günümüzde protein tasarımında yüzde 10-15 civarı başarı oranı daha tipik kabul ediliyor.

Elbette burada dikkatli olmak gerekiyor.

Bu sonuçlar AI’ın tek başına yeni ilaç geliştirdiği anlamına gelmiyor. Ancak modelin laboratuvar ortamında gerçekten test edilebilecek biyolojik tasarımlar üretebilmesi, AI’ın bilimsel araştırmadaki rolünün hızla büyüdüğünü gösteriyor.

Mythos neden herkese açılmıyor?

Tam da bu yetenekler nedeniyle Anthropic Mythos 5.1’i standart API üzerinden herkesin kullanımına sunmuyor.

Şirket biyoloji alanındaki gelişmiş yetenekler için ABD hükümetiyle birlikte oluşturduğu özel erişim programını kullanıyor.

Anthropic modelin kimyasal ve biyolojik risklerini ayrıca test etmiş.

Şirket, Mythos 5.1’in önceki Mythos 5’ten daha yetenekli olduğunu kabul etmekle birlikte modelin henüz Responsible Scaling Policy kapsamında bir sonraki risk seviyesine ulaşmadığını belirtiyor.

Kısacası Mythos 5.1’in daha sınırlı dağıtılması teknik bir eksiklikten değil, modelin erişebildiği görevlerin hassasiyetinden kaynaklanıyor.

Fable 5.1 nerede kullanılabiliyor?

Fable 5.1 tarafında erişim çok daha geniş.

Model bugünden itibaren Anthropic’in tüm platformlarında kullanılabiliyor. Ayrıca Amazon Web Services, Google Cloud ve Microsoft Azure üzerinden de erişime açılmış durumda.

Geliştiriciler Claude API üzerinde claude-fable-5-1 model kimliğini kullanabiliyor.

Claude Code tarafında model varsayılan olarak High effort, Claude Cowork ve Claude.ai tarafında ise Medium effort seviyesinde çalışıyor. Effort seviyesi yükseldikçe model bir probleme daha fazla hesaplama ve düşünme süresi ayırabiliyor.

Fable 5.1 Opus 5’in bile önüne geçtiği alanlara sahip

Anthropic’in test tablosu ilginç bir tablo ortaya koyuyor.

Fable 5.1 her alanda Opus 5’i geçmiyor ancak bazı agentic ve araştırma görevlerinde şirketin daha büyük modelini geride bırakabiliyor.

Örneğin Terminal-Bench-Science testinde Fable 5.1 yüzde 52,6’ya ulaşırken Opus 5 yüzde 29’da kalıyor. Bilgi işleri için kullanılan GDPval-AA v2 testinde ise Fable 5.1’in skoru 1853, Opus 5’in skoru 1824 olarak açıklanıyor.

Bu bize önemli bir şeyi gösteriyor.

AI dünyasında artık “daha büyük model her zaman daha iyi modeldir” yaklaşımı giderek zayıflıyor. Eğitim yöntemi, agentic araç kullanımı, maliyet ve modele verilen çalışma süresi en az ham model büyüklüğü kadar önemli hale geliyor.

Anthropic’in asıl hedefi uzun soluklu AI çalışanları

Net konuşalım: Fable 5.1’in hikâyesi yalnızca daha yüksek benchmark puanlarından ibaret değil.

Anthropic, modelin kod tabanında gezinmesini, terminal kullanmasını, araştırma yapmasını, hatalarını kontrol etmesini ve gerektiğinde saatler boyunca göreve devam etmesini istiyor.

Bu da Claude’un klasik chatbot kullanımından giderek uzaklaştığını gösteriyor.

Bugün geliştiricinin yanında çalışan bir kod asistanı olarak başlayan sistemler, yarın bütün bir yazılım projesinde bağımsız görev alan dijital ekip arkadaşlarına dönüşebilir.

Mythos 5.1 ise aynı teknolojinin bilimsel araştırma ve ileri siber güvenlik gibi daha hassas alanlara nasıl taşınabileceğinin ilk örneklerinden biri.

Anthropic’in Fable ve Mythos’u aynı temel modelden üretip farklı güvenlik seviyeleriyle dağıtması da gelecekte AI şirketlerinin izleyeceği yeni modeli gösteriyor olabilir: aynı yapay zekâ, farklı kullanıcılar için farklı yetki seviyeleri.

EDİTÖR NOTU:

Fable 5.1’de benim dikkatimi en fazla çeken şey benchmark skorundan çok 38 saat süren bağımsız çalışma örneği. AI ajanları gerçekten saatler boyunca bağlamı kaybetmeden kod yazıp araştırma yapabiliyorsa yazılım geliştirme tarafındaki dönüşüm çok daha hızlı olacak. Mythos 5.1’in sınırlı erişim modeli ise güçlü AI sistemlerinde “her kullanıcıya aynı yetki” döneminin sona ermeye başladığını gösteriyor.

ETİKETLER:

Anthropic, Claude Fable 5.1, Claude Mythos 5.1, Claude AI, yapay zekâ, AI agent, Claude Code,

Forumda tartış →

Kaynak: ANTHROPIC