Claude Fable 5 ve Claude Mythos 5 Tanıtıldı: Yapay Zeka Ajanlarında Yeni Dönem

Anthropic, Mythos sınıfı yapay zeka modellerinin ilk üyelerini tanıttı. Genel kullanıma sunulan Claude Fable 5, yazılım mühendisliği, veri analizi ve görsel yeteneklerde devrim yaratırken; ABD hükümetiyle ortak yürütülen Project Glasswing kapsamında sunulan Claude Mythos 5 ise siber savunma yetenekleriyle sınırları zorluyor. İki modelin tüm detayları, benchmark sonuçları ve sektörel etkileri.
Yapay zeka dünyasında rekabet hız kesmeden devam ederken, Anthropic'ten sınırları zorlayan yepyeni bir duyuru geldi. Şirket, şimdiye kadar geliştirdiği en yetenekli ve otonom yapay zeka ailesi olan Mythos sınıfının ilk üyelerini tanıttı: Claude Fable 5 ve Claude Mythos 5.
Bu iki yeni model, sadece işlem gücüyle değil, aynı zamanda uzun soluklu otonom çalışma becerileri, siber güvenlik, yazılım mühendisliği ve temel bilimler gibi karmaşık alanlardaki üstün performanslarıyla da öne çıkıyor. Anthropic, Fable 5'i genel kullanıma sunarken; safeguards (güvenlik duvarları) kaldırılmış olan Mythos 5'i ise stratejik siber savunma ve kritik altyapı sağlayıcıları için özel bir iş birliği programı dahilinde sahaya sürüyor.
İşte Anthropic’in yapay zekada yeni bir sayfa açan Fable 5 ve Mythos 5 modellerine dair bilmeniz gereken tüm detaylar, performans testleri ve sektörel etkileri.
---
Claude Fable 5: Genel Kullanıma Hazır En Güçlü Yapay Zeka
Claude Fable 5, Anthropic'in genel kullanıma sunduğu şimdiye kadarki en yetenekli yapay zeka modeli olarak konumlanıyor. Yazılım mühendisliğinden bilimsel araştırmalara, görsel analizden finansal muhakemeye kadar test edilen neredeyse tüm endüstri standartlarındaki benchmark'larda (performans testlerinde) en yüksek skorları elde etmeyi başardı.
Anthropic, Fable 5'in gücünü şu şekilde özetliyor: “Görev ne kadar uzun ve karmaşık olursa, Fable 5’in diğer modellerimize olan üstünlüğü ve liderliği o kadar belirgin hale geliyor.”
Ancak bu kadar yüksek kapasiteli bir modeli halka açık hale getirmek ciddi güvenlik risklerini de beraberinde getiriyor. Özellikle siber güvenlik gibi alanlardaki otonom yeteneklerin kötü niyetli kişilerce suistimal edilmesini önlemek amacıyla Anthropic, modelin genel sürümünü sıkı güvenlik bariyerleriyle çevrelemiş durumda.
5% Kuralı ve Opus 4.8 Yönlendirmesi
Fable 5'in siber güvenlik gibi hassas alanlarda zarar verme potansiyeli taşıyan sorgularda kullanılmasını önlemek için sisteme entegre edilen safeguards (güvenlik korumaları) oldukça hassas şekilde ayarlanmış. Eğer model bir isteğin güvenlik sınırlarını ihlal ettiğini veya suistimal riski taşıdığını tespit ederse, arka planda otomatik olarak bir önceki en yetenekli model olan Claude Opus 4.8 devreye giriyor ve yanıtı o üretiyor.
Lansmanın hızlı ve güvenli yapılabilmesi için bu güvenlik bariyerleri başlangıçta oldukça muhafazakar (conservative) şekilde ayarlanmış durumda. Bu durum bazen tamamen zararsız sorguların da takılmasına neden olabiliyor. Anthropic’in paylaştığı verilere göre, bu yanlış tetiklemeler ve yönlendirmeler ortalama olarak oturumların %5'inden daha azında gerçekleşiyor. Şirket, önümüzdeki aylarda güvenlik duvarlarının hassasiyetini optimize ederek yanlış pozitif oranını (false positives) düşürmek için çalıştıklarını belirtiyor.
---
Claude Mythos 5: Siber Savunmanın Otonom Gücü ve Project Glasswing
Stratejik güvenlik ihtiyaçları için Anthropic, Fable 5 ile aynı temel mimariye sahip ancak belirli alanlardaki güvenlik sınırlamaları esnetilmiş veya tamamen kaldırılmış olan Claude Mythos 5 modelini duyurdu.
Mythos 5, şu an dünyadaki en güçlü siber güvenlik yeteneklerine sahip yapay zeka modeli unvanını taşıyor. Model, ilk etapta ABD hükümetiyle ortaklaşa yürütülen Project Glasswing (Glasswing Projesi) kapsamında siber savunmacılar ve kritik altyapı sağlayıcılarına sunulacak. Claude Mythos Preview sürümünün halefi olarak tasarlanan Mythos 5, kritik yazılımların güvenliğini sağlamada ve siber tehditleri otonom olarak engellemede aktif görev alıyor. Şirket, yakın gelecekte Mythos 5'e erişimi daha geniş bir "güvenilir ortak" (trusted access) programı üzerinden genişletmeyi planlıyor.
Glasswing Projesi kapsamındaki ilk geri bildirimler, yapay zekanın siber savunma ekiplerine çok ciddi zaman kazandırdığını ve karmaşık güvenlik açıklarını tespit edip yamamada insan uzmanların seviyesine ulaştığını gösteriyor.
---
Benchmark Skorları ve Performans Analizi
Claude Fable 5 ve Mythos 5, sadece teorik kapasite artışıyla kalmayıp gerçek dünya uygulamalarında ve sektörel iş ortaklarının testlerinde de çığır açan sonuçlar elde etti. İşte öne çıkan o başlıklar:
1. Yazılım Mühendisliği ve Stripe Örneği
Geliştirici dünyasının devlerinden Stripe, Fable 5'in erken erişim sürümüyle yaptığı testlerin sonuçlarını paylaştı. Stripe yetkililerine göre Fable 5, aylar süren mühendislik süreçlerini sadece birkaç güne sığdırdı.
Model, Stripe’ın 50 milyon satırlık devasa Ruby kod tabanında, normal şartlarda koca bir ekibin en az 2 ayını alacak olan altyapı migrasyonunu (kod tabanı genelindeki bir geçiş işlemini) tek bir gün içinde tamamen otonom olarak ve başarıyla tamamladı.
Ayrıca Cognition firmasının frontier kodlama yeteneklerini test eden ve üretim standartlarında kod üretilip üretilmediğini denetleyen FrontierCode değerlendirmesinde, Fable 5 en yüksek skoru alan model oldu. Üstelik bunu rakiplerine göre çok daha token-verimli (daha az girdi/çıktı maliyeti harcayarak) yapmayı başardı.
2. Finansal Muhakeme ve Bilgi İşçiliği
Hebbia’nın finans sektörü için geliştirdiği ve kıdemli uzman seviyesinde muhakeme gerektiren Finance Benchmark testlerinde Fable 5, doküman analizi, grafik/tablo yorumlama ve karmaşık finansal problem çözme alt başlıklarında rakiplerine fark atarak zirveye oturdu.
Gelişmiş Yapay Zekalar Mythos 5 ve Fable 5 Yeniden Kullanıma Açıldı
Claude AI'da Gizlilik Skandalı: Paylaşılan Sohbet Bağlantıları Google Aramalarında İndekslendi
Benzer şekilde, küresel finansal ticaret devlerinden IMC, Fable 5'in trading analizi testlerinde mükemmel sonuçlar verdiğini belirtti. Model; veri arama, kavramsal analiz, kök neden analizi (root-cause analysis) ve beklenen değer analizi gibi çok boyutlu muhakeme adımlarında neredeyse firesiz bir performans sergiledi.
3. Görsel Yeteneklerde Devrim: Pokemon FireRed
Fable 5, görselleri analiz etme ve bunlardan veri çıkarma konusunda yeni bir standart belirliyor. Karmaşık bilimsel grafiklerdeki milimetrik sayısal verileri hatasız şekilde okuyabilen model, bir web uygulamasının ekran görüntülerinden yola çıkarak uygulamanın kaynak kodunu sıfırdan yazabiliyor.
Görsel odaklı otonom yeteneklerini test etmek için Anthropic mühendisleri Fable 5'i popüler retro oyun Pokémon FireRed'e yönlendirdi. Önceki Claude modelleri, oyunu oynayabilmek için harita bilgisi veya oyun durumunu yapay zekaya besleyen karmaşık yardımcı yazılımlara (harness) ihtiyaç duyuyordu. Fable 5 ise herhangi bir ek yazılım veya harita desteği olmadan, sadece oyunun ham ekran görüntülerini (görsel girdi) analiz ederek Pokémon FireRed’i baştan sona otonom olarak bitirmeyi başardı.
4. Bellek ve Uzun Bağlam Yönetimi: Slay the Spire
Yapay zeka modellerinin uzun soluklu işlerde odaklarını kaybetmesi en büyük sorunlardan biridir. Fable 5, milyonlarca token'ı kapsayan ve günler süren görevlerde odağını yitirmiyor.
Popüler kart tabanlı strateji oyunu Slay the Spire üzerinde yapılan testlerde, Fable 5'e dosya tabanlı bir kalıcı bellek (memory) erişimi verildi. Bellek desteği alan Fable 5'in oyun performansı, Opus 4.8'e göre 3 kat daha fazla artış gösterdi ve oyunun final aşamasına (Act 3) ulaşma oranı da yine rakiplerini üçe katladı. Model, kendi aldığı notları hafızasında tutarak ve eski hamlelerinden ders çıkararak stratejisini sürekli optimize edebiliyor.
---
Moleküler Biyoloji ve Temel Bilimlerde Çığır Açan Keşifler
Mythos 5, temel bilimsel araştırmalarda bağımsız tezler üretebilen ilk yapay zeka modellerinden biri oldu. Anthropic bünyesindeki protein tasarımı uzmanları, Mythos 5'i kullanarak ilaç geliştirme süreçlerinin belirli aşamalarını 10 kat hızlandırmayı başardı.
Yapılan kör testlerde (blinded test), Mythos 5'in ürettiği moleküler biyoloji hipotezleri, uzman bilim insanları tarafından Opus sınıfı modellere kıyasla %80 oranında daha başarılı ve tutarlı bulundu. Protein bağlama bölgelerini seçme, biyoinformatik araçlarını otonom çalıştırma ve karşılaştığı hatalardan kendi kendine ders çıkarma yetenekleriyle Mythos 5, deneyimli bir bilim insanıyla eşdeğer veya daha iyi performans gösterdi. Araştırmada tasarlanan 14 protein hedefinden 9 tanesi güçlü birer ilaç adayı olarak kabul edildi ve laboratuvar ortamında incelenmeye başlandı.
Ek olarak model, bir haftalık otonom çalışmanın ardından 138 hayvan türünden elde edilen milyonlarca hücreye ait tek hücre (single-cell) genomik verilerini işledi ve hücre rollerini tanımlayan özel bir makine öğrenmesi modeli tasarlayıp eğitti. Mythos 5 tarafından otonom olarak eğitilen bu minyatür model, prestijli bilim dergisi Science’ta yakın zamanda yayınlanan bir modelden 100 kat daha küçük olmasına rağmen daha yüksek başarı oranı yakaladı.
---
Fiyatlandırmada Büyük İndirim: Token Maliyetleri Yarıya İndi
Anthropic, bu devasa güç artışına rağmen geliştiricileri ve işletmeleri memnun edecek çok önemli bir fiyatlandırma adımını da duyurdu.
Claude Fable 5 ve Claude Mythos 5, 1 milyon girdi token'ı (input) için $10, 1 milyon çıktı token'ı (output) için ise $50 fiyat etiketiyle sunuluyor. Bu fiyatlar, bir önceki nesil olan Claude Mythos Preview modelinin yarı fiyatından daha ucuz. Bu maliyet düşüşü, yapay zeka ajanlarının ölçekli olarak üretim ortamlarında (production) konumlandırılmasını ekonomik olarak çok daha mantıklı hale getirecektir.
---
Güvenlik ve Uyum (Alignment) Seviyesi
Güçlü modellerin kontrolden çıkma veya aldatıcı davranışlar sergileme riskine karşı Anthropic’in yaptığı alignment (hizalanma) testlerinde, Fable 5 ve Mythos 5’in güvenlik skorları Opus 4.8 ile benzer düzeyde çıktı. Modelin insanı aldatma, manipüle etme veya suistimal isteklerine otonom iş birliği sağlama eğilimi oldukça düşük seviyelerde kaldı. Detaylı güvenlik analizlerine ve test metotlarına modelin resmi System Card belgesinden erişilebiliyor.
---
Yapay Zeka Ajanlarının Yılı
Claude Fable 5 ve Mythos 5, yapay zekanın sadece "sohbet edilen bir asistan" olmaktan çıkıp, karmaşık mühendislik projelerini sırtlayan, ilaç tasarlayan ve siber savunma hatlarını yöneten otonom iş ortaklarına (agents) dönüştüğünün en somut kanıtı.
Stripe’ın aylarca sürecek kodu tek günde taşıması veya modelin kendi hafızasını yöneterek oyun bitirmesi, yazılım ekosisteminin iş yapış şeklini kökten değiştirecek potansiyelde. Hem maliyetlerin yarıya düşmesi hem de otonom yeteneklerin bu seviyeye gelmesiyle birlikte, 2026 yılı yapay zeka ajanlarının gerçek dünyada olgunlaştığı yıl olarak kayıtlara geçmeye aday.

