Anthropic Claude Haiku 5.5’i Tanıttı: Daha Güçlü Performans Daha Yüksek Token Tüketimi Getiriyor
Anthropic, Claude Haiku 5.5 modelini yüksek hacimli yapay zekâ görevlerine yönelik yeni küçük model olarak kullanıma sundu ve düşük giriş fiyatına rağmen daha yüksek token tüketimiyle dikkat çeken bir performans ortaya koydu. Model, 100 bin tokene kadar olan istemlerde milyon giriş tokenı başına 0,10 dolar, çıkış tokenı başına 0,50 dolar ücretlendirirken daha uzun istemlerde fiyatlar sırasıyla 0,50 dolar ve 2,50 dolara yükseliyor. Anthropic, Haiku 5.5’in önceki nesil Haiku 4.5’e kıyasla ortalama yüzde 75 daha düşük çalıştırma maliyeti sunduğunu belirtirken bağımsız testler görev başına tüketilen token sayısının belirgin şekilde arttığını gösteriyor.
Claude Haiku 5.5 Daha Düşük Fiyatla Daha Yüksek Performans Sunuyor
Anthropic, yeni modeli özetleme, sınıflandırma ve yüksek hacimli API görevleri gibi sürekli çalıştırılan iş yükleri için konumlandırıyor. Şirket, Claude Haiku 5.5 modelini şimdiye kadarki en hızlı, en ucuz ve en yetenekli küçük modeli olarak tanımlarken önceki nesle göre özellikle bilgisayar kullanımı ile yapay zekâ ajanlarının kodlama görevlerinde büyük ilerlemeler sağladığını belirtiyor.
Modelin fiyatlandırması iki ayrı katmandan oluşuyor. 100 bin tokene kadar olan istemler için milyon giriş tokenı başına 0,10 dolar, milyon çıkış tokenı başına 0,50 dolar ücret uygulanırken 100 bin token sınırının üzerindeki istemlerde fiyatlar 0,50 dolar giriş ve 2,50 dolar çıkış seviyesine çıkıyor.
Anthropic’in sunduğu alt fiyat kademesi, OpenAI’nin GPT-6 Luna modeli için belirtilen standart giriş ve çıkış token fiyatlarıyla aynı seviyede bulunuyor. Şirket ise Haiku 5.5’in önceki Haiku 4.5’e kıyasla ortalama yüzde 75 daha düşük çalıştırma maliyetine sahip olduğunu savunuyor.
Anthropic’in paylaştığı sonuçlar, yeni modelin farklı yapay zekâ görevlerinde önceki nesle göre belirgin bir performans artışı sağladığını gösteriyor. Haiku 5.5, verilen altı karşılaştırmanın tamamında GPT-6 Luna’nın üzerinde sonuç alırken özellikle bilgisayar kullanımı ve ajan tabanlı kodlama testlerinde daha yüksek skorlar elde ediyor.
| Benchmark | Claude Haiku 5.5 | Claude Haiku 4.5 | GPT-6 Luna |
|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 |
| OSWorld 2.1 | %72,4 | %15,7 | %48,9 |
| Terminal-Bench 4.0 | %39,2 | %0 | %16,4 |
| FrontierCode 1.1 | %46,4 | — | %42,4 |
| Chartography | %46,4 | %6,4 | %29,1 |
Haiku 5.5’in özellikle OSWorld 2.1 sonucundaki yüzde 72,4’lük performansı, bilgisayar üzerinde doğrudan işlem gerçekleştiren yapay zekâ ajanları açısından öne çıkıyor. Terminal-Bench 4.0 testinde yüzde 39,2’lik skor alan model, önceki Haiku 4.5’ün sıfır puanlık sonucuna kıyasla da belirgin bir ilerleme sergiliyor.
Artificial Analysis tarafından yapılan bağımsız testler, modelin yüksek benchmark skorlarının daha fazla hesaplama ve token tüketimiyle geldiğini ortaya koyuyor. Claude Haiku 5.5’in maksimum çalışma ayarındaki Intelligence Index skoru 43 olurken GPT-6 Luna aynı ölçümde 38 puan alıyor.
| Artificial Analysis Ölçümü | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Intelligence Index | 43 | 38 |
| Görev başına ortalama çıkış tokenı | 162 bin | 50 bin |
| Görev başına ortalama akıl yürütme tokenı | 129 bin | 39 bin |
| Görev başına ortalama maliyet | 0,21 dolar | 0,07 dolar |
| Çıkış hızı | 243 token/sn | 128 token/sn |
| Görev başına ortalama süre | 427 saniye | 390 saniye |
Haiku 5.5, karşılaştırmada GPT-6 Luna’ya kıyasla yaklaşık 3,5 kat daha fazla çıkış tokenı üretiyor. Modelin akıl yürütme sırasında kullandığı token sayısı da yaklaşık 3,5 kat daha yüksek seviyeye ulaşırken görev başına ortalama maliyet 0,21 dolara çıkıyor.
Modelin saniyede 243 tokenlık çıkış hızı GPT-6 Luna’nın 128 tokenlık hızını aşmasına rağmen daha yüksek token tüketimi toplam işlem süresini artırıyor. Sonuçlar, token başına fiyatın tek başına yapay zekâ API maliyetini değerlendirmek için yeterli olmadığını gösterirken görev başına tüketim miktarı da doğrudan maliyet hesabına dahil oluyor.
Anthropic, yeni modelin Haiku 4.5’e kıyasla güvenlik tarafında da geliştirmeler içerdiğini belirtiyor. Şirket, modelin uyumsuz davranış örneklerini azaltırken potansiyel olarak zararlı taleplere uyma eğilimini de düşürdüğünü ifade ediyor.
Yüksek hacimli yapay zekâ uygulamalarında güvenlik performansı, modelin yalnızca doğru yanıt üretmesinden daha geniş bir değerlendirme alanı oluşturuyor. Anthropic’in yaklaşımı, Claude Haiku 5.5’i geliştirici uygulamalarında sürekli çalışan özetleme, sınıflandırma ve ajan görevleri için daha kontrollü bir seçenek haline getirmeyi hedefliyor.
Anthropic, Haiku 5.5 duyurusuyla birlikte Claude Max ve Team aboneleri için aylık API kredilerini de açıkladı. Max 5x aboneleri aylık 100 dolar, Max 20x aboneleri 200 dolar kredi alırken Team aboneleri ortak kullanım için 500 dolara kadar kredi elde edecek.
Aboneler söz konusu kredileri Anthropic’in farklı modelleri üzerinden uygulama ve yapay zekâ ajanı geliştirmek için kullanabilecek. Yeni kredi sistemi, özellikle API üzerinden yüksek hacimli deneyler gerçekleştiren geliştiricilerin model maliyetlerini abonelik kapsamında yönetmesine yardımcı olacak.
Claude Haiku 5.5, Anthropic Platformunun yanı sıra Amazon Web Services, Google Cloud ve Microsoft Azure üzerinden de kullanılabiliyor. Modelin farklı bulut platformlarına aynı dönemde açılması, Anthropic’in küçük modelini kurumsal yapay zekâ uygulamalarında daha geniş bir geliştirici kitlesine ulaştırma stratejisini destekliyor.
Claude Haiku 5.5’in ortaya koyduğu tablo, yapay zekâ model fiyatlandırmasında yalnızca milyon token başına ücretin dikkate alınmaması gerektiğini gösteriyor. Geliştiricilerin gerçek uygulamalarda modelin görev başına kaç token kullandığını, ne kadar sürede sonuç verdiğini ve toplam işlem maliyetini birlikte değerlendirmesi gerekecek; Anthropic’in yeni modeli de yüksek performans karşılığında daha yoğun hesaplama tüketen küçük modellerin yeni bir örneğini oluşturuyor.










