Claude Haiku 5.5: geçiş notları ve fiyat analizi
Anthropic, Claude Haiku 5.5'i duyurdu. Model; özet çıkarma, sınıflandırma ve veritabanı sorgusu gibi yüksek hacimli, maliyete duyarlı işler için tasarlandı. Haiku 4.5'e göre ortalama %75 daha ucuz, ama yeni tokenizer ve 100 bin tokenlik fiyat eşiği yüzünden gerçek maliyet iş yükünüze göre değişiyor. Bu yazıda fiyatları, benchmark sonuçlarını ve Haiku 4.5'ten geçerken nelere bakmanız gerektiğini topladım. Rakamların çoğu Anthropic'in duyurusundan, tokenizer ve süre ölçümleri ise Simon Willison'ın incelemesinden geliyor.
Fiyatlandırma
Haiku 5.5'in fiyatı prompt uzunluğuna göre iki kademeli. 100 bin tokene kadar olan isteklerde milyon token başına girdi 0,10 $, çıktı 0,50 $. Bu sınırın üzerinde fiyat beş katına çıkıyor. Anthropic'e göre önceki Haiku'ya gelen isteklerin yaklaşık %90'ı zaten 100 bin tokenin altında kalıyor.
| Model | Girdi | Çıktı |
|---|---|---|
| Haiku 5.5 (≤100 bin token) | 0,10 $ | 0,50 $ |
| Haiku 5.5 (>100 bin token) | 0,50 $ | 2,50 $ |
| Haiku 4.5 | 1,00 $ | 5,00 $ |
| GPT-6 Luna (≤272 bin token) | 0,10 $ | 0,50 $ |
| GPT-6 Luna (>272 bin token) | 0,20 $ | 0,75 $ |
Fiyatlar milyon token başına.
100 bin token eşiği
100 bin tokenin altında Haiku 5.5, OpenAI'ın GPT-6 Luna modeliyle birebir aynı fiyatta. Fark eşiğin üzerinde başlıyor. Haiku 5.5'in fiyatı 100 bin tokende beş katına çıkarken Luna 272 bin tokene kadar aynı fiyatta kalıyor. Sonrasında da yalnızca 0,20 $ / 0,75 $'a yükseliyor. Bu yüzden uzun bağlamla çalışan bir iş yükünde Luna belirgin biçimde daha ucuz.
Tokenizer etkisi
Haiku 5.5 yeni ve daha az verimli bir tokenizer kullanıyor. Tokenizer, metni modelin saydığı parçalara, yani token'lara bölen katmandır. Aynı metin ne kadar çok token'a bölünürse o kadar çok ödersiniz. Simon Willison'ın Claude Token Counter aracıyla yaptığı ölçüme göre aynı uzun prompt, Haiku 5.5'te Haiku 4.5'e göre yaklaşık 1,25 kat daha fazla token tutuyor.
Yani aynı metin için ödediğiniz tutar, token fiyatının gösterdiğinden yaklaşık %25 daha yüksek. Bu fark %75'lik indirimin yanında küçük kalıyor. Eşiğe yakın prompt'larda ise önemli hale geliyor: Haiku 4.5'te 85 bin token tutan bir prompt, Haiku 5.5'te yaklaşık 106 bin token'a çıkıyor ve pahalı kademeye düşüyor.
Performans
Anthropic'in yayınladığı benchmark'larda Haiku 5.5, Haiku 4.5'i büyük farkla geçiyor. Üç testte de GPT-6 Luna'nın önünde.
| Benchmark | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna |
|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 |
| OSWorld 2.1 | %72,4 | %15,7 | %48,9 |
| Terminal-Bench 4.0 | %39,2 | %0,0 | %16,4 |
GDPval-AA bilgi işlerindeki başarıyı puanlıyor. OSWorld, bir ajanın gerçek bir bilgisayarda çok adımlı görevleri ne kadar bitirebildiğini ölçüyor; tablodaki değerler testin çevrimdışı alt kümesine ait. Terminal-Bench ise ajan tabanlı kodlama görevlerini ölçüyor.
Çaba ayarı
Haiku 5.5, Haiku sınıfında ayarlanabilir çaba (effort) ayarı olan ilk model. Çaba ayarı, modelin cevap vermeden önce ne kadar akıl yürüteceğini belirliyor. Düşük ayar daha hızlı ve ucuz, yüksek ayar daha yavaş ama daha isabetli. Akıl yürütme tamamen kapatılamıyor ve varsayılan değer medium.
Ayarın süreye etkisi büyük. Simon Willison'ın testinde low ayarıyla bir SVG çizimi 7 saniye sürdü ve 0,0936 sent tuttu. Aynı istek max ayarıyla 5 dakika 9 saniye sürdü ve 3,38 sent tuttu. Hız tarafında Anthropic'in duyurusunda Asana'dan bir mühendis, kendi ajan ürünlerinde görev tamamlama gecikmesinin %30'dan fazla düştüğünü, ajan adımı başına çıkarımın da 2,5 kata kadar hızlandığını aktarıyor.
Geçiş notları
Haiku 4.5'ten geçerken değişmesi gereken ilk şey model adı: claude-haiku-5-5. Model, Claude Platform'un yanında AWS, Google Cloud ve Microsoft Azure'da da kullanılabiliyor. Anthropic'in geçiş rehberi ayrıntıları listeliyor.
Maliyet hesabını geçişten önce yeniden yapmakta fayda var, çünkü tokenizer değişti. Mevcut prompt'larınızın token sayısını Haiku 5.5 ile yeniden ölçün ve 100 bin eşiğine yaklaşan istekleri ayrıca kontrol edin. Akıl yürütme kapatılamadığı için gecikmeye duyarlı işlerde low ayarını deneyin. Varsayılan medium, bu tür işlerde gereğinden yavaş kalabilir.
Diğer güncellemeler
Anthropic aynı gün Claude Sonnet 5.5'in önbellek (cache) okuma fiyatını yarıya indirdi: milyon token başına 0,20 $ yerine 0,10 $. Anthropic'e göre bu, ajan tabanlı işlerin çoğunda Sonnet 5.5'i yaklaşık %20 ucuzlatıyor.
Max ve Team aboneleri artık Claude Platform'da kullanmak üzere aylık API kredisi alıyor. Max 5x için 100 $, Max 20x için 200 $, Team için kullanıcılar arasında paylaşılan 500 $'a kadar. Krediler sonraki aya devretmiyor. Kredileri almak için Settings → Billing bölümünden kredinin gideceği API organizasyonunu seçmeniz yeterli. API için otomatik bakiye yüklemeyi (auto-reload) kapatırsanız bakiye bittiğinde istekler duruyor. Kredilerle deneme yaparken beklenmedik bir faturanın önüne geçmenin en kolay yolu bu.
Python ve TypeScript SDK'larına da beta olarak computer use ve browser use desteği geldi.
Hangi durumda hangisi
| Senaryo | İlk tercih | Alternatif |
|---|---|---|
| 100 bin tokenin altında, yüksek hacimli iş | Haiku 5.5 | GPT-6 Luna (aynı fiyat) |
| Düzenli olarak 100 binin üzerinde prompt | GPT-6 Luna | Haiku 5.5, pahalı kademede |
| Şu an Haiku 4.5 kullanıyorsanız | Haiku 5.5, token sayılarını yeniden ölçerek | Haiku 4.5'te kalmak |
| Gecikmeye duyarlı ajan adımları | Haiku 5.5, low |
Haiku 5.5, medium |