İçeriğe geç
Sıfırıncı Dakika
Son haberler

Dört sınır modeli karşı karşıya: GPT-6 Astra, GPT-6.1 Sol, Gemini 4 Argon ve Claude Fable 5.1

Yapay ZekâAnaliz1 dk okuma
Dört sınır modeli karşı karşıya: GPT-6 Astra, GPT-6.1 Sol, Gemini 4 Argon ve Claude Fable 5.1

Kısaca

OpenAI, Google DeepMind ve Anthropic 30 gün içinde dört sınır sınıfı model yayımladı. Karşılaştırma, modellerin benchmark puanlarında birbirine yaklaştığını ama fiyat, erişim ve görev başına maliyette ayrıştığını gösteriyor. OpenAI, 28 Eylül'de iç testleri geçemeyen GPT-6.1 Astra'yı iptal etti; GPT-6 Astra şimdilik şirketin en üst modeli olarak kalıyor.

  • GPT-6 Astra: 1,05M bağlam penceresi, 128K çıktı, 5 akıl yürütme seviyesi
  • GPT-6.1 Sol: Astra'nın beşte biri liste fiyatı, 1,05M bağlam
  • Gemini 4 Argon: 1M token'a kadar çıktı, tanıtım fiyatı sonradan iki katına çıkıyor
  • Claude Fable 5.1: 1M bağlam, 128K çıktı, düşük/orta/yüksek efor seviyeleri
  • Dört modelin hiçbiri açık ağırlıklı değil

Ne oldu

OpenAI, Google DeepMind ve Anthropic yaklaşık 30 gün içinde dört sınır sınıfı model yayımladı. Claude Fable 5.1 1 Eylül'de, GPT-6 Astra 3 Eylül'de, GPT-6.1 Sol ve Gemini 4 Argon ise Eylül sonunda geldi. Karşılaştırma, lansman yazılarının ima ettiğinden daha fazla benchmark örtüşmesi olduğunu gösteriyor.

Fiyat ve erişim

Astra ile Fable 5.1 aynı liste fiyatını paylaşıyor: 1 milyon token giriş için 10 dolar, çıkış için 50 dolar. Sol ve Argon bunun beşte biri seviyesinde; Argon'un fiyatı tanıtım amaçlı ve sonradan iki katına çıkıyor. Önbelleğe alınan giriş fiyatı ajan kullanımında kritik: Astra'da 1 dolar, Sol'da 0,10 dolar, Fable 5.1'de 0,25 dolar.

Benchmarklarda kim önde

Hiçbir model tüm tabloyu süpürmüyor. Argon bilgi işi ve uzun ufuklu kodlamada öne çıkarken Astra sınır yazılım mühendisliği ve bilgisayar kullanımında lider. Google'ın tablosunda yer almayan GPT-6.1 Sol, OpenAI'nin kendi verilerine göre Astra'ya yakın puanlar alıyor.

Görev başına maliyet

Artificial Analysis, Fable 5.1 için görev başına 9,18 dolar, GPT-6 Astra için 4,72 dolar hesaplıyor. Aynı liste fiyatına rağmen ortaya çıkan bu fark, token hacminden kaynaklanıyor.

Neden önemli

Model seçimi artık yalnızca zeka puanıyla değil, erişim kuralları ve görev başına maliyetle belirleniyor. OpenAI'ın GPT-6.1 Astra'yı iptal etmesi, sınır modellerinde iç testlerin ne kadar belirleyici olduğunu gösteriyor.

Neden önemli?

Model seçerken yalnızca benchmark puanına bakmak yanıltıcı; önbellek fiyatı ve görev başına maliyet ajan kullanan ekipler için belirleyici olabilir. Bu karşılaştırma, hangi iş için hangi modelin daha uygun olduğunu görmek isteyenler için iyi bir başlangıç.

Kaynaklar

İlgili haberler