xAI, Grok 4.7'yi Çıkardı: Önceki Sürüme Göre İlerleme, Aynı Ucuz Fiyat
xAI (sayfadaki markasıyla SpaceXAI), Grok modelinin yeni sürümü 4.7'yi çıkardı. Bir önceki sürüm 4.6'ya göre daha büyük bir temel model, kendi işini daha iyi doğrulama, uzun bağlamı daha iyi yönetme ve tamamen yeni bir güvenlik katmanı vaat ediyor.
Kısaca
- Ne çıktı: 21 Eylül'de Grok 4.7. 4.6'ya kıyasla daha büyük model, daha zor görevlerde daha uzun pekiştirmeli öğrenme, Grok Bot'u yerel olarak anlama ve yenilenmiş bir güvenlik (safeguard) yığını.
- Fiyat ve erişim: Milyon token başına 2$ giriş / 6$ çıkış (4.6 ile aynı; hızlı sürüm iki katı hız, iki katı fiyat). "Karşılaştırılabilir modellerin iki katı hız, yarı fiyatı" iddiası var. Cursor, Grok Build, Grok API, üçüncü-taraf kodlama araçları, model yönlendiriciler ve bulut platformları üzerinden.
- Karşılaştırma (xAI'nin kendi ölçümleri): 4.6'yı paylaşılan tüm testlerde geçiyor. Sınır modellere (GPT-5.6 Sol, Fable 5.1) karşı tablo karışık — bazılarında önde (EEBench, Harvey Legal, AA Briefcase'de GPT'nin üstünde), bazılarında geride (Terminal-Bench 4.0 ve CursorBench'te Fable 5.1 açık ara önde; HealthBench'te ikisinin de gerisinde). Yani yarışıyor ama "her testte birinci" değil.
- Güvenlik notu: Sayfa güvenlik ölçümleri de paylaşıyor — bir "dual-use" testinde riskli komutların yaklaşık %3,3'ünün geçtiğini, bir biyogüvenlik testinde %62,4 aldığını belirtiyor. Bunlar da xAI'nin kendi ölçümleri.
Bizim yorumumuz
Hikâye #33'teki Grok 4.6 ile aynı ritimde: önceki sürüme göre net ilerleme, sınır modellere karşı karışık bir tablo — bazı testlerde önde, bazılarında (özellikle Terminal-Bench ve CursorBench'te Fable 5.1'in açık ara önde olduğu yerlerde) geride, hepsi de xAI'nin kendi ölçümü. Bizim kitlemiz için asıl değer yine fiyat ve hız: 2$/6$ ve "iki kat hız, yarı fiyat" iddiası, sınır seviyeye yakın bir model için ucuz sayılır ve geniş erişilebilir. Kod ya da ajan işi yapıyorsan denenmeye değer düşük maliyetli bir seçenek. Dürüst uyarılar aynı: rakamlar bağımsız değil (birkaç hafta içinde gerçek kıyaslar gelir) ve "yarışıyor" demek "en iyisi" demek değil. Bir de şunu not düşelim: bu, ~2,5 ayda işlediğimiz üçüncü Grok sürümü (4.5, 4.6, 4.7) — asıl işaret belki de tek tek modeller değil, sınır laboratuvarlarının bu ucuz-hızlı sürümleri ne kadar sık çıkardığı.
Kaynak: xAI