Yapay Zeka

SpaceXAI, kodlama ve uzun süreli görevler için Grok 4.7’yi tanıttı

SpaceXAI, kodlama ve uzun süreli görevlerde performans sunmak üzere geliştirdiği yeni yapay zekâ modeli Grok 4.7’yi tanıttı

SpaceXAI, kodlama ve uzun süreli görevler için Grok 4.7’yi tanıttı

SpaceXAI, kodlama ve profesyonel bilgi işlerine odaklanan yeni yapay zeka modeli Grok 4.7’yi kullanıma sundu. Şirket, yeni modelin özellikle saatler sürebilen karmaşık görevlerde çalışabilmesi, kendi çıktısını daha iyi kontrol edebilmesi ve uzun bağlamları yönetebilmesi için geliştirildiğini açıkladı.

Grok 4.7, bir önceki nesil Grok 4.6’ya kıyasla daha büyük bir temel model üzerine inşa edildi. Modelin eğitiminde, tamamlanması saatler sürebilecek daha zorlu problemlere ağırlık verilirken daha uzun bir pekiştirmeli öğrenme süreci kullanıldı. Bu yaklaşımın, modelin uzun süre devam eden çok aşamalı görevlerde daha istikrarlı çalışmasına yardımcı olması hedefleniyor.

SpaceXAI’ye göre Grok 4.7 yalnızca yazılım geliştirme süreçlerine odaklanmıyor. Model; belge ve sunum hazırlama, profesyonel bilgi çalışmaları, terminal kullanımı ve farklı araçlarla yürütülen çok aşamalı görevlerde de kullanılabiliyor. Ayrıca model, şirketin ajan tabanlı çalışma altyapısı Grok Bot’u doğal olarak anlayacak şekilde eğitildi.

SpaceXAI, kodlama ve uzun süreli görevler için Grok 4.7’yi tanıttı

SpaceXAI’nin paylaştığı testlerde Grok 4.7, Grok 4.6’ya kıyasla çeşitli benchmarklarda ilerleme kaydetti. Uzun süreli kodlama görevlerini ölçen CursorBench 4.0 testinde yeni model yüzde 46,3, Grok 4.6 ise yüzde 40,4 sonuç elde etti. DeepSWE v1.1 testinde Grok 4.7’nin sonucu yüzde 71 olurken, Terminal-Bench 4.0 performansı yüzde 38 olarak açıklandı.

Model ayrıca 500 bin tokenlık bağlam penceresi sunuyor. Metin ve görsel girdileri destekleyen Grok 4.7’de düşük, orta, yüksek ve xhigh olmak üzere dört farklı muhakeme seviyesi bulunuyor.

Grok 4.7’nin API fiyatlandırması ise 1 milyon giriş tokenı için 2 dolar, 1 milyon çıkış tokenı için 6 dolar seviyesinden başlıyor. Model; xAI API, Cursor, Grok Build ve bazı üçüncü taraf platformlar üzerinden kullanılabiliyor. Daha hızlı çalışan Grok 4.7 Fast sürümü ise standart fiyatların iki katına sunuluyor.

SpaceXAI, kodlama ve uzun süreli görevler için Grok 4.7’yi tanıttı

SpaceXAI böylece Grok’u yalnızca soru-cevap odaklı bir sohbet modeli olmaktan çıkararak, uzun süre boyunca kendi başına çalışabilen yapay zeka ajanlarının merkezindeki modellerden biri haline getirmeyi hedefliyor.


Paylaş