SpaceXAI, Uzun Süreli Ajan Görevlerine Odaklanan Grok 4.6 Modelini Duyurdu

SpaceXAI, uzun süreli ajan görevleri ve karmaşık kodlama için optimize edilen, yüksek performanslı Grok 4.6 modelini kullanıma sundu.

Atlas Newsdesk ·

SpaceXAI, Uzun Süreli Ajan Görevlerine Odaklanan Grok 4.6 Modelini Duyurdu

SpaceXAI, karmaşık kodlama, görsel uygulama geliştirme ve çok adımlı ajan görevlerini yönetmek üzere tasarlanan Grok 4.6 modelini piyasaya sürdü. Önceki sürüme göre daha uzun bir eğitim sürecinden geçen model, özellikle uzun süreli görevlerde bağlam koruma ve kendi çıktısını test etme yetenekleriyle öne çıkıyor.

Model, Artificial Analysis Intelligence Index testinde 61 puan alarak sektördeki rakipleriyle rekabetçi bir konuma yerleşti. Uzun süreli bilgi işlerini ölçen -Briefcase testinde 1577 puanla rakiplerini geride bırakan Grok 4.6, yazılım mühendisliği odaklı testlerde ise benzer modellerin bir miktar gerisinde kaldı.

API üzerinden erişime açılan modelin fiyatlandırması, bir milyon girdi tokenı için 2 dolar, çıkış tokenı için ise 6 dolar olarak belirlendi. Şirket, modelin dağıtım öncesi güvenlik testlerini genişlettiğini ve üçüncü taraf denetimlerine devam edeceğini bildirdi.

More stories

Son haberler