Elon Musk’ın daha önce xAI adıyla faaliyet gösteren yapay zeka şirketi SpaceXAI, yeni amiral gemisi yapay zeka modeli Grok 4.6’yı tanıttı. Grok 4.5’in yayınlanmasından yaklaşık bir ay sonra kullanıma sunulan model; uzun süreli yapay zeka ajanları, kodlama, bilgi işleri ve görsel uygulama geliştirme alanlarına odaklanıyor.
SpaceXAI’ın aktardığına göre Grok 4.6; araştırma yapmak, farklı kaynaklardaki bilgileri analiz etmek, büyük kod tabanları üzerinde çalışmak ve bir fikri işlevsel bir uygulamaya dönüştürmek gibi çok adımlı görevleri sürdürebiliyor. Modelin özellikle uzun süren görevlerde bağlamını koruması ve çalışmasını tamamlamadan önce kendi çıktısını test etmesi hedefleniyor.
Grok 4.6’nın eğitim süreci
Grok 4.6’nın geliştirilmesi sırasında Grok 4.5’e kıyasla daha uzun bir ek eğitim süreci yürütüldüğü belirtiliyor. Paylaşılan bilgilere göre; bu süreçte muhakeme ve ileri teknik kavramlara yönelik, modeller tarafından oluşturulan seçilmiş veriler kullanıldı. Eğitim veri setine yüksek kaliteli mühendislik verileri de dahil edilirken, modelin optimizasyon yöntemi ve eğitim yaklaşımı güncellendi.
Şirket daha sonra Grok 4.5’i kullanarak farklı muhakeme seviyeleri, ajan altyapıları, STEM, yazılım mühendisliği ve bilgi işleri için denetimli ince ayar, yani SFT verilerini yeniden oluşturdu. Sorunlu eğitim örnekleri ise model tabanlı kontrollerden geçirilerek veri setinden çıkarıldı. Grok 4.6’nın pekiştirmeli öğrenme aşamasında genel kodlama ve bilgi işlerinin yanı sıra çekirdek optimizasyonu, web geliştirme ve bilgisayar destekli tasarım gibi alanlara özel ajan görevlerinden yararlanıldı.
Grok 4.6’nın performansı
SpaceXAI, Grok 4.6’nın genel bir ürün fikrini çalışan bir ilk sürüme dönüştürme konusunda önceki modele kıyasla daha başarılı olduğunu belirtiyor. Modelin bilmediği bir alanı araştırabildiği, uygulamanın yapısını kurabildiği, temel etkileşimleri geliştirebildiği ve kullanıcı geri bildirimleri doğrultusunda çıktıyı birkaç tur boyunca iyileştirebildiği ifade ediliyor.
Görsel ve etkileşimli projelerde de Grok 4.5’e göre daha güçlü ilk çıktılar üreten model, bir uygulamanın yapısını ve görsel dilini tek seferde oluşturabiliyor. Şirket, uzun görevlerde modelin ilerlemeden önce kendi çalışmasını test etme ve doğrulama eğiliminin de arttığını söylüyor.
Grok 4.6, dokuz farklı testi bir araya getiren Artificial Analysis Intelligence Index’te 61 puan aldı. Grok 4.5’in aynı testteki puanı 56 seviyesindeydi. Yeni model bu sonuçla OpenAI’ın GPT-5.6 Sol Max modeliyle aynı puana ulaşırken, Anthropic’in Fable 5 Max modelinin bir puan gerisinde kaldı.

Model, uzun süreli bilgi işlerini değerlendiren AA-Briefcase testinde 1577 puan alarak Fable 5 Max’in 1574 ve GPT-5.6 Sol Max’in 1502 puanını geçti. GDPVal-AA v2 testinde de 1753 puanla her iki rakibinin önünde yer aldı. CursorBench v3.2’de yüzde 69,9 ve DeepSWE v1.1’de yüzde 65,9 başarı oranına ulaşan Grok 4.6, bu iki testte Fable 5 Max’in gerisinde kaldı. SpaceXAI, rakip modellere ait verilerin geliştiricilerin sistem kartlarından ve herkese açık test sonuçlarından alındığını belirtiyor.
Grok 4.6’nın fiyatı ve erişim seçenekleri
Grok 4.6, Cursor ve SpaceXAI’ın kodlama aracı Grok Build üzerinden kullanılabiliyor. Model ayrıca SpaceXAI API’sinin yanı sıra OpenRouter, Vercel ve Cloudflare gibi iş ortakları aracılığıyla geliştiricilere sunuluyor. Grok 4.6’nın API fiyatlandırması bir milyon girdi tokenı için 2 dolar, bir milyon çıkış tokenı için ise 6 dolardan başlıyor. Modelin iki kat daha hızlı çalışan sürümü, standart fiyatın iki katı üzerinden ücretlendiriliyor.
Şirket, lansmanın ilk haftasında Cursor ve Grok Build kullanıcılarına iki kat dahil kullanım hakkı sunuyor. SpaceXAI, modelin yetenekleriyle birlikte güvenlik önlemlerini de güncellediğini belirtiyor. Şirketin açıklamasına göre Grok 4.6, şimdiye kadarki en kapsamlı dağıtım öncesi yetenek ve güvenlik testlerinden geçirildi. Model için dağıtım sonrasında ve üçüncü taraflarla birlikte ek testlerin de yürütüleceği ifade edildi.
İlk Yorumu yazmak ister misiniz?
Yorum Yazmak için Giriş Yap