Elon Musk'ın SpaceXAI'ı, Dogecoin (DOGE) İzlemede, Grok 4.7'yi Yüzde 71 DeepSWE Skoruyla Duyurdu

Elon Musk'ın SpaceXAI'ı Grok 4.7'yi 21 Eylül'de lansmanladı: DeepSWE v1.1'de yüzde 71,0, Terminal-Bench 4.0'da yüzde 38,0; fiyat 2/6 dolar sabit kaldı.

(00:39 UTC)
4 dakika okuma süresi
AI ÖzetiAI
  • SpaceXAI, Grok 4.7'yi 21 Eylül'de duyurdu ve DeepSWE v1.1'de yüzde 71,0 skor aldı.
  • Terminal-Bench 4.0'da Grok 4.7, önceki sürümün yüzde 20,3'ünden yüzde 38,0'a çıktı.
  • Grok 4.7 fiyatı, milyon token başına 2 dolar / 6 dolarla Grok 4.6 ile aynı kaldı.
  • GPT-5.6 Sol 4 dolar / 20 dolar, Fable 5.1 ise 10 dolar / 50 dolar tarifeli.
k7rq2fdm

Grok 4.7 Saatler Süren İş Yüklerini Hedefliyor

Elon Musk'ın yapay zekâ kolu SpaceXAI, Grok 4.7'yi 21 Eylül'de yayına aldı ve modeli bugüne kadar geliştirdiği en yetenekli kodlama ve bilgi işi modeli olarak tanıttı. Resmî duyuruya göre sistem, Grok 4.6'dan daha büyük bir temel model üzerinde inşa edildi ve daha zor görev karışımları üzerinden daha uzun pekiştirmeli öğrenme (reinforcement learning) döngülerinden geçti; odak, tamamlanması birkaç saat süren problemlerdi. SpaceXAI lansmanı dayanıklılık ekseninde konumlandırıyor: önceki modeller dakikalar içinde yanıt verirken bu model, bir insan mühendisin veya analistin saatlerini alacak işleri ilerletecek şekilde ayarlandı. Şirkete göre model artık uzun oturumlarda kendi çıktısını doğrulamada, çok uzun bağlam pencerelerini yönetmede ve Grok Bot ajan çerçevesini (agent framework) yerel olarak çalıştırmada belirgin biçimde daha iyi; bu sıçramanın sohbet, genel bilgi görevleri ile profesyonel belge ve sunum üretiminde görüldüğü iddia ediliyor. Yayımlanan kıyaslamalar (benchmark) xhigh yapılandırmasını sınırın dibine yerleştiriyor: yazılım mühendisliği paketi DeepSWE v1.1'de Grok 4.7 yüzde 71,0 aldı; Fable 5.1 max'ın yüzde 70,0'ının önüne geçti ve yalnızca GPT-5.6 Sol max'ın yüzde 72,7'sinin gerisinde kaldı. Saatler süren terminal çalışmasını puanlayan Terminal-Bench 4.0'da ise model, bir önceki sürümün yüzde 20,3'ünden yüzde 38,0'a fırladı. Avukatlar, hemşireler ve finans analistleri için uzun süreli mesleki işleri simüle eden paketlerde — AA Briefcase ve HealthBench dahil — SpaceXAI, Grok 4.7'nin artık sektörün en iyileriyle aynı hizada koştuğunu söylüyor. Güvenlik de başlıklı iddialardan biri: yeniden kurgulanan güvenlik katmanı sayesinde bu sürüm, uygunsuz talepleri reddetmede ve jailbreak girişimlerine dirençte şirketin şimdiye kadarki en sert versiyonu. Kötücül siber görevleri test eden HackerBench v0.3'te yüksek riskli çift kullanımlı yönlendirmelerin yalnızca yüzde 3,3'ü geçti; meşru savunma güvenliği işine dair yanlış reddetmeler de az kaldı. Seçilmiş siber güvenlik ortaklarına, savunma araştırmalarını desteklemek için yalnızca davetiyeyle girilen kırmızı takım erişimi verildi. Model şu an Cursor, Grok Build, Grok API, büyük bulut platformları ve model yönlendiricileri üzerinden canlı.

Fiyat 2 Dolar Sabit Kalırken Brood War Grok 4.6'yı Sırtüstü Yıktı

Asıl sessiz şok fiyatta: Grok 4.7, milyon giriş token'ı başına 2 dolar ve milyon çıkış token'ı başına 6 dolarla — Grok 4.6 ile aynı oranlarla — lansmana çıktı; buna karşılık çıkış hızını iki katına çıkaran, fiyatı da iki katına koyan hızlı bir varyant sunuluyor. Tokenomik rakamları rekabeti sert biçimde dibe vuruyor: GPT-5.6 Sol milyon token başına 4 dolar / 20 dolar, Fable 5.1 ise 10 dolar / 50 dolar listeleniyor; Grok'un oranları, daha hızlı teslimatla birlikte kabaca rakiplerin üçte biri ile yarısı aralığında. SpaceXAI'nin kendi kıyaslama tablosuna bakılırsa Grok 4.7, elektrik mühendisliğinde (EEBench: yüzde 64,0'ya karşılık GPT-5.6 Sol'da yüzde 39,4 ve Fable 5.1'de yüzde 56,4) ve Harvey hukuk ajanı kıyaslamasında (yüzde 19,6'ya karşılık yüzde 2,5 ve yüzde 6,7) lider; buna karşılık yazılım mühendisliğinde (CursorBench 4.0: yüzde 46,3'ya karşılık yüzde 51,8) ve klinik akıl yürütmede (HealthBench Professional: yüzde 56,7'ye karşılık yüzde 62,1) Fable 5.1'in gerisinde. Yukarıdaki her sayı SpaceXAI'nin yayımladığı verilerden geliyor. Kurumsal arka plan da önemli: SpaceXAI bugünkü şeklini Şubat'ta, xAI'nin SpaceX ile birleşmesiyle aldı; ardından Haziran'da Cursor satın alındı — Musk'ın Tesla (TSLA)'yı da kapsayan imparatorluğunun bir parçası. Daha önce aktardığımız gibi şirket, yapay zekâ abonelik planlarını haftalar içinde tek çatı altında toplamaya hazırlanıyor. Ne var ki lansmandan saatler önce kitle kaynaklı bir kıyaslama, bir önceki sürümü yerden yere vurdu. Geliştirici Ben Swerdlow'un, yapay zekâ ajanlarının StarCraft: Brood War oynadığı Brood War Bench, 20 Eylül'de X'te dolaşıma girdi: Codex, Claude ve Grok'tan 19 yapılandırma 171 birebir maçta karşılaştı ve Codex Astra, maksimum akıl yürütme ayarında oynadığı 18 maçı da saniye saniye süpürdü. Grok 4.6'nın üç yapılandırması tüm Codex ve Claude karşılıklarına kaybetti; en iyi sonuç 18'de 2 galibiyet. Swerdlow, tepe akıl yürütme ayarındaki Grok'un bir maçta 43 dakikada 11.138 akıl yürütme token'ı yaktığını ama yalnızca altı komut grubu yayımladığını — ve sahaya tek bir muharebe birliği dahi çıkaramadığını — kaydettikten sonra, Grok'un bu oyun için henüz yeterince akıllı olmadığını, eski modellerin gerçek zamanlı stratejiyi sıra tabanlı (turn-based) sanarak oynadığını yazdı. Katılımcıların hiçbirinin acemi (novice) seviyesini aşamadığını, Grok 4.7'nin ise henüz derecelendirilmediğini de ekledi. Piyasayı anlık izlemek isteyen okurlar, spot ve vadeli fiyatları Bitget üzerinden canlı takip edebilir.

Asıl Sinyal Fiyat Baskısı

Lansman günü rakamları ile Brood War faciasının aynı hikâyeyi anlattığını düşünüyoruz: sınır laboratuvarları artık akıl yürütmeyi emtia fiyatına satıyor ve kazananı statik kıyaslama skorları değil, ajan güvenilirliği belirliyor. COINOTAG'in okuması şu: 2 dolar / 6 dolar tarifesi, Grok 4.7'ye rakiplerin eşleşmek zorunda kaldığı bir tokenomik kazandırıyor — tıpkı vadeli işlem (futures) fiyatlamasının piyasaları beklentileri yeniden sabitlemeye zorlaması gibi. Karşılaştırılabilir işlem gücü olmayan laboratuvarlar ise bu fiyat savaşında çıkış likiditesine dönüşme riski taşıyor. Tarihsel olarak Musk kökenli işlem gücü haberleri, Dogecoin (DOGE) gibi Musk'a bağlı varlıklardaki duyarlılığı hareket ettirdi; bizim takibimiz Grok 4.7'nin lansman iddiaları değil, ajan performansı üzerinden olacak.

COINOTAG News Desk
COINOTAG News Desk

COINOTAG'in editöryal ve araştırma ekibi.

AI Destekli

Yapay zekâ destekli üretildi, AI ile incelendi ve COINOTAG editöryal gözetiminde yayımlandı.