Grok 4.5, xAI tarafından Temmuz 2026'da resmi olarak duyurulan ve yazılım geliştirme ile ajan tabanlı görevler için özel olarak eğitilmiş yeni nesil bir yapay zeka modelidir. Elon Musk, bu modelin Anthropic'in Fable 5 modelini performans açısından geçtiğini iddia etmiştir; ancak resmi benchmark verilerine göz atıldığında bu iddianın tamamıyla doğru olmadığı ortaya çıkmaktadır. Video, bu karşılaştırmaları detaylı bir şekilde inceleyerek, Musk'ın iddialarının hangi kısmının gerçeğe uygun olduğunu, hangisinin eksik veya yanıltıcı olduğunu ortaya koyar. Ayrıca modelin fiyatlandırması, erişilebilirliği ve gerçek dünyadaki uygulamalarından bahsedilmektedir.

Benchmark testleri açısından, xAI'ın yayınladığı veriler incelendiğinde ilginç bir tablo ortaya çıkmaktadır: SWE-bench Pro testinde Fable 5 %80.4 ile Grok 4.5'in %64.7'sinden çok daha ileridedir; Terminal-Bench 2.1'de Fable %84.3 ile Grok %83.3'ün karşısında lider konumdadır; DeepSWE 1.1 testinde de Fable %70 ile Grok'un %53'ünü oldukça geride bırakmıştır. Sadece SWE Marathon testinde Grok 4.5 %29.0 ile Fable 5'in %24.0'ını geçmiştir. Bu bulgular, Musk'ın genel iddiaları yerine konuya daha nuanseli bakılması gerektiğini gösterir. Fable, çoğu kodlama görevinde hala daha güçlüyken, Grok belirli yazılım mühendisliği senaryolarında avantaj sağlamaktadır.

Grok 4.5'in asıl gücü, saf performans metriğinde değil, token verimliliğinde ve maliyet etkinliğinde yatmaktadır. Model, milyon token başına 2 dolar giriş ve 6 dolar çıkış fiyatıyla Anthropic'in Opus modelinden (5 ve 25 dolar) dört kat daha ucuzdur. xAI, SpaceX'in yapay zeka kolu olarak Şubat 2026'da SpaceX'e katılmış ve Cursor kod editörü ile doğrudan entegrasyon sağlamıştır. Bu entegrasyon, geliştiricilerin kod yazarken Grok'u doğrudan araçlarının içinden kullanabilmesini mümkün kılar. Model, ofis görevleri (Excel, PowerPoint, Word), kodlama ve ajan tabanlı otomasyon için özel olarak optimize edilmiştir. Avrupa Birliği'nde henüz kullanılamayan model, Temmuz ortasında bölgede erişime açılması beklenmektedir.

Özellikle yazılımcılar, veri analisti ve yapay zeka mühendisleri için bu model ilginçtir, çünkü maliyeti düşük tutarken nispeten yüksek performans sunmaktadır. Elon Musk'ın "Fable'ı geçtik" söylemi, benchmark metriklerine göre tam doğru olmasa da, asıl değer önerme bu değildir: Grok, aynı kalite seviyesinde ama daha ucuz, daha hızlı ve daha token-verimli bir seçenek sunar. Videoda sunulan değerlendirme bilimsel olarak doğru veriye dayanmakta, fakat Musk'ın pazarlama söyleminin bir kısmı eksik veya abartılı olduğunun altı çizilmektedir. Gerçek hikaye, ham performanstaki marjinal iyileşmeyi geride bırakıp, maliyet-etkinlik dengesindeki gerçek ilerlemeye odaklanmaktır.