Elon Musk, Tesla çalışanlarına kendi şirketinin geliştirdiği ve rakiplerinden daha kötü olduğunu kabul ettiği Grok yapay zeka modelini kullanmalarını emretti. Haftalık 200 dolarlık AI harcama sınırı, Grok’u hariç tutarken rakip modelleri kapsıyor. Tesla mühendisleri ise daha iyi performans gösteren Anthropic’in Claude modelini tercih ediyor.

Elon Musk, Cuma günü Tesla çalışanlarına gönderdiği bir notla, kendi şirketi xAI’nin (artık SpaceX bünyesinde) geliştirdiği yapay zeka modeli Grok‘a geçmelerini istedi. Bu hamle, Tesla’nın üçüncü taraf yapay zeka araçlarına yönelik harcamaları sınırlamasından sadece günler sonra geldi. İşin ilginç yanı, Musk’ın kendisi de Grok‘un rakiplerinden daha iyi olmadığını kabul ediyor.
The Information’ın haberine göre Musk, Grok 4.5‘in rakiplerine kıyasla daha düşük token maliyeti sunduğunu belirterek çalışanlardan “mümkün olduğunda” bu modele geçmelerini istedi. Ayrıca mühendislerden modelle ilgili geri bildirimleri doğrudan kendisine e-posta yoluyla iletmelerini talep etti.
Bu yönlendirme, Tesla’nın bu hafta başında çalışanların yapay zeka harcamalarına haftalık 200 dolar sınırı getirmesinin ardından geldi. Sınırlama Anthropic, OpenAI ve Google’ın modellerini kapsarken, Musk’ın şimdi kullanılmasını istediği xAI‘nin Grok modelini hariç tutuyor.
Tesla aylardır Grok’un beta sürümlerini dahili olarak test ediyor ve xAI ürün sorumlusu Andrew Milich, sorun giderme için Tesla çalışanlarıyla birlikte çalışıyor. Ancak dahili kullanıma aşina dört kaynağa göre, Tesla mühendisleri günlük geliştirme çalışmalarında büyük ölçüde Anthropic‘in Claude modelini tercih ediyor.
xAI, Çarşamba günü Grok 4.5‘i, SpaceX’in 60 milyar dolar değerle satın aldığı kodlama girişimi Cursor ile birlikte piyasaya sürdü. Musk modeli “Opus sınıfı” olarak tanıttı.
Ancak kıyaslama verileri daha mütevazı bir hikaye anlatıyor. Çok alanlı genel sıralamada Grok 4.5, 76.3 puanla 9. sırada yer alıyor ve OpenAI (GPT-5.6 Sol, GPT-5.5, GPT-5.6 Terra, GPT-5.4), Anthropic (Claude Fable 5, Claude 4.8 Opus, Claude 4.7 Opus) ve Google’ın (Gemini 3.1 Pro) birden fazla modelinin gerisinde kalıyor. Kodlama puanı olan 68.6 ise listedeki en düşük değer.
LiveBench’te de benzer bir tablo var: Grok ailesi, üst sıraların en altına yeni girebildi. Tarafsız DeepSWE 1.1 kodlama kıyaslamasında Grok 4.5 %53 alırken, Claude Fable 5 %70 elde etti. Ayrıca Cursor, Grok 4.5’in eğitim verilerine yanlışlıkla kendi kod tabanının eski bir sürümünün dahil edildiğini ve bunun bir kıyaslama puanını şişirdiğini açıkladı.
Musk farkı inkar etmedi: “Fable kesinlikle Grok 4.5’ten daha iyi, ancak çoğu görev Fable seviyesinde yetenek gerektirmez,” dedi. Grok 4.5’in avantajı fiyatı: listede görev başına yaklaşık 0,13 dolar maliyetle çalışıyor, Claude Fable 5 ise 1,57 dolar.
Tesla halka açık bir şirket ve mühendisleri, CEO’larının sahibi olduğu bir şirketin ürününe yönlendirilmemeli. 200 dolarlık sınırın Grok’u hariç tutması, bunun bir çıkar çatışması olduğunu gösteriyor. Maliyet endişesi anlaşılabilir, ancak daha iyi bir çözüm var: açık ağırlıklı modelleri kendi donanımınızda barındırmak. DeepSeek-V4 ve GLM-5.2 gibi modeller, öncü yeteneklerin %90-95’ini çok daha düşük maliyetle sunuyor. Bu, gerçek bir maliyet çözümü sunarken, çalışanların tercihlerine saygı duyar.
Kaynak: Haber Merkezi