Kapsam: Son 24–36 saat · Kaynak politikası: Birincil kaynaklar ve tanınmış haber ajansları önceliklendirilmiş, doğrulanmamış bilgiler açıkça işaretlenmiştir.
Günün Özeti
Günün en sağlam haberi fiyat/performans dengesinin sınır modellerde kayması oldu: SpaceXAI’nin Grok 4.6’sı bağımsız bir bileşik endekste OpenAI’nin en iyi modeliyle eşitlenirken token fiyatını %60’ın üzerinde altta tuttu. İkinci önemli eksen kurumsal uyum ve veri egemenliği; Mistral bölgesel çıkarımı genel kullanıma açtı, fakat kapsamın “egemenlik” söyleminden belirgin biçimde daha dar olduğu ortaya çıktı. Üçüncü ve en ciddi başlık ajan destekli siber saldırının devlet düzeyinde doğrulanması: Tayvan, temmuzda kamu kurumlarına yönelik yapay zekâ ajanı destekli bir saldırıyı resmen kabul etti.
Ölçüm tarafında dikkat çekici bir çelişki var. Google Gemini uygulamasının 1 milyar aylık kullanıcıya ulaştığını duyurdu; buna karşılık üç bağımsız veri kaynağı Gemini’nin fiili kullanım payının gerilediğini gösteriyor. Bu ayrışma, “aylık aktif kullanıcı” metriğinin kurumsal karar alma için zayıf bir sinyal olduğunu hatırlatıyor.
Öne Çıkan Gelişmeler
Sıralama, profesyonel kullanıcı üzerindeki doğrudan etki potansiyeline göre yapılmıştır.
1. Grok 4.6, sınır performansını üçte bir fiyata sunuyor
Kurum: SpaceXAI (xAI) · Ne oldu: Artificial Analysis Intelligence Index’te 61 puan alan Grok 4.6, OpenAI’nin GPT-5.6 Sol’u ile eşitlendi; yalnızca Claude Opus 5 (63) ve Claude Fable 5 (62) üstünde kaldı. Bu, selefi Grok 4.5’e göre beş puanlık bir sıçrama. Model özellikle ajan görevlerinde güçlü: gerçek dünya bilgi işini ölçmeyi amaçlayan GDPval-AA v2 kıyaslamasında 1.753 Elo ile ikinci sırada ve karmaşık görevleri yaklaşık 53 adımda tamamlıyor; Claude Opus 5 aynı işi yaklaşık 103 adımda yapıyor 1.
| Model | Endeks puanı | Girdi/Çıktı (milyon token) |
|---|---|---|
| Claude Opus 5 | 63 | 5 $$/ 25$$ |
| Claude Fable 5 | 62 | — |
| Grok 4.6 | 61 | **2 **$$/ 6$$ |
| GPT-5.6 Sol | 61 | 5 $$/ 30$$ |
Neden önemli: Adım verimliliği ile token fiyatı birleştiğinde, çok adımlı ajan iş akışlarında toplam maliyet farkı katlanarak büyür. Model API, Cursor, Grok Build ve OpenRouter, Vercel, Cloudflare gibi ortaklar üzerinden hemen erişilebilir durumda; xAI ilk hafta için Grok Build ve Cursor’da çift kullanım kotası sunuyor.
2. Tayvan, kamu kurumlarına yönelik ajan destekli saldırıyı resmen doğruladı
Kurum: Tayvan Dijital İşler Bakanlığı · Ne oldu: Bakanlık, temmuz ayında kamu kurumlarını hedef alan “anormal bir saldırı” tespit ettiğini ve 20 Temmuz’dan itibaren Ulusal Siber Güvenlik Enstitüsü’nün bir dizi uyarı yayımladığını açıkladı. İnceleme, saldırganların manuel operasyonları yapay zekâ ajanı destekli saldırılarla harmanladığını gösterdi; bakanlık örnek olarak Open Claw’ı adlandırdı ve kaynağın “yurt dışı” karakteristiği taşıdığını belirtti. Çin’in adı açıklamada geçmiyor 2.
Açıklama, İsrailli siber güvenlik şirketi Dream’in bir gün önce yayımladığı raporun ardından geldi. Dream’e göre bir yapay zekâ ajanı ekibi dört gün boyunca çok sayıda yetkiliden şifre çıkardı, adalet bakanlığından personel kayıtları çaldı ve nükleer güvenlik ajansını zafiyet taramasına tabi tuttu; şirket, ajanların “tam operasyonel çalışma alanını” kurtardığını söylüyor. Dream hedefi adlandırmadı, hedef kurumları Tayvan’a ait olarak tanımlayan ilk yayın Financial Times oldu.
“İçinde hâlâ bir yerde bir insan var. Birinin kime saldıracağını seçmesi, bir hedef belirlemesi ve bir direktif vermesi gerekti. Bu tamamen, yüzde yüz otonom değil.”— Cris Thomas, Semgrep güvenlik savunucusu, Reuters’a 2
Neden önemli: Bu, ajan destekli bir casusluk kampanyasının hedef devlet tarafından kabul edildiği ilk belirgin örneklerden biri. Kurumsal savunma açısından pratik sonuç, tespit pencerelerinin gün değil saat ölçeğine inmesidir. Belirsiz bilgi işareti: Bazı yayınlarda geçen “21 kamu sistemi, 85 hesap, 8 eşzamanlı ajan” gibi sayısal ayrıntılar Dream’in raporuna dayanıyor ve Reuters tarafından bağımsız olarak doğrulanmamıştır.
3. Mistral’ın AB veri işleme seçeneği geldi, fakat kapsamı sınırlı
Kurum: Mistral AI · Ne oldu: Bölgesel çıkarım genel kullanıma açıldı; müşteriler isteklerini Avrupa (api.eu.mistral.ai) veya ABD (api.us.mistral.ai) uç noktasına yönlendirebiliyor ve işlem o bölgede kalıyor. Standart fiyatın üzerine %10 ek ücret uygulanıyor. Ayrıca %99,5 çalışma süresi taahhüdü içeren bir Priority Tier açık betada; yoğun trafikte öncelikli kuyruk sağlıyor ve standart fiyatın 1,75 katına satılıyor 3.
Kapsam, “egemenlik” ifadesinden daha dardır ve bu ayrım sözleşme aşamasında kritik önemdedir:
| Bölgesel uç noktada çalışan | Bölgesel uç noktada çalışmayan |
|---|---|
| Standart model çağrıları | Ajanlar (Agents) |
| Function calling | Toplu işleme (batch) |
| — | Dosya yönetimi (Files API) |
Ek olarak hesap ayarları, API anahtarları, faturalama ve kullanım istatistikleri seçilen bölgenin dışında işlenebiliyor; bölge dışı alt yüklenicilere sınırlı ve güvenli aktarımlar da mümkün. Bölgesel olan yalnızca hesaplama adımıdır; isteklerin sonradan saklanıp saklanmadığı Zero Data Retention adlı ayrı bir ayara bağlı. Mistral aynı zamanda platformunu üçüncü taraf açık modellere açtı; ilk olarak Z.ai’nin GLM-5.2 modeli aynı bölgesel kurallarla sunuluyor.
Neden önemli: Sözleşme metnini doğrudan modele gönderen bir ekip AB uç noktasını kullanabilir; ancak ajanlara veya Files API üzerinden dosya yönetimine ihtiyaç duyan bir mimari aynı garantiyi alamaz. Bu, KVKK/GDPR temelli tedarik değerlendirmelerinde doğrudan belirleyici bir kısıttır.
4. Gemini’nin kullanıcı sayısı ile kullanım payı ters yönde hareket ediyor
Kurum: Google · Ne oldu: Google, Gemini uygulamasının 1 milyar aylık aktif kullanıcıyı geçtiğini duyurmuştu. Buna karşılık üç bağımsız veri noktası tersini gösteriyor: metin tanıma platformu Pangram’ın gönderilen metinler üzerinden yaptığı analize göre Gemini’nin payı Temmuz 2026’da %12’den %1,9’a düştü — Pangram bunu “çöküş” olarak niteliyor. Aynı dönemde OpenAI %50’nin üzerindeki payını korudu, Anthropic %4,3’ten %14,9’a çıktı. Similarweb verisi Google’ın web pazar payının %27’den %26,8’e gerilediğini gösteriyor (bir yıl önce %9,4 idi) 4.
Neden önemli: Her üç kaynağın da kör noktaları var — Pangram ağırlıklı olarak yazma görevlerini ölçüyor, OpenRouter açık ağırlıklı modellere eğilimli, Similarweb mobil uygulamaları görmüyor. Yine de üçü aynı yöne işaret ediyor. Model seçimi yapan ekipler için çıkarım açık: kullanıcı sayısı duyuruları tedarik kararı için yeterli bir gösterge değil, fiili kullanım ve kıyaslama verisi esas alınmalıdır.
5. Microsoft, Copilot için ucuzlattığı yeni kod modelinde açık rakiplerin gerisinde kaldı
Kurum: Microsoft · Ne oldu: GitHub Copilot için yayımlanan MAI Code 1.1 Flash, selefine göre %25 daha token verimli ve maliyeti dörtte biri; geliştiriciler çıktısının %4 fazlasını kabul etmiş. Ancak kıyaslamalar, modelin daha ucuz olan DeepSeek V4 Flash karşısında belirgin biçimde geride kaldığını gösteriyor 5.
| Kıyaslama | MAI Code 1.1 Flash | Claude Haiku 4.5 | GPT-5.4 mini | DeepSeek V4 Flash |
|---|---|---|---|---|
| SWE-bench Verified | %72,6 | %69,8 | %69,2 | Yayımlanmadı |
| Terminal Bench 2.1 | %62,9 | %49,4 | %60,7 | %82,7 |
| Çıktı fiyatı (M token) | 1,20 $ | 5,00 $ | — | 0,28 $ |
Neden önemli: Microsoft ekosistemindeki kullanıcılar hâlâ model seçebiliyor, ancak varsayılanların zamanla kendi modellerine kayması bekleniyor. Kod üretimini Copilot üzerinden yürüten ekiplerin varsayılan model ayarını bilinçli olarak gözden geçirmesi gerekiyor.
6. Kurumsal yapay zekâ yatırımı modelden uygulamaya kayıyor
Kurum: Thrive Holdings (OpenAI ortaklı) · Ne oldu: Şirket, SoftBank, D1 Capital Partners ve Altimeter Capital’in katılımıyla 12 milyar dolar değerleme üzerinden 2 milyar dolar topladı. İş modeli, muhasebe ve bilgi teknolojileri gibi geleneksel işletmeleri satın alıp iş akışlarına yapay zekâ gömmek. Platformdaki işletme sayısı 70’i aştı: muhasebe kolu Current 50’den fazla firma ve 2.000’den fazla profesyoneli barındırıyor, TaxAI adlı ajanları 7.000’den fazla vergi beyanını %98 doğrulukla işledi ve hazırlık sürelerini %30’un üzerinde kısalttı; BT kolu Shield’da yardım masası çözüm süreleri 36 kat hızlandı 6. Yeni fonun bir kısmı, fiziksel varlıkların onay, sertifikasyon ve uyum süreçlerine odaklanan üçüncü bir platforma gidecek.
Neden önemli: Değerin modelden ziyade uygulamada oluştuğu tezi sermaye tarafından fiyatlanıyor. OpenAI ve Anthropic’in özel sermaye şirketleriyle kurduğu benzer uygulama ortaklıkları da aynı yönü gösteriyor.
7. Anthropic hukuk dikeyine yönetici düzeyinde yatırım yapıyor
Kurum: Anthropic · Ne oldu: Hukuk yapay zekâsı alanında doktorası bulunan ve Akiva AI’yı kuran Robert Mahari, şirketin ilk “Head of Claude for Legal” pozisyonuna atandı. Anthropic mayısta Claude için on iki hukuk eklentisi tanıtmış ve LexisNexis ile Relativity dahil yirmiden fazla hukuk teknolojisi şirketiyle ortaklık duyurmuştu. Aynı pazarda OpenAI Ironclad kurucusu Jason Boehmig’i işe aldı, Amazon hukuk görevleri için Amazon Quick’i başlattı ve Microsoft Word’ün içine sözleşme incelemesi yapan bir hukuk ajanı yerleştirdi 7.
Neden önemli: Hukuk, kaynak uydurma ve gizlilik kısıtları nedeniyle en geç benimseyen dikeylerden biriydi. Modellerin mevcut hukuk kaynaklarına ve büro yazılımlarına bağlanması, bu direncin çözülmeye başladığını gösteriyor.
8. Filigran uygulaması beklenen tepkiyi doğurdu
Kurum: Anthropic · Ne oldu: Şirketin AB Yapay Zekâ Yasası Şeffaflık Kodu’na uyum için metin çıktılarına filigran eklemeye başlaması, bir kısım kullanıcı arasında hoşnutsuzluk yarattı; şikâyetlerin odağı, filigranın yapay zekâ kullanımını iş yerinde ve derslerde tespit edilebilir kılması 8.
Neden önemli: Kurumsal içerik akışları açısından bu bir belirsizlik değil, planlanması gereken bir gerçeklik. Filigran model düzeyinde uygulandığı için kopyala-yapıştırla taşınıyor ve Claude’un tüm yüzeylerinde geçerli. Ajans, akademi ve kurumsal iletişim ekiplerinin açıklama politikalarını buna göre güncellemesi gerekiyor.
9. Sağlık alanında beklenti ile sonuç arasındaki makas ölçüldü
Kurum: Society of Breast Imaging üyeleri arasında yapılan anket (Clinical Imaging) · Ne oldu: 215 üyeyle yapılan araştırmaya göre üyelerin yaklaşık yarısı FDA onaylı yapay zekâ araçlarını zaten kullanıyor, %11’i kullanmayı planlıyor. Ancak beklenti ile gerçekleşen arasında belirgin bir açık var: geri çağırma oranlarının düştüğünü bildirenler %35 (beklenti %59), gereksiz biyopsilerin azaldığını söyleyenler %9 (beklenti %36), tükenmişliğin azaldığını belirtenler %29 (beklenti %56). Çoğunluk yapay zekâyı esas olarak ikinci görüş olarak konumlandırıyor; en büyük engeller maliyet ve kurumsal destek eksikliği 9.
Neden önemli: Düzenlenmiş, yüksek riskli alanlarda yapay zekâ dağıtımının değeri araç yeteneğinden değil süreç tasarımından geliyor. Bu, kurumsal pilot projelerin başarı ölçütlerini belirlerken referans alınması gereken somut bir veri noktası.
10. Eğitim verisi ve içerik kullanımında şeffaflık tartışması genişliyor
Kurumlar: Amazon/Twitch, OpenWALDO girişimi · Ne oldu: Amazon, Twitch yayıncılarının içeriğini varsayılan olarak model eğitiminde kullanacağını, isteyenlerin bunu devre dışı bırakması gerektiğini duyurdu 10. Diğer yönde, Rocky Linux kurucusu Gregory Kurtzer eğitim verisini açık kaynak bağımlılıkları gibi denetlenebilir kılmayı amaçlayan topluluk yönetimli OpenWALDO girişimini başlattı; kamuya açık külliyat 75,1 milyon doküman içinde 124 milyar referans tokeni lisans bilgisiyle dizinliyor ve veri kökeni ile model soyağacını izlemek için “AI Bill of Materials” kavramını öneriyor 11.
Neden önemli: Kurumsal içerik üreten her yapı için iki yönlü bir sorumluluk doğuyor: kendi içeriğinin nasıl kullanıldığını denetlemek ve kullandığı modellerin veri kökenini belgelemek.
Yeni ve Güncellenen Profesyonel Hizmetler
| Hizmet | Sağlayıcı | Hedef kullanıcı | Temel yetenek | Erişim / fiyatlandırma | Pratik kullanım alanı |
|---|---|---|---|---|---|
| Grok 4.6 | SpaceXAI (xAI) | Ajan geliştiricileri, yoğun token tüketen ekipler | Sınır düzeyi genel yetenek; çok adımlı görevlerde yüksek adım verimliliği | 2 $$/ 6$$ (milyon token); API, Cursor, Grok Build, OpenRouter, Vercel, Cloudflare. İlk hafta Grok Build ve Cursor’da çift kota 1 | Maliyet duyarlı otomasyon hatları, uzun soluklu araştırma ve kodlama ajanları |
| Regional Inference | Mistral AI | Banka, sigorta, kamu ve AB’de veri ikametgâhı gerektiren kurumlar | İsteklerin AB veya ABD uç noktasında işlenmesi; function calling destekli | Standart fiyat + %10; api.eu.mistral.ai / api.us.mistral.ai. Ajanlar, batch ve Files API kapsam dışı 3 | Sözleşme, başvuru ve müşteri metinlerinin bölge dışına çıkmadan işlenmesi |
| Priority Tier | Mistral AI | Üretim ortamında gecikmeye duyarlı sistemler | Yoğun trafikte öncelikli kuyruk; %99,5 çalışma süresi taahhüdü | Standart fiyatın 1,75 katı; açık beta; satış sözleşmesi gerekli; service_tier parametresiyle etkinleştirilir 3 | Müşteri hizmetleri asistanları, üretim hattı sistemleri |
| MAI Code 1.1 Flash | Microsoft | GitHub Copilot kullanan geliştirme ekipleri | Kod üretimi; selefine göre %25 daha token verimli | Girdi 0,20 $$/ önbellekli 0,02$$ / çıktı 1,20 $; Copilot içinden 5 | Rutin kod tamamlama; terminal ağırlıklı ajan işlerinde alternatifler değerlendirilmeli |
| GLM-5.2 (Mistral platformunda) | Z.ai, Mistral üzerinden | AB’de barındırma arayan maliyet odaklı ekipler | Üçüncü taraf açık model; Mistral’ın bölgesel kurallarıyla aynı garantiler | Mistral platformu üzerinden; fiyat kamuya açıklanmadı 3 | Avrupa’da barındırılan yüksek hacimli çıkarım |
| Claude for Legal | Anthropic | Hukuk büroları ve kurumsal hukuk departmanları | Hukuk dikeyi için özel eklentiler ve büro yazılımı entegrasyonları; ayrı yönetim kadrosu | Mevcut Claude ürünleri içinde; on iki hukuk eklentisi ve 20+ legal tech ortaklığı 7 | Sözleşme incelemesi, keşif (discovery), mevzuat araştırması |
| Live Transcribe (İşaret dili) ve Rambler | Erişilebilirlik gereksinimi olan kurumlar, sesli iş akışları | Pixel kamerayla Amerikan İşaret Dili’nin metne çevrilmesi; dağınık konuşmayı anlayan sesli giriş | Pixel 11 serisiyle birlikte; Pixel 11 899 $$, Pixel 11 Pro 1.099 $$ 12 | Erişilebilir toplantı ve saha iletişimi; serbest konuşmayla not alma | |
| Regülasyon platformu (yeni dikey) | Thrive Holdings | İnşaat, enerji, veri merkezi ve sağlık altyapısı yatırımcıları | İzin hazırlama, denetim dokümantasyonu ve uyum takibinin ajanlarla hızlandırılması | Yeni kurulan platform; ticari erişim koşulları açıklanmadı 6 | Fiziksel varlıkların onay ve sertifikasyon süreçlerindeki darboğazlar |
Doğrulanmamış olarak işaretlenenler. Nvidia’nın en az bir trilyon parametreli Nemotron 4 ailesini geliştirdiği bilgisi The Information’a dayanan bir habere dayanıyor ve şirket tarafından resmen duyurulmamıştır; en erken çıkış bu sonbahar olarak aktarılıyor 13. Benzer şekilde Anthropic’in Decart AI’yı satın almak için görüştüğü bilgisi tek bir kaynağa dayalıdır ve kesinleşmemiştir 14; Cognition’ın 40 milyar dolar değerleme üzerinden tur görüştüğü haberi de aynı statüdedir 15.
Kaynaklar
[1] SpaceXAI’s Grok 4.6 matches OpenAI’s best model and undercuts it on price — The Decoder
[2] Taiwan says it was targeted last month in AI-driven hacking campaign — Reuters
[6] OpenAI-backed Thrive Holdings raises $2B to bring AI to the enterprise — TechCrunch
[9] AI tools for breast cancer detection fall short of radiologists’ expectations — The Decoder
[10] Amazon will train on Twitch streamers’ content by default, unless they opt out — TechCrunch
[14] Anthropic in talks to buy Decart AI, source says — Reuters
[15] AI coding startup Cognition reportedly already in talks to raise at $40B valuation — TechCrunch