Günlük Yapay Zekâ Raporu — 13 Ağustos 2026

Kapsam: Son 24–36 saat · Kaynak politikası: Birincil kaynaklar ve tanınmış haber ajansları önceliklendirilmiş, doğrulanmamış bilgiler açıkça işaretlenmiştir.

Günün Özeti

Günün en sağlam haberi fiyat/performans dengesinin sınır modellerde kayması oldu: SpaceXAI’nin Grok 4.6’sı bağımsız bir bileşik endekste OpenAI’nin en iyi modeliyle eşitlenirken token fiyatını %60’ın üzerinde altta tuttu. İkinci önemli eksen kurumsal uyum ve veri egemenliği; Mistral bölgesel çıkarımı genel kullanıma açtı, fakat kapsamın “egemenlik” söyleminden belirgin biçimde daha dar olduğu ortaya çıktı. Üçüncü ve en ciddi başlık ajan destekli siber saldırının devlet düzeyinde doğrulanması: Tayvan, temmuzda kamu kurumlarına yönelik yapay zekâ ajanı destekli bir saldırıyı resmen kabul etti.

Ölçüm tarafında dikkat çekici bir çelişki var. Google Gemini uygulamasının 1 milyar aylık kullanıcıya ulaştığını duyurdu; buna karşılık üç bağımsız veri kaynağı Gemini’nin fiili kullanım payının gerilediğini gösteriyor. Bu ayrışma, “aylık aktif kullanıcı” metriğinin kurumsal karar alma için zayıf bir sinyal olduğunu hatırlatıyor.

Öne Çıkan Gelişmeler

Sıralama, profesyonel kullanıcı üzerindeki doğrudan etki potansiyeline göre yapılmıştır.

1. Grok 4.6, sınır performansını üçte bir fiyata sunuyor

Kurum: SpaceXAI (xAI) · Ne oldu: Artificial Analysis Intelligence Index’te 61 puan alan Grok 4.6, OpenAI’nin GPT-5.6 Sol’u ile eşitlendi; yalnızca Claude Opus 5 (63) ve Claude Fable 5 (62) üstünde kaldı. Bu, selefi Grok 4.5’e göre beş puanlık bir sıçrama. Model özellikle ajan görevlerinde güçlü: gerçek dünya bilgi işini ölçmeyi amaçlayan GDPval-AA v2 kıyaslamasında 1.753 Elo ile ikinci sırada ve karmaşık görevleri yaklaşık 53 adımda tamamlıyor; Claude Opus 5 aynı işi yaklaşık 103 adımda yapıyor 1.

ModelEndeks puanıGirdi/Çıktı (milyon token)
Claude Opus 5635 $$/ 25$$
Claude Fable 562
Grok 4.661**2 **$$/ 6$$
GPT-5.6 Sol615 $$/ 30$$

Neden önemli: Adım verimliliği ile token fiyatı birleştiğinde, çok adımlı ajan iş akışlarında toplam maliyet farkı katlanarak büyür. Model API, Cursor, Grok Build ve OpenRouter, Vercel, Cloudflare gibi ortaklar üzerinden hemen erişilebilir durumda; xAI ilk hafta için Grok Build ve Cursor’da çift kullanım kotası sunuyor.

2. Tayvan, kamu kurumlarına yönelik ajan destekli saldırıyı resmen doğruladı

Kurum: Tayvan Dijital İşler Bakanlığı · Ne oldu: Bakanlık, temmuz ayında kamu kurumlarını hedef alan “anormal bir saldırı” tespit ettiğini ve 20 Temmuz’dan itibaren Ulusal Siber Güvenlik Enstitüsü’nün bir dizi uyarı yayımladığını açıkladı. İnceleme, saldırganların manuel operasyonları yapay zekâ ajanı destekli saldırılarla harmanladığını gösterdi; bakanlık örnek olarak Open Claw’ı adlandırdı ve kaynağın “yurt dışı” karakteristiği taşıdığını belirtti. Çin’in adı açıklamada geçmiyor 2.

Açıklama, İsrailli siber güvenlik şirketi Dream’in bir gün önce yayımladığı raporun ardından geldi. Dream’e göre bir yapay zekâ ajanı ekibi dört gün boyunca çok sayıda yetkiliden şifre çıkardı, adalet bakanlığından personel kayıtları çaldı ve nükleer güvenlik ajansını zafiyet taramasına tabi tuttu; şirket, ajanların “tam operasyonel çalışma alanını” kurtardığını söylüyor. Dream hedefi adlandırmadı, hedef kurumları Tayvan’a ait olarak tanımlayan ilk yayın Financial Times oldu.

“İçinde hâlâ bir yerde bir insan var. Birinin kime saldıracağını seçmesi, bir hedef belirlemesi ve bir direktif vermesi gerekti. Bu tamamen, yüzde yüz otonom değil.”— Cris Thomas, Semgrep güvenlik savunucusu, Reuters’a 2

Neden önemli: Bu, ajan destekli bir casusluk kampanyasının hedef devlet tarafından kabul edildiği ilk belirgin örneklerden biri. Kurumsal savunma açısından pratik sonuç, tespit pencerelerinin gün değil saat ölçeğine inmesidir. Belirsiz bilgi işareti: Bazı yayınlarda geçen “21 kamu sistemi, 85 hesap, 8 eşzamanlı ajan” gibi sayısal ayrıntılar Dream’in raporuna dayanıyor ve Reuters tarafından bağımsız olarak doğrulanmamıştır.

3. Mistral’ın AB veri işleme seçeneği geldi, fakat kapsamı sınırlı

Kurum: Mistral AI · Ne oldu: Bölgesel çıkarım genel kullanıma açıldı; müşteriler isteklerini Avrupa (api.eu.mistral.ai) veya ABD (api.us.mistral.ai) uç noktasına yönlendirebiliyor ve işlem o bölgede kalıyor. Standart fiyatın üzerine %10 ek ücret uygulanıyor. Ayrıca %99,5 çalışma süresi taahhüdü içeren bir Priority Tier açık betada; yoğun trafikte öncelikli kuyruk sağlıyor ve standart fiyatın 1,75 katına satılıyor 3.

Kapsam, “egemenlik” ifadesinden daha dardır ve bu ayrım sözleşme aşamasında kritik önemdedir:

Bölgesel uç noktada çalışanBölgesel uç noktada çalışmayan
Standart model çağrılarıAjanlar (Agents)
Function callingToplu işleme (batch)
Dosya yönetimi (Files API)

Ek olarak hesap ayarları, API anahtarları, faturalama ve kullanım istatistikleri seçilen bölgenin dışında işlenebiliyor; bölge dışı alt yüklenicilere sınırlı ve güvenli aktarımlar da mümkün. Bölgesel olan yalnızca hesaplama adımıdır; isteklerin sonradan saklanıp saklanmadığı Zero Data Retention adlı ayrı bir ayara bağlı. Mistral aynı zamanda platformunu üçüncü taraf açık modellere açtı; ilk olarak Z.ai’nin GLM-5.2 modeli aynı bölgesel kurallarla sunuluyor.

Neden önemli: Sözleşme metnini doğrudan modele gönderen bir ekip AB uç noktasını kullanabilir; ancak ajanlara veya Files API üzerinden dosya yönetimine ihtiyaç duyan bir mimari aynı garantiyi alamaz. Bu, KVKK/GDPR temelli tedarik değerlendirmelerinde doğrudan belirleyici bir kısıttır.

4. Gemini’nin kullanıcı sayısı ile kullanım payı ters yönde hareket ediyor

Kurum: Google · Ne oldu: Google, Gemini uygulamasının 1 milyar aylık aktif kullanıcıyı geçtiğini duyurmuştu. Buna karşılık üç bağımsız veri noktası tersini gösteriyor: metin tanıma platformu Pangram’ın gönderilen metinler üzerinden yaptığı analize göre Gemini’nin payı Temmuz 2026’da %12’den %1,9’a düştü — Pangram bunu “çöküş” olarak niteliyor. Aynı dönemde OpenAI %50’nin üzerindeki payını korudu, Anthropic %4,3’ten %14,9’a çıktı. Similarweb verisi Google’ın web pazar payının %27’den %26,8’e gerilediğini gösteriyor (bir yıl önce %9,4 idi) 4.

Neden önemli: Her üç kaynağın da kör noktaları var — Pangram ağırlıklı olarak yazma görevlerini ölçüyor, OpenRouter açık ağırlıklı modellere eğilimli, Similarweb mobil uygulamaları görmüyor. Yine de üçü aynı yöne işaret ediyor. Model seçimi yapan ekipler için çıkarım açık: kullanıcı sayısı duyuruları tedarik kararı için yeterli bir gösterge değil, fiili kullanım ve kıyaslama verisi esas alınmalıdır.

5. Microsoft, Copilot için ucuzlattığı yeni kod modelinde açık rakiplerin gerisinde kaldı

Kurum: Microsoft · Ne oldu: GitHub Copilot için yayımlanan MAI Code 1.1 Flash, selefine göre %25 daha token verimli ve maliyeti dörtte biri; geliştiriciler çıktısının %4 fazlasını kabul etmiş. Ancak kıyaslamalar, modelin daha ucuz olan DeepSeek V4 Flash karşısında belirgin biçimde geride kaldığını gösteriyor 5.

KıyaslamaMAI Code 1.1 FlashClaude Haiku 4.5GPT-5.4 miniDeepSeek V4 Flash
SWE-bench Verified%72,6%69,8%69,2Yayımlanmadı
Terminal Bench 2.1%62,9%49,4%60,7%82,7
Çıktı fiyatı (M token)1,20 $5,00 $0,28 $

Neden önemli: Microsoft ekosistemindeki kullanıcılar hâlâ model seçebiliyor, ancak varsayılanların zamanla kendi modellerine kayması bekleniyor. Kod üretimini Copilot üzerinden yürüten ekiplerin varsayılan model ayarını bilinçli olarak gözden geçirmesi gerekiyor.

6. Kurumsal yapay zekâ yatırımı modelden uygulamaya kayıyor

Kurum: Thrive Holdings (OpenAI ortaklı) · Ne oldu: Şirket, SoftBank, D1 Capital Partners ve Altimeter Capital’in katılımıyla 12 milyar dolar değerleme üzerinden 2 milyar dolar topladı. İş modeli, muhasebe ve bilgi teknolojileri gibi geleneksel işletmeleri satın alıp iş akışlarına yapay zekâ gömmek. Platformdaki işletme sayısı 70’i aştı: muhasebe kolu Current 50’den fazla firma ve 2.000’den fazla profesyoneli barındırıyor, TaxAI adlı ajanları 7.000’den fazla vergi beyanını %98 doğrulukla işledi ve hazırlık sürelerini %30’un üzerinde kısalttı; BT kolu Shield’da yardım masası çözüm süreleri 36 kat hızlandı 6. Yeni fonun bir kısmı, fiziksel varlıkların onay, sertifikasyon ve uyum süreçlerine odaklanan üçüncü bir platforma gidecek.

Neden önemli: Değerin modelden ziyade uygulamada oluştuğu tezi sermaye tarafından fiyatlanıyor. OpenAI ve Anthropic’in özel sermaye şirketleriyle kurduğu benzer uygulama ortaklıkları da aynı yönü gösteriyor.

7. Anthropic hukuk dikeyine yönetici düzeyinde yatırım yapıyor

Kurum: Anthropic · Ne oldu: Hukuk yapay zekâsı alanında doktorası bulunan ve Akiva AI’yı kuran Robert Mahari, şirketin ilk “Head of Claude for Legal” pozisyonuna atandı. Anthropic mayısta Claude için on iki hukuk eklentisi tanıtmış ve LexisNexis ile Relativity dahil yirmiden fazla hukuk teknolojisi şirketiyle ortaklık duyurmuştu. Aynı pazarda OpenAI Ironclad kurucusu Jason Boehmig’i işe aldı, Amazon hukuk görevleri için Amazon Quick’i başlattı ve Microsoft Word’ün içine sözleşme incelemesi yapan bir hukuk ajanı yerleştirdi 7.

Neden önemli: Hukuk, kaynak uydurma ve gizlilik kısıtları nedeniyle en geç benimseyen dikeylerden biriydi. Modellerin mevcut hukuk kaynaklarına ve büro yazılımlarına bağlanması, bu direncin çözülmeye başladığını gösteriyor.

8. Filigran uygulaması beklenen tepkiyi doğurdu

Kurum: Anthropic · Ne oldu: Şirketin AB Yapay Zekâ Yasası Şeffaflık Kodu’na uyum için metin çıktılarına filigran eklemeye başlaması, bir kısım kullanıcı arasında hoşnutsuzluk yarattı; şikâyetlerin odağı, filigranın yapay zekâ kullanımını iş yerinde ve derslerde tespit edilebilir kılması 8.

Neden önemli: Kurumsal içerik akışları açısından bu bir belirsizlik değil, planlanması gereken bir gerçeklik. Filigran model düzeyinde uygulandığı için kopyala-yapıştırla taşınıyor ve Claude’un tüm yüzeylerinde geçerli. Ajans, akademi ve kurumsal iletişim ekiplerinin açıklama politikalarını buna göre güncellemesi gerekiyor.

9. Sağlık alanında beklenti ile sonuç arasındaki makas ölçüldü

Kurum: Society of Breast Imaging üyeleri arasında yapılan anket (Clinical Imaging) · Ne oldu: 215 üyeyle yapılan araştırmaya göre üyelerin yaklaşık yarısı FDA onaylı yapay zekâ araçlarını zaten kullanıyor, %11’i kullanmayı planlıyor. Ancak beklenti ile gerçekleşen arasında belirgin bir açık var: geri çağırma oranlarının düştüğünü bildirenler %35 (beklenti %59), gereksiz biyopsilerin azaldığını söyleyenler %9 (beklenti %36), tükenmişliğin azaldığını belirtenler %29 (beklenti %56). Çoğunluk yapay zekâyı esas olarak ikinci görüş olarak konumlandırıyor; en büyük engeller maliyet ve kurumsal destek eksikliği 9.

Neden önemli: Düzenlenmiş, yüksek riskli alanlarda yapay zekâ dağıtımının değeri araç yeteneğinden değil süreç tasarımından geliyor. Bu, kurumsal pilot projelerin başarı ölçütlerini belirlerken referans alınması gereken somut bir veri noktası.

10. Eğitim verisi ve içerik kullanımında şeffaflık tartışması genişliyor

Kurumlar: Amazon/Twitch, OpenWALDO girişimi · Ne oldu: Amazon, Twitch yayıncılarının içeriğini varsayılan olarak model eğitiminde kullanacağını, isteyenlerin bunu devre dışı bırakması gerektiğini duyurdu 10. Diğer yönde, Rocky Linux kurucusu Gregory Kurtzer eğitim verisini açık kaynak bağımlılıkları gibi denetlenebilir kılmayı amaçlayan topluluk yönetimli OpenWALDO girişimini başlattı; kamuya açık külliyat 75,1 milyon doküman içinde 124 milyar referans tokeni lisans bilgisiyle dizinliyor ve veri kökeni ile model soyağacını izlemek için “AI Bill of Materials” kavramını öneriyor 11.

Neden önemli: Kurumsal içerik üreten her yapı için iki yönlü bir sorumluluk doğuyor: kendi içeriğinin nasıl kullanıldığını denetlemek ve kullandığı modellerin veri kökenini belgelemek.

Yeni ve Güncellenen Profesyonel Hizmetler

HizmetSağlayıcıHedef kullanıcıTemel yetenekErişim / fiyatlandırmaPratik kullanım alanı
Grok 4.6SpaceXAI (xAI)Ajan geliştiricileri, yoğun token tüketen ekiplerSınır düzeyi genel yetenek; çok adımlı görevlerde yüksek adım verimliliği2 $$/ 6$$ (milyon token); API, Cursor, Grok Build, OpenRouter, Vercel, Cloudflare. İlk hafta Grok Build ve Cursor’da çift kota 1Maliyet duyarlı otomasyon hatları, uzun soluklu araştırma ve kodlama ajanları
Regional InferenceMistral AIBanka, sigorta, kamu ve AB’de veri ikametgâhı gerektiren kurumlarİsteklerin AB veya ABD uç noktasında işlenmesi; function calling destekliStandart fiyat + %10; api.eu.mistral.ai / api.us.mistral.ai. Ajanlar, batch ve Files API kapsam dışı 3Sözleşme, başvuru ve müşteri metinlerinin bölge dışına çıkmadan işlenmesi
Priority TierMistral AIÜretim ortamında gecikmeye duyarlı sistemlerYoğun trafikte öncelikli kuyruk; %99,5 çalışma süresi taahhüdüStandart fiyatın 1,75 katı; açık beta; satış sözleşmesi gerekli; service_tier parametresiyle etkinleştirilir 3Müşteri hizmetleri asistanları, üretim hattı sistemleri
MAI Code 1.1 FlashMicrosoftGitHub Copilot kullanan geliştirme ekipleriKod üretimi; selefine göre %25 daha token verimliGirdi 0,20 $$/ önbellekli 0,02$$ / çıktı 1,20 $; Copilot içinden 5Rutin kod tamamlama; terminal ağırlıklı ajan işlerinde alternatifler değerlendirilmeli
GLM-5.2 (Mistral platformunda)Z.ai, Mistral üzerindenAB’de barındırma arayan maliyet odaklı ekiplerÜçüncü taraf açık model; Mistral’ın bölgesel kurallarıyla aynı garantilerMistral platformu üzerinden; fiyat kamuya açıklanmadı 3Avrupa’da barındırılan yüksek hacimli çıkarım
Claude for LegalAnthropicHukuk büroları ve kurumsal hukuk departmanlarıHukuk dikeyi için özel eklentiler ve büro yazılımı entegrasyonları; ayrı yönetim kadrosuMevcut Claude ürünleri içinde; on iki hukuk eklentisi ve 20+ legal tech ortaklığı 7Sözleşme incelemesi, keşif (discovery), mevzuat araştırması
Live Transcribe (İşaret dili) ve RamblerGoogleErişilebilirlik gereksinimi olan kurumlar, sesli iş akışlarıPixel kamerayla Amerikan İşaret Dili’nin metne çevrilmesi; dağınık konuşmayı anlayan sesli girişPixel 11 serisiyle birlikte; Pixel 11 899 $$, Pixel 11 Pro 1.099 $$ 12Erişilebilir toplantı ve saha iletişimi; serbest konuşmayla not alma
Regülasyon platformu (yeni dikey)Thrive Holdingsİnşaat, enerji, veri merkezi ve sağlık altyapısı yatırımcılarıİzin hazırlama, denetim dokümantasyonu ve uyum takibinin ajanlarla hızlandırılmasıYeni kurulan platform; ticari erişim koşulları açıklanmadı 6Fiziksel varlıkların onay ve sertifikasyon süreçlerindeki darboğazlar

Doğrulanmamış olarak işaretlenenler. Nvidia’nın en az bir trilyon parametreli Nemotron 4 ailesini geliştirdiği bilgisi The Information’a dayanan bir habere dayanıyor ve şirket tarafından resmen duyurulmamıştır; en erken çıkış bu sonbahar olarak aktarılıyor 13. Benzer şekilde Anthropic’in Decart AI’yı satın almak için görüştüğü bilgisi tek bir kaynağa dayalıdır ve kesinleşmemiştir 14; Cognition’ın 40 milyar dolar değerleme üzerinden tur görüştüğü haberi de aynı statüdedir 15.

Kaynaklar

[1] SpaceXAI’s Grok 4.6 matches OpenAI’s best model and undercuts it on price — The Decoder

[2] Taiwan says it was targeted last month in AI-driven hacking campaign — Reuters

[3] Mistral now offers EU data processing and priority access, but both come with important limits — The Decoder

[4] Google’s Gemini is losing market share to ChatGPT and Claude according to new market data — The Decoder

[5] Microsoft’s new MAI Code 1.1 Flash gets crushed by Deepseek on both price and performance — The Decoder

[6] OpenAI-backed Thrive Holdings raises $2B to bring AI to the enterprise — TechCrunch

[7] Legal startup founder Robert Mahari joins Anthropic to lead Claude’s push into law practices — The Decoder

[8] Some Claude users are mad that Anthropic’s new watermarks will catch them using it at their jobs, classes — TechCrunch

[9] AI tools for breast cancer detection fall short of radiologists’ expectations — The Decoder

[10] Amazon will train on Twitch streamers’ content by default, unless they opt out — TechCrunch

[11] Rocky Linux founder Gregory Kurtzer launches OpenWALDO to open up AI training data — Techstrong.ai

[12] Everything announced at Made by Google ’26: Pixel 11, Pixel Watch 5, Pixel Tag, and tons of Gemini features — TechCrunch

[13] Nvidia’s Nemotron 4 aims for one trillion parameters, a scale Chinese labs already surpassed — The Decoder

[14] Anthropic in talks to buy Decart AI, source says — Reuters

[15] AI coding startup Cognition reportedly already in talks to raise at $40B valuation — TechCrunch