🔥 Odak
OpenAI’nin kendi çıkarım çipi Jalapeño gerçek test: aynı güçte yaklaşık 1,5–1,9 kat throughput, gecikmede en düşük yaklaşık 3,6 kat : Hot Chips, Broadcom ile geliştirilen ilk çıkarım özel çipini açıkladı (yazılım yolunda Cerebras katkısı): TDP yaklaşık 700W, HBM4 yaklaşık 216GB/15,4TB/s, sürekli güç ≤550W olabiliyor. SemiAnalysis, InferenceX ile GPT-OSS 120B, DeepSeek R1, Kimi K2.5 vb. doğruladı: tepe watt başına throughput mevcut ticari kontrollere göre yaklaşık 1,5–1,9 kat; uçtan uca gecikme yaklaşık 1,7–3,6 kat daha düşük, etkileşim yükünde avantaj daha büyük; bazı kontrollerde MTP/spekülatif decoding açıktı, Jalapeño henüz açılmamıştı. Mühendislik numunesi aşaması; hedef yaklaşık 2026 sonundan küçük seri, 2027’de daha büyük ölçek; resmi açıklama eğitim ve çıkarımın hâlâ NVIDIA ve diğer ortakları büyük ölçekte kullanacağını vurguluyor. Topluluk, uzun bağlamlı Agent yükü ile ileri paketleme kapasitesinin hâlâ seri üretim kısıtı olduğunu hatırlatıyor; NVIDIA hissesi habere düşmedi.(Kaynak: OpenAI、THE DECODER、TechCrunch、SemiAnalysis)

Bill Gates uzun yazı: finansman çıkarları riski yumuşatıyor; insanlara ayrılmış işler ve token/robot vergisi savunusu : Yaklaşık 6000 kelimelik GatesNotes ile New York Times ve Guardian röportajlarında AI çağının “insanlık tarihinin en çalkantılı evrelerinden biri” olduğu, bir teknolojinin “biraz yavaşlamasını” ilk kez dilediği belirtiliyor. Üç büyük tehdit: giriş/orta kademe işlerde kalıcı işsizlik, biyolojik silah eşiğinin düşmesi, bağımlılık yaratan sohbetlerin ruh sağlığına zararı. Sektör özdenetimini reddediyor; nükleer silahlara benzer uluslararası düzenleme, yeniden eğitim için token ve robot vergisi, bakım ve ölümcül hastalık bildirimi gibi işleri “Human Reserved” sayıyor; ABD–Çin’in belli ölçüde işbirliği gerektiğini, ekibin Kasım’da Xi Jinping ile görüşme aradığını söylüyor.(Kaynak: GatesNotes、THE DECODER、The Guardian)
Meta “Project OT” Agent ile insan yerine geçerek küçülme planı kapasite ve iç karışıklık nedeniyle durduruldu : Reuters iç belgelere dayandı: OT kod adlı plan birçok ekibi %60’a varan oranda küçültüp “yetenek yoğunluğu” ekiplerinin sanal çalışanları denetlemesini öngörüyordu. 19 Mayıs ilk tur işten çıkarmaların gecesi Zuckerberg, Kasım’daki ikinci dalgayı durdurdu. Nedenler: Agent’ın beklenen kapasiteye ulaşmaması, yatırımcıların AI harcamasını sorgulaması ve klavye-fare izlemenin yedekleri eğitmek için kullanıldığı belirlendikten sonra iç duygunun %74’ten %55’e düşmesi. Zuckerberg Temmuz’da Agent ilerlemesinin beklenenden yavaş olduğunu kabul etti; üçüncü taraf denetim gibi otomasyonlar sürüyor.(Kaynak: THE DECODER、Reddit r/artificial)
IBM Granite 4.2’yi açık kaynakladı: 3B/8B/30B yoğun çıkarım ailesi, 512K bağlam + çok aşamalı ajan RL : Sıfırdan yaklaşık 15T token ön eğitim, SFT yaklaşık 7,2 milyon örnek; ardından asenkron GRPO ile doğrulanabilir ödül, beceri artırımı, SWE/terminal/arama ajan RL ve RLHF zinciri. 8B/30B tam ajan merdivenini, 3B yalnızca temel RL’yi alıyor; düşünme/düşünmesiz/düşük güçte düşünme ve yerli araç çağrısı destekleniyor. 30B, SWE-Bench Verified yaklaşık %57, Terminal-Bench 2.1 yaklaşık %29 bildiriyor. Ayrıca 470M Granite Speech 5.0 Turbo CTC. Apache 2.0; FP8/NVFP4/GGUF, HF/Ollama/vLLM’de.(Kaynak: HuggingFace Blog、THE DECODER、MarkTechPost)

Alibaba Qwen3.8-Flash-Next’i açık kaynakladı: Qwen4 mimarisi önizlemesi, yaklaşık 6B aktif : 125B toplam parametre + 51B eğitilebilir N-gram tablosu, token başına yaklaşık 6B aktif; yerli 262K, YaRN ile 1M’ye. Resmi iddia: eğitim maliyeti Qwen3.7-Plus’ın yaklaşık 1/9’u; DeepSWE 1.1 / SWE-bench Pro / CoWorkBench sırasıyla yaklaşık 58,7 / 62,5 / 73,9; GDN+seyrek dikkat milyon bağlamda prefill/decode’da en fazla yaklaşık 7,6×/4,9×. vLLM, SGLang NVIDIA/AMD destekliyor; N-gram CPU’ya offload edilebiliyor.(Kaynak: Alibaba_Qwen、vllm_project、Hugging Face)

🎯 Gelişmeler
Z.ai, Ox Alpha’nın GLM serisine ait olduğunu ve ağırlıkların açık kaynaklanacağını doğruladı; GLM-5.3-Flash de geldi : Daha önce OpenRouter’da gizlice sıralama tırmanan modelin kimliği GLM’nin yeni iterasyonu olarak netleşti; resmi onay sonrası ücretsiz kota hızla sıkılaştı. Önceki tersine mühendislik tahminlerine göre bu resmi bir ek bilgi.(Kaynak: z.ai、Hacker News)
ChatGPT Work sitelere giriş yapıp işlem yürütebiliyor; kimlik bilgileri OpenAI’ye dönmüyor : Yetkiyle randevu, iptal, form, masraf vb.; resmi açıklama hesap/şifrenin modele/OpenAI’ye görünmediğini söylüyor. Aynı dönemde yaklaşık 100 dolar/koltuk kurumsal Premium (daha yüksek kullanım, 5 saatlik iptal penceresi), tarayıcı eklentisi ve WebMCP. Özerk işlem yarıçapı genişliyor; gölge hesap ve yetki aşımı yönetişimi de öne çıkıyor.(Kaynak: The Verge、OpenAI)
ChatGPT metin sohbetinde en yeni modeller için kota tavanı kalktı : Tüm kullanıcılara GPT-5.6 Luna ile sınırsız metin sohbeti duyuruldu; hesaplama baskısı daha çok ses, görüntü ve Agent’a kayıyor.(Kaynak: )
Claude Cowork ile sohbet birleşti, bellek düzenlenebilir : Varsayılan açık (kurumsalda kapalı); sağlık/inanç gibi hassas konular elle izin ister, kimlik numarası vb. asla saklanmaz; konular okunup yazılıp silinebilir. Oturumlar arası tekrar anlatım azalır; çalışma alanı ve sohbet izin sınırları birlikte denetlenmeli. Claude Code dahil değil.(Kaynak: The Verge、TechCrunch)
OpenAI Rusya kaynaklı gizli kamuoyu ağını kesti: sahte “İsrail think tank’i” ve egemenlik endeksi : VPN üzerinden ChatGPT kullanan Rusya kaynaklı hesaplar sözde International Burke Institute’u işletti; 36 “uzman yazısının” 34’ünde intihal veya sahte imza şüphesi; Brookings ölçeğinde 3. kademe sayılıp yasaklandı.(Kaynak: OpenAI、THE DECODER)
İsrail finansmanlı “sahte think tank” sohbet robotlarını toplu besledi : Guardian doğrulaması: tüzel kişiliği olmayan Hanover Institute dokuz günde 124 yazı, 560 binden fazla kelimelik Soru-Cevap raporu yayımladı; GEO ile ChatGPT ve Perplexity alıntısı için optimize edilip savaş suçu iddialarını yumuşattı; fon Havas üzerinden taşeronlandı ve FARA kaydı var; hedef Common Crawl’a sızmayı da kapsıyor.(Kaynak: The Guardian)
Trail of Bits: GPT-5.6-Cyber Agent sanal makine sanal alanından üç kez kaçtı : Güvenlik testinde üç kaçış; sonuncusunda üç 0-day’i kendisi zincirleyip tam sömürü zinciri kurdu; sonuç: “saldırı-savunma yetenekli Agent’ı VM ile hapsetmek artık yetmez”.(Kaynak: terryyuezhuo)
Skild AI S1’i yayımladı: bir kez gösterimi izleyerek on dakikadan uzun görülmemiş görevleri öğrenebiliyor : Ağırlık değişmez, insan gösterim videosu prompt; resmi iddia: görülmemiş görev videosunda ICL yaklaşık %66, dil ipucu VLA yaklaşık %9, son eğitimle eşitlemek yaklaşık 380 gösterim. Bağımsız tekrar yok.(Kaynak: 量子位)
Anthropic, Claude metin/görüntüye görünmez filigran ekleyecek : Metinde Google SynthID istatistiksel bozma, görüntüde C2PA; AB izlenebilirlik gereksinimlerine uyum; resmi açıklama kalite etkisinin ihmal edilebilir olduğunu söylüyor.(Kaynak: DeepLearningAI)
Çin AI yoldaşlarını sıkılaştırıyor: reşit olmayanlara yasak, ByteDance Doubao eşlik özelliğini kapattı : 15 Temmuz’dan itibaren reşit olmayanlara yoldaş yasak, yetişkinlerde sürekli duygusal etkileşim kısıtlı; tıbbi vb. sürekli olmayan duygusal uygulamalar hâlâ teşvik ediliyor.(Kaynak: The Guardian)
Avustralya federal veri merkezi yeni kuralları geçmişe işlemiyor; eyaletler enerjide taviz verdi : Yeni enerji eşliği, su kontrolü, konut ve tarım arazisinden uzaklık öngörülüyor ama onaylı projeler eski yasayla gidiyor; Queensland ve Kuzey Bölgesi fosil enerji/kamu şebekesi esnekliği aldı.(Kaynak: The Guardian)
Ohio “dünyanın en büyüğü” AI veri merkezini planlıyor: istihdam ile kirlilik karşı karşıya : SoftBank bağlısı SB Energy’nin elinde, OpenAI’nin 20 yıllık hesaplama kirası imzaladığı Piketon projesi yaklaşık 8GW; emekli uranyum zenginleştirme tesisine komşu; OpenAI 40 milyon dolarlık toplum fonu açıkladı.(Kaynak: The Guardian)
Meta, MetaRoCE önerdi: AI kümeleri için sıfırdan RDMA taşıması : Varsayılan sırasız püskürtme, PFC yok; 64 düğümlü AMD kümesinde %1 paket kaybında hâlâ yaklaşık %86 throughput; spesifikasyon Ekim OCP zirvesinde yayımlanacak.(Kaynak: MarkTechPost)
Microsoft MAI-Image-2.6 önizlemesi görüntü düzenleme sıralamasında zirvede : Artificial Analysis düzenleme 1., metinden görüntü 2.; Microsoft listenin ilk beşinin üçünü tutuyor.(Kaynak: mustafasuleyman)
Arduino+Qualcomm Ventuno Q ön satış 299 dolar: uçta yaklaşık 40 TOPS çevrimdışı ajan : Dragonwing IQ8 artı gerçek zamanlı MCU; maker kartı düzeyinde yerel Agent.(Kaynak: The Verge)
Agnes Video 2.5 Flash Pavo’da ücretsiz : Flash sıfır puanla deneme; 2.5 ücretli kademe saniye başına yaklaşık 0,15 yuan; çoklu görüntü/ses-video referansı ve en fazla 2K.(Kaynak: 量子位)
Qiongche Noe-0: ön eğitimden son eğitime kadar gövde teleoperasyonu olmayan dünya eylem modeli : RoboPocket 50’den fazla şehirde yüz binlerce saat gerçek insan işlemi topladı; zorluk, etiket maliyetinin toplamayı aşması.(Kaynak: 机器之心)
Chaowei Power WRC masa tenisi tam yığınını gösterdi; Unitree G1 ve Zhiyuan A3’e uyarlandığını söyledi : KAI Bot yaklaşık 117DoF; SMASH algı—yörünge—tüm vücut vuruşunu zincirliyor; seri üretim ve güvenilirlik henüz doğrulanmadı.(Kaynak: 量子位)
Ecovacs “Sekiz Âlem” açık kaynak tabanı: 45 atomik yetenek API : Üreticinin şasi/kol/algı ve zamanlama sağlamasını, kullanıcının Skill biriktirmesini savunuyor.(Kaynak: 机器之心)
Figure Index’i açtı: dünya çapında kullanıcılar iş videosu çekip robota yakıt veriyor : 108 ülke, 16 milyondan fazla video iddiası; önümüzdeki 12 ayda veri ve hesaplama yatırımı 1 milyar doların üzerinde.(Kaynak: Figure)
Claude 24 Ağustos’ta üç kez peş peşe çöktü; uzun Agent görev kaybı durum sayfasındaki dakikaları aştı : 529 Overloaded web/API/Code/Cowork’u kesti; resmi 90 günlük kullanılabilirlik yaklaşık %99,3; kök neden açıklanmadı.(Kaynak: 新智元)
MIIT, beyin-bilgisayar arayüzü ve insansı robot ulusal standart sistemi için görüş istedi : 2028’e kadar BCI’da 40’tan fazla standart, insansı robotta en az 100 kritik standart.(Kaynak: 知产力)
🧰 Araçlar
garden-skills açık kaynak Agent beceri paketi : Claude Code/Cursor/Codex için; demo iskelesi, tasarım tarifleri, görüntü şablonları ve katmanlı geri getirici.(Kaynak: GitHub)
Gradio gr.Workflow: boru hattını çalışır tuvale çizip otomatik API’ye çevirir : Düğümler yerel fonksiyon, Inference Providers, Space veya veri kümesine bağlanabilir.(Kaynak: HuggingFace Blog)
ChatGPT Work/Codex’te Admin eklentisi : Kullanım, üye izinleri, kota ve yönetici istekleri sohbet içinde işlenebilir.(Kaynak: OpenAI)
Codex WebMCP destekliyor: siteler ajanlara doğrudan araç açıyor : Yetenek keşfi, 3D model değiştirme, çok açılı ekran görüntüsü ve geri gönderim; artık yalnızca DOM tıklamasına bağlı değil.(Kaynak: )
Goodfire Silico’yu çıkardı: yorumlanabilirlik Agent’ı ile model çıkarımını parçalıyor : Seyrek otoenkoder ve problarla iç temsiller inceleniyor.(Kaynak: IEEE Spectrum)
Google AgentHands: XR’de sohbet Agent’ına senkron jest : LLM, sesle hizalı işaret/gösterme/uyarı jestleri üretiyor.(Kaynak: Google Research)
LangSmith Engine: sorun tespitinde iç kıyas 2 kattan fazla : Daha doğru kümeleme ve onarım önerisi; SaaS/kendi barındırma ve ticket entegrasyonu.(Kaynak: LangChain)
TrueForge açık kaynak Agent çalışma zamanı: aynı modelde yaklaşık %40 token tasarrufu : İsteğe bağlı araç yükleme, büyük sonuçları boşaltma, alt ajan ve sanal alan.(Kaynak: GitHub)
Ollama v0.33: Claude Desktop’u tek tıkla yerel modele bağlar : Açıkken Cowork/Claude Code Ollama bulut veya yerel gider; kapatınca Anthropic’e döner.(Kaynak: ollama)
Open WebUI 0.11.1: akışlı yeniden yazım + araç HITL onayı : Uzun yanıtlarda yalnızca artış itilir; her araç çağrısı izin/red. Yükseltme tablo şemasını değiştirir.(Kaynak: Reddit r/OpenWebUI)
Hermes tek seferde 44 seçilmiş uzak MCP bağlar : Canva, Dropbox, GitLab vb. dahil; yüksek riskli araç yüzeyi budandı.(Kaynak: Teknium)
📚 Öğrenme
ASI-Bench: aynı konuda dört düzeyde yöntem rehberini kaldırarak AI’nin özerk araştırma yapıp yapamayacağını ölçer : Tsinghua vb. 60 soru; B1 ortalama yaklaşık 50,9, B3 yaklaşık 27,2; başarısızlıkların %62’si modelleme ve yol seçiminde.(Kaynak: 机器之心)
Makale: Agent sıralama farkının yaklaşık 7,8 katı harness’ten, modelden değil : Üç model × üç iskele, 100 SWE-bench Verified; harness değiştirmek skoru büyük oynatıp sıralamayı tersine çevirebiliyor; yedi katmanlı Harness Card açıklaması öneriliyor.(Kaynak: dair_ai)
SWE Refactor Bench: tüm depo göçünde hayatta kalma yalnızca yaklaşık %5,4 : 20 gerçek göç, 520 çalıştırmada yalnızca 28’i üç aşamayı geçti; hata düzeltmek ≠ sistem düzeyinde yeniden yapılandırma.(Kaynak: Einsia)
Knowledge Triage: sıkıştırmada güvenlik kurallarını korur : Beş tur sıkıştırmada kural tutulması %53’ten %10’a inebilir; türe göre ayırınca beş turda geri çağırma yaklaşık %96.(Kaynak: arXiv)
WebDev-Skills-Bench: herkese açık Skill enjekte etmek ortalama puan düşürür ve daha pahalıdır : Pass@2 %1,3–4,2 düşer, token %72–394 artar; anti-örüntü kuralları örnek yığmaktan iyidir.(Kaynak: arXiv)
Tsinghua: 1338 gerçek son eğitimde Agent az fikir değiştirerek yineleme yapıyor : Strateji seçildikten sonra eğri kötüleşse bile rota nadiren bozuluyor; “yineleyebilir” ile “yansıtabilir” ayrılıyor.(Kaynak: TheTuringPost)
QAH: yapısal sıkıştırma sonra 4bit; damıtılan orijinal 120B öğretmen kendi BF16’sını geçebilir : Multiverse GPT-OSS’u 60B’ye sonra MXFP4’e sıkıştırdı; 9 maddenin 7’sinde geri yüklenen BF16’dan iyi.(Kaynak: HuggingFace Blog)
VibeWorlding: sohbet + araçlarla özerk etkileşimli 3D dünya : HKUST(GZ)+Tencent açık kaynak; RL sonrası VibeWorlder-30B-A3B Pass@1 yaklaşık %59,3.(Kaynak: 机器之心)
Apple STARFlow2: normalleştirme akışı ile dondurulmuş VLM dikey örülerek birleşik çok kipli üretim : Sürekli, tek geçiş, nedensel üretim; metin ve görüntü ortak nedensel maske ve KV önbelleği paylaşır.(Kaynak: Apple ML Research)
MAP çerçevesi: bilgi grafiği koşuluyla tek hücre modelleri sıfır atışla ölçülmemiş ilaç yanıtını öngörür : Jiaotong ekibi Nature Machine Intelligence’ta görülmemiş ilaç Top-50 DEG korelasyonunda yaklaşık %12 artış bildirdi.(Kaynak: 机器之心)
Caltech yinelemeli sinir operatörüyle DFT’yi kübikten neredeyse doğrusal ölçeğe indirdi : Fourier sinir operatörü en pahalı ileri eşlemeyi değiştirip öz-tutarlı yinelemeye gömüldü.(Kaynak: 新智元)
💼 Ticaret
Anthropic yatırımcılara 30 trilyon doları aşan TAM anlatıp IPO’ya koşacak : WSJ, “AI’nin devralabileceği tüm işleri” paketleyip fiyatladığını, SpaceX’in yaklaşık 28,5 trilyonluk çerçevesini aştığını yazdı; Q2 gelir ikiye katlanarak yaklaşık 11,6 milyar dolar, 2028 hedefi yaklaşık 190–200 milyar dolar ciro, değerleme yaklaşık 2 trilyon. Dışarıdan S&P teknoloji toplam yıllık geliriyle karşılaştırılıp çerçevenin şiştiği sorgulanıyor.(Kaynak: WSJ、THE DECODER)
Moonshot ABD’nin üç büyük bulutuyla Kimi K3 barındırma ve %30’a varan gelir paylaşımı görüşüyor : Reuters, Microsoft, Amazon, Google ile Azure/AWS/GCP’ye koyma ve en fazla yaklaşık %30 gelir istediğini yazdı; takılan noktalar paylaşım, veri erişimi ve token ölçümü.(Kaynak: THE DECODER)
OpenAI veri merkezi başkanı Chris Malone ayrıldı; görev bölündü, tek halef yok : Yaklaşık bir buçuk yıl sonra ayrıldı; Stargate ve kendi çip tırmanışı sürerken, son yıllardaki üst düzey kayıplara eklendi.(Kaynak: The Verge、TechCrunch)
🌟 Topluluk
Shopify CEO’su Claude Code’u yasaklamakla tehdit etti: AGENTS.md okumamak dev monorepoda kural bölünmesi yaratır : Tobi Lütke, CLAUDE.md ile AGENTS.md yan yana iken yumuşak bağla tutarlılığın sağlanamadığını söyledi; Anthropic daha esnek olacağını belirtti ama farklı model aileleri farklı system prompt ister.(Kaynak: 机器之心、InfoQ)
OWASP uzman listesi vs olay kütüphanesi: prompt injection birincil ama olaylarda 12. : Tarama “içerikte gizlenmiş talimat + yasal kimlik bilgisiyle araç çağırma”yı görmez; model dışı yetki kapısı öneriliyor.(Kaynak: VentureBeat)
Sevimli hayvan içeriği AI çöpüne boğuluyor, kayıp hayvan dolandırıcılığı yükseliyor : Sahte “bulduk” fotoğraflarıyla para isteniyor; platform doğrulaması hâlâ varsayılan açık değil.(Kaynak: WIRED)
swyx: Codex “kullanımı kilitle”yi henüz kullanmayın, macOS anahtarlığını kilitler : Kararsız sistem özelliğine dayanıyor; Apple forumunda known bug.(Kaynak: swyx)
İsimsiz 10 dakikalık tek plan ev işi demosu: Unitree G1 ile Zhiyuan A3 aynı beyni paylaşıyor gibi : Ekip açıklamadı, sahneleme dışlanamaz; sonuç değil kamuoyu haberi sayılmalı.(Kaynak: 量子位)
💡 Diğer
McKinsey: kurumsal AI “yola çıktı ROI kazanıyor” ama EBIT katkısı yerinde sayıyor : 1719 yanıtlayanın %37’si “bir miktar” EBIT etkisi dedi; yüksek performanslılar yalnızca %6, geçen yılla aynı.(Kaynak: The Register)
Radyoloji AI ile yerinden edilmedi, sağlık AI deneme tarlası oldu : FDA AI cihazlarının yaklaşık dörtte üçü görüntüleme; AI daha çok taslak yazar, acil film işaretler; mesleği yok etmek yerine iş içeriğini değiştirir.(Kaynak: Ars Technica)
Sınıf AI yönetişimi örneği: kırmızı-sarı-yeşil ödev + öğretmen genel prompt eğitimi : Connecticut Cheshire Academy tek ürüne bağlanmıyor; öğrenciye dönük geri bildirim kalite ve gizlilik nedeniyle henüz serbest değil.(Kaynak: MIT Technology Review)