OpenAI, Anthropic ve Google, Öncü Yapay Zeka Güvenlik… | Yapay Zeka Bülteni 2026-09-26

🔥 Odak

OpenAI, Anthropic ve Google, Öncü Yapay Zeka Güvenlik Kurumu SAFA’yı Kurmayı Planlıyor : The Information tarafından sızdırılan bilgilere göre OpenAI, Anthropic ve Google, “Frontier AI Standards Authority” (SAFA) adlı öncü AI güvenlik organizasyonunu kurmaya hazırlanıyor ve resmi lansmanın 2027 başlarında yapılması planlanıyor. Kurum, model dağıtımı öncesinde bağımsız üçüncü taraf testlerini koordine etmeyi, sektör çapında olay bildirim mekanizmaları ve kıyaslama standartları oluşturmayı amaçlıyor; bu adım, öncü modellerin kontrolden çıkma risklerinin arttığı ve küresel düzenlemelerin sıkılaştığı bir dönemde teknoloji devlerinin sektörel özdenetim ve standart savunma hattı olarak değerlendiriliyor (Kaynak: The Verge)

Beyaz Saray, OpenAI ve Anthropic’in Öncü Modelleri Öncelikli Olarak ABD İncelemesine Sunmasını Talep Etti : Beyaz Saray Ulusal Siber Direktörlüğü Ofisi, OpenAI ve Anthropic’ten en yeni öncü modellerini Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü’ne (AISI) sunmadan önce resmi ABD kurumlarının incelemesine sunmalarını talep etti. Anthropic bu doğrultuda düzenlemeye giderek bazı öncü sürümleri yalnızca ABD kurumlarına açtı. Bu hamle, büyük güçler arasındaki öncü AI temel teknoloji değerlendirmesi ve ulusal güvenlik hakimiyeti mücadelesini gözler önüne sererken, ABD-İngiltere arasındaki sınır ötesi güvenlik değerlendirme iş birliğinde kurumsal sürtüşmelere yol açıyor (Kaynak: THE DECODER)

Anthropic Süper Oy Hakkı Yapısı Kurmayı Planlıyor: 7 Kurucu Ortak Yalnızca %2 Hisseleriyle %50,1 Oy Hakkını Kontrol Edecek : Anthropic, trilyon dolarlık halka arz (IPO) öncesinde hissedarlarından yeni bir yönetim planı için onay talep ediyor. CEO Dario Amodei dahil 7 kurucu ortağın her biri yalnızca yaklaşık %2 hisseye sahip olsa da, bunlardan en az 3’ünün belirlenen hisse eşiğini karşılaması durumunda, Palantir benzeri bir kurucu oylama vakfı (Founder Voting Trust) aracılığıyla şirketin %50,1 oy hakkını toplu olarak kontrol edebilecek. Bu yapı, ekonomik çıkarları karar alma kontrolünden ayırarak Wall Street’in kısa vadeli kâr baskısının uzun vadeli AI hizalama ve güvenlik araştırmalarına müdahalesini engellemeyi amaçlıyor (Kaynak: 机器之心, 36氪, kimmonismus)

Anthropic Süper Oy Hakkı Yapısı Kurmayı Planlıyor

Google, Suncatcher Uzay Tabanlı Güneş Enerjili AI İşlem Merkezi Pilot Projesini Başlattı : Google, yörüngedeki AI veri merkezi “Project Suncatcher”ın ilk deneysel uydusu MVP’nin 1 Ekim’de SpaceX Falcon 9 (Transporter-18 görevi) ile fırlatılacağını duyurdu. Güneş enerjisiyle çalışan ve 4 adet özel Trillium TPU hızlandırıcı taşıyan uydu, uzayın aşırı koşullarında Dünya’dakinin 8 katı güneş enerjisinden yararlanarak AI çıkarımı (inference) gerçekleştirmenin fizibilitesini doğrulamayı hedefliyor. Vakumda ısı dağılımı ve yüksek enerji verimliliğine sahip yörünge hesaplamaları temel test konuları arasında yer alırken, 2027’de uydular arası lazerli yüksek hızlı bağlantı testlerinin yapılması bekleniyor (Kaynak: Ars Technica, Google, dotey)

OpenAI’ın Aylık 500 Dolarlık ChatGPT Pro Max Planını Hazırladığı Ortaya Çıktı : Geliştiriciler, ChatGPT ön yüz kodlarında aylık 500 dolar gibi yüksek bir ücrete sahip “Pro Max” adlı yeni bir abonelik katmanını keşfetti. “En hızlı Work ve Codex yürütme hızını” vadeden paketin, özel düşük gecikmeli bilgi işlem gücüne erişim sağlaması bekleniyor. GPT-6 Astra’nın çıkarım kaynaklarını yoğun şekilde tüketmesi ve yüksek yük altında abonelik kısıtlamalarına yol açmasının ardından OpenAI, yüksek primli fiyatlandırma ile yoğun üretkenlik senaryoları için işlem gücünü kademelendirip izole ediyor; bu durum, öncü işlem gücünün yüksek net değerli şirketler ve profesyonel kurumlarda yoğunlaştığını gösteriyor (Kaynak: 36氪, nicdunz)

ChatGPT aylık 500 dolarlık Pro Max paketi satmaya hazırlanıyor!

🎯 Gelişmeler

Google, Gemini 3.8 Live ve Gerçek Zamanlı Sanal İnsan Modelini Duyurdu : Google, gerçek zamanlı akışlı sohbet ile düşük gecikmeli dinamik sanal video üretimini derinlemesine entegre eden Gemini 3.8 Live ve Live Avatar özelliklerini resmi olarak tanıttı. Model, 97 dilde yerel ses-video dudak senkronizasyonunu ve asenkron arka plan araç çağrılarını destekliyor; kurumsal etkileşim senaryoları için özelleştirilebilir avatarlar sunarken SynthID filigran teknolojisini de tamamen içeriyor (Kaynak: Google DeepMind Blog)

Meta, Gerçek Zamanlı Bedenleştirilmiş Modeli Muse Realtime Avatar’ı Tanıttı : Meta, Realtime Voice ile ses token akışını paylaşan Muse Realtime Avatar akış mimarisini yayınladı. Sistem, uçtan uca görüntülü sohbet yanıt gecikmesini yaklaşık 870 ms seviyesine indiriyor. Sabit uzunluktaki geçmiş bağlam sayesinde hesaplama maliyetini sınırlı tutan model, her uzunluktaki sohbette dudak ve mikro ifade senkronizasyonunu destekliyor (Kaynak: alex_conneau, jack_w_rae)

Muse Realtime Avatar

Meta Muse, İzinsiz “Gerçek İnsan Müşteri Temsilcisi” Kullanımı Nedeniyle Gizlilik Skandalına Karıştı : Reuters, Meta’nın yeni yayınlanan kişisel agent’ı Muse için otonom telefon arama özelliğini test ederken, arka planda yüksek başarı oranını korumak amacıyla aramaları taşeron insan ekiplerine yönlendirdiğini ve bu durumun ciddi kullanıcı gizliliği endişelerine ve regülatif soru işaretlerine yol açtığını bildirdi. Meta yöneticileri hızla özür dileyerek testi durdurdu ve gizlilik bildirimleri ile güvenlik koruma mekanizmaları iyileştirilene kadar bu kanalın yeniden açılmayacağını taahhüt etti (Kaynak: 量子位)

Modern AI’ın Öncülerinden Jürgen Schmidhuber, Sakana AI Baş Bilim Danışmanı Oldu : Özyinelemeli Öz-Geliştirme (Recursive Self-Improvement – RSI) ve meta-öğrenme öncüsü Jürgen Schmidhuber, Japon AI girişimi Sakana AI’ın Baş Bilim Danışmanı olarak göreve başladı. Schmidhuber, Tokyo’da yeni kurulan RSI Lab’a liderlik ederek evrimsel algoritmalar, dünya modelleri ve öz-örgütlenmeli mimarileri birleştirecek; kısıtlı işlem gücü altında uyarlanabilir zeka ve fiziksel dünyada RSI kapalı döngülerini araştıracak (Kaynak: SakanaAILabs, hardmaru)

Jürgen Schmidhuber Sakana AI Baş Bilim Danışmanı Oldu

LangChain, LangSmith Engine v2 ve Managed Deep Agents 0.8’i Yayınladı : LangSmith Engine v2, proaktif kırmızı takım (Red Teaming) testleri ve otomatik doğrulama/onarım mekanizması getirerek Agent’ların yayına alınmadan önce anormal mantık hatalarını proaktif olarak tespit edip düzeltmesini sağlıyor. Managed Deep Agents 0.8 ise kurumsal kullanıcılar için kalıcı bellek izin politikaları, sandbox dosya API’leri ve yerel web arama özellikleri ekliyor (Kaynak: LangChain, hwchase17)

LangChain Interrupt Konferansında Yeni Ürünlerini Tanıttı

Perplexity, Rust Tabanlı Tescilli Arama Motoru Photon ve Fast Search API’sini Duyurdu : Perplexity, Rust ile geliştirilen arama ve yeniden sıralama (reranking) hizmeti Photon’u tanıttı. p95 gecikmesini 230 ms altına, p50 gecikmesini ise sadece 160 ms’ye indiren ultra hızlı bir arama sunan servis, API çağrı maliyetini bin istek başına 1 dolara düşürdü ve Hermes Agent ile yerel AI ekosistemine sorunsuz şekilde entegre edildi (Kaynak: AravSrinivas, MParakhin)

Perplexity Fast Search'ü Duyurdu

Açık Kaynak AI-SQL Ortak Sorgu Motoru Quail Yayınlandı: Tek Kartta Dakikada 1 Milyardan Fazla Token İşleme Kapasitesi : Stanford ve Modal ekipleri, AI veri operasyonlarına yönelik SQL motoru Quail’ı açık kaynak olarak yayınladı. vLLM zamanlayıcısını yeniden yapılandıran ve sorgu planlamasını LLM Prefill aşamasıyla birleştiren Quail, özelleştirilmiş KV cache ve dikkat çekirdekleri (attention kernels) sayesinde tek bir H100 üzerinde sorgu başına dakikada 1 milyardan fazla girdi Token’ı işleme çıktısına ulaştı (Kaynak: charles_irl, HamelHusain)

Google, Pixel Cihazlar İçin Gemini “Benim Adıma Ara” Özelliğini Test Ediyor : Google, ABD’deki Pixel 11 cihazlarda “Call for Me” özelliğini test ediyor. Bu özellik, Gemini’ın cihaz sahibinin gerçek numarasını kullanarak işletmeleri otonom olarak aramasına, stok sorgulama, restoran rezervasyonu yapma veya randevu değiştirme gibi işlemleri gerçekleştirmesine imkan tanıyor. Süreç boyunca sesli menüleri ve bekleme aktarmalarını otomatik yöneten sistem, gerçek zamanlı transkripsiyon ve anında manuel devralma seçeneği sunuyor (Kaynak: TechCrunch)

Alibaba T-Head, Zhenwu AI Çip Yazılım Yığını T-Head SAIL’i Tamamen Açık Kaynak Yaptı : Alibaba T-Head, Apsara Conference’ta CUDA benzeri yazılım yığını T-Head SAIL’in en son açık kaynak gelişmelerini duyurdu. PyTorch uyarlama katmanı, sailify geçiş aracı ve DeepGEMM/FlashAttention gibi hızlandırma kütüphanelerini açarak geliştiricilerin Zhenwu mimarisi için operatör düzeyinde optimizasyon ve sorunsuz geçiş yapmalarını sağlıyor (Kaynak: 量子位)

NIO Ren Shaoqing Ekibi, Otonom Sürüş İçin Çok Modlu Dünya-Eylem Modeli MM-Future’ı Önerdi : NIO ekibi, otonom sürüş planlamasında birden fazla “senaryo-eylem eşleşmesi hipotezi”nin ortak evrimini gerçekleştiren MM-Future mimarisini önerdi. MM-Tokens kompakt uzay-zaman temsili ve geçmiş-gelecek ortak puanlayıcısı aracılığıyla NAVSIM-v1 kıyaslamasında 94.0 PDMS elde ederek dünya modellerinin tek yönlü pasif tahminden kapalı döngü aktif planlamaya geçişini hızlandırıyor (Kaynak: 量子位)

Kuaishou, E-Ticaret Görsel Düzenleme Temel Modeli KwaiMind’ı Tanıttı : Kuaishou, gerçek e-ticaret materyali üretimine yönelik görsel düzenleme temeli KwaiMind’ı yayınladı. Çoklu agent veri motoru ve çevrim içi damıtma (online distillation) çözümüyle kıyafet detaylarını, ürün tutarlılığını ve metin işlemeyi entegre eden model, 11 e-ticaret görev değerlendirmesinde açık kaynaklı modeller arasında birinci oldu ve çevrim içi A/B testlerinde yaklaşık %2,44’lük göreceli CTR artışı sağladı (Kaynak: 机器之心)

Liquid AI, LFM2.5-VL-DSpark Taslak Spekülatif Kod Çözme Modelini Açık Kaynak Yaptı : Liquid AI, 3B görsel dil modelleri için DSpark spekülatif kod çözme çözümünü piyasaya sürdü. Yalnızca 280M parametre ekleyerek ve çıktının tamamen eşdeğer kalmasını sağlayarak uç cihazdaki M5 Max üzerinde 3,13 kata kadar kod çözme hızlandırması sunan model, aynı zamanda llama.cpp ve SGLang ile de uyumlu çalışıyor (Kaynak: HuggingFace Blog)

Qwengram-0.8B Açık Kaynak Olarak Yayınlandı: 51B Açık N-Gram Belleği Kayıpsız Şekilde Minik Uç Cihaz Modeline Aktarıldı : Geliştiriciler, Qwen3.5-0.8B omurga ağını dondurarak hafif bir Reader ve dinamik geçitleme (gating) mekanizması eğiten ve 51B boyutundaki PLE N-gram harici belleğini başarıyla bağlayan Qwengram mimarisini açık kaynak yaptı; model doğrulama setinde şaşkınlık (perplexity – PPL) değerinde %5,05’lik bir düşüş elde etti (Kaynak: Reddit r/LocalLLaMA)

PrismML, 1-Bit Ultra Hafif LLM’i Qualcomm Snapdragon Akıllı Gözlüklere Getiriyor : Model ince ayarı ve sıkıştırma odaklı PrismML, Snapdragon AR1 Gen 1 çipi üzerinde çalışan 2B parametreli 1-bit Bonsai modelini sergiledi. Yerel uç cihazda gerçek zamanlı görsel soru-cevap ve doğal etkileşim sağlayan çalışma, son derece düşük güç tüketiminde uç cihaz çok modlu model çalıştırmanın mühendislik fizibilitesini kanıtladı (Kaynak: TechCrunch)

🧰 Araçlar

Kimi Tarayıcı Uzantısı Yayında: Web İşlemlerini Skill Olarak Kaydetmeyi Destekliyor : Kimi, WebBridge’i resmi olarak yerel bir tarayıcı uzantısına yükseltti; yeni kenar çubuğu etkileşimli sohbeti ekledi ve kullanıcıların tıklama, sayfa çevirme ve veri çekme gibi ardışık eylemlerini yeniden kullanılabilir Skill komutları olarak kaydetmesini sağladı. Bu yapı, Kimi Code Desktop ile iç ve dış koordinasyonlu otomatik bir iş akışı oluşturuyor (Kaynak: 量子位)

GLiNER2.5-Decide Açık Kaynak: Varlık İlişkilerini ve Mantıksal Kısıtlamaları Destekleyen Ultra Hızlı Karar Modeli : Fastino, hafif yapılandırılmış karar modeli GLiNER2.5-Decide’ı (340M) açık kaynak yaptı. Model, yalnızca hızlı yönlendirme ve sınıflandırmayı desteklemekle kalmıyor, aynı zamanda karakter düzeyinde aralıkları ve varlık ilişkilerini çıkarabiliyor; dışlayıcılık, kardinalite ve sıra kısıtlamaları üzerinde gerçek zamanlı mantıksal doğrulama gerçekleştiriyor. CPU çıkarım gecikmesi yalnızca 167 ms, GPU’da ise 38-47 ms olan model, geleneksel LLM uzun metin üretiminin karar maliyetini tamamen ikame ediyor (Kaynak: MarkTechPost, ClementDelangue)

GLiNER2.5-Decide Açık Kaynak

LangSmith, Açık Kaynak İnce Ayar Aracı smithtune ve Custom Apps Özelleştirme Platformunu Tanıttı : LangChain, Baseten ve Fireworks ile iş birliği yaparak, üretim ortamındaki LangSmith oturum izlerini tek tıkla doğrudan SFT ince ayar veri setlerine dönüştürmeyi ve modelleri otomatik dağıtmayı destekleyen smithtune komut satırı aracını yayınladı. Eş zamanlı olarak sunulan Custom Apps özelliği, geliştiricilerin Prompt kullanarak Agent çalışma günlüklerinden doğrudan etiketleme kuyrukları veya metrik karşılaştırma panoları oluşturmasına olanak tanıyor (Kaynak: LangChain, baseten)

LangSmith Custom Apps ve smithtune'u Tanıttı

CoreWeave, AI Kodlama Ortamlarını Birbirine Bağlayan Mission Control MCP Sunucusunu Başlattı : Bilişim bulutu sağlayıcısı CoreWeave, Cursor ve Claude Code gibi programlama araçlarının doğrudan alt katmandaki GPU kümelerini, ağ ve düğüm çalışma durumlarını okumasına izin veren MCP protokolü tabanlı Mission Control hizmetini duyurdu. Bu sayede Agent’lar kod editörü içerisinden işlem gücü sorunlarını giderebiliyor ve kaynak optimizasyonu yapabiliyor (Kaynak: AI Business)

Pruna-Qwen-Image-2.1 Açık Kaynak: 5-8 Adımlı LoRA ile 6,3 Kat Görsel Üretim Hızlandırması : Pruna AI, Qwen-Image-2.1 için ultra hızlı LoRA adaptörünü açık kaynak yaptı. Bağımsız olarak optimize edilmiş sigma çizelgeleme planı ve CFG’siz çalışma modu aracılığıyla görsel üretimi ve düzenlemeyi 40 adımdan 5 ila 8 adıma indirerek 1K görüntü kalitesini ve çoklu referans tutarlılığını korurken 6,3 kata kadar hızlandırma sağlıyor (Kaynak: _akhaliq, huggingface)

flow-transform 1.0 Yayınlandı: İş Akışlarını Koruyan Yüksek Doğruluklu Kurumsal PII Maskeleme Modeli : micro1, öncü büyük modellerin eğitimi için özel olarak tasarlanan gizlilik maskeleme modeli flow-transform 1.0’ı piyasaya sürdü; model PrivacyBench’te %96,0 F1 skoru elde etti. Çekirdek yapısı, basit sansürleme yerine sentetik kimlik ikamesi kullanarak kurumsal iş süreçlerindeki çok turlu karar ilişkilerini ve araç çağrı zincirlerini eksiksiz koruyor (Kaynak: omarsar0)

flow-transform 1.0 Yayınlandı

Whiteboard: İnsan-Yapay Zeka İş Birlikli Yazılım Mimarisi Tasarımı İçin Açık Kaynak IDE : CodeOSS tabanlı açık kaynak masaüstü IDE Whiteboard resmi olarak yayınlandı. Claude Code gibi programlama agent’ları için çizim SDK’sı ve anlamsal Diff görüntüleyici sağlayan platform, görselleştirilmiş sıralama diyagramları, ER diyagramları ve karar günlükleri aracılığıyla tam otomatik kodlamanın yol açtığı “bilişsel borcu” hafifletiyor (Kaynak: Hacker News)

StarNet: Piksel Tarzı Masaüstü Yerel Öncelikli Çoklu Agent Çalışma Alanı : Açık kaynak masaüstü projesi StarNet, AI Agent çalışma ortamını piksel bir uzay istasyonu olarak görselleştiriyor; her oda yetki kapsamını, koridorlar ise veri akışını temsil ediyor. BYOK aracılığıyla popüler büyük modellere bağlanmayı destekleyen sistem, çoklu Agent iş birliğini ve görev kayıtlarını yerel olarak kalıcı biçimde yönetiyor (Kaynak: GitHub Trending)

Google Gemini, Adobe Photoshop ve Lightroom Eklentilerini Resmi Olarak Entegre Etti : ChatGPT ve Claude entegrasyonlarının ardından Adobe Creative Suite eklentileri Google Gemini’a da resmi olarak eklendi. Kullanıcılar “@Adobe” ifadesini kullanarak profesyonel görsel düzenleme ve yaratıcı mizanpaj araçlarını doğrudan çağırabiliyor ve sohbet asistanının grafik üretkenliğini genişletebiliyor (Kaynak: The Verge)

📚 Öğrenme

Stanford Üniversitesi Yeni Güz Dönemi Dersi CS329Z “Building AI Agents Engineering”i Açık Kaynak Yaptı : Stanford NLP ekibi, DSPy ve SWE-bench yazarlarıyla iş birliği yaparak basit LLM boru hatlarından bileşik AI sistemlerine ve otonom Agent’lara kadar tam yığın mühendislik tasarımını kapsayan CS329Z sistem dersini başlattı. Prompt mühendisliği, durum değerlendirmesi, sandbox güvenliği ve araç orkestrasyonunu derinlemesine inceleyen dersin ilk sunumları ve kodları tamamen erişime açıldı (Kaynak: stanfordnlp)

Stanford CS329Z Dersini Başlattı

Google, Çoklu Agent Uzun Video Üretim Mimarisi AI Video Co-Director’ı Duyurdu : Google araştırma ekibi, video anlatı üretim paketini tanıttı. MAB küresel strateji optimizasyonu, CANVAS açık görsel bellek ve VQQA prompt kapalı döngü geri bildirimini birleştiren mimari, çok çekimli uzun video üretimindeki özne kayması ve zincirleme hata sorunlarını etkili bir şekilde çözerek dakikalarca süren tutarlı anlatı çıktıları sağlıyor (Kaynak: Google Research Blog)

Perplexity, Gerçek Hatalara Dayalı İpucu Rehberliğinde Kendi Kendine Damıtma Yöntemini Açıkladı : Perplexity, bilgisayar kontrolü sağlayan Agent’ların eğitim sonrası (post-training) mekanizmasını açıkladı. Başarısız çalışma izlerindeki hataları yapılandırılmış ipuçlarına dönüştüren ve on-policy self-distillation (OPSD) yöntemini kullanan sistem, öğretmen modelin öğrenci modeli düzeltmesini sağlayarak çevrim içi araç çağrı başarısızlık oranını göreceli olarak %21,2 düşürdü (Kaynak: MarkTechPost)

Beijing Jiaotong Üniversitesi ve Tsinghua’dan ARGUS: Çoklu Agent İş Birliği ve Kanıt Zinciri Odaklı Sahte Video Tespit Çerçevesi : Deepfake video tespitindeki kara kutu kararlarının zayıf genelleme sorununa yönelik olarak araştırma ekibi ARGUS sistemini önerdi. Doku, aydınlatma, zamansal hareket ve fiziksel sağduyu gibi bağımsız gözlemci Agent’ları karar verici Agent’tan ayıran ekip, ayrıca 33 üretim kaynağını kapsayan FaceVid-Forensics-100K veri setini yayınlayarak alan dışı (OOD) F1 skorunu %53,28’e çıkardı (Kaynak: 36氪)

ARGUS Sahte Video Tespit Çerçevesi

Zhejiang Üniversitesi ve Ortaklarından MemGUI-Bench: GUI Agent’larının Uzun Vadeli Bellek ve Oturumlar Arası Öğrenimi İçin İlk Değerlendirme Kriteri : Zhejiang Üniversitesi, Nankai ve CUHK ile ortaklaşa 128 uzun vadeli gerçek görevi kapsayan MemGUI-Bench benchmark’ını ve üç aşamalı aşamalı denetim aracı MemGUI-Eval’i yayınladı. Deneyler, mevcut lider modellerin uygulamalar arası ve oturumlar arası uzun vadeli görevlerde %58,9’a varan bellek halüsinasyonuna sahip olduğunu ortaya koyarak geleneksel kıyaslamaların ölçemediği bellek kör noktalarını gözler önüne serdi (Kaynak: 36氪)

MemGUI-Bench Bellek Değerlendirme Kriteri

Hugging Face, 5.000’den Fazla Doğrulanabilir Pekiştirmeli Öğrenme Ortamı İçeren SmolDataEnvs’i Açık Kaynak Yaptı : 10B altındaki küçük modellerin veri bilimi ve kodlama alanlarında eğitim ortamı eksikliği sorununu çözmek için açık kaynak topluluğu SmolDataEnvs’i yayınladı. 5.000’den fazla gerçek veri bilimi görevi için doğrulanabilir RL ortamları içeren proje, tek GPU üzerinde asenkron pekiştirmeli öğrenme çalıştırmayı destekliyor (Kaynak: _lewtun, huggingface)

Microsoft ve Ortaklarından CASD: Kod Agent’larının Tam Günlük Analizini Kullanarak Prompt Optimizasyonu : Microsoft araştırma ekibi CASD yöntemini önererek kod Agent’larının tam iz istatistiklerini doğrudan hesaplamasını ve optimizasyon kuralları yazmasını sağlamanın, küçük grup izlerde arama döngüsü çalıştırmaya kıyasla 16,6 puan daha yüksek sonuç verdiğini ve tekil Prompt optimizasyon maliyetini 1,60 dolara düşürdüğünü kanıtladı (Kaynak: dair_ai)

CASD Prompt Optimizasyon Yöntemi

IROS 2026 Aday Makalesi ULTRA: İnsansı Robotlar İçin Hedef Odaklı Tüm Vücut Koordinasyonlu Kontrol : UIUC araştırma ekibi, fizik güdümlü nöral yeniden hedefleme ve pekiştirmeli öğrenme ince ayarı aracılığıyla Unitree G1 robotunun yalnızca seyrek hedefler veya birinci şahıs nokta bulutları verildiğinde otonom olarak sürekli kavrama ve tüm vücut öteleme hareketleri üretmesini sağlayan birleşik çok modlu kontrol çerçevesi ULTRA’yı önerdi (Kaynak: 机器之心)

AdaRoboVLG: Görevden Ayrıştırılmış Robotik Kollar Arası Görsel-Dilsel Kavrama Çerçevesi : HUST ve Pekin Üniversitesi ekipleri, üst düzey anlamsal/zamansal öncülleri alt düzey fiziksel kavrama üretiminden ayıran AdaRoboVLG’yi önerdi. Birleşik arayüz hem çok parmaklı hünerli ellere hem de paralel kıskaçlara uyum sağlayarak dinamik taşıma bantlarında ve dağınık sahnelerde yüksek sağlamlık gösteriyor (Kaynak: 机器之心)

Agent mı yoksa Workflow mu? İş Sistemleri Mimari Seçimi İçin Pratik Değerlendirme Rehberi : Sektörel bir makale, sabit akışlı Workflow’lar ile otonom Agent’lar arasındaki sınırları analiz ederek “çalıştırmadan önce eksiksiz bir durum makinesinin çizilip çizilemeyeceği” temel test kriterini öne sürdü; yüksek verimlilik ve regülasyona duyarlı senaryolarda LLM kararlarıyla güçlendirilmiş Workflow kullanımını önerdi (Kaynak: Machine Learning Mastery)

💼 İş Dünyası

Anthropic ve Akamai, 11,6 Milyar Dolarlık Uzun Vadeli Bulut Bilişim Anlaşması İmzaladı : Anthropic, Akamai ile 7 yıllık ve toplam 11,6 milyar dolar değerinde bir bulut bilişim altyapısı anlaşmasına vardı ve Akamai’ye %5’e kadar hisse senedi varantı sağladı; bu anlaşma şirketin son 11 aydaki bilgi işlem tedarik taahhütlerinin 500 milyar doları aşmasını sağladı (Kaynak: THE DECODER)

TypeSafe’in 10 Milyar Doların Üzerinde Değerleme ile 1 Milyar Dolarlık Yeni Yatırım Turu Aradığı Bildirildi : The Information’ın haberine göre Jev karar modelinin geliştirici topluluğunda büyük yankı uyandırması ve günlük çağrı hacminin 1 trilyon Token’ı aşmasının ardından TypeSafe AI, önde gelen yatırım kuruluşlarıyla 1 milyar doların üzerinde yeni bir finansman turu için görüşüyor; yatırım sonrası değerlemenin önceki değerlemeye kıyasla patlama yaparak 10 milyar doları aşması bekleniyor (Kaynak: steph_palazzolo)

Databricks, Gerçek Zamanlı Bulut Elektronik Tablo Platformu Row Zero’yu Satın Aldığını Duyurdu : Databricks, yüz milyonlarca satırlık veriyi destekleyen yüksek performanslı bulut tablosu ile tanınan Row Zero’yu satın almak üzere anlaşmaya vardığını açıkladı. Satın alma, platformu Databricks’in Genie akıllı analiz motoruyla derinlemesine entegre ederek kurumsal finans ve analiz uzmanlarına yönetişim ve AI destekli, gerçek zamanlı etkileşimli bir veri çalışma alanı sunmayı amaçlıyor (Kaynak: jefrankle, matei_zaharia)

🌟 Topluluk

Geliştiricinin Claude Code’un Yanlışlıkla 48 Bin Kritik Dosyayı Silmesini Test Etmesi Kod Güvenliği Tartışmalarını Başlattı : Topluluk, bir geliştiricinin Claude Code kullanarak bir image’ı yeniden oluştururken komut dosyası izin izolasyonundaki bir eksiklik nedeniyle 48 bin proje dosyasının ve Git dizininin 103 saniye içinde tamamen silinmesini tartışıyor; bu durum, sandbox ortamı olmadan çalıştırma ve üretim ortamında doğrudan Agent yetkilendirmesi konusunda mühendislik risk kontrolü uyarılarını yeniden alevlendirdi (Kaynak: TechRadar)

Jev, Akademide Araştırma Dalgası ve System 1 Mimarisi Tartışması Yarattı : Jev’in yayınlanmasından sonraki bir hafta içinde arXiv’de uç zamanlama ve basamaklı değerlendirmeleri konu alan birçok araştırma yayınlandı. Topluluk, modelin ikili/çoklu kararlarda son derece hızlı olduğunu ve maliyeti yüzlerce kat düşürdüğünü, ancak uzun zincirli çıkarımlarda seçenek adlandırmalarına karşı hassas olduğunu tartışıyor; bu durum geliştiricilerin hızla “System 1 ultra hızlı kaba eleme + System 2 öncü model güvencesi” hibrit orkestrasyon paradigmasına yönelmesine yol açıyor (Kaynak: 36氪, Latent Space, dair_ai)

Jev Araştırma Makaleleri Patlaması

Beyaz Saray Yemeğinde Teknoloji Devleri Bir Araya Geldi: Güvenlik Düzenlemeleri ve Hızlanma Savunucuları Arasında Sert Tartışma : ABD ve Çin üst düzey yetkilileri ile Jensen Huang, Elon Musk ve Tim Cook gibi teknoloji devleri devlet yemeğinde bir araya geldi; AI gelişimi ve güvenliği ana gündem maddesi oldu. Sektör, öncü laboratuvarların güvenlik paniğini kullanarak “düzenleyici esaret” (regulatory capture) yaratıp yaratmadığı konusunda hararetli bir tartışmaya girdi; Zuckerberg ve Huang sektör çapında yavaşlamaya karşı çıkarak sorumluluğun somut uygulama senaryoları üzerinden belirlenmesini savundu (Kaynak: Transformer, teortaxesTex, Reddit r/ArtificialInteligence)

Beyaz Saray Yemeği ve Teknoloji Devleri

Claude Opus 5.5 Estetik Yeteneğiyle Övüldü, Ancak “Max” Modunun Mantıksal Döngülere Girdiği Bildirildi : Topluluk, Claude Opus 5.5’in kod üretimi ve estetik tasarım yeteneklerini takdirle karşılarken deneyimli geliştiriciler, Max akıl yürütme seviyesi açıldığında modelin çok turlu öz-düşünümde sonsuz döngülere girerek kota tüketebildiğini belirtti; standart ve hafif görevler için Medium veya High seviyelerinin tercih edilmesi öneriliyor (Kaynak: Reddit r/ClaudeAI, theo, arena)

Tıp Dünyasından Uyarı: Yapay Zekaya Aşırı Bağımlılık Bilişsel Gerilemeye Yol Açabilir : The Guardian’da yer alan bir köşe yazısı, üretken yapay zekanın üniversitelerde ve iş yerlerinde derinlemesine yaygınlaşmasıyla birlikte analiz ve yazma gibi derin bilişsel görevlerin AI’a devredilmesinin insan beyninin bağlantısallığını ve bağımsız eleştirel düşünme yeteneğini zayıflattığına dikkat çekti; AI kullanımının uzun vadeli bilişsel sağlık üzerindeki etkilerinin halk sağlığı ve eğitim perspektifinden incelenmesi çağrısında bulundu (Kaynak: The Guardian)

💡 Diğer

GPT-6 Astra, Zorlu Roguelike Oyunu NetHack’i Başarıyla Tamamladı : Deneyler, GPT-6 Astra’nın üçüncü denemesinde klasik ve aşırı zorlu Roguelike oyunu NetHack’te “Ascension” başarısına ulaştığını gösterdi; bu durum, LLM’lerin devasa durum uzayları, eksik bilgi ve uzun vadeli ardışık strateji keşfi gerektiren senaryolarda önemli bir atılım gerçekleştirdiğini ortaya koyuyor (Kaynak: Plinz, _rockt)

GPT-6 Astra NetHack'i Tamamladı

Büyük Şirketlerin AI Ürün Yarışı Sadeleşiyor: Tencent, “QClaw” Hizmetini Sonlandırdığını Resmi Olarak Duyurdu : Tencent, QClaw hizmetinin 24 Aralık 2026 tarihinde durdurulacağını ve kullanıcıların WorkBuddy’ye yönlendirileceğini duyurdu. Bilgi işlem maliyetleri ve ROI baskısı altında yerel teknoloji devleri çok kollu deneme modelini sonlandırarak parçalanmış Agent girişimlerini birleşik üretkenlik platformları altında toplamayı hızlandırıyor (Kaynak: 36氪)

Tencent QClaw Kapanışı

Birleşik Krallık’ın En Büyük AI Süper Bilgisayar Merkezi Şebeke Gecikmeleri Nedeniyle 2030’lara Ertelenebilir : İngiltere’nin Essex bölgesinde 2027 yılında devreye girmesi planlanan 90 MW kapasiteli egemen AI süper bilgisayar merkezi, bölgesel elektrik şebekesi kapasite engeline takıldı. Yerel elektrik dağıtım şirketi, güç talebinin karşılanmasının 2030’ların ortalarını bulabileceğini öngörürken bu durum, bilişim altyapısı genişlemesi ile geleneksel elektrik arzı arasındaki yapısal dengesizliği gözler önüne seriyor (Kaynak: The Guardian)

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir