🔥 Odak
OpenAI, Henüz Yayımlanmamış Modellerine Ait 722 Matematik Makalesini Erişime Açarak Yarı-Riemann Hipotezi Gibi Asırlık Problemlerin Sınırlarını Zorladı : OpenAI resmi olarak GitHub açık kaynak deposu openai/math altında, yayımlanmamış dahili öncü modeli tarafından üretilen 372 sonuç kümesini ve toplamda 722 matematiksel makale taslağını yayımladı. Temel bulgular; Yarı-Riemann Hipotezi (tüm Dirichlet L-fonksiyonlarının gerçel kısmı 7/8’den büyük bölgede sıfır noktası bulunmadığını ve Siegel sıfırlarının elendiğini kanıtlama iddiası), Abelian varyeteleri için Hodge Hipotezi kanıtı, 4 boyutlu Kakeya Hipotezi, rasyonel sayılar kümesinde Hilbert’in 10. Problemi ve Unique Games Conjecture’dan bağımsız olarak Basic-SDP’nin standart NP-hard eşiğini belirlemeyi kapsıyor; bunların yaklaşık 160 tanesi Lean formel kanıtlarını içeriyor. OpenAI, tek bir sonucun ChatGPT Pro çıkarım (inference) işlem gücüyle ortalama yaklaşık 3 saat sürdüğünü açıkladı. Bu gelişme, makinelerin otonom bilimsel keşifleri açısından bir dönüm noktası olarak görülse de aralarında üç Fields Madalyası sahibinin de bulunduğu Institute for Advanced Study danışma kurulu bir bildiri yayımlayarak kamuya açıklamanın akademik kabul anlamına gelmediğini vurguladı ve makinelerin toplu halde kanıt üretmesinin insan araştırmacıların özümseme ve doğrulama mekanizmalarını ciddi şekilde zorladığı uyarısında bulundu (Kaynak: 机器之心、The Verge、Latent Space、Abhishek Saha、openai)

ABD Enerji Bakanlığı ve NIH, DeepMind ve Diğer Devlerle Birlikte “Virtual Biology Initiative” Girişimini Başlattı : ABD Enerji Bakanlığı (DOE) ve ABD Ulusal Sağlık Enstitüleri (NIH), Google DeepMind, Meta, Isomorphic Labs ve NVIDIA gibi kuruluşlarla ortaklaşa “Virtual Biology Initiative” projesini hayata geçirdiklerini duyurarak ulusal düzeyde stratejik bir iş birliğine imza attı. Plan; hücresel biyolojinin tam ölçekli haritasını sistematik olarak çıkarmayı, standartlaştırılmış kıyaslama (benchmark) verileri üretmeyi ve çok modlu (multimodal) AI’ı bir araya getirerek hücre yaşam aktivitelerini uçtan uca tahmin edebilen dünyanın ilk genel dijital modelini inşa etmeyi amaçlıyor; böylece ilk ilkelerden (first principles) hareketle yeni ilaç keşfi ve hastalık mekanizması araştırmalarını yeniden şekillendirmeyi hedefliyor (Kaynak: Alex Rives)
Google DeepMind, Cihaz Üzerinde Çalışan Tam Kapsamlı Çok Modlu Embedding Modeli EmbeddingGemma 2’yi Açık Kaynak Olarak Yayımladı : Google DeepMind, Gemma 4 mimarisine dayanan ilk çok modlu embedding modeli EmbeddingGemma 2’yi Apache 2.0 lisansı altında resmi olarak açık kaynak yaptı. 740M parametreye sahip bu model; metin, kod, görsel, ses ve video vektör temsil uzaylarını yerel olarak birleştiriyor ve 8K bağlam (context) uzunluğunu destekliyor. Modüler tasarımı sayesinde metin modalitesi tek başına 270M parametre ile çalışabiliyor, kuantizasyon sonrasında mobil cihazlarda yalnızca yaklaşık 191 MB belleğe ihtiyaç duyuyor ve Matryoshka Representation Learning yardımıyla boyutların 768’in altına dinamik olarak kırpılmasını destekliyor. Qdrant testlerinde 1-bit kuantizasyon ile birleştirildiğinde VRAM kullanımını 77 kat azaltırken %94,5 geri çağırma (retrieval) doğruluğunu koruduğu görüldü; bu da hafif cihaz üstü tam modlu RAG ve çevrimdışı anlamsal arama (semantic search) alanındaki altyapı boşluğunu dolduruyor (Kaynak: Google DeepMind Blog、THE DECODER、GoogleDeepMind)

OpenAI “28 Günlük İddia” Kapsamındaki 2. Gün Güncellemesini Sundu: Auto-review Tamamen Ücretsiz Oldu ve Decisions API Genel Teste Açıldı : OpenAI, “28 gün boyunca her gün pratik iyileştirmeler sunma” meydan okumasının ikinci gününde, AI Agent uygulamalarının önündeki sürtünmeleri azaltmaya yönelik bir dizi temel güncelleme yayımladı: Uzun görevler için otomatik risk kontrolü ve denetim özelliği Auto-review, tüm giriş yapmış ChatGPT kullanıcılarına ücretsiz ve kota harcamadan açıldı; API ücretlendirme kademeleri Build, Launch ve Grow olmak üzere üç seviyeye basitleştirildi ve en üst kademe eşiği 500 dolara indirildi; ayrık yönlendirme ve araç dağıtımı için tasarlanan Decisions API resmi olarak genel teste açıldı; GPT-6 Luna tarafından desteklenen bu arayüz, 100 milisaniyenin altında sunucu yanıt süresi sunuyor, girdi token başına bir milyon için yalnızca 0,10 dolar talep ediyor ve çıktı ile önbellek ücreti almıyor; ayrıca macOS tarafında Meetings toplantı çalışma alanı eklentisi kademeli olarak kullanıma sunuldu (Kaynak: 机器之心、OpenAI Developers、)

Meta ve Sierra, Sektör Devleriyle Birlikte Kişisel Ajan Protokolü PAP’ı Yayımlayarak İnsan-İşletme Agent Etkileşim Standartlarını Belirledi : Tüketici odaklı AI Agent’ların ticari web sitelerinde sık sık scraping engellerine takılması sorununa karşı Meta ve AI müşteri hizmetleri platformu Sierra; Stripe, Shopify ve Walmart gibi şirketlerle ortaklaşa açık endüstri standardı “Personal Agent Protocol”ü (PAP) başlattı. A2A ve OAuth mimarilerini temel alan bu protokol, kişisel AI asistanlarının kullanıcı adına e-ticaret siparişi verme, bilet sorgulama ve form doldurma gibi işlemleri yürütürken kurumsal sistemlerle iletişim kurmasındaki kimlik doğrulama ve risk kontrol sınırlarını net bir şekilde düzenliyor; Decagon da buna paralel olarak PACT güven protokolünü açık kaynak yaparak ajanların sınır ötesi çağrılarındaki güven sorunlarını çözmeyi hızlandırdı (Kaynak: The Verge、TechCrunch、saranormous)

🎯 Gelişmeler
Google DeepMind, Görsel Üretim ve Düzenleme Modeli Nano Banana 2.1’i Yayımladı : Google, Gemini 3.6 Flash tabanlı üretken görsel modeli Nano Banana 2.1’i (gemini-nano-banana-2.1 API tanımlayıcısı ile) kullanıma sundu ve Gemini API, AI Studio ile Google Ads üzerinde eş zamanlı olarak erişime açtı. Yeni model; karmaşık tipografi tasarımlarını, hassas maskeleme ile bölgesel yeniden çizimi (inpainting) ve 14 adede kadar referans görselle karakter tutarlılığı sentezini yerel olarak destekliyor. 4K’ya kadar çözünürlükte görüntü oluşturmayı destekleyen modelde, görsel başına maliyet 0,034 dolara düşürüldü (%50 civarında indirim); böylece ticari görsel tasarımındaki turlar arası tutarlılık sorunlarının çözümüne odaklanıldı (Kaynak: 机器之心、GoogleAIStudio、THE DECODER)

Claude Olasılık Teorisindeki Zorlu Problemi Çözdü: Perkolasyon Sürekli Faz Geçişi Hipotezini Lean ile Formel Olarak Kanıtladı : Anthropic’in henüz yayımlanmamış dahili öncü Claude modeli, matematik dünyasını yaklaşık 70 yıldır meşgul eden sürekli faz geçişi hipotezini ($p_c$ kritik olasılığında sonsuz bağlantı olasılığının 0 olması) başarıyla çözdü. Model, akademi dünyasının 2024 yılında kurduğu eşitsizlik çerçevesi temelinde, Lean kanıt asistanı aracılığıyla binlerce satırlık formel çıkarım gerçekleştirerek 3 ila 10 arasındaki kritik fiziksel boyutlarda uzun süredir devam eden tıkanıklığı aştı. AI’ın Fields Madalyası düzeyindeki bir hipotezin formel kanıtını tamamlaması akademik dünyada derin yankı uyandırdı (Kaynak: 36氪)

Anthropic, Siber Güvenlik Doğrulama Programını Genişleterek Üç Kademeli Erişim Mekanizması Getirdi : Anthropic, Siber Güvenlik Doğrulama Programı’nı (CVP) kalıcı üç kademeli erişim mimarisine (Savunma düzeyi, Red Team düzeyi, Özel düzey) yükselttiğini ve doğrulanmış kurumlara ve beyaz şapkalı uzmanlara güvenlik filtreleri gevşetilmiş Claude Opus 5.5, Sonnet 5.5 ve Mythos 5.1 modellerini açtığını duyurdu. Yeni sistem, sızma testi (penetrasyon testi) ve kırmızı-mavi takım mücadeleleri için yetkilendirilmiş ofansif çağrı yeteneklerini ilk kez mevzuata uygun şekilde erişime açıyor; bu adım, “savunmacıların açıkları kapatmak için güçlü araçlara ihtiyaç duyması ancak genel güvenlik politikaları nedeniyle modellerden ret yanıtı alması” çelişkisini çözmeyi amaçlıyor (Kaynak: Anthropic News、AnthropicAI、THE DECODER)
DeepMind, Tüm Genom Varyasyonlarının Etkilerini Çözümlemek İçin AlphaGenome Atlas’ı Tanıttı : Google DeepMind, genomik derin öğrenme modeli AlphaGenome’u ve önceden hesaplanmış veritabanı AlphaGenome Atlas’ı tanıttı. Tek baz çifti çözünürlüğüne ve 1 milyon baz çifti uzun bağlam uzunluğuna sahip olan modelin Atlas veri tabanı, insan genomundaki 9 milyar olası tek nükleotid varyasyonunun tamamının moleküler fenotipik etkilerini önceden hesaplamış durumda. AlphaFold veritabanının 30 katı büyüklüğe ulaşan bu veri kümesi, nadir mutasyonların ve karmaşık hastalıkların yatkınlık mekanizmalarını sistematik olarak aydınlatmayı amaçlıyor (Kaynak: )
vLLM v0.31.0, CRIU Anlık Görüntü Mekanizmasını Getirerek Soğuk Başlatmayı Milisaniye Düzeyinde Süreç Geri Yüklemesine Dönüştürüyor : vLLM, vllm snapshot ve vllm preload arka plan servislerini (daemon) içeren v0.31.0 sürümünü yayımladı. Linux CRIU teknolojisine dayanan bu mekanizma, çıkarım motoru çalışırken hızlı kontrol noktası (checkpoint) kaydetme ve imaj geri yükleme işlemlerini gerçekleştiriyor; bulut örneklerinin dinamik geçişlerinde veya ölçeklenmesinde zaman alan model ağırlığı yükleme ve başlatma süreçlerini atlayarak büyük ölçekli çıkarım kümelerinin esnek zamanlamasında soğuk başlatma (cold start) gecikmesini belirgin şekilde düşürüyor (Kaynak: vLLM)
Harbin Teknoloji Enstitüsü ve NUS, Video Dünya Modelleri İçin 2-bit KV Cache Sıkıştırma Çözümü QuantWM’i Açık Kaynak Yaptı : Otoregresif video dünya modellerinin aşırı VRAM tüketmesi ve geleneksel kuantizasyonun ciddi ekran titremelerine (flickering) yol açması sorununa yönelik olarak, Harbin Teknoloji Enstitüsü Shenzhen ve NUS ekipleri ortaklaşa eğitim gerektirmeyen QuantWM kuantizasyon çözümünü sundu. Araştırma, kuantize edilen Key’lerin yol açtığı uzay-zaman dikkat kaymasının zamansal titremenin temel kaynağı olduğunu ortaya koydu; duyarlılık odaklı kümeleme ve ana altuzay hata telafisi yoluyla üretilen videoların zamansal kararlılığını korurken 6,2 kata kadar KV Cache VRAM sıkıştırması sağlandı (Kaynak: 机器之心)
.jpg)
Perplexity, Yükseltilmiş Açık Kaynak Karar Modeli pplx-decider-v1.1-27b’yi Yayımladı : Perplexity, güncellenmiş çok modlu karar modeli pplx-decider-v1.1-27b’yi açık kaynak yaptı. Bu ağırlıklar, en son Hugging Face Decision Index 0.3 değerlendirmesinde zirveye yerleşirken görsel ve mantıksal karar doğruluğunu koruyarak çıkarım verimliliğini büyük ölçüde optimize etti; buna paralel olarak Decision API hizmet birim fiyatı 1 milyon girdi token’ı başına 0,02 dolara indirildi (Kaynak: AravSrinivas)

Meta, Üretim Seviyesindeki Dağıtım Karar Çözücüsü Rebalancer’ı Açık Kaynak Olarak Sundu : Meta, 9 yılı aşkın süredir kurum içinde çalışan ve günde yaklaşık 40 milyon kaynak zamanlamasını işleyen C++ çekirdek çözücüsü Rebalancer’ı resmi olarak açık kaynak yaptı (Python arayüzü ve Apache 2.0 lisansı ile). Bu araç, sharding zamanlaması ve trafik dengeleme gibi NP-hard problemleri birleşik yönlendirilmiş asiklik grafiklere (DAG) soyutlayarak milyonlarca ölçekteki devasa varlıklar için verimli yerel arama ve karma tamsayılı programlama çözümleri sunuyor (Kaynak: MarkTechPost)
TII, BAE Lehçesine Özel Büyük Dil Modeli Falcon-Emirati-7B’yi Yayımladı : Birleşik Arap Emirlikleri Teknoloji İnovasyon Enstitüsü (TII), BAE lehçesinde uzmanlaşmış Falcon-Emirati-7B modelini tanıttı. Ekip; konuşma dili web verilerini, yerel kültürel arka planı ve kontrollü sentetik derlemleri içeren bir veri hattı oluşturarak yerel değerlendirme kriteri Alyah üzerinde %84,83 çoktan seçmeli doğruluk elde etti ve serbest diyaloglarda kültürel metaforları anlama ile nezaket uyumunu belirgin şekilde artırdı (Kaynak: HuggingFace Blog)

Figma’nın Ürün Tasarımı AI Agent’ı Tamamen GA Olarak Genel Erişime Açıldı : Figma, UI/UX ürün tasarımına yönelik yerleşik AI Agent’ının tüm kullanıcılara resmi olarak açıldığını duyurdu. Yeni sürüm, ekip tasarım kuralları referans kılavuzlarını bağlama mekanizmasını ve çok oyunculu iş birliği modunda ekipler arası Agent eylemlerini birlikte görselleştirme yeteneğini ekleyerek ajanların doğrudan bileşen kitaplıklarına dayanarak yüksek doğruluklu arayüzler ve çok durumlu etkileşimli prototipler oluşturmasına olanak tanıyor (Kaynak: The Verge)

Cohere, 70’ten Fazla Düşük Kaynaklı Dili Kapsayan Küçük Çok Dilli Model Ailesi Tiny Aya’yı Açık Kaynak Yaptı : Cohere Labs, COLM 2026 konferansında hafif çok dilli model ailesi Tiny Aya’yı açık kaynak olarak paylaştı. Bu seri, genel çok dilli temeli bölgesel olarak özelleştirilmiş varyantlarla birleştirerek dünya çapında 70’ten fazla dili (çok sayıda düşük kaynaklı yerel dil dahil) kapsıyor; amacı cihaz üstü çok dilli dağıtım eşiğini düşürmek ve küçük modellerin kültürlerarası anlamsal üretim yeteneğini geliştirmek (Kaynak: sarahookr)

NeurIPS 2026 | SAGE Çerçevesi, Büyük Dil Modellerinin Uzun Erimli Çıkarımlarını Düzeltmek İçin Topolojik Yapı Sinyallerini Kullanıyor : Virginia Tech ve diğer ekipler, LLM’lerin uzun zincirli akıl yürütmelerinde görülen “yarı yolda sapma yaşanmasına rağmen uç ödülün gecikmesi nedeniyle hatanın düzeltilememesi” kronik sorununa karşı SAGE (Yapısal Kabul Edilebilirlik Rehberliğinde Keşif) yöntemini önerdi. Yöntem, cebirsel seyreltme yoluyla keşif sapmalarını sıkıştırıyor ve hiperbolik uzay mesafeleri aracılığıyla adım adım geri bildirim sağlayarak sembolik ve formel matematik testlerinde doğruluğu önemli ölçüde artırıyor ve Lean doğrulama başarı oranını katbekat yükseltiyor (Kaynak: 机器之心)
.jpg)
Google, Kodsuz Deneysel Oyun Üretim Platformu Playground’u Tanıttı : Google, yapay zeka oyun deneme platformu playground.google’ı kullanıma sundu. Kullanıcılar, yalnızca doğal dil diyalogları yoluyla tarayıcı üzerinde özel fizik kuralları, karakter etkileşimleri ve sahne stilleri içeren hafif oyunlar tasarlayabiliyor; ayrıca oyunları birden fazla cihazda oynama ve toplulukla paylaşma imkanı buluyor. İlerleyen süreçte daha profesyonel 3D motor desteği sağlamak için Unity Spark entegrasyonu planlanıyor (Kaynak: Google AI Blog)
Replit, Projeler Arası Genel Bağlamı ve Arka Planda Eşzamansız Çalışan Kod Agent’ını Başlattı : Replit, geliştirme ortamında büyük bir yükseltme yaparak projeler arası çalışma alanında genel bağlam (global context) özelliğini resmen tanıttı. Agent, kullanıcının hesabındaki tüm geçmiş projeleri ve tasarım kurallarını dizine ekleyebiliyor; referans projelerden renk ve bileşen mantıklarını çıkarıp yeni projelere aktarabiliyor, ayrıca arka planda asenkron düzenleme görevleri oluşturup tek tıklamayla inceleme ve birleştirme (merge) desteği sunuyor (Kaynak: amasad)
🧰 Araçlar
Hark Pro: Bağımsız Korumalı Alan Tarayıcısına Sahip Cihaz Üstü Gizlilik Odaklı Kişisel Agent : Figure AI kurucusu Brett Adcock’un ekibi, masaüstü ve mobil uygulama Hark Pro’yu kullanıma sundu. Sistem; Handoff bilgisayar kullanım ajanını ve eski Apple ekibi tarafından hazırlanan kullanıcı arayüzünü bünyesinde barındırıyor. İzole edilmiş bir sanal alanda (sandbox) kullanıcı kimlik bilgilerini güvenli bir şekilde yönetebiliyor, otonom olarak web’de gezinip vize başvuruları, bilet alımları ve sistemler arası form işlemlerini gerçekleştirebiliyor. Tüm işlem geçmişi kullanıcıya şeffaf şekilde sunularak otonom ajanlık ile cihaz üstü gizlilik ve güvenlik dengeleniyor (Kaynak: TechCrunch、TheRundownAI)
Monid.ai, Agent’lar İçin Dinamik Araç Ödeme Ağ Geçidi İnşa Etmek Amacıyla 7,7 Milyon Dolar Yatırım Aldı : Agent geliştirme servis sağlayıcısı Monid.ai, “Agent’lara yönelik OpenRouter” olarak adlandırılan bir toplu API ağ geçidi sunarak 7,7 milyon dolar fon sağladı. Geliştiriciler, tek bir arayüzle agent’ların çalışma anında pazarlama, SEO, arama, e-ticaret ve çok modlu üretim alanlarındaki 2.500 ticari API’yi dinamik olarak keşfetmesini ve çağrı başına ödeme yapmasını sağlayabiliyor; bu da geleneksel aylık kurumsal SaaS aboneliklerinin yerini alıyor (Kaynak: yoheinakajima)
AgentID Kullanıma Sunuldu: AI Agent’lar İçin Özel Olarak Geliştirilen Bağımsız Kimlik Bilgisi Çözümü : AgentMail, AgentID hizmetini duyurdu. Bu çözüm, otonom olarak çalışan her bir agent’a bir insan sahibe bağlı bağımsız doğrulanmış bir e-posta ve kimlik bilgisi atıyor; böylece üçüncü taraf SaaS platformlarının denetim ve izlenebilirliği korurken hesap risk kontrollerine takılmadan harici agent’ların oturum açma ve platformlar arası yetkilendirme işlemlerine güvenli şekilde izin vermesini sağlıyor (Kaynak: omarsar0)
Spotify Portal AI Plugins: Kurumsal Geliştirme Platformunu Popüler Kod Agent’larına Taşıyor : Spotify, şirket içi geliştirici platformu Spotify Portal’ı doğrudan Claude Code, Codex ve Cursor’a bağlayan resmi açık kaynak eklenti paketini yayımladı. Agent’lar CLI üzerinden doğrudan mikroservis dizinlerini tarayabiliyor, servis tanılamalarını çalıştırabiliyor ve sağlık durumlarını sorgulayabiliyor; ayrıca token harcamalarını düşürmek için I/O yoğun görevleri shunt eklentisiyle hafif modellere yönlendirebiliyor (Kaynak: GitHub Trending)
T3 Code, Mesaj Akışı İçi Gerçek Zamanlı UI Görselleştirme ve Etkileşimli Önizleme Özelliğini Başlattı : Kodlama aracı T3 Code, uygulama içi UI görselleştirme özelliğini duyurdu. Agent, ön yüz yeniden yapılandırması veya PR kod incelemesi yaparken doğrudan sohbet dizisi içinde etkileşimli HTML/React bileşen çıktılarını ve görsel prototipleri satır içi olarak işleyebiliyor; bu da geliştiricilerin hot-reload hata ayıklaması için sürekli IDE dışına çıkmasından kaynaklanan bağlam kaybını azaltıyor (Kaynak: theo)

Overmind Açık Kaynak Oldu: Agent Yürütme İzlerini Kullanarak Dikey Küçük Modelleri Otomatik Olarak Distile Ediyor : Açık kaynaklı araç Overmind yayımlandı; günlük kodlama agent’larının veya kurumsal agent’ların araç çağırma günlüklerinden ve yürütme izlerinden yüksek değerli ince ayar (fine-tuning) ve değerlendirme veri setleri oluşturulmasını destekliyor. Yapılan testler, bu yöntemle ince ayar yapılan dikey küçük modellerin uzun sözleşme maddesi çıkarma senaryolarında referans uydurma (halüsinasyon) oranını büyük modellerdeki %3,36’dan %0,12’ye indirdiğini gösterdi (Kaynak: kimmonismus)

Mitchell Hashimoto, Evrensel Terminal Programı Durum Spesifikasyonu OSC 7501’i Yayımladı : Ünlü geliştirici Mitchell Hashimoto, komut satırı programlarının terminale boştalık, çalışma, bekleme, tamamlanma ve başarısızlık gibi ayrıntılı durumları doğru şekilde bildirmesini sağlayan yepyeni OSC 7501 terminal kontrol spesifikasyonunu yayımladı. Amaç, şu anda yüzlerce agent düzenleyicisinin (orchestrator) bağımlı olduğu sezgisel regex kontrollerinin yerini alarak çoklu agent durum iletişimi için standart bir protokol oluşturmak (Kaynak: mitchellh)
Scale AI, Yüksek Doğruluklu Agent Pekiştirmeli Öğrenme Ortamı Çerçevesi AgentEnv’i Açık Kaynak Yaptı : Scale AI, Modal ile ortaklaşa AgentEnv ortam geliştirme paketini açık kaynak yaptı. Karmaşık ve uzun erimli agent’ların pekiştirmeli öğrenme (reinforcement learning) ardıl eğitimi için özel olarak geliştirilen bu çerçeve; dinamik tetikleyiciler, sanal saatler ve çoklu sandbox ortam yönetimi sunarak büyük ölçekli eşzamanlı rollout ve ortam içi çekişmeli eğitimleri desteklemek üzere önde gelen bulut sandbox kümelerine sorunsuz bir şekilde bağlanabiliyor (Kaynak: Scale AI)
DAIR.AI, Agent’lara Yönelik Üst Düzey Konferans Literatürü Keşif MCP Paketini Tanıttı : Tanınmış açık kaynak AI topluluğu DAIR.AI, Claude Code, Codex ve Grok Bot gibi agent’lara tek tıkla bağlanmayı destekleyen özel bir MCP eklentisi sundu. Agent’lar, özenle seçilmiş AI makale veritabanına otonom olarak erişerek en son araştırma trendlerini haritalandırabiliyor, otomatik literatür taraması hazırlayabiliyor ve yöntem mimarilerini görsel olarak karşılaştırabiliyor (Kaynak: DAIR.AI)
ruNNtime, EmbeddingGemma 2’nin Tamamen Tarayıcı Tarafında WebGPU ile Çalışmasını Sağladı : WebGPU çıkarım kütüphanesi ruNNtime, EmbeddingGemma 2’nin metin ve görüntü kulelerini tamamen ön yüz ortamına başarıyla taşıdı. Kullanıcılar, herhangi bir arka uç sunucusuna ihtiyaç duymadan doğrudan yerel tarayıcı GPU’larını kullanarak resim galerilerinde çok modlu anlamsal aramalar yapabiliyor; bu da cihaz üstü hafif çok modlu arama mimarilerinin gizlilik koruması ve çevrimdışı senaryolardaki potansiyelini kanıtlıyor (Kaynak: Reddit r/LocalLLaMA)

Anthropic, Claude for Google Workspace Eklentisinin Genel Testini Başlattı : Anthropic, ücretli aboneleri için Google Workspace resmi kenar çubuğu eklentisini kullanıma sundu. Bu eklenti, kullanıcıların Docs, Slides ve Sheets içinde doğrudan Claude’u çağırarak çok turlu düzenlemeler yapmasına, yapısal optimizasyonlar gerçekleştirmesine, otomatik biçimlendirme sağlamasına ve belgeler arası bağlamı doğrudan okumasına olanak tanıyor (Kaynak: The Verge)
📚 Öğrenme
Yann LeCun’un Ekibi Katmanlı Dünya Modeli H-JEPA’yı Önerdi: Uzun Erimli Görsel Planlama Başarı Oranı Dört Katına Çıktı : Uçtan uca görsel planlamada yerel ayrıntıların kolayca kaybolması sorununa karşı Yann LeCun’un ekibi, yukarıdan aşağıya hiyerarşik temsile sahip H-JEPA mimarisini önerdi. Her katmanın bağımsız gizil uzay temsilleri ve anlamsal soyutlama ölçekleri bulunuyor; karmaşık Visual AntMaze labirentinde yapılan uzun vadeli planlama testlerinde, üç katmanlı yapı görev başarı oranını %18’den %73’e çıkardı (Kaynak: ylecun)

Meta ve MIT Coco’yu Yayımladı: Donanım ve Derin Öğrenme Modeli Ortak Tasarımı İçin Agent Platformu : Meta ve MIT, donanım tasarımına yönelik çoklu ajan sistemi Coco’yu sundu. Yüzlerce GB boyutunda daha önce görülmemiş simülasyon tarama verileri karşısında Agent; ilişkisel veritabanlarını sorgulamak için otonom olarak SQL yazabiliyor, analiz araçlarını koordine edebiliyor ve UI gezinme durumlarını okuyabiliyor; bu sayede TPU mimarlarının simülasyon konfigürasyonlarını kurma ve performans darboğazlarını tespit etme konusundaki iş yükünü yarı yarıya azaltıyor (Kaynak: dair_ai)

AgentCore ve OpenClaw ile Kalıcı Belleğe Sahip Akıllı Asistan İnşa Etme Rehberi : AWS ekibi, sunucusuz (Serverless) çalışma ortamında OpenClaw tabanı ile Bedrock AgentCore kalıcı bellek bileşeninin nasıl birleştirileceğini gösteren kapsamlı bir mimari rehberi yayımladı. Makale, kısa vadeli olay yakalama ile asenkron uzun vadeli olgu çıkarımından oluşan iki katmanlı bellek mimarisini ayrıntılı olarak ele alıyor ve Prompt Caching teknolojisi sayesinde hafızalı çok turlu etkileşimlerin çıkarım maliyetini yaklaşık %90 oranında düşürüyor (Kaynak: AWS Machine Learning Blog)

Stanford, Büyük Dil Modellerinin Özgün Bilimsel Hipotez Üretme Yeteneğini Ölçen Priced Guidance Çerçevesini Sundu : Percy Liang’ın ekibi, bilgi teorisine dayanan Priced Guidance değerlendirme paradigmasını önerdi. “Yirmi Soru” oyun mekanizması tasarlayarak modelin ön eğitim kesme noktasından gelecekte yayımlanan yeni makalelerin temel kavramlarını yeniden oluşturması için gereken bilgi bitlerini hassas bir şekilde ölçen bu yöntem, sıkıştırma perspektifinden modelin bilimsel sezgisini ve öncü genelleme yeteneğini nicelleştiren bir kriter oluşturuyor (Kaynak: percyliang)

Çok Öğretmenli İlke İçi Distilasyon (MOPD) Mekanizması Analizi: Alanlar Arası RL Yetenek Çatışmalarını Aşmak : Araştırma, Çok Öğretmenli İlke İçi Distilasyon (MOPD) yöntemini ayrıntılarıyla inceledi. Muhakeme, kodlama ve diyalog gibi birden fazla alanın birleşik RL ince ayarında ödül çatışmaları ve aşırı işlem gücü tüketimi sorunlarına karşı bu yöntem, alanlara özel uzman öğretmen modelleri ayrı ayrı eğitiyor; ardından ters KL diverjansı aracılığıyla öğrenci modele token düzeyinde yoğun gözetim sağlayarak hem her alanda yetkin modeli birleştiriyor hem de örnek verimliliğini koruyor (Kaynak: cwolferesearch)

HAD Çerçevesi: Ortam Farkındalıklı Distilasyon ile Küçük Dil Modeli Agent’larının Yürütme Gücünü Artırma : Makale, Harness ile dağıtılan küçük model agent’larına yönelik HAD distilasyon yöntemini öneriyor. Harici durum bilgilerinin varlığında ve yokluğunda öğretmen modelin eylem farklılıklarını karşılaştırarak küçük modelin çerçeve bilgilerini kullanma niyetini özel olarak eğiten bu yaklaşım, ALFWorld kıyaslamasında küçük modellerin görev başarı oranını %63,4’e çıkardı ve tıkanma yaşanan senaryoların yaklaşık %60’ında başarıyla çıkış sağladı (Kaynak: omarsar0)

Amazon AGI, Uyarlanabilir Döngüsel Difüzyon Dil Modeli ALoDLM’i Açık Kaynak Yaptı : Amazon AGI araştırma ekibi, 8B parametreli ALoDLM mimarisini ve eğitim protokolünü açık kaynak olarak yayımladı. Difüzyon dil modeli içinde uyarlanabilir döngüsel çıkarım ve aşamalı hata düzeltme mekanizmaları sunarak zorlu örnekler için bilgi işlem kaynaklarını dinamik olarak tahsis eden bu model, birden fazla kapsamlı dil anlama ve üretme kriterinde eşdeğer ölçekteki otoregresif temel modelleri geride bıraktı (Kaynak: arankomatsuzaki)

Jay Alammar, “AI Agent’lar İçin Görsel Rehber”in Temel Sistem Mimarisi Şemasını Paylaştı : Tanınmış teknik yazar Jay Alammar, agent sistemlerinin en kritik kapalı döngü mimari şemasını paylaştı. LLM’lerin bir agent ortamında kullanıcı hedefi alma, durum sürdürme, bellek sorgulama ve ortam eylemi yürütme adımlarından oluşan özyinelemeli kapalı döngü mekanizmasını ayrıntılı olarak açıklayan şema, geliştiriciler için modern otonom Agent sistemlerinin temel mühendislik yapı taşlarını özetliyor (Kaynak: Jay Alammar)

💼 İş Dünyası
AMD, Fei-Fei Li’nin Uzamsal Zeka Girişimi World Labs’i Tamamı Hisse Senedi Karşılığı 8,2 Milyar Dolara Satın Alacağını Duyurdu : AMD, Fei-Fei Li’nin kurucularından olduğu dünya modeli girişimi World Labs ile yaklaşık 8,2 milyar dolarlık tamamı hisse senedi anlaşması yoluyla nihai bir satın alma sözleşmesine vardığını duyurdu. Sektör analizleri, Atlas modelinin seyrek bakış açısından gerçek zamanlı 4D rekonstrüksiyonun uygulanabilirliğini kanıtlamasıyla birlikte fiziksel yapay zeka (embodied AI) ve dünya modellerinin ölçeklenebilir bir endüstriyel dönüm noktasına ulaştığını belirtiyor; AMD’nin bu hamlesi NVIDIA ile rekabet etmeyi, 4D bilgi işlem çip mimarisinde ve simülasyon ekosisteminde derinlemesine engeller oluşturmayı amaçlıyor (Kaynak: 36氪)

Kuaishou Bünyesindeki Kling AI, Hong Kong IPO’su İçin CICC ve Goldman Sachs’ı Seçti: 1 Milyar Doların Üzerinde Fon Toplamayı Hedefliyor : Kuaishou’nun video büyük model girişimi Kling AI; Hong Kong’da halka arz (spin-off IPO) sürecini yürütmek üzere CICC, Goldman Sachs ve UBS’i sponsor ekip olarak belirledi ve en erken 2027 yılında borsaya kote olmak üzere en az 1 milyar dolar toplamayı planlıyor. Kling AI’ın 2026 yılı ikinci çeyrek geliri 850 milyon yuanı aştı; bağımsız halka arzın amacı, yüksek maliyetli bilgi işlem kümesi Ar-Ge süreçleri için bağımsız bir finansman kanalı açmak olup Kuaishou şirket üzerindeki mutlak kontrolünü korumaya devam edecek (Kaynak: 36氪)

AI Bilgi İşlem Bulut Sağlayıcısı Lambda, IPO Öncesinde 14,5 Milyar Dolar Değerleme Üzerinden 4 Milyar Dolar Toplamayı Planlıyor : Wall Street Journal’ın haberine göre GPU bulut altyapısı sağlayıcısı Lambda, Coatue ve Blackstone liderliğinde yatırım öncesi 14,5 milyar dolar değerlemeyle 4 milyar dolara kadar fon topluyor. Anthropic gibi büyük müşterilerden gelen devasa bilgi işlem sözleşmeleri sayesinde bekleyen sipariş hacmi 50 milyar dolara fırlayan şirketin bu hisse senedi finansmanı turu, halka arz öncesinde yeni nesil bilgi işlem merkezlerinin inşasını güvence altına almak için kullanılacak (Kaynak: TechCrunch)
🌟 Topluluk
Şirketlerin Agent Dağıtımlarında “İş Birliği Vergisi” Engeli: Çözülen Her 1 Saatlik Talep İçin 3 Saat Şirket İçi İletişim Gerekiyor : Müşteri hizmetleri yönetim platformu Front’un 700 şirket yöneticisiyle yaptığı anket büyük yankı uyandırdı. Veriler, şirketlerin Agent sistemlerini devreye aldıktan sonra iş gücü maliyetlerini doğrudan düşüremediğini, aksine agent’ların döngüyü kendi başına tamamlayamamasından kaynaklanan çok düğümlü devirler ve talep eskalasyonları nedeniyle ölçülemeyen devasa bir “iş birliği vergisi” ortaya çıktığını gösteriyor. Şirketlerin sistemler arası devir ve arka plan doğrulaması için harcadığı süre gerçek çözüm süresinin 3 katına ulaşarak uçtan uca gözlemlenebilirlik eksikliğindeki yönetişim sancılarını gözler önüne seriyor (Kaynak: )
ChatGPT Sohbet Başlıklarının Sonuna Kumar Reklamı Sızmasının Nedenleri Detaylandırıldı: Tokenizer Kirliliği ve Kesme Başarısızlığı : Geliştiriciler, ChatGPT oturum başlıklarında zaman zaman beliren yasa dışı reklamların teknik mekanizmasını derinlemesine aydınlattı. o200k tokenizer’ın ön eğitim külliyatına gri sektör web sitelerinden yüksek frekanslı uzun token’ların karışması ve hafif başlık oluşturma çıkarım modelinin EOS kontrol karakterini üretirken olasılık sapması yaşaması nedeniyle, modelin daha önce hiç görmediği nadir token “çöp deposundan” yüksek olasılıklı reklam parçacıklarını yanlışlıkla örneklediği tespit edildi (Kaynak: 36氪)
Bulut Tabanlı Harness Mimarisi Yükseliyor: Kubernetes’in Yaratıcıları Agent’lar İçin Merkezi Yönetişim Çözümünü Araştırıyor : Kubernetes’in erken dönem çekirdek ekibi tarafından kurulan Stacklok, bulut tabanlı Agent Harness projesi Mecatl’ı açık kaynak yaptı. Topluluk, agent’ların “yerel terminal komut dosyaları” olmaktan çıkıp “kurumsal merkezi kontrol platformlarına” doğru evrimini derinlemesine tartıştı; şirketlerin temel varlıklarının ve yetkilerinin tek bir yerel ortama bağımlı hale gelmesini önlemek için Agent durumunun, MCP araç ağ geçidinin ve hassas sandbox yürütme ortamının birbirinden tamamen ayrıştırılması gerektiği vurgulandı (Kaynak: Latent Space)
Meta Muse’un 4 Milyon Kullanıcının Sosyal Profilini Gerçek Zamanlı Oluşturduğu Ortaya Çıktı, Gizlilik Endişeleri Arttı : Toplulukta, Meta’nın Muse adlı agent’ının kullanıcı sohbetleri ve iletişim kayıtlarına dayanarak her saat başı sosyal ilişkiler, kişilerarası çatışmalar ve tercihler gibi ayrıntıları içeren kapsamlı profilleri otomatik olarak güncellediği ifşa edildi. Meta, kullanıcı sanal makinelerinin (VM) bağımsız korumalı alanlar olduğunu belirtse de örnekler arası “öğrenme deneyimlerinin paylaşılması” mekanizması, görünmez veri toplama ve hedeflenmiş reklam istismarı konusunda kullanıcılarda ciddi endişelere yol açtı (Kaynak: Reddit r/artificial)

Geliştiriciler “AI İnsan Gibi Konuşmuyor” Olgusunu Tartışıyor: CoT Sıkıştırmasından Derlem Uyumsuzluğuna : Son dönemde geliştirici topluluklarında, en yeni kodlama büyük modellerinin durum bildirirken sık sık anlaşılması güç teknik jargona başvurması yoğun tepki topladı. Tartışmalarda, geliştiricilerin token tüketimini düşürmek amacıyla örtük düşünce zincirini (CoT) aşırı derecede kısaltarak kapalı ifadelere dönüştürmesinin bunda etkili olduğu belirtildi; bazı teknoloji meraklıları ise bu vesileyle yoğun klasik dillerin ya da edebi sözdizimlerinin token’ları aşırı sıkıştırmadaki mühendislik avantajlarını tartıştı (Kaynak: 量子位)

Şifreli Prompt ile Filtre Atlama Açığı Ortaya Çıktı: Agent’ların Kendi Kendine Şifre Çözmesi Güvenlik Zafiyetine Dönüştü : Güvenlik araştırmaları, saldırganların şifrelenmiş kötü amaçlı komutları kullanarak Copilot gibi sistemlerin dış güvenlik filtrelerini aştığını ortaya koydu; agent’lar girdiyi işlerken şifreyi kendi başlarına çözüyor, yerel gizli bilgileri tarıyor ve bunları ağ üzerinden dışarı sızdırıyor. Testler, otomatik model yönlendirme mekanizmalarının güvenlik savunmasını son derece istikrarsız hale getirdiğini ve güvenlik hattı olarak modelin kendi denetimine güvenmenin sistemsel riskler barındırdığını gösterdi (Kaynak: Reddit r/artificial)

Minyatürleştirmenin Sınırları Zorlandı: Geliştirici Yalnızca 20 Bin Parametreye Sahip Anlatı Modeli MacroStories’i Eğitti : Bağımsız bir geliştirici, boyutu yalnızca 81 KB (19.969 parametre) olan MacroStories adlı mikro dil modelini açık kaynak yaptı. Tek bir kod çözücünün 4 kez döngüsel çıkarım yaptığı bir mimari kullanan model, standart CPU’larda ve hatta mikrodenetleyici önbelleklerinde son derece hızlı çalışabiliyor; kısıtlı bir kelime dağarcığında net bir anlatı çizgisini koruyarak dilsel tutarlılık için gereken asgari hesaplama sınırlarını keşfediyor (Kaynak: Reddit r/LocalLLaMA)

💡 Diğer
Elektrik Şebekesi Kapasitesi ve Transformatör Tedarik Zinciri Kıtlığı, Hesaplama Çiplerinden Önce AI Genişlemesine Sert Fren Yaptırabilir : Enerji politikası analizleri, ABD genelinde AI veri merkezlerinin elektrik yükünün 2030 yılına kadar 50 GW’a ulaşmasının beklenmesine rağmen, ultra yüksek gerilim transformatörleri gibi ağır elektrikli ekipmanların teslimat sürelerinin 5 yılı aştığını ve üreticilerin geçmişteki kapasite balonları nedeniyle temkinli davranarak kapasite artırımına gitmekten çekindiğini gösteriyor. Fiziksel elektrik şebekesi ile iletim ve dağıtım tesislerindeki bu katı arz-talep uyumsuzluğu, bilgi işlem gücünün kontrolsüz büyümesini kısıtlayan en ciddi fiziksel darboğaz haline geliyor (Kaynak: Transformer)
Adobe Tasarım Araçları Setinin Tamamı Açık Kaynak Olarak Tersine Mühendislikle Klonlandı: Kod Büyük Dil Modelleri Fikri Mülkiyet Kalkanını Yeniden Şekillendiriyor : Açık kaynak projesi Artcraft, Opus 5.5 gibi öncü kod modellerini kullanarak geleneksel tasarım yazılımlarının mantığını tersine derledi ve Rust standartlarına göre yeniden yapılandırarak Photoshop düzeyindeki tam tasarım paketinin temiz oda (clean-room) açık kaynak alternatifini hayata geçirdi. Topluluk, kod agent’larının eski yazılımları ışık hızında tersine mühendislikle yeniden üretme yeteneğinin, geleneksel tescilli yazılımların dayandığı yüksek giriş bariyerli ticari koruma kalkanlarını temelden sarstığını tartışıyor (Kaynak: dotey、amasad)

McDonald’s, Bayi Fiyatlarında Gizli Anlaşma Yapmak İçin AI Fiyatlandırma Aracını Kullandığı İddiasıyla Antitröst Davasıyla Karşı Karşıya : Tüketiciler, Chicago Federal Mahkemesi’nde McDonald’s aleyhine toplu antitröst davası açtı; bağımsız bayilerin entegre etmek zorunda kaldığı dinamik fiyatlandırma AI aracının aslında kamuya açık olmayan satış verilerinin yatay değişimini ve algoritmik fiyat manipülasyonunu oluşturduğunu, bunun da tüketici haklarını ihlal ederek piyasa rekabet düzenini bozduğunu iddia etti (Kaynak: The Guardian)
