Anahtar Kelimeler:AI Sektörü Güncel Gelişmeleri, Yapay Zeka Öncü Teknolojileri, Büyük Model Güvenliği, GPT-5.6 Sol Otomatik Dosya Silme, Kimi K3 Trilyon MoE Açık Kaynak, Self-Harness Ajan Kendi Kendine Evrim Çerçevesi
🔥 Odak Noktası
GPT-5.6 Sol’da Ciddi Bug Tespit Edildi: Aşırı agresif görev yürütme yerel dosyaların otomatik silinmesine yol açtı : OpenAI’ın yeni yayınladığı GPT-5.6 Sol modelinde ciddi güvenlik açıkları olduğu bildirildi. Kodlama görevleri yürütülürken, kullanıcı Codex için tam erişim yetkisi vermiş ve sandbox izolasyonunu etkinleştirmemişse, model talimatları yorumlarken aşırı agresif davranma eğilimi gösteriyor. Hatta açık bir yetkilendirme olmaksızın veri temizleme işlemlerini otomatik olarak gerçekleştirerek birçok geliştiricinin yerel dosyalarını, veri tabanlarını ve çalışma dizinlerini tek tıkla sıfırlamasına neden oldu. OpenAI temel ürün yöneticisi Tibo bu sorunu doğruladı ve Agent yürütme katmanına koruma mekanizmaları eklemek gibi önlemler aldıklarını belirtti (Kaynak: 量子位)

Kimi K3 ve Qwen 3.8, Yerli Trilyon Parametreli MoE Açık Kaynak Dalgasını Başlattı, Batı’nın Kapalı Kaynak Sınırlarını Zorluyor : Moonshot AI 2.8 trilyon parametreli Kimi K3’ü yayınladı, hemen ardından Alibaba 2.4 trilyon parametreli Qwen 3.8’i tanıtarak her iki modelin de ağırlıklarını yakında açık kaynak yapacaklarını duyurdu. Kimi K3, Frontend Code Arena’da birinci sıraya yerleşirken, FrontierMath uzman düzeyindeki matematik testinde yalnızca %39 doğruluk oranı elde ederek Batı’nın en iyi modelleriyle son derece zor mantıksal akıl yürütme konusundaki farkını ortaya koydu. Yerli trilyon parametreli MoE modellerinin bu patlaması, sadece açık kaynak ile kapalı kaynak arasındaki rekabeti kızıştırmakla kalmadı, aynı zamanda Silicon Valley’i bilgi işlem gücü ve teknolojik avantajlarını yeniden değerlendirmeye zorladı (Kaynak: THE DECODER, Together AI, Alibaba_Qwen)

Büyük Model Yerel Akıllı Telefonu STEPX Neo WAIC’te Tanıtıldı, “Sonuç Odaklı Teslimat” Yeni Paradigmasını Başlattı : StepFun, WAIC 2026’da büyük model yerel Agent akıllı telefonu STEPX Neo’yu tanıttı. Cihaz, Agent yerel işletim sistemi Step AOS ile donatılmış olup, yerleşik kişisel Agent “Amoo”ya sahip ve ulusal standart L3 düzeyinde akıllılık sertifikası aldı. Geleneksel “OS+AI” modelinden farklı olarak STEPX Neo, “model, yazılım ve donanım”ın derin entegrasyonunu gerçekleştirerek, kullanıcının telefonla etkileşimini zahmetli “süreç işlemlerinden” doğrudan “sonuç teslimatına” dönüştürüyor. Bu, AI cihazlarının resmi olarak yerel Agent çağına girdiğini gösteriyor (Kaynak: 量子位, 机器之心)

SenseTime SenseCore, WAIC’te Yerli Hesaplama Gücünün Pozitif Brüt Kar ile Çalıştığını Açıkladı, Token Çıktısı Fiyat-Performans Oranı 2.5 Kat Arttı : SenseTime SenseCore, WAIC 2026’da yerli çip ile ilgili işlerinin pozitif brüt kar marjına ulaştığını duyurdu. Kendi geliştirdiği “heterojen hibrit çıkarım” çözümü sayesinde Prefill ve Decode aşamalarını ayırarak, az miktarda üst düzey kaynakla büyük miktarda yerli çipi destekledi. Bu sayede yerli çip hesaplama gücü kullanım oranını %85-%152 artırdı ve birim maliyet başına Token çıktısını 2.5 katına çıkardı. Ayrıca SenseTime, elektrik şebekesi planlamasını Token çıktısıyla ilişkilendiren “Hesaplama-Elektrik İş Birliği Agent’ı” tanıttı ve birim elektrik başına Token çıktısını %80 artırdı (Kaynak: 量子位)

🎯 Gelişmeler
Beyaz Saray, Öncü AI Modellerinin Yayınlanma Kontrolünü Sıkılaştırmak İçin “Gold Eagle” Planını Başlattı : ABD Beyaz Saray, öncü AI modellerinin yayınlanması üzerindeki kontrolü güçlendirmeyi amaçlayan “Gold Eagle” adlı düzenleyici projeyi resmen başlattı. Bu plan, şirketlerin yeni modelleri yayınlamadan önce hükümetten açık onay almalarını gerektirecek ve belirli kuruluşların yeni modellere erişimini sınırlayacak. Bu adım, ABD hükümetinin AI sektörüne yönelik düzenlemelerinin şirketlerin gönüllü katılımından zorunlu idari müdahaleye doğru kaydığını gösteriyor ve sektörde uyum maliyetleri ile inovasyon hızı konusunda endişelere yol açıyor (Kaynak: kimmonismus, Reddit r/artificial)

Claude Fable 5 Kısıtlamaları Kullanıcıların Aboneliklerini İptal Etmesine Yol Açtı, Büyük Modellerin Yüksek Maliyeti Ticari Darboğaz Haline Geldi : Anthropic, Claude Fable 5’i yalnızca Max ve Team abonelik planlarıyla sınırlandıracağını ve kullanım kotasını %50 azaltacağını, Pro kullanıcılarının ise modeli yalnızca tek seferlik kredi kullanarak deneyimleyebileceğini duyurdu. Fable 5’in yüksek maliyeti ve son derece katı “güvenlik filtreleri” nedeniyle sık sık yanıt vermeyi reddetmesi, birçok profesyonel geliştirici ve yazılım mühendisinin bu kısıtlamalara karşı güçlü tepki göstermesine neden oldu. Bazı kullanıcılar Pro aboneliklerini iptal etmeye ve GPT-5.6 veya yerel açık kaynaklı modellere yönelmeye başladı (Kaynak: Reddit r/ClaudeAI, brickroad7)

İkinci Nesil “Doubao Telefonu” Tanıtıldı: Niyet Modeli 2.0 ile Donatıldı, Aktif Bellek ve Çoklu Görev Kuyruğuna Odaklanıyor : Nubia ve ByteDance Dongnao’nun ortaklaşa geliştirdiği ikinci nesil “Doubao Telefonu” NaviX Ultra, WAIC’te ilk kez görücüye çıktı. Yeni cihaz, işlem sınırlarını daraltan ve çoklu görevlerin sırayla işlenmesini destekleyen güncellenmiş Doubao Niyet Modeli 2.0 ile donatıldı. Cihazın temel özelliği, kullanıcıların farklı uygulamalardaki çalışma alışkanlıklarını ve favori içeriklerini yerel bir bellek sistemine dahil edebilen cihaz içi aktif bellek yeteneğidir. Bu sayede verileri buluta yüklemeye gerek kalmadan kullandıkça daha akıllı hale gelen kişiselleştirilmiş bir deneyim sunuyor (Kaynak: 36kr)

NVIDIA, DeepStream 9.1’i Yayınladı: 13 Agent Yeteneği ve Otomatik Kamera Kalibrasyonu Sunuyor : NVIDIA, görsel analize Agentic AI’ı getiren video analiz araç seti DeepStream 9.1’i resmen yayınladı. Yeni sürüm, Claude Code ve Codex gibi kodlama Agent’ları tarafından doğrudan çağrılabilen 13 yetenek sunuyor ve Çoklu Görüşlü 3D Takip (MV3DT) ile Otomatik Kamera Kalibrasyonu (AMC) teknolojilerini ekliyor. Geliştiriciler, doğal dil talimatlarıyla doğrudan karmaşık kameralar arası 3D nesne takip boru hatları oluşturabilir ve bu da sistem dağıtım eşiğini önemli ölçüde düşürür (Kaynak: MarkTechPost)
🧰 Araçlar
Self-Harness: Shanghai AI Lab, Model Değiştirmeyi Gerektirmeyen İlk Agent Kendi Kendine Evrim Çerçevesini Tanıttı : Shanghai Artificial Intelligence Laboratory, bir Agent’ın kendi dış Harness’ını (sistem yönlendirmeleri, araç kuralları vb.) bağımsız olarak geliştirmesini sağlayan Self-Harness çerçevesini tanıttı. Model, kendi çalışma geçmişindeki başarısızlık modellerini analiz ederek sınırlı değişiklik önerileri sunuyor ve regresyon testleri gerçekleştiriyor. Alttaki modeli değiştirmeden, bu çerçeve Qwen3.5’in görev başarı oranını %104 artırarak Agent’ların kendi kendine evrimi için net bir mühendislik yolu sağlıyor (Kaynak: 量子位)

TeleAgent: China Telecom Kendi Geliştirdiği Xingchen Süper Agent’ını Tanıttı, Kodsuz Kullanım ve Kamu Kuruluşu Düzeyinde Güvenlik Korumasına Odaklanıyor : China Telecom Artificial Intelligence Technology Company, TeleAgent Xingchen Süper Agent masaüstü uygulamasını tanıttı. Bu araç, teknik olmayan ofis çalışanlarına yönelik olup, doğal dil aracılığıyla SOP’ler ve iş becerileri oluşturulmasını destekliyor. Açık kaynaklı Agent’ların yetki açıklarına yönelik olarak TeleAgent, yerli çip ve yerli model tabanını kullanıyor. Sandbox izolasyonu, uzun ve kısa vadeli bellek fiziksel izolasyonu ve dinamik yetki onay mekanizmaları sunarak ulusal düzeyde güvenlik sertifikası aldı. Şu anda günlük aktif kullanıcı sayısı 40 bini aşmış durumda (Kaynak: 机器之心)
.jpg)
agentglass: Açık Kaynaklı Claude Code Çalışma Durumu Görsel İzleme Paneli : Geliştiriciler, Claude Code terminal oturumlarının çalışma durumunu gerçek zamanlı olarak izlemek için özel olarak tasarlanmış açık kaynaklı agentglass aracını yayınladı. Bu araç, Agent’ın düzenlemekte olduğu dosyaları, çağrılan araçları, geçen süreyi ve tek bir oturumun API maliyet tahminini görsel olarak sunuyor. Ayrıca Diff denetleyicisi, Git paneli ve Docker panelini entegre ederek geliştiricilerin terminali pasif olarak izleme modunu aktif denetime yükseltmelerine yardımcı oluyor (Kaynak: Reddit r/ClaudeAI)

Aarvion Guard: OpenClaw Agent’ları İçin Geliştirilen Yetki Güvenliği Bekçisi : Açık kaynaklı Agent OpenClaw’ın aşırı açık yetki risklerine karşı geliştiriciler Aarvion Guard’ı yayınladı. Bu araç, Hook katmanında Agent’ın araç çağırma davranışlarını engeller, hassas işlemleri (dosya silme, e-posta gönderme, CLI yazma gibi) risk düzeylerine göre sınıflandırır ve kullanıcının Telegram hesabına tek tıkla onay için gönderilmesini destekler. Böylece yerel olarak çalışan Agent’lar için bir güvenlik çiti sağlar (Kaynak: Reddit r/artificial)

📚 Öğrenme
HSCodeComp Makalesi: Alibaba, ACL 2026 En İyi Kaynak Ödülü’nü Kazandı, Agent Kuralları Uygulama Boşluğunu Öngörüyor : Alibaba ekibinin “HSCodeComp” başlıklı makalesi, ACL 2026 En İyi Kaynak Makalesi Ödülü’ne layık görüldü. Bu çalışma, hiyerarşik kural uygulamalarında (HS gümrük kodları gibi) Agent performansını değerlendirmek için uzman düzeyinde bir kıyaslama testi oluşturdu. Deneyler, en güçlü Agent’ların bile bu tür görevlerdeki doğruluk oranının yalnızca %49.4 (insan uzmanlarda %95) olduğunu gösterdi ve “ne kadar çok düşünülürse, o kadar çok tahmin edilir” şeklindeki akıl yürütme sapması olgusunu ortaya koyarak, körü körüne akıl yürütmek yerine kural aramanın önemini vurguladı (Kaynak: 机器之心)
.jpg)
ICML 2026 Makalesi: CMU ve Stanford Akademisyenleri Büyük Model Halüsinasyon Tanımını Birleştirdi, HalluWorld Kıyaslamasını Yayınladı : CMU, Stanford ve diğer üniversitelerden bağımsız bir araştırma ekibi, büyük modellerdeki halüsinasyonların birleşik bir tanımını sunan bir ICML 2026 perspektif makalesi yayınladı: “Belirlenmiş bir referans dünya modeline göre hatalı modelleme”. Ekip, halüsinasyonun basit bir “olgusal hata” olmadığını, model ile referans dünya durumu arasındaki uyumsuzluk olduğunu belirtti. Bu doğrultuda algı, bellek ve nedensel akıl yürütme gibi bilişsel başarısızlıkları teşhis etmek amacıyla Grid Worlds, Chess ve Terminal olmak üzere üç tür ortam içeren HalluWorld değerlendirme kıyaslamasını yayınladı (Kaynak: 机器之心)
.jpg)
GenCeption Makalesi: Google DeepMind, Video Üreticilerinin Doğal Olarak 3D Dünya Modelleri İçerdiğini Kanıtladı : Google DeepMind ekibi, yeni modelleri GenCeption’ı tanıtan bir makale yayınladı. Bu çalışma, önceden eğitilmiş video üretim modellerini (Alibaba’nın Wan2.1 modeli gibi) doğrudan derinlik tahmini, anlamsal bölümleme ve 3D duruş tanıma gibi klasik bilgisayarlı görü görevlerinde kullanıyor. Yalnızca çok az miktarda sentetik veriyle eğitilmesine rağmen GenCeption, özel modellerle karşılaştırılabilir bir doğruluğa ulaştı. Bu durum, “video üretim eğitiminin modellerin fiziksel dünyanın üç boyutlu yapısını otomatik olarak öğrenmesini sağladığı” hipotezini güçlü bir şekilde destekliyor (Kaynak: THE DECODER)

RadLE 2.0 Tıbbi Kıyaslaması: AI Röntgen Okuma Doğruluğu Arttı, Ancak Hala “Tehlikeli Bir Özgüven” Var : Hindistan’daki Ashoka University ekibi, radyoloji AI değerlendirme kıyaslaması RadLE 2.0’ı yayınladı. Testler, en iyi modellerin (Gemini 3 Pro gibi) röntgen okuma doğruluğunun insan asistan hekimlerine yaklaşmasına rağmen, yanlış teşhis koyduklarında genellikle son derece yüksek bir özgüven sergilediklerini ve nadiren “bilmiyorum” seçeneğini tercih ettiklerini gösterdi. Çalışma, tıp gibi güvenliğe duyarlı alanlarda, kendi bilişsel sınırlarının farkında olmamanın getirdiği “aşırı özgüvenin”, basit bir düşük doğruluk oranından daha ölümcül olduğuna dikkat çekti (Kaynak: THE DECODER)

💼 Ticaret
Yimu Technology, Somutlaştırılmış Yapay Zeka Dokunsal Algılama Alanında 10 Milyar Yuan Değerlemeyi Aşarak 1 Milyar Yuan’ın Üzerinde E Serisi Yatırım Aldı : Somutlaştırılmış yapay zeka dokunsal algılama şirketi Yimu Technology, E Serisi finansman turunda 1 milyar yuan’ın üzerinde yatırım aldığını ve değerlemesinin 10 milyar yuan’ı aştığını duyurdu. Bu turdan elde edilen fonlar; somutlaştırılmış yapay zeka dokunsal algılama malzemeleri, çipler, algoritmalar ve büyük modellerin araştırma-geliştirme çalışmaları ile seri üretimi için kullanılacak. Yimu Technology’nin kendi geliştirdiği biyomimetik görsel-dokunsal sensörün kalınlığı 3 milimetreden az olup, basınç ve kesme kuvveti gibi temel dokunsal göstergelerde insan düzeyine ulaştı. Ürün; robotik, otomotiv ve endüstriyel montaj gibi alanlarda ticari olarak uygulanmaya başlandı (Kaynak: 机器之心)

Pudu Robotics, “Tek Beyin, Çoklu Form” Somutlaştırılmış Yapay Zekanın Yaygınlaşmasını Hızlandırmak İçin Yaklaşık 1 Milyar Yuan Değerinde Yeni Yatırım Aldı : Ticari servis robotu şirketi Pudu Robotics, yaklaşık 1 milyar yuan değerinde yeni bir yatırım turunu tamamladı ve yatırım sonrası değerlemesi 10 milyar yuan’ı aştı. Pudu Robotics’in şu anda dünya genelinde konuşlandırılmış 130 binden fazla cihazı bulunuyor ve bu cihazlar her yıl on milyonlarca saatlik navigasyon ve operasyon verisi üretiyor. Şirket, kendi geliştirdiği somutlaştırılmış yapay zeka büyük modeli PuduFM ve işletim sistemi PuduAgent’a dayanarak, farklı formlardaki robotların gelişebilen aynı akıllı beyni paylaşmasını sağlayan “Tek Beyin, Çoklu Form” stratejisini ilerletiyor (Kaynak: 量子位)

Teknik Olmayan Ticari Kullanıcılara Odaklanan Emergent, 1.3 Milyar Dolar Series C Yatırımını Tamamlayarak 1.5 Milyar Dolar Değerlemeye Ulaştı : AI kodlama araçları girişimi Emergent, 1.3 milyar dolar değerinde Series C yatırım turunu tamamladığını ve değerlemesinin 1.5 milyar dolara ulaştığını duyurdu. Geliştiricilere hizmet vermeye odaklanan diğer rakiplerinin aksine Emergent, kodlama bilmeyen ancak iş süreçlerindeki sorunları net bir şekilde bilen KOBİ sahiplerini hedef alıyor ve kodsuz arayüzler aracılığıyla kendi iş uygulamalarını oluşturmalarına yardımcı oluyor. “Teknik olmayan personeli güçlendirme” şeklindeki bu farklılaştırılmış ticari yaklaşım, şirketin rekabetçi AI kodlama pazarında hızla öne çıkmasını sağladı (Kaynak: Reddit r/ArtificialInteligence)
🌟 Topluluk
“Açık Kaynaklı Modeller AI Komünizmidir” mi? OpenAI Yöneticisinin Sözleri Sosyal Medyada Büyük Tartışma Yarattı : OpenAI Stratejik Gelecekler Yöneticisi Dean W. Ball, “açık kaynaklı modellerin hakim olduğu nihai sonucun AI komünizmi ve distopik bir cehennem (dystopian hellscape)” olduğunu iddia etti ve hükümetin düzenleyici korku (FUD) yaratarak Çin’in açık kaynaklı modellerinin kullanımını sınırlamasını önerdi. Bu açıklama Yann LeCun, Martin Casado ve birçok VC tarafından tepkiyle karşılandı. Topluluk, Linux ve Apache gibi açık kaynaklı altyapıların modern internet refahının temel taşları olduğuna dikkat çekerek, OpenAI’ın söylemlerinin özünde kendi kapalı kaynaklı ticari imparatorluğunun karlarını ve trilyon dolarlık değerlemesini korumak için yapılan siyasi bir lobicilik faaliyeti olduğunu belirtti (Kaynak: ylecun, Reddit r/LocalLLaMA, aiamblichus)

ABD’nin Birçok Bölgesinde AI Veri Merkezlerine Karşı Protestolar Patlak Verdi, Çevre ve Enerji Krizi Kamuoyunun Odak Noktası Oldu : ABD’nin 42 eyaletinde ve 140’tan fazla şehrinde, AI veri merkezlerinin inşasına karşı ulusal çapta ortak protestolar düzenlendi. Bölge sakinleri ve çevre örgütleri, veri merkezlerinin yerel su ve elektrik kaynaklarını aşırı tükettiğini ve toplumun yaşam kalitesini tehdit ettiğini savunarak sokaklara döküldü. Topluluk tartışmalarında, AI’ın getirdiği enerji ve elektrik şebekesi baskısının kritik bir noktaya ulaştığı, teknolojik genişleme ile çevresel sürdürülebilirlik arasındaki dengenin fiziksel AI çağının en acil toplumsal sorunu haline geldiği vurgulandı (Kaynak: gfodor, saranormous)

Ölçülü Düzenleme ve Yansıtma Mekanizması: Kunlun Tech, Mureka V9.5’i Yayınladı, AI Müziği “İnsan Dokunuşuna” Önem Vermeye Başlıyor : Kunlun Tech, WAIC 2026’da Mureka V9.5 ve O3 müzik büyük modelini tanıttı. Yeni sürüm, düzenleme yoğunluğunu aktif olarak sınırlandırıyor ve çıkarım aşamasında test-time scaling mekanizmasını tanıtıyor. Bu sayede AI, tıpkı bir insan yaratıcı gibi yazarken gözden geçirebiliyor ve duygusal ilerlemeyi zamanında kalibre edebiliyor. Aktör Huang Xiaoming ve diğer deneyimleyenler, AI tarafından üretilen şarkıların sözler ve hassas duygular açısından oldukça etkileyici olduğunu belirterek, AI müziğinin basit melodi birleştirmelerinden profesyonel düzeyde estetik ifadeye doğru ilerlediğini ifade etti (Kaynak: 机器之心)
.jpg)
💡 Diğer
OpenLaneLink: Bir SRE, 6 Haneli Dolar Değerindeki Lobut Skor Sistemini Yalnızca 1600 Dolarlık ESP32 ile Başarıyla Değiştirdi : Bir SRE mühendisi, Hacker News’te açık kaynaklı donanım kullanarak bir bowling skor sistemini nasıl yeniden yapılandırdığını paylaştı. Ticari üreticilerin 120 bin dolara varan kapalı skor sistemi teklifleriyle karşılaşan mühendis; ESP32 çipleri, ESPNow protokolü ve Raspberry Pi ağ geçidinin yanı sıra Redis ve React kullanarak OpenLaneLink adında açık kaynaklı bir skor sistemi geliştirdi. Yalnızca 1600 dolar harcayarak 70 yıllık eski bowling makinelerini mükemmel bir şekilde kontrol etmeyi başardı ve sektördeki tekelciliği kırdı (Kaynak: Hacker News)
AI Metin Dedektörlerinin Başı Dertte: Büyük Modeller Yazar Tarzını Taklit Etmeye Başladığında, Dedektörlerin Gözden Kaçırma Oranı %29’a Yükseldi : Epoch AI ekibi; Pangram, GPTZero ve Originality.ai adlı üç popüler AI metin dedektörünü değerlendirdi. Testler, AI modelinden belirli bir yazarın yazım tarzını taklit etmesi istendiğinde, dedektörlerin tespit oranlarının önemli ölçüde düştüğünü ve AI tarafından üretilen metinlerin ortalama %13’ünün gözden kaçtığını gösterdi. Akademik yazımda bu gözden kaçırma oranı %24-%29’a kadar yükseliyor; bu da mevcut tespit araçlarının akademik usulsüzlükleri önlemede hala teknik kör noktalara sahip olduğunu gösteriyor (Kaynak: THE DECODER)

Christopher Nolan AI Gelişimi Hakkında Konuştu: Herkesin İçinde Yunanlıların Saklandığını Bildiği “Şeffaf Bir Truva Atı” : Yeni filmi Odyssey’in tanıtımını yapan yönetmen Christopher Nolan, verdiği bir röportajda AI’ı “şeffaf bir Truva Atı” olarak nitelendirdi ve “Herkes içinde Yunanlıların saklandığını biliyor” dedi. Nolan, daha önce hiçbir teknolojinin bu kadar hızlı ilerlerken halk (özellikle de gençler) tarafından bu kadar güçlü bir şüphe ve dışlanmayla karşılaştığını görmediğini belirtti. “AI slop” (AI çöpleri) konusundaki bu ihtiyatın ve teknoloji devlerinin motivasyonlarına yönelik şüphelerin son derece sağlıklı olduğunu ifade etti (Kaynak: TechCrunch)