Gizemli Model Ox Alpha, OpenRouter ve OpenCode’a Sürpriz… | Yapay Zeka Bülteni 2026-08-22

🔥 Odak Noktası

Gizemli Model Ox Alpha, OpenRouter ve OpenCode’a Sürpriz Bir Giriş Yaptı : OpenRouter ve OpenCode, “Ox Alpha” kod adlı gizemli bir stealth (gizli) modeli sürpriz bir şekilde kullanıma sundu. Model, 1 milyon Token bağlam penceresi sağlarken metin, görsel ve video girdilerini yerel olarak destekliyor. Uzun döngülü Agent programlama, karmaşık akıl yürütme ve gerçek üretim ortamları için özel olarak tasarlanan modele günlük 100 trilyon Token ücretsiz test kotası tahsis edildi. Birçok geliştiricinin gerçek testleri, modelin kodlama ve akıl yürütme yeteneklerinin Fable 5 ve GPT-5.6 Sol’u geride bıraktığını gösteriyor. Tüm internet modelin gerçek kimliğini hararetle tahmin etmeye çalışırken, topluluğun mevcut tahminleri ağırlıklı olarak Zhipu GLM-5.4/5.5 veya Xiaomi MiMo V3 yönünde. (Kaynak: OpenRouter, 36Kr)

DeepSeek, Çok Modlu Görsel Modeli V4-Flash-Vision-Exp’i Resmi Olarak Yayınladı : DeepSeek resmi API platformu, ilk yerel görsel anlama modeli olan DeepSeek-V4-Flash-Vision-Exp’i beklenmedik bir şekilde yayınladı. Model, V4-Flash’ın güçlü metin yeteneklerini korurken çok modlu Agent performansını önemli ölçüde artırarak Opus 4.8 seviyesine yaklaştırıyor. Görseller boyutlarına göre Token’a dönüştürülecek (görsel başına üst sınır 384 token) ve fiyatlandırma V4-Flash ile tamamen aynı olacak (bin görsel yaklaşık sadece 1 Yuan’a denk geliyor). Aynı zamanda ücretsiz Files API ve Harness 0.1.1 uyumluluğu da eş zamanlı olarak açılarak görsel Agent geliştirme ve çalıştırma maliyetleri büyük ölçüde düşürüldü. (Kaynak: DeepSeek, JiQizhixin)

DeepSeek, Çok Modlu Görsel Modeli V4-Flash-Vision-Exp'i Resmi Olarak Yayınladı

Google, Gemini 3.7 Flash’ı Tanıttı ve Birden Fazla Agent Kıyaslamasında Rekor Kırdı : Google, Gemini 3.7 Flash’ı resmi olarak sundu. API fiyatı 3.6 Flash’a kıyasla %50 düşürülürken, algoritmik düzeyde büyük bir zeka sıçraması gerçekleştirildi. Artificial Analysis’in AA-AnalystAgent gerçek veri analizi kıyaslamasında Gemini 3.7 Flash zirveye yerleşti ve görevleri rakiplerinden %60 ila %90 daha hızlı tamamladı. Aynı zamanda ARC-AGI doğrulama değerlendirmesinde son derece düşük bir maliyetle ARC-AGI-2 üzerinde %84.6 gibi yüksek bir puan elde ederek son derece yüksek fiyat-performans oranı ve görsel Agent gücü sergiledi. (Kaynak: demishassabis, Google Research Blog)

Google, Gemini 3.7 Flash'ı Tanıttı ve Birden Fazla Agent Kıyaslamasında Rekor Kırdı

OpenAI, Vakıf Kurdu ve AI Futures Projesini Başlattı : OpenAI, AGI yeteneklerini geniş toplumsal kamu yararına dönüştürmeyi amaçlayan OpenAI Foundation vakfını resmi olarak kurdu ve AI Futures projesini başlattı. Yaşam bilimleri (protein tasarımı ve yeni ilaç geliştirme gibi) ile AI toplumsal dayanıklılığına (biyolojik/siber tehditlere karşı savunma) odaklanan vakıf, ilk beş ayda yüz milyonlarca dolar harcadı ve gelecekte milyarlarca dolar yatırmayı planlıyor; buna erken uyarı sistemi inşa etmesi için SecureBio’ya yapılan 17.2 milyon dolarlık bağış da dahil. Bu hamle, öncü AI laboratuvarlarının teknolojinin kötüye kullanımını ve toplumsal riskleri önlemeye yönelik kamu altyapısı inşasını hızlandırdığına işaret ediyor. (Kaynak: OpenAI News, woj_zaremba)

OpenAI, Vakıf Kurdu ve AI Futures Projesini Başlattı

🎯 Gelişmeler

NVIDIA, AVO Agent’ını Tanıttı ve ARC-AGI-3’te %100 Tam Puan Elde Etti : NVIDIA AI ekibi, genel programlama ve etkileşimli akıl yürütme Agent’ı AVO’yu yayınladı. Herhangi bir açık talimat, kural veya önceden belirlenmiş hedef olmadan, Claude Opus 5 destekli AVO Harness, ARC-AGI-3 etkileşimli akıl yürütme kıyaslamasının tüm 25 ortamındaki 183 seviyeyi tamamlayarak %100 tam puan aldı ve eylem yürütme verimliliğini benzer sistemlere göre %12 artırdı. (Kaynak: ClementDelangue)

Alibaba, Qwen-UI-Agent Temel Agent Modelini Açık Kaynak Olarak Sundu : Alibaba, mobil, masaüstü ve web uygulamaları için tasarlanmış GUI temel Agent modeli Qwen-UI-Agent’ı (27B / 35B-A3B / 4B sürümleriyle) sundu. Model, 100’den fazla gerçek cep telefonu ortamında eğitildi. GUI tıklama ve CLI komut satırı eylem alanlarını birleştiren model, 5 temel GUI kıyaslama testinde GPT-5.6 Sol ve Opus 4.8’i geride bıraktı. (Kaynak: 36Kr)

Alibaba, Qwen-UI-Agent Temel Agent Modelini Açık Kaynak Olarak Sundu

Xiaohongshu, Birleşik Ses Üretim ve Düzenleme Modeli FireRedTTS3’ü Açık Kaynak Yaptı : Xiaohongshu, yeni nesil ses modeli FireRedTTS3’ü duyurdu. Bir öncü olan RedAE anlamsal olarak artırılmış sürekli temsiline dayanan model; 24 dil ve 21 Çince lehçesinde sıfır örnekli klonlama (zero-shot cloning), doğal dilde ses tasarımı ve hassas yerel ses düzenlemeyi tek bir modelde birleştiriyor ve Seed-TTS-Eval dahil dört ana açık kıyaslamada zirveye yerleşiyor. (Kaynak: JiQizhixin)

Xiaohongshu, Birleşik Ses Üretim ve Düzenleme Modeli FireRedTTS3'ü Açık Kaynak Yaptı

Replit, GPT-5.6 Luna Destekli Ücretsiz Modu (Free Mode) Tanıttı : Replit, OpenAI ortaklığıyla GPT-5.6 Luna tarafından desteklenen Free Mode’u kullanıma sundu. Dünya genelindeki tüm kullanıcıların etkileşimli AI programlama ve Agent uygulama geliştirmeyi ücretsiz olarak deneyimlemelerine olanak tanıyarak sıfırdan eksiksiz yazılım geliştirme eşiğini önemli ölçüde düşürdü. (Kaynak: amasad)

Replit, GPT-5.6 Luna Destekli Ücretsiz Modu (Free Mode) Tanıttı

Meta, Yerel Tam Modlu Büyük Modeli Muse Spark 1.2’yi Yayınladı : Meta, güçlü görsel kod üretimi, robot planlama ve ses-video anlama yeteneklerine sahip Muse Spark 1.2’yi resmi olarak yayınladı. Design Arena değerlendirmesinde Video-to-Website listesinde birinci sırayı ve Image-to-HTML sıralamasında üst sıraları elde ederek son derece güçlü tam modlu pratik değer sergiledi. (Kaynak: alexandr_wang)

Meta, Yerel Tam Modlu Büyük Modeli Muse Spark 1.2'yi Yayınladı

OpenAI, GPT-Image-2 Şeffaf Arka Plan Yerel Üretim Özelliğini Önizlemeye Açtı : OpenAI, GPT-Image-2 API’sinde background=transparent parametre önizlemesini sundu. Bu özellik, modelin üretim aşamasında alpha kanallı şeffaf PNG katmanlarını doğrudan üretmesine olanak tanıyarak cam şeffaflığı ve ince kenar dokuları gibi karmaşık detaylarda geleneksel son işleme dekupe yöntemlerini açık ara geride bırakıyor. (Kaynak: THE DECODER)

Adobe Firefly, Google Gemini Omni Flash’ı Entegre Etti ve AI Ses Araçlarını Kullanıma Sundu : Adobe, Firefly içerik oluşturma platformuna Google Gemini Omni Flash çok modlu video modelini entegre ettiğini duyurdu. Aynı zamanda ticari olarak güvenli üç AI ses üretim aracı olan Generate Music, Generate Speech ve Generate Sound Effects’i tam olarak kullanıma sundu. (Kaynak: THE DECODER)

Google, Mekansal Algılı Görsel Dil Modeli TIPS’i Yayınladı : Google, Hugging Face üzerinde görüntü bölümleme (segmentation) ve derinlik tahmini gibi yoğun görsel anlama görevleri için özel olarak tasarlanmış mekansal algılı görsel dil modeli TIPS’i (ve TIPSv2) açık kaynak olarak sundu. (Kaynak: gabriberton)

Google, Mekansal Algılı Görsel Dil Modeli TIPS'i Yayınladı

Runway, 16-bit HDR Video İyileştirme Modeli Ruby’yi Tanıttı : Runway, SDR videoların 16-bit HDR ProRes/EXR dizilerine dönüştürülmesini destekleyen Ruby video modelini sundu. Bu model, üretilen videoların ve yüklenen materyallerin renk derinliğini ve görüntü kalitesi performansını artırıyor. (Kaynak: c_valenzuelab)

NetEase Bee, AI Etkileşimli Toplulukları ve Yeni Nesil UGC Kaynaklarını Keşfediyor : NetEase Bee, açık kaynaklı ve kendi geliştirdiği modellerin AI yeteneklerini genç ilgi topluluklarına derinlemesine entegre ederek “Wannao Lobster” kişisel asistanı ile AI etkileşimli oyunlar/görsel-metin içeriklerini kullanıma sundu. Bu hamle, topluluk içerik biçimlerinin oynanabilir ve yeniden üretilebilir (co-creation) etkileşimli UGC’ye dönüşmesini teşvik ediyor. (Kaynak: 36Kr)

NetEase Bee, AI Etkileşimli Toplulukları ve Yeni Nesil UGC Kaynaklarını Keşfediyor

🧰 Araçlar

MiniMax, Video Üretim ve Oluşturma Platformu MiniMax Design’ı Yayınladı : MiniMax, ticari video üretimine yönelik MiniMax Design platformunu tanıttı. Agent’ı temel giriş noktası olarak kullanan platform; senaryo, storyboard, üretim, seslendirme ve kurguyu tek bir tuvalde birleştiriyor. Yeniden kullanılabilir Skill (yetenek) mekanizmasını tanıtan sistem, Adobe ve Canva’nın ticari video üretim süreçlerine doğrudan rakip oluyor. (Kaynak: 36Kr)

MiniMax, Video Üretim ve Oluşturma Platformu MiniMax Design'ı Yayınladı

DP Technology, Masaüstü AI Bilimsel Araştırma İş Birliği Ortamı “Bohr Science Space”i Yayınladı : DP Technology, masaüstü uygulaması “Bohr Science Space”i piyasaya sürdü. SciMaster, BioMaster ve PharmMaster gibi alana özel AI uzmanlarını bünyesinde barındıran uygulama; literatür araştırması, hipotez çıkarma, veri hesaplama ve makale yazımı gibi tüm süreçleri bağlayarak araştırmacıların angarya araştırma işlerini üstlenmelerine yardımcı oluyor. (Kaynak: QbitAI)

DP Technology, Masaüstü AI Bilimsel Araştırma İş Birliği Ortamı "Bohr Science Space"i Yayınladı

Lindy, Gelen Kutusunu Akıllıca Yönetmek İçin Chrome Eklentisini Sundu : AI Agent platformu Lindy, doğrudan Gmail gelen kutusuna entegre olan bir Chrome eklentisi yayınladı. Kişisel hafıza deposunu kullanarak gece gelen e-postaların özetlerini otomatik oluşturabiliyor, yanıtlar yazabiliyor ve otomatik etiket sınıflandırmasını tamamlayabiliyor. (Kaynak: omarsar0)

ChatGPT / Codex, ExaAI Arama Eklentisini Entegre Etti : OpenAI, ExaAI eklentisini ChatGPT Work ve Codex’e entegre ederek AI Agent’larının web üzerindeki 100 milyardan fazla web sayfasını, akademik makaleyi ve kurumsal belgeyi doğrudan aramasına olanak tanıdı. (Kaynak: OpenAIDevs)

OpenHistory, Mac Yerel İş Akışı Takip Uygulamasını Açık Kaynak Yaptı : Geliştiriciler, OpenHistory uygulamasını açık kaynak hale getirdi. Uygulama, cihaz içi Mac modellerini kullanarak çalışma süreçlerini otomatik olarak kaydedip özetler çıkarıyor ve güvenli MCP protokolü üzerinden yerel Agent’lar ile iş birliğini destekliyor. (Kaynak: zachtratar)

OpenBot, Çapraz Harness Grok Bot Alternatifini Açık Kaynak Olarak Sundu : CopilotKit ekibi, her türlü Agent Harness ile uyumlu bir Grok Bot alternatifi sunan OpenBot’u açık kaynak olarak yayınladı. Sistem; üretken UI, bilgisayar kontrolü, Agent-İnsan iş birliği ve özel veri saklamayı destekliyor. (Kaynak: hwchase17)

📚 Araştırma ve Öğrenme

Pleias Araştırmacıları 0.63M Parametreli Süper Mikro Doğrulayıcı (Verifier) Önerdi : Araştırmacılar doğrulayıcı modellerin alt ölçek sınırlarını araştırdı. Tek bir H100 üzerinde sadece 2 dakikalık ön eğitim gerektiren ve 630 bin parametreye sahip bu süper mikro model, belirli doğrulama görevlerinde 7B boyutundaki büyük modellerin performansına ulaşabildi. (Kaynak: Dorialexander)

Pleias Araştırmacıları 0.63M Parametreli Süper Mikro Doğrulayıcı (Verifier) Önerdi

Spark-to-Paper: Uçtan Uca Açık Kaynak Makale Üretim Sistemi : Araştırma ekibi, programlama asistanına dayalı açık kaynak makale üretim sistemi Spark-to-Paper’ı tanıttı. 13 birleştirilebilir yetenek içeren sistem, bir bilimsel fikirden yola çıkarak deneyleri otomatik çalıştırabiliyor, vektör grafikleri çizebiliyor, verileri doğrulayabiliyor ve derlenebilir düzeyde LaTeX makaleleri üretebiliyor; sahte sonuçları tespit etme oranı %92’ye ulaşıyor. (Kaynak: JiQizhixin)

Spark-to-Paper: Uçtan Uca Açık Kaynak Makale Üretim Sistemi

Zhejiang Üniversitesi ve Baidu, BEACON Uzun Döngülü Agent Takviyeli Öğrenme Çerçevesini Sundu (ICML 2026) : Zhejiang Üniversitesi ve Baidu, kilometre taşı güdümlü bir politika öğrenme çerçevesi olan BEACON’ı önerdi. Yörüngeleri kilometre taşı sınırlarına bölen ve çift ölçekli avantaj tahminiyle birleştiren yöntem, uzun döngülü Agent görevlerindeki kredi yanlış tahsis sorununu çözdü. ALFWorld uzun döngülü görevlerinde başarı oranını GRPO’nun %53.5 seviyesinden %92.9’a çıkardı. (Kaynak: JiQizhixin)

Zhejiang Üniversitesi ve Baidu, BEACON Uzun Döngülü Agent Takviyeli Öğrenme Çerçevesini Sundu (ICML 2026)

AutoResearch Değerlendirme Raporu: Agent’larda “Üstbilişsel Döngü” Eksikliği Bilimsel Araştırma Kararlarının Başarısızlığına Yol Açıyor : Stanford ve Prentis AI gibi kurumlar, 800 Agent araştırma yörüngesini inceledi ve başarısızlıkların %92.1’inin mühendislik dışı bilişsel ve mantıksal hatalardan kaynaklandığını buldu. Yörüngelerin %82.5’inde “sorunun farkına varılmasına rağmen düzeltilmemesi” şeklinde bir üstbilişsel kopukluk görüldü; bu durum otomatik araştırmanın basit mühendislik yürütmesinden derin karar alma süreçlerine geçişindeki darboğazı ortaya koyuyor. (Kaynak: JiQizhixin)

AutoResearch Değerlendirme Raporu: Agent'larda "Üstbilişsel Döngü" Eksikliği Bilimsel Araştırma Kararlarının Başarısızlığına Yol Açıyor

Patronus AI, FigmaTrace Tasarım Bilgisayar Kullanımı Veri Setini Açık Kaynak Yaptı : Patronus AI, UI/UX tasarımı alanına yönelik ilk Computer-use veri seti olan FigmaTrace’i açık kaynak yaptı. Veri seti, gerçek tasarımcıların Figma’daki 200 saatten fazla ve 3400’den fazla uzun dönemli karmaşık işlem yörüngesini içeriyor. (Kaynak: rebeccatqian)

LangChain Kurucusu, Managed Deep Agents Eğitim Serisini Yayınladı : Harrison Chase, derinden çalışan Agent Harness’larının ve yürütme ortamlarının üretim ortamında nasıl inşa edileceğini, dağıtılacağını ve yönetileceğini sistematik olarak açıklayan Managed Deep Agents video ve eğitim serisini yayınladı. (Kaynak: hwchase17)

LangChain Kurucusu, Managed Deep Agents Eğitim Serisini Yayınladı

Google, Pandora’s Router Akıllı Model Yönlendirme Teorisini Sundu : Google DeepMind ekibi, çoklu model yönlendirmesini bir “Pandora Kutusu” arama problemi olarak biçimlendirdi. Hesaplama değerlendirme maliyetlerini ve uzman kazanımlarını kapsamlı bir şekilde ele alan yaklaşım, tam arama kalitesini yakalarken yüksek maliyetli tahmincilerin çağrı sayısını önemli ölçüde azalttı. (Kaynak: dair_ai)

Google, Pandora's Router Akıllı Model Yönlendirme Teorisini Sundu

💼 İş Dünyası

GPT-5.6 Sol, OpenAI’ın Üçüncü Çeyrek Kurumsal Harcamalarını Çeyreklik %82 Artırdı : Ramp’ın en son verilerine ve analizlerine göre, GPT-5.6 Sol modelinin güçlü performansının etkisiyle OpenAI’ın 2026 yılı 3. çeyreğindeki kurumsal API harcamaları çeyreklik bazda %82 artış göstererek Anthropic’in %76’lık artışını geride bıraktı ve üçüncü çeyrek gelirlerini %35 artırdı. (Kaynak: THE DECODER, GavinSBaker)

GPT-5.6 Sol, OpenAI'ın Üçüncü Çeyrek Kurumsal Harcamalarını Çeyreklik %82 Artırdı

River AI, Cisco Investments’ın da Katıldığı 110 Milyon Dolar / 1,1 Milyar Dolarlık Finansman Turunu Tamamladı : Cisco Investments, kullanıcıların sahip olduğu bağımsız AI altyapısını ortaklaşa teşvik etmek amacıyla merkeziyetsiz kişisel AI girişimi River AI’ın 1,1 milyar dolarlık finansman turuna stratejik yatırım yaptığını duyurdu. (Kaynak: ibab)

Hark, AT&T Ortaklığıyla AI Destekli Tüketici Donanım Cihazını Piyasaya Sürdü : AI donanım girişimi Hark, ABD telekom devi AT&T ile stratejik ortaklık kurduğunu duyurdu. AT&T, Hark’a yatırım yaparak ağ ve cihaz sertifikasyon desteği sağlayacak; iki şirket birlikte yeni nesil yerel AI kişisel akıllı terminaller sunacak. (Kaynak: adcock_brett)

Hark, AT&T Ortaklığıyla AI Destekli Tüketici Donanım Cihazını Piyasaya Sürdü

🌟 Topluluk

Pangram Analizi: RLHF Eğitim Sonrası Korkuluklar “Mod Çökmesine” (Mode Collapse) Neden Oluyor ve AI Metinlerinin Tespit Edilmesini Kolaylaştırıyor : AI tespit kuruluşu Pangram, ince ayar yapılmamış temel büyük modellerin başlangıçta insanlarla kıyaslanabilir dil çeşitliliğine sahip olduğunu, ancak RLHF ve güvenlik korumalarının dayattığı davranış kurallarının mod çökmesine (Mode Collapse) yol açarak modellerin sabit ifade kalıplarını tercih etmesine neden olduğunu belirtti. Bu durum, aksine AI tarafından üretilen metinlerin yüksek hassasiyetle tespit edilmesinin ana özelliği haline geldi. (Kaynak: THE DECODER)

Pangram Analizi: RLHF Eğitim Sonrası Korkuluklar "Mod Çökmesine" (Mode Collapse) Neden Oluyor ve AI Metinlerinin Tespit Edilmesini Kolaylaştırıyor

💡 Diğer

JavaScript Çalışma Zamanı Bun 1.4 Kararlı Sürümü Yayınlandı (Tamamen Rust ile Yeniden Yazıldı) : Anthropic tarafından satın alındıktan sonra Bun, tamamen Rust ile yeniden yazılan Bun 1.4 kararlı sürümünü resmi olarak yayınladı. 2900’den fazla sorunu düzelten ve bellek sızıntılarını gideren sürüm; yerleşik görüntü işleme, tarayıcı otomasyonu ve HTTP/3 dağıtımı sunuyor. Aylık indirme sayısı 20 milyonu aştı. (Kaynak: 36Kr)

JavaScript Çalışma Zamanı Bun 1.4 Kararlı Sürümü Yayınlandı (Tamamen Rust ile Yeniden Yazıldı)

RayNeo, Hafif RayNeo iO AI Gözlüğünü Tanıttı : RayNeo, optik ve çerçeve formunu yeniden tasarlayan RayNeo iO AI gözlüğünü duyurdu. Ağırlığı 34 grama düşürülen cihaz, iki günlük pil ömrü ve miyop cam takma imkanı sunuyor. Tüm gün hafıza motoru ve DeepSeek V4 Pro / Qwen 3.7 Max gibi çoklu model altyapılarına dayanarak aktif bilgi, hafıza ve gerçek zamanlı çeviri geliştirmeleri sağlıyor. (Kaynak: QbitAI)

RayNeo, Hafif RayNeo iO AI Gözlüğünü Tanıttı

ABD-Çin AI Rekabeti Kızışıyor ve Pax Silica İttifakı Sınırları Belirleniyor : ABD, müttefiklerinden ABD-Çin AI yarışında açıkça taraf seçmelerini talep eden bir belge taslağı hazırladı. Çin Yapay Zeka İşbirliği Örgütü’ne (WAICO) katılan ülkeler Pax Silica İttifakı’nın dışında bırakılacak; bu durum, küresel AI altyapısı ve tedarik zincirindeki bölünmenin siyasi risklerini vurguluyor. (Kaynak: THE DECODER)

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir