🔥 Odak
OpenAI ve Anthropic, bilgisayar kullanım Agent’larını eğitmek için on binlerce Mac mini/Studio stokluyor : Birden fazla medya, OpenAI’nin on binlerce ekransız Mac mini ve Mac Studio satın aldığını, Anthropic’in ise AWS üzerinden benzer cihazlar kiraladığını doğruladı; amaç, computer-use ajanlarının pekiştirmeli öğrenmesi ve yörünge toplanması. Güdüler arasında macOS sanal makine lisansının Apple donanımına bağlı olması, unified memory’nin büyük modelleri yüklemeyi kolaylaştırması ve soğutmanın 7×24 tam yük GUI etkileşimine izin vermesi var; GPU ön-eğitiminin yerine geçmek değil. Yüksek konfigürasyonlu makineler bellek kıtlığı yüzünden aylardır stokta yok; Apple’ın o çeyrek Mac geliri yıllık yaklaşık %29 arttı. NVIDIA DGX Spark/RTX Spark masaüstü rakip olarak görülüyor; EXO kümeleri ve Mount Thor gibi Apple donanım bulutları da ısınıyor. Apple’ın kurumsal mühendislik ve geliştirici ilişkileri hâlâ zayıf; talep çoğunlukla üçüncü taraflarca karşılanıyor. (Kaynak: THE DECODER、量子位、机器之心、量子位/36氪)
AB, ChatGPT, Reddit ve Roblox’u çok büyük çevrimiçi platformlar olarak sınıflandırdı : Avrupa Komisyonu, ChatGPT vb. için Dijital Hizmetler Yasası’nın en sıkı yükümlülüklerinin geçerli olduğunu tespit etti; yasadışı içeriğin işlenmesi, reşit olmayanların gizliliği ve güvenliği korunmalı, ihlalde küresel cironun %6’sına kadar ceza. Bazı haberler aynı zamanda çok büyük arama motoru sayıldığını ve dört ay içinde uyumun sıkılaştırılması gerektiğini yazdı. Brüksel, sohbet AI’sını mevcut platform düzenlemesine alıyor; sıfırdan yeni bir rejim kurmuyor. (Kaynak: Ars Technica、kimmonismus)
İngiltere Merkez Bankası G20’yi uyardı: öncü AI küresel finansal istikrarı sarsabilir : İngiltere Merkez Bankası Başkanı ve Finansal İstikrar Kurulu Başkanı Andrew Bailey, G20 maliye bakanları ve merkez bankası başkanlarına yazdığı mektupta, öncü modellerin özerkliği, problem çözme ve saldırı yeteneğinin birlikte yükseldiğini; en doğrudan riskin siber saldırıların hızını, ölçeğini ve maliyetini değiştirmek ve yoğunlaşmış üçüncü taraf hizmet sağlayıcılar üzerinden sınır ötesi finans sistemine yayılmak olduğunu söyledi. Birçok yargı alanında ileri modellerin geliştirme, yayın ve dağıtım protokollerinin henüz olmadığını belirtti; AI iyimserliğinin değerlemeleri ve kaldıraçı şişirdiğini, şokların birden fazla kırılgan noktayı aynı anda tetikleyebileceğini uyardı ve küresel düzeyde güvenli, sorumlu yayın ve dağıtımı önceliklendirmeyi istedi. (Kaynak: The Guardian)
NHS denetimi: AI kâtipler ilaç adı ve tanıyı yanlış yazıyor, hastalar doktorlardan önce fark ediyor : Healthwatch England, dinleme transkripsiyon kazalarını açıkladı: MRI özeti “demiyelinizasyon yok”u demiyelinizasyon diye yazmış, reçete adı yakın sesli başka ilaca dönmüş, taburcu mektubunda aile hekiminden reçete yenileme atlanmış. İngiltere’de yaklaşık 27 kâtip kullanılıyor; on yıllık plan yükü azaltmayı umuyor ama MHRA bunları tıbbi cihaz saymıyor, ulusal birleşik güvenlik denetimi yok. Doktorlar hâlâ satır satır kontrol etmek zorunda; halüsinasyon, aksan, çok kişili konsültasyon ve karmaşık öykü birleşince hata oranı yükseliyor; araç henüz zaman tasarrufu vaadini tutmuyor. (Kaynak: The Guardian)
Google, Disney, Universal vb. ile karakter ve filmleri AI araçlarına lisanslamak için görüşüyor : Google, Hollywood stüdyolarını karakter ve film arşivlerini AI üretim ve VFX süreçlerinde lisanslamaya ikna etmeye çalışıyor; sendikalar telif, iş ve yaratıcı kontrol direnişi gösteriyor. Hollywood daha önce AI’ya dava açmıştı; “lisanslı işbirliği”ne dönüş, içerik ve model taraflarının müzakeresinin çatışmadan ticarete geçtiğini işaret ediyor. (Kaynak: The Verge)
🎯 Eğilimler
OpenClaw 2.0: rehberli kurulum, konsol yaklaşık 575ms açılış; bulut oturumları güvenlik sınırı değil : Yaklaşık yedi haftalık duraklamadan sonra şimdiye kadarki en büyük sürüm (yaklaşık 16 bin PR): rehberli kurulum yerel Codex/ChatGPT/Claude oturumunu, API Key veya Ollama/LM Studio’yu yeniden kullanıp önceden doğrulayabiliyor; Control UI sohbet merkezli, açılış yaklaşık 1.6s→575ms; oturumlar SQLite’a taşındı. Paylaşılan bulut oturumları ve eşleşmiş cihaz/Crabbox destekleniyor ama belgeler işbirliği yetkisinin kiracı izolasyonu ve güvenlik sınırı olmadığını yazıyor; Gateway varsayılanı loopback, güvenlik hâlâ araç onayı, sandbox ve eklenti beyaz listesine bağlı. Toplulukta heyecan düşüşü de var: kararlı sürüm yok, güncellemeler çok sık; bazı kullanıcılar Hermes’e veya kendi harness’ine kayıyor. (Kaynak: THE DECODER、MarkTechPost、机器之心、Reddit r/LocalLLaMA)
DeepSeek-V4-Flash-Vision-Exp yayında ve ağırlıklar açık kaynak : DeepSeek, API ve Hugging Face’te deneysel çok kipli sürümü yayınladı; metin tarafının (Agent, muhakeme ve dünya bilgisi dahil) V4-Flash ile hizalı olduğunu, çok kipli Agent kıyaslarında belirgin sıçrama olduğunu iddia etti. App tarafında Vision’a işaretleme, hazır sorular ve arka plan görsel arama eklendi. Yerel topluluk tam hassasiyetin yaklaşık 168GB, yerel 4bit’in 256GB bellekli makineler için uygun olduğunu ve görsel ile yapılandırılmış çıktı taşıdığını söylüyor. (Kaynak: huggingface、Reddit r/LocalLLaMA)
Qwen Creation, Agent Teams’i açtı; Wan 3.0 ile çok meslekli kısa dizi hattı : Kullanıcı tek cümleyle senarist, yönetmen, sanat, storyboard, kurgu vb. Agent’ları çağırıyor; ara ürünler incelenebilir sahne metni, karakter varlıkları ve çekim prompt’ları. Testlerde senaryodan filme gidilebiliyor ama çekim kalitesi üretim öncesi insan onayı ve sonrası yerel rötuş istiyor. Alibaba Wan aynı zamanda karakterler arası çekim, 30 saniyelik tek plan reklam ve görselden video gösterdi ve Buzzy’de süreli sınırsız üretime girdi; rekabet tek çekim kalitesinden tüm yapım hattını aynı bağlama toplamaya kayıyor. (Kaynak: 机器之心、Alibaba_Wan)
Didi’nin yeni nesil Robotaxi R2’si Pekin ve Guangzhou’da insansız yolcu testine başladı : GAC Aion ile ortak özel model 33 sensör ve üç alanlı füzyon hesaplama taşıyor; arka sıra büyük ekran ve ses etkileşimi kabin deneyimini vurguluyor; Çin-Avrupa çift beş yıldız ve çoklu yedeklilik iddiası var. Hâlâ gösterim bölgesi testi; güvenlik ve ölçekli işletme verileri açıklanmadı. (Kaynak: 量子位)
Ropedia HOMIE Gen2’yi yayınladı: insan deneyimini eğitilebilir Physical AI verisine çeviriyor : Yaklaşık 380g kafa takımı yaklaşık 13 saat topluyor; 4 kameralı 360° artı uzamsal ses, çok kipli hizalama aynı uzay-zamana. Konum hatası yaklaşık binde iki, el motion capture yaklaşık 4.68mm iddiası. Yol, “gövdesiz toplama” ile kapasiteyi robot stokundan insan sayısına çözmek; Xperience veri seti ve işleme hattı eşlik ediyor. (Kaynak: 机器之心)
Caterpillar maden otonom deneyimini şantiye ve satış sonrası AI asistanına taşıyor : Caterpillar, maden kamyonu ve matkap otomasyon deneyimini daha dinamik şantiyelere uyguluyor ve teknisyenlere sesle bakım sürecini çağıran Cat AI Assistant sunuyor; yaklaşık 1.6 milyon varlık ve 16PB yapılandırılmış veri bağlantısı iddiası. CTO, zorluğun model yapmak değil iş akışını değiştirmek olduğunu vurguladı; şirket beş yılda çalışan eğitimi için yaklaşık 100 milyon dolar planlıyor. (Kaynak: TechCrunch)
Meta Pocket, “tek cümleyle küçük oyun”u sosyal akışa çevirdi : Gizmo ekibini satın aldıktan sonraki mobil uygulama, kullanıcıların kod görmeden oynanabilir gizmo üretmesine ve kısa video kaydırmasıyla paylaşmasına izin veriyor. Prototip hızlı ama eserler Meta duvarının içinde kilitli; bağımsız ürüne dışa aktarmak zor. (Kaynak: Ars Technica)
Google EnvHarness: sarmalayıcı, statik değerlendirme ortamını politikaya göre zorlaştırıyor : Google Cloud AI Research vb. EnvHarness’i açık kaynakladı; yalnızca reset()/step() ile başlangıç durumu, eylem ve gözlemi değiştiriyor, insan doğrulayıcıyı koruyor. EnvRigger politika yörüngelerinden zayıflıkları teşhis edip Python sarmalayıcı yazıyor; beş kıyasta beceri madenciliği en fazla +9.0 OOD, SWE-bench Verified adım sayısı yaklaşık %9.8 az. Önkoşul ortamın sıfırlanabilir olması; gerçek hesaplar ve fiziksel robotlar hariç. Apache-2.0 kodu yayında. (Kaynak: MarkTechPost)
Google Assistant 4 Eylül’de duruyor, uyandırma sözcüğü Gemini’ye geçiyor : On yıldır çalışan Google Assistant 4 Eylül’de duracak; telefon, saat, kulaklık ve Android Auto birlikte Gemini’ye geçecek. Emeklilik birkaç kez ertelenmişti. Analiz, sesin Agent’ın sahaya inmesinden önceki en az eforlu ara katman olduğunu, kararın hâlâ kullanıcının ağzında kalması gerektiğini söylüyor. (Kaynak: 36氪)
Anthropic, çalınan oturumları ele geçiren truva atı ile kaçırılan Claude oturumlarını zorunlu kapatıyor : Resmi e-posta, Vidar, Lumma, StealC, RedLine, Acreed ve Mac tarafı AMOS gibi truva atlarının tarayıcı Session’ını çaldığını, şifre ve 2FA’yı atlayarak kotayı çaldığını ve API aktarımı açabileceğini söylüyor. Kullanıcı kota tükenmesi, yabancı İngilizce kod kayıtları, oturumdan atılma, bağlı kartın boşalmasını görebiliyor. Yalnızca şifre değiştirmek yetmez; tüm oturumlar iptal edilmeli ve Cookie temizlenmeli; korsan yazılım yaygın bulaşma kaynağı. (Kaynak: 新智元)
Kurumsal Agent güvenliği: önce kimlik ve vekâlet bağlamı; ağ geçidi beşinci kapı olmalı : Sektör yazıları LiteLLM vb. ağ geçidi açıklarının CISA’nın bilinen istismar kataloğuna girdiğini, çoğu ekibin hâlâ ağ geçidini birinci hat sandığını belirtiyor. Etkili sıra: adlandırılabilir Agent listesi ve sorumlu → bağımsız kimlik artı vekâlet görevi → kısa süreli görev düzeyi kimlik bilgisi → geri alınabilir uçtan uca telemetri → sonra çalışma zamanı kesme ve sistemler arası sigorta. Teleport araştırması aşırı yetkili örgütlerde kaza oranının yaklaşık %76, en az yetkide yaklaşık %17 olduğunu söylüyor. Kimlik doğrulama geçilse bile hedef kayması, aşırı araç çağırma ve bellek zehirlenmesi mümkün. (Kaynak: VentureBeat)
Musk, SpaceX’in doğal gaz üretim döngüsünü kısaltmak için türbin kanadı dökümünü kendi kurduğunu doğruladı : Veri merkezi elektrik darboğazına karşı Musk, kanat dökümünün gaz türbini kapasitesinin tıkanma noktası olduğunu, SpaceX’in Texas’ta kendi dökümünün ünite devreye almayı en fazla yaklaşık 18 ay öne çekebileceğini; SpaceX ve Tesla’nın her birinin yılda 100GW güneş planladığını söyledi. Eleştiri, gazı hızlandırmanın daha fazla emisyon demek olduğunu, Memphis vb. yerlerde izin ve sağlık zararı tartışması olduğunu belirtti. (Kaynak: TechCrunch)
ABD drone ve ileri robot ithalatını sıkılaştırıyor; Çin hâlâ ölçek avantajını elinde tutuyor : Washington ulusal güvenlik gerekçesiyle yabancı ileri robotlara kısıt ve ithal drone ile parçalara yüksek tarife koyuyor. Analiz, bunun Çin’in insansı robot sevkiyatı ve maliyet eğrisindeki önderliğini tersine çevirmesinin zor olduğunu; küresel pazarın “güvenlik-uyum pazarı vs düşük maliyet ölçek pazarı”na parçalanmasının daha olası olduğunu, Japonya/Kore/Tayvan’ın ara bölge olabileceğini söylüyor. (Kaynak: TechCrunch)
Tencent CubeSandbox 0.7: sandbox makineler arası duraklatılıp uyandırılabiliyor : Tek makinede soğuk açılış hâlâ yaklaşık 60ms; küme önizlemesi bir makinede duraklatıp diğerinde uyandırmayı destekliyor, durum paylaşılan depolamada; makine boşaltırken duraklatılmış görevler öldürülmüyor. 239 commit, 57 katkıda bulunan; Agent sandbox’ını tek makineden zamanlanabilir kümeye taşımayı hedefliyor. (Kaynak: ziran_pu)
GLM-5.3 nicemleme onarımı ve MXFP4 : DGX Spark’ta eski ModelOpt nicemlemesinin token’ları sessizce bozduğu ve tool-call’ı kestiği (vLLM #54150 ile ilişkili) söylendi; RedHatAI compressed-tensors’a geçildi. Vietnam One Nexus, GLM-5.3/Flash için MXFP4 yayınladı; Together, Flash’ın yaklaşık 17 kat daha ucuz, 5.3’ün tek sefer başarı oranının daha yüksek olduğunu söyledi. (Kaynak: ziran_pu)
Qwen 3.8 “insan okuyamıyor” diye eleştirildi : LocalLLaMA kullanıcıları 27B ve Flash-Next’in küme sembolleri, persona vb. sık yazım kullandığını, “birim zekâ başına token”ı düşürmek için okunabilirliği feda ettiğini; Agent RL’nin dil modelini “modele bakılan lehçe”ye pişirdiği yorumunu yaptı. (Kaynak: Reddit r/LocalLLaMA)
KCD2 yönetmeni sızdırılmış DLSS 5’i denedi: geometriyi değiştirmek değil ışık gölgeyi tamamlamak : Kingdom Come: Deliverance 2 yönetmeni Daniel Vavra, sızdırılmış NVIDIA DLSS 5’in karakter geometrisini yeniden çizmediğini, mevcut veriyle yüz derisi, ortam oklüzyonu, şapka kenarı ve saç gölgelerini güçlendirdiğini, orijinal sanat niyetine daha yakın olduğunu söyledi. Yorumlar, geliştiricilerin ileride “sonradan sihir”i işçilik kısma düğmesi yapmasından endişe etti. (Kaynak: Reddit r/ArtificialInteligence)
🧰 Araçlar
Perplexity Portable Computer: Qwen3.8-27B için yerelde öncelikli özel Harness : Varsayılan model, yörünge ve dosyalar yerelde kalır; arama ve bulut danışman isteğe bağlı yükseltilir. Küçük modeller için sistem prompt kısaltılır, MCP CLI’ye çevrilir, sandbox ve öz-doğrulama zorunlu. DGX Spark’ta BrowseComp yaklaşık %66.7; danışman yükseltmesinden sonra Terminal-Bench 2.1 yaklaşık %59.6’dan %73.0’e. Son eğitim PPLX 27B kendi iç bilgi çalışma tezgâhında yaklaşık %85.4. (Kaynak: 机器之心)
ChatGPT Work aslında bulut görev sistemi: ağlı kod yorumlayıcı, başsız Chrome, kalıcı disk ve dağıtılabilir siteler : Simon Willison ücretli Work katmanını ayırdı: isteğe bağlı Sol/Luna/Terra ve muhakeme katmanı; varsayılan neredeyse açık çıkışlı kod ortamı; tam Chrome form doldurabilir, 2FA kullanıcıda kalır modele gitmez; /workspace oturumlar arası kalıcı; Cloudflare Workers ile ChatGPT Sites yayınlanabilir. Yazar, özel veri, güvenilmeyen web ve dışarı kanalın “ölümcül üçlüsü”ne sahip olduğunu, güvenlik ayrıntılarının hâlâ opak olduğunu uyardı. ZDNET testi iş saati kazandırabileceğini ama mutlaka gözden geçirme gerektiğini, yetki bitince kapatıldığını yazdı. (Kaynak: Simon Willison、ZDNet)
Cisco yaklaşık 90 bin çalışana kişisel Agent MyAgent’ı sunuyor : İç platform Circuit üzerinde MyAgent, 800’den fazla uzman Agent’ı bağlayan genel zamanlayıcı; isteklerin yaklaşık %50–60’ı açık ağırlık, %20–30’u geleneksel otomasyon, azı dış büyük modele gidiyor. Çalışan adım adım komut değil hedef veriyor; Outlook, Webex, Jira, SharePoint koordine edilip arka planda devam edebiliyor. (Kaynak: InfoQ)
Archify: tek cümleyle depoyu etkileşimli mimari diyagrama çeviriyor : Açık kaynak Agent Skill, Claude Code, Codex, Cursor vb. için koddan JSON IR üretip aranabilir, çağrı zinciri izlenebilir HTML diyagram render ediyor. Sınır: doğruluk hâlâ Agent analizine bağlı, kota tüketimi yüksek. (Kaynak: 量子位)
Doubao Work bağımsız yayında; ByteDance ofis Agent’ını B tarafı girişine topladı : ByteDance bağımsız ürün 「Doubao Work」ı yayınladı ve Feishu ile entegre etti; aynı dönemde TRAE ve Coze ekipleri Doubao sistemine katıldı. Skill PPT, tutanak, haber yakalama için otomatik eşleşebiliyor; ince yazı stili ve olgu kontrolü hâlâ zayıf. (Kaynak: 新博弈)
Circleback toplantı tutanağı ücretsiz katman açtı : YC toplantı kaydı ürünü sınırsız transkripsiyon açtı ama geçmiş yalnızca 30 gün; tam entegrasyon ve MCP ayda yaklaşık 14 dolardan. 8 kişilik ekip, kişi başı yıllık cironun 1 milyon doları aştığını iddia ediyor; ücretsiz katmanı reklam yerine müşteri çekmek için kullanıyor. (Kaynak: TechCrunch)
Sonar Vortex: semantik grafik gezinmesi Agent kod arama maliyetini düşürüyor : Önceden sınıf/yöntem/alan/arayüz ilişki grafiği kuruluyor; Agent doğrudan “kim arayüzü uyguluyor, kim bu yöntemi çağırıyor” diye sorabiliyor. 6 gerçek görev, 4 dil, her biri 10 çalıştırmada maliyet düşüşü yaklaşık %5–36 (Java arayüz değişikliği en yüksek yaklaşık %36). (Kaynak: TheTuringPost)
llmprobe 0.6.0: motorlar arası nicemleme/regresyon sondası : npx [email protected] --eval antirez tarzı değerlendirmeyi chat completions/responses/messages’a bağlayıp herhangi bir çıkarım motoruna regresyon raporu basmayı kolaylaştırıyor. (Kaynak: QuixiAI)
📚 Öğrenme
AI4X 《Agentic çağında üretkenlik》: verimlilik×genişleme ve dört aşamalı vekâlet : Fudan vb. 12 kurumun 68 sayfalık derlemesi, Agent’ın hem genellik hem özerklik taşıdığını; üretkenliğin eski görev maliyetini sıkıştırmak ve aslında yapılmayan işi açmaktan geldiğini söylüyor. Sektör sohbet asistanı→tepkisel yürütme→uyarlanabilir koordinasyon→özerk sistem diye katmanlanıyor; yayılma derinliği dijitalleşme, doğrulanabilir geri bildirim, hata toleransı, parçalanabilirlik ve sorumluluk atamasına bağlı, sıralama puanına değil. (Kaynak: 机器之心)
LDM: üretici model arama uzayını genişletir, Gauss süreci sonraki deneyi seçer : UCL Wang Jun ekibi bilimsel keşfi hızlı döngü (deney sonrası bağlam güncelleme) ve yavaş döngü (yüksek toplama fonksiyonu yörüngelerini parametrelere damıtma) olarak yazdı. NanoGPT ayar, antikor CDRH3 ve molekül çift hedefte, salt LLM yansımaya göre sırasıyla yaklaşık 2.4 kat BPB düşüşü, bağlanma enerjisi yaklaşık %18.2 düşüş, hipervolüm %60’tan fazla artış. (Kaynak: 机器之心)
AI4AI: güçlü model zayıfı eğitmez, yalnızca Harness tasarlar : Salesforce ve UIUC, Builder’ın %5 doğrulama setinde GPT-5.4-mini için otomatik iskele kurmasına izin verdi; zihin kuramı görevlerinde ortalama doğruluk 0.488’den en iyi 0.912’ye. Etkili araçlar deterministik çözücü ve durum takibi; daha uzun düşünce zinciri değil. (Kaynak: 机器之心)
AQuA: nicel araştırma Agent’ı “kanıt belleğe, değerlendirici kilitli” : Princeton, Ant Group ve Stanford faktör ve model için iki bağımsız döngüye ayırdı; Agent’ın veri yolunu ve nihai test setini değiştirmesini yasakladı. Kripto beş dakikalık kombinasyon doğrulamasında Spearman IC yaklaşık 0.190; ABD hissesi 30 dakikalık tahminde hisse başı IC yaklaşık +0.0843, 2bps sonrası örnek dışı Sharpe en yüksek yaklaşık +2.50. Erken ileri bakış sapması kazaları tam açıklandı. (Kaynak: 量子位)
MIT CrysVCD: üretmeden önce değerlik ve yük dengesini sağla : Dil modeli oksidasyon durumuna göre formül üretir, ardından difüzyon modeli yapı büyütür; mekanik kararlı yaklaşık %68, yarı kararlı yaklaşık %85; yüksek ısıl iletkenlikli GeC vb. adaylar. Pahalı kararlılık elemesini öne alır. (Kaynak: MIT News)
VibeGame: Agent için duraklatılabilir, tam metin oyun motorunu yeniden kuruyor : Nanjing Üniversitesi ve NTU, Prompt-to-Game için 8 karşıt rol kullanıyor; motor durumu tamamen JSON, kare kare işlem enjekte edilebilir. Deney iskelet/bileşen/sözleşmeye çöker, ağırlık güncellenmez. (Kaynak: 机器之心)
TailSFT: SFT yalnızca “henüz öğrenilmemiş kuyruğa” vurur, sonra RL : Microsoft çalışması standart SFT’nin zaten oturmuş dizilerde gradyan harcayıp sonraki RL keşfini daralttığını savunuyor. OLMo-3 7B’de coding pass@16 en fazla yaklaşık +16.8, matematik +3.1; ardından GRPO pass@1 en fazla yaklaşık +3.9. (Kaynak: dair_ai)
NPO: tek soy prompt optimizasyonu, bütçe GEPA’ya yakın : Her turda mevcut prompt ile öğrenci çalıştırılır, yakın yörüngeler öğretmene yeniden yazdırılır; aday havuzu ve arama ağacı yok. Talimat izleme kıyasında rollout yaklaşık 3500/6800, GEPA’ya yakın. (Kaynak: omarsar0)
SWA+sinks, son eğitim doğrusal dikkatle kapışıyor : Makale, kayan pencere artı sinks’in birçok aşağı akışta son eğitim doğrusal dikkattan geri kalmadığını; Needle/BABILong vb. uzun bağlam muhakemede 2–10 kat yüksek olabileceğini, son eğitim gerekmediğini, daha hızlı ve bellek tasarruflu olduğunu söylüyor. (Kaynak: iScienceLuvr)
BIT: çift yönlü görsel-metin difüzyon köprüsü, Gauss gürültüsünden başlamak zorunda değil : BIT metinden görsele interpolasyon yapar, kaynak-farkında örnekleme yolu sunar ve görsel→metin ters gezintiyi destekler. (Kaynak: iScienceLuvr)
LaGSplat: saniyeler içinde tek göz video ile Lagrange öğrenir, hiç ölçülmemiş kuvvet uygulanabilir : Aynı gizli değişken q hem Gauss’u hem hareket denklemlerini sürer; görsele tıklamak kuvvetle ilgili Jacobian’a dönüşebilir. (Kaynak: andrew_n_carr)
LangGraph 《Deep Agents from Scratch》 beş derslik defter : ReAct’ten TODO planlamaya, sanal dosya sistemiyle bağlam boşaltmaya, alt Agent vekâletine. (Kaynak: hwchase17)
Entropic Scree: karşılıklı bilgi ile kirli tabloda gerçek sinyal var mı teşhis eder : Dönüştürülmüş karşılıklı bilgi ile sinyal hacmi, SNR, öz-rank vb. tahmin eder; PCA’dan daha az parametre ve mesafe varsayımına bağlı olduğunu iddia eder. (Kaynak: Reddit r/MachineLearning)
💼 Ticaret
Barclays: model şirketlerinde her 100 dolar gelirin yaklaşık 35–40 doları üç büyük buluta gidiyor : Rapor, ücretli çıkarım kâr marjının 2025 düşük çift haneden 2026’da yaklaşık %50–65’e çıktığını tahmin ediyor; laboratuvar A (API ağırlıklı) ile laboratuvar B (abonelik ağırlıklı) düzeltilmiş brüt marj farkı yaklaşık 17 puan olabilir. Bulut tarafı faaliyet marjı yaklaşık %35–45. 2028’den itibaren laboratuvarların kendi özel hesaplama gücünün devreye gireceği, AWS/Azure/GCP payının gerileyebileceği öngörülüyor. (Kaynak: 财联社)
ChatGPT Ads 200 günden az sürede yıllık yaklaşık 1 milyar dolar : Haber, reklamın 40’tan fazla ülkeyi kapsadığını ve self-servis yayın açıldığını; AB’nin ChatGPT’yi DSA’nın en sıkı yükümlülüklerine almasıyla karşıtlık oluşturduğunu yazdı. (Kaynak: TheZachMueller)
Together AI, Suudi Humain ile yaklaşık 250MW veri merkezi işbirliği : The New York Times, tesisin kamuya açıklananlar arasında açık kaynak modellere özel daha büyük kampüslerden biri olacağını yazdı. (Kaynak: togethercompute)
🌟 Topluluk
Claude güvenlik düşürmesinden sonra geliştiricinin yaklaşık 700GB ana dizinini yanlışlıkla sildi : Kullanıcı modelden /tmp sandbox temizleme betiği yazmasını istedi; hassas silme karşıt incelemeyi tetikledi, model Fable’dan Opus 4.8’e düştü. Test ana dizinin silinemeyeceğini saptadı ama geçici dosyaları temizlerken ana dizini gösteren değişkeni yeniden kullanıp silmeyi çalıştırdı. Topluluk “yüksek riskte zayıf modele geç”in yol ve kapsam ayrıntılarında daha kolay hata yaptığını düşünüyor; bazıları düşürmede oturumu durduran hook yazdı. (Kaynak: 机器之心、机器之心/36氪)
Sigorta hasar uzmanı Glassdoor’da AI’dan en nefret eden meslek; bahsedenlerin %98’i olumsuz : WIRED, Glassdoor’a atıfla uzmanların yöneticilerin hataya açık AI’yı müşteriye dayattığını, ilk rapor yanlış sınıflandırma ve özet halüsinasyonunun suçu onlara yıktığını yazdı. ABD’de meslek istihdamı bir yılda yaklaşık %21 düştü, giriş işleri yarıya indi. Pratisyenler idarenin kullanılabileceğini, hasar tespiti ve empatinin anahtar teslim verilemeyeceğini düşünüyor. (Kaynak: WIRED)
GrokBot mühendisi: uyurken 20 PR kendiliğinden ana dala birleşti : Lauren Tan, 20’den fazla GrokBot artı kendi pstack ile ayda binlerce PR teslim ettiğini söyledi. Anahtar prompt değil doğrulama: Agent’ın uygulamayı kendisinin ayağa kaldırması, UI’ya tıklaması, performansı yakalaması; incelemede tekrarlanan yasakların lint/CI kırmızı ışığına yazılması. (Kaynak: 新智元)
Kişileştirme dili savaşı: uygarlık/fedakârlık vs paylaşılan önbellek ve ödül fonksiyonu : Dwarkesh anlatısı fermente olmaya devam ediyor. Anil Seth, Amjad Masad vb. “uygarlık, ölüme gitme, heyecan”ın yazılımı canlı gibi anlattığını eleştirdi; hizalama çevresi niyet duruşunun CUDA okumaktan davranış tahmininde daha iyi olduğunu savundu. Artış söylem savaşında, yeni teknik olguda değil. Qwen3.8 Max’in Grug tarzı CoT’u Agent’ı tehlikeli ekoloji veya laboratuvar hayvan sürüsü gibi görüyor: “dil onların eli”. (Kaynak: dearmadisonblue、aiamblichus)
Gavin Baker fikir değiştirdi: iyi yapılandırılmış veri merkezi ABD için net pozitif : 18 ay önceki su, elektrik fiyatı, kasaba etkisi endişelerinin makul olduğunu kabul etti ama kapalı döngü soğutma, emlak vergisi, mavi yaka sürekli işletme, büyük kullanıcıların kendi güç ve batarya geri beslemesinin gerçeği değiştirdiğini söyledi. Kamuoyu “inşa edilmeli mi”den “sözleşme nasıl yazılır ki maliyeti sakinlere yığılmasın”a kayıyor. (Kaynak: GavinSBaker)
Vibe Coding hâlâ “ne değişecek”e göre modül ayırmalı : Baoyu vb. özetledi: mimari katmanlama, test onarımla birlikte, özellik silinince kod da silinsin, CI temiz makinede geçsin, tekrarlayan iş skill olsun. Modüller ödeme kanalı, indirim kuralı gibi değişim eksenine göre kesilsin; bir talep yalnızca bir modülü hareket ettirsin. (Kaynak: dotey)
Boş prompt “bir kadın” hâlâ aynı influencer yüzüne yakınsıyor : Kullanıcı yepyeni sohbette tekrar tekrar “Generate an image of a woman” üretti; kompozisyon ve yüz hatları yüksek oranda aynı, vektör uzayında varsayılan çekici gibi. (Kaynak: Reddit r/ChatGPT)
Doktora, Claude Code ile deney iskelesi yazdıktan sonra “kendi kod tabanına sahip değil” : NLP yorumlanabilirlik doktoru iskele, veri yükleme, hata ayıklama ve çizimi Claude Code’a verdi; çıktı arttı ama sonuç yanlış olunca başkasının deposunu okur gibi sayılardan geri gitmek zorunda. Bazıları değerlendirme ve metriklerin asla dış kaynaklanmamasını savunuyor. (Kaynak: Reddit r/MachineLearning)
ChatGPT galerisi “göndermediğin” fotoğrafları bırakıyor : Plus kullanıcıları görsel seçtikten sonra gönderimi iptal veya tüm sohbeti silseler bile orijinalin galeriye girdiğini, ayrıca silmek gerektiğini; geri dönüşüm kutusunun yaklaşık 30 günde tamamen temizlendiğini keşfetti. Öz: seçmek yüklemektir. (Kaynak: Reddit r/ChatGPT)
Max’in “20x Pro”su çoğunlukla beş saatlik pencere çarpanı; haftalık kota yaklaşık 2–2.5 kat : Ağır kullanıcılar $100 ve $200 katmanını karşılaştırdı: reklam 20x yalnızca nadiren çarpılan 5 saat penceresinde işliyor; asıl önce çarpan haftalık limit, yaklaşık 2–2.5 kat kullanım için 4 kat para. (Kaynak: Reddit r/ClaudeAI)
💡 Diğer
Dünya modeli dört yol paralel: piksel üretimi, 3D yeniden inşa, JEPA gizli uzay, dil füzyonu : Bağımsız değişken WALL-SS, Qunhe Lux3D, BAAI Orca, Yann LeCun AdaJEPA, Fei-Fei Li Marble aynı ay yoğun yayınlandı ama akademide “dünya modeli”nin birleşik tanımı yok. Yollar birbirini tamamlamaya daha yakın; tek evin her şeyi yutması değil. (Kaynak: 铑科技)
Bedensel fabrikaya giriş: iş yapabildiği kanıtlandı, her gün iş yeni başlıyor, hesap neredeyse kimse kapatamadı : Foton Cummins vb. fabrika testleri taşıma temposunun hatta yaklaşabildiğini ama başarı oranı, ömür ve verinin hâlâ sert eşik olduğunu gösterdi; becerikli el sürekli iş ömrü haftalarla ölçülüyor. Liderler çoğunlukla ikinci-üçüncü adımda takılı; ticari döngü henüz yok. (Kaynak: 科创日报)
Kore AI for All: SKT, Kakao, KT ulusal ücretsiz sınırsız ihalesini kazandı : Plan 9–10 ay Beta, yıl sonundan önce resmi; hesaplama gücünü devlet, model ve uygulamayı yerli firmalar verir; sağlık, konut, vergi, eğitime bağlanır. Motif vb. seçilmeyince chaebol kilidi tartışması çıktı. (Kaynak: kimmonismus)