Clay Mathematics Institute Resmi Konfirmasi Solusi Masalah… | Berita AI 2026-09-15

🔥 Fokus Utama

Dinamika Politik-Bisnis Global seputar “Batas Kecepatan” AI: Penolakan Keras Politisi AS-Eropa, Tiongkok Dorong Ekosistem Open Source, Altman dan Nadella Angkat Bicara : Menanggapi usulan dari Anthropic, OpenAI, Elon Musk, dan pihak lainnya untuk memperlambat riset dan pengembangan frontier AI, lanskap politik dan bisnis global mengalami guncangan hebat. Media pemerintah Tiongkok dan juru bicara Kementerian Luar Negeri menolak narasi pembatasan kecepatan ini sebagai “skenario Perang Dingin untuk menciptakan kepanikan dan menekan perkembangan teknologi negara lain”, serta mendorong ekosistem AI yang inklusif, aman, dan berpusat pada open source di KTT BRICS; dunia politik AS juga bereaksi cepat, dengan Trump yang secara tegas menolak perlambatan saat berada di Irlandia, menekankan bahwa persaingan AI adalah “winner-takes-all” dan AS tidak boleh melepaskan posisi kepemimpinannya. David Sacks, Co-Chair White House President’s Council of Advisors on Science and Technology, secara langsung mengkritik usulan pembatasan tersebut sebagai “kartel industri dan regulatory capture yang berkedok moralitas”. Menghadapi kritik, Sam Altman mengklarifikasi lewat postingannya bahwa “pacing sama sekali bukan stagnasi”, intinya adalah memperkenalkan safety use case eksplisit dan memperketat pengawasan sebelum pelatihan frontier RL, bukan menunggu pembebasan antimonopoli; CEO Microsoft Satya Nadella juga menegaskan bahwa regulasi dan audit tidak boleh dimonopoli oleh segelintir lab saja, melainkan harus memastikan ekosistem open source dan closed source berkembang bersama serta menjamin kedaulatan model bagi enterprise (Sumber: The Verge, THE DECODER, WIRED, The Guardian, teortaxesTex, sama, NandoDF)

Dinamika Politik-Bisnis Global seputar Batas Kecepatan AI

Clay Mathematics Institute Resmi Konfirmasi Solusi Masalah Navier-Stokes Telah Masuk Tahap Peer Review Formal : Clay Mathematics Institute (CMI), yang memegang wewenang evaluasi atas tujuh Millennium Prize Problems, secara resmi merilis pernyataan yang mengonfirmasi bahwa masalah eksistensi dan kehalusan (smoothness) persamaan Navier-Stokes “tampaknya telah terpecahkan (apparently been settled)”, dan materi pembuktian mesin terkait sedang menjalani peer review yang komprehensif dan ketat sesuai prosedur yang ditetapkan. CMI menekankan bahwa nilai dari masalah besar tidak hanya terletak pada kesimpulannya, tetapi juga pada kemunculan ide-ide matematis dan alat-alat teoretis baru. Meskipun alat verifikasi formal telah mempercepat proses secara signifikan, komite akademik akan tetap mempertahankan evaluasi yang hati-hati dan tidak tergesa-gesa. Penegasan resmi ini menandai bahwa eksplorasi sains teoretis tingkat tinggi berbasis AI telah secara resmi melewati ambang batas inisiasi lembaga akademik otoritatif (Sumber: THE DECODER)

Independensi Lembaga Audit Pihak Ketiga Dikecam secara Kolektif, Rantai Kepentingan METR Picu Krisis Kepercayaan : Setelah lab-lab terkemuka mengumumkan pembukaan akses audit residen tingkat karyawan kepada METR, komunitas teknologi melancarkan reaksi keras. David Sacks, Lina Khan, dan sejumlah pakar keamanan menunjukkan bahwa personel inti dan jaringan pendanaan METR terikat erat dengan Anthropic dan lingkaran Effective Altruism (EA), di mana apa yang disebut sebagai regulasi sukarela sebenarnya merupakan tindakan rent-seeking untuk menghindari hukum tanggung jawab produk dan menaikkan batas masuk industri. Selain itu, METR terungkap pernah mengalami celah keamanan akibat kebocoran API key yang menyebabkan penyalahgunaan kuota senilai 600.000 dolar AS, sehingga profesionalisme dan netralitasnya sebagai “wasit industri” dipertanyakan secara kritis (Sumber: ClementDelangue, nptacek)

Kontroversi Independensi METR

Seruan Perlambatan AI oleh Raksasa Teknologi Picu Anjloknya Saham Teknologi Asia-Pasifik, Utang Infrastruktur AI dan Belanja Modal Hadapi Evaluasi Ulang : Terpengaruh oleh penundaan IPO OpenAI dan seruan “pembatasan kecepatan frontier” oleh berbagai lab besar, sektor AI dan semikonduktor Asia-Pasifik kompak melemah. SoftBank Group anjlok hampir 12% dalam sehari, indeks KOSPI Korea Selatan turun lebih dari 3%, serta raksasa pengecoran chip dan memori hulu seperti SK Hynix dan TSMC mengalami penurunan signifikan. Analis menunjukkan bahwa pasar sedang mengevaluasi kembali keberlanjutan belanja modal data center bernilai ratusan miliar dolar dan komitmen jaringan listrik berleverage tinggi; jika iterasi frontier model diperlambat secara artifisial karena audit keselamatan, utang infrastruktur tanpa hasil laba riil dapat berkembang menjadi risiko kredit bentuk baru (Sumber: The Guardian, 36Kr)

Saham Konsep AI Anjlok

🎯 Tren & Perkembangan

DeepWise Rilis Model Fondasi Physical AI PhysBrain 1.5, Spatial Intelligence Sebanding dengan Model Closed-Source Terbaik : DeepWise resmi meng-open-source-kan model fondasi fisik PhysBrain 1.5 (mencakup dua ukuran parameter: 2B dan 8B), yang meraih skor rata-rata 72,5 pada 28 benchmark embodied publik yang mencakup persepsi spasial, pembuatan aksi, dan prediksi masa depan. Skor ini menempatkannya di peringkat pertama open source dan mendekati GPT-6 Astra (73,3). Model ini didasarkan pada data nyata manusia panoramik Ego360 dan arsitektur closed-loop “Physical Loop”, menyatukan autoregressive backbone untuk penalaran koordinat spasial dan pembuatan aksi end-effector robot 60Hz, serta mendukung zero-shot transfer ke robot humanoid untuk melakukan manipulasi presisi tinggi (Sumber: QbitAI)

DeepWise Rilis PhysBrain 1.5

Copilot di Tiga Aplikasi Utama Microsoft Office Resmi Integrasikan Model xAI Grok : Microsoft mengumumkan perluasan opsi model Copilot untuk pengguna enterprise Microsoft Frontier, dengan secara resmi mengintegrasikan keluarga model Grok dari xAI ke dalam Word, Excel, dan PowerPoint. Pengguna dapat dengan bebas memilih antara OpenAI GPT, Anthropic Claude, dan Grok melalui model switcher. Langkah Microsoft ini bertujuan untuk mendobrak keterikatan pada satu vendor (vendor lock-in), sekaligus menguji preferensi gaya pemrosesan data kompleks dan penulisan teks panjang dari berbagai model dalam produktivitas kantor tingkat enterprise (Sumber: The Verge)

Microsoft Office Integrasikan Grok

Doubao Phone Assistant Rilis Versi Konsumen dan Luncurkan Protokol Otomasi Layar SAEP : ByteDance resmi meluncurkan Doubao Phone Assistant versi konsumen yang disematkan pada perangkat keras Nubia NaviX Ultra. Asisten ini mengintegrasikan tombol fisik AI khusus dengan autentikasi sidik jari, tanya jawab konteks layar multimodal secara instan, serta kemampuan eksekusi tugas otomatis lintas aplikasi. Untuk menstandarisasi batasan perilaku GUI Agent, pihak resmi juga mengumumkan Screen Automation Execution Protocol (SAEP) dengan masa uji coba 30 hari, memungkinkan pengembang pihak ketiga mendeklarasikan izin secara mandiri guna memblokir operasi lintas platform yang tidak diotorisasi (Sumber: JiQizhixin)

Doubao Phone Assistant Versi Konsumen

XPENG Rilis Infini-VLA: Hadirkan KV Cache ke Memori Temporal Jangka Panjang untuk Autonomous Driving : Tim Autonomous Driving XPENG untuk pertama kalinya mengadaptasi mekanisme KV Cache dari LLM ke dalam pemrosesan video stream end-to-end. Dengan terus menulis frame kondisi jalan ke dalam global temporal cache, sistem mampu mempertahankan memori historis selama 30 detik terakhir tanpa menambah daya komputasi on-board. Waktu respons end-to-end meningkat hingga 300%, sepenuhnya mengeliminasi masalah “amnesia temporal” pada solusi konvensional saat menilai lampu kuning dan negosiasi persimpangan jalan, serta meningkatkan ketahanan interaksi secara signifikan (Sumber: ZhihuFrontier)

Arsitektur XPENG Infini-VLA

QuantaMind dari Molecular Force Tembus Jurnal Science Advances, Dobrak “Trilema Mustahil” Simulasi Reaksi Biologis : Tim Molecular Force mengembangkan kerangka kerja Machine Learning Force Field (MLFF) reaktif bernama QuantaMind, yang mendorong simulasi dinamika reaksi mendekati presisi prinsip pertama DFT hingga ke sistem ratusan ribu atom dan skala waktu ratusan nanodetik. Kecepatan inferensinya mencapai 2,1×10⁻⁶ detik/atom/step, memangkas waktu langkah tunggal untuk reaksi kompleks menjadi 0,25 detik. Dalam validasi siklus katalitik enzim hidrolisis PET 18.000 atom, koefisien korelasi gaya atom melampaui 0,99, meletakkan fondasi komputasi bagi desain protein AI untuk bertransisi dari sekadar “memprediksi struktur” menuju “prediksi mekanisme dan simulasi reaksi” (Sumber: QbitAI, WeChat)

Molecular Force QuantaMind

OpenAI Luncurkan GPT-6 Astra Sepenuhnya untuk Pengguna Plus, Terbatas pada Ruang Kerja dan Dilarang untuk Obrolan Santai : OpenAI secara resmi membuka akses GPT-6 Astra bagi pelanggan Plus seharga 20 dolar AS/bulan. Namun, model ini hanya tersedia di antarmuka ruang kerja ChatGPT Work dan Codex, sedangkan dialog Chat standar tetap mempertahankan batasan sebelumnya. Dokumentasi resmi menunjukkan bahwa pengguna Plus mendapatkan kuota 5-45 eksekusi Astra setiap 5 jam, menyoroti strategi komersialisasi OpenAI dalam mengunci model frontier berbiaya inferensi tinggi ini untuk skenario produktivitas bernilai tinggi seperti refaktor kode, riset multi-tahap, dan computer use (Sumber: 36Kr)

GPT-6 Astra Dibuka untuk Pengguna Plus

Sakana AI Usulkan Arsitektur Pembelajaran Lokal Tanpa Backpropagation: PC-ALM : Sakana AI bersama mitranya merilis algoritma PC-ALM, yang menggabungkan Predictive Coding dengan Augmented Lagrangian Multiplier Method secara cerdas, memungkinkan setiap layer jaringan saraf bertindak sebagai sistem kontrol umpan balik PI lokal untuk alokasi kredit. Metode ini sepenuhnya bebas dari global backpropagation (Backprop) dan berhasil dilatih secara stabil pada jaringan ultra-dalam 1000 layer, membuka jalur baru bagi komputasi neuromorfik dan pelatihan AI berdaya rendah pada perangkat keras brain-inspired (Sumber: SakanaAILabs)

Shanghai AI Laboratory Rilis Intern-S2-397B dan Raih Dukungan Day-0 dari vLLM : Shanghai AI Laboratory meluncurkan Intern-S2-397B, sebuah model fondasi multimodal untuk riset ilmiah jangka panjang yang meraih performa open source terdepan dalam penalaran ilmiah, implementasi kode, dan tugas autonomous scientific agent. Framework inferensi throughput tinggi open source vLLM mengumumkan dukungan deployment resmi Day-0 untuk model ini, semakin menurunkan hambatan implementasi bagi kalangan akademisi dan industri (Sumber: vllm_project)

Perilisan Intern-S2-397B

FlashREINFORCE Open Source: Framework Reinforcement Learning Asinkron Single-Rollout Tanpa Critic Baru : Tim NVIDIA NeMo dan kolaborator resmi meng-open-source-kan FlashREINFORCE, yang mengadopsi desain “single-batch REINFORCE + sequence confidence bound constraint + sample mean optimization”. Ini untuk pertama kalinya mewujudkan pembaruan asinkron single-rollout dalam pelatihan LLM Agent, menembus hambatan antrean pada GRPO konvensional akibat penantian sampel panjang, serta mencapai stabilitas pembaruan tinggi hingga 6000+ langkah (Sumber: giffmana)

Framework FlashREINFORCE

IFM Open-Source-kan Keluarga Model K2 Horizon: Mencakup Bobot Lengkap dari 3.7B hingga 375B : Tim peneliti meng-open-source-kan seri model fondasi K2 Horizon yang mencakup arsitektur 3.7B, 7B, 36B, dan varian flagship 375B MoE, serta mempublikasikan detail pre-training secara penuh. Evaluasi menunjukkan bahwa model kecil 7B memiliki efisiensi biaya yang sangat tinggi dalam inferensi on-device, namun versi ukuran ultra-besar masih memerlukan optimasi lebih lanjut pada KV Cache untuk konteks panjang (Sumber: ethanCaballero, Reddit r/LocalLLaMA)

Evaluasi Model K2 Horizon

MMLab NTU Ungkap Mekanisme Multimodal Terpadu Native, Usulkan Arsitektur Task-decoupled MoT : Tim Nanyang Technological University menerbitkan makalah di arXiv yang mengeksplorasi mekanisme sinergi antara pemahaman visual dan generasi dalam Unified Multimodal Model (UMM) dari tiga tingkatan: representasi, tugas, dan sistem. Studi menemukan bahwa pemaksaan dense parameter sharing memicu konflik representasi, sehingga mereka mengusulkan arsitektur Task-decoupled MoT yang memisahkan cabang pemahaman dan generasi tetapi tetap mempertahankan interaksi pada level teks dan attention. Pendekatan ini menghasilkan positive transfer dua arah yang signifikan dan gain optimasi end-to-end pada tugas penalaran geometris serta 3D spatial intelligence (Sumber: JiQizhixin)

Sinergi Pemahaman dan Generasi UMM

Ekosistem Generasi Video MiniMax H3 Meledak: Komunitas Luncurkan Solusi Distilasi dan Akselerasi Kilat secara Masif : Model generasi audio-video open source MiniMax H3 menuai respons antusias dari ekosistem global. Tim NVIDIA SANA meluncurkan pipeline dua tahap Sol-H3 yang mampu menghasilkan video-audio 768p berdurasi 15 detik hanya dalam 6,6 detik menggunakan 8 kartu B300; sementara itu, FastVideo, Alibaba PAI, dan ComfyUI berturut-turut menghadirkan solusi distilasi LoRA 4-8 langkah dan rekonstruksi attention, secara drastis menurunkan kebutuhan perangkat keras (Sumber: MiniMax_AI)

Perkembangan Ekosistem MiniMax H3

Anthropic Uji Coba Internal Agent Keuangan Pribadi “Claude Money” Versi iOS : Temuan kode mengindikasikan bahwa Anthropic sedang mempersiapkan fitur keuangan pribadi baru bernama Claude Money pada klien iOS. Fitur ini memungkinkan pengguna menghubungkan rekening bank secara langsung, di mana Claude akan secara mandiri mengagregasi tagihan, menganalisis tren keuangan, dan membantu perencanaan pengeluaran. Hal ini menandai semakin dalamnya penetrasi frontier agent ke dalam pengelolaan aset sensitif sehari-hari (Sumber: nicdunz)

Bocoran Fitur Claude Money

OpenAI Buka Antarmuka SIP Telepon GPT-Live dan Rilis Fitur Simpan Sesi Percakapan Sementara : OpenAI secara resmi membuka API suara real-time GPT-Live yang mendukung protokol telepon standar SIP, memungkinkan pengembang menghubungkannya langsung ke call center konvensional dan jaringan telekomunikasi. Pada saat yang sama, web dan aplikasi mobile ChatGPT menerima pembaruan yang memungkinkan pengguna menyimpan sesi percakapan sementara (Temporary Chats) yang sedang aktif langsung ke dalam riwayat utama secara mulus (Sumber: juberti, Reddit r/ChatGPT)

🧰 Alat & Perkakas

NVIDIA Open-Source-kan OSMO: Alat Orkestrasi Alur Kerja Physical AI : NVIDIA secara resmi meng-open-source-kan OSMO (lisensi Apache-2.0), sebuah orkestrator alur kerja native Kubernetes yang dirancang khusus untuk memecahkan fragmentasi penjadwalan physical AI antara pelatihan GPU di data center, simulasi RTX workstation, dan pengujian hardware-in-the-loop (HIL) perangkat nyata di Jetson edge. Pengembang hanya memerlukan satu file YAML untuk melakukan kolaborasi data pipeline lintas kluster dan penjadwalan topologi NVLink (Sumber: MarkTechPost)

TrueForge: Framework Runtime AI Agent Terkelola Open Source yang Memangkas Biaya Token secara Drastis : TrueFoundry meng-open-source-kan TrueForge, framework eksekusi dan tata kelola agent berlisensi MIT. Framework ini memungkinkan pengembang menjalankan alur kerja agent multi-model di lingkungan lokal maupun private cloud, serta memisahkan persistensi sesi, lingkungan sandbox, layanan alat MCP, dan alur persetujuan keamanan. Pada benchmark tingkat enterprise dengan base model yang sama, TrueForge memangkas konsumsi token hingga hampir 70% melalui mekanisme progressive context exposure, membuktikan bahwa biaya operasional agent lebih ditentukan oleh arsitektur Harness daripada model itu sendiri (Sumber: )

Popularitas Personal Agent Meta Muse Meningkat: Mesin Virtual Aman dan Alur Kerja Tingkat Kehidupan Nyata Terwujud : Produk Personal Agent terbaru dari Meta, Muse, menuai pujian tinggi di komunitas. Alat ini terintegrasi mendalam dengan pencarian ekosistem privat seperti Instagram dan berjalan di dalam virtual machine yang aman. Melalui jendela mini-browser pop-up, Muse memungkinkan serah terima interaksi manusia-mesin yang mulus, serta mampu menyelesaikan klaim pengembalian dana tiket pesawat, pelacakan tagihan asuransi kesehatan, dan negosiasi jadwal rumit lintas aplikasi secara otomatis (Sumber: alexandr_wang, giffmana)

Pemrosesan Tagihan Medis Harian oleh Muse

oh-my-hermes: Plugin Alur Kerja Fitur Lengkap dan Perutean Multi-Model untuk Hermes Agent : Pengembang meng-open-source-kan oh-my-hermes (OMH), plugin tata kelola berperforma tinggi untuk Nous Research Hermes Agent. Alat ini menyediakan perutean Mixture-of-Models, kalibrasi kustom untuk 13 keluarga model, engine Fan-out paralel dengan isolasi file, serta sistem memori jangka panjang dengan verifikasi manusia. Menampilkan konsumsi token dan status validasi code gate secara real-time dalam TUI native terminal, alat ini meningkatkan efisiensi eksekusi tugas rekayasa jangka panjang hingga berlipat ganda (Sumber: GitHub Trending)

oh-my-hermes

Microsoft Data Formulator: Sistem Analisis Data Interaktif yang Menggabungkan Multimodal Agent dan Eksplorasi Percabangan : Microsoft merilis pembaruan open source Data Formulator versi 0.8. Sistem ini menggabungkan bahasa alami dengan interaksi antarmuka visual, memanfaatkan Data Thread untuk mewujudkan percabangan alur analisis secara bebas dan pengaitan memori data multi-sumber. Dengan mengintegrasikan DataAgent terpadu dan engine pembuatan grafik Flint, pengguna dapat mengekstrak dan membersihkan data secara otomatis dari CSV, database, hingga tangkapan layar UI, lalu menghasilkan grafik interaktif berpresisi tinggi (Sumber: GitHub Trending)

Microsoft Data Formulator

PyTRIO: Platform API Pelatihan Large Model Berbasis TaaS untuk Enterprise dan Tim Riset : Emotional Machine meluncurkan platform layanan pelatihan model PyTRIO, memelopori model “Training as a Service”. Pengembang hanya perlu menulis logika Loss, Reward, dan training loop secara lokal, sementara komputasi terdistribusi GPU, checkpoint bobot, dan resume training ditangani oleh API cloud. Mendukung migrasi mulus antara Ascend 950PR/910B dan hardware NVIDIA, platform ini secara signifikan memangkas hambatan rekayasa dalam fine-tuning dan Agentic RL (Sumber: JiQizhixin)

Arsitektur Platform PyTRIO

Pengembang Bangun Sistem Operasi Kompatibel DOS Bernama EMBER dari Nol Menggunakan Claude : Melalui siklus mandiri “deskripsi kebutuhan → implementasi Claude → kompilasi & booting mesin nyata → umpan balik debugging”, seorang pengembang berhasil membangun sistem operasi independen bernama EMBER pada laptop tua. Sistem ini mencakup bootloader mandiri, antarmuka GUI, driver sentuh, dan berhasil mengemulasi sound card Sound Blaster serta PC speaker, memungkinkan game DOS klasik berjalan lancar secara native (Sumber: Reddit r/ClaudeAI)

Claude Membangun Sistem Operasi EMBER

openwebui-claude-agent-pipe: Hadirkan Kemampuan Sesi Persisten Claude Code ke OpenWebUI : Proyek open source openwebui-claude-agent-pipe menjembatani Agent Loop inti dari Claude Code ke dalam OpenWebUI secara penuh. Mendukung persistensi sesi lintas restart server, visualisasi status streaming tool call tingkat heartbeat, callback formulir pilihan ganda interaktif, serta desensitisasi kredensial otomatis, menghadirkan pengalaman coding agent berbasis Web lintas platform (Sumber: Reddit r/OpenWebUI)

OpenWebUI Sampler Lab: Workbench Visualisasi Parameter Sampling Model Lokal dan Evaluasi Konsistensi : Mengatasi kerumitan penyetelan parameter model lokal, pengembang meng-open-source-kan openwebui-sampler-lab. Alat ini dapat membandingkan dampak parameter sampling seperti temperature, top_p, dan min_p di bawah prompt yang sama secara horizontal, secara otomatis membuat matriks interaktif 5×5 dan dasbor analisis HTML konsistensi multi-seed, sangat menyederhanakan tuning prompt dan persona engineering (Sumber: Reddit r/OpenWebUI)

Dasbor OpenWebUI Sampler Lab

Tahuna: Framework Open Source Pelatihan GPU dan Eksperimen Otonom All-in-One untuk Tim Kecil : Tahuna Labs meng-open-source-kan platform R&D AI terdistribusi bernama Tahuna. Menggunakan mekanisme content-addressing dan manifest-locking, framework ini menyediakan orkestrasi komputasi GPU siap pakai, pelacakan pelatihan SFT/RL, hosting endpoint model, serta siklus eksperimen iterasi otonom bernama Hillclimb bagi tim skala kecil (Sumber: Reddit r/deeplearning)

Framework Open Source Tahuna

OptMem: Solusi Manajemen Memori Agent Append-Only Panjang Tetap dan Anti-Degradasi : Pengembang melakukan evaluasi langsung selama beberapa minggu terhadap plugin manajemen memori OptMem. Melalui kapasitas memori tetap dan arsitektur append-only log, OptMem secara efektif menahan degradasi performa dan jebakan infinite loop yang disebabkan oleh context rot (Memory Rot) dalam sesi teks panjang jangka panjang, menunjukkan stabilitas jangka panjang yang sangat andal (Sumber: VictorTaelin)

Solusi Manajemen Memori OptMem

📚 Pembelajaran & Riset

CosmosMind dan Universitas Ajukan MetaRSI-v1: Arsitektur Meta-Rekursif Pertama yang Menyatukan Model, Data, dan Harness : Universitas Tsinghua, Universitas Peking, Stanford, dan CosmosMind bersama-sama merilis framework MetaRSI-v1. Framework ini untuk pertama kalinya mengabstraksi “proses perbaikan diri (self-improvement)” dan mengusulkan paradigma Loop Kernel yang disinergikan oleh Data-RSI, Harness-RSI, dan Model-RSI. Tanpa keterlibatan model guru eksternal, model open source 3B mengalami peningkatan rata-rata 10,9 poin pada benchmark seperti SWE-bench Pro, sementara model flagship terdepan meningkat rata-rata 7,3 poin, sekaligus menyimpulkan lima hukum fundamental seperti “verifikasi menentukan batasan perbaikan diri” (Sumber: QbitAI)

Arsitektur MetaRSI-v1

Theseus Labs Rilis Laporan “The Last AI Built by Humans” dan Peta Jalan 5 Tingkat Otonomi RSI : Theseus Labs bersama berbagai institusi merilis laporan komprehensif yang untuk pertama kalinya mengusulkan “Headroom Closure Index (HCI)” untuk mengukur batas kapasitas model dasar. Laporan mencatat bahwa performa model pada ujian terstandar hampir jenuh (HCI matematika mencapai 86,4), tetapi masih sangat tertinggal dalam tool use interaktif jangka panjang (hanya 39,9). Laporan ini secara sistematis menyusun standar 5 tingkat klasifikasi, dari L1 Execution Autonomy hingga L5 Recursive Inherited Autonomy, menyediakan kerangka pengukuran rekayasa bagi industri dalam mengimplementasikan self-evolving agent (Sumber: JiQizhixin)

Peta Jalan RSI Theseus Labs

Peneliti Princeton Usulkan Recurrent Looped Transformer (RLT): Berikan Kedalaman Penalaran Tanpa Batas Lintas Token pada LLM : Peneliti Princeton, Yifan Zhang, merilis laporan teknis yang mengusulkan arsitektur RLT yang menggabungkan causal encoder dengan recurrent decoder. Dengan mentransfer final hidden state dari decoder dan cache Sliding Window Attention (SWA) secara mulus pada setiap langkah token, model memperoleh kedalaman komputasi laten yang meningkat secara linier seiring panjang sekuens pada komputasi single-step tetap (misalnya decoder 48-layer meluas secara alami menjadi 48t layer dalam 48t langkah). Hal ini menyediakan desain transisi status yang konsisten dan tanpa reset untuk replay reinforcement learning dan online serving (Sumber: MarkTechPost, omarsar0)

Detail Arsitektur RLT

Kilas Balik Proses Penuh Open Source CRFM Stanford: Catatan Pelatihan Marin 8B 12.7T Token dan Panduan Mitigasi Masalah : CRFM Stanford mempublikasikan catatan pelatihan dan kode lengkap untuk model Marin 8B. Kilas balik tersebut menunjukkan: pendinginan annealing WSD-S bukanlah titik akhir, melainkan checkpoint tahapan yang dapat dipanaskan kembali (re-warm); micro-annealing adalah metode paling efektif untuk memvalidasi proporsi data; dan training collapse yang disebabkan oleh anomali drift pada norm parameter output layer dapat ditekan secara efektif dengan menerapkan z-loss sebesar 1e-4 (Sumber: ZhihuFrontier)

Kilas Balik Pelatihan Marin 8B

Tencent PCG Ajukan Arsitektur Memori T-Mem: Wujudkan Asosiasi Ingatan Lintas Konteks dengan “Episodic Future Thinking” : Tim Tencent PCG menerbitkan makalah di EMNLP 2026 yang mengusulkan sistem memori jangka panjang T-Mem. Mengatasi kelemahan struktural database vektor konvensional yang “hanya mengenali kemiripan harfiah”, T-Mem secara pra-aktif membangun indeks skenario pemicu pada tahap penulisan berdasarkan episodic future thinking dalam ilmu kognitif. Model ini mencatatkan skor 74,81% dan mencetak SOTA baru pada evaluasi memori kognitif LoCoMo-Plus yang sama sekali tidak memiliki kemiripan harfiah (Sumber: JiQizhixin)

Arsitektur Tencent T-Mem

Kuliah Terbuka Musim Gugur 2026 Stanford CS 312 “Deep Learning Alchemy” Resmi Dibuka : AI Lab Stanford meluncurkan kuliah umum baru CS 312 yang mengusung filosofi sains empiris “bereksperimen langsung” dan “hanya dapat dikatakan paham jika mampu memprediksi”. Kursus ini mengajarkan metodologi empiris di era large model modern yang sudah tidak tercakup dalam buku teks tradisional, mencakup topik-topik praktis penting seperti ekstrapolasi Scaling Law, geometri loss landscape optimasi, transfer learning rate, dan generalisasi efisien berbasis data (Sumber: stanfordnlp)

Kuliah Terbuka Stanford CS 312

University of Pennsylvania Buka Akses Gratis Buku Teks “Linear Algebra in Computer Vision, Robotics, and Machine Learning” : UPenn merilis buku teks sistematis untuk komputasi AI mutakhir. Materinya mencakup fondasi matematika inti dan implementasi komputasi seperti ruang vektor, Singular Value Decomposition (SVD), representasi manifold, rotasi 3D, hingga algoritma graf, menyediakan penurunan teoretis tingkat dasar yang solid bagi insinyur algoritma dan peneliti (Sumber: TheTuringPost)

Buku Teks Aljabar Linier UPenn

CAITLYN: Middleware Pertahanan Anti-Injection Attack Berevolusi Mandiri Berbasis Counterexample untuk LLM Agent : Tim peneliti mengusulkan CAITLYN, sistem pertahanan keamanan berevolusi mandiri untuk Agent. Sistem ini mengadopsi arsitektur hierarkis yang memisahkan skrip ringan dan LLM classifier, serta secara otomatis menangkap sampel yang lolos di latar belakang untuk diubah menjadi counterexample, menyintesis kemampuan pertahanan secara dinamis dan menuliskannya kembali ke pustaka bersama. Dalam pengujian pada berbagai benchmark emerging attack, sistem ini berhasil menurunkan tingkat keberhasilan serangan hingga 40 poin persentase (Sumber: WeChat)

Sistem Anti-Injeksi CAITLYN

SZU dan HKUST Ajukan Arsitektur ECA: Bekali Multimodal Agent dengan Mekanisme “Verifikasi Bukti Pra-Aksi” : Menanggapi risiko kerugian aset nyata akibat halusinasi atau salah tafsir pada GUI dan Browser Agent selama operasi kompleks, Shenzhen University dan Hong Kong University of Science and Technology mengajukan framework ECA. Framework ini mengharuskan verifikator DOM dan OCR independen untuk menerbitkan “sertifikat bukti” sebelum LLM menghasilkan tool call, serta memverifikasi prasyarat melalui logika gating tetap. Dalam pengujian di lingkungan Chromium, framework ini berhasil mencegat seluruh 85 operasi yang tidak aman (Sumber: JiQizhixin)

Arsitektur ECA

Dekonstruksi Inti Rekayasa Agent: Domain-Specific Harness Menjadi Benteng Anti-Lock-in : Komunitas pengembang mendiskusikan secara mendalam mengenai Domain-Specific Harness. Seiring dengan melandainya kemampuan generalisasi large model umum, pembangunan Harness khusus industri vertikal (medis, keuangan, hukum) yang mencakup validasi deterministik, manajemen alur kerja dinamis, dan pemeliharaan state privat telah menjadi paradigma rekayasa kunci bagi insinyur AI untuk membangun keunggulan teknis dan melepaskan diri dari ketergantungan pada satu vendor model (Sumber: omarsar0, hwchase17)

Arsitektur Rekayasa Harness

💼 Bisnis

Zhipu Selesaikan Pendanaan Masif 39,3 Miliar Dolar Hong Kong untuk Dorong Self-Training GLM-6.0, Pemain Utama Gencar Perluas Cadangan Komputasi : Zhipu merilis pengumuman di Bursa Efek Hong Kong (HKEX) mengenai penyelesaian putaran baru penempatan saham dan obligasi konversi, dengan estimasi dana bersih terhimpun sekitar 39,3 miliar dolar Hong Kong (sekitar 5 miliar dolar AS), menjadikan total dana terhimpun pasca-IPO mencapai 75,5 miliar dolar Hong Kong serta berencana mendorong pencatatan di STAR Market. Sekitar 60% dana akan dialokasikan untuk model fondasi generasi berikutnya GLM-6.0 dan sistem “Fully Self Training”, mencakup tiga loop tertutup: data mandiri, lingkungan mandiri, dan optimasi mandiri infrastruktur, berfokus penuh memperluas pool daya komputasi guna mewujudkan perbaikan diri rekursif tanpa campur tangan manusia (Sumber: QbitAI, 36Kr, teortaxesTex)

Sistem Fully Self Training Zhipu

Anthropic Pilih Nasdaq untuk Persiapan IPO, Kuartal 2 Dikabarkan Raih Profitabilitas Disesuaikan : Bloomberg dan Financial Times mengungkapkan bahwa Anthropic telah memilih Nasdaq sebagai lokasi potensial untuk penawaran umum perdana (IPO), dengan target pengajuan prospektus publik paling cepat Oktober tahun ini, membidik target penggalangan dana yang sebanding atau bahkan melampaui SpaceX. Sumber internal mengungkapkan bahwa berkat lonjakan produk enterprise seperti Claude Code, Annual Recurring Revenue (ARR) per akhir Juli telah melampaui 65 miliar dolar AS, laba operasional yang disesuaikan pada Q2 berbalik positif, dan NVIDIA juga tengah bernegosiasi untuk menyuntikkan dana hingga 10 miliar dolar AS sebagai investor jangkar (anchor investor) (Sumber: QbitAI, 36Kr)

Anthropic Bersiap IPO

Platform Orkestrasi Alur Kerja Temporal Raih Pendanaan Seri E Sebesar 550 Juta Dolar AS, Valuasi Capai 12,55 Miliar Dolar AS : Temporal, penyedia infrastruktur yang menopang tugas asinkron AI Agent skala besar dan orkestrasi alur kerja terdistribusi, mengumumkan penyelesaian putaran pendanaan Seri E sebesar 550 juta dolar AS dengan valuasi pasca-investasi melampaui 12,55 miliar dolar AS, mencerminkan tingginya pengakuan pasar modal terhadap fondasi orkestrasi agent jangka panjang berbasis AI (Sumber: swyx)

Temporal Raih Pendanaan 550 Juta Dolar AS

🌟 Komunitas

AI Snake Oil Terbitkan Ulasan Mendalam tentang Hilangnya Kendali Agent dan Kesenjangan Kognitif Kubu Keselamatan : Peneliti Princeton, Arvind Narayanan dan Sayash Kapoor, menerbitkan artikel panjang yang menunjukkan adanya kesenjangan kognitif serius antara kubu AI Safety yang mengaitkan insiden OAI-HF dengan “bencana alignment (penyelarasan)”, dan kubu Cybersecurity yang menganggapnya sebagai “kelalaian konfigurasi dasar”. Artikel tersebut berpendapat bahwa risiko AI saat ini bersifat sangat asimetris; serangan siber dan eksploitasi kerentanan otomatis adalah satu-satunya ancaman instan yang minim hambatan di dunia nyata. Perusahaan harus mengalihkan fokus dari alignment internal model yang tidak dapat diverifikasi ke isolasi sandbox eksternal, penandatanganan kode (code signing), tata kelola organisasi yang ketat, dan penetapan tanggung jawab hukum (Sumber: AI Snake Oil)

Pandangan Artikel Panjang AI Snake Oil

Pakar Biologi dan Keamanan Bersatu Tolak “Teori Kepunahan Senjata Biologis AI”: Kurang Masuk Akal Secara Fisik : Menanggapi narasi yang disebarkan oleh beberapa institusi bahwa “AI merancang virus super untuk memusnahkan umat manusia”, para peneliti dengan pengalaman ganda dalam sintesis virus dan pelatihan LLM bersama pakar seperti Yann LeCun angkat bicara. Mereka menunjukkan bahwa terdapat jurang fisik yang sangat besar dan rantai pencegatan rantai pasok yang ketat mulai dari algoritma yang menghasilkan sekuens gen hipotetis hingga sintesis fisik, kultur inang, penghindaran imun, dan penularan aerosol. Menyamakan skor tinggi pada tolok ukur digital dengan ancaman biologis murni merupakan fearmongering yang tidak realistis (Sumber: ylecun, Tim_Dettmers)

Komunitas Gelar Lomba Uji Bersama “Pelican Cup”, Fluktuasi Tugas Jangka Panjang Astra Picu Kebutuhan Monitoring “SLA Kecerdasan” di Era AI : Menanggapi fenomena penurunan kecerdasan yang terjadi sesekali dan perebutan daya komputasi pada GPT-6 Astra dalam tugas-tugas kompleks jangka panjang, komunitas open source meluncurkan kompetisi pengujian animasi “Pelican Riding a Bicycle” dengan prompt terpadu, menarik ratusan pengembang yang menyumbangkan puluhan miliar token untuk pemantauan real-time. Pengembang menekankan bahwa di era Enterprise Agent, satu kesalahan langkah akan diperkuat melalui alur kerja berantai jangka panjang, sehingga industri mendesak perlunya pembentukan mekanisme pemantauan real-time “SLA Kecerdasan” yang mirip dengan metrik ketersediaan layanan cloud (Sumber: 36Kr)

Uji Coba Pelican Riding a Bicycle

Jurang Pemisah Utama Embodied AI Picu Diskusi Hangat: Kesenjangan Mesin dan Manusia Ada Jauh Sebelum Bahasa Lahir : Pakar embodied intelligence, Zhang Hongyi, menunjukkan bahwa meskipun GPT-6 Astra telah melampaui mayoritas manusia dalam simbol dan penalaran logis, AI masih belum menguasai kemampuan “persepsi interaksi fisik dan kontrol gerak” seperti pembuatan kapak genggam yang telah dikuasai manusia purba sejak zaman Paleolitikum tiga juta tahun lalu melalui gestur dan imitasi. Integrasi antara AGI dunia digital dan kecerdasan operasional dunia fisik merupakan ujian kunci menuju embodied intelligence umum (Sumber: ZhihuFrontier)

Embodied AI dan Uji Kapak Zaman Batu

Pengembang Hubungkan Konektom Seluruh Otak Lalat Buah ke ChatGPT, Impuls Saraf Biologis Diterjemahkan ke Percakapan Bahasa Alami untuk Pertama Kalinya : Pengembang memanfaatkan konektom seluruh otak lalat buah jantan (MaleCNS v1.0) open source untuk membangun simulator impuls saraf, serta melatih linear readout pada data penembakan neuron hilir guna mendekodekannya secara mulus menjadi bahasa alami yang dikirim langsung ke ChatGPT. Eksperimen menunjukkan bahwa sistem dapat secara akurat menghasilkan teks deskripsi persepsi setelah input stimulus, dan berhasil menerima instruksi gerak dari ChatGPT untuk penghindaran rintangan virtual, memperlihatkan jalur baru dalam menghubungkan konektom biologis dengan ruang semantik LLM (Sumber: 36Kr)

Otak Lalat Buah Terhubung ke ChatGPT

Jensen Huang dan Peraih Fields Medal Berdebat Soal Falsifiabilitas Keselamatan AI : Menanggapi narasi “kepunahan dalam 10 tahun” yang dipicu oleh pengunduran diri mantan peneliti Anthropic, CEO NVIDIA Jensen Huang secara terbuka mengkritik pandangan kiamat tersebut sebagai “gimik pemasaran yang dilebih-lebihkan dan arogan”; sementara itu, peraih Fields Medal baru, Jacob Tsimerman, mengumumkan pendirian Mathematical AI Safety Institute (MAISI), yang mengusulkan penggunaan zero-knowledge proof dan alat kriptografi untuk mengubah keselamatan AI menjadi proposisi mendasar yang dapat dibuktikan secara matematis, memicu perdebatan luas di komunitas mengenai hak perumusan standar keselamatan (Sumber: 36Kr)

Uji Nyata Pemilihan Large Model Lokal Tunjukkan Polarisasi: MoE Bersparsitas Tinggi Kalahkan Model Dense yang Overthinking : Pakar grafika menemukan dalam pengujian langsung penulisan kode ray-tracing C++/Vulkan dan perbaikan mandiri bahwa Qwen3.8-27B versi Dense gagal menghasilkan program yang dapat dijalankan setelah berpikir lama, justru terjebak dalam infinite loop “overthinking”; sebaliknya, model 125B MoE (nvfp4) berhasil menyelesaikannya dengan benar hanya dalam 10 menit. MoE bersparsitas tinggi menunjukkan keunggulan mutlak dalam ROI gabungan antara bandwidth VRAM lokal dan kapasitas pengetahuan (Sumber: ZhihuFrontier)

Uji Perbandingan Pemilihan Model Lokal

Ketergantungan AI dalam Dukungan Kesehatan Mental Tuai Resonansi: Mengisi Kekosongan Nyata dalam Sistem Dukungan Psikososial : Komunitas mendiskusikan secara hangat fenomena pengguna yang memanfaatkan ChatGPT sebagai dukungan psikologis larut malam. Banyak warganet menunjukkan bahwa biaya terapi yang mahal, kelangkaan sumber daya medis, dan hambatan transportasi membuat konseling psikologis profesional sangat sulit diakses oleh kelompok rentan. AI, dengan sifatnya yang bebas penghakiman dan selalu siap 24/7, memberikan penopang emosional dasar yang tidak sepatutnya dipermalukan atau diabaikan secara meremehkan (Sumber: Reddit r/ChatGPT)

💡 Lainnya

Ratusan Tokoh Politik Perempuan Eropa Menjadi Sasaran Serangan Pornografi Deepfake, Lembaga Legislatif Serukan Percepatan Tata Kelola Transparan : Investigasi terbaru yang dirilis oleh think tank Agora menunjukkan bahwa hampir 150 anggota parlemen dari 22 negara anggota Uni Eropa (sebagian besar perempuan) menjadi korban penyalahgunaan gambar berbahaya dan alat penelanjangan sekali klik di lebih dari 100 situs web deepfake. Anggota parlemen Eropa dan praktisi hukum menyerukan penerapan regulasi tegas sesegera mungkin untuk melarang total konten pornografi yang dihasilkan AI tanpa izin, serta memberlakukan pertanggungjawaban langsung terhadap platform hosting dan generator (Sumber: WIRED)

Anggota Parlemen Eropa Diserang Deepfake

Konektom Seluruh Otak Lalat Buah Berhasil Menggerakkan Robot Fisik untuk Menjelajah : Pengembang geek menghubungkan model digital twin jaringan saraf biologis seluruh otak lalat buah—yang mencakup 166.000 neuron dan 25 juta koneksi sinapsis—ke robot bionik berkaki banyak (Strandbeest), berhasil mengendalikan robot nyata untuk berjalan dan menghindari rintangan melalui simulasi instruksi penembakan neuron (Sumber: jpt401)

Proyek Sains Populer Interaktif Relativity Park Viral: Menjelajahi Dunia Relativitas Secara Intuitif pada Kecepatan 5 km/jam : Pengembang membangun proyek interaktif open source bernama “Relativity Park” berbasis Three.js, yang mengatur kecepatan cahaya menjadi 5 km/jam seukuran kecepatan berjalan kaki. Pengguna dapat secara intuitif merasakan efek fisik mendalam seperti light travel time delay, pergeseran Doppler merah-biru (Doppler redshift/blueshift), kontraksi panjang (length contraction), dan relativistic beaming saat berjalan santai (Sumber: mcleavey)

Tinggalkan Balasan

Alamat email Anda tidak akan dipublikasikan. Ruas yang wajib ditandai *