🔥 Fokus
Trump Umumkan Rencana Pembentukan “AI Force” dan Penunjukan AI Czar : Trump secara terbuka di platform media sosial melabeli kepanikan keamanan AI saat ini sebagai “tipuan politik” yang dipicu oleh pihak oposisi, dan mengumumkan pembentukan “AI Force” baru yang meniru Space Force untuk memperkuat dominasi nasional, sembari berencana segera menunjuk seorang “AI Czar” ber-IQ tinggi. Trump menekankan bahwa AI adalah revolusi industri kunci dengan nilai output yang berpotensi mencapai 25% dari PDB AS, dan AS tidak boleh melambat dalam persaingan dengan Tiongkok. Potensi penyalahgunaan AI seharusnya ditangani oleh sistem hukum perdata dan pidana yang sudah ada, bukannya dengan membuat hambatan regulasi baru yang menghambat inovasi. Langkah ini menempatkan Gedung Putih dalam konfrontasi terbuka dengan perusahaan-perusahaan raksasa terkemuka yang menyerukan “pembatasan kecepatan batas global” (global frontier speed limits) dan faksi regulator bipartisan (Sumber: The Guardian).

StepFun Resmi Rilis Model Flagship Multimodal Step 5 Preview : StepFun meluncurkan fondasi flagship generasi baru Step 5 Preview, yang mengadopsi arsitektur sparse MoE dengan total parameter 600B dan aktivasi hanya 27B, serta mendukung konteks 1M dan input visual omni-modal secara native. Dalam Artificial Analysis Intelligence Index yang baru diperbarui, model ini meraih skor 44, masuk dalam tiga besar model open-source global dengan biaya inferensi per tugas hanya 0,71 dolar AS. Model ini dioptimalkan untuk rekayasa kode jangka panjang, laporan riset mendalam, dan skenario due diligence keuangan melalui long-trajectory reinforcement learning serta arsitektur ultra-dalam 92 layer, menunjukkan kemampuan cross-checking data dan orkestrasi otonom tugas kompleks yang sangat tinggi, dengan rencana rilis open-source bobot penuh pada 15 Oktober (Sumber: 新智元).

Tim Alibaba Qwen Open-Source Qwen-Image-2.1 dan Rilis Model Penerjemahan Simultan Real-Time : Tim Alibaba Tongyi secara resmi melakukan open-source pada model terpadu pembuatan dan pengeditan gambar yang ringan, Qwen-Image-2.1. Model ini mengadopsi arsitektur 7B DiT yang dikombinasikan dengan Qwen3-VL-8B, mendukung pembuatan native 2K, output langsung layer transparan RGBA, dan pengeditan presisi lokal hingga 10 gambar referensi, serta telah mendapatkan dukungan hari pertama dari vLLM dan ComfyUI; pada hari yang sama, model penerjemahan simultan real-time Qwen3.8-LiveTranslate diluncurkan, mengadopsi arsitektur Interleave baru yang memangkas latensi penerjemahan rata-rata untuk 60 bahasa menjadi 2,3 detik serta mendukung streaming speaker separation dan disorientasi konteks audio-visual secara native (Sumber: Alibaba_Qwen).

GPT-6 Astra Pecahkan Masalah Matematika Tingkat Signifikan di FrontierMath : Dalam benchmark matematika terkemuka dunia FrontierMath, GPT-6 Astra bersama beberapa akademisi terkemuka memecahkan masalah terbuka yang membingungkan teori pilihan sosial sejak 2017—“Keberadaan Core dalam Pemilihan Komite Berbasis Persetujuan”. Tujuan awal soal adalah mencari contoh sangkalan (counterexample), namun Astra justru membuktikan secara sebaliknya bahwa Core selalu non-kosong, dan secara kreatif mengusulkan kerangka optimasi berbasis “Harmonic Entropy” serta algoritma penyelesaian waktu polinomial. Terobosan ini mendorong Epoch AI untuk segera memperkenalkan label baru “Human + AI” untuk benchmark tersebut, menandai transisi resmi model besar dari pemecahan masalah pasif ke tahap pengajuan konsep matematika baru dan penemuan pola (Sumber: 36氪).

25 Peraih Fields Medal Bersama Tandatangani Pernyataan Darurat Memprotes “Pemecahan Masalah Predatoris” Raksasa AI : 25 peraih Fields Medal, termasuk Terence Tao dan Efim Zelmanov, bersama-sama menerbitkan surat terbuka berjudul “Severe Misalignment of Artificial Intelligence in Mathematics”, yang mengkritik keras raksasa teknologi karena mereduksi masalah matematika yang sulit menjadi sekadar benchmark model dan trik pemasaran IPO. Dalam wawancara eksklusif, Zelmanov secara langsung menuduh OpenAI memanfaatkan puluhan ribu agent konkuren untuk melakukan “penjarahan akademis secara terang-terangan” terhadap jejak kerja para matematikawan, memperingatkan bahwa brute-force mesin tanpa pemahaman konseptual dan transfer pengetahuan sedang mengganggu sistem pelatihan akademis, yang akan menghadapkan generasi muda matematikawan pada krisis kehilangan ruang bertahan hidup yang serius (Sumber: 每日经济新闻).

🎯 Tren
Anthropic Terungkap Lakukan Uji Gray-Scale Intensif untuk Fable 5.2 dan Opus 5.2 : Komunitas developer mendeteksi bahwa Anthropic sedang melakukan uji gray-scale lalu lintas skala besar untuk Fable 5.2 dan Opus 5.2 (nama kode internal Opus-Next) di Claude Code, Chat, dan Cowork. Uji langsung menunjukkan model baru membawa peningkatan lompatan dalam rekayasa fisika kompleks, arsitektur front-end, dan pembuatan aset 3D. Dalam mode penalaran tinggi, kedalaman output secara signifikan melampaui Astra, meskipun disertai latensi slow thinking yang cukup terasa dan peningkatan biaya komputasi. Analisis menunjukkan bahwa menghadapi situasi kritis di mana Astra merebut 13% belanja korporat dalam dua minggu terakhir, Anthropic berencana mengubah jadwal rilis untuk meluncurkan pertahanan flagship lebih awal (Sumber: 新智元).
Model Khusus Matematika Internal Google DeepThink Mathematica Bocor Secara Tak Sengaja : Komunitas teknologi membocorkan parameter card dan log Chain of Thought mentah dari model evaluasi internal Google “models/deepthink-mathematica-tf-raw-thoughts”. Model ini memiliki output maksimum 65K dan konteks 1M, yang berjalan secara default pada divergensi tinggi Temperature=1. Saat memecahkan persamaan Diophantine polinomial yang kompleks, neuron internal model menghasilkan lonjakan reward yang kuat ketika menemukan jalur penyederhanaan simetris, serta meninggalkan seruan huruf kapital yang sangat emosional dalam log pemikiran yang belum difilter, menunjukkan kemampuan lompatan intuisi non-tradisional di bawah deep reinforcement learning (Sumber: 新智元).

Aether AI Rilis Model Dunia Kausal CausalWM dan Puncaki TriWorldBench : Aether AI meluncurkan model dunia kausal 16B pertama, CausalWM, yang memperkenalkan paradigma “Causal Chain of Thought” (Causal CoT). Model ini beralih dari memprediksi masa depan langsung dari frame saat ini, menjadi secara eksplisit menyimpulkan pergerakan optical flow dan perubahan point cloud geometri 3D secara bertahap (Motion→Geometry→Future), serta menyuntikkan kembali prediksi sebelumnya ke dalam konteks untuk membentuk antarmuka intervensi. Arsitektur ini menempati peringkat pertama global di benchmark multi-view robotika TriWorldBench dan evaluasi hukum fisika PAI-Bench (Sumber: 机器之心).

Daxiao Robotics Bersama Universitas Rilis Kerangka Kerja Rekonstruksi Interaksi Manusia-Pemandangan yang Dapat Disimulasikan HSImul3R : Daxiao Robotics berkolaborasi dengan Nanyang Technological University dan Shanghai AI Lab menghadirkan HSImul3R, yang karyanya terpilih di ECCV 2026. Kerangka kerja ini menargetkan “kesenjangan persepsi-simulasi” dalam visi 3D, mengadopsi optimasi dua arah loop tertutup fisik, mengintegrasikan stabilitas gravitasi dan keandalan kontak ke dalam rekonstruksi, memangkas tingkat penetrasi mesh dari 69,5% menjadi 22,9%, dan berhasil mengekstraksi serta mentransfer pengalaman interaksi manusia dari video monokuler sehari-hari ke robot humanoid Unitree G1 untuk dieksekusi secara stabil (Sumber: 机器之心).

Runway Ungkap Riset Pembuatan Video Streaming Real-Time dan Arsitektur Koreksi Mandiri : Runway mempublikasikan peta jalan teknis pembuatan streaming video terkontrol secara real-time. Teknologi ini memanfaatkan arsitektur autoregressive causal diffusion untuk menekan latensi gambar ke tingkat milidetik, memungkinkan streaming bersamaan saat input prompt diberikan. Menanggapi masalah di mana cacat kecil dalam pembuatan video autoregresif dapat memicu kerusakan visual secara global, Runway melatih model pada output yang membawa biasnya sendiri untuk membangun mekanisme koreksi mandiri yang dinamis secara real-time, meletakkan fondasi bagi simulasi jangka panjang kendaraan otonom dan model dunia interaktif (Sumber: THE DECODER).

🧰 Alat
Ekosistem TypeSafe Jev Meledak dan Gelombang Replikasi Open-Source Bermunculan : Model pengambilan keputusan System 1, Jev, yang diluncurkan oleh TypeSafe AI memicu tren integrasi otomasi di komunitas. APUS merilis proyek replikasi open-source fast-browser-use untuk memungkinkan eksekusi offline lokal, Bespoke Labs merilis open-source Nimble 9B yang di-fine-tune berbasis Qwen; LangChain meluncurkan suite evaluasi Jev-as-a-Judge, dengan pengujian aktual memakan waktu 0,44 detik per penilaian dan biaya hanya 0,00035 dolar AS; komunitas juga memunculkan ekosistem yang kaya seperti benchmark JevBench, plugin kompresi konteks fast-jev-compaction, dan intelligent model router (Sumber: 机器之心).

Vercel Labs Open-Source Kerangka Kerja Generative UI json-render : Vercel Labs secara resmi merilis open-source kerangka kerja Generative UI json-render, yang bertujuan untuk menyelesaikan masalah hilangnya kendali struktur dan halusinasi gaya pada pembuatan front-end oleh LLM. Melalui katalog komponen yang telah ditentukan sebelumnya, validasi tipe ketat Zod, dan rendering streaming inkremental SpecStream, kerangka kerja ini memastikan LLM hanya menghasilkan JSON terstruktur dalam batas-batas yang aman, dengan dukungan penuh untuk React, Vue, Svelte, Next.js, serta rendering 3D Gaussian splatting berbasis Three.js (Sumber: GitHub Trending).
OpenClaw Rilis Versi 2026.9.5 Hadirkan Pembaruan Atomik dan Hot Reload Plugin : Gateway Agent pribadi open-source OpenClaw merilis versi 2026.9.5, menggabungkan 4.179 PR. Fitur utama baru adalah mekanisme “pembaruan atomik” (atomic update), yang memvalidasi konfigurasi secara penuh melalui lingkungan terisolasi privat sebelum upgrade; jika validasi gagal, sistem akan otomatis melakukan rollback tanpa hambatan, memastikan gateway Agent tidak terputus; selain itu, pembaruan ini mendukung hot reload plugin tanpa restart, berbagi sesi read-only yang aman di beberapa terminal, serta penyimpanan arsip cold data (Sumber: MarkTechPost).
Proyek Open-Source Editable-Design Wujudkan Dekopling Semantik dan Pengeditan Layer pada Pembuatan Gambar AI : Kerangka kerja Editable-Design yang bersifat open-source untuk bidang desain visual mengubah pembuatan gambar AI dari pengiriman gambar PNG berpixel tetap tradisional menjadi pengiriman terstruktur. Model visual hanya bertanggung jawab mengekstraksi komposisi, hierarki, dan prioritas warna, sementara Coding Agent merekonstruksi HTML semantik, teks asli, dan layer materi independen, mendukung pengguna untuk mengklik dua kali guna mengedit teks, menyeret layer dengan bebas, dan memutar ulang seluruh jejak keputusan desain (Sumber: 机器之心).

Microsoft Open-Source Sistem Avatar Digital Siswa StudentSim Bantu Optimasi Tutor AI : Microsoft dan UIUC bersama-sama merilis StudentSim. Melalui alur kerja pelatihan dua tahap (model dasar mempelajari pola kesalahan umum + fine-tuning personalisasi dengan sedikit catatan), sistem ini dapat mereplikasi celah kognitif siswa nyata dan respons mereka terhadap prompt secara akurat hanya dengan beberapa sampel latihan. StudentSim mengungguli GPT-5.4 secara menyeluruh dalam evaluasi catur, penulisan, dan matematika, menyediakan platform pengujian loop tertutup berbiaya rendah untuk produk pendidikan AI (Sumber: THE DECODER).

📚 Pembelajaran
Salesforce dan UIUC Usulkan Strategi Pengurangan Acak KV Cache, Random Attention : Penelitian dalam makalah ini menemukan bahwa dalam komputasi rantai panjang model penalaran, selama input Prompt terlindungi sepenuhnya, pembuangan acak KV secara independen di setiap head untuk Reasoning Trace yang dihasilkan sendiri oleh model dapat menyamai akurasi algoritma penilaian heuristik yang kompleks pada enam benchmark utama seperti MATH500. Selain itu, dalam penerapan vLLM, throughput inferensi meningkat sebesar 32%–43% berkat penghapusan overhead komputasi, yang mengungkap adanya redundansi representasi teks dan multi-head yang sangat tinggi dalam Chain of Thought penalaran panjang (Sumber: 机器之心).

Tim Universitas Tsinghua Ungkap Mekanisme “Visual-Origin Hallucination” pada Model Multimodal Besar : Universitas Tsinghua menerbitkan makalah di ACM MM 2026 yang menunjukkan bahwa dalam skenario jawaban singkat dan tanya-jawab Yes/No, halusinasi objek multimodal tidak didominasi oleh prior bahasa, melainkan dipicu oleh kesalahan ekstraksi fitur visual dan runtuhnya embedding gambar-teks. Tim mengusulkan probe diagnostik pembalikan atribut adversarial AHAF dan fine-tuning kontrastif adversarial ACFT, yang hanya membutuhkan 0,9% data COCO untuk menekan halusinasi secara signifikan tanpa overhead inferensi tambahan (Sumber: 新智元).

VBVR-Pro Bangun 300 Benchmark Penalaran Native Visual dan Sistem Reward yang Dapat Diverifikasi : Institusi termasuk NTU, CMU, dan UC Berkeley bersama-sama meluncurkan suite penalaran visual native VBVR-Pro, yang mencakup 300 tugas dan 1,25 juta data multimodal. Mereka mengembangkan scorer deterministik yang dapat diverifikasi berdasarkan properti geometris untuk 100 tugas di antaranya (dengan konsistensi terhadap penilaian manusia melebihi 60%). Eksperimen membuktikan bahwa scorer ini dapat berfungsi sebagai reward yang dapat diverifikasi untuk RLVR, mendorong model multimodal belajar mengoreksi keadaan visual perantara secara mandiri selama proses denoising (Sumber: 机器之心).

Boundless Evolution Buka Pengujian Tertutup untuk Karl Workbench, Workbench Agent Riset Ilmiah : Boundless Evolution merilis workbench agent riset ilmiah Karl Workbench, berbasis kerangka Recursive Scientific Discovery (RSD), yang mengarsipkan dan mengelola hipotesis ilmiah, literatur, kode analisis, dan bukti yang dapat direproduksi secara terpadu. Dalam evaluasi otoritatif SciAgentArena, tingkat keberhasilan analisis data sel tunggal dan spasial omics keduanya mencapai 100%, dengan performa keseluruhan menempati peringkat pertama di antara seluruh sistem AI yang diuji (Sumber: 机器之心).

Baidu Open-Source LoongForge dan Ungkap Jebakan Pelatihan VLA Multi-GPU Tanpa NVLink : Tim Baidu Baige merilis open-source kerangka kerja pelatihan model embodied multimodal LoongForge-VLA. Laporan teknisnya merinci pengalaman praktis dalam menguantisasi komunikasi menjadi FP8 pada lingkungan murni PCIe Gen5. Studi menemukan bahwa menggabungkan AllReduce parameter kecil secara membabi buta justru merusak tumpang tindih komputasi dengan backpropagation, menyebabkan byte komunikasi berkurang setengahnya namun waktu per langkah pelatihan tidak berkurang, menekankan pentingnya penjadwalan berbasis topologi yang disesuaikan dengan exposure komunikasi (Sumber: Reddit r/deeplearning).
💼 Bisnis
Profound, Unicorn Optimasi Pencarian AI, Raih Pendanaan Seri D Senilai 180 Juta Dolar AS : Pelopor GEO (Generative Engine Optimization) Profound mengumumkan penyelesaian putaran pendanaan Seri D senilai 180 juta dolar AS, yang dipimpin bersama oleh Sequoia Capital dan Kleiner Perkins, dengan valuasi pasca-investasi mencapai 1,8 miliar dolar AS. Perusahaan berfokus membantu merek melacak dan mengoptimalkan probabilitas rekomendasi serta citra mereka dalam percakapan AI seperti ChatGPT dan Gemini. Dalam enam bulan terakhir, pendapatan tumbuh tiga kali lipat, dengan klien mencakup lebih dari sepertiga perusahaan Fortune 100 (Sumber: 36氪).
Unicorn Chip Komputasi AI Cloud RISC-V Yixing Intelligence Raih Pendanaan Hampir 2 Miliar Yuan : Yixing Intelligence mengumumkan penyelesaian putaran pendanaan baru hampir 2 miliar yuan, dengan valuasi pasca-investasi mendekati 15 miliar yuan, melibatkan lebih dari 20 institusi seperti Huatai Innovation dan SMIC Origin. Chip generasi pertama Epoch dan kluster supernode pendingin cair tanpa backplane ortogonal 64-node telah dikirimkan dalam produksi massal ke pusat data operator telekomunikasi. Chip generasi baru telah menyelesaikan tape-out, menghasilkan peningkatan throughput yang signifikan dalam skenario pemisahan PD (Prefill-Decode) untuk model besar (Sumber: 36氪).

Startup Model Dunia Embodied GigaAI Selesaikan Restrukturisasi Saham untuk Targetkan IPO di Bursa Hong Kong : GigaAI secara resmi mengubah nama perusahaannya menjadi perseroan terbatas (joint-stock company) dan menyelesaikan restrukturisasi saham dengan valuasi pra-investasi sekitar 20 miliar yuan, serta berencana mengajukan permohonan listing ke Bursa Efek Hong Kong (HKEX) paling cepat pada akhir tahun 2026. Mengandalkan model dunia GigaWorld-1 dan otak universal GigaBrain, perusahaan ini memajukan solusi embodied yang terintegrasi antara perangkat lunak dan keras. Tahun ini, perusahaan telah mengumpulkan pendanaan sebesar 3,5 miliar yuan dan berpeluang menjadi “saham model dunia pertama” (Sumber: 36氪).
🌟 Komunitas
Rumor Penundaan IPO Anthropic dan Perdebatan Hebat tentang Motif “Perlambatan demi Keamanan” : Laporan dari media seperti The Wall Street Journal mengungkapkan bahwa Anthropic mungkin menunda IPO-nya hingga November, memicu pengawasan mendalam oleh komunitas terhadap argumen “perlambatan demi keamanan” (safety slowdown) oleh raksasa AI. Para blogger investigasi dan analis menunjukkan adanya hubungan finansial yang kompleks antara investor awal Anthropic dan lembaga evaluasi inti METR, di mana narasi “kehancuran akibat AI” (AI doomerism) dinilai telah berkembang menjadi siklus bisnis tertutup bagi raksasa closed-source untuk meraih regulatory capture dan valuasi tinggi; sementara itu, akademisi seperti Yann LeCun mengkritik bahwa membesar-besarkan risiko eksistensial pada hakikatnya adalah upaya menekan persaingan open-source (Sumber: THE DECODER).

YC dan Komunitas Pengembang Diskusikan “Harness Lebih Krusial daripada Model Dasar” : Diskusi tematik yang diadakan oleh YC Paper Club menunjukkan bahwa dalam benchmark seperti ARC-AGI-3, model GPT-6 Astra yang sama dapat melonjakkan skornya dari 62,7% menjadi 98,6% dengan penurunan biaya sebesar 34% di bawah Harness yang berbeda. Komunitas mencapai konsensus: seiring kemampuan model dasar yang semakin konvergen, arsitektur Harness untuk manajemen status bertingkat, kontrol izin, dan orkestrasi sub-Agent kini menjadi faktor penentu utama apakah Agent dapat diterapkan secara nyata di tingkat perusahaan (Sumber: 36氪).
Agent Pribadi Meta Muse Picu Kontroversi Privasi dan “Beban Kognitif” : Aplikasi Agent pribadi desktop Meta, Muse, melampaui 900.000 unduhan pada minggu pertama peluncurannya dan memuncaki App Store Kanada. Namun, pengaktifan default penggunaan data interaksi pengguna untuk pelatihan model serta upaya berkelanjutan untuk meminta kredensial tingkat tinggi seperti rekening bank dan email memicu kritik keras dari lembaga privasi digital. “Degradasi kognitif” akibat Agent multimodal yang mengambil alih seluruh keputusan hidup juga menjadi fokus refleksi komunitas (Sumber: WIRED).

Penggunaan Model Open-Weight di Vercel Lampaui 78% untuk Pertama Kalinya : Data terbaru dari Vercel AI Gateway menunjukkan bahwa panggilan token model open-source mencapai 78,4%, dengan model bernilai tinggi seperti DeepSeek dan Kimi secara cepat menggerogoti pangsa API closed-source di sisi pengembangan. Developer menunjukkan bahwa dalam alur kerja tingkat produksi, arsitektur hibrida—yang menggunakan model berparameter kecil untuk tugas rutin berfrekuensi tinggi dan hanya menyerahkan 1% keputusan yang sangat sulit kepada model closed-source terdepan—telah menjadi standar industri (Sumber: X平台讨论).

💡 Lain-lain
Embodied AI dan Sistem Operasi Terminal Berakselerasi dalam Konvergensi : Qiyuan Robotics mengumumkan integrasi dengan Tencent WorkBuddy untuk membuka akses panggilan ke 10.000 Skill kantor dan interaksi; sementara itu, Huawei HarmonyOS 7 meningkatkan kerangka agent HMAF 2.0 untuk mendukung komunikasi lintas aplikasi A2A (Agent-to-Agent) di perangkat serta evolusi mandiri status, mendorong perangkat keras kelas konsumen beralih dari respons instruksi tunggal ke era kolaborasi otonom tingkat sistem (Sumber: 机器之心)).

Raksasa Teknologi Global Picu Perebutan Nama Domain Tingkat Atas “.ai” : Seiring pendaftaran domain “.ai” Anguilla melampaui 1 juta, raksasa seperti Alibaba dan Tencent gencar menggunakan arbitrase internasional UDRP untuk merebut kembali nama domain merek yang di-cybersquat, dengan transaksi domain tunggal di pasar sekunder berulang kali menembus angka jutaan dolar AS. Domain telah berevolusi dari sekadar pintu masuk URL menjadi “wilayah digital” langka yang tak terpisahkan dari startup AI dan narasi modal merek (Sumber: 36氪).
Layanan “Pelestarian Kerabat Digital” AI Hadapi Masalah Model Bisnis dan Dilema Etika : Seiring beberapa perusahaan rintisan yang berfokus pada “menghidupkan kembali” kerabat yang telah meninggal lewat suara dan avatar AI—seperti HereAfter—mengalami penghentian operasional atau perlindungan kebangkrutan, sektor keabadian digital menghadapi kenyataan rumit berupa desensitisasi psikologis pengguna, terputusnya pembayaran bulanan, dan sengketa etika terkait hak atas informasi, yang mendorong startup terkait untuk bertransisi menuju avatar digital orang hidup dan monetisasi pengetahuan (Sumber: 36氪).