🔥 Fokus
Pemimpin AI Eropa Mistral AI Raih Pendanaan Seri D Senilai €3 Miliar, Valuasi Lampaui €21 Miliar : Startup AI asal Prancis, Mistral AI, mengumumkan penutupan putaran pendanaan Seri D sebesar €3 miliar (sekitar 23,4 miliar RMB), mencatatkan rekor tertinggi dalam sejarah pendanaan ekuitas putaran tunggal bagi perusahaan teknologi di Eropa. Putaran ini dipimpin bersama oleh Samsung Electronics, Scaleup Europe Fund, dan PSG Equity, dengan partisipasi dari ASML, NVIDIA, BlackRock, dan lainnya. Dana tersebut akan dialokasikan untuk memperluas klaster komputasi pelatihan dan inferensi frontier model, membangun infrastruktur data center mandiri, serta memperluas tim ilmuwan terkemuka di Paris, London, Zurich, Warsawa, dan berbagai lokasi di AS. Presiden Prancis Emmanuel Macron menyampaikan ucapan selamat, menyebutnya sebagai tonggak penting bagi Eropa dalam bersama-sama membangun “jalur ketiga” untuk sovereign open-source AI (Sumber: Mistral AI, THE DECODER, arthurmensch, ClementDelangue)

Matematikawan Pecahkan Masalah Blow-up Persamaan Fluida dengan LLM, Memicu Sengketa Etika Akademik dengan OpenAI : Matematikawan New York University Tristan Buckmaster bersama kolaboratornya Levent Alpöge (karyawan Anthropic) mengumumkan bahwa dengan bantuan model seperti Claude dan Codex, mereka berhasil menyelesaikan bukti finite-time blow-up untuk persamaan Navier-Stokes/Euler 3D incompressible di bawah smooth external force dalam waktu satu bulan, serta menyelesaikan verifikasi formal dengan Lean 4. Namun, Buckmaster menuduh tim OpenAI (tim Sébastien Bubeck) melancarkan komputasi intensif untuk mereplikasi temuan tersebut setelah mengetahui progresnya, serta berupaya menghapus nama Alpöge dari publikasi bersama disertai ancaman karier. Terence Tao memberikan apresiasi tinggi terhadap terobosan matematika ini, sementara Bubeck secara terbuka membantah tuduhan tersebut. Peristiwa ini memicu perdebatan sengit di kalangan akademisi mengenai hak kepemilikan riset berbantuan closed-source LLM serta etika akademik perusahaan teknologi raksasa (Sumber: 36氪, dotey, kimmonismus, akbirkhan)

Google DeepMind Rilis AlphaGenome Atlas, Memetakan 9 Miliar Variasi Titik Tunggal pada Genom Manusia : Google DeepMind resmi merilis AlphaGenome Atlas, yang memanfaatkan AI untuk memprediksi dampak terhadap mekanisme molekuler dari keseluruhan 9 miliar kemungkinan mutasi basa tunggal pada genom manusia. Hasil riset ini mencakup dataset prediksi berukuran 1PB serta skor dampak varian terstandarisasi AVI, memungkinkan para peneliti mengevaluasi pengaruh mutasi pada wilayah coding maupun non-coding terhadap penyakit dan fenotipe menggunakan metrik tunggal. Hasil penelitian ini kini telah dibuka sepenuhnya untuk komunitas riset global (Sumber: Google DeepMind, IEEE Spectrum)

NeurIPS Gunakan AI Detector yang Menyebabkan 178 Makalah Ditolak Keliru, Memicu Krisis Kepercayaan Peer Review Akademik : Jalur position paper NeurIPS 2026 menggunakan perangkat deteksi komersial Pangram untuk langsung melakukan desk reject terhadap 178 makalah (18,4% dari total pengajuan) tanpa menyediakan peninjauan ulang manusia maupun saluran banding. Selanjutnya, peneliti independen melakukan uji balik terhadap makalah masa lalu dari tiga track chairs terkait dan menemukan bahwa detektor tersebut juga memberikan skor AI yang tinggi antara 24%-69%. Detektor tersebut disorot memiliki bias salah penilaian yang signifikan terhadap struktur kalimat akademis penulis non-penutur asli bahasa Inggris, memicu kecaman keras dari kalangan akademisi atas penggunaan “black box AI untuk mengadili integritas akademik manusia” (Sumber: Reddit r/MachineLearning)
🎯 Tren & Perkembangan
DeepSeek Mulai Uji Coba Internal Multimodal Asli V4.1 Flash, Throughput Generasi Capai 400 t/s : DeepSeek membuka pengujian internal terbatas untuk versi perantara deepseek-v4.1-flash-expires-on-0910. Informasi resmi mengungkapkan bahwa versi ini mengadopsi arsitektur model baru dan mendukung kemampuan visual multimodal secara native. Model ini menghadirkan peningkatan berlipat ganda dalam pencarian long-context serta pembuatan kode SVG dibandingkan generasi sebelumnya, dengan kecepatan decoding rata-rata mencapai 350-400 token/s dan biaya pemanggilan yang sangat rendah. Uji coba komunitas menunjukkan responsivitas yang sangat tinggi dalam spatial reasoning pada gambar serta kolaborasi multi-step Agent (Sumber: 机器之心, op7418, teortaxesTex)
.jpg)
ModelBest Rilis Open-Source Model Agent On-Device MiniCPM5-2B Beserta Resep Pelatihannya : ModelBest merilis model dense on-device berparameter 2.52B, MiniCPM5-2B, yang mendukung kemampuan inti Agent seperti tool calling, code generation, dan deep search secara native. Model ini meraih performa on-device terdepan pada benchmark alur kerja Artificial Analysis. Tim pengembang juga membuka secara open-source framework reinforcement learning Meshy, algoritma JustRL II, serta dataset UltraData-SFT-Agent yang berisi 500.000 sampel (Sumber: 机器之心, MarkTechPost)
.jpg)
XPeng Luncurkan Lini Produksi Massal Otomatis Robot Humanoid dan Hubungkan Arsitektur Universal VLA 2.0 : He Xiaopeng mengumumkan selesainya lini produksi otomatis penuh pertama di dunia untuk robot humanoid serbaguna, mewujudkan konsep “robot memproduksi robot” dan turun langsung dari lini perakitan untuk aplikasi pabrik secara mandiri. Melalui chip Turing AI yang dikembangkan secara in-house (setiap robot membawa 3 chip dengan total komputasi 2250 TOPS) dan pusat superkomputer “FuYao”, XPeng mengembangkan sistem autonomous driving XNGP menjadi arsitektur model universal VLA 2.0 yang menghubungkan kontrol kendaraan cerdas dan robotika embodied (Sumber: jpt401, bookwormengr)

OpenAI Luncurkan Fitur Pembelajaran Gaya Penulisan Personal untuk ChatGPT Work : OpenAI merilis modul adaptasi nada dan gaya penulisan personal dalam ekosistem ChatGPT Work. Setelah pengguna menghubungkan alat kerja sehari-hari seperti Gmail, Google Drive, dan Slack, model dapat secara otomatis mempelajari kebiasaan pilihan kata, tanda tangan email khusus, serta preferensi format pengguna, sehingga teks yang dihasilkan Agent berpadu secara alami dengan gaya personal dan mengatasi masalah output kaku pada enterprise Agent (Sumber: kimmonismus, gdb)

Inclusion AI Rilis Open-Source Model Text-to-Image & Pengeditan 6B LLaDA-Image : Inclusion AI meluncurkan LLaDA-Image, sebuah model DiT 6B berbasis arsitektur full diffusion. Lebih dari 90% sampel pre-training menggunakan tugas restorasi masking lokal pada gambar murni untuk membangun prior visual, sedangkan pasangan teks-gambar hanya digunakan pada tahap akhir untuk penyelarasan bahasa (language alignment). Model ini menempati jajaran teratas open-source dalam evaluasi bilingual Mandarin-Inggris, serta menyediakan bobot versi distilasi Turbo (inferensi 2-4 step) dan adaptasi SGLang Day-0 (Sumber: 机器之心)
.jpg)
Cambricon Menjadi Anggota Platinum Tingkat Tertinggi di PyTorch Foundation : Cambricon resmi memperoleh kursi di Dewan Direksi PyTorch Foundation, menjadikannya salah satu produsen chip AI Tiongkok pertama yang masuk ke jajaran pengambil keputusan komunitas open-source tersebut. Menerapkan prinsip Upstream First, Cambricon telah menyumbangkan kode ke tujuh modul utama PyTorch dan merealisasikan adaptasi Day-0 untuk model besar domestik dalam ekosistem vLLM, mempercepat decoupling perangkat lunak-perangkat keras dan pengalaman pengembangan native (Sumber: WeChat)

Platform openJiuwen Huawei Luncurkan Mekanisme Sesi Persisten WorkSwarm : Platform AI Agent open-source Huawei, openJiuwen, meluncurkan kapabilitas Persist Session pada agent perkantoran WorkSwarm. Melalui pemisahan antara Raw Work Log lapisan bawah dan mekanisme pengorganisasian background, platform ini berhasil mempertahankan kesinambungan konteks kompleks dan pembagian tanggung jawab tanpa drift dalam percakapan grup Feishu hingga 189 giliran multi-pengguna serta 200 giliran tugas pengembangan jangka panjang (Sumber: 机器之心)
.jpg)
Xiaomi Diam-diam Membuka Uji Coba Terbatas Desktop Agent MiMo Desktop Melalui Undangan : Xiaomi membuka uji coba terbatas melalui undangan untuk desktop agent MiMo Desktop. Fitur ini mendukung persepsi visual seluruh layar, kontrol otomatisasi keyboard dan mouse, kolaborasi lintas aplikasi, serta perekaman dan pemutaran ulang alur kerja yang dapat digunakan kembali. Pengguna dapat langsung menyeret aset Office, file kompresi, serta audio-video ke dalam sistem, lalu membiarkan model MiMo generasi baru di sisi perangkat menjalankan alur kerja kompleks secara otonom (Sumber: teortaxesTex, bookwormengr)
SemiAnalysis dan Google Bersama Rilis InferenceX, Tolok Ukur Inferensi Publik Pertama untuk TPU : Lembaga riset semikonduktor SemiAnalysis bermitra dengan Google untuk meluncurkan InferenceX, benchmark publik berkala pertama untuk stack komputasi Google TPU. Data menunjukkan bahwa di berbagai skenario inferensi sekuens panjang pada frontier model terkemuka, throughput token per dolar pada Google TPU hingga 50% lebih tinggi dibandingkan NVIDIA B200/B300 (Sumber: dylan522p, woosuk_k)
BaseGenesis Rilis Model Agent-Native NeoHorse : BaseGenesis, yang didirikan oleh mantan kepala Huawei Noah’s Ark Lab Wang Yunhe, merilis model Agent pertamanya, NeoHorse (4B/9B). Model ini memanfaatkan kurikulum pembelajaran yang dibangun dari jejak orkestrasi dan perbaikan kesalahan multi-model yang diakumulasikan melalui Routing Harness-nya, secara signifikan meningkatkan tool calling dan kemampuan self-healing terhadap feedback lingkungan tanpa mengubah ukuran parameter dasarnya (Sumber: 量子位)

Scalabot Rilis HERON-World Model, World Model Interaksi Multi-Agent Pertama : Scalabot meluncurkan HERON-World Model yang mengadopsi arsitektur gabungan MoT (pemisahan parameter vision-language) dan Mixture of Experts (MoE). Model ini tidak hanya mampu memproyeksikan evolusi fisik berdasarkan tindakan robot tunggal, tetapi juga dapat memodelkan interaksi dinamis dan status kausal dari multi-agent dalam skenario kolaborasi yang kompleks (Sumber: 36氪)

🧰 Alat & Tools
OpenAI Buka Public Beta ChatGPT Sites, Hasilkan Situs Web Interaktif Hanya dengan Satu Kalimat : OpenAI meluncurkan fitur ChatGPT Sites untuk pengguna langganan berbayar. Tanpa perlu menulis kode front-end, pengguna hanya perlu memberikan deskripsi bahasa alami atau sketsa untuk menghasilkan situs web lengkap dengan interaksi kompleks, physics engine fluida, atau logika online store dalam waktu belasan menit, disertai dukungan anotasi sidebar untuk iterasi lokal (Sumber: WeChat)

ManyCore Tech Rilis Model Generasi 3D Lux3D dan Buka SDK Serta Antarmuka MCP Lintas Platform : ManyCore Tech memperkenalkan model spatial generation Lux3D yang mencakup versi Express dan Standard, berfokus pada baking material fisik PBR presisi tinggi dan topologi mesh. Model ini menyediakan SDK Python/TS/Java serta antarmuka MCP yang dapat diintegrasikan secara mulus ke alur kerja agent seperti GPT-6 Astra untuk rendering dan ekspor aset 3D otomatis (Sumber: 36氪)

Reducto Luncurkan Model Parsing Dokumen Single-Pass r-1 : Reducto merilis model parsing dokumen baru bernama r-1, yang mengintegrasikan OCR konvensional, analisis tata letak, ekstraksi tabel, dan penjajaran posisi ke dalam pemindaian satu halaman penuh (single-pass). Pendekatan ini mengurangi tingkat kesalahan sebesar 20% dibandingkan pipeline agentic sebelumnya dan memangkas biaya pemrosesan dokumen kompleks menjadi 1 sen per halaman (Sumber: MarkTechPost)
Jenny: Desktop Agent Harness Open-Source yang Mendukung Sandbox Rollback dan IDE Lokal : Pengembang independen merilis Jenny, sebuah harness model lokal open-source berbasis Electron. Dirancang khusus untuk deployment LLM privat, Jenny dilengkapi dengan IDE interaktif, checkpoint status sesi, serta mekanisme konfirmasi ganda untuk instruksi Shell berbahaya. Tool ini mendukung llama.cpp, vLLM, dan berbagai endpoint kompatibel OpenAI, memberikan keamanan tinggi sekaligus memastikan model kecil dapat melakukan tool calling secara cepat (Sumber: Reddit r/LocalLLaMA)
Open QuizUI: Plugin Kuis & Pembelajaran AI Interaktif untuk Open WebUI : Pengembang membangun plugin kuis khusus Open QuizUI untuk ekosistem Open WebUI. Plugin ini mendukung pembuatan dan penjelasan soal pilihan ganda secara otomatis melalui tool call model atau prompt teks murni, dilengkapi fitur rendering formula matematika LaTeX, mode fokus layar penuh, rekap statistik jawaban, serta ekspor file HTML mandiri untuk dibagikan (Sumber: Reddit r/OpenWebUI)
AstraBlender: Kontrol Pemodelan dan Rendering Blender di Cloud Menggunakan Perintah Ponsel : Pengembang merilis alat integrasi ringan open-source bernama AstraBlender. Dengan menjalankan headless Blender di cloud host dan melakukan streaming virtual desktop, pengguna dapat langsung menginstruksikan model untuk membuat geometri 3D, menyesuaikan material, dan melakukan tugas rendering hanya melalui ChatGPT di ponsel tanpa memerlukan GPU lokal atau terminal environment (Sumber: Reddit r/artificial)

Embedflow: Alat Migrasi Tanpa Downtime untuk Upgrade Basis Data Vektor Skala Besar : Tim peneliti merilis framework migrasi open-source Embedflow untuk mengatasi kendala proses re-encoding berbulan-bulan saat meng-upgrade model embedding pada vector database berskala miliaran. Solusi ini memanfaatkan indeks sumber untuk memanggil set kandidat lalu melakukan reranking ringan dengan model baru, mencapai transisi basis data vektor secara instan tanpa kendala operasional sembari mempertahankan akurasi pencarian Top-K (Sumber: Reddit r/MachineLearning)

📚 Pembelajaran & Riset
Tsinghua dan ByteDance Seed Ajukan Arsitektur SMELT: Looped Transformer Tunjukkan Keunggulan Scaling di Bawah Batasan Anggaran Ketat : Menanggapi perdebatan mengenai sumber keuntungan arsitektur recurrent layer, tim dari Tsinghua University dan ByteDance Seed melakukan penyelarasan ketat pada FLOPs, jumlah parameter, dan KV Cache dalam makalah mereka. Mereka membuktikan bahwa resep SMELT—yang mengeksekusi 50% layer bagian tengah sebanyak dua kali secara berulang (loop)—mencapai fitting Scaling Law yang lebih baik dan hasil evaluasi kode/teks panjang yang lebih unggul di berbagai skala model (Sumber: 机器之心)
.jpg)
Karya EMNLP 2026: Mengalihkan Target Pelatihan Text World Model ke Konsistensi Perilaku BehR : Riset dari Dalian University of Technology, Microsoft, dan institusi lainnya menemukan bahwa teks hasil generasi yang semakin mendekati prediksi nyata justru dapat menyebabkan kesalahan keputusan fatal pada Agent (pembalikan metrik). Makalah ini mengusulkan reward BehR yang memanfaatkan selisih skor aksi dari reference agent yang dibekukan sebagai sinyal reinforcement learning, menurunkan tingkat false positive pada evaluasi offline agent yang lemah dari 42,5% menjadi 9,5% (Sumber: 机器之心)
.jpg)
Riset Mengungkap Keberadaan Ruang Kerja Spasial S-Space di Dalam Model Multimodal : Tim MirroS menemukan adanya subspace kontinu berdimensi rendah bernama S-Space pada aktivasi intermediate layer VLM. Subspace ini mampu mengodekan koordinat 3D objek secara linear dan memengaruhi causalitas Q&A spasial, meskipun model masih memerlukan bantuan program deterministik eksternal saat memproses kopling sistem referensi yang berbeda dan transformasi rotasi sudut pandang (Sumber: 机器之心)
.jpg)
HKUST dan Tim Lain Rilis Tinjauan Komprehensif terhadap 259 Studi: Dari Generasi Konten Menuju Konstruksi & Pengiriman Berkelanjutan : Tim gabungan dari HKUST (Guangzhou), Zhejiang University, dan institusi lainnya secara sistematis memetakan lanskap teknologi Agentic Artifact Creation. Berangkat dari arsitektur tiga lapis yang mencakup representasi artefak, strategi konstruksi, dan verifikasi runtime, mereka mengusulkan empat prinsip desain dan sistem evaluasi untuk aset digital yang siap dikirimkan (deliverable) (Sumber: WeChat)

EMNLP 2026: Menemukan Multi-modal Retrieval Heads (MMRetHeads) pada LLM Multimodal Dokumen Panjang : Makalah ini mengungkap bahwa Vision-Language Model bergantung pada attention heads tertentu untuk melacak bukti dalam Q&A dokumen panjang. Pemblokiran retrieval heads berskor tinggi menyebabkan penurunan akurasi drastis pada Q&A bagan dan diagram yang kompleks. Modul reranker tanpa supervisi yang dibangun berdasarkan mekanisme ini secara signifikan meningkatkan retrieval recall pada benchmark MMDocIR (Sumber: 36氪)

MIT Rilis Seluruh Materi Kursus dan Kuliah Multimodal AI Musim Semi 2026 ke Publik : Profesor Paul Liang dari Massachusetts Institute of Technology (MIT) merilis rekaman video dan materi kuliah musim semi 2026 terbaru untuk kursus 《How to AI (Almost) Anything》. Materinya secara sistematis mencakup multimodal agents, mekanisme penalaran kompleks, self-evolving AI, serta batas terdepan representasi gabungan data sensor multimodal (seperti sentuhan dan penciuman) dengan LLM (Sumber: rsalakhu)

DeepMind dan MIT Bersama Usulkan Paradigma Restrukturisasi Software AI-Native yang Berpusat pada Design Docs : Google DeepMind dan MIT mempublikasikan makalah berjudul 《Design Docs Are All You Need》 yang mengeksplorasi paradigma pengembangan baru: main branch tidak menyimpan kode bisnis apa pun, melainkan hanya menyimpan design docs dalam bahasa alami dan formal operator IR. Coding Agent digunakan untuk meregenerasi seluruh kode dari dokumen pada setiap iterasi versi demi mencegah software rot (pembusukan perangkat lunak) (Sumber: omarsar0)

Evolusi Program Berbasis Panduan LLM Buat Terobosan pada Tolok Ukur Matematika Pengepakan Lingkaran Packomania : Peneliti independen mengusulkan framework pencarian evolusi program yang dipandu oleh LLM, memungkinkan model untuk secara otonom memodifikasi dan mengoptimalkan algoritma berdasarkan skor feedback dari verifikator independen. Pada benchmark geometri circle packing Packomania yang terkenal, framework ini berhasil memecahkan 10 rekor terbaik dunia baru untuk rentang N=101 hingga 114 hanya dengan biaya $27 dalam bentuk token (Sumber: Reddit r/MachineLearning)

💼 Bisnis & Industri
Perusahaan Physical AI DeepCooling Selesaikan Pendanaan Seri B+ Senilai Ratusan Juta Yuan : DeepCooling menyelesaikan putaran pendanaan baru Seri B+ senilai ratusan juta yuan yang dipimpin oleh CATL, dengan partisipasi dari Aramco Ventures, Taiping Innovation, dan investor lainnya. Dana tersebut akan digunakan untuk mempercepat penerapan skala besar PhyAI engine miliknya dalam kontrol cerdas liquid cooling industri serta infrastruktur terkoordinasi daya-komputasi (Sumber: 量子位)

Tianji Intelligence Selesaikan Pendanaan Seri B/B+ Senilai 1 Miliar Yuan, Percepat Produksi Massal Robot Embodied : Guangdong Tianji Intelligence mengumumkan penyelesaian pendanaan senilai 1 miliar yuan dengan valuasi pasca-investasi mendekati 10 miliar yuan, dipimpin oleh GL Ventures dan Meituan Strategic Investment, dengan partisipasi dari Tencent dan Gaorong Ventures. Perusahaan ini telah mengantongi pesanan lebih dari 10.000 unit robot, dan dana tersebut akan difokuskan untuk mendorong manufaktur skala besar terstandarisasi untuk lengan ganda force-controlled serta komponen intinya (Sumber: 36氪)

Anthropic Dilaporkan Batal Akuisisi Startup Inferensi Asal Israel, Decart AI, Senilai Sekitar $6 Miliar : Laporan industri mengungkapkan bahwa Anthropic telah resmi membatalkan negosiasi akuisisi terhadap startup AI asal Israel, Decart. Decart mengembangkan arsitektur decoding inferensi generasi baru yang diklaim mampu menghasilkan throughput token 8 kali lipat dari standar industri. Sebelumnya, NVIDIA dilaporkan sempat mengajukan tawaran akuisisi sekitar $8 miliar. Mundurnya Anthropic mencerminkan adanya perbedaan strategi di antara pengembang frontier model dalam merger dan akuisisi infrastruktur komputasi (Sumber: teortaxesTex, typedfemale)

🌟 Komunitas & Opini
Mantan Peneliti DeepMind Ungkap Celah Replay dan Kebocoran Encrypted Chain-of-Thought pada Model Proprietary : Riset keamanan menunjukkan bahwa blok data penalaran terenkripsi yang dikembalikan oleh API model mutakhir dapat di-replay ke model ringan di berbagai sesi dan model berbeda untuk didekodekan secara langsung, menyebabkan data pribadi seperti password dan API key yang tersembunyi dapat bocor. Dalam eksperimen prefilling, riset ini juga mengamati bahwa model open-source seperti Kimi mengalami style drift yang signifikan akibat pengaruh prefix prompt, memicu diskusi mendalam mengenai distilasi model dan perlindungan keamanan (Sumber: 36氪)

Mekanisme Internal Anthropic Labs Terungkap: Tim 20 Orang, Keputusan Tiap Dua Minggu : Media mengungkap detail operasional inkubator internal Anthropic, Labs: tim mempertahankan skala sekitar 20 orang dengan toleransi tingkat eliminasi proyek mencapai 70%-80%. Evaluasi prototipe dilakukan setiap dua minggu, dan tim yang berkembang melebihi 4 orang akan “lulus” untuk beralih menjadi lini bisnis mandiri. Inkubator ini sebelumnya telah melahirkan produk-produk penting seperti Claude Code, MCP, dan Claude Design (Sumber: 机器之心)
.jpg)
DeepSeek Rekrut 150 Insinyur Backend dan Elastic Computing untuk Agent, Memicu Diskusi Hangat : DeepSeek mengumumkan pembukaan 150 posisi senior yang seluruhnya ditujukan untuk pengembangan sisi server dan platform sandbox tingkat produksi DSec. Diskusi komunitas menilai bahwa pusat persaingan LLM sedang bergeser cepat dari riset algoritma titik tunggal ke optimasi OS lapisan bawah, komunikasi RPC, dan infrastruktur evaluasi paralel Agent berskala besar (Sumber: 36氪)

Kinerja GPT-6 Astra dalam Eksplorasi Otonom dan Generasi 3D Picu Perdebatan Seputar Komputasi dan Batasan AGI : Baru-baru ini, para developer secara intensif memanfaatkan GPT-6 Astra untuk kontrol skrip Blender, eksplorasi otonom dalam game Factorio, serta dekompilasi balik skenario, menunjukkan kemampuan tool use dan spatial closed-loop yang luar biasa. Namun, hal ini menyebabkan kuota cepat habis dan seringnya pemulihan kuota (reset) oleh pihak resmi. Komunitas memperdebatkan konsumsi daya komputasi Computer Use yang meningkat secara eksponensial, serta menyoroti bahwa model masih kekurangan mekanisme continual learning pada tugas-tugas tanpa pengetahuan awal (Sumber: 量子位, Plinz, Reddit r/ArtificialInteligence)

Output Claude yang Terlalu Panjang dan Watermark Model Memicu Kontroversi Kedaulatan Aset Perangkat Lunak : Komunitas pengembang menunjukkan respons terpolarisasi terhadap pengalaman output Claude versi baru. Banyak pengguna mengeluhkan respons yang dipenuhi istilah berulang dan mencari patch prompt ASD-STE100; di saat yang sama, langkah Anthropic memperluas statistical text watermarking ke domain kode telah memicu kekhawatiran kepatuhan bagi perusahaan terkait penanaman penanda atribusi pihak ketiga yang tidak dapat diaudit di dalam repositori kode inti milik pribadi (Sumber: Reddit r/ClaudeAI, kimmonismus)

Laporan Ketenagakerjaan “The Economist” Picu Perdebatan: Lonjakan Lapangan Kerja AI Dinilai Menutupi Eksploitasi Karyawan Tingkat Bawah : The Economist menerbitkan artikel yang menyatakan bahwa AI telah menciptakan lebih dari satu juta lapangan kerja baru di AS, sehingga menunda krisis pengangguran. Namun, pandangan ini menuai reaksi negatif dari kalangan pekerja. Para profesional mengungkapkan bahwa manajemen sering kali menggunakan alasan “efisiensi AI” untuk melakukan PHK sembari menuntut karyawan yang tersisa melipatgandakan output mereka, sehingga “pemberdayaan AI” di tempat kerja nyata dinilai beralih fungsi menjadi dalih baru untuk mengeksploitasi tenaga kerja (Sumber: saranormous, Reddit r/artificial)

💡 Lain-lain
University of Edinburgh Ajukan Teknologi Pulsa Medan Magnet Super Cepat, Berpotensi Turunkan Konsumsi Energi Penyimpanan AI hingga Dua Kali Lipat Skala Magnitudo : Tim peneliti dari University of Edinburgh mempublikasikan temuan di jurnal Advanced Materials mengenai manipulasi status magnetic memory menggunakan pulsa medan magnet ultra-cepat. Secara teoritis, metode ini dapat mengurangi konsumsi energi switching memori dan penyimpanan data center hingga 100 kali lipat, menawarkan jalur fisika baru untuk mengatasi hambatan konsumsi daya dan panas pada infrastruktur komputasi AI (Sumber: TechRadar)

Menteri Kesehatan Inggris Ingatkan Ketidakpercayaan Publik terhadap Palantir Dapat Mempengaruhi Riset Data NHS : Pejabat Departemen Kesehatan Inggris menyatakan kekhawatiran atas tren masyarakat yang memilih keluar (opt-out) dari berbagi data pada platform data NHS. Ditegaskan bahwa keraguan publik terhadap keamanan data kontraktor AI dan pertahanan Palantir berpotensi berdampak buruk pada pelatihan model AI medis serta rencana riset kesehatan masyarakat jangka panjang (Sumber: The Guardian)

Karyawan OpenAI dan Anthropic Bantah Tuduhan “Model Mencuri Sesi Percakapan Pribadi Pengguna” : Menanggapi kekhawatiran akibat sengketa persamaan fluida terkait dugaan apakah frontier lab secara diam-diam memantau sesi privat Codex/Claude pengguna untuk mendahului penerbitan hasil riset, beberapa peneliti dari lab terkemuka tampil memberikan klarifikasi. Mereka menegaskan bahwa perusahaan teknologi besar memiliki kontrol hak akses data yang sangat ketat terhadap log percakapan pengguna, dan tindakan mengakses log pengguna secara langsung merupakan pelanggaran berat yang berujung pada pemecatan seketika. Mereka mengimbau komunitas untuk menyikapi kebetulan dan temuan akademis publik secara rasional (Sumber: willdepue, _sholtodouglas)