🔥 Fokus
xAI Rilis Grok 4.6 dan Luncurkan Grok Bot Agent : xAI secara resmi merilis model Grok 4.6, yang mendukung 500K context window dan input multimodal. Model ini meraih skor 61 pada AA Intelligence Index, menyamai GPT-5.6 Sol, dan menempati posisi kedua dengan 1753 Elo pada evaluasi kerja nyata GDPVal-AA v2. Harga API-nya ditetapkan sebesar 2 USD per juta input dan 6 USD per juta output, lebih murah 60% dibanding produk pesaing. Grok Bot yang diluncurkan secara bersamaan mendukung kolaborasi multi-agent dan berjalan secara independen di cloud, serta dapat masuk otomatis ke aplikasi pihak ketiga dan mempelajari workflow pengguna. (Sumber: xAI)

DeepSeek V4 Pro Versi Resmi Dirilis dan Open-Source-kan Framework Harness : DeepSeek merilis versi resmi V4 Pro (0813), menggunakan arsitektur MoE dengan parameter 1.6T, serta mendukung 1M context window dan input gambar. Kemampuan Agent-nya melonjak drastis, melesat dari 12.8 poin pada versi pratinjau menjadi 62.7 poin pada benchmark DeepSWE. Di saat yang sama, secara resmi meng-open-source-kan framework agent DeepSeek Harness v0.1 berbasis microkernel Cordis, yang mendukung perakitan fleksibel untuk model, tools, dan sandbox dalam bentuk plugin. (Sumber: DeepSeek)
.jpg)
Alibaba Open-Source-kan LLM Qwen3.8-Max dengan 2,4 Triliun Parameter : Tim Qwen Alibaba meng-open-source-kan bobot model Qwen3.8-2.4T-A95B (Qwen3.8-Max), dengan parameter aktif mencapai 95B dan mendukung 262K context window secara native. Model ini meraih skor 93 di PaperBench dan berkinerja sangat baik pada tugas-tugas agent seperti OSWorld. Unsloth menggunakan teknologi kuantisasi 1-bit untuk mengompresi ukurannya sebesar 91% menjadi 397GB, sehingga memungkinkan deployment lokal. (Sumber: Hugging Face)
Google DeepMind Luncurkan Model Sign Language-to-Text SL2T : Google DeepMind merilis model sign language-to-text SL2T, yang kini tersedia di Gboard dan Live Transcribe pada Pixel 11. Model ini meraih skor zero-shot tinggi sebesar 70 BLEURT pada benchmark penerjemahan FLEURS-ASL. Untuk melindungi privasi, sistem menggunakan MediaPipe Holistic untuk mengekstrak koordinat pose tubuh secara lokal, dan hanya mengirimkan data geometris ke cloud untuk menyelesaikan penerjemahan real-time dari ASL ke bahasa Inggris. (Sumber: Google DeepMind)
Model Penalaran Pertama Berbasis TTT dari SSI Milik Ilya Terungkap : Bocoran dari komunitas menyebutkan bahwa SSI, yang didirikan oleh Ilya Sutskever, sedang mengembangkan mesin penalaran kecil berbasis Test-Time Training (TTT). Model ini dapat memperbarui sebagian bobotnya secara real-time melalui gradient descent saat melakukan inferensi untuk beradaptasi dengan data out-of-distribution, sehingga terbebas dari batasan static context window dan mencapai pembelajaran berkelanjutan yang efisien dalam sampel, dengan kinerja yang mampu bersaing dengan model yang berukuran jauh lebih besar. (Sumber: X)

🎯 Tren
Dyna Robotics Rilis Model Dyna-2 Berbasis Pre-training Video Egocentric Selama Jutaan Jam : Dyna Robotics merilis world action model Dyna-2 untuk manipulasi robot. Model ini di-pre-train pada lebih dari 1 juta jam video sudut pandang orang pertama (egocentric) manusia, yang untuk pertama kalinya memvalidasi kemampuan generalisasi lintas tubuh (cross-body generalization) dari Scaling Law pada data robot yang belum pernah dilihat sebelumnya. Eksperimen menunjukkan bahwa pelatihan kolaboratif yang menggabungkan prediksi video dan denoising tindakan adalah kunci untuk mencapai generalisasi. (Sumber: Dyna Robotics)
Xiaohongshu dan Shanghai Jiao Tong University Open-Source-kan Model Sintesis Suara Autoregresif Kontinu dots.tts : Model ini memiliki 2 miliar parameter, yang memodelkan secara autoregresif blok demi blok langsung dalam ruang laten kontinu, menghindari hilangnya informasi yang disebabkan oleh token akustik diskrit. Pada benchmark Seed-TTS-Eval, rata-rata kemiripan pembicara dan akurasi kontennya mencapai SOTA, serta mendukung output streaming dan mode interaksi dual-stream. (Sumber: Almost Human)
.jpg)
Microsoft Rilis MAI-Code-1.1-Flash dan Pangkas Harga Secara Signifikan : Microsoft memperbarui model kodenya dan merilis MAI-Code-1.1-Flash, mengoptimalkan konsumsi token untuk tugas CLI dan agent. Di saat yang sama, Microsoft memotong harga API di GitHub sebesar 75% (input 0,2 USD/juta, output 1,2 USD/juta), dengan tujuan untuk tetap kompetitif di pasar pemrograman yang didominasi oleh Anthropic. (Sumber: AI Business)

Tim Keamanan Alibaba Rilis Model Fondasi Keamanan Multimodal Yuvion VL : Tim Keamanan Alibaba meluncurkan seri model Yuvion VL, yang berfokus pada AI dan keamanan konten. Model ini memperkenalkan framework contrastive learning Confused Contrastive Fine-Tuning (C2FT) untuk menggali sampel negatif sulit yang mudah membingungkan secara dinamis. Evaluasi menunjukkan bahwa versi 8B-nya melampaui model komersial besar seperti GPT-5.4 yang memiliki jumlah parameter 50 kali lebih besar pada beberapa tugas keamanan. (Sumber: arXiv)
Oxford dan National University of Singapore Usulkan Framework “Mental World Model” MWM : Tim peneliti gabungan mengusulkan framework Mental World Modeling (MWM), yang menyarankan untuk memasukkan variabel mental seperti keyakinan, tujuan, dan emosi agent ke dalam status dunia global. Pengujian pada sistem referensi MENTIS menunjukkan bahwa dibandingkan dengan model dunia fisik murni, pemodelan status mental secara eksplisit dapat meningkatkan skor F1 prediksi keputusan manusia secara signifikan. (Sumber: arXiv)
.jpg)
Tim dari Peking University dan Lainnya Usulkan ContactSeek, Framework Optimasi Pengeditan Gen Berbasis Probabilitas Kontak AF3 : Tim peneliti gabungan menerbitkan makalah di jurnal Nature, mengusulkan ContactSeek, sebuah framework AI yang menggunakan Contact Probability (CP) yang diprediksi oleh AlphaFold3 untuk mengoptimalkan spesifisitas pengedit gen. Framework ini berhasil mengidentifikasi residu kontak kunci dalam interaksi antara protein Cas dan DNA/RNA, serta merancang varian base editor dengan fidelitas tinggi. (Sumber: Nature)
.jpg)
LiteLLM Alami Serangan Rantai Pasokan Skala Besar yang Mengakibatkan Kebocoran Kredensial Sebesar Beberapa Terabyte : Lembaga keamanan mengungkapkan bahwa alat pengembangan AI open-source LiteLLM mengalami serangan rantai pasokan (supply chain attack) pada bulan Maret. Melalui versi berbahaya di sumber PyPI resmi, peretas mencuri kunci cloud, API Token, dan SSH private key dari 2.500 perusahaan termasuk Microsoft, Amazon, dan Salesforce dalam waktu 40 menit, dengan data yang bocor mencapai 195TB. (Sumber: Ars Technica)
Apple Bernegosiasi untuk Membayar Penerbit Berita Guna Meningkatkan Layanan Berita AI Siri : Menurut laporan, Apple sedang melakukan pembicaraan dengan beberapa penerbit berita utama, mengusulkan pembayaran ketika Siri menggunakan konten berita penerbit untuk menjawab pertanyaan pengguna atau menghasilkan ringkasan. Langkah ini bertujuan untuk memperoleh data real-time berkualitas tinggi yang patuh hukum guna meningkatkan pengalaman asisten pintar Siri. (Sumber: The Wall Street Journal)
Google Rilis Seri Pixel 11 dan Tingkatkan Fitur Gemini AI Secara Menyeluruh : Google merilis seri ponsel Pixel 11 pada acara Made by Google ‘26. Ponsel baru ini dilengkapi dengan prosesor Tensor G6 dan integrasi mendalam dengan Gemini. Fitur-fitur baru mencakup dukungan untuk konversi real-time bahasa isyarat ASL ke teks, input suara Rambler yang dapat memahami ekspresi sehari-hari, serta sinkronisasi data kesehatan dengan Pixel Watch 5. (Sumber: TechCrunch)

iFlytek Rilis Matriks Agent Layanan Perusahaan yang Mencakup Tujuh Skenario Inti : iFlytek meluncurkan matriks agent yang mencakup tujuh skenario seperti manajemen cerdas, proses IT, dan transaksi rantai pasokan, mendorong AI perusahaan dari “menyelesaikan tindakan titik tunggal” menjadi “memberikan hasil bisnis”. Produk-produk tersebut mencakup agent audit kepatuhan yang mendukung pengawasan pengadaan, serta agent SparkOS dengan interaksi super-humanoid. (Sumber: QbitAI)

Mantan Kepala Robotika ByteDance Kong Tao Bergabung dengan Xiaomi, Menjabat sebagai Kepala Departemen Embodied AI dan Aplikasi : Mantan kepala tim robotika ByteDance, Kong Tao, baru-baru ini bergabung dengan Xiaomi untuk memimpin “Departemen Embodied AI dan Aplikasi” yang baru didirikan. Skenario fisik nyata Xiaomi dalam ekosistem penuh “Manusia x Mobil x Rumah” seperti manufaktur mobil pintar, dianggap sebagai faktor kunci yang menarik doktor ilmu komputer lulusan Tsinghua University ini untuk bergabung. (Sumber: 36Kr)
Canva Pangkas Sepertiga Prediksi Pertumbuhan Pendapatan karena Biaya Komputasi AI yang Tinggi : Unicorn perangkat lunak desain Canva menurunkan perkiraan tingkat pertumbuhan pendapatannya menjadi 20%. CEO Melanie Perkins mengungkapkan bahwa permintaan pengguna terhadap fitur AI jauh melampaui ekspektasi, menyebabkan lonjakan biaya komputasi. Perusahaan memutuskan untuk memperlambat promosi beberapa fitur AI dan membangun kembali arsitektur dasar guna mengurangi biaya token per tugas. (Sumber: Reddit)

🧰 Alat
LlamaIndex Rilis ExtractBench dan LlamaExtract Agentic Plus : LlamaIndex meluncurkan ExtractBench, sebuah dataset evaluasi ekstraksi informasi dokumen perusahaan. Untuk mengatasi masalah penurunan recall rate pada VLM terdepan saat mengekstrak dokumen panjang, mereka meluncurkan LlamaExtract Agentic Plus, yang memproses dokumen panjang melalui iterasi tersegmentasi dan mencapai skor F1 sebesar 96,1% pada tugas ekstraksi daftar panjang. (Sumber: LlamaIndex)
OpenAI Luncurkan ChatGPT Work Enterprise Workspace dan Alat Pembuat Halaman Web Sites : Alat ini dapat mengintegrasikan dokumen perusahaan di Google Drive, kinerja keuangan di NetSuite, dan diskusi tim di Slack secara mulus. Pengguna dapat secara otomatis menyelesaikan audit keuangan kuartalan yang kompleks dan analisis data perkiraan melalui instruksi bahasa alami, serta membuat dasbor data Sites yang interaktif dengan satu klik. (Sumber: OpenAI)

Alat Manajemen Hubungan Mesh dari Automattic Hadir di Platform Android : Alat manajemen hubungan pribadi dan CRM Mesh (sebelumnya bernama Clay) meluncurkan versi Android. Aplikasi ini mendukung tampilan split-screen dan pop-up, serta dapat dihubungkan dengan perangkat lunak perpesanan multi-platform seperti Beeper. Nexus AI bawaannya memungkinkan pengguna menggunakan bahasa alami untuk mencari pakar industri atau kontak di kota tertentu dalam jaringan relasi mereka. (Sumber: TechCrunch)

📚 Pembelajaran
DeepLearning.AI Berkolaborasi dengan JetBrains Luncurkan Kursus Singkat “AI Coding Workflows: From Cloud to Local” : Kursus ini dipandu oleh Paul Everitt, Developer Advocate dari JetBrains, yang membimbing peserta untuk membangun aplikasi Python di lingkungan cloud, hibrida, dan sepenuhnya lokal. Kursus ini mencakup cara menggunakan sub-agent untuk memecah tugas, cara mengurangi biaya melalui model routing, dan cara mengonfigurasi coding agent open-source secara lokal. (Sumber: DeepLearning.AI)
IIT Bombay dan Adobe Research Usulkan Metode PTP untuk Ekstraksi Terbalik Prompt LLM : Tim peneliti gabungan menerbitkan makalah yang memperkenalkan metode ekstraksi terbalik bernama Pre-Token Prediction (PTP). Dengan melatih model terbalik pada output sintetis dari LLM target, metode ini mampu memulihkan system prompt model besar dan data privasi pengguna dengan fidelitas yang sangat tinggi, tanpa memerlukan akses ke bobot model. (Sumber: arXiv)

Tim OpenMOSS Open-Source-kan Model World Critic Model (WCM) untuk Kontrol RL Embodied : Tim peneliti gabungan meng-open-source-kan framework WCM. Untuk mengatasi masalah observabilitas parsial dalam kontrol robot, WCM memprediksi status laten berikutnya setelah tindakan dieksekusi sambil memperkirakan nilai status. Eksperimen menunjukkan bahwa pengenalan prediksi status masa depan dapat secara signifikan meningkatkan efisiensi model VLA dalam reinforcement learning pada robot nyata. (Sumber: arXiv)
.jpg)
Dataset Open-Source OpenWALDO Berkomitmen Menyediakan Sumber Data Pelatihan AI yang Aman dan Transparan : Menanggapi masalah kurangnya transparansi data pelatihan model open-source, pendiri CentOS Gregory Kurtzer memprakarsai proyek OpenWALDO. Proyek ini bertujuan untuk membangun dataset pelatihan AI yang sepenuhnya terbuka dan dapat diaudit, yang saat ini telah mencakup 167,3 miiliar token referensi yang bersumber dari literatur domain publik dan makalah akademis. (Sumber: The Register)
💼 Bisnis
Platform Pengembangan Perangkat Lunak No-Code Lovable Selesaikan Pendanaan Seri C Senilai 400 Juta USD : Startup “pemrograman visual” asal Swedia, Lovable, mengumumkan penyelesaian pendanaan Seri C senilai 400 juta USD, yang dipimpin oleh Menlo Ventures dengan partisipasi dari Tencent dan lainnya, melipatgandakan valuasinya menjadi 13,3 miliar USD dalam waktu 7 bulan. ARR perusahaan telah mencapai 600 juta USD, memungkinkan pengguna untuk menyelesaikan seluruh proses mulai dari konsep aplikasi hingga peluncuran operasional langsung di platform. (Sumber: TechCrunch)

Thrive Holdings Kumpulkan Pendanaan 2 Miliar USD untuk Mendorong Penerapan Model OpenAI di Industri Tradisional : Perusahaan ekuitas swasta yang berfokus pada penerapan AI, Thrive Holdings, mengumumkan perolehan dana baru sebesar 2 miliar USD, dengan valuasi mencapai 12 miliar USD. Perusahaan ini mengoptimalkan workflow dengan mengakuisisi bisnis tradisional seperti akuntansi dan IT, serta menanamkan model OpenAI secara langsung. Dana baru ini akan digunakan untuk mengeksplorasi bisnis baru seperti pengawasan aset fisik. (Sumber: TechCrunch)
IBM dan Together AI Capai Kesepakatan Sewa Kluster Nvidia Blackwell Senilai 240 Juta USD : IBM dan Together AI menandatangani perjanjian kerja sama multi-tahun senilai 240 juta USD. Together AI akan men-deploy kluster komputasi AI yang berisi 2.000 chip Nvidia B300 (Blackwell) di IBM Cloud, guna menyediakan layanan inferensi cloud yang efisien untuk model besar open-source seperti DeepSeek dan Kimi. (Sumber: IBM)

🌟 Komunitas
Komunitas Diskusikan Rendahnya Adopsi Komersial Fable 5 dan Batas Atas Pengeluaran AI Perusahaan : Data dari penyedia layanan keuangan Ramp menunjukkan bahwa Fable 5 hanya menyumbang 11,4% dari total pengeluaran perusahaan untuk model Anthropic pada bulan pertama peluncurannya. Analisis menunjukkan bahwa harga tinggi sebesar 50 USD per juta output telah menyentuh batas atas pengeluaran AI perusahaan. Tanpa kemampuan untuk mengukur ROI, perusahaan beralih ke model open-source atau model berukuran menengah-ringan yang lebih hemat biaya. (Sumber: Ramp)

Para Developer Diskusikan Batasan antara “Harness” dan Kemampuan Model dalam Alat Pemrograman AI : Setelah Opus 5 berhasil menyelesaikan ARC-AGI-3 dengan menulis 269 program secara mandiri, para developer berdiskusi dan berpendapat bahwa seiring dengan meningkatnya kemampuan penalaran model, prompt yang dirancang berlebihan dan framework Agent eksternal yang kompleks (Harness) justru menjadi “tali” yang membatasi kinerja model. Di masa depan, antarmuka lingkungan yang minimalis akan menjadi tren. (Sumber: 36Kr)
Kelompok Kerja AI Royal Statistical Society Serukan Penerapan Prinsip Statistik dalam Regulasi AI : Royal Statistical Society menerbitkan laporan yang menunjukkan bahwa karena model AI berkembang secara dinamis seiring dengan lingkungan setelah di-deploy, tinjauan kepatuhan statis tradisional tidak dapat mencegah risiko secara efektif. Kelompok kerja tersebut menyerukan kepada badan regulasi untuk membangun kemampuan evaluasi statistik guna melakukan audit berkelanjutan terhadap perilaku AI Agent dalam skenario bisnis nyata. (Sumber: RSS)

Halusinasi AI Mengakibatkan Kerugian Pertanian, Memicu Diskusi tentang Batasan Pengambilan Keputusan Otomatis : Komunitas ramai mendiskusikan insiden hancurnya 25 ekar tanaman akibat mengikuti saran AI. Aplikasi AI secara keliru merekomendasikan agen kimia yang membunuh gulma sekaligus tanaman. Warganet menunjukkan bahwa dalam keputusan yang melibatkan dunia fisik, mempercayai saran otomatis AI secara buta tanpa verifikasi manusia akan membawa konsekuensi serius. (Sumber: X)
💡 Lainnya
Kellanova Gunakan Teknologi Digital Twin Siemens untuk Optimalkan Lini Produksi Keripik Kentang : Raksasa makanan ringan Kellanova menginvestasikan 5 juta USD untuk men-deploy sistem digital twin real-time untuk kentang tumbuk di pabriknya di Polandia. Sensor mengumpulkan 200 titik data setiap milidetik dan memasukkannya ke dalam model machine learning untuk menyempurnakan resep secara otomatis, mengurangi limbah lini produksi sebesar 13% dan menurunkan konsumsi energi sebesar 7%. (Sumber: X)
IPO Unitree Robotics Dipesan oleh Hampir 10 Juta Akun, Catatkan Rekor Terendah Tingkat Alokasi Saham dalam Sejarah STAR Market : Jumlah akun langganan online untuk IPO saham-A Unitree Robotics melampaui 9,78 juta, dengan tingkat alokasi (winning rate) hanya 0,018%, mencatatkan rekor terendah baru dalam sejarah STAR Market (Sci-Tech Innovation Board). Nilai pasar penerbitan mencapai 61 miliar RMB. Selain itu, perusahaan kecerdasan buatan DeepSeek telah dikonfirmasi berpartisipasi dalam penempatan sebagai investor strategis, dan kedua belah pihak akan melakukan penelitian dan pengembangan bersama seputar embodied AI dan model besar. (Sumber: 36Kr)
Suno Jalin Kemitraan dengan BMG, Namun Watermark Digital Memicu Kekhawatiran Kreator : Platform pembuat musik Suno mengumumkan kemitraan global dengan BMG untuk menempatkan kreator manusia di pusat ekosistem musik AI. Namun, watermark digital ireversibel yang ditambahkan secara paksa oleh Suno ke dalam trek audio telah memicu reaksi keras dari komunitas, dengan kekhawatiran dari para kreator bahwa hal ini akan menjadi alat bagi label rekaman dan platform untuk melakukan pengawasan hak cipta dan penghapusan konten. (Sumber: Suno)