🔥 Sorotan
OpenAI Pangkas Signifikan Harga API dan Kredit GPT-5.6 Sol Sebesar 20% : OpenAI resmi mengumumkan penurunan harga API dan kredit untuk GPT-5.6 Sol lebih dari 20% selama 3 bulan ke depan mulai hari ini. Dengan diskon bertumpuk di platform seperti Devin, diskon aktual dapat mencapai 76%. Analisis industri menunjukkan bahwa seiring dengan ekspansi pusat komputasi milik OpenAI sendiri dan peningkatan efisiensi inferensi, langkah ini bertujuan untuk menghadapi secara langsung dampak model open-source yang sangat hemat biaya (seperti DeepSeek, GLM) terhadap pasar enterprise, serta memberikan tekanan harga pada pesaing closed-source terdepan. (Sumber: OpenAI)
Anthropic Buka Akses Claude Mythos 5 untuk Pertahanan Keamanan Siber bagi Enterprise : Anthropic secara resmi menghadirkan Claude Mythos 5, yang memiliki kemampuan keamanan siber tingkat tinggi, ke dalam alat pemindaian kerentanan kode kelas enterprise Claude Security dan memulai uji coba publik. Alat ini secara langsung menghasilkan klasifikasi CWE, tingkat keyakinan (confidence level), dan saran perbaikan melalui pipeline prasetel tanpa menyediakan jendela prompt bebas, guna mencegah penyerang memanfaatkannya untuk menulis kode eksploitasi berbahaya; pada saat yang sama, Anthropic mendirikan dana hibah sebesar $35 juta untuk mendukung keamanan perangkat lunak open-source. (Sumber: THE DECODER、MarkTechPost)
Anthropic Dikabarkan Siapkan IPO Terbesar dalam Sejarah Senilai Ratusan Miliar Dolar dan Bentuk Tim Chip Mandiri : Bank investasi dilaporkan sedang membantu Anthropic mempersiapkan penawaran umum perdana (IPO) paling cepat pada kuartal keempat tahun ini, dengan target penggalangan dana lebih dari $100 miliar dan valuasi yang berpotensi mencapai $2 triliun. Di saat yang sama, mantan pimpinan inti Google TPU, Amir Salek, telah resmi bergabung dengan divisi komputasi Anthropic untuk memimpin pengembangan chip mandiri. Menghadapi pengeluaran komputasi tahunan yang mendekati $20 miliar, laboratorium frontier AI terkemuka mempercepat penataan perangkat keras lapisan dasar, bertransisi dari pengembang model murni menjadi raksasa infrastruktur yang terintegrasi secara vertikal. (Sumber: 机器之心、srimuppidi)
.jpg)
UC Berkeley dan Lainnya Merilis FreeToken Open-Source: Jalankan Model MoE Puluhan hingga Ratusan Miliar Parameter dengan Lancar di GPU Konsumen : Tim peneliti dari institusi seperti UC Berkeley dan MIT telah merilis sistem inferensi MoE edge-side bernama FreeToken secara open-source. Melalui buffering ganda all-layer, penjadwalan dinamis adaptif bandwidth CPU/GPU, dan penggunaan kembali status inkremental multi-round untuk Agent, sistem ini berhasil menjalankan Qwen3.6-35B pada laptop RTX 4060 dengan kecepatan 39,3 tok/s, serta menjalankan DeepSeek-V4-Flash 284B pada RTX 5090 dengan kecepatan 22-25 tok/s, mengatasi bottleneck I/O dalam implementasi MoE VRAM besar secara lokal. (Sumber: 机器之心)
.jpg)
🎯 Perkembangan
Netflix Luncurkan GenRec, Sistem Rekomendasi Native Berbasis LLM : Netflix mengumumkan sistem rekomendasi generasi baru GenRec, yang mengubah perilaku pemutaran, penyelesaian tontonan, dan interaksi pengguna menjadi urutan dialog bahasa alami, serta menggunakan LLM open-source yang telah di-fine-tune untuk penilaian kandidat secara end-to-end. Dibandingkan dengan mesin rekomendasi rekayasa fitur tradisional yang dipelihara selama bertahun-tahun, GenRec membutuhkan data berlabel 40 kali lebih sedikit pada pelatihan tahap kedua, dan kualitas rekomendasi meningkat secara signifikan baik dalam pengujian A/B offline maupun online, menandai pergeseran arsitektur rekomendasi ke paradigma LLM-native. (Sumber: THE DECODER)

Tim Tiongkok Luncurkan Proyek Embodied AI Antariksa SpaceClaw “Lobster Luar Angkasa” : Chaonao Future, Future Aerospace, dan Cloud希Tech mencapai kerja sama strategis untuk meluncurkan proyek embodied AI luar angkasa open-source pertama, SpaceClaw, dengan rencana untuk menyelesaikan verifikasi cengkeraman kolaboratif lengan ganda dalam mikrogravitasi di orbit dalam waktu 6 bulan. Proyek ini juga merilis OrbitBench, tolok ukur evaluasi yang mencakup berbagai lingkungan gravitasi, guna membangun siklus tertutup data embodied kelas kedirgantaraan yang terdiri dari “simulasi darat – penerapan model ke satelit – operasi di orbit – transmisi data kembali”. (Sumber: 机器之心)
.jpg)
UBTECH, VitaPower, dan Lainnya Tampilkan “On-Device Embodied AI” dan “Pewarisan Lintas-Ontologi” di WRC : UBTECH mereplikasi lini produksi industri di World Robot Conference 2026, memamerkan world model Thinker-WM yang dikembangkan secara mandiri serta kemampuan penerapan VLA di perangkat edge; sementara itu, VitaPower mengusulkan sistem “Genom Embodied”, yang memisahkan semantik tingkat tinggi dari adaptor kontrol gerak tingkat rendah untuk mencapai transfer cerdas lintas ontologi dari robot berkaki empat ke robot humanoid. Konsensus industri kini bergeser dari demo laboratorium ke data loop tertutup pada mesin nyata berintensitas tinggi dan stabilitas operasional di lokasi kerja. (Sumber: 量子位、机器之心)

Lightwheel dan Hugging Face Rilis EgoSuite-Open100K, Dataset Embodied Sudut Pandang Orang Pertama 100.000 Jam secara Open-Source : Lightwheel bermitra dengan Hugging Face untuk merilis dataset multimodal sudut pandang orang pertama (first-person) skala besar bernama EgoSuite-Open100K yang mendukung pelatihan komersial. Mencakup lebih dari 15.000 skenario tugas nyata, postur tangan dan tubuh, serta sudut pandang kamera pergelangan tangan, dataset ini menyediakan basis data terbuka untuk scaling law AI dunia fisik dan model tindakan robotik (robot action models). (Sumber: huggingface)
NVIDIA Usulkan Teknik Transfer Linier KV Cache Lintas-Model : Peneliti NVIDIA mengusulkan skema pemetaan closed-form ridge regression tanpa pelatihan backpropagation, yang memungkinkan konversi langsung KV Cache yang telah di-prefill di antara model dari keluarga yang sama dengan ukuran berbeda (seperti Qwen 14B ke 32B, Llama 8B ke 70B). Metode ini 2,7 hingga 25 kali lebih cepat daripada menghitung ulang konteks sambil mempertahankan akurasi hingga 98%, secara efektif mengurangi latensi peralihan antar-model dalam alur kerja kolaboratif multi-model. (Sumber: VentureBeat)
“Kecurangan Peringkat Tolok Ukur” (Benchmaxxing) Meluas di Bidang Pengenalan Suara : Penelitian bersama antara Hume AI dan Hugging Face menunjukkan bahwa model ASR open-source saat ini mengalami overfitting yang parah pada tolok ukur seperti VoxPopuli. Pengujian menunjukkan bahwa beberapa model bahkan dapat “menebak secara buta” dan merekonstruksi kesalahan dalam teks tolok ukur meskipun angka kunci pada audio telah dibisukan, bergantung pada petunjuk akustik untuk mengenali dataset uji. Studi ini mendesak agar evaluasi menerapkan dataset holdout yang ketat dan mekanisme blind test. (Sumber: HuggingFace Blog)

Apple Music Wajibkan Label Transparansi untuk Musik Buatan AI : Apple telah mengirimkan pemberitahuan kepada mitra industri, mengumumkan bahwa akhir tahun ini mereka akan mewajibkan penambahan label transparansi (AI Transparency Tags) untuk lagu-lagu yang mengandung konten buatan AI di platform Apple Music. Langkah ini dilakukan untuk mengatasi lonjakan pemalsuan AI dan penipuan streaming, yang menandai pengetatan regulasi menyeluruh terhadap audio generatif oleh platform streaming musik arus utama. (Sumber: TechRadar)

🧰 Alat
nodeterm: Terminal Kanvas Tak Terbatas Berbasis Node untuk AI Coding Agent : Pengelola terminal open-source nodeterm memetakan sesi multi-tmux dan interaksi AI Agent ke kanvas pan/zoom tak terbatas, mendukung eksekusi paralel beberapa sesi Claude Code, Codex, dll. dalam satu ruang kerja, mengintegrasikan input suara Whisper edge-side dan manajemen Kanban, yang dirancang khusus untuk menyelesaikan masalah fragmentasi konteks dalam pengembangan multi-agent yang kompleks. (Sumber: GitHub Trending)

Apache Maka (Incubating): Ruang Kerja dan Buku Besar Eksekusi AI Agent Lokal-Utama (Local-First) : Proyek inkubasi Apache, Maka, resmi dirilis secara open-source. Mengadopsi arsitektur local-first, proyek ini mengabstraksikan pesan model besar, pemanggilan tools, keputusan izin, dan pemulihan interupsi ke dalam log peristiwa (Event Log) runtime yang dapat ditambahkan (appendable). Sambil melindungi keamanan data lokal, sistem ini menyediakan fondasi eksekusi dan evaluasi Agent yang terpadu untuk desktop dan CLI. (Sumber: GitHub Trending)
Amazon Bedrock Hadirkan AgentCore Gateway dan Platform Operasi Data ADOP : AWS meluncurkan AgentCore Gateway, yang menyediakan autentikasi terpusat, kontrol kebijakan Cedar, dan desensitisasi data PII untuk pemanggilan tools MCP (Model Context Protocol) enterprise; serta merilis framework ADOP open-source, yang merangkum pembuatan kode ETL, pembersihan data, dan audit kepatuhan ke dalam pipeline R&D Agent yang dapat direproduksi, sehingga mempersingkat siklus penyerapan sumber data secara signifikan. (Sumber: AWS Machine Learning Blog)

OBLITERATUS: Perangkat Open-Source untuk Deteksi Geometris dan Ablasi Mekanisme Penolakan LLM : Pengembang telah merilis OBLITERATUS, perangkat penelitian untuk representasi penolakan dalam ruang aktivasi Transformer secara open-source. Alat ini mendukung ekstraksi SVD diputihkan (whitened SVD), analisis geometri kerucut konsep (concept cone), dan kontrol vektor pengarah pada saat inferensi, yang memungkinkan para peneliti untuk mengeksplorasi dan menghilangkan perilaku penolakan berlebih pada model tanpa perlu melatih ulang. (Sumber: GitHub Trending)
📚 Pembelajaran
Stanford Rilis CS336 Open-Source: Kursus Praktik Membangun LLM dari Awal : Stanford University membuka seluruh materi kursus CS336 yang diampu oleh Percy Liang dan Tatsu Hashimoto. Kursus ini mencakup seluruh alur kerja mulai dari menulis Transformer manual dengan PyTorch murni, pre-training terdistribusi, proporsi data, optimalisasi preferensi RLHF/DPO, hingga KV cache dan analisis inferensi. Semua tugas pemrograman dan materi kuliah tersedia sepenuhnya secara terbuka. (Sumber: stanfordnlp)

LoopsBench: Tolok Ukur Evaluasi Proses Eksekusi Coding Agent untuk Rekayasa Perangkat Lunak Jangka Panjang : Microsoft bersama Nanjing University dan institusi lainnya mengusulkan LoopsBench, yang memecah pengembangan perangkat lunak jangka panjang menjadi grafik DAG dependensi yang berisi lebih dari 5.300 unit. Fokus evaluasi beralih dari sekadar tingkat penyelesaian akhir tunggal menjadi pengujian kemampuan Agent dalam mengidentifikasi dependensi tugas, persistensi status, dan kontrol regresi, serta menunjukkan bahwa rekayasa loop dan retensi status telah menjadi hambatan utama bagi Agent jangka panjang. (Sumber: 机器之心)
.jpg)
SOP-Bench: Amazon Rilis Tolok Ukur untuk Mengevaluasi AI Agent dalam Menjalankan SOP Bisnis Enterprise Nyata : Amazon merilis SOP-Bench di KDD 2026, yang mencakup 12 domain seperti layanan kesehatan, kepatuhan, dan logistik, berisi lebih dari 2.000 tugas prosedur bisnis dengan tools nyata. Pengujian menemukan bahwa pembaruan parameter model tidak serta merta meningkatkan eksekusi SOP, dan pustaka tools yang redundan dapat memangkas tingkat keberhasilan hingga setengahnya, menekankan pentingnya kontrol batas alur proses bagi Agent. (Sumber: Amazon Science)
MWM/MENTIS: Kerangka Kerja “Mental World Model” yang Mengintegrasikan Simulasi Keadaan Mental : Untuk mengatasi kelemahan model dunia yang ada saat ini—yang hanya memodelkan lingkungan fisik dan mengabaikan niat manusia—para peneliti mengusulkan Mental World Modeling (MWM) dan implementasi referensinya, MENTIS. Dengan memisahkan beban fisik dan beban mental dari suatu tindakan serta melakukan penalaran bercabang, model ini meningkatkan skor F1 sebesar 26,4 poin persentase dalam skenario pengambilan keputusan interaksi manusia. (Sumber: THE DECODER)

Analisis Mendalam Mekanisme Watermark Teks AI: Penandaan Tak Kasat Mata Bebas Rugi Berbasis Sampling Pseudorandom : Pakar machine learning menguraikan mekanisme watermarking teks SynthID yang digunakan oleh model-model besar terkemuka seperti Claude. Metode ini menggantikan sumber angka pseudorandom dengan kunci privat pada tahap sampling probabilitas model, sehingga distribusi teks yang dihasilkan tetap tidak berubah dan tidak mengurangi kualitas output, serta memungkinkan pihak pendeteksi memverifikasi asal teks secara cepat tanpa perlu menjalankan ulang LLM. (Sumber: Ahead of AI)
💼 Bisnis
NVIDIA Lakukan Investasi Strategis di Pengembang Daya Pusat Data Cloverleaf : NVIDIA mengumumkan kemitraan strategis dengan pengembang infrastruktur tenaga listrik Cloverleaf Infrastructure dan melakukan investasi saham minoritas senilai ratusan juta dolar. Cloverleaf, yang berperan sebagai jembatan antara utilitas jaringan listrik dan pusat komputasi, akan membantu NVIDIA mempercepat pengadaan daya dan integrasi jaringan untuk pusat data AI skala besar. (Sumber: TechCrunch)
Lembaga Private Credit Termasuk Apollo Berencana Sediakan Pembiayaan Utang Ratusan Miliar Dolar untuk Infrastruktur AI : Menurut laporan, Broadcom sedang bernegosiasi dengan Blackstone dan Apollo untuk memperluas paket kredit terstruktur hingga sekitar $100 miliar guna mendanai komputasi AI dan penerapan chip bagi perusahaan seperti Anthropic. Hal ini menunjukkan bahwa Capex infrastruktur AI semakin bergantung pada sistem kredit privat dengan jaminan aset yang kompleks. (Sumber: Reddit r/artificial)
Divergensi Lanskap GPU Neoclouds Q2 2026: CoreWeave dan Nebius Memimpin : Data industri menunjukkan pendapatan Q2 CoreWeave mencapai $2,58 miliar dengan premi harga yang tetap tinggi; ARR komputasi awan AI Nebius melampaui $3 miliar dengan strategi harga rendah yang agresif untuk Blackwell; sementara Lambda dan Crusoe bersaing melalui diferensiasi pada chip tertentu (seperti harga terendah B200, AMD MI300X) serta skala kontrak daya listrik. (Sumber: MarkTechPost)
🌟 Komunitas
Studi Empiris Memperingatkan: Ketergantungan Berlebih pada AI Menyebabkan Penurunan Kemampuan Kognitif Kritis Pelajar dan Profesional : The Economist dan beberapa studi melacak 27.000 siswa yang menggunakan AI untuk mengerjakan PR, menemukan bahwa waktu pengerjaan tugas berkurang 30% tetapi nilai ujian closed-book turun 20%, dan pengguna jangka panjang hampir sepenuhnya berhenti melakukan penalaran mandiri. Fenomena serupa juga muncul dalam pemeriksaan endoskopi medis dan di kalangan programmer, memicu diskusi hangat di komunitas bahwa “cognitive offloading” (pelepasan beban kognitif) mengikis kemampuan inti manusia dalam membangun mental model dan mendeteksi serta memperbaiki kesalahan. (Sumber: 36氪)

Penolakan Warga AS terhadap Pusat Data AI Melonjak hingga 75% : Jajak pendapat terbaru menunjukkan bahwa proporsi warga AS yang menentang pembangunan pusat data AI di sekitar tempat tinggal mereka melonjak dari 42% setahun lalu menjadi 75%. Konsumsi air, kenaikan tarif listrik, dan penggunaan lahan memicu penolakan keras dari pemilih kedua partai, membuat beberapa politisi merespons sentimen publik dengan menghambat realisasi proyek. Konflik antara pemilihan lokasi pusat data dan konsumsi energi lokal telah menjadi kendala nyata bagi ekspansi di seluruh AS. (Sumber: THE DECODER)

WAU Codex Capai 20 Juta, Ekspansi Multi-Skenario Pangkas Jarak dengan Claude Code : OpenAI mengonfirmasi bahwa pengguna aktif mingguan (WAU) Codex dan Agent kerja mencapai 20 juta, dengan proporsi pengguna non-developer yang meningkat. Meskipun Claude Code masih memiliki keunggulan dalam kedalaman pemrograman profesional, Codex dengan cepat meningkatkan volume penggunaannya dalam otomatisasi harian non-programmer dan alur kerja enterprise berkat integrasi konvergen dengan gerbang super ChatGPT serta strategi penurunan harga. (Sumber: 36氪)

Model Lama Anthropic Opus 4.6 Dilaporkan Dapat Di-jailbreak untuk Menghasilkan Konten Sensitif Melalui Bimbingan Moral Multi-Putaran : Peneliti keamanan independen mengungkapkan bahwa dengan menuduh AI memiliki stereotip gender dan proteksionisme berlebihan dalam percakapan multi-round, Claude Opus 4.6 berhasil dipandu untuk melewati batasan keamanan dan menghasilkan teks pornografi eksplisit. Meskipun Opus 5 telah memperbaiki kerentanan ini, ketersediaan model lama pada API kembali memicu diskusi komunitas mengenai tata kelola keamanan long-tail. (Sumber: TechCrunch)
💡 Lainnya
Investigasi Internal Supermicro Menyatakan Tidak Menemukan Eksekutif Mengetahui Penyelundupan Chip : Komite khusus dewan direksi Supermicro mengumumkan kesimpulan investigasi independen, yang menyatakan tidak menemukan adanya manajemen senior saat ini yang mengetahui rencana penyelundupan chip NVIDIA ke Tiongkok senilai $2,5 miliar. Sebelumnya, Departemen Kehakiman AS telah mendakwa mantan direkturnya. Meskipun penyelidikan internal telah rampung, investigasi oleh dewan juri federal AS (federal grand jury) masih terus berlanjut. (Sumber: Fortune)
Raksasa Kredit Komputasi AI Apollo Konfirmasi Alami Kebocoran Data Siber : Apollo, lembaga private equity utama yang terlibat dalam konsorsium infrastruktur dan pinjaman beragun komputasi GPU senilai miliaran dolar, mengonfirmasi bahwa mereka telah diretas dan beberapa informasi sensitif karyawan bocor. Mengingat posisi kunci Apollo dalam sekuritisasi aset AI dan pembiayaan agunan komputasi, pihak luar sangat mengkhawatirkan apakah transaksi AI internal dan data underwriting infrastruktur mereka ikut terdampak. (Sumber: The Verge)