OpenAI, Anthropic, dan Google Berencana Membentuk Badan Keamanan… | Berita AI 2026-09-26

🔥 Sorotan

OpenAI, Anthropic, dan Google Berencana Membentuk Badan Keamanan Frontier AI Bernama SAFA : Menurut laporan The Information, OpenAI, Anthropic, dan Google sedang bersiap mendirikan organisasi keamanan frontier AI bernama “Frontier AI Standards Authority” (SAFA), yang direncanakan meluncur resmi pada awal 2027. Badan ini dimaksudkan untuk mengoordinasikan pengujian independen pihak ketiga sebelum penerapan model, menetapkan mekanisme pelaporan insiden industri serta tolok ukur (benchmark), yang dipandang sebagai pertahanan standar dan disiplin mandiri industri oleh raksasa teknologi di tengah meningkatnya risiko hilangnya kendali model frontier dan pengetatan regulasi di berbagai negara (Sumber: The Verge)

Gedung Putih Minta OpenAI dan Anthropic Prioritaskan Tinjauan Model Frontier oleh AS : Kantor Direktur Siber Nasional Gedung Putih telah meminta OpenAI dan Anthropic agar menyerahkan model frontier terbaru mereka untuk ditinjau oleh lembaga resmi AS terlebih dahulu sebelum membagikannya kepada AI Safety Institute (AISI) Inggris. Anthropic telah menyesuaikan langkah ini dengan membatasi beberapa versi frontier hanya untuk lembaga AS. Langkah ini menyoroti persaingan langsung antar-negara besar dalam evaluasi teknologi inti frontier AI dan dominasi keamanan nasional, sekaligus memicu gesekan institusional dalam kolaborasi evaluasi keamanan lintas batas antara AS dan Inggris (Sumber: THE DECODER)

Anthropic Berencana Menetapkan Struktur Super-Voting: 7 Co-founder Hanya Miliki 2% Saham namun Akan Kuasai 50,1% Hak Suara : Anthropic, menjelang IPO bernilai triliunan dolar, sedang meminta persetujuan pemegang saham untuk skema tata kelola baru. CEO Dario Amodei beserta 7 co-founder lainnya, meskipun masing-masing hanya memegang sekitar 2% saham, selama setidaknya 3 di antaranya memenuhi ambang batas kepemilikan, dapat mengendalikan secara kolektif 50,1% hak suara perusahaan melalui founder voting trust mirip Palantir. Struktur ini bertujuan memisahkan kepentingan ekonomi dari kendali pengambilan keputusan, guna membendung campur tangan tekanan profit jangka pendek Wall Street terhadap riset alignment dan keamanan AI jangka panjang (Sumber: 机器之心, 36氪, kimmonismus)

Anthropic Berencana Menetapkan Struktur Super-Voting

Google Meluncurkan Uji Coba Pusat Komputasi AI Bertenaga Surya di Luar Angkasa Suncatcher : Google mengumumkan bahwa satelit eksperimental MVP pertama dari pusat data AI orbitalnya, “Project Suncatcher”, dijadwalkan meluncur pada 1 Oktober dengan menumpang SpaceX Falcon 9 (misi Transporter-18). Satelit ini membawa 4 akselerator Trillium TPU kustom bertenaga surya, yang bertujuan memverifikasi kelayakan menjalankan inferensi AI di lingkungan ekstrem luar angkasa dengan memanfaatkan energi surya 8 kali lebih besar dari daratan. Uji coba utamanya mencakup pembuangan panas di ruang hampa dan komputasi orbital berefisiensi energi tinggi, dengan rencana pengujian interkoneksi laser berkecepatan tinggi antar-satelit pada 2027 (Sumber: Ars Technica, Google, dotey)

OpenAI Dilaporkan Sedang Menyiapkan Paket ChatGPT Pro Max Seharga $500 per Bulan : Pengembang mengungkap tingkatan langganan baru “Pro Max” berbiaya hingga $500 per bulan dari kode front-end ChatGPT, yang berfokus pada “kecepatan eksekusi Work dan Codex tercepat” serta kemungkinan akses ke komputasi latensi rendah khusus. Setelah konsumsi daya komputasi inferensi besar-besaran oleh GPT-6 Astra yang menyebabkan pembatasan langganan pada beban tinggi sebelumnya, OpenAI kini melakukan isolasi berjenjang komputasi untuk skenario produktivitas berat melalui premi harga tinggi, menandakan daya komputasi mutakhir makin terkonsentrasi pada perusahaan bernilai tinggi dan institusi profesional (Sumber: 36氪, nicdunz)

ChatGPT akan menjual paket Pro Max seharga $500!

🎯 Perkembangan

Google Rilis Gemini 3.8 Live dan Model Avatar Virtual Real-Time : Google resmi meluncurkan Gemini 3.8 Live dan fitur Live Avatar, mengintegrasikan secara mendalam dialog streaming real-time dengan pembuatan video avatar dinamis berlatensi rendah. Model ini mendukung sinkronisasi bibir audio-video native dalam 97 bahasa dan pemanggilan background tool secara asinkron, menyediakan pembuatan avatar kustom untuk skenario interaksi tingkat enterprise, serta sepenuhnya disematkan watermark SynthID (Sumber: Google DeepMind Blog)

Meta Rilis Model Embodied Real-Time Muse Realtime Avatar : Meta merilis arsitektur streaming Muse Realtime Avatar, yang berbagi aliran token suara dengan Realtime Voice, menekan latensi respons dialog video end-to-end hingga sekitar 870 ms. Sistem ini mempertahankan komputasi berbatas melalui konteks riwayat dengan panjang tetap, mendukung sinkronisasi gerakan bibir dan ekspresi mikro untuk percakapan berdurasi berapa pun (Sumber: alex_conneau, jack_w_rae)

Muse Realtime Avatar

Meta Muse Terjerat Kontroversi Privasi Akibat Penggunaan Agen Manusia Tanpa Izin untuk Melakukan Panggilan : Reuters melaporkan bahwa saat Meta menguji fungsi panggilan telepon otonom untuk agen personal barunya, Muse, sistem backend justru mengalihkan tugas tersebut kepada tim outsourcing manusia untuk menjaga tingkat keberhasilan yang tinggi, memicu kekhawatiran privasi serius dari pengguna dan pertanyaan regulasi. Eksekutif Meta kemudian segera menyampaikan permintaan maaf dan mencabut uji coba tersebut, berjanji tidak akan membuka kembali jalur tersebut sebelum menyempurnakan pengungkapan privasi dan mekanisme perlindungan keamanan (Sumber: 量子位)

Bapak AI Modern Jürgen Schmidhuber Ditunjuk sebagai Chief Scientific Advisor Sakana AI : Pelopor recursive self-improvement (RSI) dan meta-learning, Jürgen Schmidhuber, resmi bergabung sebagai Chief Scientific Advisor di startup AI Jepang, Sakana AI, untuk memimpin RSI Lab yang baru didirikan di Tokyo. Laboratorium ini menggabungkan algoritma evolusioner, world models, dan arsitektur self-organizing untuk mengeksplorasi kecerdasan adaptif dalam keterbatasan daya komputasi serta siklus tertutup RSI di dunia fisik (Sumber: SakanaAILabs, hardmaru)

Jürgen Schmidhuber ditunjuk sebagai Chief Scientific Advisor Sakana AI

LangChain Rilis LangSmith Engine v2 dan Managed Deep Agents 0.8 : LangSmith Engine v2 memperkenalkan pengujian red teaming proaktif dan mekanisme verifikasi serta perbaikan otomatis, yang mampu memeriksa dan memperbaiki logika abnormal secara proaktif sebelum Agent diluncurkan; sementara Managed Deep Agents 0.8 menambahkan kebijakan izin memori persisten tingkat enterprise, sandbox file API, serta kemampuan web search native (Sumber: LangChain, hwchase17)

LangChain meluncurkan produk baru di konferensi Interrupt

Perplexity Luncurkan Mesin Pencari Mandiri Berbasis Rust Bernama Photon dan Fast Search API : Perplexity memperkenalkan layanan retrieval dan reranking Photon yang dibangun dengan Rust, mencapai pencarian ultra-cepat dengan latensi p95 di bawah 230 ms dan p50 hanya 160 ms, serta memangkas biaya pemanggilan API menjadi $1 per seribu permintaan. Layanan ini telah terintegrasi secara mulus ke dalam Hermes Agent dan ekosistem AI lokal (Sumber: AravSrinivas, MParakhin)

Perplexity luncurkan Fast Search

Mesin Kueri Gabungan AI-SQL Open-Source Quail Dirilis: Proses Lebih dari 1 Miliar Token per Menit pada Satu GPU : Tim gabungan dari Stanford, Modal, dan institusi lainnya merilis Quail, mesin SQL open-source untuk manipulasi data AI. Dengan merekonstruksi scheduler vLLM serta menggabungkan query plan dengan tahap prefill LLM, serta mengustomisasi KV cache dan kernel attention, Quail mencapai throughput pemrosesan lebih dari 1 miliar input token per menit per kueri pada satu GPU H100 (Sumber: charles_irl, HamelHusain)

Google Uji Fitur Panggilan Telepon Otomatis Gemini untuk Perangkat Pixel : Google sedang menguji fitur “Call for Me” pada Pixel 11 di wilayah AS, memungkinkan Gemini menggunakan nomor asli pengguna untuk menelepon bisnis secara mandiri guna menanyakan ketersediaan stok, reservasi restoran, dan perubahan jadwal, menangani menu suara dan masa tunggu transfer secara otomatis, serta menyediakan transkripsi real-time dan pengambilalihan manual instan (Sumber: TechCrunch)

T-Head Alibaba Buka Kode Sumber Penuh Software Stack Chip AI Zhenwu, T-Head SAIL : T-Head Alibaba mengumumkan perkembangan open-source terbaru dari software stack mirip CUDA mereka, T-Head SAIL, di Apsara Conference. Mereka merilis lapisan adaptasi PyTorch, alat migrasi sailify, serta library akselerasi seperti DeepGEMM/FlashAttention, yang memberdayakan pengembang untuk melakukan optimasi tingkat operator dan migrasi mulus pada arsitektur Zhenwu (Sumber: 量子位)

Tim Shaoqing Ren dari NIO Ajukan Model World-Action Multimodal Autonomous Driving MM-Future : Tim NIO mengajukan arsitektur MM-Future untuk mewujudkan evolusi bersama dari beberapa hipotesis “pasangan skenario-aksi” dalam perencanaan autonomous driving. Melalui representasi spatiotemporal ringkas MM-Tokens dan gabungan scorer masa lalu-masa depan, model ini meraih skor 94,0 PDMS pada benchmark NAVSIM-v1, mendorong world model beralih dari prediksi pasif satu arah menuju perencanaan aktif loop tertutup (Sumber: 量子位)

Kuaishou Luncurkan Model Dasar Pengeditan Gambar E-commerce KwaiMind : Kuaishou merilis fondasi pengeditan gambar KwaiMind untuk pembuatan materi e-commerce nyata, yang mengintegrasikan detail pakaian, konsistensi produk, dan perenderan teks melalui data engine multi-agent dan skema distilasi online. Model ini menempati peringkat pertama di antara model open-source dalam evaluasi 11 tugas e-commerce, dan uji A/B online menghasilkan peningkatan relatif CTR sekitar 2,44% (Sumber: 机器之心)

Liquid AI Rilis Model Draft Speculative Decoding Open-Source LFM2.5-VL-DSpark : Liquid AI meluncurkan solusi speculative decoding DSpark untuk model visi-bahasa 3B. Hanya dengan menambahkan 280M parameter, solusi ini mampu meningkatkan kecepatan decoding hingga 3,13 kali lipat pada perangkat M5 Max dengan tetap mempertahankan kesetaraan output yang sempurna, serta diadaptasi secara bersamaan untuk llama.cpp dan SGLang (Sumber: HuggingFace Blog)

Qwengram-0.8B Dirilis Open-Source: Migrasi Memori N-Gram Eksplisit 51B Tanpa Rugi ke Model Edge Mini : Pengembang merilis arsitektur Qwengram secara open-source. Dengan membekukan backbone Qwen3.5-0.8B, arsitektur ini berhasil memasang modul eksternal memori PLE N-gram sebesar 51B melalui pelatihan Reader yang ringan dan mekanisme dynamic gating, mencapai penurunan perplexity (PPL) sebesar 5,05% pada dataset validasi (Sumber: Reddit r/LocalLLaMA)

PrismML Hadirkan LLM Ultra-Ringan 1-Bit ke Kacamata Pintar Qualcomm Snapdragon : PrismML, yang berfokus pada kompresi dan fine-tuning model, mendemonstrasikan model Bonsai 1-bit dengan 2B parameter yang berjalan pada chip Snapdragon AR1 Gen 1, menghadirkan visual question answering dan interaksi alami real-time secara on-device lokal, memverifikasi kelayakan rekayasa menjalankan model multimodal pada perangkat dengan konsumsi daya ultra-rendah (Sumber: TechCrunch)

🧰 Alat & Perkakas

Ekstensi Browser Kimi Diluncurkan dan Mendukung Konversi Operasi Web Menjadi Skill : Kimi secara resmi meningkatkan WebBridge menjadi ekstensi browser native, menambahkan dialog interaktif sidebar, dan mendukung perekaman tindakan berurutan pengguna seperti klik, membalik halaman, dan scraping data menjadi instruksi Skill yang dapat digunakan kembali, membentuk alur kerja otomatisasi kolaboratif internal dan eksternal bersama Kimi Code Desktop (Sumber: 量子位)

GLiNER2.5-Decide Dirilis Open-Source: Model Pengambilan Keputusan Super Cepat yang Mendukung Hubungan Entitas dan Batasan Logika : Fastino merilis model pengambilan keputusan terstruktur ringan GLiNER2.5-Decide (340M) secara open-source. Model ini tidak hanya mendukung routing dan klasifikasi cepat, tetapi juga dapat mengekstrak span tingkat karakter dan hubungan entitas, serta memvalidasi logika real-time terhadap batasan eksklusivitas, kardinalitas, dan ordinal. Latensi inferensi CPU hanya 167 ms dan GPU mencapai 38-47 ms, sepenuhnya menggantikan beban keputusan dari pembuatan teks panjang LLM tradisional (Sumber: MarkTechPost, ClementDelangue)

GLiNER2.5-Decide open-source

LangSmith Luncurkan Alat Fine-Tuning Open-Source smithtune dan Platform Kustomisasi Custom Apps : LangChain berkolaborasi dengan Baseten dan Fireworks untuk meluncurkan alat command-line smithtune, yang mendukung konversi langsung jejak sesi LangSmith di lingkungan produksi menjadi dataset SFT fine-tuning sekali klik dan menerapkan model secara otomatis; fitur Custom Apps yang diluncurkan bersamaan memungkinkan pengembang menggunakan prompt untuk mengubah log eksekusi Agent secara langsung menjadi antrean anotasi atau dasbor perbandingan metrik (Sumber: LangChain, baseten)

LangSmith meluncurkan Custom Apps dan smithtune

CoreWeave Luncurkan Server MCP Mission Control untuk Menghubungkan Lingkungan Coding AI : Penyedia cloud komputasi CoreWeave merilis layanan Mission Control berbasis protokol MCP, memungkinkan alat pemrograman seperti Cursor dan Claude Code untuk membaca langsung status operasional cluster GPU, jaringan, dan node di lapisan bawah, sehingga Agent dapat memecahkan masalah komputasi dan mengoptimalkan alokasi sumber daya langsung dari dalam editor kode (Sumber: AI Business)

Pruna-Qwen-Image-2.1 Dirilis Open-Source: LoRA 5-8 Langkah Capai Akselerasi Pembuatan Gambar hingga 6,3x : Pruna AI merilis adaptor LoRA ultra-cepat untuk Qwen-Image-2.1 secara open-source. Melalui skema penjadwalan sigma yang dioptimalkan secara independen dan mode operasi tanpa CFG, proses pembuatan dan pengeditan gambar dikompresi dari 40 langkah menjadi 5 hingga 8 langkah, mempercepat proses hingga 6,3 kali lipat dengan tetap mempertahankan kualitas gambar 1K dan konsistensi referensi multi-gambar (Sumber: _akhaliq, huggingface)

flow-transform 1.0 Dirilis: Model Desensitisasi PII Enterprise Fidelitas Tinggi untuk Melindungi Alur Kerja Bisnis : micro1 merilis flow-transform 1.0, model desensitisasi privasi yang dirancang khusus untuk pelatihan frontier LLM, yang meraih skor F1 96,0% pada PrivacyBench. Keunggulannya terletak pada penggantian identitas sintetik alih-alih sekadar menyensor atau mengaburkan data, sehingga sepenuhnya menjaga hubungan pengambilan keputusan multi-putaran dan rantai pemanggilan alat dalam proses bisnis perusahaan (Sumber: omarsar0)

Perilisan flow-transform 1.0

Whiteboard: IDE Open-Source untuk Desain Arsitektur Perangkat Lunak Kolaboratif Manusia-AI : Whiteboard, sebuah IDE desktop open-source yang dibangun berbasis CodeOSS, resmi dirilis. IDE ini menyediakan SDK diagram dan penampil semantic diff untuk AI coding agent seperti Claude Code, meringankan “utang kognitif” (cognitive debt) yang disebabkan oleh coding otomatis penuh melalui visualisasi diagram sekuens, diagram ER, dan log keputusan (Sumber: Hacker News)

StarNet: Workbench Runtime Multi-Agent Local-First Tingkat Desktop Bergaya Pixel : Proyek desktop open-source StarNet memproyeksikan runtime AI Agent ke dalam stasiun luar angkasa bergaya piksel, di mana setiap ruangan mewakili cakupan izin dan lorong mewakili aliran data, mendukung integrasi model LLM terkemuka melalui BYOK serta manajemen kolaborasi multi-agent dan buku besar tugas secara lokal dan persisten (Sumber: GitHub Trending)

Google Gemini Resmi Integrasikan Plugin Adobe Photoshop dan Lightroom : Menyusul integrasi dengan ChatGPT dan Claude, plugin Adobe Creative Suite kini resmi hadir di Google Gemini. Pengguna dapat langsung memanggil alat pengeditan gambar profesional dan tata letak kreatif melalui “@Adobe”, memperluas produktivitas grafis dari asisten percakapan (Sumber: The Verge)

📚 Pembelajaran

Universitas Stanford Buka Kursus Musim Gugur Baru CS329Z “Engineering AI Agents” secara Open-Source : Tim Stanford NLP bersama pembuat DSPy dan SWE-bench merilis kursus sistematis CS329Z, mencakup desain rekayasa full-stack mulai dari pipeline LLM sederhana, sistem AI majemuk, hingga Agent otonom, dengan fokus membedah prompt engineering, evaluasi status, keamanan sandbox, dan orkestrasi alat. Materi slide kuliah dan kode untuk sesi pertama telah dipublikasikan sepenuhnya (Sumber: stanfordnlp)

Stanford membuka kursus CS329Z

Google Ungkap Arsitektur Pembuatan Video Panjang Multi-Agent Bernama AI Video Co-Director : Tim riset Google merilis rangkaian pembuatan video naratif yang menggabungkan optimasi kebijakan global MAB, memori visual eksplisit CANVAS, dan umpan balik loop tertutup prompt VQQA, secara efektif mengatasi penyimpangan subjek dan kesalahan berjenjang (cascading errors) dalam pembuatan video berdurasi panjang multi-shot, menghasilkan output naratif yang konsisten selama beberapa menit (Sumber: Google Research Blog)

Perplexity Ungkap Metode Hint-Guided Self-Distillation Berdasarkan Kesalahan Nyata : Perplexity mengungkap mekanisme post-training untuk agen pengoperasian komputernya, yang mengubah kesalahan pada lintasan kegagalan menjadi petunjuk terstruktur, menggunakan on-policy self-distillation (OPSD) agar model guru membimbing model murid memperbaiki kesalahan, menghasilkan penurunan relatif sebesar 21,2% pada tingkat kegagalan pemanggilan alat secara online (Sumber: MarkTechPost)

BJTU, Tsinghua, dan Tim Lainnya Ajukan ARGUS: Kerangka Kerja Forensik Video Berbasis Rantai Bukti dan Kolaborasi Multi-Agent : Untuk mengatasi masalah generalisasi yang buruk pada keputusan kotak hitam dalam deteksi video deepfake, tim peneliti mengusulkan sistem ARGUS yang memisahkan agen observasi independen (seperti tekstur, pencahayaan, gerakan temporal, dan akal sehat fisik) dari agen juri, serta merilis dataset FaceVid-Forensics-100K yang mencakup 33 sumber pembuatan, meningkatkan skor F1 out-of-domain menjadi 53,28% (Sumber: 36氪)

Kerangka kerja forensik video ARGUS

Zhejiang University dkk. Ajukan MemGUI-Bench: Tolok Ukur Pertama untuk Memori Jangka Panjang dan Pembelajaran Lintas Sesi pada Agen GUI : Zhejiang University bersama Nankai, CUHK, dan institusi lainnya merilis MemGUI-Bench yang mencakup 128 tugas nyata jangka panjang serta alat evaluasi bertahap tiga fase MemGUI-Eval. Eksperimen mengungkap bahwa model terkemuka saat ini mengalami halusinasi memori hingga 58,9% dalam tugas jangka panjang lintas aplikasi dan lintas sesi, menyingkap titik buta memori yang tidak dapat diukur oleh tolok ukur konvensional (Sumber: 36氪)

Tolok ukur evaluasi memori MemGUI-Bench

Hugging Face Rilis SmolDataEnvs Open-Source: Lebih dari 5.000 Lingkungan Reinforcement Learning yang Dapat Diverifikasi : Mengatasi tantangan minimnya lingkungan pelatihan bagi model kecil di bawah 10B dalam domain data science dan coding, komunitas open-source merilis SmolDataEnvs yang berisi lebih dari 5.000 lingkungan RL yang dapat diverifikasi untuk tugas-tugas data science nyata, mendukung eksekusi reinforcement learning asinkron pada GPU tunggal (Sumber: _lewtun, huggingface)

Tim Microsoft dkk. Ajukan CASD: Optimalkan Prompt Menggunakan Analisis Log Penuh Agen Coding : Tim riset Microsoft mengajukan metode CASD, membuktikan bahwa membiarkan coding agent menghitung statistik lintasan penuh secara langsung dan menyusun aturan optimasi menghasilkan skor 16,6 poin lebih tinggi dibandingkan menjalankan search loop pada batch lintasan kecil, sekaligus memangkas biaya optimasi prompt tunggal menjadi hanya $1,60 (Sumber: dair_ai)

Metode optimasi Prompt CASD

Kandidat Makalah IROS 2026 ULTRA: Kontrol Koordinasi Seluruh Tubuh Berbasis Target untuk Robot Humanoid : Tim peneliti UIUC mengusulkan kerangka kerja kontrol multimodal terpadu ULTRA. Melalui neural retargeting berbasis fisika dan fine-tuning reinforcement learning, kerangka kerja ini memungkinkan robot Unitree G1 menghasilkan gerakan mencengkeram dan translasi seluruh tubuh secara otonom hanya dengan target yang jarang (sparse) atau point cloud sudut pandang orang pertama (Sumber: 机器之心)

AdaRoboVLG: Kerangka Kerja Vision-Language Grasping Lintas-Manipulator dengan Pemisahan Tugas : Tim dari HUST, Peking University, dan mitra lainnya mengajukan AdaRoboVLG, yang memisahkan apriori semantik/temporal tingkat atas dari pembuatan genggaman fisik tingkat bawah. Antarmuka terpadunya dapat disesuaikan untuk tangan dexterous multi-jari maupun parallel gripper, mempertahankan ketahanan tinggi pada sabuk konveyor dinamis dan skenario yang berantakan (Sumber: 机器之心)

Agent atau Workflow? Panduan Evaluasi Praktis Pemilihan Arsitektur Sistem Bisnis : Sebuah artikel mendalam menganalisis batas antara alur kerja proses tetap (workflow) dan Agent otonom, mengusulkan kriteria uji utama “apakah state machine lengkap dapat digambar sebelum eksekusi”, serta menyarankan agar skenario throughput tinggi dan sensitif terhadap kepatuhan memprioritaskan Workflow yang ditingkatkan dengan evaluasi LLM (Sumber: Machine Learning Mastery)

💼 Bisnis

Anthropic dan Akamai Tandatangani Kontrak Jangka Panjang Layanan Cloud Komputasi Senilai $11,6 Miliar : Anthropic mencapai kesepakatan infrastruktur cloud computing berjangka waktu 7 tahun senilai $11,6 miliar dengan Akamai, serta memberikan waran saham hingga 5% kepada Akamai, mendorong komitmen pengadaan daya komputasi Anthropic melampaui $500 miliar dalam 11 bulan terakhir (Sumber: THE DECODER)

TypeSafe Dilaporkan Sedang Menggalang Pendanaan Baru Senilai $1 Miliar dengan Valuasi Lebih dari $10 Miliar : Menurut laporan The Information, setelah model keputusan Jev memicu antusiasme di komunitas pengembang dan volume pemanggilan hariannya menembus 1 triliun token, TypeSafe AI sedang berdiskusi dengan lembaga investasi papan atas untuk putaran pendanaan baru senilai lebih dari $1 miliar, dengan valuasi pasca-investasi diperkirakan melampaui $10 miliar, melonjak drastis dibandingkan valuasi sebelumnya (Sumber: steph_palazzolo)

Databricks Umumkan Akuisisi Platform Spreadsheet Cloud Real-Time Row Zero : Databricks mengumumkan telah mencapai kesepakatan untuk mengakuisisi Row Zero. Row Zero unggul dalam spreadsheet berbasis cloud berkinerja tinggi yang mendukung ratusan juta baris data. Akuisisi ini bertujuan untuk mengintegrasikannya secara mendalam dengan mesin analisis cerdas Databricks, Genie, guna menyediakan workbench data interaktif real-time yang didukung oleh tata kelola dan AI bagi kalangan keuangan dan analis enterprise (Sumber: jefrankle, matei_zaharia)

🌟 Komunitas

Pengembang Uji Claude Code yang Tak Sengaja Hapus 48.000 File Kunci Memicu Refleksi Keamanan Kode : Komunitas dihebohkan oleh laporan pengembang bahwa saat menggunakan Claude Code untuk membangun ulang image, celah isolasi izin skrip menyebabkan 48.000 file proyek dan indeks Git terhapus total dalam 103 detik, kembali membunyikan alarm peringatan risiko rekayasa terkait eksekusi tanpa sandbox dan otorisasi langsung terhadap Agent di lingkungan produksi (Sumber: TechRadar)

Jev Memicu Gelombang Riset Akademis dan Diskusi Hangat Mengenai Arsitektur System 1 : Dalam sepekan setelah perilisan Jev, sejumlah makalah riset seputar edge scheduling dan evaluasi cascade bermunculan di arXiv. Komunitas mendiskusikan bahwa meskipun Jev sangat cepat dan memangkas biaya ratusan kali lipat dalam pengambilan keputusan biner/pilihan ganda, model ini sensitif terhadap penamaan opsi dalam penalaran rantai panjang. Hal ini mendorong para pengembang untuk mempercepat transisi ke paradigma orkestrasi hybrid “Penyaringan Cepat System 1 + Penanganan Akhir Model Frontier System 2” (Sumber: 36氪, Latent Space, dair_ai)

Lonjakan makalah riset Jev

Raksasa Teknologi Berkumpul di Jamuan Makan Malam Gedung Putih: Perdebatan Sengit antara Regulasi Keamanan dan Akselerasionisme : Pejabat tinggi AS dan Tiongkok bersama tokoh raksasa teknologi seperti Jensen Huang, Elon Musk, dan Tim Cook berkumpul dalam jamuan kenegaraan, dengan pengembangan AI dan keselamatan menjadi agenda utama. Industri memperdebatkan secara sengit apakah laboratorium frontier memanfaatkan kepanikan keamanan untuk membangun “regulatory capture”, sementara Mark Zuckerberg dan Jensen Huang secara terbuka menentang perlambatan yang terkoordinasi dalam industri, serta menganjurkan penegakan akuntabilitas berbasis skenario aplikasi tertentu (Sumber: Transformer, teortaxesTex, Reddit r/ArtificialInteligence)

Jamuan makan malam Gedung Putih dan raksasa teknologi

Claude Opus 5.5 Dipuji karena Estetika yang Luar Biasa, namun Mode “Max” Dilaporkan Rentan Terjebak dalam Loop Logika Berulang : Komunitas memberikan apresiasi tinggi terhadap kemampuan pembuatan kode dan desain estetika Claude Opus 5.5, namun pengembang berpengalaman juga mencatat bahwa saat mengaktifkan tingkat penalaran Max, model tersebut mudah terjebak dalam loop intropeksi multi-putaran tanpa akhir yang menghabiskan kuota token. Disarankan untuk menggunakan level Medium atau High untuk tugas-tugas standar dan ringan (Sumber: Reddit r/ClaudeAI, theo, arena)

Kalangan Medis Serukan Kewaspadaan terhadap Penurunan Fungsi Kognitif Akibat Ketergantungan Berlebih pada AI : Artikel opini di The Guardian menyoroti bahwa seiring penetrasi mendalam generative AI di perguruan tinggi dan tempat kerja, ketergantungan berlebihan dalam mengalihkan tugas-tugas kognitif mendalam seperti analisis dan penulisan kepada AI mulai melemahkan konektivitas otak manusia dan kemampuan berpikir kritis independen. Artikel tersebut menyerukan agar dampak penggunaan AI terhadap kesehatan kognitif jangka panjang dimasukkan ke dalam pengawasan kesehatan masyarakat dan pendidikan (Sumber: The Guardian)

💡 Lainnya

GPT-6 Astra Berhasil Menamatkan Game Hardcore Roguelike Tingkat Tinggi NetHack : Eksperimen menunjukkan bahwa GPT-6 Astra berhasil mencapai “Ascension” dalam game hardcore Roguelike klasik yang ekstrem, NetHack, pada percobaan ketiga. Ini menandai terobosan besar bagi LLM dalam menghadapi state space yang sangat luas, informasi tidak lengkap, dan eksplorasi strategi kontinu jangka panjang (Sumber: Plinz, _rockt)

GPT-6 Astra tamatkan NetHack

Konsolidasi Produk AI Raksasa Teknologi: Tencent Resmi Umumkan Penghentian Operasional “Xiaolongxia” QClaw : Tencent merilis pengumuman bahwa QClaw akan menghentikan operasionalnya pada 24 Desember 2026 dan mengarahkan pengguna untuk bermigrasi ke WorkBuddy. Di bawah tekanan biaya komputasi dan penilaian ROI, raksasa teknologi domestik mempercepat penghentian pendekatan multi-eksperimen (horse-racing model) dan mengonsolidasikan inisiatif Agent yang terfragmentasi ke dalam platform produktivitas terpadu (Sumber: 36氪)

QClaw Tencent tutup

Pusat Superkomputer AI Terbesar di Inggris Kemungkinan Ditunda hingga Dekade 2030-an Akibat Keterlambatan Akses Jaringan Listrik : Pusat superkomputer kedaulatan AI berkapasitas 90MW di Essex, Inggris, yang awalnya dijadwalkan online pada 2027, menghadapi hambatan perluasan jaringan listrik regional. Perusahaan jaringan listrik setempat memperkirakan penundaan hingga pertengahan dekade 2030-an untuk dapat memenuhi kebutuhan pasokan daya, menyoroti ketidakseimbangan struktural antara ekspansi infrastruktur komputasi dan pasokan listrik tradisional (Sumber: The Guardian)

Tinggalkan Balasan

Alamat email Anda tidak akan dipublikasikan. Ruas yang wajib ditandai *