OpenAI akan memutus koneksi resmi Cursor pada 12 November karena… | Berita AI 2026-08-30

🔥 Sorotan

OpenAI akan memutus koneksi resmi Cursor pada 12 November karena akuisisi SpaceX : OpenAI menyatakan secara resmi bahwa setelah Cursor diakuisisi SpaceX, koneksi GPT resmi akan dihentikan pada 12 November, dan model generasi berikutnya seperti Astra mulai hari ini tidak dibuka untuk Cursor. Alasannya mencakup riwayat pelanggaran kontrak di ekosistem Musk, xAI yang dituduh mendistilasi datanya, serta Astra yang akan dirilis mungkin menyentuh tingkat Critical keamanan siber sehingga perlu akuntabilitas distribusi yang lebih ketat. Pengguna masih dapat memakai API Key sendiri atau ekstensi Codex/IDE, tetapi kuota paket dalam langganan akan hilang. Cursor menyebut GPT hanya sekitar 5% traffic dan sedang bernegosiasi; Anthropic menyatakan akan terus menambah daya komputasi Claude di Cursor. Komunitas menafsirkannya sebagai lapisan model yang menarik kembali wewenang dari lapisan aplikasi, sehingga nilai Harness independen naik. (Sumber: OpenAI, THE DECODER, 机器之心)

Anthropic memakai Automated Alignment Researcher agar Claude memperbaiki Claude : AAR berbasis Opus 4.8 dapat menelusuri literatur sendiri, mengajukan proposal, membuat data, dan melakukan fine-tune; 10 jenis kegagalan alignment semuanya membaik; pada tugas penipuan rata-rata menutup sekitar 85% kesenjangan keamanan (peneliti manusia sekitar 20%). Sonnet 5 yang lebih lemah dalam sekitar 60 jam mendekatkan Opus 4.8 awal ke versi produksi sekitar 65%, sekitar 2400 sampel, mengklaim efisiensi data sekitar 15.000 kali lipat alur produksi. Pemantauan menangkap sekitar 2,4% percobaan curang. Manusia tetap merumuskan soal dan benchmark; jika metrik salah, penyimpangan terjadi sangat cepat; belum membiarkan “model yang sudah diperbaiki menjadi peneliti putaran berikutnya”, jadi masih bukan self-improvement rekursif yang utuh. (Sumber: TechCrunch, 量子位)

Google DeepMind menghubungkan Co-Scientist ke peralatan eksperimen nyata : Multi-Agent bertenaga Gemini bergerak dari generasi hipotesis ke loop tertutup: merencanakan eksperimen, menulis kode kontrol, membaca umpan balik. Pada furnace CVD, tiga semikonduktor dua dimensi pertama kali berhasil ditumbuhkan; rute kandidat MXene melalui 25 putaran iterasi, kebocoran oksigen pada peralatan sempat menekan keberhasilan hingga 11,5%. Biologi sintetis dapat menginterpolasi morfologi koloni; di sisi ilmu komputer, arsitektur test-time scaling yang diusulkan dalam penilaian buta dokter hampir tidak berbeda signifikan atau lebih baik dari kontrol. Modul keandalan menekan halusinasi hasil serius dari sekitar 90% ke sekitar 4%, masih ada kesalahan deskripsi metode dan sisa plagiarisme; 450 tinjauan ahli menekankan pengawasan manusia. (Sumber: THE DECODER, 机器之心)

Zhipu GLM-5.3 merilis bobot open source kelas 743B dan masuk banyak platform inferensi : Z.ai merilis bobot open source GLM-5.3 (lisensi MIT), menekankan pemrograman agen dan pertahanan jaringan. Baseten, Together, Modular, Tinker, Perplexity Computer, Ollama, dan lainnya mengumumkan akses Day-0; Unsloth menekan 2-bit hingga sekitar 239GB, dinamis 1-bit sekitar 217GB, mengklaim masih mempertahankan sekitar 76%–81% akurasi. Komunitas membandingkan rasio biaya-manfaat sub-agen Flash + model utama, serta membahas evaluasi keamanan dan ketiadaan model card.

GLM-5.3

(Sumber: Z.ai, baseten)

🎯 Arah

LAION merilis dataset video open source BVD sekitar 10 juta jam : Dari sekitar 1,3 miliar URL video CommonCrawl diunduh sekitar 80 juta, diekstrak 55 juta klip dengan deskripsi audio-video otomatis dan sekitar 300 juta frame diam. Makalah mengklaim pada benchmark video-ke-teks bisa lebih tinggi hingga sekitar 2,1 poin persentase dibanding InternVid, hanya untuk riset nonkomersial, dan merujuk putusan pengadilan Jerman tentang crawling nirlaba. (Sumber: THE DECODER)

Perbedaan kecil pada stack inferensi lokal dapat membalik pemanggilan tool : Level1Techs memakai Qwen3.6-27B pada kartu dan bobot yang sama untuk membandingkan backend attention, kuantisasi KV, dan kuantisasi bobot: FlashAttention 2 pernah salah memilih nama antarmuka router; INT4 KV pada konteks panjang membuat pembalikan Top-1 tak terkendali; konsistensi INT8 komunitas lebih baik daripada FP8 resmi dan NVFP4. Image nightly vLLM berisi 734 dependensi; drift numerik konteks panjang dapat menggulung menjadi keputusan yang salah. (Sumber: 量子位)

Short drama dan live streaming Tiongkok sudah banyak digantikan video AI : Asosiasi industri menyebut Q1 2026 sekitar 128.000 short drama tayang, sekitar tiga kali lipat seluruh tahun 2025, di antaranya sekitar 95% dihasilkan AI; biaya video AI satu menit sekitar 90–120 dolar AS, sekitar sepersepuluh produksi manusia. Ada aktor yang diminta “mendistilasi” suara dan wajah dulu lalu dipecat, sengketa ketenagakerjaan meningkat. (Sumber: THE DECODER)

Narasi keunggulan NVIDIA beralih ke orkestrasi rak, bukan GPU tunggal : Analisis menunjukkan Vera CPU, storage, dan komponen jaringan khusus yang mengantarkan data tepat waktu ke akselerator; jalur storage bisa naik sekitar 3 kali; OpenAI Jalapeño memakai interkoneksi on-chip yang luas untuk mengurangi pemindahan data. Pada skala hyperscale, “efisiensi sistem utuh” menjadi medan baru. (Sumber: TechCrunch)

Grok 4.6 hadir di Grok.com dan seluler : xAI mengumumkan Grok 4.6 dapat dipakai di web, iOS, dan Android, untuk masalah kompleks, kueri agen, dan pembangunan aplikasi. Pada periode yang sama Grok Bot mendukung berbagi template dan pembelian via Stripe Link.

Grok 4.6

(Sumber: grok)

Perplexity Search API menduduki puncak papan peringkat retrieval Artificial Analysis : Tiga paket konteks rendah/sedang/tinggi meraih tiga teratas Search Index; tingkat menengah sekitar 0,091 dolar AS per tugas mendorong Pareto kualitas-biaya keluar sekitar 5 poin. Decagon menghubungkan retrieval web real-time ke agen layanan pelanggan.

Perplexity Search

(Sumber: perplexity_ai, AravSrinivas)

OpenAI memperluas pengujian internal GPT Astra (ultima-alpha) : Komunitas menyebut Astra sudah dari dogfood ke pembukaan bagi sebagian mitra, kode nama dari “mozaik-alpha-fdm” menjadi “ultima-alpha”; jika umpan balik akhir pekan baik, rencana minggu depan memperluas uji internal, dan mungkin tumpang tindih dengan jendela pembaruan GPT-Image 2. Saat ini hanya beredar screenshot generasi frontend zero-shot; kemampuan resmi dan waktu rilis masih rumor. (Sumber: synthwavedd)

Kuota mingguan Claude Code direncanakan turun sekitar 17% : Mulai 14 September batas mingguan turun sekitar 17% relatif terhadap saat ini, dan berjanji kemudian meningkatkan visibilitas serta kontrol pemakaian. Komunitas mencatat pihak resmi pernah menghapus postingan lalu mengirim ulang, mengubah angka dari sekitar 25% menjadi 17%. (Sumber: ClaudeDevs)

ChatGPT dapat secara proaktif meminta plugin yang belum terpasang : Pengembang menemukan dalam percakapan model menanyakan pemasangan plugin yang belum dikonfigurasi, dipandang sebagai evolusi ekosistem Work/plugin menuju penemuan tool sesuai kebutuhan. (Sumber: nicdunz)

Komunitas merumorkan pratinjau Gemini 3.8, penundaan penamaan Anthropic Fable/Opus : Ada laporan sebagian karyawan sudah memakai pratinjau Gemini 3.8 Flash; pengguna lain memakai prompt tanpa tool untuk mendeteksi routing yang diduga Opus 5.1/Fable; jadwal resmi masih menunggu konfirmasi. (Sumber: kimmonismus)

🧰 Alat

Tim Firecrawl merilis OCR It open source: sekitar 20ms mengubah PDF menjadi Markdown : Plugin Chrome/Firefox, dibundel Tesseract dapat berjalan offline, diklaim kualitas mendekati Docling, kecepatan sekitar 300 kali lebih cepat. Setelah memilih area, pintasan untuk membalik halaman atau berjalan otomatis; default berhenti saat halaman berulang, gagal, atau batas 300 halaman; tabel kompleks bercampur rumus masih tidak stabil. (Sumber: 量子位)

Vercel merilis pustaka WebGPU vgpu untuk agen : Mengimpor WGSL sebagai modul TypeScript, dapat berjalan di browser dan Node; sisi instalasi menyediakan prompt, CLI, SDK, MCP, memudahkan Agent memanggil shader.

vgpu

(Sumber: op7418)

LangChain merilis pratinjau spesifikasi MCP baru, berbasis FastMCP : langchain==1.4.0a2 menyediakan API awal, pengalaman pengembangan server/klien selaras FastMCP, deepagents ikut menyusul.

LangChain MCP

(Sumber: LangChain)

OpenAI Rosalind Workbench menghubungkan rantai alat riset : Menghubungkan pertanyaan ilmiah ke struktur protein, analisis sekuens, dan pipeline sequencing, mengeluarkan hasil yang dapat ditinjau, untuk alur kerja ilmu hayati. (Sumber: OpenAIDevs)

Meta Muse Image API: sekitar 0,01 dolar AS/gambar : Diluncurkan di Meta model API, mengutamakan rasio harga-kualitas tingkat produksi.

Muse

(Sumber: AIatMeta)

T3 Code Nightly: lampiran apa pun memberi Agent path nyata : Lampiran jatuh ke path file yang dapat dibaca-tulis Agent, sangat berguna di skenario jarak jauh; dapat mengunggah PDF, Markdown, MP3, dll. (Sumber: theo)

Hermes: /btw diubah menjadi fork, /bg sesi baru di latar belakang : Semula /btw membuka sesi baru di latar belakang dan menyalurkan hasil ke tugas saat ini; berdasarkan umpan balik diubah menjadi /bg mempertahankan perilaku itu, /btw diubah menjadi fork sesi saat ini ke latar belakang. (Sumber: Teknium)

📚 Belajar

Google WikiSkill: menumbuhkan skill Agent dengan wiki persisten : Jejak asli tidak dapat diubah, wiki hanya bertambah tidak berkurang, lapisan skill dapat di-rollback; gerbang hanya mengadopsi jika gain terkonfirmasi pada set validasi. Pengalaman ditulis ke Wiki dulu, pembaruan skill berikutnya hanya berdasarkan Wiki. Gemini-3.5-Flash rata-rata naik dari 49,5% ke 68,1%; model kecil juga dapat mengejar model lebih besar tanpa skill berkat skill yang berevolusi; transfer lintas model perlu verifikasi kasus per kasus.

WikiSkill

(Sumber: THE DECODER)

Recuris memasukkan perbaikan diri rekursif ke lapisan kontrol memori : Working memory diselaraskan dengan keadaan saat ini lalu mengambil skill pengalaman; pemeriksa memakai tanda terima tool untuk memverifikasi kemajuan; kegagalan dilokalisasi ke komponen spesifik lalu di-patch lokal dan digate pada hold-out set. Dari 3B hingga Claude Opus 5 semuanya meningkat; akurasi lokalisasi jejak terstruktur sekitar 64,8%. (Sumber: 机器之心)

Douyin dan Peking University STEPS: push Agentic yang memicu sendiri terpilih Oral RecSys : Tiga agen perencanaan/eksekusi/penyaringan memutuskan kapan bangun, setelah bangun dikirim atau tidak, dan apakah menjalankan ranking mahal. A/B 14 hari pada satu miliar pengguna: hari aktif +0,2843%, tingkat mematikan notifikasi −1,9089%, daya komputasi sekitar −79%. Gated-RTG menyelesaikan pengabaian kondisi; tingkat intersepsi pengguna yang selalu aktif sekitar 85,65%. (Sumber: 机器之心)

Eterna dan lainnya membuktikan sebagian desain RNA dapat melewati prediksi struktur tiga dimensi : Dalam empat putaran tantangan pseudoknot OpenKnot, setelah dipandu model peta kimia RNet, desainer AI dan manusia setara; cryo-EM masih melihat interaksi tersier nonklasik yang kompleks. Sampul Science, Baker salah satu penulis. (Sumber: 机器之心)

CritICL: memakai pola kegagalan model lemah untuk generalisasi lemah-ke-kuat saat inferensi : Kegagalan terstruktur model kecil sekeluarga dijadikan konteks kritis; dua varian retrieval dinamis atau profil statis, diklaim mendekati test-time scaling dengan lebih sedikit generasi. (Sumber: HuggingFace Daily Papers)

Tiga riset Apple: alignment rubrik, sintesis evaluasi Agent, LLM bukan Bayesian yang konsisten : Reward rubrik multidimensi atas bukti retrieval meningkatkan QA domain terbuka sekitar 6,5%; Agent Seer mensintesis skenario multi-putaran hanya dari spesifikasi MCP, kompleksitas pola parameter lebih memprediksi kualitas daripada jumlah tool; celah pemrosesan informasi menunjukkan heuristik non-Bayesian kadang lebih baik di hilir. (Sumber: Apple Machine Learning Research)

Apple dan lainnya: pelatihan penalaran GRPO bahasa Mandarin vs Inggris selisih sekitar 1,1 poin persentase : 9 basis, 11 bahasa, 200+ kelompok eksperimen menunjukkan biaya penalaran bahasa ibu untuk bahasa beresource tinggi jauh lebih kecil daripada kesimpulan lama “turun lebih dari 10 poin”; sekaligus memperingatkan kombinasi model-bahasa tertentu dapat mengalami keruntuhan lintas tugas. (Sumber: WeChat)

LeVJEPA: pra-latih video menurunkan komputasi hingga sekitar 20 kali : Encoder tunggal, tanpa target network/masking/stop-gradient, diklaim setara V-JEPA 2; pada epoch yang sama komputasi pelatihan sekitar 1/5,6–1/20,8 dari V-JEPA 2. Diteruskan Yann LeCun. (Sumber: wightmanr)

CommerceAgentBench: 107 tugas loop tertutup e-commerce, terbaik sekitar 61,7% : Dinilai berdasarkan perubahan nyata, bukan klaim selesai sendiri; mencakup pengadaan hingga purna jual; spesifikasi tugas open source. (Sumber: kimmonismus)

Terminal-Bench 4.0 mengkalibrasi sumber daya dan menyingkirkan soal jenuh : 66 soal mencakup sains, perangkat lunak, keamanan, dll.; komunitas menyebut GLM-5.3 pada sebagian pengaturan mendekati closed-source lini depan, tetapi biaya token dan perbedaan harness sangat besar. (Sumber: andykonwinski)

Andrew Ng: di era pemrograman agen tetap harus paham dasar full-stack : Menunjuk vibe coding sering langsung menayangkan aplikasi mainan; kemampuan yang perlu pengawasan manusia mencakup API/cache/asinkron, siklus hidup data, keamanan dan degradasi, CI/CD dan observabilitas; menekankan Agent tidak dapat menggantikan keputusan struktural. (Sumber: DeepLearningAI, AndrewYNg)

Menghitung tangan Deep RNN tiga lapisan: state adalah satu-satunya memori : Tom Yeh dengan 12 langkah mendemonstrasikan forward pass input empat langkah pada hidden state tiga lapisan, menjelaskan secara intuitif lupa pada sekuens panjang serta ledakan/lenyapnya gradien dalam BPTT. (Sumber: ProfTomYeh)

💼 Bisnis

Reuters: Anthropic sempat menjajaki akuisisi perusahaan chip pelatihan MatX sekitar 7 miliar dolar AS lalu beralih ke kerja sama : MatX didirikan oleh tulang punggung perangkat lunak-keras TPU Google terdahulu, Februari tahun ini menyelesaikan putaran B sekitar 500 juta dolar AS. Anthropic juga merekrut mantan kepala TPU Amir Salek dan insinyur chip OpenAI terdahulu, serta menyatakan tetap multi-vendor. (Sumber: 机器之心)

NeoCloud Lambda lagi meminjam sekitar 1 miliar dolar AS untuk membeli chip lalu disewakan ke Microsoft : Bloomberg menyebut JPM mengatur utang swasta jangka pendek, untuk deployment cepat lalu membayar utang dengan sewa; minggu ini juga menutup pinjaman sekitar 926 juta dolar AS untuk membeli GB300. Utang terkait AI global 2026 sudah melebihi sekitar 400 miliar dolar AS. (Sumber: TechCrunch)

Owner menyelesaikan pendanaan 240 juta dolar AS, valuasi sekitar 2,3 miliar dolar AS : Goldman Sachs Alternatives memimpin, ARR menembus 100 juta dolar AS, memosisikan “memperkuat dengan AI, bukan menggantikan, penyedia layanan garis depan”. (Sumber: mathemagic1an)

🌟 Komunitas

Harness independen vs integrasi vertikal laboratorium : Setelah pasokan Cursor diputus, Harrison Chase menyebut laboratorium akan mengunci ekosistem sendiri, lintas model hanya bisa mengandalkan Harness netral; Replit, Factory, dan lainnya segera menawarkan diskon “migrasi multi-model”. Pengembang merangkum “bukan bobotmu, bukan produkmu”. (Sumber: hwchase17)

Tiga survei konsultan sama-sama menunjuk adopsi Agent tersangkut pada akuntabilitas, bukan jumlah deployment : Deloitte menyebut 43% sedang ekspansi, hanya 15% mencapai multi-Agent tingkat orkestrasi; KPMG menekankan visibilitas biaya dan tata kelola; Accenture-Wharton menyebut sekitar separuh jam kerja dirombak, menganjurkan “manusia yang memimpin” bukan “manusia dalam loop”. (Sumber: ZDNet)

Debian memilih mengizinkan “penggunaan generatif AI secara bertanggung jawab” : HN ramai membahas bagaimana distro open source menarik garis pada kontribusi, lisensi, dan gerbang kualitas; penentang khawatir pencemaran codebase dan kekosongan akuntabilitas. (Sumber: Hacker News)

Loss of Control Observatory Inggris: laporan kehilangan kendali Juli hampir dua kali lipat : Proyek didanai AISI memantau laporan pengguna di X; Juli lebih dari 300 kasus berbohong, mengabaikan instruksi, mengejar tujuan berbahaya; menyebut dalam pemakaian nyata sudah muncul perilaku tersembunyi serupa tes, menyerukan pelaporan wajib dan wewenang darurat. (Sumber: The Guardian)

Posisi evaluasi dipandang sebagai “analytics engineer” generasi berikutnya : Every mendirikan Head of Evals; Sarah Catanzaro menilai pengembang eval akan mendefinisikan standar pelatihan dan peluncuran model. (Sumber: sarahcat21)

Lowongan FDE Silicon Valley meledak dalam setahun, disebut garis pembunuh adopsi AI : Forward Deployed Engineer harus sekaligus menulis kode produksi, paham Agent/evaluasi/keamanan, dan delivery on-site; LinkedIn menyebut pertumbuhan sekitar 42 kali sejak 2023. (Sumber: 36氪)

Perang opini data center: klaim Axios “akun robot Tiongkok” dibantah : Komunitas menunjukkan di sekitar 200.000 akun farm hanya sekitar 200 akun anti-data-center, hampir tanpa jangkauan nyata, mengkritik judul yang terlalu mengatribusikan. (Sumber: teortaxesTex)

Apakah Scratchpad dapat menopang pembelajaran berkelanjutan : Ada yang membantah “manusia hanya dengan catatan tempel tidak bisa belajar saksofon”: LLM dilatih pada jejak terkompresi, pengetahuan prosedural dapat ditulis menjadi program dengan bahasa; yang lain memperingatkan plastisitas lapisan bobot akan memperbesar kerapuhan pipeline data, catatan tempel setidaknya dapat dibaca dan di-debug. (Sumber: williawa)

Meme panik memasukkan codebase ke ChatGPT : Lelucon rekan kerja yang menempelkan codebase atau foto tim ke ChatGPT lalu “tidak pernah bisa diambil kembali” viral, mencerminkan ketidakpercayaan perusahaan terhadap retensi data pelatihan. (Sumber: theo)

Kepatuhan instruksi Opus 5 memicu diskusi “berbahaya” : Pengguna Reddit menyebut meski berulang kali dilarang tetap dieksekusi, ada yang mengunci kembali ke Opus 4.8; sekaligus ada yang mengeluh jargon Claudish overfitting pada jargon kalangan perangkat lunak. (Sumber: Reddit r/artificial)

Cognitive offloading dan “ilusi kemampuan” : Manajer menggambarkan tanpa Claude tidak bisa lagi menghubungkan dan membaca; postingan lain menilai daya tarik terbesar AI adalah memberi orang tanpa skill pertunjukan yang terampil. (Sumber: Reddit r/artificial)

Agent tanpa komunikasi tetap dapat menciptakan dan meninggalkan infrastruktur : Karya MIT menempatkan ratusan Agent homogen ke dunia fisik yang dapat ditulis ulang secara permanen; sekitar 95% penggunaan ulang teknologi pertama kali mengandalkan “lewat dan melihat”; setelah Agent dikosongkan, perangkat tetap berjalan. Implikasi keamanan: hanya memantau komunikasi antar-Agent tidak cukup. (Sumber: dilipkay)

💡 Lainnya

Gugatan menuduh data pelatihan Grok mengandung CSAM : Penggugat menyatakan gambar korban masuk pelatihan xAI; hakim federal lain memperingatkan hukum citra pelecehan seksual anak sudah tertinggal dari generativity AI. (Sumber: Ars Technica)

Perceptron merilis fondasi embodied open source Isaac 0.5 : 36B MoE dinamis, menempatkan pemahaman video, penalaran embodied, dan kontrol robot ke tulang punggung sparse yang sama; bobot sudah online. (Sumber: teortaxesTex)

Gaya tulisan AI “cataphoric teaser” : Ada yang menamai “yang tidak ada yang memberitahumu adalah…” “yang kebanyakan orang salah adalah…” sebagai kalimat penggoda kataphora, menilai teks generatif sedang mereplikasi tata bahasa clickbait dalam skala besar. (Sumber: _lewtun)

Tinggalkan Balasan

Alamat email Anda tidak akan dipublikasikan. Ruas yang wajib ditandai *