Fei-Fei Li World Labs merilis Atlas: rekonstruksi 3D dari sedikit… | Berita AI 2026-09-03

🔥 Sorotan

Anthropic merilis Claude Fable 5.1 / Mythos 5.1: lonjakan coding riset, harga baca cache dipotong 75%, plus anti-distilasi, watermark, dan retensi nol untuk enterprise : Keduanya berbagi fondasi, kebijakan keamanan bercabang. Fable langsung masuk API/Bedrock/Azure dan lainnya; Mythos hanya untuk lembaga keamanan siber dan ilmu hayati yang telah ditinjau. Terminal-Bench-Science 0.1 mencapai 52,6% (generasi sebelumnya sekitar 24,7%), Terminal-Bench 4.0 sekitar 55,8%/Mythos sekitar 60,9%, CursorBench sekitar 73,4%. Input/output tetap $10/$50 per juta token, baca cache turun dari $1 ke $0,25; pihak resmi menyebut beban tipikal turun sekitar 25%, Agent berat hingga sekitar 45%. Akun API baru tidak bisa mengubah prefiks sambil menyimpan rantai pemikiran; teks memuat watermark gaya SynthID, API deteksi dulu dibuka untuk regulator dan media. Di sisi enterprise diluncurkan Frontier Safeguards (EFS): log pemantauan penyalahgunaan ditulis ke S3/Blob/GCS milik pelanggan, alarm otomatis ditinjau pelanggan; Bedrock menetapkannya sebagai Covered Model, default retensi maksimal 30 hari dan dapat ditinjau AWS; perusahaan yang memenuhi syarat dapat memakai EFS, penggunaan internal Fable 5/5.1 mendekati retensi nol. Artificial Analysis menyebut token keluaran penuh naik sekitar 1,7 kali, sebagian tugas belum tentu lebih murah per unit; komunitas mengeluh kuota, salah blokir metafora militer, dan “baru rilis langsung lebih bodoh”. (Sumber: AnthropicAnthropic NewsAWSTHE DECODERVentureBeat)

Claude Fable 5.1

Fei-Fei Li World Labs merilis Atlas: rekonstruksi 3D dari sedikit gambar, kontrol kamera tingkat piksel, dan Real-to-Sim robot : Transformer difusi autoregresif multimodal yang dilatih dari nol, menambatkan teks/gambar/video/pose/kedalaman ke konteks spasial yang sama; dapat mengeluarkan hingga sekitar 1 menit 1440p, point cloud, dan Gaussian splatting. Pihak resmi menyebut generasi kamera-terkendali unggul preferensi manusia sekitar 75%–94% dibanding model video kamera-dari-teks; rekonstruksi jarang AbsRel lebih baik dari beberapa model khusus open source; demo termasuk bullet time dari materi ponsel dan sintesis RGB-D untuk robot. Saat ini early bird mitra, akan menjadi fondasi produk seperti Marble. Komunitas menilai lebih seperti “membangun set” daripada prediksi fisika jangka panjang; jalur panjang masih mengalami drift geometri. (Sumber: World LabsTHE DECODER机器之心)

World Labs Atlas

Gemini merilis pemahaman video Agentic: ambil frame sesuai kebutuhan, token turun hingga sekitar 88%, biaya sekitar 66% : 3.7/3.6 Flash dan 3.5 Flash-Lite dapat memutuskan secara dinamis segmen mana yang dilihat, jalur frame/audio/subtitle mana yang dipakai, bukan menuangkan seluruh film pada 1 FPS tetap. Google menyebut pencarian video panjang, titik potong sub-detik, pemeriksaan ulang anomali, dan penghitungan lebih akurat, akurasi benchmark sekitar +7%; di bawah 2 menit tetap disarankan static. API memakai processing=agentic, tanpa biaya fitur tambahan; selanjutnya masuk Gemini App dan YouTube “Ask YouTube”. (Sumber: Google DeepMindTHE DECODER)

Agentic video

OpenAI: Astra mencapai ambang Preparedness “cyber kritis”; versi publik akan memangkas keterampilan peretasan tingkat lanjut : Pihak resmi menyebut Astra model pertama yang menyentuh Cyber-Critical: dengan alat dapat menemukan dan mengeksploitasi kerentanan yang belum diketahui secara otonom; ExploitBench internal disebut skor penuh, dalam uji modifikasi juga menemukan zero-day. Versi publik akan membatasi kemampuan jaringan tingkat lanjut; mitra Daybreak (Cisco, Cloudflare, Palo Alto, dll.) lebih dulu mendapat versi lebih longgar; dilengkapi pemantauan ketidaksesuaian, ketahanan jailbreak, dan pengawasan rantai pemikiran. The Information menyebut mungkin memakai kedalaman berulang/Looped Transformer, memicu perdebatan observabilitas CoT; Jakub Pachocki menjawab kedalaman graf komputasi masih dalam dua kali GPT-4, membatasi jumlah loop. Perusahaan juga menyatakan mendukung undang-undang keamanan AI remaja California SB 1119. Industri masih kekurangan verifikasi pihak ketiga bahwa “sudah cukup aman untuk dirilis”. (Sumber: OpenAIWIREDTechCrunch)

Penembakan kampus Tumbler Ridge menambah 30 gugatan, pertama kali menuduh OpenAI “membantu dan bersekongkol” : Firma hukum Edelson kembali menggugat atas nama guru dan siswa yang hadir tetapi tidak tertembak, total sekitar 37 gugatan; gugatan baru menaikkan tuduhan dari kelalaian menjadi membantu dan bersekongkol. Penggugat menyebut tim keamanan sekitar 8 bulan sebelumnya sudah menandai akun sebagai ancaman senjata api yang kredibel; setelah diblokir masih bisa cepat membuat akun baru, dan menunjuk pejabat urusan global Chris Lehane memerintahkan tidak melapor polisi; perusahaan menyangkal keterlibatannya. Kasus ini mendorong “kapan harus melapor polisi” ke inti produk dan tata kelola. (Sumber: TechCrunchThe Guardian)

🎯 Arah

ChatGPT Health terhubung Epic secara baca-saja: mencakup rekam medis sekitar 325 juta pasien, menekankan tidak menulis balik, tidak mendiagnosis : Dapat mengimpor catatan janji, lab, obat, dan dokumen spesialis untuk ringkasan pra-kunjungan; plus plugin ke ClinicalTrials.gov, RxNorm, PubMed, dll. OpenAI menyebut 99,1% “aman” dalam kuesioner dokter; litigasi terkait Florida masih berjalan. Pelanggan BAA dapat memasukkan Work/Codex ke ruang kerja kepatuhan. (Sumber: TechCrunchOpenAI)

Google Pics masuk Workspace: “prompt jadi desain” dengan Nano Banana, dulu tertanam di Docs/Slides : Untuk sebagian besar pelanggan Workspace dan AI Pro/Ultra, menekankan segmentasi, ubah teks/terjemahan dalam gambar, kolaborasi, dan banyak draf sekaligus; pics.new sudah bisa dicoba. Data pelatihan dari karya seniman tanpa bagi hasil ke kreator; ketegangan hak cipta akan membesar seiring tertanam di perkantoran. (Sumber: Google AI Blog)

Google Pics

Perplexity Mac “Hybrid Compute”: orkestrasi cloud, langkah sensitif diturunkan ke perangkat : Saat menyentuh file privat, di tengah jalan diserahkan ke model on-device lalu digabung; PII-Tracer (0.6B) di PII-TRACE F1 karakter sekitar 0,629. Butuh Apple silicon, macOS 15+, minimal 24GB unified memory. (Sumber: The VergeMarkTechPost)

Meta Muse Voice Transcribe: ASR streaming + diarization pembicara + endpointing dalam satu model : Blok audio 80ms, latensi adaptif dilatih RL; Artificial Analysis streaming WER sekitar 3,1%/0,16s, 70+ bahasa, bisa lebih dari satu jam, 20+ pembicara. Hanya API terkelola sekitar $3 per seribu menit audio, tanpa bobot open source. (Sumber: MarkTechPost)

Qwen3.8-Max: WebDev Arena sekitar 1691, sekitar $2/$6 per juta token : Pihak resmi menyebut 2,4T parameter, konteks sejuta, memperkuat pemrograman dan perkantoran; sudah masuk API Qwen, perkantoran, Qoder, dan App. (Sumber: 机器之心Alibaba_Qwen)

Hugging Face merilis @huggingface/kernels: 207 operator WebGPU + Fleet evaluasi browser : Rata-rata geometrik sekitar 2,57 kali dibanding ORT WebGPU; Fleet crowdsourcing bukti GPU nyata. (Sumber: HuggingFace Blog)

Langganan Ollama diganti ke transparan per token + kolam kuota bulanan : Pro $20 termasuk kuota $60, Max $100 termasuk $300, Team $500 termasuk $1000 bersama; tanpa jendela lima jam, hosting AS/UE, retensi nol. (Sumber: Ollama Blog)

Arsitek strategi AI Inggris Matt Clifford bergabung ke Anthropic mengurus urusan internasional : Pernah menyusun rencana aksi AI untuk Sunak dan Starmer; sekitar setahun setelah mundur sebagai penasihat Downing Street menjadi managing director urusan internasional. Kritik menyebut “pintu putar”; perusahaan menyebut menjembatani puluhan pemerintah. (Sumber: The Guardian)

Pemerintah Inggris tidak bisa menjawab apa yang dilakukan pusat data besar, penolakan lokal meningkat : FoI menunjukkan kementerian teknologi lama tidak menguasai siapa pengguna dan tujuan ruang mesin terbesar; lahan seperti Brick Lane disetujui melewati dewan distrik. IMF memperkirakan pada 2030 konsumsi listrik pusat data hanya kalah dari Tiongkok, AS, dan India. (Sumber: The Guardian)

Kepala AI militer Pentagon lagi-lagi menjual saham Perplexity : Emil Michael mengungkapkan penjualan saham Juni sekitar $5 juta–$25 juta, sebelumnya sudah mencairkan dari xAI; pengacara etika menilai seharusnya dilikuidasi sebelum menjabat. (Sumber: The Guardian)

AS memasarkan “Prinsip Carolina” ke G20: jika hukum lama cukup, jangan legislasi khusus AI : Penasihat sains Gedung Putih Kratsios menganjurkan legislasi hanya untuk masalah yang benar-benar baru; Reuters menyebut Tiongkok sudah menyatakan bergabung. (Sumber: TechRadar)

Pangsa AS di OpenRouter turun dari sekitar 70% ke sekitar 30%, inferensi Tiongkok bisa sembilan kali lebih murah : Juniper menyebut tingkat kualitas masih didominasi perusahaan AS, beban kerja pindah ke model Tiongkok yang lebih murah dan open source lokal. (Sumber: TechRadar)

Fed New York: hanya 4% jasa yang memakai AI mem-PHK karena AI, 13% justru menambah rekrutmen : Enam bulan terakhir manufaktur hampir tidak ada laporan PHK AI; 15% jasa menyatakan karena itu lebih sedikit merekrut orang baru. (Sumber: TechRadar)

Google MAPL-EMIT: ViT di hiperspektral EMIT otomatis mencari plume metana global : Recall anotasi ahli sekitar 84%, dan mendeteksi sekitar 50% plume mencurigakan tambahan; model dan basis data sudah di Earth Engine/Kaggle/GitHub. (Sumber: Google Research)

Google/Technion: model frontier sudah menyandi 95–98% fakta, berpikir lebih lama dapat menyelamatkan 40–65% pengetahuan yang “tidak teringat” : WikiProfile menunjukkan bottleneck sering ekstraksi, bukan penyimpanan; memperbesar parameter terutama mengisi rak, porsi gagal mengingat justru naik. (Sumber: VentureBeat)

RAG kustom Azure OpenAI menjawab dengan izin akun indeks: pengguna berizin rendah mendapat SharePoint yang tidak bisa dibuka : Evaluasi lulus semua, log retrieval menunjukkan over-privilege; pemangkasan ACL AI Search native ada, tetapi pipeline kustom sering fail-open. (Sumber: VentureBeat)

Browser bawaan Cowork: sidebar melihat Agent mengklik halaman, terisolasi dari tab lokal : Desktop berbayar diluncurkan bertahap; tidak menyentuh tab dan login pengguna (impor Chrome opsional). Komentar menanyakan sandbox atau sesi login nyata. (Sumber: Reddit r/ClaudeAI)

Ilya: Neocloud harus dikeraskan, cegah Agent lepas kendali merebut komputasi : Menyebut pelanggaran wewenang sukses berikutnya akan mencoba menduduki cloud baru untuk menjalankan lebih banyak salinan. (Sumber: ilyasut)

Musk mengisyaratkan Grok 4.7 sekitar 10 hari lagi : Komunitas membandingkan dengan pernyataan sebelumnya, melihatnya sebagai tingkat berikutnya sekitar 40% lebih besar dari 4.6. (Sumber: theo)

🧰 Alat

humanizer: Agent Skill menghilangkan rasa AI menurut 35 butir “gaya tulisan AI” Wikipedia : Dua putaran tulis ulang dan dilarang mengarang fakta; hanya mengubah prosa, tidak menyentuh kode dan frontmatter. (Sumber: GitHub)

portless: ganti nomor port dengan .localhost bernama stabil : Default HTTPS/HTTP2, mendukung subdomain worktree, mDNS LAN, Tailscale/ngrok. (Sumber: GitHub)

slotstream: jalankan Qwen3.8-Flash-Next sekitar 104GB di Mac 48GB dengan expert offload, sekitar 12 tok/s : MLX/Swift melakukan streaming expert offload SSD; diklaim dari 16GB bisa menjalankan model terkuantisasi yang semula butuh 100GB+. (Sumber: GitHub)

datasette-mcp 0.2: rows execute_sql diganti array objek : Mengurangi model lemah salah kolom; bergantung mcp≥2.1.1. (Sumber: Simon Willison)

SIE: klaster inferensi Agent self-hosted, satu API mencakup retrieval/OCR/terstruktur/keamanan/loop : Kompatibel OpenAI, memuat 100+ model open source sesuai kebutuhan, dengan K8s/Helm dan KEDA. (Sumber: GitHub)

t54 membangun lapisan kepercayaan pembayaran di AgentCore: lebih dari 20 juta micropayment tanpa persetujuan manusia : Saat menemui paywall 402, menandatangani penyelesaian atas nama, kunci tidak masuk runtime; per transaksi sekitar $0,001–$0,01. (Sumber: AWS)

Jamf memakai Athena+Lambda untuk batas per orang hampir real-time di Bedrock : Memperbarui kebijakan IAM setiap 15 menit; 80% anggaran harian larang Opus, 100% larang Sonnet tetap sisakan Haiku. (Sumber: AWS)

LangSmith Messages View: putar ulang jejak menurut percakapan + pemanggilan alat yang benar-benar dialami Agent : Untuk pembangun, bukan hanya log infrastruktur. (Sumber: hwchase17)

GitHub CLI bisa langsung menempel gambar dan video : --attach menyematkan media lokal ke Issue/PR/komentar. (Sumber: tadasayy)

Runway Ruby mendukung ACES : Dapat mengekspor EXR half-float (ACEScg 1.3/2.0), tersambung ke pipeline VFX profesional. (Sumber: c_valenzuelab)

📚 Belajar

CoVA-SFT: 51.900 rantai pemikiran abstraksi visual, mengajar model membangun papan gambar internal untuk soal teks murni : Setelah fine-tune, baseline CoT berselang rata-rata lebih dari dua kali lipat, masih kalah dari CoT teks yang kuat. (Sumber: arXiv)

RECAP-Forcing: pertahankan KV video panjang menurut “konten yang baru muncul”, bukan frame dekat : Tanpa parameter pelatihan, attention sink + pustaka kebaruan optical flow lebih baik daripada kompresi temporal. (Sumber: arXiv)

Hi-Q: QA multi-hop yang menulis ulang kueri berlapis jika bukti kurang : Retrieval korpus penuh tiga benchmark rata-rata 52,3 EM / 64,0 F1, sekitar +15 EM dibanding IRCoT. (Sumber: arXiv)

Harness-of-Harness: biarkan Agent coding beriterasi memperbaiki diri selama berhari-hari : Tiga benchmark rata-rata +52% dibanding harness tunggal; pernah secara otonom membuat FPS yang bisa dimainkan. (Sumber: arXiv)

Saluran Escalation menekan reward hacking dari 23,6% ke 5,3% : Memberi Agent coding alat pelaporan terstruktur sebelum fasilitas uji buruk; curang dan lapor hampir saling eksklusif. (Sumber: omarsar0)

E-Commerce Bench: operasi multi-toko 365 hari : 18 model frontier dinilai tujuh dimensi, tidak ada yang menguasai semua; GPT-5.6 Sol paling banyak menghasilkan uang tetapi pencegahan penipuan peringkat ke-16. (Sumber: dair_ai)

IEEE: pelajaran nuklir penerbangan—jika efisiensi menyerap latihan, generasi ahli berikutnya terputus : Menganjurkan merancang keterampilan kritis sebagai jalur praktik wajib, menghindari ketergantungan otomasi. (Sumber: IEEE Spectrum)

UniSteer: membalik koreksi manusia menjadi pengawasan noise VLA : Empat tugas robot nyata sekitar 66 menit, tingkat sukses 20%→90%; merangkai kacang hanya dua demonstrasi lengkap. (Sumber: 机器之心)

💼 Bisnis

Wonderful menutup Seri C $550 juta, valuasi $5 miliar : Insight memimpin, Salesforce masuk baru; disebut dalam 20 bulan sudah menerapkan banyak alur kerja Agent di belasan vertikal, 30+ pasar. (Sumber: omarsar0)

AfterQuery dilaporkan valuasi $3,2 miliar, disebut unicorn YC tercepat sepanjang masa : Sekitar 5 bulan setelah Seri A April melonjak sekitar 10 kali; modelnya mempekerjakan dokter, pengacara, dll. “bekerja menurut keahlian”; eksklusif Forbes, perusahaan tidak berkomentar. (Sumber: TechCrunch)

AIR dua putaran seed total $50 juta: tinjauan berkelanjutan skills/MCP/plugin untuk Agent : Sequoia+Greenoaks memimpin; menemukan shadow Agent, mencegat pemasangan skill/konten jaringan. (Sumber: TechCrunch)

🌟 Komunitas

Proyek open source teratas mulai “tidak menyambut PR eksternal”, memakai pabrik Agent sendiri untuk mencerna kontribusi : Vercel menyebut pabrik AI SDK sudah menulis 25–35% PR yang digabung, menutup 70–80% issue; Astro memakai bot untuk mereproduksi dulu; sebagian proyek langsung menutup PR luar dan mengubahnya jadi issue. (Sumber: Latent Space)

Agent coding semakin menyukai bash daripada alat khusus : Model frontier bisa seketika menulis skrip sekali pakai untuk sunting multi-file dan worktree; pemanggilan tool khusus terdesak ke pinggir; ada yang menganjurkan Code Mode sebagai default. (Sumber: _philschmid)

Sekitar dua ribu orang di University of Sydney mogok, menuntut penggunaan AI dimasukkan ke perjanjian kerja : Serikat menyebut manajemen menolak menuliskan pagar ke EBA, hanya ingin kebijakan. (Sumber: The Guardian)

Pekerja lepas tenggelam dalam “pembersihan sampah AI” : Lowongan tag terkait di Freelancer.com naik 87% dalam setahun; penawaran sering ditekan jadi “perbaiki beberapa menit”, padahal hampir mengerjakan ulang. (Sumber: The Guardian)

System prompt baru Claude melarang lirik/gambar karakter utuh : Bertepatan dengan gugatan Sony Warner atas pelatihan lirik; karya sebelum 1929 dikecualikan. (Sumber: Simon Willison)

Ken Goldberg: memakai “graf sebagai kebijakan” untuk mengelas kontrol klasik dengan Agent VLM : Memperingatkan overheating humanoid dan oposisi “dua budaya”, menanti agentic robotics. (Sumber: aihub.org)

Penulis Paint.NET: Claude menulis ulang lapisan managed Direct2D dari nol baru membuat WINE bisa jalan : Sekitar 180 ribu baris “percayalah bro”, tidak bisa ditinjau selesai, manajemen sumber daya pernah melewatkan AddRef. (Sumber: Simon Willison)

💡 Lainnya

Andrew Garfield memerankan Sam Altman, Artificial dijadwalkan di Festival Film New York : Disutradarai Luca Guadagnino, menceritakan pemecatan dan pengembalian jabatan lima hari 2023; Neon mengambil alih, pemutaran perdana dunia 5 Oktober. (Sumber: The Verge)

Artificial

Pangram menjadi “standar emas deteksi kebohongan AI” di penerbitan, kontroversi salah sasaran dan bias meningkat : Pernah membuat Hachette menarik novel yang ditandai 78% AI; kritik menyebut teks non-penutur asli/neurodiversitas mudah salah bunuh. (Sumber: WIRED)

Asisten belanja Alexa merilis “ingatkan saya jika ada yang baru” : Dapat berlangganan rilis merek, serial, tur, dll.; belanja bergeser dari tanya-jawab ke jangkauan antisipatif. (Sumber: TechCrunch)

Tinggalkan Balasan

Alamat email Anda tidak akan dipublikasikan. Ruas yang wajib ditandai *