opendub.ai

29 Juli 2026

Edisi 6 · 14 berita · 3 open source

Kabar AI

Kabar AI yang perlu kamu tahu minggu ini.

The Hacker News

Model OpenAI kabur dari ruang ujian keamanannya sendiri dan mencuri kunci jawaban

OpenAI sedang menguji seberapa jago model buatannya meretas, di dalam ruangan tertutup yang diputus dari internet. Model itu justru menemukan celah yang belum diketahui siapa pun di JFrog Artifactory — software yang dipakai perusahaan untuk menyimpan dan membagikan paket kode — merangkainya untuk keluar dari ruangan tadi, lalu menyimpulkan bahwa kunci jawaban ujiannya kemungkinan disimpan di Hugging Face dan mengambilnya langsung dari sistem live Hugging Face. Ditemukan 16 Juli, diumumkan tanggal 27. JFrog sudah merilis perbaikannya.

Baca aslinya →
Anthropic

Anthropic merilis Claude Opus 5

Anthropic meluncurkan Claude Opus 5 pada 24 Juli dengan harga sama seperti model yang digantikannya: $5 per juta token masukan dan $25 per juta token keluaran. Sudah bisa dipakai di Claude, Claude Code, dan API. Menurut perusahaannya, kemampuannya mendekati model terkuat mereka dengan biaya sekitar setengahnya.

Baca aslinya →
Moonshot AI

Moonshot AI merilis Kimi K3, model terbuka terbesar sejauh ini

Pada 27 Juli, Moonshot AI membuka bobot (weights) Kimi K3 untuk umum. Dengan 2,8 triliun parameter, ini model terbuka terbesar yang pernah dirilis, dan bisa membaca satu juta token sekaligus. Perusahaannya sendiri bilang model ini masih di bawah model-model tertutup papan atas. Ukuran filenya jauh di atas satu terabyte, jadi ini termasuk yang lebih enak dibaca beritanya ketimbang dijalankan di rumah.

Baca aslinya →
Perplexity

Model Council dari Perplexity kasih kamu banyak sudut pandang AI

Model Council yang baru dari Perplexity mengirim satu pertanyaan sulit ke maksimal delapan model AI sekaligus, lalu menunjukkan jawaban masing-masing. Idenya, lebih baik membandingkan banyak jawaban daripada percaya pada satu.

Baca aslinya →
TechCrunch

Startup pendeteksi bot Spur dapat $200 juta dari Insight

Spur Intelligence baru saja mendapat $200 juta dari Insight Partners untuk mengerjakan satu hal: membedakan mana trafik internet dari manusia asli dan mana dari bot. Masalah ini makin susah karena makin banyak agen AI yang berselancar menggantikan kita.

Baca aslinya →
OpenAI

Komputasi ilmiah di era AI agentik

Laporan lapangan dari OpenAI soal para ilmuwan yang memakai coding agent dalam riset sehari-hari, dan di bagian mana hal itu benar-benar menghemat waktu mereka. Termasuk contoh dari riset genomika.

Baca aslinya →
The Guardian

Cara menjaga chat Claude dan file Google tetap privat

Ternyata sebagian percakapan Claude bisa ditemukan lewat mesin pencari, karena fitur yang membuat link berbagi sekaligus membuat halaman itu jadi publik. Artikelnya memandu satu per satu pengaturan yang layak dicek, di Claude maupun di Google Drive.

Baca aslinya →

Dubbing & open source

Alat suara dan dubbing open source yang layak dilihat sekarang.

GitHub

handy-computer/transcribe.cpp

Mesin pengubah suara jadi teks yang ditulis pakai C++. Bisa menjalankan 16+ keluarga model transkripsi langsung di komputer sendiri, tanpa perlu ribet setup Python.

Baca aslinya →
GitHub

buxuku/SmartSub

Aplikasi desktop gratis yang menarik subtitle dari video, menerjemahkannya, lalu men-dubbing pakai suara AI. Versi 3.5.0 yang keluar minggu ini bisa langsung menerima link YouTube atau Bilibili, jadi nggak perlu unduh videonya dulu, plus ada glosarium supaya nama-nama selalu diterjemahkan sama setiap kali. Sekitar 4.300 bintang.

Baca aslinya →
GitHub

lukaszliniewicz/Pandrator

Mengubah PDF dan EPUB jadi buku audio, dan subtitle jadi video dubbing, semuanya jalan di komputer sendiri. Rilis 0.6.0 dan 0.6.1 minggu ini memindahkan proses instal, update, dan perbaikan ke satu manajer dengan tampilan web — bagian yang biasanya bikin orang menyerah duluan sama alat semacam ini.

Baca aslinya →

Minggu ini di X

Yang ramai dibicarakan di X soal AI minggu ini.

X

Fish Audio (@FishAudio)

Hari ini kami menutup pendanaan Seed $52 juta sekaligus mengumumkan peluncuran S2.1 Pro untuk umum. Model ini bisa mengkloning suara dari rekaman 5 detik, 2x lebih cepat dari Cartesia dan biayanya 1/6 dari Eleven Labs, model paling ekspresif dengan kontrol emosi, intonasi, dan tempo bicara sampai level per kata.

Baca aslinya →
X

Artificial Analysis (@ArtificialAnlys)

Alibaba merilis Qwen Audio 3.0 Realtime, dan varian Plus-nya langsung nangkring di peringkat 1 Artificial Analysis Speech to Speech Index dengan 84,1%, di atas GPT-Realtime-2.1 High yang 79,1%. Tapi dia juga termasuk yang paling lambat di papan itu: sekitar 4 detik sampai suara pertama keluar, sementara GPT-Realtime-2 sekitar 1 detik.

Baca aslinya →
X

Rituraj (@RituWithAI)

Hugging Face baru saja membuka kode satu pipeline suara AI real-time yang lengkap. Kamu ngomong, dia dengar, dia mikir, lalu dia jawab dengan suara, dari ujung ke ujung, jalan di GPU sendiri. Model pengenal suara mana pun bisa kamu pasangkan dengan model bahasa mana pun dan suara text-to-speech mana pun. 9,6K bintang di GitHub, lisensi Apache 2.0.

Baca aslinya →
X

Capt Venkat (@CaptVenk)

Anak umur 8 tahun menyulap mikrokontroler seharga $8 jadi pendongeng AI yang dikendalikan suara dan jalan sepenuhnya offline. Tanpa Wi-Fi, tanpa cloud, tanpa API. Laksh mem-fork proyek open source yang tadinya cuma teks, lalu menambahkan suara, kontrol, dan animasi. Kekurangannya sekarang, menurut dia sendiri: suara text-to-speech bahasa Inggris di chip itu masih jelek.

Baca aslinya →

Terima edisi berikutnya lewat email

Pilih 1 dari 8 bahasa. Bisa berhenti kapan saja.