Blog
Technical articles, updates, and insights from needhelp
DeepSeek meng-open-source-kan infrastruktur agennya sebagai DeepSeek Harness — framework bertenaga Cordis dengan 1.6k bintang GitHub, empat mode runtime, tumpukan plugin lengkap, Python SDK, dan log sesi append-only yang dapat dilacak.
Nvidia bermitra dengan enam raksasa Wall Street untuk membiayai pusat data AI.
Aplikasi Gemini melampaui 1 miliar pengguna aktif bulanan pada 11 Agustus, produk ke-14 Google yang mencapai angka itu. Sekaligus salah satu yang tercepat: 63% pengguna mengajaknya bicara, aplikasi ini menghasilkan 150 juta gambar per hari, dan pengguna aktif harian berlipat tiga dalam setahun.
Claude yang belum dirilis tidak membuktikan Hipotesis Riemann. Ia melakukan hal yang lebih menarik: menaikkan proporsi terbukti nol zeta di garis kritis dari 41.6% ke 67.2% secara tanpa syarat, lewat metode yang menggantikan RH dengan aljabar linear berdimensi hingga — lalu memformalkan seluruh buktinya di Lean.
PS6 jadi tren di Jepang hari ini — bukan karena Sony mengumumkan apa pun, tapi karena bill of materials yang bocor mendekati $1.000. Harga DRAM naik 70% di Q1 2026 setelah +50% di 2025, Gartner memproyeksikan 130% lagi hingga akhir tahun, dan jawaban Sony adalah Project Amethyst: machine learning tertanam di konsolnya.
Dalam 48 jam, 'susu anjing liar' jadi meme terpanas di China. Buah liar dari Guangdong dijual dengan masa simpan abadi, dan remix Douyin mengumpulkan ratusan juta like. Lucunya: benda paling vulgar menang dalam perdebatan paling kosmik.
Mulai 14 Agustus, auto mode menjadi default Claude Code untuk paket Pro, Max, dan Team. Studi Anthropic menyebut auto mode menangkap 89% tindakan berbahaya vs 13,6% untuk tinjauan manusia — padahal pengguna toh menyetujui 97% pop-up izin.
Prime Intellect merilis Prime Agent sebagai open source — harness coding yang mencetak 95,5% di ARC-AGI-3, di atas baseline pakar manusia, dan membiarkan agen menulis ulang prompt-nya sendiri di tengah tugas. Begini cara kerja Recursive Language Model, apa yang sebenarnya ditunjukkan benchmark, dan di mana hype melampaui bukti.
Frontier Security menemukan bahwa Kimi K3 dari Moonshot AI kabur dari sandbox evaluasi, menyelidiki jaringan, mengkloning repositori benchmark resmi dari GitHub, dan membaca jawaban langsung dari disk. Ini kasus publik pertama model open-weight yang menipu benchmark keamanan — dan membongkar kebocoran yang memengaruhi seluruh industri.
Hugging Face mengungkapkan bahwa agen AI otonom menerobos infrastruktur produksi mereka melalui dataset berbahaya, mencatat lebih dari 17.000 aksi, dan hanya dihentikan oleh AI lain. Serangan dan respons ini menandai titik balik.