
Kimi K3 adalah model bahasa besar berbobot terbuka dengan 2,8 triliun parameter yang dirilis oleh perusahaan Tiongkok Moonshot AI (berbasis di Beijing) pada 17 Juli 2026, yang oleh perusahaan itu sendiri disebut sebagai “model bobot terbuka terbesar di dunia”. Yang menjadi fokus artikel ini bukan seberapa mengesankan model itu sendiri, melainkan reaksi pasar dalam beberapa hari setelah peluncurannya, bagaimana beberapa akademisi dan analis yang berkomentar secara publik menafsirkan peristiwa ini, dan apa sebenarnya makna rangkaian perkembangan ini sebagai titik acuan bagi perusahaan dan pengembang yang sedang mengevaluasi pengadaan dan pemilihan model AI.
Apa Itu Kimi K3? Spesifikasi Dasar dan Konteks di Balik Peluncuran Ini
Kimi K3 dikembangkan oleh Moonshot AI dan merupakan model bobot terbuka, artinya berkas bobot model dapat diunduh dan digunakan di lingkungan Anda sendiri, alih-alih hanya dapat diakses melalui API resmi — ini adalah perbedaan paling langsung dengan sebagian besar model komersial berbobot tertutup. Skala 2,8 triliun parameter, ditambah dengan posisi resmi sebagai “model bobot terbuka terbesar di dunia”, adalah dua angka dan klaim pertama yang dibicarakan setelah peluncuran ini. Peluncuran ini juga terjadi dalam konteks yang lebih besar: dorongan berkelanjutan Tiongkok untuk ekosistem AI sumber terbuka, berbeda dengan kubu model tertutup yang diwakili oleh OpenAI dan Anthropic di AS — Kimi K3 adalah kasus terbaru yang mendapat perhatian tinggi di bawah tren besar ini.
Kinerja Aktual di Papan Peringkat: Sekitar Peringkat 10 di Teks, Peringkat Pertama di Pengodean
Alih-alih hanya melihat jumlah parameter, peringkat papan peringkat pihak ketiga memberikan nilai referensi yang lebih berguna. Di papan peringkat Arena (dulu LMArena/Chatbot Arena), yang berasal dari tim riset UC Berkeley dan sejak itu telah menjadi organisasi evaluasi independen dan khusus, Kimi K3 berada di peringkat sekitar 10 secara global dalam kategori teks (karena interval kepercayaan tumpang tindih dengan peringkat tetangga, posisi aktual berfluktuasi sedikit di setiap putaran evaluasi — peringkat 10 adalah angka langsung pada saat artikel ini diverifikasi faktanya); tetapi di papan peringkat pengodean (coding) Arena, Kimi K3 berada di peringkat pertama. Kesenjangan ini — “peringkat menengah di teks, peringkat pertama di pengodean” — adalah detail penting yang secara independen disoroti oleh beberapa komentator yang meliput peristiwa ini: ini adalah pengingat bahwa satu peringkat papan peringkat saja tidak bisa menunjukkan seberapa kuat sebuah model “secara keseluruhan”, karena kinerja pada jenis tugas yang berbeda bisa berada pada rentang yang sama sekali berbeda.
Bagaimana Moonshot Sendiri Memposisikan Model Ini: Kinerja Tingkat Terdepan, tapi Masih Tertinggal dari Model Berpemilik Terkuat
Perlu dicatat, posisi Moonshot sendiri terhadap Kimi K3 cukup terukur, dan tidak mengklaim mengungguli semua pesaing secara menyeluruh. Pernyataan resminya adalah bahwa Kimi K3 “menunjukkan kinerja tingkat terdepan (frontier-level) dalam rangkaian evaluasi kami”, sambil juga secara eksplisit mengakui bahwa model ini “masih tertinggal dari model berpemilik terkuat dari Anthropic dan OpenAI”. Penilaian diri ini sendiri merupakan sebuah sinyal: ketika sebuah perusahaan secara sukarela mengakui saat peluncuran siapa saja yang masih mengungguli mereka, kesenjangan itu biasanya merupakan fakta yang sudah dilihat industri dan tidak bisa dihindari — bukan retorika PR yang sengaja dibuat rendah hati oleh vendor.
Pandangan Ethan Mollick: Model Terbuka yang Mendekati Garis Depan Bisa Juga Menggeser Ritme Peluncuran Laboratorium AS Sendiri
Profesor Wharton School Ethan Mollick memposting komentar publik di X (Twitter) pada hari peluncuran Kimi K3. Fokusnya bukan pada apakah model itu sendiri bagus atau tidak, melainkan pada reaksi berantai yang mungkin dipicu peristiwa ini dalam lanskap kompetitif AS. Inti komentarnya: seiring model bobot terbuka seperti Kimi K3 semakin mendekati garis depan, ia bertanya-tanya apakah Anthropic dan OpenAI akan diizinkan oleh pemerintah AS untuk mempercepat ritme peluncuran mereka sendiri — mencatat bahwa rilis Anthropic sebelumnya, Mythos, adalah produk bulan April (sebelum Opus 4.7), yang berarti Claude Fable 5 sebenarnya sudah menjadi model yang “lebih lama” dibandingkan. Dengan kata lain, komentar Mollick adalah spekulasi terbuka: seiring model bobot terbuka dari kubu Tiongkok terus mendekati garis depan, apakah sikap regulasi pemerintah AS terhadap ritme peluncuran laboratorium terdepannya sendiri juga bisa melonggar? Ini adalah pengamatan dan pertanyaan publik Mollick tentang peristiwa ini — bukan vonis atas kinerja aktual Kimi K3, dan juga bukan pujian atau kritik.
Perbandingan Pasar: Apakah Ini “Momen DeepSeek” Lagi?
Setelah peluncuran Kimi K3, saham semikonduktor dan terkait AI anjlok tajam, dan skala reaksi pasar membuat beberapa analis secara terbuka membandingkan guncangan ini dengan dampak pasar dari peluncuran DeepSeek R1 di awal 2025. Patrick Moorhead, CEO Moor Insights & Strategy, menggambarkannya dalam sebuah postingan di X sebagai “reaksi berlebihan yang mengejutkan miripnya dengan kepanikan DeepSeek”, menambahkan bahwa meski kemajuan teknis terus berlanjut, “kita masih sangat jauh dari superintelijensi”. Di sisi lain, pengamat industri Poe Zhao, pendiri buletin Hello China Tech, membacanya dari sudut kelanjutan tren: “Signifikansi yang lebih luas adalah DeepSeek semakin terlihat seperti awal dari sebuah pola; K3 menjadi bukti bahwa kemajuan Tiongkok semakin bisa diulang”. Semua ini adalah komentar publik dari berbagai analis tentang reaksi pasar terhadap peristiwa ini, dan pandangan mereka juga tidak sepenuhnya sepakat — ada yang menganggapnya reaksi berlebihan, ada yang menganggapnya kelanjutan tren — artikel ini tidak memperbesar perbandingan ini lebih jauh, dan juga tidak mewakili posisi situs ini soal apakah perbandingan itu sendiri sahih.
Peringatan Analis: Kesenjangan Uji Nyata dan Infrastruktur Komputasi Adalah Variabel yang Mudah Terlewat
Selain peringkat papan peringkat, beberapa analis menawarkan sudut pandang yang lebih hati-hati, memperingatkan pembaca agar tidak menafsirkan berlebihan satu papan peringkat mana pun. Malik Ahmed Khan, analis ekuitas senior di Morningstar, menyatakan dalam catatan risetnya: “Meski K3 memang merupakan kemajuan, kami akan ragu untuk menyebutnya hampir setara dengan model tingkat terdepan Amerika, seperti Fable 5, dalam tugas dunia nyata”, ia menjelaskan bahwa banyak pengembang model terbuka secara historis mengoptimalkan performa perangkat lunak khusus untuk tolok ukur, sehingga bisa ada kesenjangan antara skor tolok ukur dan kinerja dunia nyata. Variabel lain yang mudah terlewat adalah infrastruktur komputasi itu sendiri: dalam 48 jam setelah peluncuran Kimi K3, Moonshot secara resmi mengonfirmasi bahwa permintaan telah mendekati batas kapasitas komputasi yang ada, memaksanya menghentikan sementara langganan pengguna baru untuk menjaga kualitas layanan bagi pengguna yang sudah ada — yang justru menegaskan bahwa “apakah pasokan stabil, di luar kemampuan model itu sendiri” juga merupakan masalah yang tak terhindarkan begitu sebuah model benar-benar digunakan. Peringatan-peringatan ini semuanya cenderung pada kerangka yang hati-hati dan penuh reservasi, bukan vonis positif atau negatif terhadap Kimi K3.
48 Jam Setelah Peluncuran: Apa yang Sebenarnya Diungkapkan oleh Lonjakan Permintaan, Penghentian Langganan, dan Laporan Pendanaan
Dalam 48 jam setelah peluncuran Kimi K3, permintaan dengan cepat mendekati batas kapasitas komputasi Moonshot yang ada; perusahaan menyatakan di X bahwa “Kimi K3 mendapat lebih banyak cinta dari yang kami perkirakan — GPU kami merasakannya”, dan sebagai hasilnya untuk sementara menghentikan langganan pengguna baru (pelanggan yang sudah ada tidak terpengaruh), menyatakan akan memperluas kapasitas secepat mungkin dan membuka kembali slot langganan baru secara bertahap, dan juga berencana memisahkan keanggotaan menjadi tingkatan tujuan umum dan khusus pengodean secara terpisah ke depannya untuk mengalokasikan sumber daya komputasi secara lebih efektif. Pada saat yang sama, laporan menunjukkan Moonshot saat ini sedang menutup putaran pendanaan dengan valuasi sekitar $31,5 miliar, dan berencana untuk putaran pra-IPO lainnya — yang berpotensi diluncurkan paling cepat Agustus — menargetkan valuasi hingga $50 miliar, membuka jalan menuju IPO Hong Kong (yang berpotensi melantai dalam enam bulan); angka-angka ini terus berubah seiring proses berjalan dan tetap menjadi kondisi terbaru yang masih dinamis pada saat penulisan ini. Digabungkan, rangkaian peristiwa ini sebenarnya tidak memberi tahu kita “seberapa sempurna model ini secara teknis” — melainkan menunjukkan bahwa permintaan pasar untuk kombinasi “bobot terbuka + kinerja tingkat terdepan” telah jauh melampaui kapasitas komputasi yang awalnya disiapkan Moonshot — inilah tepatnya mengapa beberapa analis menggambarkan skala reaksi pasar ini sebagai “sesuatu seperti momen DeepSeek”.
Apa yang Sebenarnya Perlu Dipelajari Perusahaan dan Pengembang untuk Strategi Pemilihan Model
Merangkum semua hal di atas, peristiwa Kimi K3 ini menawarkan setidaknya tiga pelajaran konkret bagi perusahaan dan pengembang yang sedang membuat keputusan pemilihan dan pengadaan model. Pertama, satu peringkat papan peringkat tidak bisa mewakili kemampuan keseluruhan — sebuah model mungkin peringkat pertama pada tugas pengodean sambil hanya tampil biasa-biasa saja pada tugas yang membutuhkan penanganan bahasa yang halus; dalam praktiknya, Anda harus menguji terhadap jenis tugas spesifik yang benar-benar akan Anda gunakan, bukan memutuskan berdasarkan satu peringkat yang terlihat mengesankan. Kedua, kesenjangan antara model bobot terbuka dan tertutup terus menyempit, tetapi bahkan Moonshot sendiri mengakui masih tertinggal dari model berpemilik terkuat — artinya “sumber terbuka” itu sendiri tidak sama dengan “terkuat”; pemilihan tetap harus kembali pada perbandingan dengan kebutuhan tugas spesifik Anda, bukan memperlakukan terbuka vs tertutup sebagai satu-satunya kriteria. Ketiga, kesenjangan uji nyata dan variabel infrastruktur yang disoroti analis berlaku sama untuk keputusan pengadaan — apakah sebuah model bisa dipasok secara stabil, dan apakah mungkin menghentikan layanan karena lonjakan permintaan (seperti Moonshot menghentikan langganan baru kali ini karena permintaan mendekati batas kapasitas komputasinya), itu sendiri adalah faktor risiko yang harus diperhitungkan dalam pemilihan model, bukan sesuatu yang bisa dinilai hanya dari skor kemampuan saja.
Tanya Jawab
Perusahaan mana yang merilis Kimi K3?
Kimi K3 adalah model bahasa besar berbobot terbuka yang dirilis oleh perusahaan Tiongkok Moonshot AI (berbasis di Beijing) pada 17 Juli 2026, dengan sekitar 2,8 triliun parameter. Perusahaan menyebutnya “model bobot terbuka terbesar di dunia”.
Apakah kinerja Kimi K3 di papan peringkat benar-benar bagus?
Tergantung jenis tugasnya. Di papan peringkat Arena, peringkat kategori teks Kimi K3 adalah sekitar 10 secara global pada saat verifikasi fakta (peringkat semacam ini berfluktuasi di setiap putaran evaluasi), sementara peringkat pertama di papan peringkat pengodean — kesenjangan yang cukup besar antara keduanya. Moonshot sendiri telah menyatakan model ini menunjukkan kinerja tingkat terdepan sambil masih tertinggal dari model berpemilik terkuat Anthropic dan OpenAI.
Apa arti perbandingan “momen DeepSeek”?
Ini adalah analogi yang dibuat oleh beberapa analis industri — termasuk Patrick Moorhead (CEO Moor Insights & Strategy) dan Poe Zhao (pendiri Hello China Tech) — sebagai respons terhadap reaksi pasar yang tajam setelah peluncuran Kimi K3, merujuk pada guncangan pasar serupa yang disebabkan oleh peluncuran DeepSeek R1 pada 2025. Ini adalah komentar publik dari analis tentang peristiwa ini, dengan pandangan yang juga tidak sepenuhnya sepakat satu sama lain; ini bukan vonis resmi, dan artikel ini tidak memperbesar perbandingan ini lebih jauh.
Mengapa Moonshot menghentikan sementara langganan pengguna baru?
Menurut pernyataan resmi, permintaan dengan cepat mendekati batas kapasitas komputasi Moonshot dalam 48 jam setelah peluncuran Kimi K3, yang membuatnya menghentikan sementara langganan pengguna baru (pelanggan yang sudah ada tidak terpengaruh); perusahaan mengatakan akan memperluas kapasitas secepat mungkin dan membuka kembali slot langganan baru secara bertahap.
Apa yang perlu diperhatikan perusahaan saat mengevaluasi apakah akan mengadopsi model baru seperti Kimi K3?
Setidaknya tiga hal: pertama, jangan menilai kemampuan keseluruhan dari satu peringkat papan peringkat saja — uji terhadap jenis tugas spesifik yang benar-benar akan Anda gunakan; kedua, kesenjangan antara model terbuka dan tertutup semakin menyempit, tetapi itu tidak berarti model terbuka pasti yang terkuat — tetap bandingkan dengan kebutuhan spesifik Anda; ketiga, stabilitas pasokan sebuah model (misalnya, apakah mungkin menghentikan layanan karena lonjakan permintaan) itu sendiri merupakan faktor risiko yang layak dipertimbangkan dalam pemilihan model.
Selain peringkat papan peringkat, perspektif hati-hati lain apa yang layak dipertimbangkan?
Ethan Mollick mengajukan pertanyaan terbuka dari sudut ritme regulasi AS: apakah model terbuka Tiongkok yang mendekati garis depan bisa membuat pemerintah AS melonggarkan sikapnya terhadap ritme peluncuran Anthropic dan OpenAI sendiri; analis Morningstar Malik Ahmed Khan memperingatkan bahwa banyak model terbuka secara historis telah dioptimalkan untuk tolok ukur, sehingga bisa ada kesenjangan antara skor tolok ukur dan kinerja dunia nyata, dan posisi sebenarnya dari sebuah model dalam tugas dunia nyata masih memerlukan penilaian yang hati-hati. Komentar keduanya cenderung pada kerangka hati-hati dan penuh reservasi, bukan vonis positif atau negatif terhadap model.
Sumber
Materi yang memicu topik ini adalah video yang dipublikasikan oleh kanal YouTube AI Revolution, “Is This the Biggest AI Release of 2026? (China's New DeepSeek Moment)” (videoId: V0RsocRqjIU), dipublikasikan sekitar 17 Juli 2026, dengan sekitar 128.000 tayangan (terverifikasi). Artikel ini ditulis tanpa akses ke transkrip video tersebut; setiap fakta spesifik dalam isi artikel (spesifikasi model dan tanggal rilis, peringkat papan peringkat Arena, deskripsi diri resmi Moonshot, pernyataan publik Ethan Mollick di X, komentar publik analis Patrick Moorhead / Poe Zhao / Malik Ahmed Khan, perubahan permintaan dalam 48 jam dan penjelasan penghentian langganan, serta laporan pendanaan/IPO) telah diverifikasi silang terhadap posting blog resmi Moonshot dan berbagai laporan berita publik (termasuk CNBC, CNN, Decrypt, NY Post, IBTimes/Reuters, Financial Express, Bloomberg, TechNode, Yahoo Finance, dan CoinDesk) dan disusun ulang menjadi analisis orisinal — bukan terjemahan atau parafrasa kata demi kata dari konten video. Judul video itu sendiri, “Is This the Biggest AI Release of 2026”, dengan sendirinya merupakan format pertanyaan sensasional yang belum terverifikasi; artikel ini secara eksplisit tidak mengadopsi atau mendukung klaim yang terdengar mutlak itu, dan mencantumkan judul serta tautan asli semata-mata untuk pengungkapan kepatuhan hak cipta. Artikel ini bukan merupakan saran investasi atau jaminan kinerja model; perusahaan yang mengevaluasi adopsi sebenarnya sebaiknya mengacu pada dokumentasi resmi dan hasil pengujian tugas spesifik mereka sendiri.