DEV Community

Cover image for Cara Menggunakan Kimi K3 untuk Coding dengan Kimi Code
Walse
Walse

Posted on • Originally published at apidog.com

Cara Menggunakan Kimi K3 untuk Coding dengan Kimi Code

Moonshot AI membangun Kimi K3 untuk pekerjaan coding yang tidak selesai dalam satu prompt: menavigasi repositori besar, membaca file, menjalankan alat, mengeksekusi tes, memeriksa log atau tangkapan layar, lalu mengulang sampai tugas selesai. Untuk menjalankan alur kerja ini, gunakan Kimi Code—agen terminal dan IDE dari Moonshot yang membungkus model dengan akses ke sistem file, shell, dan umpan balik runtime. Artikel ini menunjukkan cara menjalankan K3, membuat loop agensi yang terukur, serta memverifikasi API hasilnya.

Coba Apidog hari ini

TL;DR: menjalankan Kimi K3 untuk coding

Kimi K3 adalah model unggulan Moonshot AI yang diluncurkan pada 16 Juli 2026. Model ini memiliki jendela konteks 1 juta token dan dirancang untuk pekerjaan skala repositori. Jalankan melalui Kimi Code, lalu pilih model dengan /model dan berikan tugas yang spesifik.

K3 kuat untuk:

  • menavigasi basis kode besar;
  • memakai alat, shell, dan tes;
  • melakukan debugging;
  • mengulang berdasarkan log, hasil tes, respons runtime, dan tangkapan layar.

Model ini menarik untuk loop yang banyak memakai cache karena Moonshot melaporkan cache-hit rate di atas 90%. Namun, kecepatannya sekitar 62 token per detik dan Moonshot menyatakan K3 masih berada di bawah Claude Fable 5 serta GPT-5.6 Sol dalam kemampuan mentah.

Jika K3 membuat atau mengubah API, gunakan Apidog untuk mengirim permintaan nyata, memeriksa respons, dan memvalidasi kontrak endpoint. Untuk konteks model, baca apa itu Kimi K3.

Apa itu Kimi Code

Kimi Code adalah agen coding Moonshot yang berjalan di terminal dan dapat terintegrasi dengan IDE. Agen ini dapat:

  • membaca dan menulis file;
  • menjalankan perintah shell;
  • menjalankan tes dan build;
  • memeriksa hasilnya;
  • mengulang perubahan sampai target terpenuhi.

Model adalah mesin untuk menghasilkan teks dan memanggil alat. Kimi Code adalah harness yang memberi model akses ke repositori, sistem file, shell, output tes, serta tangkapan layar. Kombinasi ini membuat model tidak hanya menyarankan snippet, tetapi dapat mengerjakan ticket secara bertahap.

Kimi Code

Kimi Code sudah tersedia sejak lini Kimi K2. Untuk instalasi dari nol, lihat panduan CLI Kimi Code. Untuk referensi perintah yang lebih luas, baca cara menggunakan Kimi CLI.

Menjalankan Kimi K3 di Kimi Code

Sintaks instalasi dan flag dapat berubah seiring pembaruan Moonshot. Anggap perintah berikut sebagai pola alur kerja, lalu konfirmasikan sintaks terbaru melalui dokumentasi resmi Kimi atau panduan CLI Kimi Code.

Contoh Kimi Code

1. Instal agen dan autentikasi

Anda memerlukan akun Kimi serta API key dari platform pengembang Kimi. Simpan API key dalam variabel lingkungan, bukan di file konfigurasi yang berisiko ikut ter-commit.

# Contoh. Periksa dokumentasi resmi untuk sintaks terbaru.
export KIMI_API_KEY="your-key-here"
kimi-code
Enter fullscreen mode Exit fullscreen mode

2. Jalankan dari root proyek

Masuk ke direktori repositori sebelum menjalankan agen.

cd ~/projects/my-service
kimi-code
Enter fullscreen mode Exit fullscreen mode

Direktori saat ini menjadi root kerja Kimi Code. Karena itu, menjalankan agen dari folder yang salah dapat membuat konteks proyek tidak lengkap.

3. Pilih Kimi K3

Di dalam sesi Kimi Code, pilih model aktif:

/model kimi-k3
Enter fullscreen mode Exit fullscreen mode

Gunakan mekanisme yang sama untuk berpindah ke model lain, misalnya Kimi K2.7 Code, bila tugas Anda lebih cocok untuk model tersebut.

4. Sesuaikan upaya penalaran

K3 menyediakan pengaturan upaya penalaran, termasuk mode maksimum.

Gunakan upaya tinggi untuk:

  • debugging yang sulit;
  • refactor lintas modul;
  • investigasi regresi;
  • tugas yang memerlukan banyak iterasi.

Gunakan upaya lebih rendah untuk perubahan sederhana, seperti pembaruan teks, penggantian nama, atau perbaikan kecil yang sudah jelas.

Jika ingin mencoba K3 tanpa memasang Kimi Code atau tanpa biaya, lihat cara menggunakan Kimi K3 secara gratis.

Alur kerja coding agensi yang praktis

Pola kerja K3 sama untuk perbaikan bug, penambahan fitur, atau refactor: berikan tugas yang dapat diverifikasi, biarkan agen mengumpulkan konteks, lalu minta ia membuktikan hasilnya melalui tes atau pemeriksaan objektif.

Berikan tugas yang spesifik dan dapat diuji

Hindari instruksi seperti:

Perbaiki modul autentikasi.

Gunakan instruksi yang memiliki kondisi selesai yang jelas:

Endpoint /login mengembalikan 500 ketika field password kosong.

1. Reproduksi masalahnya.
2. Temukan penyebabnya.
3. Perbaiki implementasinya.
4. Tambahkan tes untuk password kosong.
5. Jalankan seluruh test suite terkait.
6. Ringkas file yang diubah dan hasil tes.
Enter fullscreen mode Exit fullscreen mode

Instruksi seperti ini membantu agen menentukan:

  • titik awal investigasi;
  • kondisi gagal;
  • perubahan yang diperlukan;
  • bukti bahwa masalah sudah selesai.

Konteks 1 juta token K3 membuat pekerjaan lintas banyak file lebih realistis. Agen dapat menelusuri aliran dari route handler, ke service, validasi, database, dan tes tanpa Anda harus secara manual memberikan semua file yang relevan.

Biarkan agen memakai alat dan membaca umpan balik

Nilai utama agen bukan pada tebakan pertama, tetapi pada kemampuan untuk menjalankan dan mengoreksi pekerjaannya.

Alur yang diharapkan:

  1. Agen membaca file yang relevan.
  2. Agen membentuk hipotesis penyebab masalah.
  3. Agen mengedit kode.
  4. Agen menjalankan tes, build, atau aplikasi.
  5. Agen membaca stack trace, log, atau output gagal.
  6. Agen merevisi perubahan.
  7. Agen mengulang sampai pemeriksaan berhasil.

Contoh instruksi untuk debugging:

Jalankan test suite untuk modul pembayaran.

Jika ada kegagalan:
- baca stack trace;
- identifikasi penyebab utama;
- buat perbaikan minimal;
- tambahkan regression test;
- jalankan ulang tes sampai hijau.

Jangan ubah kontrak API yang sudah ada tanpa menjelaskan alasannya.
Enter fullscreen mode Exit fullscreen mode

Gunakan tangkapan layar dan keluaran runtime

Untuk pekerjaan frontend, gunakan loop visual:

  1. Ubah komponen atau CSS.
  2. Jalankan aplikasi.
  3. Ambil tangkapan layar.
  4. Periksa hasil render.
  5. Sesuaikan implementasi.

Untuk backend, gunakan umpan balik seperti:

  • laporan tes;
  • log aplikasi;
  • stack trace;
  • respons HTTP;
  • hasil build;
  • pesan error database.

Contoh tugas UI:

Perbaiki layout halaman profil pada viewport 375px.

- Pertahankan tampilan desktop yang ada.
- Jalankan aplikasi lokal.
- Verifikasi hasil pada viewport mobile.
- Gunakan tangkapan layar sebagai bukti.
- Tambahkan atau perbarui tes jika proyek sudah memiliki setup UI test.
Enter fullscreen mode Exit fullscreen mode

Jadikan tes sebagai batas selesai

Tes menjaga loop agen tetap terarah. Tanpa tes, agen dapat membuat perubahan yang tampak benar tetapi merusak perilaku lain.

Untuk perubahan penting, gunakan urutan ini:

  1. Tulis atau identifikasi tes yang gagal.
  2. Minta K3 memperbaiki implementasi.
  3. Jalankan tes unit dan integrasi terkait.
  4. Jalankan lint serta build bila tersedia.
  5. Tinjau diff sebelum menggabungkan perubahan.

Contoh prompt:

Sebelum mengubah kode, cari tes yang mencakup endpoint ini.

Jika belum ada tes:
- tambahkan tes untuk perilaku saat ini;
- tambahkan tes gagal untuk bug yang dilaporkan;
- implementasikan perbaikan;
- jalankan semua tes terkait.
Enter fullscreen mode Exit fullscreen mode

Kimi K3 vs Claude Code dan Cursor untuk coding

Kimi Code bukan satu-satunya cara menjalankan agen terhadap basis kode. Berikut perbandingan praktis tiga pendekatan umum pada pertengahan 2026.

Dimensi Kimi Code (Kimi K3) Claude Code (Fable 5) Cursor
Faktor bentuk Agen coding terminal dan IDE Agen coding terminal Editor kode AI-native penuh
Model bawaan Kimi K3, dapat ditukar via /model Claude Fable 5 dan model Claude lain Model bawaan atau model pilihan pengguna
Jendela konteks 1 juta token Besar, tergantung model Tergantung model yang dipilih
Navigasi repositori Kuat untuk pekerjaan repositori besar dan berjangka panjang Kuat dengan akses file dan shell Pengindeksan serta pengambilan konteks dalam editor
Penggunaan alat Panggilan alat, shell, tes, tangkapan layar Panggilan alat, shell, MCP Alat editor, terminal, MCP
Pengungkit biaya Murah untuk loop dengan cache tinggi Harga per token Claude Langganan ditambah penggunaan model
Bobot terbuka Diperkirakan sekitar 27 Juli 2026 Tertutup Editor proprietary, model bervariasi
Terbaik untuk Agen repositori besar dengan anggaran terbatas Penalaran dan keandalan tingkat atas Developer yang ingin agen langsung di editor

Beberapa implikasi praktis:

  • Untuk tugas yang sangat sulit dan kebutuhan keandalan tertinggi, Moonshot sendiri mengakui Fable 5 di Claude Code berada di atas K3.
  • Jika Anda membutuhkan pengalaman editor yang terintegrasi, Cursor atau Cline bisa lebih sesuai.
  • Untuk menjalankan model lain dalam Claude Code, Cline, atau Cursor, lihat panduan GLM-5.2 di Claude Code, Cline, dan Cursor.
  • Keunggulan K3 adalah konteks besar, navigasi repositori, dan struktur biaya yang cocok untuk loop panjang serta berulang.
  • Setelah bobot dirilis, K3 berpotensi menjadi satu-satunya opsi di tabel ini yang dapat di-self-host.

Kekuatan dan batasan Kimi K3

Kekuatan: konteks skala repositori

Jendela 1 juta token membantu agen menampung lebih banyak bagian basis kode dalam satu sesi. Ini berguna untuk:

  • monorepo;
  • refactor lintas paket;
  • migrasi API;
  • pelacakan dependensi antar modul;
  • investigasi alur request dari route ke database.

Kekuatan: penggunaan alat dan otonomi jangka panjang

K3 dirancang untuk mempertahankan sesi rekayasa yang panjang dengan intervensi minimal. Agen dapat mengorkestrasi shell, tes, build, dan pemeriksaan hasil untuk memperbaiki dirinya berdasarkan keluaran nyata.

Kekuatan: biaya untuk loop dengan cache tinggi

Agentic coding sering mengirim ulang konteks yang sama—struktur file, instruksi sistem, dan konteks tugas—pada setiap langkah. Harga input cache-hit K3 adalah $0,30 per juta token dibandingkan $3,00 pada cache miss, atau selisih 10x.

Moonshot melaporkan cache-hit rate di atas 90% pada beban kerja coding untuk inferensi Mooncake. Detail angka dapat dilihat di rincian harga Kimi K3.

Batasan: bukan model terdepan

Moonshot menyatakan K3 masih tertinggal dari Claude Fable 5 dan GPT-5.6 Sol. Pada benchmark yang diterbitkan Moonshot:

  • Terminal Bench 2.1: K3 mendapat 88,3, dibanding 88,8 untuk GPT-5.6 Sol.
  • DeepSWE: K3 mendapat 67,5, dibanding 70,0 untuk Fable 5 dan 73,0 untuk GPT-5.6 Sol.

Artinya, K3 kompetitif, tetapi bukan yang teratas. Untuk rincian lebih lengkap, baca analisis benchmark Kimi K3.

Batasan: kecepatan

Menurut Artificial Analysis, K3 menghasilkan sekitar 62 token per detik. Ini berada di bawah median untuk tingkat harganya, terutama ketika konfigurasi default menggunakan upaya berpikir tinggi.

Untuk alur kerja yang sangat interaktif, uji model lain jika kecepatan lebih penting daripada kualitas tambahan dari penalaran yang lebih dalam.

Batasan: keterbukaan masih terjadwal

Bobot penuh diperkirakan tersedia sekitar 27 Juli 2026, bukan pada hari peluncuran. Jika rencana Anda bergantung pada self-hosting, perlakukan ini sebagai jadwal yang perlu dipantau.

Untuk perbandingan langsung, lihat:

Kasus penggunaan yang cocok

K3 paling sesuai untuk pekerjaan yang membutuhkan iterasi dan verifikasi berulang, seperti:

  • refactor besar di seluruh monorepo;
  • investigasi regresi lintas banyak modul;
  • sesi debugging panjang dengan log dan stack trace;
  • pembuatan handler, route, dan tes API;
  • tugas frontend yang membutuhkan validasi visual;
  • pekerjaan yang dapat dinilai lewat tes, build, atau kontrak API.

Memverifikasi API yang dibangun K3

Tes yang dijalankan agen dapat membuktikan bahwa kode berjalan. Namun, tes internal belum tentu memastikan API bekerja seperti yang diharapkan klien nyata.

Verifikasi setidaknya:

  • kode status;
  • header respons;
  • bentuk JSON;
  • validasi input;
  • respons error;
  • autentikasi dan otorisasi;
  • kompatibilitas dengan kontrak OpenAPI.

Gunakan Apidog untuk mengirim permintaan nyata ke endpoint yang dibuat K3, memeriksa body dan header respons, serta menambahkan assertion.

Contoh checklist verifikasi endpoint /login:

POST /login

[ ] Password kosong menghasilkan 400, bukan 500
[ ] Respons error memiliki bentuk JSON yang konsisten
[ ] Kredensial valid menghasilkan token
[ ] Kredensial tidak valid ditolak
[ ] Header Content-Type benar
[ ] Endpoint sesuai dengan spesifikasi OpenAPI
Enter fullscreen mode Exit fullscreen mode

Jika K3 menghasilkan spesifikasi OpenAPI, impor spesifikasi tersebut ke Apidog untuk membangun koleksi permintaan. Dengan begitu, Anda memvalidasi implementasi terhadap kontrak, bukan hanya berdasarkan asumsi.

Simpan token dan API key sebagai variabel lingkungan di Apidog agar tidak bocor ke koleksi bersama.

Apidog juga menyediakan antarmuka MCP. Untuk menghubungkan alat API ke konteks agen, baca panduan visual debugging dengan klien MCP Apidog. Jika bekerja dari editor, Apidog di VS Code membantu menjaga loop pengujian API tetap dekat dengan kode.

Unduh Apidog untuk memverifikasi hasil API segera setelah agen menyelesaikan perubahan.

Implikasinya bagi Anda

Kimi K3 di Kimi Code cocok ketika pekerjaan Anda melibatkan repositori besar, loop otonom panjang, serta iterasi terhadap tes, log, dan tangkapan layar. Konteks 1 juta token dan harga cache-hit membuatnya praktis untuk tugas multi-langkah yang dapat menjadi mahal pada model lain.

Mulailah dengan tugas yang konkret dan dapat diuji. Minta agen untuk menjalankan pemeriksaan. Tinjau diff yang dihasilkan. Lalu verifikasi endpoint API dengan Apidog sebelum merilis perubahan.

Untuk melanjutkan, baca apa itu Kimi K3 dan panduan API Kimi K3.

Pertanyaan yang Sering Diajukan

Bagaimana cara menggunakan Kimi K3 untuk coding?

Jalankan K3 di Kimi Code. Instal agen, buka dari direktori proyek, pilih model dengan /model kimi-k3, lalu berikan tugas yang spesifik dan dapat diuji. Biarkan agen membaca file, menjalankan alat, dan mengulang berdasarkan hasil tes. Lihat panduan CLI Kimi Code untuk instalasi.

Apakah Kimi K3 bagus untuk agentic coding?

Ya. K3 dirancang untuk menavigasi repositori besar, memakai alat, melakukan debugging, dan mengulang terhadap tes, log, serta umpan balik runtime dalam konteks hingga 1 juta token. K3 kompetitif pada benchmark coding, meskipun masih sedikit berada di bawah Fable 5 dan GPT-5.6 Sol.

Apakah Kimi K3 mendukung pemanggilan alat untuk alur kerja agen?

Ya. API K3 mendukung panggilan alat, batasan pilihan alat, mode JSON, keluaran terstruktur, pencarian internet, pemuatan alat dinamis, dan upaya penalaran yang dapat dikonfigurasi. Kemampuan ini memungkinkan agen menjalankan tes, mengeksekusi perintah shell, dan mengelola loop agensi di Kimi Code. Detail implementasi tersedia di panduan API Kimi K3.

Bisakah saya menguji API yang ditulis Kimi K3?

Ya, dan sebaiknya Anda melakukannya. Tes agen hanya mengonfirmasi bahwa kode berjalan; tes tersebut belum tentu memastikan endpoint memiliki kode status, respons JSON, dan perilaku autentikasi yang sesuai untuk klien nyata. Kirim permintaan nyata melalui Apidog, tambahkan assertion, lalu impor spesifikasi OpenAPI yang dihasilkan untuk memvalidasi implementasi terhadap kontrak.

Top comments (0)