AI Coding.Info
RepositoriesREPORTS
ABOUT

Bisakah LLM lokal digunakan untuk AI Coding? ~Ringkasan tren AI Coding pada Juli 2026 dilihat melalui data~

pengarang: @kotauchisunsun

Tanggal rilis: 2026/08/12

Tren AI Coding Agent pada Agustus 2026

Kami telah mengoperasikan situs bernama AI Coding.Info sejak Juli 2025.

https://ai-coding.info/

https://x.com/AICodingInfo

Ini adalah situs yang mengamati tren penggunaan terkait Agen Pengodean AI seperti Claude Code, Codex CLI, Github Copilot, dan Gemini dari titik tetap berdasarkan informasi dari repositori Github. Untuk menentukan penggunaan AI Coding Agent, kami melakukan survei harian dengan ketentuan sebagai berikut.

Tren bulan lalu

https://ai-coding.info/reports/articles/20260703

Tingkat penggunaan AI Coding Agent adalah 13,0%

Tingkat pemanfaatan repositori AI Coding Agent adalah 13,0%, meningkat 0,9% dari 12,1% sebelumnya.

gambar.png

gambar.png

Tingkat penggunaan AI Coding Agent pada 2026/8/1

https://ai-coding.info/?date=2026-08-01#adoption-rate

Tingkat penggunaan AI Coding Agent pada 1 Juli 2026

https://ai-coding.info/?date=2026-07-01#adoption-rate

Tren tingkat penggunaan Agen Pengodean AI dari 1/7/2026 hingga 1/8/2026

https://ai-coding.info/?date=2026-04-01&since=2026-07-01&until=2026-08-01#share-trend

Pangsa Agen Pengodean AI berdasarkan produk

Pembagian berdasarkan produk adalah sebagai berikut.

PeringkatNama ProdukTingkat pembagian
tempat pertamaKodeks CLI40,8%
tempat keduaKode Claude32,0%
tempat ketigaAgen Kopilot15,1%
tempat ke-4Gemini CLI (Antigravitasi)5,3%
tempat ke-5Kursor4,4%

Meskipun pangsa Codex CLI meningkat, Claude Code tetap sama. Copilot Agent dan Gemini CLI (Antigravity) juga menunjukkan sedikit penurunan. Kursor adalah sesuatu yang sedikit saya perhatikan. Kursor diakuisisi oleh SpaceX. Ada berita.

https://www.nikkei.com/article/DGXZQOGN16BC70W6A610C2000000/

Oleh karena itu, apakah akan terjadi perubahan harga saham Kursor ini? Saya kira begitu, tapi bulan lalu 4,7% dan bulan ini 4,4%, jadi tidak banyak perubahan. Dilihat dari jumlah repositori yang disebutkan di bawah ini, pada tanggal 1 Juli terdapat 85 repositori yang mengadopsi Cursor, dan per tanggal 1 Agustus jumlahnya tetap tidak berubah yaitu 85. Oleh karena itu, terkait fenomena ini, populasi repositori yang menggunakan AI Coding Agent mengalami peningkatan secara keseluruhan, namun jumlah penggunaan Cursor tidak meningkat. Akibatnya, pangsa pasar secara keseluruhan menurun. Hal ini sudah menjadi sebuah fenomena. Namun, karena karakteristik penelitian AI Coding.Info, jumlah repositori dengan file konfigurasi khusus Kursor (.cursor) tidak akan berubah. Meskipun demikian, Cursor sendiri mendukung AGENTS.md. AI Coding.Info menyatakan bahwa jumlah repositori dengan AGENTS.md = jumlah adopsi Codex CLI, jadi meskipun Cursor digunakan, ada kemungkinan dihitung sebagai Codex CLI, dan ada kemungkinan jumlah penggunaannya meningkat di bagian yang tidak terlihat.

image.png

Nilai saham AI Coding Agent pada 8/1/2026

https://ai-coding.info/?date=2026-08-01&since=2026-07-01&until=2026-08-01#agent-share

Nilai saham AI Coding Agent pada 1/7/2026

https://ai-coding.info/?date=2026-07-01&since=2026-07-01&until=2026-08-01#agent-share

Status penggunaan AI Coding Agent berdasarkan bahasa pemrograman

Bahasa pemrograman yang paling banyak menggunakan AI Coding Agent adalah "TypeScript", bahasa kedua adalah "Python", bahasa ketiga adalah "Rust", bahasa keempat adalah "Go", dan bahasa kelima adalah "C#". Tingkat adopsi AI Coding untuk TypeScript tetap tinggi, sementara komposisi Python'', Rust'', dan Go'' sebagai grup kedua, dan C#'' sebagai grup ketiga telah menjadi tren yang konsisten dalam beberapa tahun terakhir.

gambar.png

Pemeringkatan Agen Pengodean AI berdasarkan bahasa pemrograman pada 1/8/2026

https://ai-coding.info/?date=2026-08-01&since=2026-07-01&until=2026-08-01#language-agent-rank

Pemeringkatan AI Coding Agent berdasarkan bahasa pemrograman pada 1 Juli 2026

https://ai-coding.info/?date=2026-07-01&since=2026-07-01&until=2026-08-01#language-agent-rank

Tren bulanan dalam jumlah repositori yang digunakan oleh AI Coding Agent

Jumlah repositori adalah 1,794 pada 01/07/2026, namun telah meningkat menjadi 1,940 pada 01/08/2026, dan jumlah repositori yang menggunakan AI Coding Agent telah meningkat sebesar 146.

gambar.png

Perubahan jumlah repositori yang menggunakan AI Coding Agent dari 1/7/2026 menjadi 1/8/2026

https://ai-coding.info/?date=2026-08-01&since=2026-07-01&until=2026-08-01#time-based-bar-chart

Bisakah LLM lokal digunakan untuk AI Coding?

Pada bulan Juni, LLM generasi berikutnya, Mythos dan Fable 5, dirilis oleh Claude dan mengejutkan industri dengan kinerja mereka. Namun, setelah itu, perusahaan Kimi China merilis model bobot terbuka bernama Kimi-K3, yang hampir sekelas Fable. Itu menjadi topik hangat. Bahkan jika dilihat dari tolok ukur sebenarnya, angkanya hampir sama.

image.png

https://artificialanalysis.ai/#intelligence-category-tabs

Saat aku memikirkan itu,

**Bukankah LLM lokal juga merupakan pilihan untuk AI Coding? **

Saya pikir Anda mungkin berpikir demikian. Saya menyelidiki daerah itu. Tabel di bawah mencantumkan model LLM bobot terbuka utama dari grafik di atas.

Nama ModelNama PerusahaanTanggal PengumumanJumlah ParameterJumlah Parameter AktifPanjang KonteksIndeks Intelijen
Kimi K3(maks)Kimi(China)2026/072.800B104B1M60
GLM-5.2(maks)Z AI(Tiongkok)2026/06756B40B1M53
DeepSeek V4 Flash 0731DeepSeek(China)2026/07284B13B1M52
MiMo-V2.5-ProXiaomi(Tiongkok)2026/041,023B42B1M43
Muse Glimmer (tinggi)Meta(AS)2026/0830B256K35
Gemma 4 31B (Penalaran)Google (AS)2026/0430.7B256K30

Namun, apakah ini benar-benar berfungsi di PC Anda? Saya tidak begitu mengerti itu. Oleh karena itu, metode penentuan yang kami pertimbangkan adalah

Memori VRAM yang dibutuhkan adalah

2[GB] per parameter 1[B]

adalah. Anda dapat memperkirakan secara kasar apakah ini akan berfungsi berdasarkan kapasitas memori VRAM PC Anda dan jumlah parameter model yang ingin Anda jalankan. Karena itu,

**Secara matematis, diperlukan memori 5,6 TB (5.600 GB) untuk menjalankan Kimi-K3. **

Saya akan menjelaskan alasannya. Dalam model LLM terdistribusi standar, bobot dinyatakan menggunakan angka desimal dengan presisi bf16 atau fp16. Ini memerlukan 2 Byte untuk setiap parameter. Notasi yang sering Anda lihat, seperti 30[B], adalah jumlah parameter, dan B adalah singkatan dari miliar dan mewakili 10^9. Oleh karena itu, terlihat bahwa model seperti 30[B] memiliki data bobot 30×10^9. Dan 1[GB]=1*10^9[Byte]. Kalau dipikir-pikir seperti itu, kami telah menyebutkan sebelumnya bahwa bobot standar disimpan dalam 2 Byte, jadi dibutuhkan 2 Byte per bobot, yang berarti 2 [GB] untuk menyimpan 1 parameter [B] di memori. Ini perhitungannya. Ini adalah arti dari "2[GB] per parameter 1[B]" yang disebutkan sebelumnya. Namun, ini hanyalah perkiraan; ini adalah persyaratan minimum untuk memuat bobot ke dalam VRAM, dan karena memori dapat digunakan selain itu, sangat disarankan untuk tidak melebihinya. Ini adalah kapasitas VRAM.

Di sinilah konsep kuantisasi berperan. Anda mungkin pernah melihat Q4_0 atau Q4_K_M. Ini adalah teknik yang memampatkan bobot menjadi jumlah bitnya. Oleh karena itu, dalam kasus Q4_0, secara kasar, kapasitas bobotnya adalah 4 bit (4 bagian dari Q4_0). Oleh karena itu, dalam hal ini, kapasitasnya adalah 0,5[GB] per 1[B]. Tabel referensi singkatnya terlihat seperti ini:

Metode kuantisasiJumlah memori yang diperlukan per 1[B] [GB]
bf16,fp16(standar)2.0
Q8_01.0
Q4_00,5

Anda mungkin melihat notasi seperti Q4_K_M, namun secara kasar, ini adalah model yang meningkatkan akurasi dibandingkan Q4_0, namun menggunakan kapasitas memori yang sedikit lebih besar. Adalah baik untuk menyadari hal ini. Ada cara lain untuk mengetahuinya, cukup dengan melihat ukuran file dari file berat (safetensor atau gguf). Jika melebihi kapasitas memori VRAM, umumnya tidak akan berfungsi. Saya pikir Anda bisa berpikir begitu.

Dari sini, kami telah membuat tabel referensi singkat tentang jumlah memori VRAM, metode kuantisasi, dan jumlah parameter.

Kapasitas memori VRAM [GB]Jumlah parameter (bf16,fp16)[B]Jumlah parameter (Q8_0)[B]Jumlah parameter (Q4_0)[B]
84816
1681632
24122448
32163264
643264128
12864128256
256128256512
5122565121024
102451210242048
2048102420484096

Kira-kira berapa lama hal tersebut bisa dilakukan? Mengingat, jika model dengan VRAM 8 GB, maka akan menjadi RTX 5050, dan harga Amazon adalah 55.000 yen. Ini mungkin berhasil jika modelnya sekitar 8[B] dikuantisasi dengan Q8_0. Itulah levelnya.

https://link.amazon/B0brulI9R

Ketika VRAM ditingkatkan menjadi 16GB, itu menjadi model seperti RTX 5060 Ti, yang harganya sekitar 108.000 yen. Pada titik ini, dengan kuantisasi Q4_0, LLM kelas 30[B] akan berfungsi atau tidak. Itulah levelnya.

https://link.amazon/B0ghUQISo

Ketika VRAM ditingkatkan menjadi 32GB, itu menjadi model andalan RTX 5090 dan berharga 795.000 yen. Dalam hal ini, saya kira itu berada pada level di mana Anda tidak dapat melakukannya kecuali Anda memiliki tekad yang kuat. Saya kira demikian. Ini adalah kuantisasi Q8_0, dan apakah model kelas 30[B] berfungsi atau tidak. Ini akan berada pada level yang sama.

https://link.amazon/B03EseQp5

Area ini merupakan lini teratas tingkat produk konsumen. Kini untuk level profesional, RTX PRO 6000 Blackwell dibekali memori sebesar 96GB. **Harganya 2,35 juta yen. ** Di sini, bahkan pada tingkat kuantisasi Q4_0, hanya model 192[B] yang berfungsi, sehingga model andalan tidak berfungsi.

https://link.amazon/B0g76ngZz

Dan karena ada data cluster GPU yang akan dipasang di server, saya akan mempostingnya sebagai referensi saja. Untuk NVIDIA B300, memorinya 288GB dan harganya 8,63 juta yen. Jika ya, DeepSeek V4 Flash 0731 dengan kuantisasi Q8_0 mungkin berfungsi. Q4_0 akan berfungsi. Jika Anda memiliki dua (setara dengan 17 juta yen), MiMo-V2.5-Pro ​​​​dengan kuantisasi Q4_0 dapat berfungsi.

gambar.png

https://www.nttpc.co.jp/cgi-bin/gpu/simulation/custom/index.cgi

Oleh karena itu, jika kita membandingkan jumlah memori dan jumlah parameter, itu saja. Tentu saja, ada lebih banyak perdebatan daripada ini, dan apakah hal ini akan dimasukkan dalam memori atau tidak. Jadi, apakah ini menghasilkan TOK/dtk yang cukup untuk digunakan secara normal? Ada masalah lain. Artikel ini membahas tentang dasar-dasarnya. LLM memiliki arsitektur yang disebut Dense dan MoE, dan di MoE, hanya parameter aktif yang benar-benar dihitung, dan bergantung pada metode eksekusi, ada cara untuk mengurangi jumlah memori fisik dengan membacakan Pakar yang diperlukan dari penyimpanan, dll., daripada menyimpan semua Pakar di memori sepanjang waktu. Namun, ada beberapa aspek khusus pada cara model dijalankan, dan pemuatan dari penyimpanan ke memori dapat menjadi hambatan. Ada beberapa cerita seperti ini, tapi di sini kita mengabaikan detail tersebut dan hanya mempertimbangkan kapasitas ketika semua bobot model disimpan dalam memori.

Jadi, jika Anda ingin menjalankan model andalan terkuantisasi Q4_0 atau Q8_0 saat ini, Anda memerlukan mesin yang berharga setidaknya 10 juta yen. Itulah rasanya. Di sisi lain, ini mungkin berhasil jika Anda menggunakan perangkat keras khusus untuk mencapai kuantisasi yang lebih besar. Misalnya, ada orang yang menjalankan kuantisasi 2-bit dan kuantisasi 3-bit di M4 Mac dengan memori 128 GB (terjual habis) dan DGX Spark (memori 128 GB).

https://zenn.dev/tkhr_sait/articles/20260508_try-local-deepseek-v4

https://dev.classmethod.jp/articles/dgx-spark-deepseek-v4-flash-0731-llama-cpp/

Di sisi lain, ini mungkin merupakan batasan bagi seorang individu. Itu adalah perasaan kulit. Secara pribadi, saya memperhatikan kuantisasi 1-bit. Model terkenal mencakup Bonsai dan teknologi seperti BitNet, tetapi pengetahuan tentang kuantisasi 1-bit belum dipublikasikan, jadi saya belum mencobanya (mungkin akan memakan banyak waktu dan mengurangi akurasi inferensi).

Jadi, secara pribadi, jika DeepSeek versi terkuantisasi 1-bit (sekitar 35,5 GB) dirilis, saya dapat melihat dunia di mana ia dapat dijalankan secara lokal pada GPU tingkat konsumen, bergantung pada kecerdikan, tetapi karena saat ini kami tidak memilikinya, itu cukup sulit. Itu adalah kebenaran yang jujur.

Karena itu,

**Tidak realistis menjalankan model andalan dengan LLM lokal. **

Itu kesan umum saya. Jika Anda benar-benar ingin ini berfungsi, saya rasa Anda perlu melakukan beberapa pengujian.

pikiran

Kali ini saya memfokuskan pembicaraan saya pada LLM lokal. Saat Kimi-K3 keluar, saya cukup kaget, dan kelas Fable pindah ke LLM lokal! Itu cukup mengesankan, tapi aku bahkan tidak bisa memindahkannya dengan perlengkapan yang kumiliki. Itu adalah kesan jujurku. Saya pernah memposting artikel tentang LLM lokal, tetapi pada saat itu tidak berfungsi dengan baik, jadi saya ingin menggali lebih dalam sendiri. Saya pikir begitu.