// review model
Review Model LLM
Model bahasa besar dinilai dari penalaran, coding, kecepatan, dan rasio harga/performa.
Review Lengkap
98 hasil
Claude Opus 5 (Adaptive Reasoning, Max Effort)
Generasi Opus terbaru — intel 63,1 dan coding 78 memimpin papan atas dunia frontier
Flagship terbaru Anthropic per Agustus 2026 yang memimpin papan atas dunia frontier. Intelligence index 63,1 (sumber: Artificial Analysis) menjadi skor tertinggi di antara seluruh model yang sudah diulas Wawasan AI — melampaui Claude Opus 4.8 (57,3), Claude Fable 5 (62,1), Kimi K3 (57,1), dan Grok 4.5 (55,8). Coding index 78 (sumber: Artificial Analysis) memimpin benchmark pemrograman proprietary global, meninggalkan Sonnet 5 (71,5), Opus 4.7 (73,6), dan hampir menyamai Kimi K3 (76,2). Lompatan dari Opus 4.8 (intel 57,3, coding 74,3) ke Opus 5 (intel 63,1, coding 78) bukan sekadar iterasi, melainkan reposisi total: Opus 5 menjadi standar baru untuk workload agentic papan atas.
Claude Opus 4.5
Raja coding dan agentic task — andalan para power user
Model flagship Anthropic yang menjadi standar emas untuk tugas coding dan agentic. Kemampuannya mengerjakan tugas panjang multi-langkah — refactor besar, debugging lintas file, riset mendalam — masih sulit ditandingi.
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
Anthropic rilis mode Xhigh Effort — penalaran terdalam di keluarga Opus 5
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) adalah varian penalaran terdalam kedua dari keluarga Claude Opus 5 Anthropic, diposisikan di antara Max Effort (intel 63,1) dan High Effort (intel 61,5). Intelligence index 62,5 (sumber: Artificial Analysis) menaruhnya di papan atas proprietary global — di atas Claude Fable 5 (62,1), Opus 4.8 (57,3), Kimi K3 (57,1), dan Sonnet 5 (55,3). Coding index 77 (sumber: Artificial Analysis) memimpin benchmark pemrograman proprietary global, hanya 1 poin di bawah Opus 5 Max (78) dan sejajar dengan frontier papan atas Asia. Varian Xhigh menjadi sweet spot untuk workload riset multi-langkah dan agentic coding yang butuh penalaran ekstra tanpa latensi Max Effort. Sumber data: Artificial Analysis.
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
Generasi terbaru Opus — intel 57,3 dan coding 74,3 menaruhnya di puncak papan atas dunia frontier
Flagship terbaru Anthropic per Agustus 2026 yang membawa keluarga Opus ke papan atas dunia frontier. Intelligence index 57,3 (sumber: Artificial Analysis) menembus level yang sebelumnya hanya dicapai Kimi K3 (57,1) dan melampaui Grok 4.5 (55,8), Claude Opus 4.5 (43,1), serta GPT-5 (44,6). Coding index 74,3 (sumber: Artificial Analysis) menjadi skor tertinggi ketiga di antara model yang sudah diulas Wawasan AI — di bawah Kimi K3 (76,2) dan hampir menyamai Grok 4.5 (72,4), mengonfirmasi posisi Opus sebagai salah satu pemain utama di liga agentic coding. Lompatan dari Opus 4.5 (intel 43,1, coding 42,9) ke Opus 4.8 (intel 57,3, coding 74,3) bukan sekadar iterasi numerik, melainkan reposisi fundamental: dari model yang 'unggul di ceruk coding' menjadi model papan atas sejajar dengan frontier reasoning papan atas.
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
Varian Fable 5 Max Effort — fallback Opus 4.8 dengan kemampuan puncak keluarga Adaptive Reasoning
Varian Max Effort dari keluarga Claude Fable 5 Anthropic yang dirancang sebagai fallback otomatis dari Claude Opus 4.8 Adaptive Reasoning — mempertahankan kemampuan papan atas dengan perilaku routing terukur. Intelligence index 62,1 (sumber: Artificial Analysis) menaruhnya di papan atas proprietary global, sejajar dengan Opus 5 Xhigh dan di bawah Opus 5 Max Effort, menjadikannya rute degradasi tepercaya untuk workload agentic panjang.
GPT-5
Generalis terkuat dengan ekosistem terluas
Model andalan OpenAI dengan sistem routing pintar yang memilih sendiri kapan perlu 'berpikir keras'. Ekosistemnya — ChatGPT, API, integrasi pihak ketiga — tetap yang paling luas di industri.
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)
Varian Max Effort Claude Fable 5.1 — intel 65,7 dan coding 81,6, puncak kemampuan keluarga Fable
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) adalah varian Max Effort dari keluarga Claude Fable 5.1 Anthropic, diposisikan sebagai tujuan akhir rute ketika sistem Adaptive Reasoning keluarga Claude perlu mode penalaran terdalam tanpa keluar dari keluarga flagship. Intelligence index 65,7 (sumber: Artificial Analysis) menjadi skor tertinggi di antara seluruh model yang sudah diulas Wawasan AI — melampaui Claude Opus 5 Max Effort (63,1), Claude Opus 5 Xhigh (62,5), Claude Fable 5 (62,1), Opus 4.8 (57,3), dan Kimi K3 (57,1) di papan atas proprietary global. Coding index 81,6 (sumber: Artificial Analysis) memimpin benchmark pemrograman proprietary global, melampaui Opus 5 Max (78) dengan selisih 3,6 poin, Opus 5 Xhigh (77) dengan selisih 4,6 poin, dan Sonnet 5 (71,5) dengan selisih 10,1 poin. Harga API $10,00 input dan $50,00 output per juta token menjadikannya posisi tertinggi di keluarga Anthropic, dua kali input Opus 5 dan Sonnet 5, sebuah banderol premium untuk workload yang butuh kemampuan mutlak.
Gemini 3
Multimodal monster dengan context window raksasa
Lompatan besar Google: penalaran frontier, kemampuan multimodal (video, audio, gambar) terbaik, dan context window jutaan token. Integrasinya dengan ekosistem Google membuatnya sulit diabaikan.
Claude Opus 5 (Adaptive Reasoning, High Effort)
Varian High Effort Opus 5 — intel 61,5 dan coding 76,5 dengan TTFT 11,3 detik yang lebih responsif
Varian Adaptive Reasoning dengan mode High Effort dari keluarga Claude Opus 5 Anthropic — kelas flagship yang bermain di satu tier di bawah Opus 5 Max Effort dengan trade-off yang menarik: intelligence index 61,5 (sumber: Artificial Analysis) hanya 1,6 poin di bawah Max Effort (63,1), namun TTFT turun drastis ke 11,3 detik (sumber: Artificial Analysis) dibanding 31,9 detik pada Max Effort. Coding index 76,5 (sumber: Artificial Analysis) memimpin benchmark pemrograman proprietary global hanya di bawah Opus 5 Max (78), Sonnet 5 (71,5), dan Kimi K3 (76,2) — menjadikan High Effort pilihan rasional untuk workload agentic yang butuh keseimbangan antara penalaran mendalam dan responsivitas chat interaktif.
Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)
Varian Medium Effort Claude Fable 5.1 — intel 60,5 dan coding 77,1 dengan harga $10/$50 per juta token
Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) adalah varian mode Medium Effort dari keluarga Claude Fable 5.1 Anthropic, diposisikan sebagai default fallback ketika Claude Opus 5 Adaptive Reasoning perlu route request ke model yang lebih hemat. Intelligence index 60,5 (sumber: Artificial Analysis) menaruhnya di papan atas proprietary global — hanya 2,6 poin di bawah Opus 5 Max Effort (63,1), sejajar dengan Claude Opus 5 Xhigh Effort (62,5), dan meninggalkan Sonnet 5 (55,3) serta Claude Opus 4.8 (57,3) di belakang. Coding index 77,1 (sumber: Artificial Analysis) memimpin benchmark pemrograman proprietary global, hanya 0,9 poin di bawah Opus 5 Max (78), sejajar dengan Opus 5 Xhigh (77), dan melampaui Sonnet 5 (71,5) dengan jarak signifikan. Harga API $10,00 input dan $50,00 output per juta token menjadikannya model dengan kelas kemampuan frontier namun banderol di atas Opus 5, sebuah posisi niche yang menarik untuk workload spesifik yang butuh perilaku fallback terukur.
GPT-6 Astra (xhigh)
Lompatan generasi GPT-6 dengan routing penalaran adaptif dan coding papan atas
Generasi GPT-6 dari OpenAI yang menaruh coding sebagai pilar utama, dengan intelligence index 54,3 (sumber: Artificial Analysis) dan coding index 75,9 (sumber: Artificial Analysis) memimpin benchmark pemrograman proprietary di keluarga OpenAI. Routing penalaran adaptif generasi baru menentukan sendiri kedalaman berpikir per tugas, sementara throughput 57,461 token/detik menjadikannya opsi paling kencang di kelas flagship OpenAI untuk workload batch modern.
Qwen3.8 2.4T A95B
Flagship MoE Alibaba 2,4 triliun parameter — intel 57,7 dan coding 71,9 dengan footprint inference premium
Qwen3.8 2.4T A95B adalah flagship MoE Alibaba per Agustus 2026 dengan total 2,4 triliun parameter (95B aktif per token) — arsitektur terbesar keluarga Qwen hingga saat ini. Intelligence index 57,7 (sumber: Artificial Analysis) menaruhnya di papan atas proprietary global, sejajar dengan frontier papan atas laboratorium Barat, dan coding index 71,9 (sumber: Artificial Analysis) adalah salah satu skor tertinggi di benchmark pemrograman. Harga API $2,00 per juta token input dan $6,00 output bermain di kelas premium, sebanding dengan frontier Barat kelas atas untuk workload agentic engineering volume tinggi.
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
Sonnet kelas flagship dengan intel 55,3 dan coding 71,5 — sweet spot harga dan kapabilitas
Claude Sonnet 5 (Adaptive Reasoning, Max Effort) adalah generasi terbaru lini Sonnet dari Anthropic yang dirilis 30 Juni 2026, diposisikan di sweet spot antara Opus 5 yang harganya premium dan Haiku yang bermain di kelas ringan. Intelligence index 55,3 (sumber: Artificial Analysis) menaruhnya di papan atas proprietary global — sejajar dengan Gemini 3.7 Flash high (56) dan Claude Opus 4.7 (55) — sementara coding index 71,5 (sumber: Artificial Analysis) mendekati Opus 4.7 (73,6) dan meninggalkan Sonnet 4.5 (49,2) di belakang. Bedanya dari Opus 5 di intel 63,1 dan coding 78 hanya 8 poin di intelligence dan 6,5 poin di coding, tapi harga API $2 input / $10 output per juta token adalah 2,5x lebih murah dari Opus 5 ($5/$25).
Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
Varian High Effort Claude Fable 5.1 — intel 51,7 dan coding 79,1, kelas flagship dengan TTFT ramah
Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback) adalah varian High Effort dari keluarga Claude Fable 5.1 Anthropic, diposisikan sebagai titik keseimbangan antara kemampuan penalaran mendalam dan latensi responsif di lini eksperimental keluarga Claude. Intelligence index 51,7 (sumber: Artificial Analysis) menaruhnya di papan tengah-atas proprietary global — di bawah Opus 5 Max Effort (63,1) dan Opus 5 Xhigh (62,5), sejajar Sonnet 5 (55,3) di kelas intel, dan di atas frontier value-tier Asia untuk kombinasi intel + coding. Coding index 79,1 (sumber: Artificial Analysis) memimpin benchmark pemrograman proprietary global, melampaui Opus 5 Max (78) dengan selisih tipis 1,1 poin, Opus 5 Xhigh (77) dengan selisih 2,1 poin, dan Sonnet 5 (71,5) dengan selisih 7,6 poin signifikan. TTFT 11,92 detik (sumber: Artificial Analysis) jauh lebih responsif dibanding Max Effort (142,2 detik), menjadikan High Effort opsi paling seimbang untuk workload agentic yang butuh kemampuan tinggi tanpa mengorbankan responsivitas pertama. Harga API $10,00 input dan $50,00 output per juta token sama dengan varian Fable 5.1 lain di kelas tertinggi Anthropic.
GPT-5.6 Sol (high)
Varian Sol high-effort OpenAI — intel 57,3 dan coding 77,2 dengan API premium kelas flagship
GPT-5.6 Sol (high) adalah varian high-effort reasoning OpenAI yang dirilis Juli 2026, diposisikan untuk workload agentic coding dan riset multi-langkah yang butuh penalaran konsisten di sesi panjang. Intelligence index 57,3 (sumber: Artificial Analysis) menaruhnya di papan atas proprietary global, sejajar dengan Claude Opus 5 (63,1) dan Kimi K3 (57,1), sementara coding index 77,2 (sumber: Artificial Analysis) mendekati Claude Opus 5 (78,0) dan menjadikannya salah satu skor tertinggi di benchmark pemrograman. Harga API $5,00 per juta token input dan $30,00 output bermain di kelas flagship premium, sebanding dengan frontier Barat papan atas untuk workload engineering volume tinggi.
GPT-6 Astra (high)
Flagship Astra OpenAI — frontier coding dengan harga premium
GPT-6 Astra (high) adalah varian Astra dari keluarga GPT-6 OpenAI, dirancang untuk workload coding agentic dan penalaran multi-langkah di kelas proprietary tertinggi. Coding index 77,1 (sumber: Artificial Analysis) menaruh model ini di papan atas benchmark pemrograman global — sejajar dengan frontier high-end lainnya. Harga API $10,00 per juta token input dan $50,00 output menempatkannya di kelas premium OpenAI, dua kali input Sonnet 5 atau Claude Sonnet 5 — sebuah posisi niche yang butuh justifikasi workload spesifik di mana coding agentik adalah kebutuhan utama.
Qwen3.8 Max
Flagship reasoning Alibaba terbaru — coding index papan atas dengan harga API premium efisien
Qwen3.8 Max adalah iterasi terbaru flagship reasoning proprietary Alibaba per Agustus 2026, dirancang untuk meneruskan dominasi saudara Qwen3.6 Max Preview dan Qwen3.7 Plus di kelas Asia papan atas. Intelligence index 53,4 (sumber: Artificial Analysis) menaruhnya di papan atas laboratorium proprietary Asia dan sejajar dengan frontier Barat papan atas seperti Claude Opus 4.5 (43,1) dan GPT-5 (44,6) — pembeda utamanya ada di coding index 68,9 yang meletakkannya di puncak ranking global untuk benchmark pemrograman. Harga API $2,00 per juta token input dan $6,00 output bermain di kelas premium, sedikit di atas Qwen3.7 Plus tapi sebanding dengan kelas flagship Barat untuk workload agentic engineering.
Kimi K3 (max)
Flagship reasoning Moonshot — coding 76,2 dan intel 57,1, setara frontier papan atas
Flagship reasoning terbaru Moonshot AI yang menaruh Kimi di papan atas dunia frontier. Intelligence index 57,1 (sumber: Artificial Analysis) sejajar dengan Gemini 3 (57,2) dan melampaui Claude Opus 4.5 (43,1) serta GPT-5 (44,6), sementara coding index 76,2 menjadi skor tertinggi di antara model yang sudah diulas Wawasan AI — di atas Qwen3.8 Max (68,9) dan GLM-5.2 (44,2). Lompatan dari K2 ke K3 bukan inkremental, melainkan repositioning: dari model open-weight murah ke pemain papan atas proprietary.
DeepSeek V4 Flash 0731
DeepSeek value king baru — coding 69,1 dan 108 token/detik dengan harga paling murah di kelas papan atas
Varian Flash terbaru DeepSeek yang dirilis 31 Juli 2026 — intelligence index 51,8 (sumber: Artificial Analysis) menembus papan atas dunia frontier, sejajar dengan Grok 4.5 (55,8) dan di atas Claude Opus 4.5 (43,1) serta GPT-5 (44,6). Bedanya, DeepSeek V4 Flash 0731 harganya $0,14 input dan $0,28 output per juta token — sekitar 14x lebih murah dari Claude Opus 4.5 ($5/$25) dan 3x lebih murah dari DeepSeek V3.x sendiri ($0,40/$2), sambil mempertahankan coding index 69,1 (sumber: Artificial Analysis) yang menjadi salah satu skor tertinggi di antara model yang sudah diulas Wawasan AI.
GLM-5.3 (max)
Z AI naik kelas — coding 74,8 dengan harga tetap kompetitif
GLM-5.3 (max) adalah iterasi flagship Z AI yang kembali menaikkan standar kemampuan coding keluarga GLM. Intelligence index 59,5 menempatkannya di jajaran model proprietary Asia papan atas, sementara coding index 74,8 menjadi pembeda utama untuk rekayasa perangkat lunak. Harga $1,40 per juta token input dan $4,40 output juga tetap lebih masuk akal daripada frontier Barat sekelasnya. Sumber data: Artificial Analysis.
Qwen3.7 Plus
Varian multimodal Qwen3.7 — visi, penalaran, dan tool-use dalam satu agen
Varian multimodal dari keluarga Qwen3.7 yang dirancang sejak lahir untuk kerja agentic: membaca gambar dan video, penalaran multi-langkah, eksekusi tool, dan iterasi mandiri lewat loop RL di platform Bailian. Intelligence index 53,3 (sumber: Artificial Analysis) menempatkannya di papan atas model proprietary dari laboratorium non-AS — dengan harga API yang ramah untuk pasar Indonesia.
MiMo-V2.5-Pro
Xiaomi naik kelas — model proprietary dengan intelligence frontier dan harga agresif
MiMo-V2.5-Pro adalah flagship proprietary Xiaomi yang menempatkan perusahaan perangkat keras ini di papan atas laboratorium non-AS. Intelligence index 53,8 (sumber: Artificial Analysis) sejajar dengan Qwen3.7 Plus dan Grok 4 — tapi dengan harga API hampir setengah dari frontier Barat. Strateginya jelas: Xiaomi pakai model ini untuk memperkuat ekosistem MiAI dan perangkat pintar mereka, sambil membuka akses ke developer lewat API publik.
Grok 4.5 (high)
Flagship SpaceXAI — intel 55,8 dan coding 72,4 dengan akses real-time X tetap menjadi pembeda
Flagship SpaceXAI per Juli 2026 yang menaikan Grok ke papan atas dunia frontier — intelligence index 55,8 (sumber: Artificial Analysis) sejajar dengan frontier papan atas (Kimi K3 57,1, GPT-5 44,6, Claude Opus 4.5 43,1) dan coding index 72,4 menjadi skor tertinggi kedua setelah Kimi K3 (76,2) di antara model yang sudah diulas Wawasan AI. Bedanya dari frontier Barat: integrasi native dengan X (Twitter) memberi akses real-time ke percakapan publik yang tidak dimiliki model mana pun, sementara harga API $2/$6 per juta token bermain di kelas menengah premium — di bawah Claude Opus 4.5 ($5/$25) tapi di atas GPT-5 ($1,25/$10).
GLM-4.6
Kuda hitam coding dari Zhipu — alternatif murah yang serius
Model open-weight dari Zhipu AI (Z.ai) yang melejit sebagai alternatif murah di tool coding agentic. Untuk pekerjaan kode sehari-hari, jarak rasanya ke model proprietary mahal makin tipis — dengan biaya langganan yang jauh lebih ringan.
Qwen3.6 Max Preview
Flagship proprietary Alibaba April 2026 — fokus agentic coding dan top-2 dunia untuk programming
Qwen3.6 Max Preview adalah flagship proprietary Alibaba yang dirilis 20 April 2026, dirancang sejak lahir untuk kerja agentic berdurasi panjang. Intelligence index 51,8 (sumber: Artificial Analysis) menaruhnya di papan atas laboratorium Asia dan mendudukkannya di peringkat kedua dunia untuk benchmark pemrograman. Bedanya dengan saudara Qwen3.7 Plus: Max adalah varian penalaran murni tanpa beban multimodal, dengan fokus ke engineering multi-langkah dan tool-use intensif — serta positioning harga premium yang mencerminkan kelas flagship.
DeepSeek V4 Pro (Reasoning, Max Effort)
Varian reasoning paling serius DeepSeek — coding 59,4 dan intel 45,3 dengan mode Max Effort
Varian reasoning flagship keluarga V4 DeepSeek, dirilis 24 April 2026 dengan mode Max Effort sebagai pembeda utama dari V4 Flash 0731 — intelligence index 45,3 (sumber: Artificial Analysis) menembus papan atas dunia frontier dengan biaya inference yang relatif moderat, sementara coding index 59,4 (sumber: Artificial Analysis) menjadi salah satu skor tertinggi di antara model reasoning yang sudah diulas Wawasan AI. Bedanya dari V4 Flash 0731: V4 Pro diposisikan untuk workload penalaran terdalam — riset multi-langkah, agen penelitian otonom, code architect dengan chain-of-thought panjang — dengan trade-off harga yang lebih tinggi ($0,435 input / $0,87 output per 1M) demi kedalaman reasoning yang lebih kuat.
Gemini 3.7 Flash (high)
Varian Flash high-effort Google — intel 56, coding 76,1 dengan throughput 357,8 token/detik
Gemini 3.7 Flash (high) adalah varian high-effort reasoning dari keluarga Gemini 3.7 Flash Google yang dirilis 13 Agustus 2026. Intelligence index 56 (sumber: Artificial Analysis) menaruhnya di papan atas proprietary global, sejajar dengan GPT-5.6 Terra max (56,6) dan Sonnet 5 (55,3), sementara coding index 76,1 (sumber: Artificial Analysis) mendekati Claude Opus 5 (78). Pembeda utamanya adalah throughput output 357,8 token/detik — salah satu yang tertinggi di benchmark — plus harga API $0,75 per juta token input yang bermain di kelas mid-tier meski kemampuan kelas flagship.
Qwen3.8-Flash-Next
Varian Flash Next Alibaba — intel 55,8 dengan coding 73,1 dan tier awal gratis untuk eksplorasi
Qwen3.8-Flash-Next adalah varian iteratif dari lini Flash keluarga Qwen3.8 Alibaba yang diposisikan sebagai model kelas ringan cepat dengan kemampuan penalaran dan coding papan tengah ke atas. Intelligence index 55,8 (sumber: Artificial Analysis) menaruhnya di papan tengah proprietary global — sejajar dengan Sonnet 5 (55,3) dan mendekati frontier Asia atas (Qwen3.7 Plus 53,3, MiMo-V2.5-Pro 53,8) — sementara coding index 73,1 (sumber: Artificial Analysis) menjadi pembeda utamanya, melampaui Sonnet 5 (71,5) dan mendekati GLM-5.3 di papan atas. Harga input/output nol (sumber: Artificial Analysis) mengindikasikan akses tier awal gratis atau program promo untuk eksplorasi awal, menjadikan model ini titik masuk paling ramah di lineup Alibaba untuk eksperimen volume tinggi tanpa biaya.
GLM-5.3 Flash
Varian Flash keluarga GLM-5.3 Z AI — intel 57,5 dan coding 71,5 dengan harga input $0,15 per juta token
GLM-5.3 Flash adalah varian ringan dari keluarga GLM-5.3 Z AI yang diposisikan untuk workload volume-tinggi dengan sensitivitas biaya tinggi. Intelligence index 57,5 (sumber: Artificial Analysis) menempatkannya di papan atas proprietary Asia, sejajar dengan Sonnet 5 dan mendekati frontier papan atas GLM-5.3 max (59,5), sementara coding index 71,5 (sumber: Artificial Analysis) mendekati Sonnet 5 (71,5) dan GLM-5.2 (68,8). Pembeda utamanya adalah harga input $0,15 per juta token — sekitar 9x lebih murah dari GLM-5.3 max ($1,40) pada input, menjadikannya salah satu model papan tengah dengan rasio harga-performa paling menarik di lineup Z AI.
Qwen3.8 27B (xhigh)
Model dense 27B Alibaba dengan intel 52 dan coding 68 — sweet spot harga/performa untuk deployment lokal Indonesia
Qwen3.8 27B (xhigh) adalah varian mode xhigh dari keluarga Qwen3.8 Alibaba yang bermain di kelas dense parameter 27 miliar — jauh lebih kecil dari frontier MoE raksasanya, namun tetap mampu meraih intelligence index 52 (sumber: Artificial Analysis) yang menaruhnya di papan atas proprietary global. Coding index 68,1 (sumber: Artificial Analysis) menjadi pembeda utamanya: melampaui Claude Opus 4.5 (42,9), GPT-5 (36,0), dan mendekati GLM-5.2 max (68,8) di kelas coding meski di parameter count yang jauh lebih kecil. Harga API $0,50 per juta token input dan throughput 45,7 token/detik menjadikannya sweet spot ideal untuk deployment lokal skala menengah dan pipeline coding volume-tinggi di Indonesia.
Grok 4
Model nyeleneh dari xAI dengan mata yang selalu memantau X
Model flagship xAI dengan penalaran kuat dan keunggulan unik: akses real-time ke linimasa X. Gayanya yang santai dan kadang nyeleneh membuatnya terasa berbeda dari asisten AI lain yang serba sopan.
GLM-5.2 (max)
Flagship terbaru Z AI — lompatan coding kelas atas dengan harga mid-tier
GLM-5.2 (max) adalah iterasi flagship Z AI yang kembali ke papan atas dengan coding index 68,8 — salah satu skor tertinggi di benchmark Artificial Analysis, di atas Claude Opus 4.5 dan setara dengan frontier proprietary Barat di kelas coding. Intelligence index 51,1 menaruhnya di papan tengah-atas proprietary Asia, dengan harga API $1,40 per juta token input yang bermain di kelas mid-tier. Kombinasi coding superior dan harga yang lebih masuk akal dari frontier Barat menjadikannya opsi menarik untuk pipeline engineering serius.
Grok 4.6 (medium)
Frontier SpaceXAI Mei 2026 — intel 59,0 dengan harga mid-tier dan akses real-time bawaan
Grok 4.6 (medium) adalah iterasi frontier SpaceXAI (xAI) yang dirilis Mei 2026, diposisikan sebagai varian penalaran mid-tier dari keluarga Grok 4.6 — intelligence index 59,0 (sumber: Artificial Analysis) menembus papan atas proprietary global dan sejajar dengan frontier papan atas Asia, sementara coding index 74,4 menaruhnya di atas Sonnet 5 dan mendekati GLM-5.3. Bedanya dari Grok 4.5 dan Grok 4 keluarga sebelumnya: model ini dirancang sejak lahir untuk reasoning configurability dan akses real-time ke data X (Twitter) — diferensiasi unik di kelasnya.
GLM-5 (Reasoning)
Model reasoning Z AI yang dirancang untuk kerja agentic panjang dan engineering multi-langkah
Generasi kelima keluarga GLM dari Z AI (Zhipu) yang fokus ke pekerjaan agentic berdurasi panjang: penalaran multi-langkah, eksekusi tool dalam loop, dan rekayasa sistem kompleks. Intelligence index 49,8 (sumber: Artificial Analysis) menaruhnya di papan atas laboratorium Asia, bersaing head-to-head dengan Qwen3.7 Plus dan MiMo-V2.5-Pro — dengan positioning harga yang lebih premium dari keduanya.
GPT-6 Astra (low)
Tier hemat energi GPT-6 Astra untuk pipeline volume tinggi
Varian hemat energi dari lini GPT-6 Astra OpenAI yang menurunkan kedalaman penalaran demi biaya komputasi lebih rendah, dengan intelligence index 46,0 (sumber: Artificial Analysis) dan coding index 75,7 (sumber: Artificial Analysis) yang tetap memimpin benchmark pemrograman proprietary keluarga OpenAI. Throughput 53,614 token/detik cocok untuk pipeline batch dan workload volume tinggi di ekosistem developer yang sudah terikat pada tool OpenAI.
Doubao Seed Code
Model coding ByteDance dengan math index 79,3 — kekuatan matematika yang jarang terbuka
Doubao Seed Code adalah model terbaru dari divisi ByteDance Seed yang dirancang khusus untuk workload coding dan matematika. Math index 79,3 (sumber: Artificial Analysis) menaruhnya di papan atas industri untuk benchmark matematika — angka yang hanya dilampaui segelintir model frontier dunia. Dipasangkan dengan API Volcano Engine yang murah, model ini menjadi pilihan menarik untuk pipeline code assistant dan agentic tool-use.
Ling-2.6 1T
InclusionAI flagship trillion-parameter — ring attention untuk context panjang dan harga paling agresif di kelas reasoning
Flagship trillion-parameter InclusionAI (laboratorium AI Ant Group) yang menggunakan pola ring attention untuk menangani context panjang secara efisien. Intelligence index 26,1 (sumber: Artificial Analysis) menaruhnya di papan tengah proprietary Asia, tapi kombinasi arsitektur ring 1T dan harga API $0,30 per juta token input menjadikannya pilihan menarik untuk pipeline reasoning volume-tinggi dengan dokumen panjang khas pekerjaan birokrasi dan riset di Indonesia.
Muse Spark
Model eksperimental Meta untuk generasi kreatif multimodal
Muse Spark adalah keluarga model eksperimental dari Meta yang fokus pada generasi kreatif multimodal — teks, gambar, dan audio dalam satu pipeline. Intelligence index 52 dan bobot terbuka menjadikannya pilihan menarik untuk eksplorasi pipeline generasi konten di infrastruktur sendiri. Bukan model penalaran terkuat, tapi kelebihannya ada pada kelancaran dan integrasi multimodal.
MiMo-V2.5
Flagship open-weight Xiaomi — 1M konteks, harga paling murah di kelas frontier proprietary
MiMo-V2.5 adalah rilis open-weight flagship Xiaomi yang diumumkan 22 April 2026 — berbeda dari MiMo-V2.5-Pro proprietary, model ini tersedia di Hugging Face dengan lisensi MIT dan harga API paling agresif di kelasnya: $0,14 per juta token input dan $0,28 output. Intelligence index 40,1 (sumber: Artificial Analysis) menaruhnya di papan menengah proprietary, tapi kombinasi konteks 1M token, throughput 89 tokens/detik, dan lisensi yang benar-benar terbuka menjadikannya opsi menarik untuk deployment on-premise dan pipeline agentik skala besar di Indonesia.
Solar Pro 4
Model proprietary Upstage Korea — intel 41,6 dan coding 52,7 dengan harga termurah di kelas papan atas
Solar Pro 4 adalah flagship terbaru Upstage (Korea Selatan) yang dirilis 2026, diposisikan untuk Enterprise document AI dan workload multilingual Asia — intelligence index 41,6 (sumber: Artificial Analysis) menembus papan atas kategori proprietary mid-flagship, sementara coding index 52,7 (sumber: Artificial Analysis) menaruhnya sejajar dengan Claude Opus 4.5. Bedanya dari model China value-tier (DeepSeek V4 Flash, Qwen3.8 Max): Solar Pro 4 dijual lewat API enterprise-grade dengan SLA dan compliance Korea, Jepang, dan Indonesia, dengan dokumentasi dan dukungan regional yang lebih matang untuk pasar usaha Asia Tenggara dibanding vendor China.
Kimi K2.7 Code
Spesialis coding Kimi Moonshot — coding index 60,8 di kelas API mid-range
Varian khusus coding dari keluarga Kimi K2.7 Moonshot AI yang diposisikan sebagai pilihan ekonomis untuk pipeline coding agentic. Intelligence index 43,0 (sumber: Artificial Analysis) menaruhnya di papan tengah — di atas K2 lama (26,3) tapi di bawah Kimi K3 flagship (57,1). Coding index 60,8 menjadi nilai jual utama: mendekati Kimi K3 (76,2) untuk rasio coding-per-harga di kelas API mid-range, dan harga $0,95 per juta token input menjadikannya opsi rasional untuk developer Indonesia yang sensitif dolar.
Motif 3
MoE open-weight Korea dengan intel 47,4 dan coding 63,5 — lisensi MIT, gratis untuk komersial
Motif 3 adalah iterasi ketiga keluarga model Motif Technologies — laboratorium riset Korea Selatan yang fokus pada model open-weight skala besar dengan arsitektur Mixture-of-Experts. Intelligence index 47,4 (sumber: Artificial Analysis) menempatkannya di papan tengah-atas proprietary global, sejajar dengan Claude Opus 4.8 (48,1) dan Sonnet 4.5 (49,2), sementara coding index 63,5 (sumber: Artificial Analysis) mendekati frontier papan atas kelas Asia seperti Kimi K3 (76,2). Pembeda utamanya: lisensi MIT yang ramah komersial, gratis untuk inference lokal tanpa API cost, dan jejak multibahasa Inggris-Korea yang dirancang untuk deployment di pasar Asia.
MiMo-V2-Pro
Model 1T parameter Xiaomi yang lahir untuk era agent — fondasi sebelum V2.5-Pro
MiMo-V2-Pro adalah flagship proprietary Xiaomi yang rilis Maret 2026 dan memperkenalkan arsitektur hybrid attention 1T parameter (42B aktif) — pondasi yang kemudian dikembangkan V2.5-Pro. Intelligence index 40,3 (sumber: Artificial Analysis) menaruhnya di papan tengah atas, dengan kekuatan utama di tugas agentic panjang dan software engineering multi-langkah. Model ini sempat jadi misteri publik ketika muncul anonim di OpenRouter dengan nama sandi 'Hunter Alpha' sebelum Xiaomi mengakui sebagai model mereka.
Nemotron 3 Ultra 550B A55B (Reasoning)
Hybrid MoE NVIDIA 550B dengan 55B aktif — reasoning cepat dan throughput tinggi
Nemotron 3 Ultra 550B A55B (Reasoning) adalah iterasi reasoning flagship NVIDIA dengan arsitektur hybrid Mixture-of-Experts — total 550 miliar parameter, hanya 55 miliar aktif per token. Intelligence index 37,8 (sumber: Artificial Analysis) menempatkannya di papan tengah proprietary, dengan coding index 49,3 dan throughput output 148,3 tokens/detik yang menjadi pembeda utama. Kombinasi harga API $0,68 per juta token input dan TTFT 0,899 detik menjadikannya opsi menarik untuk pipeline reasoning yang butuh latensi rendah.
Hy3
Flagship Hunyuan reasoning generasi ketiga Tencent — coding dan tool-use kelas atas
Flagship reasoning terbaru dari keluarga Hunyuan Tencent — arsitektur MoE generasi ketiga dengan intelligence index 41,2 dan coding index 58,8 (sumber: Artificial Analysis). Diferensiasi utamanya: reasoning configurability, tool-use agentik yang solid, dan harga API agresif di kisaran $0,123 input / $0,430 output per juta token — dikelola lewat Tencent Cloud dan endpoint partner regional Asia Tenggara.
DeepSeek V3.x / R1
Open-weight disruptor: performa frontier, harga kaki lima
Model dari Tiongkok yang mengguncang industri: kemampuan mendekati model frontier dengan harga API sepersekian, dan bobotnya terbuka untuk di-host sendiri. Pilihan rasional untuk volume besar.
Qwen 3
Keluarga model open terlengkap — dari laptop sampai data center
Keluarga model open-weight Alibaba dengan rentang ukuran terlengkap, varian coding yang sangat kompeten, dan opsi MoE untuk skala server. Favorit komunitas self-host.
Kimi K2
MoE open-weight raksasa yang jago kerja agentic — dengan harga kaki lima
Model mixture-of-experts raksasa dari Moonshot AI yang dirancang sejak awal untuk tool-use dan kerja agentic. Kemampuan coding-nya menempel ketat ke model proprietary papan atas, dengan harga API yang jauh lebih ramah dan bobot yang terbuka.
MiniMax-M3
Flagship MiniMax berikutnya — intel kelas atas Asia dengan harga agresif
MiniMax-M3 adalah lonjakan generasi berikutnya dari laboratorium MiniMax — lompatan dari saudara kelas menengah M2.7 ke ambang kelas atas Asia. Intelligence index 44,4 (sumber: Artificial Analysis) menempatkan M3 sejajar dengan frontier proprietary yang lebih mapan di papan tengah-atas, dengan harga API $0,30 per juta token input yang tetap di kuadran agresif. Kombinasi coding index 43,4 dan throughput 69,17 tokens/detik menjadikannya model value-for-money yang menarik untuk pipeline produksi yang butuh kecepatan.
GLM-5-Turbo
Varian speed-optimized Z.ai — agentik ringan untuk long execution chain dengan harga mid-range
GLM-5-Turbo adalah varian speed-optimized dari keluarga GLM-5 yang dirilis Z.ai (sebelumnya Zhipu AI) pada 15 Maret 2026. Model ini mengambil trade-off yang berbeda dari GLM-5.1 atau GLM-5.2: mengorbankan sedikit kedalaman penalaran demi throughput tinggi dan latensi rendah, sambil tetap mempertahankan thinking modes selektif yang menjadi ciri keluarga GLM-5. Intelligence index 38,1 (sumber: Artificial Analysis) menaruhnya di papan menengah proprietary Asia, tapi kombinasi harga $1,20 input per juta token, throughput 43 tps, dan integrasi native dengan Claude Code lewat endpoint Anthropic-compatible menjadikannya opsi pragmatis untuk pipeline agentik volume-tinggi yang perlu iterasi cepat.
GLM-5.1 (Non-reasoning)
Varian non-reasoning GLM-5.1 dari Z AI — token throughput cepat dengan harga mid-range untuk workload agentik volume-tinggi
Varian non-reasoning dari keluarga GLM-5.1 Z AI (Zhipu) yang memprioritaskan token throughput cepat dengan harga mid-range, dirancang untuk pipeline agentik volume-tinggi yang tidak butuh chain-of-thought panjang. Intelligence index 35,4 (sumber: Artificial Analysis) menempatkannya di papan tengah laboratorium Asia, di bawah GLM-5 Reasoning (49,8) dan GLM-5.2 max, tapi dengan positioning yang berbeda: responsiveness di atas penalaran murni.
Inkling
Open-weights debut Thinking Machines — fleksibel, bisa di-host sendiri
Model open-weights pertama dari Thinking Machines, lab AI yang didirikan oleh Mira Murati setelah hengkang dari OpenAI. Intelligence index 40,7 dan coding index 52,1 (sumber: Artificial Analysis) menempatkannya di papan atas kelas menengah atas — dan yang menarik adalah arsitekturnya: dirancang agar bisa di-host sendiri dengan biaya inference jauh di bawah frontier proprietary.
o4-mini (high)
Reasoning ringan OpenAI — math index papan atas dengan footprint API ekonomis
o4-mini (high) adalah varian reasoning efisiensi dari keluarga o-series OpenAI — dirancang untuk memberikan penalaran multi-langkah yang solid dengan biaya API yang jauh lebih rasional dari GPT-5 atau o3. Intelligence index 25,6 (sumber: Artificial Analysis) menaruhnya di papan tengah, namun math index 90,7 meletakkannya di puncak untuk penalaran numerik — sejajar dengan frontier papan atas untuk workload matematik. Harga API $1,10 per juta token input dan $4,40 output bermain di kelas mid-tier yang efisien, menjadikannya opsi menarik untuk pipeline reasoning volume-tinggi di mana setiap dolar inference dihitung.
MiniMax-M2.7
Model kelas menengah MiniMax — intel papan tengah dengan harga paling agresif di keluarganya
MiniMax-M2.7 adalah model kelas menengah dari MiniMax yang bermain di kuadran harga paling agresif di keluarga M-series. Intelligence index 38,1 (sumber: Artificial Analysis) menempatkannya di papan tengah industri — di bawah frontier proprietary Asia (Qwen3.7 Plus, MiMo-V2.5-Pro, GLM-5), tapi dengan harga API $0,30 per juta token input yang nyaris menyentuh level open-weight. Kombinasi coding index 41,9 dan harga segini menempatkan M2.7 sebagai opsi volume-tinggi untuk pipeline engineering yang sensitif dolar.
JT-4.1 Flash 236B A21B
MoE raksasa China Mobile — papan tengah benchmark dengan konteks 256K
Varian Flash dari keluarga JT-4.1 (Jiutian) milik China Mobile — operator telekomunikasi milik negara China yang merilis model ini pada 9 Juli 2026. Intelligence index 38,8 dan coding index 52,4 (sumber: Artificial Analysis) menempatkannya di papan tengah benchmark agregat, jauh di atas median non-reasoning di kelas harga yang sama, dengan jendela konteks 256K token dan arsitektur MoE yang diklaim 236B parameter total / 21B aktif per AA.
NVIDIA Nemotron 3 Super 120B A12B (Reasoning)
Varian MoE reasoning NVIDIA dengan efisiensi tinggi dan harga API sangat agresif
Varian MoE reasoning dari keluarga Nemotron 3 NVIDIA, dirancang untuk workload penalaran berat dengan efisiensi tinggi lewat aktivasi sparse 12B dari total 120B parameter. Intelligence index 25,4 dan coding index 37,7 (sumber: Artificial Analysis) menempatkannya di papan menengah atas dengan diferensiasi jelas pada rasio harga/performa: $0,25/M input dan $0,775/M output, salah satu yang paling agresif untuk model dengan kemampuan reasoning terukur.
Agnes 2.5 Pro Alpha
Sapiens AI agresif di ceruk developer — coding solid, harga Asia-friendly
Model andalan Sapiens AI yang bermain di ceruk harga agresif dengan coding index 58,8 (sumber: Artificial Analysis) — salah satu skor coding terbaik di papan API di bawah $1 per juta token. Intelligence index 38,8 menaruhnya di mid-tier proprietary, tapi untuk workload backend dan tooling developer, value proposition-nya sulit diabaikan.
Llama 4
Fondasi ekosistem open dari Meta — standar de facto industri
Generasi terbaru keluarga Llama dengan arsitektur MoE dan kemampuan multimodal. Bukan yang tertajam di setiap benchmark, tapi ekosistem dan dukungannya tetap yang paling luas di dunia open model.
Qwen3.5 397B A17B (Reasoning)
MoE hybrid Alibaba 397B dengan 17B aktif — penalaran solid di kelas harga paling efisien
Qwen3.5 397B A17B (Reasoning) adalah varian reasoning dari keluarga Qwen3.5 Alibaba dengan arsitektur Mixture-of-Experts (MoE) hybrid: total 397 miliar parameter, namun hanya 17 miliar parameter aktif per token — desain yang menurunkan biaya inferens tanpa mengorbankan kualitas penalaran. Intelligence index 33,7 (sumber: Artificial Analysis) menaruhnya di papan tengah, tapi coding index 48,2 menunjukkan kekuatan utama model ini di kelas harganya, dengan API $0,60 per juta token input yang bermain di kuadran paling efisien untuk proprietary reasoning.
Ring-2.6-1T
Flagship trillion-parameter InclusionAI — arsitektur ring attention 1T dengan harga paling agresif di kelas reasoning
Ring-2.6-1T adalah iterasi flagship dari InclusionAI — laboratorium AI milik Ant Group — dengan arsitektur trillion-parameter (1T total) yang menggunakan pola ring attention untuk menangani context panjang secara efisien. Intelligence index 30,6 (sumber: Artificial Analysis) menempatkannya di papan tengah proprietary Asia, tapi kombinasi coding index 42,8, throughput output 137,5 tokens/detik, dan harga API $0,30 per juta token input menjadikannya model value-for-money yang menarik untuk pipeline reasoning volume-tinggi di Indonesia.
MiMo-V2-Omni-0327
Omni foundation Xiaomi — persepsi multimodal terpadu (gambar, video, audio, teks) dengan tool calling agentik native
MiMo-V2-Omni-0327 adalah omni foundation model dari Xiaomi — laboratorium yang sebelumnya merilis MiMo-V2.5-Pro untuk reasoning teks. Varian Omni ini memperluas arsitektur ke multimodal terpadu: encoder gambar, video, dan audio digabung ke satu backbone bersama, dengan tool calling agentik native dan structured function execution. Intelligence index 36,4 (sumber: Artificial Analysis) menaruhnya di papan menengah proprietary Asia, tapi kombinasi persepsi lintas-modalitas dan harga API $0,40 input per juta token menjadikannya opsi pragmatis untuk pipeline agentik multimodal volume-tinggi.
KAT Coder Pro V2
Flagship agentic coding Kuaishou - 73,4% SWE-Bench Verified dengan harga agresif
KAT Coder Pro V2 adalah model flagship agentic coding dari KwaiKAT (divisi riset AI Kuaishou) yang dirilis 27 Maret 2026, diposisikan khusus untuk software engineering agentik dan frontend aesthetic generation. Intelligence index 35,4 (sumber: Artificial Analysis) menaruhnya di papan menengah, tapi skor SWE-Bench Verified 73,4% - sejajar dengan GPT-5 High dan Claude Sonnet 4.5 - menjadikannya salah satu model coding paling kompetitif di kelas harga $0,30 per juta token input dan $1,20 output.
Hy3-preview (Reasoning)
Flagship MoE 295B Tencent Hunyuan — reasoning configurable, throughput tinggi, harga paling agresif di kelas open-weight besar
Hy3-preview (Reasoning) adalah model flagship Hunyuan terbaru dari Tencent yang dirilis 22 April 2026 — arsitektur Mixture-of-Experts 295B parameter dengan hanya 21B aktif per forward pass, dirancang khusus untuk reasoning mendalam, agentic workflow, dan problem-solving STEM. Intelligence index 33,6 (sumber: Artificial Analysis) menempatkannya di papan tengah laboratorium Asia, tapi throughput output 150 tps dan harga API $0,12 input menjadikannya salah satu kombinasi harga/performa paling menarik di kelas model besar open-weight.
o3
Model reasoning klasik OpenAI dengan spesialisasi matematika dan sains tingkat olimpiade
Model reasoning ikonik OpenAI yang menaruh dasar penalaran multi-langkah skala besar dengan skor matematika 88,3 - angka yang menempatkannya di papan atas benchmark numerik dibanding frontier reasoning 2026. Intelligence index 30,4 (sumber: Artificial Analysis) memang bukan yang tertinggi di kelasnya, tapi kombinasi kecepatan 154 token/detik dan tradisi OpenAI dalam penalaran terstruktur menjadikan o3 titik masuk yang menarik untuk riset dan pipeline agen yang butuh verifikasi bertahap.
Step 3.7 Flash
Model kilat dari StepFun — harga agresif, throughput tinggi
Model 'Flash' kelas menengah dari StepFun yang menonjol lewat harga sangat agresif ($0,20 input, $1,15 output per juta token) dan throughput 393 token/detik — jauh di atas rata-rata frontier. Intelligence index 30,3 dan coding index 39,6 menempatkannya di papan tengah benchmark, menjadikannya menarik untuk workload volume tinggi yang tidak menuntut penalaran frontier.
Qwen3 Coder Next
Specialist coding agent dari Alibaba — throughput tinggi di kelas harga agresif
Varian specialist coding dari keluarga Qwen3 — lini model open-weight Alibaba yang kini punya varian proprietary API khusus coding agent. Intelligence index 21,1 dan coding index 36,2 (sumber: Artificial Analysis) menempatkannya sebagai model papan tengah dengan trade-off khas: penalaran umum biasa, tapi kemampuan coding dan kecepatan throughput di atas rata-rata kelas harga. Dipasarkan lewat harga API $0,35/M input dan $1,20/M output — kompetitif untuk workload volume.
Cohere North Mini Code
Varian coding Cohere yang ultra-murah dan cepat untuk workflow agent
Varian specialist coding dari keluarga Command R+ North Cohere, dirilis lewat API North platform Cohere, dan partner enterprise Cohere. Intelligence index 20,6 dan coding index 36,5 (sumber: Artificial Analysis) menaruhnya di papan tengah dengan trade-off khas Cohere: penalaran umum biasa, tapi kemampuan coding, throughput, dan harga paling agresif di kelas papan tengah. Dipasarkan dengan tier harga khusus untuk workload coding agentik — menarik untuk developer yang perlu budget ketat.
Mercury 2
Diffusion LLM dari Inception — reasoning model dengan kecepatan 1000+ token/detik
Mercury 2 adalah model penalaran generasi kedua dari Inception yang menggunakan arsitektur diffusion language model (dLLM) — pendekatan yang berbeda dari LLM auto-regresif dominan industri. Kecepatan outputnya yang nyaris 1200 token/detik menjadikannya model penalaran tercepat yang masuk katalog Artificial Analysis, meski intelligence index 21,4 menempatkannya di papan bawah-tengah benchmark standar.
Motif 3 (Beta)
Model open-weight baru Motif Technologies — Coding 62 di kelas intel mid
Model open-weight dari Motif Technologies yang menonjol di dimensi coding: skor 62 di coding index (sumber: Artificial Analysis) menempatkannya di papan atas kelas mid-range, jauh di atas rata-rata model open-weight sekelas intelligence index 44,1. Trade-off jelas: penalaran umum masih di bawah frontier, tapi untuk workload coding agentik dengan biaya rendah, value proposition-nya sulit diabaikan.
LongCat 2.0
Model open-weight 135B MoE dari Meituan — coding solid, konteks 1M, lisensi MIT
LongCat 2.0 adalah model open-weight 135B parameter (arsitektur MoE sparse) yang dirilis Meituan, induk platform lifestyle dan food delivery terbesar di China. Intelligence index 33,5 (sumber: Artificial Analysis) menaruhnya di papan tengah open-weight, tapi coding index 45,3 (sumber: Artificial Analysis) menempatkannya di papan atas untuk kategori open-weight — dan lisensi MIT dengan konteks 1M token membuat model ini menarik untuk deployment sendiri tanpa beban lisensi proprietary.
K-EXAONE (Reasoning)
Laboratorium riset Korea dengan penalaran matematik papan atas — alternatif serius di luar liga AS-Tiongkok
Model reasoning dari LG AI Research — laboratorium riset Korea yang jarang masuk radar pembicaraan model global, tapi konsisten di papan atas untuk benchmark matematik. Intelligence index 22,1 (sumber: Artificial Analysis) menempatkannya di papan menengah, namun math index 90,3 menaruhnya di puncak untuk penalaran numerik. Bobot terbuka menjadikan K-EXAONE menarik untuk self-host riset atau workload matematika volume tinggi yang sensitif biaya.
A.X-K2
Model Korea Selatan dari SK Telecom — intel 35,0 dan coding 38,8 dengan harga inference gratis untuk pasar domestik dan Asia
A.X-K2 adalah model proprietary SK Telecom (Korea Selatan) yang diposisikan untuk pasar telekomunikasi Asia — intelligence index 35,0 (sumber: Artificial Analysis) menembus papan menengah proprietary mid-flagship, coding index 38,8 (sumber: Artificial Analysis) menaruhnya di atas rata-rata industri, dan dijual dengan harga inference $0 input dan $0 output untuk adoption domestik Korea dan mitra telco regional. Bedanya dari Upstage Solar Pro 4 (41,6) atau DeepSeek V4 Pro (45,3): A.X-K2 adalah model telco-first, bukan dokumen enterprise atau penalaran umum, dan strategi monetisasinya bukan inference-per-token melainkan bundling dengan layanan telekomunikasi SK Telecom ke 30+ juta pelanggan.
Granite 4.2 30B
Model open-weight IBM Granite 4.2 dengan intel 23,7 dan coding 29,9 — Apache 2.0, harga input $0,16 per juta token
Granite 4.2 30B adalah iterasi terbaru keluarga Granite IBM untuk deployment enterprise open-weight dengan lisensi Apache 2.0. Intelligence index 23,7 (sumber: Artificial Analysis) menempatkannya di papan menengah, jauh di bawah frontier papan atas, namun pembeda utamanya adalah lisensi benar-benar komersial dan harga input $0,16 per juta token (sumber: Artificial Analysis) yang menjadikannya salah satu opsi on-premise paling terjangkau untuk workload volume-tinggi yang sensitif data.
Nex-N2-Pro
Flagship Nex AGI — keseimbangan penalaran, coding agentik, dan harga mid-range
Nex-N2-Pro adalah model flagship dari Nex AGI yang dirilis 2 Juni 2026, diposisikan untuk keseimbangan penalaran umum dan coding agentik di kelas mid-range proprietary. Intelligence index 41 dan coding index 59,1 (sumber: Artificial Analysis) menaruhnya di papan menengah — di bawah frontier Barat untuk penalaran murni, tapi cukup solid untuk engineering task dan workflow multi-langkah, dengan harga $0,50 per juta token input dan $2,50 output yang kompetitif dibanding peer proprietary papan menengah.
MiniMax-M2.5
Varian efisiensi M-series — throughput output tercepat di keluarganya dengan harga $0,30 input
MiniMax-M2.5 adalah varian efisiensi M-series MiniMax yang dirilis 12 Februari 2026 — sebelum saudara M2.7 (Maret 2026) dan M3 — dengan positioning berbeda: throughput output 175,19 tokens/detik menjadikannya model tercepat di keluarga M-series, jauh meninggalkan M2.7 (31,7 tps) yang keluar sebulan kemudian. Intelligence index 33,7 (sumber: Artificial Analysis) menaruhnya di papan tengah ke bawah, di bawah M2.7 (38,1) dan M3 (44,4), tapi kombinasi harga API $0,30 input dan kecepatan tinggi menjadikannya opsi menarik untuk chat interaktif volume-tinggi di mana responsivitas lebih diprioritaskan dari penalaran murni terberat.
GLM 5V Turbo (Reasoning)
Varian multimodal cepat Z AI untuk dokumen visual dan reasoning ringan
Varian ringkas dari keluarga GLM 5V Z AI yang memadukan pemahaman visual multimodal dengan mode reasoning. Intelligence index 34,5 menempatkannya di papan tengah, tapi spesialisasinya ada pada pemrosesan gambar, grafik, dan diagram — use case yang ramai di kalangan analis dan pelajar Indonesia.
Command A+
Flagship enterprise Cohere dengan context window 256K dan lisensi terbuka
Flagship open-weight terbaru Cohere dengan intelligence index 22,5 dan coding index 27,8 (sumber: Artificial Analysis). Diferensiasi utamanya: jendela konteks 256K token, throughput 188,4 token/detik, dan lisensi terbuka yang memungkinkan self-host enterprise — angka intelligence agregat masih di bawah frontier Barat (Gemini 3 57,2, GPT-5 44,6, Claude Opus 4,5 memimpin 43,1+), tapi arsitektur dan karakteristik deployment-nya menarik untuk pasar enterprise dan region dengan kedaulatan data ketat.
Apriel-v1.5-15B-Thinker
Open-weight reasoning 15B dari ServiceNow — math tinggi, footprint kecil, self-host friendly
Varian reasoning dari keluarga Apriel 1.5 yang dirilis ServiceNow — laboratorium riset enterprise asal Silicon Valley yang selama ini lebih dikenal lewat platform otomatisasi Now Platform. Intelligence index 21,2 (sumber: Artificial Analysis) menaruhnya di papan tengah, namun math index 87,5 meletakkannya di puncak untuk penalaran numerik. Dengan 15 miliar parameter dan bobot terbuka, Apriel Thinker menarik untuk self-host di GPU mid-range, workload matematika, dan eksplorasi on-prem tanpa ketergantungan API proprietary.
Apriel-v1.6-15B-Thinker
Iterasi terbaru ServiceNow — math index 88 pada footprint 15B yang ringkas
Apriel-v1.6-15B-Thinker adalah iterasi terbaru keluarga Apriel Thinker dari ServiceNow yang dirilis Agustus 2026, meneruskan tradisi v1.5 dengan footprint parameter 15B yang ringan dan bobot terbuka. Intelligence index 20,5 (sumber: Artificial Analysis) menempatkannya di papan tengah, namun math index 88 meletakkannya di puncak untuk penalaran numerik — sedikit di atas v1.5 (87,5) dan sejajar dengan reasoning papan atas kelas ringan. Untuk pipeline matematika dan workload reasoning on-prem yang sensitif data, v1.6 adalah pembaruan yang mempertajam positioning tanpa mengorbankan sifat self-host friendly.
Ling-3.0 Flash
InclusionAI lightweight API — kecepatan tinggi, coding solid, harga sub-sen untuk inference volume-tinggi
Varian ringan dari keluarga Ling InclusionAI (laboratorium AI Ant Group) yang menonjol di kuadran kecepatan dan harga — intelligence index 38,3 (sumber: Artificial Analysis) menaruhnya di papan tengah, tapi throughput output 328+ token/detik dan harga API $0,075 per juta token input menjadikannya pilihan menarik untuk pipeline coding agentic volume-tinggi dan chat interaktif latency-sensitif di pasar Indonesia.
o3-pro
Varian reasoning dalam OpenAI o-series — penalaran paling dalam, harga paling premium
o3-pro adalah varian reasoning paling berat OpenAI untuk aplikasi yang butuh chain-of-thought panjang dan konsisten — sains, matematika, dan riset multi-langkah. Intelligence index 32,5 (sumber: Artificial Analysis) bukan yang tertinggi di pasaran, tapi pola penalaran deliberatif dan konsistensi jawaban panjang membuatnya andalan untuk use case reasoning murni, bukan volume tinggi.
MiMo-V2-Omni
Model omni-modal Xiaomi dengan audio 10 jam dan multimodal
Model omni-modal flagship Xiaomi yang menyatukan pemahaman teks, gambar, video, dan audio dalam satu arsitektur unified. Intelligence index 35 (sumber: Artificial Analysis) menempatkan MiMo-V2-Omni di papan tengah, tapi spesialisasinya jelas: audio 10 jam kontinyu, BigBench Audio 94,0, dan kemampuan agentic multimodal yang dirancang untuk Browser-Use dan otomasi GUI.
Nova 2.0 Pro Preview (medium)
Reasoning model Amazon — performa matematika tinggi dengan harga mid-tier
Varian reasoning menengah dari keluarga Amazon Nova 2.0 — lini model AI terbaru Amazon Web Services yang menonjol lewat math index tinggi (89, sumber: Artificial Analysis) untuk kelas harganya, dikompensasi dengan intelligence index agregat 21,8 yang lebih rendah dari frontier papan atas. Cocok untuk workload matematika, coding, dan reasoning terapan dengan integrasi native AWS.
gpt-oss-120b (high)
Open-weight flagship OpenAI — frontier reasoning dengan lisensi terbuka
Model open-weight flagship dari OpenAI dengan intelligence index 23,8 dan coding index 30,4 (sumber: Artificial Analysis) — angka intelligence agregat masih di bawah frontier Barat proprietary (Gemini 3 57,2, GPT-5 44,6, Claude Opus 4.5 43,1+), tapi coding index-nya mendekati frontier dan math index 93,4 (sumber: AA) menjadikannya salah satu skor matematika tertinggi di keluarga open weight. Dipasarkan lewat harga API paling murah di antara model kelas atas: $0,15/M input dan $0,60/M output.
GLM-4.7-Flash (Reasoning)
Varian reasoning murah Z AI — penalaran dengan harga Flash, throughput tinggi
Varian Flash reasoning dari keluarga GLM-4.7 Z AI (Zhipu) yang positioning-nya jelas: penalaran deliberatif dengan harga paling agresif di lineup proprietary Asia. Intelligence index 22,9 (sumber: Artificial Analysis) menaruhnya di papan tengah ke bawah, tapi harga $0,07 per juta token input dan $0,40 output adalah salah satu yang termurah untuk model yang menjalankan fase reasoning eksplisit. Pilihan rasional untuk workload agentic volume tinggi yang sensitif dolar.
Ling-3.0 Tiny
InclusionAI tier gratis — model ringan untuk eksplorasi API dan belajar prompt tanpa biaya
Varian paling ringan dari keluarga Ling InclusionAI — laboratorium AI Ant Group — yang menyasar pengguna yang ingin mencoba API model bahasa besar tanpa kartu kredit internasional dan tanpa tekanan biaya per inference. Intelligence index 24,5 (sumber: Artificial Analysis) menempatkannya di papan bawah-menengah untuk kemampuan penalaran, tapi throughput output 202+ token/detik dan akses gratis menjadikannya pintu masuk ideal untuk eksplorasi API, belajar prompt engineering, dan prototyping chatbot volume-menengah di pasar Indonesia.
EXAONE 4.5 33B
Model open-weight 33B dari LG AI Research untuk deployment on-premise multibahasa
EXAONE 4.5 33B adalah iterasi terbaru keluarga EXAONE dari LG AI Research, laboratorium riset Korea Selatan yang konsisten mengembangkan model bilingual Inggris-Korea dengan lisensi open-weight. Varian 33B merupakan titik keseimbangan antara kemampuan penalaran dan biaya deployment - cukup ringkas untuk dijalankan di workstation dengan GPU tunggal kelas menengah, cukup mampu untuk workload enterprise multibahasa.
KAT Coder Pro V1
Pendahulu KAT Coder Pro V2 - SWE-Bench 73,4% pertama dari KwaiKAT dengan harga paling agresif
KAT Coder Pro V1 adalah model agentic coding pertama dari KwaiKAT (divisi riset AI Kuaishou) yang dirilis 10 November 2025, diposisikan khusus untuk software engineering agentik dengan SWE-Bench Verified 73,4% - angka yang sama dengan penerusnya V2. Intelligence index 34,6 (sumber: Artificial Analysis) menaruhnya di papan menengah, tapi skor SWE-Bench 73,4% di kelas harga API $0,21-$0,30 per juta token input menjadikannya pilihan entry-level paling menarik di keluarga KAT Coder untuk developer yang baru eksplorasi agentic coding dengan budget ketat.
JT-35B-Flash
Model cepat dari China Mobile — telco raksasa serius di AI lokal
Model bahasa besar dari China Mobile, operator telekomunikasi terbesar di dunia. Intelligence index 28,4 (sumber: Artificial Analysis) menempatkan JT-35B-Flash di kelas mid-tier, dan positioning-nya jelas: fokus pada inference cepat dan deployment enterprise untuk pasar domestik China. Bukan model yang mengejar frontier, tapi calon pemain infrastruktur yang patut dipantau.
ERNIE 5.0 Thinking Preview
Varian thinking ERNIE 5.0 dari Baidu — penalaran matematis serius, akses publik gratis
Varian thinking dari ERNIE 5.0 — model andalan Baidu yang dirilis dalam mode pratinjau publik. Intelligence index 21,9 (sumber: Artificial Analysis) menaruhnya di papan tengah untuk benchmark umum, namun math index 85 meletakkannya di puncak untuk penalaran numerik. Akses gratis lewat Qianfan dan API resmi Baidu menjadikannya titik masuk yang menarik bagi pengguna Indonesia yang ingin menjajal model reasoning asal Tiongkok tanpa harus berlangganan paket premium.
MiniMax-M2
Model dasar MiniMax M-series — rilis awal 2026 dengan harga agresif untuk eksperimen volume
MiniMax-M2 adalah varian entry-level dari keluarga M-series MiniMax — rilis awal Oktober 2025 yang menjadi basis arsitektur bagi saudara-saudara M2.1, M2.5, M2.7, dan M3. Intelligence index 28,3 (sumber: Artificial Analysis) menaruhnya di papan bawah-tengah industri, di bawah saudara M2.7 (38,1) dan M3 (44,4), tapi harga API $0,30 per juta token input tetap sama agresifnya dengan seluruh keluarga M-series. Cocok untuk eksperimen volume tinggi di mana biaya inference per token adalah variabel utama, bukan performa mutlak.
GLM-4.7 (Non-reasoning)
Varian non-reasoning GLM-4.7 dari Z AI — throughput ekstrem dengan harga kelas bawah
Varian non-reasoning dari keluarga GLM-4.7 Z AI (Zhipu), di-positioning sebagai model throughput-tinggi dengan harga agresif untuk workload inference volume besar. Intelligence index 26,6 (sumber: Artificial Analysis) menaruhnya di papan tengah ke bawah proprietary Asia, tapi trade-off-nya jelas: bukan untuk penalaran murni terberat, melainkan untuk pipeline responsivitas-tinggi yang mengukur user experience lewat latensi dan biaya per token, bukan skor benchmark absolut.
AI9Stars G9v3-39A5B
Open-weight MoE Apache-2.0 39B dari AI9Stars — long-context dengan tool calling native dan arsitektur 32-expert
G9v3-39A5B adalah iterasi open-weight terbaru dari laboratorium AI9Stars dengan arsitektur Mixture-of-Experts skala menengah — total 38,97 miliar parameter dengan 32 expert aktif per token (menjadikan ini model MoE aktif-sparse dengan kapasitas besar per langkah inferens). Intelligence index 31,6 dan coding index 31,7 (sumber: Artificial Analysis) menempatkannya di papan menengah model open-weight 2026, tapi diferensiasi utamanya justru ada di kombinasi: lisensi Apache-2.0 (cocok untuk deployment komersial dan on-premise), dukungan long-context native, tool calling bawaan lewat XML function-call schema, dan multibahasa Inggris dan Mandarin. Untuk developer Indonesia yang butuh self-host atau orkestrasi multi-model dengan biaya nol per token, G9v3-39A5B menarik sebagai building block pipeline.
MiMo-V2-Flash (Reasoning)
Varian cepat reasoning Xiaomi dengan harga paling agresif di Agent Era
Varian ringan reasoning dari keluarga MiMo-V2 Xiaomi yang menawarkan harga input 10 sen dan output 30 sen per juta token — titik masuk paling murah di lini Agent Era. Intelligence index 31,2 dan skor matematika 96,3 menjadi kombinasi menarik untuk tugas penalaran numerik volume tinggi di pasar Indonesia.
MiniMax-M2.1
Pintu masuk paling murah di keluarga M-series — penalaran solid dengan harga paling agresif
Varian entry-level dari keluarga M-series MiniMax yang membawa harga paling agresif di lini M — $0,30 input dan $1,20 output per juta token. Intelligence index 31,4 (sumber: Artificial Analysis) dan math index 82,7 menjadi kombinasi menarik untuk workload penalaran numerik volume tinggi di pasar Indonesia, dengan throughput output 71,6 token/detik yang cukup responsif untuk chat interaktif.
o1
Generasi pertama reasoning model OpenAI - pionir chain-of-thought yang membuka era penalaran eksplisit di industri LLM
o1 adalah model pertama OpenAI yang secara eksplisit dirancang untuk penalaran chain-of-thought - dirilis dalam bentuk preview pada September 2024 dan versi penuh Desember 2024, o1 memperkenalkan paradigma baru di industri LLM: model yang 'berpikir keras' sebelum menjawab, dengan internal reasoning trace yang lebih panjang dibanding GPT-4o. Intelligence index 23,4 (sumber: Artificial Analysis) membuatnya tampak tertinggal dibanding frontier reasoning 2026 (Claude Opus 4.5, GPT-5, GLM-5.2, MiMo-V2.5-Pro di 43-58), tapi signifikansi historisnya - model yang mempopulerkan reasoning sebagai kategori produk terpisah - menjadikannya layak dicatat di arsip Wawasan AI sebagai tonggak transisi dari era LLM generik ke era penalaran eksplisit.
Mistral Large / Medium
Juara Eropa: efisien, enterprise-ready, dan punya Le Chat
Lini model andalan Mistral AI, satu-satunya pemain frontier dari Eropa. Filosofinya jelas: performa kompetitif dari model yang lebih kecil dan efisien, dengan opsi deployment fleksibel yang disukai enterprise — plus asisten Le Chat yang sangat responsif.
Gemma 3
Model open kecil terbaik — multimodal yang muat di laptop kentang
Keluarga model open kecil dari Google yang dirancang untuk perangkat terbatas: dari ponsel sampai laptop tanpa GPU. Kemampuan multibahasa dan multimodalnya mengejutkan untuk ukurannya — pintu masuk terbaik ke dunia AI lokal.
Tentang skor di halaman ini
Skor di Wawasan AI (0-10) adalah rating editorial yang menggabungkan penalaran, coding, kecepatan, dan rasio harga/performa — bukan benchmark murni. Untuk benchmark independen lintas model, lihat Artificial Analysis. Pada review tertentu kami cantumkan aa_intelligence_index sebagai pembanding — skala AA berbeda (0-100, median industri ≈ 20).