Benchmark model
Skor evaluasi independen dari Artificial Analysis untuk setiap model di katalog MeowAPI, disandingkan dengan harga rupiah kami. Angka benchmark tidak kami hitung sendiri — jadi tidak ada insentif buat kami memoles model yang marginnya paling besar.
Data diperbarui 1 jam lalu.
Peringkat 17 modelKecerdasan
| # | Model | Skor | Bar skor | Kecepatan | TTFT | Harga out |
|---|---|---|---|---|---|---|
| 1 | Claude Opus 5 claude-opus-5 | 63.1 | 56 tok/s | 30.10 s | Rp 24.000 | |
| 2 | Claude Fable 5 claude-fable-5 | 62.1 | 69 tok/s | 43.83 s | Rp 30.000 | |
| 3 | Kimi K3 kimi-k3 | 59.7 | 37 tok/s | 5.00 s | Gratis | |
| 4 | GLM 5.3 glm-5.3 | 59.5 | 59 tok/s | 1.53 s | Rp 15.344 | |
| 5 | Qwen 3.8 max qwen3.8-max | 58.1 | 27 tok/s | 1.76 s | Rp 19.309 | |
| 6 | GLM 5.3 Flash glm-5.3-flash | 57.5 | 49 tok/s | 1.14 s | Rp 10.640 | |
| 7 | Claude Opus 4.8 claude-opus-4-8 | 57.3 | — | — | Rp 31.250 | |
| 8 | Qwen 3.8 Flash qwen-3.8-flash | 55.8 | 70 tok/s | 1.56 s | Rp 7.370 | |
| 9 | GLM 5.2 glm-5.2 | 52.6 | 69 tok/s | 1.17 s | Rp 10.235 | |
| 10 | GPT 5.6 Luna gpt-5.6-luna | 52.3 | 124 tok/s | 67.98 s | Rp 6.670 | |
| 11 | Qwen 3.8 27B qwen-3.8-27b | 52.0 | 46 tok/s | 1.25 s | Gratis | |
| 12 | DeepSeek V4 Flash 0731 deepseek-v4-flash-0731 | 51.8 | 135 tok/s | 1.03 s | Gratis | |
| 13 | DeepSeek V4 Flash Vision exp deepseek-v4-flash | 51.5 | 117 tok/s | 0.78 s | Rp 14.950 | |
| 14 | MiniMax M3 MiniMax-M3 | 45.4 | 101 tok/s | 0.94 s | Rp 9.360 | |
| 15 | DeepSeek V4 Pro deepseek-v4-pro | 45.3 | 61 tok/s | 0.99 s | Rp 10.355 | |
| 16 | hy3 hy3 | 42.2 | 73 tok/s | 1.78 s | Gratis | |
| 17 | MiMo V2.5 mimo-v2.5 | 38.0 | 67 tok/s | 1.99 s | Gratis |
- 163.1
Claude Opus 5
claude-opus-5
56 tok/sTTFT 30.10 sout Rp 24.000 - 262.1
Claude Fable 5
claude-fable-5
69 tok/sTTFT 43.83 sout Rp 30.000 - 359.7
Kimi K3
kimi-k3
37 tok/sTTFT 5.00 sout gratis - 459.5
GLM 5.3
glm-5.3
59 tok/sTTFT 1.53 sout Rp 15.344 - 558.1
Qwen 3.8 max
qwen3.8-max
27 tok/sTTFT 1.76 sout Rp 19.309 - 657.5
GLM 5.3 Flash
glm-5.3-flash
49 tok/sTTFT 1.14 sout Rp 10.640 - 757.3
Claude Opus 4.8
claude-opus-4-8
—TTFT —out Rp 31.250 - 855.8
Qwen 3.8 Flash
qwen-3.8-flash
70 tok/sTTFT 1.56 sout Rp 7.370 - 952.6
GLM 5.2
glm-5.2
69 tok/sTTFT 1.17 sout Rp 10.235 - 1052.3
GPT 5.6 Luna
gpt-5.6-luna
124 tok/sTTFT 67.98 sout Rp 6.670 - 1152.0
Qwen 3.8 27B
qwen-3.8-27b
46 tok/sTTFT 1.25 sout gratis - 1251.8
DeepSeek V4 Flash 0731
deepseek-v4-flash-0731
135 tok/sTTFT 1.03 sout gratis - 1351.5
DeepSeek V4 Flash Vision exp
deepseek-v4-flash
117 tok/sTTFT 0.78 sout Rp 14.950 - 1445.4
MiniMax M3
MiniMax-M3
101 tok/sTTFT 0.94 sout Rp 9.360 - 1545.3
DeepSeek V4 Pro
deepseek-v4-pro
61 tok/sTTFT 0.99 sout Rp 10.355 - 1642.2
hy3
hy3
73 tok/sTTFT 1.78 sout gratis - 1738.0
MiMo V2.5
mimo-v2.5
67 tok/sTTFT 1.99 sout gratis
Belum ada data benchmark
Model ini belum dipetakan ke entri Artificial Analysis, atau AA belum menguji model tersebut.
- Agnes 2.5 Flash
Nilai: harga vs kecerdasan
Makin ke kiri-atas makin hemat. Harga campur 3 input : 1 output per 1M token.
Paling hemat
GPT 5.6 Luna
Skor 52.3 pada Rp 3.824 / 1M token campur.
Arahkan kursor
Sorot titik atau nama model untuk melihat skor, harga, dan angka nilainya.
Cara membaca angka ini
Kecerdasan, Coding, Matematika adalah index gabungan Artificial Analysis (skala 0-100) dari sekumpulan benchmark seperti MMLU-Pro, GPQA Diamond, Humanity's Last Exam, LiveCodeBench, SciCode, dan AIME. Metodologi lengkapnya ada di halaman metodologi mereka.
Kecepatan dan TTFT diukur Artificial Analysis di penyedia resmi masing-masing model, bukan di jalur yang dipakai MeowAPI — anggap sebagai gambaran kelas model, bukan janji latensi kami. Status upstream kami yang sebenarnya tampil di katalog dashboard.
Pemetaan alias kami ke entri Artificial Analysis dipilih manual, termasuk memilih varian effort untuk model yang punya beberapa tingkat. Varian yang dijalankan penyedia upstream bisa berbeda, jadi skor di sini adalah perkiraan padanan terbaik — bukan hasil pengukuran atas endpoint kami sendiri.
Sumber data: https://artificialanalysis.ai/