MeowAPI/ Benchmark
Kembali

Benchmark model

Skor evaluasi independen dari Artificial Analysis untuk setiap model di katalog MeowAPI, disandingkan dengan harga rupiah kami. Angka benchmark tidak kami hitung sendiri — jadi tidak ada insentif buat kami memoles model yang marginnya paling besar.

Data diperbarui 1 jam lalu.

Peringkat 17 modelKecerdasan

  • 1

    Claude Opus 5

    claude-opus-5

    63.1
    56 tok/sTTFT 30.10 sout Rp 24.000
  • 2

    Claude Fable 5

    claude-fable-5

    62.1
    69 tok/sTTFT 43.83 sout Rp 30.000
  • 3

    Kimi K3

    kimi-k3

    59.7
    37 tok/sTTFT 5.00 sout gratis
  • 4

    GLM 5.3

    glm-5.3

    59.5
    59 tok/sTTFT 1.53 sout Rp 15.344
  • 5

    Qwen 3.8 max

    qwen3.8-max

    58.1
    27 tok/sTTFT 1.76 sout Rp 19.309
  • 6

    GLM 5.3 Flash

    glm-5.3-flash

    57.5
    49 tok/sTTFT 1.14 sout Rp 10.640
  • 7

    Claude Opus 4.8

    claude-opus-4-8

    57.3
    TTFT out Rp 31.250
  • 8

    Qwen 3.8 Flash

    qwen-3.8-flash

    55.8
    70 tok/sTTFT 1.56 sout Rp 7.370
  • 9

    GLM 5.2

    glm-5.2

    52.6
    69 tok/sTTFT 1.17 sout Rp 10.235
  • 10

    GPT 5.6 Luna

    gpt-5.6-luna

    52.3
    124 tok/sTTFT 67.98 sout Rp 6.670
  • 11

    Qwen 3.8 27B

    qwen-3.8-27b

    52.0
    46 tok/sTTFT 1.25 sout gratis
  • 12

    DeepSeek V4 Flash 0731

    deepseek-v4-flash-0731

    51.8
    135 tok/sTTFT 1.03 sout gratis
  • 13

    DeepSeek V4 Flash Vision exp

    deepseek-v4-flash

    51.5
    117 tok/sTTFT 0.78 sout Rp 14.950
  • 14

    MiniMax M3

    MiniMax-M3

    45.4
    101 tok/sTTFT 0.94 sout Rp 9.360
  • 15

    DeepSeek V4 Pro

    deepseek-v4-pro

    45.3
    61 tok/sTTFT 0.99 sout Rp 10.355
  • 16

    hy3

    hy3

    42.2
    73 tok/sTTFT 1.78 sout gratis
  • 17

    MiMo V2.5

    mimo-v2.5

    38.0
    67 tok/sTTFT 1.99 sout gratis

Belum ada data benchmark

Model ini belum dipetakan ke entri Artificial Analysis, atau AA belum menguji model tersebut.

  • Agnes 2.5 Flash

Nilai: harga vs kecerdasan

Makin ke kiri-atas makin hemat. Harga campur 3 input : 1 output per 1M token.

40557010rbHarga per 1M token (Rp, skala log)

Paling hemat

GPT 5.6 Luna

Skor 52.3 pada Rp 3.824 / 1M token campur.

Arahkan kursor

Sorot titik atau nama model untuk melihat skor, harga, dan angka nilainya.

Cara membaca angka ini

Kecerdasan, Coding, Matematika adalah index gabungan Artificial Analysis (skala 0-100) dari sekumpulan benchmark seperti MMLU-Pro, GPQA Diamond, Humanity's Last Exam, LiveCodeBench, SciCode, dan AIME. Metodologi lengkapnya ada di halaman metodologi mereka.

Kecepatan dan TTFT diukur Artificial Analysis di penyedia resmi masing-masing model, bukan di jalur yang dipakai MeowAPI — anggap sebagai gambaran kelas model, bukan janji latensi kami. Status upstream kami yang sebenarnya tampil di katalog dashboard.

Pemetaan alias kami ke entri Artificial Analysis dipilih manual, termasuk memilih varian effort untuk model yang punya beberapa tingkat. Varian yang dijalankan penyedia upstream bisa berbeda, jadi skor di sini adalah perkiraan padanan terbaik — bukan hasil pengukuran atas endpoint kami sendiri.

Sumber data: https://artificialanalysis.ai/