GLM 5.3 Prime
Z.ai·Starter ke atas
01Ringkasan
GLM 5.3 Prime dari Z.ai di YupiAI: konteks 1jt token, menerima text, tool calling native.
Cocok untuk
- Membaca basis kode atau dokumen panjang sekali jalan, dengan konteks 1jt token.
- Keluaran panjang tanpa dipenggal, dengan batas 131rb token per respons.
- Percakapan panjang yang mengulang konteks, dengan cache hit terukur 89%.
Perlu diperhatikan
- Tarif output jauh di atas input (8,7994 berbanding 0,8169). Jawaban panjang yang menentukan biaya, bukan prompt panjang.
- Belum tercakup benchmark Artificial Analysis, jadi tidak punya peringkat di katalog ini.
02Tarif
71% di bawah terdaftar| Kelas token | Terdaftar | Efektif |
|---|---|---|
| Input | 2,80 | 0,8169 |
| Tulis cache | Belum ada | · |
| Baca cache | 0,56 | · |
| Output | 8,80 | 8,7994 |
multiplier · kredit per 1 token·cache hit 89%
TerdaftarEfektif
03Provider
| Nama | Trafik | Cache hit | Input | Output |
|---|---|---|---|---|
| Alibaba Cloud Int. | 100% | 89% | 0,8169 | 8,7994 |
04Spesifikasi
KemampuanChat teks
Konteks1jt token
Output maks131rb token
TokenizerOther
Modalitastext
Tool callingNative
AksesStarter ke atas
Upstreamglm-5.3-prime
Kepadatan4 karakter / token
05Konfigurasi
~/.codex/config.toml
model = "flex-glm-5.3-prime"
model_provider = "yupiai"
[model_providers.yupiai]
name = "YupiAI Gateway"
base_url = "https://gateway.euphy.cloud/v1"
env_key = "YUPIAI_API_KEY"