Ryzen AI Max+ 395 128GB

83 models / sorted by best_quality

Runs comfortably
GLM-5.3-Flash UD-IQ1_S Unsloth
93.1GB 1000k ctx
FIT Runs comfortably
SPEED 27 tok/s
ⓘ estimated
MEMORY 93/128GB
GLM-5.3-Flash UD-Q2_K_XL Unsloth
109.0GB 1000k ctx
FIT Runs comfortably
SPEED 23 tok/s
ⓘ estimated
MEMORY 109/128GB
Qwen3.8-Flash-Next UD-IQ1_S Unsloth
72.5GB 90k cap
FIT Runs comfortably
SPEED 30 tok/s
ⓘ estimated
MEMORY 73/128GB
Qwen3.8-Flash-Next EXL3_2BPW
62.7GB 247k cap
FIT Runs comfortably
SPEED 37 tok/s
ⓘ estimated
MEMORY 63/128GB
Qwen3.8-Flash-Next EXL3_3BPW
85.0GB 247k cap
FIT Runs comfortably
SPEED 31 tok/s
ⓘ estimated
MEMORY 85/128GB
71.1GB 101k cap
FIT Runs comfortably
SPEED 17 tok/s
ⓘ estimated
MEMORY 71/128GB
37.8GB 163k cap
FIT Runs comfortably
SPEED 26 tok/s
ⓘ estimated
MEMORY 38/128GB
29.2GB 178k cap
FIT Runs comfortably
SPEED 30 tok/s
ⓘ estimated
MEMORY 29/128GB
25.3GB 185k cap
FIT Runs comfortably
SPEED 32 tok/s
ⓘ estimated
MEMORY 25/128GB
21.7GB 192k cap
FIT Runs comfortably
SPEED 35 tok/s
ⓘ estimated
MEMORY 22/128GB
37.0GB 165k cap
FIT Runs comfortably
SPEED 26 tok/s
ⓘ estimated
MEMORY 37/128GB
20.0GB 196k cap
FIT Runs comfortably
SPEED 36 tok/s
ⓘ estimated
MEMORY 20/128GB
16.0GB 183k cap
FIT Runs comfortably
SPEED 8 tok/s
ⓘ estimated
MEMORY 16/128GB
28.0GB 163k cap
FIT Runs comfortably
SPEED 5 tok/s
ⓘ estimated
MEMORY 28/128GB
56.0GB 120k cap
FIT Runs comfortably
SPEED 2 tok/s
ⓘ estimated
MEMORY 56/128GB
68.0GB 30k cap
FIT Runs comfortably
SPEED 10 tok/s
ⓘ estimated
MEMORY 68/128GB
Qwen3.8-27B UD-Q4_K_XL Unsloth
17.6GB 198k cap
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 18/128GB
Qwen3.8-27B UD-Q2_K_XL Unsloth
9.8GB 212k cap
FIT Runs comfortably
SPEED 12 tok/s
ⓘ estimated
MEMORY 10/128GB
Qwen3.8-27B UD-IQ1_S Unsloth
6.2GB 218k cap
FIT Runs comfortably
SPEED 17 tok/s
ⓘ estimated
MEMORY 6/128GB
18.0GB 136k cap
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 18/128GB
Gemma 4 31B Q4_K_M
18.3GB 135k cap
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 18/128GB
61.4GB 81k cap
FIT Runs comfortably
SPEED 2 tok/s
ⓘ estimated
MEMORY 61/128GB
32.6GB 117k cap
FIT Runs comfortably
SPEED 4 tok/s
ⓘ estimated
MEMORY 33/128GB
50.0GB 108k cap
FIT Runs comfortably
SPEED 14 tok/s
ⓘ estimated
MEMORY 50/128GB
25.0GB 144k cap
FIT Runs comfortably
SPEED 21 tok/s
ⓘ estimated
MEMORY 25/128GB
13.0GB 159k cap
FIT Runs comfortably
SPEED 29 tok/s
ⓘ estimated
MEMORY 13/128GB
28.0GB 128k ctx
FIT Runs comfortably
SPEED 5 tok/s
ⓘ estimated
MEMORY 28/128GB
Qwen3.6 27B Q4_K_M
16.5GB 128k ctx
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 17/128GB
Qwen3 32B Q4_K_M
20.0GB 128k ctx
FIT Runs comfortably
SPEED 6 tok/s
ⓘ estimated
MEMORY 20/128GB
Qwen3 32B Q5_K_M
24.5GB 128k ctx
FIT Runs comfortably
SPEED 5 tok/s
ⓘ estimated
MEMORY 25/128GB
Qwen3 32B Q6_K
28.5GB 128k ctx
FIT Runs comfortably
SPEED 4 tok/s
ⓘ estimated
MEMORY 29/128GB
Qwen3 32B Q8_0
34.0GB 128k ctx
FIT Runs comfortably
SPEED 4 tok/s
ⓘ estimated
MEMORY 34/128GB
77.0GB 12k cap
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 77/128GB
18.4GB 218k cap
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 18/128GB
Ornith-1.5-9B Q4_K_M
5.8GB 244k cap
FIT Runs comfortably
SPEED 18 tok/s
ⓘ estimated
MEMORY 6/128GB
32.0GB 208k cap
FIT Runs comfortably
SPEED 26 tok/s
ⓘ estimated
MEMORY 32/128GB
58.0GB 146k cap
FIT Runs comfortably
SPEED 17 tok/s
ⓘ estimated
MEMORY 58/128GB
Ornith-1.5-9B Q5_K_M
6.6GB 242k cap
FIT Runs comfortably
SPEED 16 tok/s
ⓘ estimated
MEMORY 7/128GB
7.6GB 240k cap
FIT Runs comfortably
SPEED 15 tok/s
ⓘ estimated
MEMORY 8/128GB
60.0GB 142k cap
FIT Runs comfortably
SPEED 16 tok/s
ⓘ estimated
MEMORY 60/128GB
9.8GB 236k cap
FIT Runs comfortably
SPEED 12 tok/s
ⓘ estimated
MEMORY 10/128GB
Qwen3 30B A3B Q4_K_M
15.5GB 128k ctx
FIT Runs comfortably
SPEED 37 tok/s
ⓘ estimated
MEMORY 16/128GB
31.0GB 128k ctx
FIT Runs comfortably
SPEED 27 tok/s
ⓘ estimated
MEMORY 31/128GB
Phi-4 14B Q8_0
15.0GB 16k ctx
FIT Runs comfortably
SPEED 8 tok/s
ⓘ estimated
MEMORY 15/128GB
Phi-4 14B FP16
29.0GB 16k ctx
FIT Runs comfortably
SPEED 5 tok/s
ⓘ estimated
MEMORY 29/128GB
Phi-4 14B Q4_K_M
8.5GB 16k ctx
FIT Runs comfortably
SPEED 14 tok/s
ⓘ estimated
MEMORY 9/128GB
62.4GB 53k cap
FIT Runs comfortably
SPEED 10 tok/s
ⓘ estimated
MEMORY 62/128GB
20.1GB 94k cap
FIT Runs comfortably
SPEED 18 tok/s
ⓘ estimated
MEMORY 20/128GB
30.0GB 65k cap
FIT Runs comfortably
SPEED 4 tok/s
ⓘ estimated
MEMORY 30/128GB
21.5GB 71k cap
FIT Runs comfortably
SPEED 5 tok/s
ⓘ estimated
MEMORY 22/128GB
42.0GB 57k cap
FIT Runs comfortably
SPEED 3 tok/s
ⓘ estimated
MEMORY 42/128GB
74.0GB 36k cap
FIT Runs comfortably
SPEED 2 tok/s
ⓘ estimated
MEMORY 74/128GB
Qwen3 14B Q8_0
15.0GB 128k ctx
FIT Runs comfortably
SPEED 8 tok/s
ⓘ estimated
MEMORY 15/128GB
Qwen3 14B Q4_K_M
9.0GB 128k ctx
FIT Runs comfortably
SPEED 13 tok/s
ⓘ estimated
MEMORY 9/128GB
Gemma 4 12B Q4_K_M
7.2GB 128k ctx
FIT Runs comfortably
SPEED 16 tok/s
ⓘ estimated
MEMORY 7/128GB
13.0GB 128k ctx
FIT Runs comfortably
SPEED 9 tok/s
ⓘ estimated
MEMORY 13/128GB
28.0GB 128k ctx
FIT Runs comfortably
SPEED 5 tok/s
ⓘ estimated
MEMORY 28/128GB
Gemma 3 27B Q4_K_M
17.0GB 128k ctx
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 17/128GB
Qwen3 8B Q8_0
8.5GB 128k ctx
FIT Runs comfortably
SPEED 13 tok/s
ⓘ estimated
MEMORY 9/128GB
Qwen3 8B Q4_K_M
5.2GB 128k ctx
FIT Runs comfortably
SPEED 19 tok/s
ⓘ estimated
MEMORY 5/128GB
Gemma 3 12B Q4_K_M
7.5GB 128k ctx
FIT Runs comfortably
SPEED 15 tok/s
ⓘ estimated
MEMORY 8/128GB
13.5GB 128k ctx
FIT Runs comfortably
SPEED 9 tok/s
ⓘ estimated
MEMORY 14/128GB
19.0GB 32k ctx
FIT Runs comfortably
SPEED 19 tok/s
ⓘ estimated
MEMORY 19/128GB
26.5GB 32k ctx
FIT Runs comfortably
SPEED 15 tok/s
ⓘ estimated
MEMORY 27/128GB
13.2GB 128k ctx
FIT Runs comfortably
SPEED 9 tok/s
ⓘ estimated
MEMORY 13/128GB
7.3GB 128k ctx
FIT Runs comfortably
SPEED 16 tok/s
ⓘ estimated
MEMORY 7/128GB
Qwen3 4B Q4_K_M
2.6GB 32k ctx
FIT Runs comfortably
SPEED 38 tok/s
ⓘ estimated
MEMORY 3/128GB
Phi-4 Mini Q4_K_M
2.5GB 128k ctx
FIT Runs comfortably
SPEED 42 tok/s
ⓘ estimated
MEMORY 3/128GB
Phi-4 Mini Q8_0
4.1GB 128k ctx
FIT Runs comfortably
SPEED 29 tok/s
ⓘ estimated
MEMORY 4/128GB
4.5GB 128k ctx
FIT Runs comfortably
SPEED 22 tok/s
ⓘ estimated
MEMORY 5/128GB
8.0GB 128k ctx
FIT Runs comfortably
SPEED 14 tok/s
ⓘ estimated
MEMORY 8/128GB
16.0GB 128k ctx
FIT Runs comfortably
SPEED 8 tok/s
ⓘ estimated
MEMORY 16/128GB
Gemma 3 4B Q8_0
5.0GB 128k ctx
FIT Runs comfortably
SPEED 23 tok/s
ⓘ estimated
MEMORY 5/128GB
Gemma 3 4B Q4_K_M
3.0GB 128k ctx
FIT Runs comfortably
SPEED 33 tok/s
ⓘ estimated
MEMORY 3/128GB
3.5GB 128k ctx
FIT Runs comfortably
SPEED 31 tok/s
ⓘ estimated
MEMORY 4/128GB
2.0GB 128k ctx
FIT Runs comfortably
SPEED 47 tok/s
ⓘ estimated
MEMORY 2/128GB
60.0GB 53k cap
FIT Runs comfortably
SPEED 2 tok/s
ⓘ estimated
MEMORY 60/128GB
33.0GB 128k ctx
FIT Runs comfortably
SPEED 4 tok/s
ⓘ estimated
MEMORY 33/128GB
18.0GB 128k ctx
FIT Runs comfortably
SPEED 7 tok/s
ⓘ estimated
MEMORY 18/128GB
MiniMax M2.7 UD-IQ1_M Unsloth
60.7GB 200k ctx
FIT Runs comfortably
SPEED 2 tok/s
ⓘ estimated
MEMORY 61/128GB
MiniMax M2.7 UD-Q2_K_XL Unsloth
75.3GB 200k ctx
FIT Runs comfortably
SPEED 2 tok/s
ⓘ estimated
MEMORY 75/128GB
Runs tight
GLM-5.3-Flash UD-IQ3_XXS Unsloth
120.0GB ctx headroom ~0
FIT Runs tight
SPEED 21 tok/s
ⓘ estimated
MEMORY 120/128GB
125.0GB 1k cap
FIT Runs tight
SPEED 7 tok/s
ⓘ estimated
MEMORY 125/128GB

Run GLM-5.3-Flash in the cloud

No hardware? Host it - per-token API or flat subscription

DeepInfra per-token
$0.18
/MONTH
Novita per-token
$0.2
/MONTH
StreamLake per-token
$0.21
/MONTH
GMICloud per-token
$0.22
/MONTH
Decart per-token
$0.23
/MONTH
Relace per-token
$0.23
/MONTH
Near AI per-token
$0.25
/MONTH
Phala per-token
$0.27
/MONTH
Sail Research per-token
$0.27
/MONTH
InferenceNet per-token
$0.28
/MONTH
Wafer per-token
$0.3
/MONTH
OpenInference per-token
$0.3
/MONTH
Z.AI per-token
$0.36
/MONTH
Venice per-token
$0.36
/MONTH
Friendli per-token
$0.36
/MONTH
AtlasCloud per-token
$0.36
/MONTH
Modal per-token
Serverless GPU inference platform. Serves open-weight models including reason...
$0.36
/MONTH
CoreWeave per-token
$0.36
/MONTH
Crusoe per-token
$0.36
/MONTH
BaseTen per-token
$0.36
/MONTH
Z.ai per-token
Official API and platform for Zhipu AI's open-source GLM models. GLM-5.2 avai...
pricing may be outdated
$0.36
/MONTH
Reka per-token
$0.36
/MONTH
Together per-token
$0.36
/MONTH
DigitalOcean per-token
$0.36
/MONTH
SiliconFlow per-token
$0.36
/MONTH
Morph per-token
$0.38
/MONTH
Parasail per-token
$0.45
/MONTH
DekaLLM per-token
$0.48
/MONTH
Inceptron per-token
$0.49
/MONTH
Fireworks per-token
$0.54
/MONTH
Cloudflare per-token
$0.72
/MONTH
Z.ai Coding Plan Lite subscription
Official API and platform for Zhipu AI's open-source GLM models. GLM-5.2 avai...
$10.0
/MONTH
OpenCode Go Go ($5 first month) subscription
Low-cost subscription for open coding models. $5 first month, then $10/month....
$10.0
/MONTH
Z.ai Coding Plan Pro subscription
Official API and platform for Zhipu AI's open-source GLM models. GLM-5.2 avai...
$30.0
/MONTH
Z.ai Coding Plan Max subscription
Official API and platform for Zhipu AI's open-source GLM models. GLM-5.2 avai...
$80.0
/MONTH

Coding alternatives

Hosted coding assistants for comparison - per seat

Cursor Hobby
AI-first code editor. Uses frontier models (GPT-4, Claude). $20/user Business...
$0.0
/MONTH
GitHub Copilot Individual
AI coding assistant by GitHub. GPT-4o and Claude-based completions. $19/seat ...
$10.0
/MONTH
GitHub Copilot Business
AI coding assistant by GitHub. GPT-4o and Claude-based completions. $19/seat ...
$19.0
/MONTH
Cursor Pro
AI-first code editor. Uses frontier models (GPT-4, Claude). $20/user Business...
$20.0
/MONTH
GitHub Copilot Enterprise
AI coding assistant by GitHub. GPT-4o and Claude-based completions. $19/seat ...
$39.0
/MONTH
Cursor Business
AI-first code editor. Uses frontier models (GPT-4, Claude). $20/user Business...
$40.0
/MONTH

Per-token monthly figures are estimates at typical usage. Prices verified periodically - always confirm current pricing on the provider's website.

Sign in with GitHub to save this rig and get weekly model updates

Sign in with GitHub