Nieuwste benchmark: Radeon AI PRO R9700
Eén Radeon. Gewoon vLLM. Meer mogelijkheden.
Qwen3.8 levert 400,7 uitvoertokens per seconde in totaal op één R9700 van 32 GB met ROCm 10 en vLLM 0.29. De run met de 65K-preset omvatte 290 verzoeken inclusief warmups, met thinking en prefix caching uitgeschakeld. Dit is een aparte workload, geen gecontroleerde snelheidsvergelijking met de eerdere release.
Benchmark en demo


