Alle categorieën Paiton (32) Kunstmatige intelligentie (28) AMD (13) vLLM (10) NVIDIA (7) Oplossingen (7) AI (6) AMD Radeon (6) H200 (6) MI300X (6) AI-inferentie (5) AMD MI300X (5) Inferentie-optimalisatie (5) Modulaire DC (5) Trending (5) Grote taalmodellen (4) Lokale AI (4) MI325X (4) Soevereine AI (4) Agentic AI (3) AI op locatie (3) B200 (3) Generatieve AI (3) GPU-prestaties (3) H100 (3) Inferentielatentie (3) Kostenefficiëntie (3) Lokale LLM (3) AI Infrastructure (2) AI-infrastructuur (2) Bedrijfs-AI (2) ComfyUI (2) Cyberbeveiliging (2) DeepSeek (2) Documentverwerking (2) E-mailautomatisering (2) Eliovp (2) Factuurextractie (2) FP8 (2) GDPR (2) GPU (2) Hoge dichtheid (2) HPC (2) Kerneltuning (2) Llama 3.1 405B (2) MI355x (2) Modulair datacenter (2) NVL72 (2) Privacy (2) Schadedetectie (2) Ticketautomatisering (2) Vloeistofkoeling (2) Workflowautomatisering (2) 1-2MW datacenter (1) 14B (1) 150 kW-rack (1) AI Act (1) AI Neocloud (1) AI-agenten (1) AI-benchmarks (1) AI-nieuws (1) AI-strategie (1) AI-techniek (1) AMD Helios (1) AMD Instinct (1) Antropomorfisme (1) Autonome agenten (1) AVG (1) AWS (1) Beeldgeneratie (1) Beleggingsrisico's (1) Belgian Mobile ID (1) benchmark (1) Benchmarks (1) Benelux (1) Blackwell (1) ChatGPT (1) Circulaire financiering (1) CLOUD Act (1) Compute (1) CUDA-vertaling (1) Databeheer (1) Datacenters (1) Datasoevereiniteit (1) De Tijd (1) Diffusie (1) Digitale identiteit (1) DLC (1) Durfkapitaal (1) eIDAS (1) ERP (1) FLUX (1) Gegevensbeveiliging (1) GGUF (1) GPU Cloud (1) GPU-optimalisatie (1) Grafiekcompilatie (1) Hardware (1) High-performance computing (1) HIP (1) Hoge throughput (1) Inferentie (1) Instinct (1) Invoer (1) Invoerheffingen (1) itsme (1) Jim Greene (1) Kosten per token (1) Koude start (1) Koude startoptimalisatie (1) Liberty Global (1) LLM (1) LLM-optimalisatie (1) MI300 (1) Microsoft Copilot (1) MiniMax H3 (1) Mixture of Experts (1) Model serving (1) Modelverfijning (1) ModFlex (1) MoE (1) MyGov.be (1) NVIDIA B200 (1) NVIDIA Blackwell (1) NVIDIA Blackwell Ultra (1) NVIDIA GB300 (1) NVIDIA H200 (1) NVIDIA NVL (1) On-premises (1) Opstartlatentie (1) Opstartwaardering (1) Optimalisatie (1) P&L-calculator (1) Podcast (1) Precisiekoeling (1) Qwen3 (1) ROCm (1) RX7900XTX (1) SGLang (1) Shadow AI (1) Snelle implementatie (1) Synthetische bubbel (1) T2V (1) Taiwan (1) Tech Talk (1) Technische analyse (1) Tekst-naar-video (1) Tensor-parallellisme (1) tenstorrent (1) Trump (1) Tuning (1) Vaporware (1) Video-generatie (1) Videogeneratie (1) vLLM-optimalisatie (1) VRAM-optimalisatie (1) Wan2.2 (1) Zorg (1)
Qwen3.8: 400,7 tok/s op één R9700 | Paiton Qwen3.8 op één R9700: 400,7 tok/s met ROCm 10 en vLLM 0.29, plus publieke 200K/220K-chatprofielen. Benchmarks, beperkingen en startopdrachten.
Door: ElioVP
16 september 2026
Paiton
Qwen3.8 GGUF in vLLM: sneller antwoord op één Radeon Draai de originele NEO CODER MAX GGUF met Paiton in vLLM op een R9700. Bekijk de gemeten responstijden, beeldinvoer en lokale installatie.
Door: ElioVP
14 september 2026
Paiton
MiniMax H3 op Radeon: 15 seconden video met stereogeluid Paiton genereert lokaal 15 seconden MiniMax H3-video met stereogeluid op één Radeon AI PRO R9700 in 5 min 33 s, met 16,7% minder wachttijd dan stock.
Door: ElioVP
9 september 2026
Paiton
Lokale FLUX.2 klein op Radeon AI PRO R9700: sneller beelden genereren met minder VRAM Paiton genereert FLUX.2 klein-beelden van 1024 × 1024 in 1,054 seconden op een R9700, met 16,2% minder generatietijd en 33,4% minder piekallocatie in Torch.
Door: ElioVP
7 september 2026
Paiton
Ornith 1.5 haalt 44,6 tok/s op één Radeon AI PRO R9700 Paiton draait Ornith 1.5 35B A3B op één Radeon AI PRO R9700 met 44,63 outputtokens per seconde, 27% sneller en met 21,3% lagere gemodelleerde kosten.
Door: ElioVP
5 september 2026
Paiton