[{"data":1,"prerenderedAt":978},["ShallowReactive",2],{"blog-post-nl-\u002Fblog\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b":3,"blog-posts-sidebar-nl":507},{"id":4,"title":5,"body":6,"categories":481,"date":493,"description":494,"extension":495,"heading":496,"image":497,"meta":498,"navigation":499,"originalUrl":500,"path":501,"seo":502,"slug":503,"stem":504,"updated":505,"__hash__":506},"blogNl\u002Fblog\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b.md","Llama 3.1 405B: sneller starten met Paiton op MI300X",{"type":7,"value":8,"toc":467},"minimark",[9,18,34,41,44,53,59,62,95,101,107,110,130,133,139,142,162,168,277,287,293,296,316,322,423,426,432,435,441,444,464],[10,11,12,13,17],"p",{},"Met ",[14,15,16],"strong",{},"Paiton"," streven we niet alleen naar maximale inferentiesnelheden. We verbeteren de volledige levenscyclus van de deployment van grote taalmodellen (LLM's). Onze nieuwste test combineert AMD's geavanceerde MI300X-GPU's met het omvangrijke Llama-3.1-405B-Instruct-FP8-KV-model en levert baanbrekende resultaten op:",[19,20,21,28],"ol",{},[22,23,24,27],"li",{},[14,25,26],{},"Direct opstarten",": aanzienlijk kortere cold-starttijden voor grootschalige LLM-deployments.",[22,29,30,33],{},[14,31,32],{},"Geavanceerd tensorparallellisme (TP)",": een veel hogere inferentiedoorvoer en lagere latency dankzij gerichte TP-optimalisaties.",[35,36,38],"h3",{"id":37},"visuele-demonstratie-van-de-opstartsnelheid",[14,39,40],{},"Visuele demonstratie van de opstartsnelheid",[10,42,43],{},"In de demonstratie hieronder ziet u hoe Paiton een doorgaans traag opstartproces veel sneller en responsiever maakt. Na het opstarten tonen we ook de eerste inferentierun, zodat u het volledige traject ziet, van de start tot het eerste verzoek.",[10,45,46],{},[47,48,52],"a",{"href":49,"rel":50},"https:\u002F\u002Fwww.youtube.com\u002Fembed\u002FtTgMARD3i_0?feature=oembed",[51],"nofollow","Paiton op Llama 405B versus Aiter",[35,54,56],{"id":55},"benchmarkopstelling-en-methodologie",[14,57,58],{},"Benchmarkopstelling en methodologie",[10,60,61],{},"Voor transparante en reproduceerbare resultaten documenteren we de volledige benchmarkopstelling:",[63,64,65,71,77,83,89],"ul",{},[22,66,67,70],{},[14,68,69],{},"Inferentiebibliotheek",": vLLM v0.9.0 met amd\u002FLlama-3.1-405B-Instruct-FP8-KV",[22,72,73,76],{},[14,74,75],{},"Hardware",": 8 × AMD MI300X GPU's (192 GB totaal HBM3-geheugen)",[22,78,79,82],{},[14,80,81],{},"Softwarestack",": ROCm 6.3.1 op Ubuntu 22.04 (nog steeds met een oudere driverstack)",[22,84,85,88],{},[14,86,87],{},"Batchgrootte",": 32, representatief voor realistische, interactieve AI-workloads",[22,90,91,94],{},[14,92,93],{},"Metingen",": gemiddelden over 10 runs, inclusief opstarttijd, cold-start- en steady-state-TTFT en end-to-end-latency",[10,96,97,100],{},[14,98,99],{},"Belangrijkste resultaat",": Paiton levert consistent stabiele en betrouwbare prestaties en voorkomt de schommelingen die bij andere inferentieoplossingen vaak voorkomen.",[35,102,104],{"id":103},"het-opstarten-van-een-llm-een-cruciaal-knelpunt",[14,105,106],{},"Het opstarten van een LLM: een cruciaal knelpunt",[10,108,109],{},"De deployment van grootschalige LLM's zoals Llama-3.1-405B-Instruct-FP8-KV is een aanzienlijke technische uitdaging. Opstartvertragingen ontstaan vaak door:",[63,111,112,118,124],{},[22,113,114,117],{},[14,115,116],{},"Modelgewichten laden",": enorme hoeveelheden parameters van opslag naar het GPU-geheugen overbrengen.",[22,119,120,123],{},[14,121,122],{},"Grafiekcompilatie",": modeldefinities op hoog niveau transformeren in geoptimaliseerde uitvoeringsplannen.",[22,125,126,129],{},[14,127,128],{},"Eerste warm-up",": voorbereidende inferentieruns uitvoeren om de maximale operationele efficiëntie te bereiken.",[10,131,132],{},"Deze vertragingen hebben een directe impact op de schaalbaarheid, de productiviteit van ontwikkelaars, de operationele kostenefficiëntie en de eindgebruikerservaring.",[35,134,136],{"id":135},"direct-starten-het-strategische-voordeel-van-paiton",[14,137,138],{},"Direct starten: het strategische voordeel van Paiton",[10,140,141],{},"Paiton maakt op unieke wijze gebruik van AMD's GPU-architectuur in combinatie met eigen optimalisaties om de opstarttijden aanzienlijk te verkorten:",[63,143,144,150,156],{},[22,145,146,149],{},[14,147,148],{},"Sterk geoptimaliseerd laden van modelgewichten",": AMD's ultrasnelle HBM3-geheugen benutten met parallelle gegevensoverdracht.",[22,151,152,155],{},[14,153,154],{},"Versnelde grafiekcompilatie",": aangepaste routines die wachttijden bij het compileren volledig elimineren.",[22,157,158,161],{},[14,159,160],{},"Intelligente warm-up",": geavanceerde voorbereidingsstrategieën die onmiddellijk en blijvend snelle responstijden opleveren.",[35,163,165],{"id":164},"opstartvergelijking-llama-31-405b-instruct-fp8-kv",[14,166,167],{},"Opstartvergelijking: Llama-3.1-405B-Instruct-FP8-KV",[169,170,171,198],"table",{},[172,173,174],"thead",{},[175,176,177,183,188,193],"tr",{},[178,179,180],"th",{},[14,181,182],{},"Fase",[178,184,185],{},[14,186,187],{},"Standaard vLLM (sec)",[178,189,190],{},[14,191,192],{},"AMD + Paiton (sec)",[178,194,195],{},[14,196,197],{},"Verbetering",[199,200,201,215,229,242,255],"tbody",{},[175,202,203,206,209,212],{},[204,205,116],"td",{},[204,207,208],{},"71,24",[204,210,211],{},"64,28",[204,213,214],{},"9,7% sneller",[175,216,217,220,223,226],{},[204,218,219],{},"Geheugenprofilering",[204,221,222],{},"69,97",[204,224,225],{},"38,63",[204,227,228],{},"44,8% sneller",[175,230,231,233,236,239],{},[204,232,122],{},[204,234,235],{},"27",[204,237,238],{},"0,00",[204,240,241],{},"100% sneller",[175,243,244,246,249,252],{},[204,245,128],{},[204,247,248],{},"98,37",[204,250,251],{},"40,59",[204,253,254],{},"58,7% sneller",[175,256,257,262,267,272],{},[204,258,259],{},[14,260,261],{},"Totale opstart",[204,263,264],{},[14,265,266],{},"266,58",[204,268,269],{},[14,270,271],{},"143,50",[204,273,274],{},[14,275,276],{},"46,2% sneller",[10,278,279,282,283,286],{},[14,280,281],{},"Impact in de praktijk",": een volledig operationeel LLM met 405 miljard parameters is in minder dan ",[14,284,285],{},"2,4 minuten"," beschikbaar, aanzienlijk sneller dan met traditionele deploymentmethoden.",[35,288,290],{"id":289},"tensorparallellisme-in-detail-het-voordeel-van-paiton",[14,291,292],{},"Tensorparallellisme in detail: het voordeel van Paiton",[10,294,295],{},"Tensorparallellisme is essentieel om multi-GPU-configuraties optimaal te benutten. Voor Paiton hebben we veel geïnvesteerd in sterk geoptimaliseerde kernels en een verbeterde communicatielaag die specifiek is afgestemd op AMD MI300X-GPU's. Onze bedrijfseigen TP-aanpak levert uitzonderlijke prestaties:",[63,297,298,304,310],{},[22,299,300,303],{},[14,301,302],{},"Sterk geoptimaliseerde kernels",": nauwkeurig afgestemd om de rekenefficiëntie van de GPU te maximaliseren en latency binnen een node te verlagen.",[22,305,306,309],{},[14,307,308],{},"Geavanceerde communicatielaag",": aanzienlijk gestroomlijnde communicatie tussen GPU's, waardoor de overhead drastisch wordt verminderd.",[22,311,312,315],{},[14,313,314],{},"Schaalbare architectuur",": consistente, voorspelbare schaling, zelfs bij complexe implementaties met meerdere GPU's.",[35,317,319],{"id":318},"aanhoudende-prestatieverbeteringen-met-paitons-tp",[14,320,321],{},"Aanhoudende prestatieverbeteringen met Paiton's TP",[169,323,324,343],{},[172,325,326],{},[175,327,328,333,338],{},[178,329,330],{},[14,331,332],{},"Metric",[178,334,335],{},[14,336,337],{},"Gemiddelde Paiton",[178,339,340],{},[14,341,342],{},"Verbetering ten opzichte van Aiter",[199,344,345,358,371,384,397,410],{},[175,346,347,350,353],{},[204,348,349],{},"Verzoekdoorvoer (req\u002Fs)",[204,351,352],{},"2,35",[204,354,355],{},[14,356,357],{},"+20,5% sneller",[175,359,360,363,366],{},[204,361,362],{},"Doorvoer van outputtokens (tok\u002Fs)",[204,364,365],{},"462,52",[204,367,368],{},[14,369,370],{},"+13,4% sneller",[175,372,373,376,379],{},[204,374,375],{},"Totale tokendoorvoer (tok\u002Fs)",[204,377,378],{},"1009,91",[204,380,381],{},[14,382,383],{},"+17,3% sneller",[175,385,386,389,392],{},[204,387,388],{},"Gemiddelde TTFT (ms)",[204,390,391],{},"2581,94",[204,393,394],{},[14,395,396],{},"42,8% sneller",[175,398,399,402,405],{},[204,400,401],{},"Gemiddelde E2EL (ms)",[204,403,404],{},"11051.53",[204,406,407],{},[14,408,409],{},"24,3% sneller",[175,411,412,415,418],{},[204,413,414],{},"Gemiddelde ITL (ms)",[204,416,417],{},"43,28",[204,419,420],{},[14,421,422],{},"10,6% sneller",[10,424,425],{},"De combinatie van een snelle deployment en sterke runtimeprestaties maakt Paiton bijzonder geschikt voor enterprise-AI op AMD-infrastructuur.",[35,427,429],{"id":428},"de-toekomst-van-llm-implementatie-vormgeven",[14,430,431],{},"De toekomst van LLM-implementatie vormgeven",[10,433,434],{},"Onze doorbraken met Llama-3.1-405B-Instruct-FP8-KV zorgen voor meer flexibiliteit, efficiëntie en schaalbaarheid bij de deployment van grootschalige AI-workloads.",[35,436,438],{"id":437},"transparantie-onze-toewijding-aan-authenticiteit",[14,439,440],{},"Transparantie: onze toewijding aan authenticiteit",[10,442,443],{},"Bij Paiton zijn we trots op echte, meetbare resultaten. Onze reis is uniek:",[63,445,446,449,452,455,458,461],{},[22,447,448],{},"Lean en onafhankelijk: slechts 3 ingenieurs, geheel zelf gefinancierd, zonder externe investeringen of ondersteuning.",[22,450,451],{},"Zelfredzaamheid: geen financiële, technische of promotionele hulp van AMD of andere externe entiteiten; volledig zelfgefinancierde investering in onze MI300X-hardware.",[22,453,454],{},"Bewezen expertise: we leverden eerder meer dan 250.000 GPU's, duizenden AMD EPYC-CPU's en talloze AI-servers en brachten wereldwijd grootschalige AI-clusters in bedrijf.",[22,456,457],{},"Originele innovatie: In tegenstelling tot veel startups die gebruik maken van open-sourcesoftware of oppervlakkige wrappers, bouwen wij alles, inclusief diepgaande kerneloptimalisaties, vanaf nul.",[22,459,460],{},"Rechtstreekse boodschap aan AMD: hoewel AMD's Aiter-bibliotheek veel waardering verdient, behaalt ons compacte team consistent betere prestaties. Daarmee tonen we een efficiëntie en innovatiekracht die zelfs grotere, gefinancierde teams niet evenaren.",[22,462,463],{},"Resultaten boven hype: we schreeuwen nooit voordat we leveren. In tegenstelling tot anderen die miljoenen aan financiering veiligstellen met beperkte tastbare resultaten, bereiken wij eerst baanbrekende resultaten en laten we die resultaten voor zichzelf spreken.",[10,465,466],{},"Laten we samen opnieuw definiëren wat haalbaar is met de allernieuwste AI-technologie en AMD-hardware.",{"title":468,"searchDepth":469,"depth":469,"links":470},"",2,[471,473,474,475,476,477,478,479,480],{"id":37,"depth":472,"text":40},3,{"id":55,"depth":472,"text":58},{"id":103,"depth":472,"text":106},{"id":135,"depth":472,"text":138},{"id":164,"depth":472,"text":167},{"id":289,"depth":472,"text":292},{"id":318,"depth":472,"text":321},{"id":428,"depth":472,"text":431},{"id":437,"depth":472,"text":440},[482,483,16,484,485,486,487,488,122,489,490,16,491,492],"Alle","Kunstmatige intelligentie","Niet gecategoriseerd","AI-inferentie","AMD MI300X","Koude start","FP8","Llama 3.1 405B","LLM-optimalisatie","Opstartlatentie","Tensor-parallellisme","2025-06-12T20:15:23","Bekijk Paiton-benchmarks voor Llama 3.1 405B op acht AMD MI300X-GPU's, met opstarttijd, tensorparallelisme, throughput en latency.","md","Paiton: veel sneller opstarten en betere prestaties voor Llama-3.1-405B","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fservingscreenshot.webp",{},true,"https:\u002F\u002Feliovp.com\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b\u002F","\u002Fblog\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b",{"title":5,"description":494},"paiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b","blog\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b",null,"Q0URkzrY8rJhD86u6bxRr-0ScUN1yI44vM8kj0hJpPM",[508,522,532,544,555,567,576,589,620,631,653,671,690,709,727,742,754,770,785,797,806,814,816,828,839,850,860,873,883,896,907,917,928,937,949,960,969],{"path":509,"title":510,"description":511,"date":512,"slug":513,"image":514,"originalUrl":515,"categories":516},"\u002Fblog\u002Fpaiton-qwen38-mxfp4-dflash2-r9700","Qwen3.8: 400,7 tok\u002Fs op één R9700 | Paiton","Qwen3.8 op één R9700: 400,7 tok\u002Fs met ROCm 10 en vLLM 0.29, plus publieke 200K\u002F220K-chatprofielen. Benchmarks, beperkingen en startopdrachten.","2026-09-16T07:30:00Z","paiton-qwen38-mxfp4-dflash2-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-qwen38-mxfp4\u002Fupdate-2026-09-19\u002Fhero.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-qwen38-mxfp4-dflash2-r9700",[16,517,518,485,519,520,521],"AMD Radeon","Lokale AI","Inferentie-optimalisatie","Grote taalmodellen","vLLM",{"path":523,"title":524,"description":525,"date":526,"slug":527,"image":528,"originalUrl":529,"categories":530},"\u002Fblog\u002Fpaiton-qwen38-neo-gguf-vllm-r9700","Qwen3.8 GGUF in vLLM: sneller antwoord op één Radeon","Draai de originele NEO CODER MAX GGUF met Paiton in vLLM op een R9700. Bekijk de gemeten responstijden, beeldinvoer en lokale installatie.","2026-09-14T07:30:00Z","paiton-qwen38-neo-gguf-vllm-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-neo-gguf\u002F00-hero-neo-gguf-r9700.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-qwen38-neo-gguf-vllm-r9700",[16,517,518,531,521],"GGUF",{"path":533,"title":534,"description":535,"date":536,"slug":537,"image":538,"originalUrl":539,"categories":540},"\u002Fblog\u002Fpaiton-minimax-h3-radeon-ai-pro-r9700","MiniMax H3 op Radeon: 15 seconden video met stereogeluid","Paiton genereert lokaal 15 seconden MiniMax H3-video met stereogeluid op één Radeon AI PRO R9700 in 5 min 33 s, met 16,7% minder wachttijd dan stock.","2026-09-09T07:30:00Z","paiton-minimax-h3-radeon-ai-pro-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-minimax-h3\u002F00-featured-minimax-h3-r9700.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-minimax-h3-radeon-ai-pro-r9700",[16,517,518,541,542,543],"Videogeneratie","MiniMax H3","ComfyUI",{"path":545,"title":546,"description":547,"date":548,"slug":549,"image":550,"originalUrl":551,"categories":552},"\u002Fblog\u002Fpaiton-flux2-klein-radeon-ai-pro-r9700","Lokale FLUX.2 klein op Radeon AI PRO R9700: sneller beelden genereren met minder VRAM","Paiton genereert FLUX.2 klein-beelden van 1024 × 1024 in 1,054 seconden op een R9700, met 16,2% minder generatietijd en 33,4% minder piekallocatie in Torch.","2026-09-07T09:00:00","paiton-flux2-klein-radeon-ai-pro-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-flux2-klein\u002Ffox-paiton.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-flux2-klein-radeon-ai-pro-r9700",[16,517,518,553,554,543],"Beeldgeneratie","FLUX",{"path":556,"title":557,"description":558,"date":559,"slug":560,"image":561,"originalUrl":562,"categories":563},"\u002Fblog\u002Fpaiton-ornith15-radeon-ai-pro-r9700","Ornith 1.5 haalt 44,6 tok\u002Fs op één Radeon AI PRO R9700","Paiton draait Ornith 1.5 35B A3B op één Radeon AI PRO R9700 met 44,63 outputtokens per seconde, 27% sneller en met 21,3% lagere gemodelleerde kosten.","2026-09-05T09:00:00","paiton-ornith15-radeon-ai-pro-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-ornith15\u002F00-featured-ornith15-r9700.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-ornith15-radeon-ai-pro-r9700",[16,483,517,485,564,565,519,520,521,566],"GPU-prestaties","Inferentielatentie","Kostenefficiëntie",{"path":568,"title":569,"description":570,"date":571,"slug":572,"image":573,"originalUrl":574,"categories":575},"\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700","Paiton: 21% meer Qwen3.8-doorvoer op Radeon AI PRO R9700","Paiton draait AMD's Qwen3.8 27B op één Radeon AI PRO R9700 met 39,77 outputtokens per seconde. Dat levert 21% meer throughput en 17,4% lagere gemodelleerde kosten op.","2026-09-04T09:00:00","paiton-qwen38-radeon-ai-pro-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-r9700\u002F00-featured-paiton-r9700.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700",[16,483,517,485,564,565,519,520,521,566],{"path":577,"title":578,"description":579,"date":580,"slug":581,"image":582,"originalUrl":505,"categories":583},"\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt","Stroomvereisten voor AI-datacenters: de GPU-per-MW-illusie","Waarom verschillen GPU-aantallen per megawatt? Lees hoe PUE, piekbelasting, opslag, netwerken en koeling de inzetbare AI-capaciteit bepalen.","2026-07-27T23:52:00","ai-data-center-power-requirements-gpu-per-megawatt","\u002Fasset\u002Fimages\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt\u002Fgpu-per-megawatt-illusion.webp",[482,584,585,586,587,588],"AI-infrastructuur","Datacenters","ModFlex","HPC","AMD Helios",{"path":590,"title":591,"description":592,"date":593,"slug":594,"image":595,"originalUrl":596,"categories":597},"\u002Fblog\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","Wan2.2-videogeneratie: Paiton op AMD MI355X","Vergelijk Wan2.2-videogeneratie op AMD MI355X met Paiton en NVIDIA B200 via Diffusers. Lees hoe we diffusiemodellen optimaliseren.","2026-06-10T14:04:04","paiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonwan2.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x\u002F",[482,483,16,598,599,600,601,602,603,604,605,606,607,75,608,609,610,611,612,613,16,614,615,616,617,618,619],"14B","AMD","B200","Benchmarks","Blackwell","Compute","Diffusie","Eliovp","Generatieve AI","GPU","Inferentie","Instinct","MI355x","NVIDIA","On-premises","Optimalisatie","Soevereine AI","T2V","Tekst-naar-video","Tuning","Video-generatie","Wan2.2",{"path":621,"title":622,"description":623,"date":624,"slug":625,"image":626,"originalUrl":627,"categories":628},"\u002Fblog\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","ElioVP in De Tijd: chipoptimalisatie en datacenters","Lees hoe De Tijd ElioVP belicht, van de oorsprong in chipoptimalisatie tot het werk aan modulaire datacenters en koeling voor hoge vermogensdichtheid.","2026-02-10T20:48:12","from-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fphysicalnewspaper.webp","https:\u002F\u002Feliovp.com\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure\u002F",[482,483,629,484,599,630,629,611],"Modulaire DC","De Tijd",{"path":632,"title":633,"description":634,"date":635,"slug":636,"image":637,"originalUrl":638,"categories":639},"\u002Fblog\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","AI en privacy: een strategische prioriteit in de Benelux","Privacyrisico's van generatieve AI, vertrouwen, dataopslag en governance. Waarom bedrijven in de Benelux veilige AI strategisch moeten benaderen.","2026-01-29T13:51:11","privacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fheaderimage.webp","https:\u002F\u002Feliovp.com\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit\u002F",[482,483,640,484,641,642,643,644,645,646,647,648,605,649,606,650,651,652],"Trending","AI Act","Antropomorfisme","AVG","Benelux","ChatGPT","Cyberbeveiliging","Databeheer","Gegevensbeveiliging","GDPR","Microsoft Copilot","Privacy","Shadow AI",{"path":654,"title":655,"description":656,"date":657,"slug":658,"image":659,"originalUrl":660,"categories":661},"\u002Fblog\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","Waarom wij itsme niet gebruiken: privacy en soevereiniteit","Waarom ElioVP itsme niet gebruikt: onze afwegingen rond identiteitsmetadata, cloudafhankelijkheid, privacy en datasoevereiniteit.","2025-11-27T09:32:14","itsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontimage.webp","https:\u002F\u002Feliovp.com\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom\u002F",[482,662,663,664,646,665,666,667,649,668,669,670,651],"AWS","Belgian Mobile ID","CLOUD Act","Datasoevereiniteit","Digitale identiteit","eIDAS","itsme","Liberty Global","MyGov.be",{"path":672,"title":673,"description":674,"date":675,"slug":676,"image":677,"originalUrl":678,"categories":679},"\u002Fblog\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025","Praktijkrapport: de realiteit van Agentic AI bouwen in 2025","Praktijklessen over lokale AI-agents in 2025 gaan in op workflowontwerp, observability, modeltraining, hallucinaties en GPU-geheugenlimieten.","2025-11-25T14:03:39","field-report-the-reality-of-building-agentic-ai-in-2025","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffieldreport.webp","https:\u002F\u002Feliovp.com\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025\u002F",[482,483,680,640,681,682,683,684,685,686,687,688,614,689],"Oplossingen","Agentic AI","AI-techniek","AI-strategie","Autonome agenten","Bedrijfs-AI","Lokale LLM","Modelverfijning","AI op locatie","VRAM-optimalisatie",{"path":691,"title":692,"description":693,"date":694,"slug":695,"image":696,"originalUrl":697,"categories":698},"\u002Fblog\u002Fthe-synthetic-unicorn-bubble","De synthetische unicornzeepbel","Een analyse van investeringsrisico’s bij AI-neoclouds: circulaire financiering, infrastructuurclaims, contractvoorwaarden en due diligence.","2025-11-24T19:22:28","the-synthetic-unicorn-bubble","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsyntheticunicorn.webp","https:\u002F\u002Feliovp.com\u002Fthe-synthetic-unicorn-bubble\u002F",[482,483,640,699,700,701,702,703,704,705,706,707,708],"AI Infrastructure","AI Neocloud","Circulaire financiering","GPU Cloud","Beleggingsrisico's","Opstartwaardering","Synthetische bubbel","Technische analyse","Vaporware","Durfkapitaal",{"path":710,"title":711,"description":712,"date":713,"slug":714,"image":715,"originalUrl":716,"categories":717},"\u002Fblog\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","NVIDIA GB300 NVL72: modulair datacenter in vier maanden","Ontdek een modulair datacenterontwerp voor NVIDIA GB300 NVL72, met redundante voeding, hybride koeling en een bouwplanning van vier maanden.","2025-11-20T14:10:19","building-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsuperpodmodflexfrontimage.webp","https:\u002F\u002Feliovp.com\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power\u002F",[482,629,484,718,584,719,720,721,722,723,724,725,726],"150 kW-rack","DLC","Hoge dichtheid","Vloeistofkoeling","Modulair datacenter","NVIDIA Blackwell Ultra","NVIDIA GB300","NVL72","Snelle implementatie",{"path":728,"title":729,"description":730,"date":731,"slug":732,"image":733,"originalUrl":734,"categories":735},"\u002Fblog\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential","CUDA-vertaling versus AMD-gerichte optimalisatie","Waarom CUDA-compatibiliteit niet hetzelfde is als AMD-prestaties: over ROCm, HIP, kerneloptimalisatie en hardwaregerichte afstemming.","2025-11-12T14:48:37","why-cuda-translation-wont-unlock-amds-real-potential","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fchatgpt-image-nov-11-2025-09_16_10-pm-1.webp","https:\u002F\u002Feliovp.com\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential\u002F",[482,483,16,484,486,483,736,488,737,738,739,740,16,741],"CUDA-vertaling","GPU-optimalisatie","High-performance computing","HIP","Kerneltuning","ROCm",{"path":743,"title":744,"description":745,"date":746,"slug":747,"image":748,"originalUrl":749,"categories":750},"\u002Fblog\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference","Paiton: snellere AI-inferentie in uw bestaande stack","Lees hoe Paiton aansluit op bestaande inferentiestacks, met AMD MI300X-benchmarks en vergelijkingen van prestaties per dollar.","2025-11-11T10:31:22","paiton-the-simplest-way-to-supercharge-ai-inference","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton-powaaah.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference\u002F",[482,483,16,485,751,486,566,752,519,740,16,753,521],"AMD Instinct","Hoge throughput","SGLang",{"path":755,"title":756,"description":757,"date":758,"slug":759,"image":760,"originalUrl":761,"categories":762},"\u002Fblog\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","Paiton MoE-benchmarks: MI300X versus H200 en B200","Vergelijk Qwen3-30B-A3B MoE-benchmarks van MI300X met Paiton, H200 en B200: throughput en kosten per miljoen tokens.","2025-09-26T13:36:18","stop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhulkvshulkpaitonwins.webp","https:\u002F\u002Feliovp.com\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens\u002F",[482,483,16,763,486,764,519,765,766,767,768,16,769],"AI-benchmarks","Kosten per token","Mixture of Experts","MoE","NVIDIA B200","NVIDIA H200","Qwen3",{"path":771,"title":772,"description":773,"date":774,"slug":775,"image":776,"originalUrl":777,"categories":778},"\u002Fblog\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","Lokale Agentic AI: van inbox naar actie","Lokale AI-agents zetten e-mails, documenten en beelden om in tickets, rapporten en acties, met modellen op maat van uw gegevens en systemen.","2025-09-16T13:09:00","agentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontfotoblog.webp","https:\u002F\u002Feliovp.com\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en\u002F",[482,483,680,484,681,779,780,781,782,686,688,614,783,784],"Schadedetectie","Documentverwerking","E-mailautomatisering","Factuurextractie","Ticketautomatisering","Workflowautomatisering",{"path":786,"title":787,"description":788,"date":789,"slug":790,"image":791,"originalUrl":792,"categories":793},"\u002Fblog\u002Fmi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","MI300X FP8-benchmarks: GPU-partitionering met Paiton","Bekijk hoe Paiton presteert met Llama 3.1 8B FP8 op gepartitioneerde MI300X-GPU's, vergeleken met NVIDIA H200 en B200.","2025-07-31T13:32:57","mi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fimage-2-1.webp","https:\u002F\u002Feliovp.com\u002Fmi300x-fp8-data%e2%80%91parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach\u002F",[482,483,16,484,794,599,600,795,796,610,611,16,521],"AI","H200","MI300X",{"path":798,"title":799,"description":800,"date":801,"slug":802,"image":803,"originalUrl":804,"categories":805},"\u002Fblog\u002Fapplicable-ai-for-businesses","Toepasbare AI voor bedrijven","Ontdek hoe ElioVP lokale AI voor bedrijfsprocessen bouwt, met modeltraining op maat en automatische schadedetectie voor de logistiek.","2025-07-09T21:35:30","applicable-ai-for-businesses","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fscherm_afbeelding-2025-07-09-om-23.30.17.webp","https:\u002F\u002Feliovp.com\u002Fapplicable-ai-for-businesses\u002F",[482,483,680,681,779,780,781,782,686,688,614,783,784],{"path":807,"title":808,"description":809,"date":810,"slug":811,"image":468,"originalUrl":812,"categories":813},"\u002Fblog\u002Fintroducing-paitons-free-evaluation-models","Maak kennis met de gratis evaluatiemodellen van Paiton","Test Paiton met gratis evaluatiemodellen voor AMD-GPU's. Vergelijk de prestaties voor tekst, beeldanalyse en beeldgeneratie met uw eigen workloads.","2025-07-07T11:26:13","introducing-paitons-free-evaluation-models","https:\u002F\u002Feliovp.com\u002Fintroducing-paitons-free-evaluation-models\u002F",[482,483,16],{"path":501,"title":5,"description":494,"date":493,"slug":503,"image":497,"originalUrl":500,"categories":815},[482,483,16,484,485,486,487,488,122,489,490,16,491,492],{"path":817,"title":818,"description":819,"date":820,"slug":821,"image":822,"originalUrl":823,"categories":824},"\u002Fblog\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x","Paiton FP8 verslaat NVIDIA's H200 op AMD's MI300X","Vergelijk Paiton op AMD MI300X met NVIDIA H200 voor Llama 3.1 70B FP8: throughput, wachttijd tot het eerste token en latency bij diverse batchgroottes.","2025-06-08T19:12:40","paiton-fp8-beats-nvidias-h200-on-amds-mi300x","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fblognewfp8.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x\u002F",[482,483,16,484,486,825,685,606,564,565,520,489,826,827],"Koude startoptimalisatie","Model serving","vLLM-optimalisatie",{"path":829,"title":830,"description":831,"date":832,"slug":833,"image":834,"originalUrl":835,"categories":836},"\u002Fblog\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","MI300X, H200, RX 7900 XTX en n300s: vLLM-benchmarks","Vergelijk MI300X, H200, RX 7900 XTX en Tenstorrent n300s met vLLM: throughput, gemodelleerde tokenkosten en hardwarebeperkingen voor Llama 3 8B.","2025-05-09T14:03:58","mi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisontenstor.webp","https:\u002F\u002Feliovp.com\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm\u002F",[482,483,16,680,484,599,796,611,837,838],"RX7900XTX","tenstorrent",{"path":840,"title":841,"description":842,"date":843,"slug":844,"image":845,"originalUrl":846,"categories":847},"\u002Fblog\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","ClusterP&L: financiële modellen voor GPU-clusters","Ontdek hoe ClusterP&L kosten, rendement en investeringsscenario's voor GPU-clusters modelleert, met risicoanalyses en exporteerbare rapporten.","2025-05-03T10:52:22","clusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisonscenarios.webp","https:\u002F\u002Feliovp.com\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights\u002F",[482,483,629,680,600,795,848,611,849],"MI325X","P&L-calculator",{"path":851,"title":852,"description":853,"date":854,"slug":855,"image":856,"originalUrl":857,"categories":858},"\u002Fblog\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","AMD MI300X versus NVIDIA H200: Qwen3-32B met Paiton","Vergelijk Qwen3-32B-benchmarks op AMD MI300X met Paiton en NVIDIA H200, met resultaten voor throughput, latency en hardwarekosten.","2025-05-02T21:10:30","cranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002F3ac59a73-2466-4422-b7e5-ef2e4a8ca58e.webp","https:\u002F\u002Feliovp.com\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200\u002F",[482,483,16,794,599,795,859,611,16,521],"MI300",{"path":861,"title":862,"description":863,"date":864,"slug":865,"image":866,"originalUrl":867,"categories":868},"\u002Fblog\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","Modulaire datacenters voor NVIDIA NVL: 1 tot 2 MW","Ontdek modulaire datacenterontwerpen voor NVIDIA NVL-systemen, met aandacht voor vermogen, vloeistofkoeling, redundantie en uitrolplanning.","2025-05-02T14:09:59","power-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Feliovp_critical-1mw-pod_rev-2_transparent.webp","https:\u002F\u002Feliovp.com\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw\u002F",[482,629,869,699,720,587,721,722,870,871,725,872],"1-2MW datacenter","NVIDIA Blackwell","NVIDIA NVL","Precisiekoeling",{"path":874,"title":875,"description":876,"date":877,"slug":878,"image":879,"originalUrl":880,"categories":881},"\u002Fblog\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","AI-agents in de medische wereld: AI die DICOM spreekt","Ontdek een lokale AI-agent die DICOM-gegevens opzoekt en bekijk tests van beeldmodellen met geanonimiseerde medische beelden.","2025-04-11T14:45:48","examining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhealthcareblog-1.webp","https:\u002F\u002Feliovp.com\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom\u002F",[482,483,680,484,794,599,882],"Zorg",{"path":884,"title":885,"description":886,"date":887,"slug":888,"image":889,"originalUrl":890,"categories":891},"\u002Fblog\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","Amerikaanse invoerheffingen en AI-leveringszekerheid in 2025","Lees ElioVP's visie uit april 2025 op Amerikaanse invoerheffingen en leveringszekerheid voor AI-servers, HPC-systemen en modulaire datacenters.","2025-04-04T10:01:27","eliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftariffsshipping.webp","https:\u002F\u002Feliovp.com\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs\u002F",[482,640,794,599,892,893,894,895],"Invoer","Taiwan","Invoerheffingen","Trump",{"path":897,"title":898,"description":899,"date":900,"slug":901,"image":902,"originalUrl":903,"categories":904},"\u002Fblog\u002Fwhy-ai-agents-are-the-future","Waarom AI-agenten de toekomst zijn","Ontdek AI-agents voor ERP, CRM, financiën en klantondersteuning, met praktijkvoorbeelden en een traject van procesanalyse tot pilot en uitrol.","2025-03-23T22:06:59","why-ai-agents-are-the-future","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ferp2.jpeg","https:\u002F\u002Feliovp.com\u002Fwhy-ai-agents-are-the-future\u002F",[482,483,680,794,905,906],"AI-agenten","ERP",{"path":908,"title":909,"description":910,"date":911,"slug":912,"image":913,"originalUrl":914,"categories":915},"\u002Fblog\u002Fthe-rise-of-open-source-ai-model-optimization","De opkomst van open-source AI-modeloptimalisatie","Verken trends in opensource-AI-optimalisatie: kwantisatie, mixture-of-experts-modellen, hardwaregerichte afstemming, RAG en edge-AI.","2025-03-22T20:59:23","the-rise-of-open-source-ai-model-optimization","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Friseofopensource.jpeg","https:\u002F\u002Feliovp.com\u002Fthe-rise-of-open-source-ai-model-optimization\u002F",[482,483,640,916,599,607,611],"AI-nieuws",{"path":918,"title":919,"description":920,"date":921,"slug":922,"image":923,"originalUrl":924,"categories":925},"\u002Fblog\u002Fintroducing-our-benchmarking-tool-powered-by-dstack","Maak kennis met onze benchmarktool, gebouwd op dstack","Ontdek onze benchmarktool met dstack: herhaalbare vLLM-tests, automatische parameterreeksen en prestatierapporten voor lokale GPU's en de cloud.","2025-03-20T14:21:59","introducing-our-benchmarking-tool-powered-by-dstack","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fbenchmarktool.jpeg","https:\u002F\u002Feliovp.com\u002Fintroducing-our-benchmarking-tool-powered-by-dstack\u002F",[482,483,16,794,599,926,927,796,16],"benchmark","LLM",{"path":929,"title":930,"description":931,"date":932,"slug":933,"image":934,"originalUrl":935,"categories":936},"\u002Fblog\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","QwQ-32B optimaliseren (door Qwen): AMD MI300X versus NVIDIA H200","Vergelijk throughput en latency van QwQ-32B op AMD MI300X met Paiton en NVIDIA H200, bij kleine batches en meer gelijktijdige aanvragen.","2025-03-19T21:41:44","optimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton4.jpeg","https:\u002F\u002Feliovp.com\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200\u002F",[482,483,16],{"path":938,"title":939,"description":940,"date":941,"slug":942,"image":943,"originalUrl":944,"categories":945},"\u002Fblog\u002Feliovp-featured-on-amd-tech-talk-podcast","Eliovp te gast in de AMD Tech Talk-podcast","Beluister Elio Van Puyvelde en Jim Greene in de AMD Tech Talk-podcast over het ontstaan van ElioVP en de hardware- en softwarediensten voor AI.","2025-03-19T07:53:39","eliovp-featured-on-amd-tech-talk-podcast","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftechtalkjimgreene.jpeg","https:\u002F\u002Feliovp.com\u002Feliovp-featured-on-amd-tech-talk-podcast\u002F",[482,599,946,947,948],"Jim Greene","Podcast","Tech Talk",{"path":950,"title":951,"description":952,"date":953,"slug":954,"image":955,"originalUrl":956,"categories":957},"\u002Fblog\u002Ffurther-optimizing-amd-powered-inference-with-paiton","AMD-inferentie verder optimaliseren met Paiton","Bekijk Paiton-benchmarks voor DeepSeek R1 Distill Llama 8B op AMD MI300X, gericht op throughput en latency bij kleinere batchgroottes.","2025-03-13T06:18:30","further-optimizing-amd-powered-inference-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost3.webp","https:\u002F\u002Feliovp.com\u002Ffurther-optimizing-amd-powered-inference-with-paiton\u002F",[482,483,16,599,958,959,795,796,848,16,521],"DeepSeek","H100",{"path":961,"title":962,"description":963,"date":964,"slug":965,"image":966,"originalUrl":967,"categories":968},"\u002Fblog\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","Paiton-benchmarks: DeepSeek R1 Distill Llama 3.1 8B","Vergelijk standaard- en Paiton-versies van DeepSeek R1 Distill Llama 3.1 8B op AMD MI300X, met benchmarks voor throughput en latency.","2025-01-31T09:11:02","a-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost2.webp","https:\u002F\u002Feliovp.com\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b\u002F",[482,483,16,599,958,959,795,796,848,16,521],{"path":970,"title":971,"description":972,"date":973,"slug":974,"image":975,"originalUrl":976,"categories":977},"\u002Fblog\u002Fai-model-optimization-with-paiton","AI-modeloptimalisatie met Paiton","Lees hoe Paiton modelcompilatie, aangepaste kernels en kernelfusie inzet om AI-inferentie op AMD GPU's te optimaliseren.","2025-01-30T19:53:25","ai-model-optimization-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost1.webp","https:\u002F\u002Feliovp.com\u002Fai-model-optimization-with-paiton\u002F",[482,483,16,599,959,795,796,848,16,521],1789853167710]