2025-10-09_inferencemax-open-source-inference

Canonical Target Counts

TargetOccurrences
04_knowledge_base/GPU89
04_knowledge_base/InferenceX57
02_companies/NVDA48
02_companies/AMD47
04_knowledge_base/vLLM46
04_knowledge_base/SGLang42
04_knowledge_base/NVIDIA B20041
04_knowledge_base/MI355X36
04_knowledge_base/Large language model25
04_knowledge_base/Blackwell20
04_knowledge_base/GB200 NVL7219
04_knowledge_base/H20018
02_companies/DeepSeek17
04_knowledge_base/NVIDIA Collective Communications Library (NCCL)17
04_knowledge_base/MI325X15
04_knowledge_base/FP414
04_knowledge_base/GPT-OSS13
04_knowledge_base/H10011
04_knowledge_base/DeepSeek R111
04_knowledge_base/FP811
04_knowledge_base/MI300X11
02_companies/GitHub11
04_knowledge_base/Hopper9
04_knowledge_base/ROCm9
04_knowledge_base/Expert Parallelism7
04_knowledge_base/Mixture of Experts7
04_knowledge_base/Llama7
04_knowledge_base/CUDA7
04_knowledge_base/PTX6
04_knowledge_base/Prefill6
04_knowledge_base/Disaggregated serving6
04_knowledge_base/MI3555
04_knowledge_base/NVIDIA SASS Assembly5
04_knowledge_base/AMD AITER5
04_knowledge_base/PyTorch5
04_knowledge_base/Trainium4
02_companies/MSFT4
02_companies/OpenAI4
04_knowledge_base/MI3004
04_knowledge_base/TPU4
04_knowledge_base/CDNA34
04_knowledge_base/Software Stack4
04_knowledge_base/SM1004
04_knowledge_base/CDNA44
04_knowledge_base/Decode4
04_knowledge_base/Microsoft Azure3
02_companies/Crusoe3
04_knowledge_base/Hyperscaler3
02_companies/CRWV3
02_companies/Nebius3
04_knowledge_base/Prefix Caching3
04_knowledge_base/HGX3
02_companies/Together AI3
03_industries/Neocloud產業3
02_companies/Tensorwave3
02_companies/GOOG3
02_companies/ORCL3
04_knowledge_base/Disaggregated prefill3
04_knowledge_base/Multi-Token Prediction3
04_knowledge_base/CI-CD3
04_knowledge_base/GB2003
04_knowledge_base/Arithmetic intensity2
04_knowledge_base/InfiniBand2
04_knowledge_base/MI3252
02_companies/Vultr2
04_knowledge_base/Grace Blackwell2
04_knowledge_base/KV cache2
04_knowledge_base/Blackwell Ultra2
02_companies/SMCI2
04_knowledge_base/Tensor Parallelism2
04_knowledge_base/CPU2
04_knowledge_base/DeepEP2
04_knowledge_base/Data Parallelism2
04_knowledge_base/Model parallelism2
04_knowledge_base/Expected Average Power2
04_knowledge_base/Ethernet1
02_companies/Arista1
02_companies/Inspire Robots1
04_knowledge_base/Kubernetes1
04_knowledge_base/AI factory1
04_knowledge_base/SLA1
04_knowledge_base/Goodput1
02_companies/xAI1
04_knowledge_base/AWS1
02_companies/Scale AI1
04_knowledge_base/NVIDIA Dynamo1
04_knowledge_base/AI Accelerator1
04_knowledge_base/WhiteBox Ethernet1
04_knowledge_base/NVLink1
02_companies/Aligned Data Centers1
04_knowledge_base/Multi-head Latent Attention1
04_knowledge_base/Flash memory1
04_knowledge_base/TFLOPS1
04_knowledge_base/MXFP41
04_knowledge_base/Chiller1
04_knowledge_base/NVIDIA B3001
04_knowledge_base/XPU1
04_knowledge_base/GB300 NVL721
04_knowledge_base/Thermal Design Power1
04_knowledge_base/AMDGPU1
04_knowledge_base/Inference engine1
04_knowledge_base/Sequence length1
04_knowledge_base/Control Plane1
04_knowledge_base/Bare Metal1
04_knowledge_base/Batch size1