2023-07-10_gpt-4-architecture-infrastructure

Canonical Target Counts

TargetOccurrences
02_companies/OpenAI35
04_knowledge_base/GPT-427
04_knowledge_base/Batch size19
04_knowledge_base/Large language model14
04_knowledge_base/KV cache13
04_knowledge_base/Speculative Decoding11
04_knowledge_base/H10010
04_knowledge_base/GPU9
04_knowledge_base/Mixture of Experts8
02_companies/GOOG7
02_companies/NVDA6
02_companies/META5
04_knowledge_base/Pre-training4
04_knowledge_base/GPT-34
04_knowledge_base/A1004
04_knowledge_base/Pipeline parallelism3
04_knowledge_base/FLOP3
04_knowledge_base/Encoder3
04_knowledge_base/Decode3
04_knowledge_base/Chinchilla Scaling3
04_knowledge_base/Tensor Parallelism2
04_knowledge_base/Arithmetic intensity2
02_companies/ORCL2
04_knowledge_base/Fully Sharded Data Parallel2
04_knowledge_base/FP82
04_knowledge_base/Multi-Query Attention2
02_companies/Amazon2
04_knowledge_base/Prefill2
04_knowledge_base/FP162
04_knowledge_base/Head Node2
02_companies/Anthropic1
02_companies/DeepMind1
02_companies/ByteDance1
04_knowledge_base/Transformer architecture1
02_companies/Together AI1
04_knowledge_base/MI3001
04_knowledge_base/1.6T1
02_companies/Scale AI1
04_knowledge_base/SpaceX Falcon launch vehicles1
02_companies/AMD1
02_companies/7735.T1
04_knowledge_base/NVLink1
02_companies/MSFT1
04_knowledge_base/Chip-to-Chip Interconnect1
04_knowledge_base/800G1
02_companies/Baidu1
04_knowledge_base/Conditional Routing1
04_knowledge_base/All-Reduce1
04_knowledge_base/Data Parallelism1
04_knowledge_base/Token-to-token latency1
04_knowledge_base/Sequence length1
04_knowledge_base/200G1
04_knowledge_base/400G1