| 02_companies/OpenAI | 36 |
| 04_knowledge_base/Reward model | 24 |
| 04_knowledge_base/Pre-training | 19 |
| 04_knowledge_base/Large language model | 17 |
| 04_knowledge_base/KV cache | 15 |
| 02_companies/Anthropic | 14 |
| 04_knowledge_base/Reinforcement learning | 14 |
| 04_knowledge_base/Sequence length | 14 |
| 02_companies/META | 12 |
| 04_knowledge_base/Llama | 12 |
| 04_knowledge_base/GPU | 11 |
| 04_knowledge_base/Anthropic Claude | 10 |
| 04_knowledge_base/Supervised Fine-Tuning | 9 |
| 04_knowledge_base/FLOP | 8 |
| 04_knowledge_base/CPU | 8 |
| 04_knowledge_base/Batch size | 7 |
| 04_knowledge_base/Post-training | 6 |
| 04_knowledge_base/GPT-4 | 6 |
| 04_knowledge_base/Chinchilla Scaling | 5 |
| 04_knowledge_base/Proximal Policy Optimization | 5 |
| 02_companies/DeepSeek | 4 |
| 04_knowledge_base/Hyperscaler | 4 |
| 04_knowledge_base/ChatGPT | 4 |
| 02_companies/NVDA | 4 |
| 04_knowledge_base/Google Gemini | 3 |
| 04_knowledge_base/Qwen | 3 |
| 02_companies/Switch | 3 |
| 04_knowledge_base/Tokenomics | 3 |
| 02_companies/Together AI | 3 |
| 02_companies/Amazon | 3 |
| 04_knowledge_base/IC design verification | 3 |
| 04_knowledge_base/Moore’s Law | 3 |
| 04_knowledge_base/Blackwell | 2 |
| 04_knowledge_base/Transformer architecture | 2 |
| 04_knowledge_base/AlphaGo | 2 |
| 02_companies/GOOG | 2 |
| 02_companies/MSFT | 2 |
| 04_knowledge_base/SWE-Bench | 2 |
| 04_knowledge_base/GB200 NVL72 | 2 |
| 04_knowledge_base/Trn2 | 2 |
| 04_knowledge_base/Direct Preference Optimization | 2 |
| 04_knowledge_base/Reinforcement Learning from Human Feedback | 2 |
| 04_knowledge_base/Monte Carlo Tree Search | 2 |
| 04_knowledge_base/Reinforcement Learning with AI Feedback | 2 |
| 04_knowledge_base/Hopper | 1 |
| 02_companies/Scale AI | 1 |
| 02_companies/Aligned Data Centers | 1 |
| 02_companies/GitHub | 1 |
| 04_knowledge_base/封裝 | 1 |
| 04_knowledge_base/DeepSeek R1 | 1 |
| 04_knowledge_base/HBM | 1 |
| 04_knowledge_base/Fault tolerance | 1 |
| 04_knowledge_base/Dennard scaling | 1 |
| 02_companies/DeepMind | 1 |
| 04_knowledge_base/LLM-as-a-judge | 1 |
| 04_knowledge_base/x86 | 1 |
| 04_knowledge_base/Transistor | 1 |
| 04_knowledge_base/Power Density | 1 |
| 04_knowledge_base/Decode | 1 |
| 04_knowledge_base/Pruning | 1 |
| 04_knowledge_base/Reticle | 1 |
| 04_knowledge_base/Checkpointing | 1 |
| 04_knowledge_base/Scaled Dot Product Attention | 1 |
| 04_knowledge_base/Silent Data Corruption | 1 |
| 04_knowledge_base/Trust Region Policy Optimization | 1 |
| 04_knowledge_base/Model FLOPS Utilization | 1 |
| 04_knowledge_base/Prefill | 1 |