2024-12-11_scaling-laws-o1-pro-architecture-reasoning-training-infrastructure-orion-and-claude-3-5-opus-failures

Canonical Target Counts

TargetOccurrences
02_companies/OpenAI36
04_knowledge_base/Reward model24
04_knowledge_base/Pre-training19
04_knowledge_base/Large language model17
04_knowledge_base/KV cache15
02_companies/Anthropic14
04_knowledge_base/Reinforcement learning14
04_knowledge_base/Sequence length14
02_companies/META12
04_knowledge_base/Llama12
04_knowledge_base/GPU11
04_knowledge_base/Anthropic Claude10
04_knowledge_base/Supervised Fine-Tuning9
04_knowledge_base/FLOP8
04_knowledge_base/CPU8
04_knowledge_base/Batch size7
04_knowledge_base/Post-training6
04_knowledge_base/GPT-46
04_knowledge_base/Chinchilla Scaling5
04_knowledge_base/Proximal Policy Optimization5
02_companies/DeepSeek4
04_knowledge_base/Hyperscaler4
04_knowledge_base/ChatGPT4
02_companies/NVDA4
04_knowledge_base/Google Gemini3
04_knowledge_base/Qwen3
02_companies/Switch3
04_knowledge_base/Tokenomics3
02_companies/Together AI3
02_companies/Amazon3
04_knowledge_base/IC design verification3
04_knowledge_base/Moore’s Law3
04_knowledge_base/Blackwell2
04_knowledge_base/Transformer architecture2
04_knowledge_base/AlphaGo2
02_companies/GOOG2
02_companies/MSFT2
04_knowledge_base/SWE-Bench2
04_knowledge_base/GB200 NVL722
04_knowledge_base/Trn22
04_knowledge_base/Direct Preference Optimization2
04_knowledge_base/Reinforcement Learning from Human Feedback2
04_knowledge_base/Monte Carlo Tree Search2
04_knowledge_base/Reinforcement Learning with AI Feedback2
04_knowledge_base/Hopper1
02_companies/Scale AI1
02_companies/Aligned Data Centers1
02_companies/GitHub1
04_knowledge_base/封裝1
04_knowledge_base/DeepSeek R11
04_knowledge_base/HBM1
04_knowledge_base/Fault tolerance1
04_knowledge_base/Dennard scaling1
02_companies/DeepMind1
04_knowledge_base/LLM-as-a-judge1
04_knowledge_base/x861
04_knowledge_base/Transistor1
04_knowledge_base/Power Density1
04_knowledge_base/Decode1
04_knowledge_base/Pruning1
04_knowledge_base/Reticle1
04_knowledge_base/Checkpointing1
04_knowledge_base/Scaled Dot Product Attention1
04_knowledge_base/Silent Data Corruption1
04_knowledge_base/Trust Region Policy Optimization1
04_knowledge_base/Model FLOPS Utilization1
04_knowledge_base/Prefill1