Roadmap

🖥️ AI Infrastructure Mind Map

32 knowledge points · click a node for its structured card

Pipeline view: stages left→right = model lifecycle (data → training → inference → optimization → MLOps → security → agentic). Dashed = cross-module.

🗄️Data & Storage Stage🏋️Training Infra StageInference Serving Stage🔧Inference Optimization Stage🛠️MLOps & Engineering Stage🛡️Security & Governance Stage🤖Agentic Infra StageDataset Management & LineageDataset Management & LineageClick for definition & exam pointsModel Weight & Checkpoint StorageModel Weight & Checkpoint StorageClick for definition & exam pointsData Loading & IOData Loading & IOClick for definition & exam pointsData Pipelines & StreamingData Pipelines & StreamingClick for definition & exam pointsGPU Hardware & HBMGPU Hardware & HBMClick for definition & exam pointsCollective Comm & NVLinkCollective Comm & NVLinkClick for definition & exam points4D Parallelism DP/TP/PP/SP4D Parallelism DP/TP/PP/SPClick for definition & exam pointsMegatron 3D & Pipeline BubbleMegatron 3D & Pipeline BubbleClick for definition & exam pointsZeRO-1/2/3 & OffloadZeRO-1/2/3 & OffloadClick for definition & exam pointsActivation Memory EstimationActivation Memory EstimationClick for definition & exam pointsCluster Scheduling Ray/K8sCluster Scheduling Ray/K8sClick for definition & exam pointsTraining Frameworks & ProfilingTraining Frameworks & ProfilingClick for definition & exam pointsCheckpointing & RecoveryCheckpointing & RecoveryClick for definition & exam pointsKV Cache & PagedAttentionKV Cache & PagedAttentionClick for definition & exam pointsSpeculative DecodingSpeculative DecodingClick for definition & exam pointsInference Engines vLLM/SGLangInference Engines vLLM/SGLangClick for definition & exam pointsContinuous BatchingContinuous BatchingClick for definition & exam pointsPrompt Caching & RadixAttentionPrompt Caching & RadixAttentionClick for definition & exam pointsHigh-Concurrency ServingHigh-Concurrency ServingClick for definition & exam pointsInference Quantization (cross-module)Inference Quantization (cross-module)Click for definition & exam pointsFlashAttention Kernel & Online SoftmaxFlashAttention Kernel & Online SoftmaxClick for definition & exam pointsKV Cache OptimizationKV Cache OptimizationClick for definition & exam pointsPrefill/Decode DisaggregationPrefill/Decode DisaggregationClick for definition & exam pointsAutoscaling & CostAutoscaling & CostClick for definition & exam pointsMLOps PipelineMLOps PipelineClick for definition & exam pointsModel Testing & GatesModel Testing & GatesClick for definition & exam pointsMonitoring & ObservabilityMonitoring & ObservabilityClick for definition & exam pointsSecurity & PrivacySecurity & PrivacyClick for definition & exam pointsModel Risk GovernanceModel Risk GovernanceClick for definition & exam pointsAgent Runtime (cross-module)Agent Runtime (cross-module)Click for definition & exam pointsContext & Memory ServicesContext & Memory ServicesClick for definition & exam pointsRL Training/Serving (cross-module)RL Training/Serving (cross-module)Click for definition & exam points
100%
🖱️ Drag to pan · Hover for dependency chain · Click for card
Dataset Management & LineageData Pipelines & StreamingGPU Hardware & HBMCollective Comm & NVLinkCluster Scheduling Ray/K8sKV Cache & PagedAttentionSpeculative DecodingInference Quantization (cross-module)Security & PrivacyAgent Runtime (cross-module)RL Training/Serving (cross-module)