<?xml version="1.0" encoding="UTF-8"?><urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9" xmlns:news="http://www.google.com/schemas/sitemap-news/0.9" xmlns:xhtml="http://www.w3.org/1999/xhtml" xmlns:image="http://www.google.com/schemas/sitemap-image/1.1" xmlns:video="http://www.google.com/schemas/sitemap-video/1.1"><url><loc>https://ai-infra-wiki.pages.dev/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/compilers-kernels/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/compilers-kernels/01-programming/cuda-model/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/compilers-kernels/01-programming/torch-compile-xla/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/compilers-kernels/01-programming/triton/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/compilers-kernels/02-kernels/flash-attention/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/compilers-kernels/02-kernels/gemm-and-libraries/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/compilers-kernels/02-kernels/mixed-precision-fp8/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/01-parallelism/data-parallel-zero/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/01-parallelism/expert-parallel/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/01-parallelism/pipeline-parallel/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/01-parallelism/sequence-context-parallel/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/01-parallelism/tensor-parallel/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/02-practice/activation-memory/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/02-practice/fault-tolerance-training/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/distributed-training/02-practice/hybrid-config/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/efficiency-cost/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/efficiency-cost/01-utilization/cluster-utilization/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/efficiency-cost/01-utilization/mfu/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/efficiency-cost/02-cost/energy-pue/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/efficiency-cost/02-cost/inference-cost/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/efficiency-cost/02-cost/training-cost/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/all-reduce/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/gang-scheduling/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/kv-cache/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/mfu/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/pipeline-bubble/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/pue/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/roofline/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/straggler/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/ttft-tpot/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/glossary/zero/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/hardware/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/hardware/01-accelerators/accelerator-landscape/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/hardware/01-accelerators/gpu-architecture/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/hardware/01-accelerators/memory-hierarchy/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/hardware/02-node/intra-node-interconnect/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/hardware/02-node/power-cooling/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/inference-serving/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/inference-serving/01-memory/continuous-batching/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/inference-serving/01-memory/kv-cache/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/inference-serving/02-optimization/disaggregated-serving/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/inference-serving/02-optimization/quantization/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/inference-serving/02-optimization/speculative-decoding/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/inference-serving/03-frameworks/serving-frameworks/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/networking/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/networking/01-fabric/rdma/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/networking/01-fabric/topology/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/networking/02-collectives/congestion-failures/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/networking/02-collectives/nccl-algorithms/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/observability-reliability/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/observability-reliability/01-observability/profiling/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/observability-reliability/01-observability/slo-capacity/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/observability-reliability/02-failures/recovery/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/observability-reliability/02-failures/stragglers/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/overview/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/overview/01-landscape/stack-layers/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/overview/01-landscape/workload-characteristics/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/overview/02-scale/metrics/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/overview/02-scale/scaling-laws/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/platform-mlops/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/platform-mlops/01-lifecycle/experiment-tracking/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/platform-mlops/01-lifecycle/model-registry-release/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/platform-mlops/02-quality/eval-infra/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/platform-mlops/02-quality/model-cicd/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/references/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/references/01-papers/papers-inference-kernels/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/references/01-papers/papers-systems/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/references/01-papers/papers-training/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/references/02-books-blogs/blogs/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/references/02-books-blogs/books/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/references/02-books-blogs/open-source/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/scheduling-cluster/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/scheduling-cluster/01-systems/kubernetes-gpu/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/scheduling-cluster/01-systems/slurm-ray/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/scheduling-cluster/02-policy/gang-preemption/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/scheduling-cluster/02-policy/multi-tenancy-quota/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/security-governance/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/security-governance/01-isolation/data-governance/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/security-governance/01-isolation/multi-tenant-isolation/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/security-governance/02-supply-chain/inference-security/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/security-governance/02-supply-chain/model-supply-chain/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/storage-data/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/storage-data/01-pipeline/data-loading/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/storage-data/01-pipeline/data-pipeline/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/storage-data/02-checkpoint/checkpointing/</loc></url><url><loc>https://ai-infra-wiki.pages.dev/storage-data/02-checkpoint/storage-systems/</loc></url></urlset>