<?xml version="1.0" encoding="UTF-8"?><urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9" xmlns:news="http://www.google.com/schemas/sitemap-news/0.9" xmlns:xhtml="http://www.w3.org/1999/xhtml" xmlns:image="http://www.google.com/schemas/sitemap-image/1.1" xmlns:video="http://www.google.com/schemas/sitemap-video/1.1"><url><loc>https://www.tanmaypatil.com/</loc></url><url><loc>https://www.tanmaypatil.com/about/</loc></url><url><loc>https://www.tanmaypatil.com/archives/</loc></url><url><loc>https://www.tanmaypatil.com/models/</loc></url><url><loc>https://www.tanmaypatil.com/posts/</loc></url><url><loc>https://www.tanmaypatil.com/posts/2025/rmsnorm-backward-derivation-triton-kernel/</loc></url><url><loc>https://www.tanmaypatil.com/posts/2026/blackwell-2cta-gluon-gemm/</loc></url><url><loc>https://www.tanmaypatil.com/search/</loc></url><url><loc>https://www.tanmaypatil.com/tags/</loc></url><url><loc>https://www.tanmaypatil.com/tags/backpropagation/</loc></url><url><loc>https://www.tanmaypatil.com/tags/blackwell/</loc></url><url><loc>https://www.tanmaypatil.com/tags/cuda/</loc></url><url><loc>https://www.tanmaypatil.com/tags/deep-learning/</loc></url><url><loc>https://www.tanmaypatil.com/tags/gemm/</loc></url><url><loc>https://www.tanmaypatil.com/tags/gluon/</loc></url><url><loc>https://www.tanmaypatil.com/tags/gpu-kernels/</loc></url><url><loc>https://www.tanmaypatil.com/tags/matmul/</loc></url><url><loc>https://www.tanmaypatil.com/tags/normalization/</loc></url><url><loc>https://www.tanmaypatil.com/tags/pytorch/</loc></url><url><loc>https://www.tanmaypatil.com/tags/rmsnorm/</loc></url><url><loc>https://www.tanmaypatil.com/tags/tcgen-05/</loc></url><url><loc>https://www.tanmaypatil.com/tags/tensor-memory/</loc></url><url><loc>https://www.tanmaypatil.com/tags/tma/</loc></url><url><loc>https://www.tanmaypatil.com/tags/triton/</loc></url></urlset>