<?xml version="1.0" encoding="UTF-8"?> <urlset xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://www.sitemaps.org/schemas/sitemap/0.9 http://www.sitemaps.org/schemas/sitemap/0.9/sitemap.xsd" xmlns="http://www.sitemaps.org/schemas/sitemap/0.9"> <url> <loc>https://cyk1337.github.io/blog/2019/attention-mechanisms-and-transformer/</loc> <lastmod>2019-01-22T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2019/normalization-in-neural-networks/</loc> <lastmod>2019-02-28T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2019/bertology-from-xlnet-to-electra/</loc> <lastmod>2019-12-14T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2021/subword-tokenization-in-nlp/</loc> <lastmod>2021-11-29T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2022/masking-strategies-for-pre-trained-models/</loc> <lastmod>2022-01-10T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2022/efficient-distributed-training/</loc> <lastmod>2022-04-17T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2022/diffusion-models-math-guide/</loc> <lastmod>2022-12-12T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2023/position-encoding-in-transformers/</loc> <lastmod>2023-01-26T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2024/memory-efficient-attention/</loc> <lastmod>2024-05-10T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/blog/2024/multimodal-tokenization-with-vector-quantization/</loc> <lastmod>2024-06-24T00:00:00+00:00</lastmod> </url> <url> <loc>https://cyk1337.github.io/</loc> </url> <url> <loc>https://cyk1337.github.io/academic_services/</loc> </url> <url> <loc>https://cyk1337.github.io/news/</loc> </url> <url> <loc>https://cyk1337.github.io/publications/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/transformer/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/attention/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/machine-learning/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/lmm/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/tokenization/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/diffusion-models/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/generative-models/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/tag/multimodality/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/category/machine-learning/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/category/tokenization/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/category/lmm/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/category/transformer/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/category/attention/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/2019/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/2021/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/2022/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/2023/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/2024/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/</loc> </url> <url> <loc>https://cyk1337.github.io/blog/page/2/</loc> </url> </urlset>