Posts in LLM
3 posts2026
2025
- High-Performance BPE Tokenizer Optimization: From 10 Minutes to 1 Second Detailed explanation of high-performance optimization strategies for BPE tokenizers, including parallelization, lazy deletion queues, incremental updates, and more
- [Stanford CS336] Assignment 1: Building a Transformer Language Model In today's AI technology wave, mastering large model knowledge has become an essential skill for systems devel…