<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Llm on 111qqz's blog</title><link>https://111qqz.com/en/tags/llm/</link><description>Recent content in Llm on 111qqz's blog</description><generator>Hugo -- gohugo.io</generator><language>en</language><copyright>© 2015-2026 111qqz</copyright><lastBuildDate>Sun, 23 Aug 2026 14:00:00 +0800</lastBuildDate><atom:link href="https://111qqz.com/en/tags/llm/index.xml" rel="self" type="application/rss+xml"/><item><title>从 Bytes 到 Tokens：我在 CS336 中实现 BPE Tokenizer</title><link>https://111qqz.com/en/post/%E5%85%AC%E5%BC%80%E8%AF%BE/2026-08-23-cs336-bpe-tokenizer/</link><pubDate>Sun, 23 Aug 2026 14:00:00 +0800</pubDate><guid>https://111qqz.com/en/post/%E5%85%AC%E5%BC%80%E8%AF%BE/2026-08-23-cs336-bpe-tokenizer/</guid><description>&lt;p&gt;最近在做 Stanford CS336（Language Modeling from Scratch）的 Assignment 1，其中有一个完整的 BPE Tokenizer 实现——从训练到编解码。做完之后觉得，BPE 这个话题值得好好写一写。不是因为算法本身多复杂，而是它背后的 &lt;strong&gt;设计动机和 trade-off&lt;/strong&gt; 经常被一笔带过。&lt;/p&gt;</description></item></channel></rss>