Token Numbers Every Engineer Should Know
Inspired from this visualization of Jeff Dean’s Latency Numbers Every Programmer Should Know, I wanted to visualize how different documents fit into context windows of LLMs.
Numbers below are measured with a pre-4.7 Claude tokenizer. Other models can differ by 30+%.
Characters per token
| Content | Density | Chars/token |
|---|