"A practical contract for expanding a pretrained LLM tokenizer in place while preserving token identity, model quality, and real inference performance