special: true 到底改变了什么
编码时它什么都不改。解码时它决定一切——但只在 skip_special_tokens 打开的那一种情况下。全部结论用 GLM 5.2 的 tokenizer 实测得出。
这个问题是在我自己的 eval 脚本里冒出来的,这种发现方式挺丢人的。
12text = tokenizer.decode(output[0, input_len:], skip_special_tokens=True).strip()text = re.sub(r"<think>.*?</think>\s*", "", tex......