论文研究精选
推理模型的思考Token真的有助于提升安全性吗?--来自GPT-OSS、Qwen、Olmo和Phi家族的证据
原始标题:Do Thinking Tokens Help with Safety?
内容摘要
对GPT-OSS、Qwen、Olmo和Phi系列前沿开源推理模型的研究发现,所谓的"思考token"并未带来真正的安全性深思熟虑。模型是否拒绝或服从指令,在第一个token的
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-8b58b071089e31adcdc566a1