如果你问的是9.11和9.90谁大他就能回答正确了。如果是拿9.11跟9.9去比,位数不一样的话它就是先比较整数部分,然后在比较小数部分,但是小数部分它是不会自动补零的,所以就出现了这个错误,我感觉是这样
大模型并不会像人类一样把“9.11和9.9哪个大”当作比大小的问题,大模型的解答方式是预测下一个词,本身是一个概率模型
分词器的缘故吧(思考🤔)
看过一篇文章,其中提到有一个原因是训练语料里一部分是版本号的问题,比如9.11确实比9.9的版本大,另一个就是分token的问题,11和9分别作为一个token,还有其他原因记不清了
如果你问的是9.11和9.90谁大他就能回答正确了。如果是拿9.11跟9.9去比,位数不一样的话它就是先比较整数部分,然后在比较小数部分,但是小数部分它是不会自动补零的,所以就出现了这个错误,我感觉是这样
大模型并不会像人类一样把“9.11和9.9哪个大”当作比大小的问题,大模型的解答方式是预测下一个词,本身是一个概率模型
分词器的缘故吧(思考🤔)
看过一篇文章,其中提到有一个原因是训练语料里一部分是版本号的问题,比如9.11确实比9.9的版本大,另一个就是分token的问题,11和9分别作为一个token,还有其他原因记不清了