123nhh(我的状态:期待意外的每一天) (@123nhh)脑洞大开一下,为什么不开创一个“ci yuan”宇宙呢 中发帖

建议把token余额改为词元,把token改为词缘,把分词器叫作词原,训练数据叫词源,向量空间叫词园,把Agent叫词猿,最大上下文叫词远,思维链叫词圆,model list叫词苑 
token余额——词元:取“元”的意思,与“词语”的“词”进行组合,结合下来就是剩余的token 
token——词缘:“缘”代表关联与概率联系,众所周知,llm本质上就是一个概率模型,用“缘”这个字就可以形容其关系 
分词器——词原:取“原子”的含义,分词器将连续文本拆解为模型能够理解和处理的基本原子 
训练数据——词源: “源”取 “数据源”之意,指模型回答所依赖的信息出处,模型的回答建立在已有语料与上下文信息之上() 
向量空间——词园:园取自“园子”,抽象上延伸为一个“多维空间”,代表一个承载万物关系的空间 
Agent——词猿: “猿”取类似猿猴灵长类演化、智慧萌芽的能力,暗指现在Agent的进化之...
 
 
Back to Top