观察者网
然而,单纯依赖单个关键词往往难以覆盖用户多⚡样化的搜索意图
你可以直接加载中文预训练词向量,再将核心词映射到向量空间
将审核通过的词对录入同义词库,并记录相似度分值💫,便于后续优先级排序
第三步:向量相似度计算与筛选 模型训练完成后,通过🔑余弦相似度计算每个词与其他词的语义距离
人工审核候选词,🤔剔除语义不符的词(如“免费”与“付费”可能因强相关而向量相近,但并非同义)
设为首页
关于百度
About Baidu
使用百度前必读
帮助中心
© Baidu
京ICP证030173号
京公网安备11000002000001号