第十一章女孩的心思 (第2/5页)

“在的亲，请问您想要采集什么数据呢？”

“您好，请问可以帮忙分析数据吗？”

分析数据啊，凌志不是专门做数据分析的，但是能不能做要看情况。如果只是做一些简单的统计的话……

“您可以把您的需求发出来，我看看能不能做。”

“好的，我是想计算一下行业内每两个公司之间的相似度……”

凌志听着客户的需求，也不时提出一些疑问。回答完之后根据数据量给出了一个报价以及预期交付时间，客户并没有多砍价，就这么敲定了。

实际上计算文本相似度的方法有很多，比如统计两个文本中有没有词语同时出现，出现频率是否相近，标点符号使用频率是否一致等等。

但这些统计都是表层的统计，句子语义深层次的相似度没有办法通过这种办法来计算。

比如“开心”和“快乐”是同一语义，相似度为0.97，而“开心”和“伤心”则是相反语义，相似度为0.02。如果用最表层的统计方法是没办法得出上述结论的。

所以在当下，深度学习方法则成为主要的学习句子深层次语义的方法。

凌志并不想糊弄客户，他想既然要做那就尽量做到最好。

虽然客户在这一块并不是专业的，也并不知道计算相似度都有哪些方法，更没有去问凌志打算如何计算，但凌志依然想用深度学习方法来帮助客户准确计算每个公司的相似度。

凌志看着客户发来的每个公司的代表产品，找到了之前自己训练好的一份词向量表，先把产品名用分词工具分词，再对应到词向量表中，最终将两个公司之间的产品所对应的向量进行两两欧氏距离计算，最终一平均得到了每一对公司之间的相似度……

感觉也不复杂，但是不知不觉一天就过去了。凌志整理了一下数据，发给了客户。

“您好，相似度的计算已经搞好了，您看您还满意么？”

过了一会儿，客户回复道：

“[拱手]整理得太细致了，谢谢您。不过您是怎么计算相似度的呢？如果方便的话能不能告诉我一下，我想写进我的介绍推文里。”

其他小说相关阅读：校花别追了，我选娇憨白月光心动夜，她一哭！绝嗣陆总失控吻惹她？她SSSSS级异端真祖宗我不过作作妖，怎么就成了白月光攒功德，救天道，穿成女配妙妙妙皇叔求放过，九皇子是女儿身全民双人求生：开局跟校花建家园银行错打八千万，我全买烂尾楼！十亿聘礼，我嫁了！特种兵之国之重器我不想再有钱了全职业体验系统降临他心上醉吻夜！她一撩，桀骜大佬心狂跳全家爆宠，你说这是绝望主妇？恶毒女配被偷听心声后，全家人杀疯了周团的乡下二婚妻，宠爆了！重生姐妹互换人生穿越荒年有空间，王爷说我是福星娇软军嫂一掉泪，全海岛都慌了

台球博士所有内容均来自互联网，435文学只为原作者木森研心的小说进行宣传。欢迎各位书友支持木森研心并收藏台球博士最新章节。

第十一章 女孩的心思 (第2/5页)