华新社

第十一章 女孩的心思(第2页)

和“伤心”

则是相反语义,相似度为0.02。

如果用最表层的统计方法是没办法得出上述结论的。

();()  所以在当下,深度学习方法则成为主要的学习句子深层次语义的方法。

凌志并不想糊弄客户,他想既然要做那就尽量做到最好。

虽然客户在这一块并不是专业的,也并不知道计算相似度都有哪些方法,更没有去问凌志打算如何计算,但凌志依然想用深度学习方法来帮助客户准确计算每个公司的相似度。

凌志看着客户发来的每个公司的代表产品,找到了之前自己训练好的一份词向量表,先把产品名用分词工具分词,再对应到词向量表中,最终将两个公司之间的产品所对应的向量进行两两欧氏距离计算,最终一平均得到了每一对公司之间的相似度……

感觉也不复杂,但是不知不觉一天就过去了。

凌志整理了一下数据,发给了客户。

“您好,相似度的计算已经搞好了,您看您还满意么?”

过了一会儿,客户回复道:

“[拱手]整理得太细致了,谢谢您。

不过您是怎么计算相似度的呢?如果方便的话能不能告诉我一下,我想写进我的介绍推文里。”

“哦哦,其实也不复杂,我用的是词向量计算的,而词向量是用深度学习方法训练出来的……”

凌志仔细地打了一大段文字,大概介绍了一下原理,没有说得太细。

实际上词向量的训练过程是深度神经网络根据词的上下文来推断出来的,比如说,“开心”

这个词周围经常出现的词汇与“伤心”

就截然不同。

所以深度语义,本质上也是由他的上下文来决定的,这也是凌志大致解释给客户的内容。

至于如何根据上下文推导出词向量,上下文的范围界定到底有多广,凌志就没有细讲,讲了客户也不关心,他只会挑重点说。

“谢谢您哈,对了,其实我这边还有一大批数据需要计算相似度,您能不能教我使用代码呢?这样以后我就不用麻烦您了。”

教代码啊。

凌志有些脑壳疼,倒也不是说不行,只不过教不是计算机行业的人运行代码可能会出现各种各样的小问题。

但他也没有拒绝,这种需求都是常态,一般客户要了数据之后,如果想要代码,凌志都会免费给他,而且还耐心地教客户安装各种环境。

“也行,我给您发个文档,您先按里面的说明安装一下。”

凌志把以前写好的文档简单改改,发了过去。

过了一会儿。

“不好意思,我这边安装gensim包的时候报错了,……”

“哦哦,那可能是下载源的问题,……”

“这个地址斜杠后面是不是需要空格?……”

客户不断地询问着各种问题,凌志也耐心回答着,最后总算是帮客户搞定了。

“谢谢,麻烦您了。”

“不客气,应该的。”

凌志看看表,该吃晚饭了,反正已经加了客户微信,有什么事再说。

……

晚上7点,凌志拿起自己刚买的《字母表谜案》,准备进入自己的悬疑世界。

看了没几页,手机震动了一下。

凌志打开手机,发现客户又给自己发了信息:

“不好意思,晚上再打扰您一下,我觉得我之前设计的表格格式不太美观,因为我一开始也没想好,还得麻烦您再帮我排一下版。

……”

本月排行榜
本周收藏榜
热门小说推荐
六十年代白富美

六十年代白富美

夏晓意外重生到六十年代,成为了生产队的一枚小知青。因缘得了个空间,灵泉玉水,养鸡种菜,却不敢用。现下人人面黄饥瘦,她若把自己养成白富美,不得作死。夏晓仰天长叹,这真是另人心酸的惊喜啊s已有完本书...

柯南之从聊天群开始

柯南之从聊天群开始

emmmmm,不会写简历,但还是惯例写一个。柯南的世界,轻松日常,不走寻常路。诸天世界聊天群欢迎各位的加入。柯南司徒修,你到底是什么人。小哀司徒同学,你真的只有7岁嘛。司徒修装出一副小孩子的样子你们说什么,我听不懂柯南,小哀本书柯南日常加诸天世界的各位道友。小茂群主,来一场精灵对战吧!小当家群主,我会做发光的菜!布玛地球首富大小姐,就是这么有钱!蓝兔倾国倾城颜依旧,唯有明月映星辰!娜美小贼猫就是我。各位书友要是觉得柯南之从聊天群开始还不错的话请不要忘记向您QQ群和微博里的朋友推荐哦!...

每日热搜小说推荐