手机浏览器扫描二维码访问
是同一语义,相似度为097,而“开心”
和“伤心”
则是相反语义,相似度为002。
如果用最表层的统计方法是没办法得出上述结论的。
所以在当下,深度学习方法则成为主要的学习句子深层次语义的方法。
凌志并不想糊弄客户,他想既然要做那就尽量做到最好。
虽然客户在这一块并不是专业的,也并不知道计算相似度都有哪些方法,更没有去问凌志打算如何计算,但凌志依然想用深度学习方法来帮助客户准确计算每个公司的相似度。
凌志看着客户发来的每个公司的代表产品,找到了之前自己训练好的一份词向量表,先把产品名用分词工具分词,再对应到词向量表中,最终将两个公司之间的产品所对应的向量进行两两欧氏距离计算,最终一平均得到了每一对公司之间的相似度……感觉也不复杂,但是不知不觉一天就过去了。
凌志整理了一下数据,发给了客户。
“您好,相似度的计算已经搞好了,您看您还满意么?”
过了一会儿,客户回复道:“[拱手]整理得太细致了,谢谢您。
不过您是怎么计算相似度的呢?如果方便的话能不能告诉我一下,我想写进我的介绍推文里。”
“哦哦,其实也不复杂,我用的是词向量计算的,而词向量是用深度学习方法训练出来的……”
凌志仔细地打了一大段文字,大概介绍了一下原理,没有说得太细。
实际上词向量的训练过程是深度神经网络根据词的上下文来推断出来的,比如说,“开心”
这个词周围经常出现的词汇与“伤心”
就截然不同。
所以深度语义,本质上也是由他的上下文来决定的,这也是凌志大致解释给客户的内容。
至于如何根据上下文推导出词向量,上下文的范围界定到底有多广,凌志就没有细讲,讲了客户也不关心,他只会挑重点说。
,!
“谢谢您哈,对了,其实我这边还有一大批数据需要计算相似度,您能不能教我使用代码呢?这样以后我就不用麻烦您了。”
教代码啊。
凌志有些脑壳疼,倒也不是说不行,只不过教不是计算机行业的人运行代码可能会出现各种各样的小问题。
但他也没有拒绝,这种需求都是常态,一般客户要了数据之后,如果想要代码,凌志都会免费给他,而且还耐心地教客户安装各种环境。
“也行,我给您发个文档,您先按里面的说明安装一下。”
凌志把以前写好的文档简单改改,发了过去。
过了一会儿。
“不好意思,我这边安装nsi包的时候报错了,……”
“哦哦,那可能是下载源的问题,……”
“这个地址斜杠后面是不是需要空格?……”
客户不断地询问着各种问题,凌志也耐心回答着,最后总算是帮客户搞定了。
“谢谢,麻烦您了。”
“不客气,应该的。”
凌志看看表,该吃晚饭了,反正已经加了客户微信,有什么事再说。
……晚上7点,凌志拿起自己刚买的《字母表谜案》,准备进入自己的悬疑世界。
看了没几页,手机震动了一下。
周胜利大学毕业后,因接收单位人事处长的一次失误延误了时机,被分配到偏远乡镇农技站。他立志做一名助力农民群众致富的农业技术人员,却因为一系列的变故误打误撞进入了仕途,调岗离任,明升暗降,一路沉浮,直至权力巅峰...
天才中医凌游,在大学毕业后为逝世的爷爷回村守孝三年,并且继承了爷爷生前经营的医馆三七堂。可突然有一天,一群大人物的到来,让他的人生出现了转折,本想一生行医的他,在经历了一些现实的打击之后,他明白了下医医人,上医医国的道理,为了救治更多的人,从而毅然决然的走向了官场,游走在政军商等各种圈子。从赤脚郎中,到执政一方,从懵懂青涩,到老成练达,看凌游如何达成他心中安得广厦千万间,大庇天下寒士俱欢颜的崇高理想。...
他们都是草根出生,凭自己的努力走上仕途,但一个清廉,一个腐败,于是一见面就成了格格不入的对手...
官场是什么?官场是权力的游戏。官场远比江湖更为险恶。千帆竞渡百舸争流!跨过去那就是海阔任潮涌风劲好扬帆!官场的规矩是什么?正确就是官场的最大规矩!重活一世。刘项东洞悉一切。他不仅能正确,还会一直正确下去!重生是风自身为鹏大鹏一日同风起,这辈子,我刘项东要扶摇直上九万里!...
性格嚣张的林飞扬走马上任镇委书记当天就得罪了顶头上司,让大领导颜面无存,差点被就地免职,且看这个嚣张到骨子里的家伙如何凭借孙子兵法和三十六计勇闯重重危机,智破层层陷阱,在官场上混得风生水起,扶摇直上…...
官场如战场,尔虞我诈,勾心斗角,可陆浩时刻谨记,做官就要做个好官,要有两颗心,一颗善心,一颗责任心。且看陆浩一个最偏远乡镇的基层公务员,如何在没有硝烟的权利游戏里一路绿灯,两袖清风,不畏权贵,官运亨通。...