手机浏览器扫描二维码访问
和“伤心”
则是相反语义,相似度为0.02。
如果用最表层的统计方法是没办法得出上述结论的。
所以在当下,深度学习方法则成为主要的学习句子深层次语义的方法。
凌志并不想糊弄客户,他想既然要做那就尽量做到最好。
虽然客户在这一块并不是专业的,也并不知道计算相似度都有哪些方法,更没有去问凌志打算如何计算,但凌志依然想用深度学习方法来帮助客户准确计算每个公司的相似度。
凌志看着客户发来的每个公司的代表产品,找到了之前自己训练好的一份词向量表,先把产品名用分词工具分词,再对应到词向量表中,最终将两个公司之间的产品所对应的向量进行两两欧氏距离计算,最终一平均得到了每一对公司之间的相似度……
感觉也不复杂,但是不知不觉一天就过去了。
凌志整理了一下数据,发给了客户。
“您好,相似度的计算已经搞好了,您看您还满意么”
过了一会儿,客户回复道:
“[拱手]整理得太细致了,谢谢您。
不过您是怎么计算相似度的呢如果方便的话能不能告诉我一下,我想写进我的介绍推文里。”
“哦哦,其实也不复杂,我用的是词向量计算的,而词向量是用深度学习方法训练出来的……”
凌志仔细地打了一大段文字,大概介绍了一下原理,没有说得太细。
实际上词向量的训练过程是深度神经网络根据词的上下文来推断出来的,比如说,“开心”
这个词周围经常出现的词汇与“伤心”
就截然不同。
所以深度语义,本质上也是由他的上下文来决定的。
这也是凌志大致解释给客户的内容。
至于如何根据上下文推导出词向量,上下文的范围界定到底有多广,凌志就没有细讲,讲了客户也不关心,他只会挑重点说。
“谢谢您哈,对了,其实我这边还有一大批数据需要计算相似度,您能不能教我使用代码呢这样以后我就不用麻烦您了。”
教代码啊。
凌志有些脑壳疼,倒也不是说不行,只不过教不是计算机行业的人运行代码可能会出现各种各样的小问题。
但他也没有拒绝,这种需求都是常态,一般客户要了数据之后,如果想要代码,凌志都会免费给他,而且还耐心地教客户安装各种环境。
“也行,我给您发个文档,您先按里面的说明安装一下。”
凌志把以前写好的文档简单改改,发了过去。
过了一会儿。
“不好意思,我这边安装gensim包的时候报错了,……”
“哦哦,那可能是下载源的问题,……”
“这个地址斜杠后面是不是需要空格……”
客户不断地询问着各种问题,凌志也耐心回答着,最后总算是帮客户搞定了。
“谢谢,麻烦您了。”
“不客气,应该的。”
凌志看看表,该吃晚饭了,反正已经加了客户微信,有什么事再说。
……
晚上7点,凌志拿起自己刚买的《字母表谜案》,准备进入自己的悬疑世界。
看了没几页,手机震动了一下。
凌志打开手机,发现客户又给自己发了信息:
“不好意思,晚上再打扰您一下,我觉得我之前设计的表格格式不太美观,因为我一开始也没想好,还得麻烦您再帮我排一下版。
我是猪哥亮?诸葛亮?鞠躬尽瘁的诸葛亮?武则天?项羽?女娲?哦,原来是王者大陆啊。我还是宅着吧,这个大陆太危险了!这是一个宅男陈磊,在玩王者荣耀时,被纯净水电到王者大陆的故事!于是,一心想宅着的他,一不小心,拯救了世界!群号六一七一五三零五零。欢迎各位加入,一起探讨剧情。...
成功闪避老爷爷金手指命运。完美避开废柴退婚事件。捕获野生老爷爷一只,老爷爷自尊心受到重创,被当成金手指卖出。我叫苏墨,不要问我为何这么吊,因为我是要凌绝九天的男人!这是一个贱贱的老爷爷夺舍重生之后斗破苍穹,武动乾坤,主宰大地,弹指遮天,不以才华惊天下,但以风X动世人的故事。你才是金手指呢,你全家都是金手指!(求收藏,求推荐)...
本是内定太子妃,却因为恶毒继母与阴狠妹妹的联合算计,她被迫嫁给病入膏肓之人冲喜。娘亲留下来的丰厚嫁妆还被侵占,夫君又被别的女人虎视眈眈,皇帝还对她的财富红眼,皇后想将她嫁给乞丐。放眼望去,都是极品人渣,比起阴狠毒辣,你们谁有我厉害?老虎不发威当我是病猫吗?继母吞下去的嫁妆全部吐出来,想勾引我夫君的,全部青楼呆着去,皇帝眼红最多就反了,皇后最好是废了。这个突然冒出来的帅哥是怎么回事呢?奸商现世,斗志斗勇,他们抢地盘,抢生意,争来争去,最后争到了床上。你不是病得快死了么?她睁眼瞪着正压在身上的男人。美男邪魅一笑这个时候说这些话未免太煞风景了,还是继续聊聊生孩子的问题吧...
林婉兮新婚之夜被陌生人夺走处子之身。一纸登报的离婚声明让她成为全城笑话。而他十里红妆将她迎了回去成为军统夫人,却不想这只是噩梦的开始。本庆幸我对你从未认真,一转眸却爱你那么深。...
2019年的18岁少年汪强,重生到了2003年的26岁有妇之夫身上,这人不仅是一个已婚处男,还有一个六岁的女儿,他要怎样才能逆袭?...
三年前,我哥下药迷了我最喜欢的女人,还冤枉说是我下的药,三年后,我喜欢的人成了我的嫂子...