關(guān)聯(lián)詞庫生成方法、文本檢索方法、裝置、設(shè)備及介質(zhì)
基本信息

| 申請?zhí)?/td> | CN202210145591.6 | 申請日 | - |
| 公開(公告)號 | CN114519350A | 公開(公告)日 | 2022-05-20 |
| 申請公布號 | CN114519350A | 申請公布日 | 2022-05-20 |
| 分類號 | G06F40/289(2020.01)I;G06F40/216(2020.01)I | 分類 | 計(jì)算;推算;計(jì)數(shù); |
| 發(fā)明人 | 孫園 | 申請(專利權(quán))人 | 國泰新點(diǎn)軟件股份有限公司 |
| 代理機(jī)構(gòu) | 北京品源專利代理有限公司 | 代理人 | - |
| 地址 | 215600江蘇省蘇州市張家港經(jīng)濟(jì)開發(fā)區(qū)(楊舍鎮(zhèn)長興路) | ||
| 法律狀態(tài) | - | ||
摘要

| 摘要 | 本發(fā)明公開了一種關(guān)聯(lián)詞庫生成方法、文本檢索方法、裝置、設(shè)備及介質(zhì)。關(guān)聯(lián)詞庫生成方法包括:獲取至少一個(gè)樣本文本,并確定所述樣本文本的至少一個(gè)樣本分詞;基于詞向量提取模型提取所述樣本分詞的詞向量;對所述詞向量進(jìn)行聚類處理,并確定所述樣本分詞之間的語義距離;基于所述語義距離和所述樣本分詞生成關(guān)聯(lián)詞庫;其中,所述關(guān)聯(lián)詞庫用于在對待檢索文本進(jìn)行檢索時(shí)確定所述待檢索文本中目標(biāo)分詞的關(guān)聯(lián)分詞。通過本發(fā)明公開的技術(shù)方案,提升了檢索的查準(zhǔn)率和查全率。 |





