數(shù)據(jù)抽樣方法和裝置
基本信息

| 申請?zhí)?/td> | CN201710145152.4 | 申請日 | - |
| 公開(公告)號 | CN107122395B | 公開(公告)日 | 2021-02-26 |
| 申請公布號 | CN107122395B | 申請公布日 | 2021-02-26 |
| 分類號 | G06F16/28(2019.01)I;G06F16/35(2019.01)I | 分類 | 計算;推算;計數(shù); |
| 發(fā)明人 | 李剛毅;趙小光;譚國蘋;于坤元;劉剛;王平平 | 申請(專利權(quán))人 | 博彥科技股份有限公司 |
| 代理機(jī)構(gòu) | 北京康信知識產(chǎn)權(quán)代理有限責(zé)任公司 | 代理人 | 韓建偉;張永明 |
| 地址 | 100193北京市海淀區(qū)西北旺東路10號院東區(qū)7號樓(博彥科技大廈) | ||
| 法律狀態(tài) | - | ||
摘要

| 摘要 | 本發(fā)明公開了一種數(shù)據(jù)抽樣方法和裝置,其中,該方法包括:獲取多條數(shù)據(jù);根據(jù)多條數(shù)據(jù)中每一條數(shù)據(jù)的一個或多個屬性值對多條數(shù)據(jù)進(jìn)行分層,其中,每一條數(shù)據(jù)的一個或多個屬性值中包括至少一個特定屬性值,特定屬性值是對該數(shù)據(jù)的其余屬性值中的部分或進(jìn)行機(jī)器學(xué)習(xí)得到的,其余屬性值為一條數(shù)據(jù)中除特定屬性值之外的其他屬性值;從每一層數(shù)據(jù)中抽取至少一條數(shù)據(jù)作為抽樣數(shù)據(jù)。本發(fā)明解決了由于傳統(tǒng)數(shù)據(jù)抽樣的分層標(biāo)準(zhǔn)是抽樣數(shù)據(jù)中的明顯屬性,造成無法對隱藏的屬性進(jìn)行分層,影響抽樣結(jié)果的準(zhǔn)確性的技術(shù)問題。?? |





