X为了获得更好的用户体验,请使用火狐、谷歌、360浏览器极速模式或IE8及以上版本的浏览器
平台简介 | 帮助中心
欢迎来到科易厦门城市创新综合服务平台,请 登录 | 注册
尊敬的 , 欢迎光临!  [会员中心]  [退出登录]
当前位置: 首页 >  科技成果  > 详细页

[00297673]一种基于局部性优化的重复数据检测方法

交易价格: 面议

所属行业: 分析仪器

类型: 发明专利

技术成熟度: 正在研发

专利所属地:中国

专利号:CN201710555589.5

交易方式: 技术转让 技术转让 技术入股

联系人: 华中科技大学

进入空间

所在地:湖北武汉市

服务承诺
产权明晰
资料保密
对所交付的所有资料进行保密
如实描述
|
收藏
|

技术详细介绍

摘要:本发明公开了一种基于局部性优化的重复数据检测方法,属于计算机存储技术领域,解决现有重复数据检测方法中检测效率低下的问题,以适应因存储数据规模扩大,而导致重复数据检测效率降低的现状。本发明包括布隆过滤器检测、哈希桶写缓存检测、哈希桶读缓存检测、哈希桶地址表检测步骤。本发明主要针对局部性较强的数据集类型,通过挖掘数据集中的局部性,提高数据预取的效率,降低磁盘访问开销,提升数据去重的吞吐率。对于数据集中可能的重复数据,本发明首先利用布隆过滤器对数据块的重复性进行预判,接下来根据不同的条件分别对缓存区的热区及冷区及磁盘进行三级重复数据的检测,充分利用重复数据中的局部性,提升重复数据的检测效能。

摘要:本发明公开了一种基于局部性优化的重复数据检测方法,属于计算机存储技术领域,解决现有重复数据检测方法中检测效率低下的问题,以适应因存储数据规模扩大,而导致重复数据检测效率降低的现状。本发明包括布隆过滤器检测、哈希桶写缓存检测、哈希桶读缓存检测、哈希桶地址表检测步骤。本发明主要针对局部性较强的数据集类型,通过挖掘数据集中的局部性,提高数据预取的效率,降低磁盘访问开销,提升数据去重的吞吐率。对于数据集中可能的重复数据,本发明首先利用布隆过滤器对数据块的重复性进行预判,接下来根据不同的条件分别对缓存区的热区及冷区及磁盘进行三级重复数据的检测,充分利用重复数据中的局部性,提升重复数据的检测效能。

推荐服务:

智能制造服务热线:0592-5380947

运营商:厦门科易帮信息技术有限公司     

增值电信业务许可证:闽B2-20100023      闽ICP备07063032号-5