火山引擎DataLeap:更强的数据目录搜索能力做到一步找数

来源:nba小九直播下载
发布时间:2024-07-26 19:07:43

...

  (原标题:火山引擎DataLeap:更强的数据目录搜索能力,做到一步找数)

  如今,Data Catalog(数据目录)被看成是元数据管理的最佳工具,而一个通用的Data Catalog平台,通常包含元数据管理,搜索,血缘,标签,术语等功能。

  其中,搜索是Data Catalog的入口功能,承担着让用户“找到数”的主要能力。

  通过汇总和组织各种元数据,大数据研发治理套件DataLeap的Data Catalog系统,能够在一定程度上帮助企业梳理数据、查询数据和理解数据的业务场景。而在DataLeap的Data Catalog系统中,每天有70%以上的用户会使用搜索功能。

  区别于需要指定具体资产类型,或在搜索出来的结果页对不同的资产分栏显示的联合搜索,为满足个性化、多语言、秒级实时性等需求,火山引擎DataLeap的Data Catalog的系统采用了个性化综合搜索的方案。

  该综合搜索方案允许用户在同一个搜索框中进行搜索输入,而无需指定搜索的资产类型;同时,搜索服务会在同一个搜索出来的结果页返回不一样的相关资产,并根据匹配程度和用户的个性化数据,进行混合排序。不但可以给到不同用户针对不一样资产的搜索需求,提供高度统一的搜索体验,同时还提供了跨类型圈定资产的能力。

  火山引擎DataLeap的Data Catalog搜索系统,采用了开源搜索引擎Elasticsearch,在海量数据下,其分布式的实时文件存储及实时分析搜索引擎,让每个字段都可以被索引且可用于搜索,可达到近实时秒级响应。同时,Elasticsearch采用的Restful api架构,天生的兼容多语言开发,且扩展能力强,能处理PB级结构化或非结构化数据。

  除了个性化的搜索需求,火山引擎DataLeap也支持单纯的列表模式,对于不要求精细度的查询需求,用户都能够在此模式下,通过指定字段来对搜索出来的结果进行简单排序。

  未来,火山引擎DataLeap团队将进一步探索性能更完善的进阶搜索功能,包括查询语法功能的实现,以及血缘搜索和多租户之间模型的迁移。

  除此之外,火山引擎DataLeap还能够给大家提供数据集成、开发、运维、治理、资产等能力,帮助用户提升数据研发效率、降低管理成本,加速推动企业的数字化转型,目前已经应用于泛互联网、制造、新零售、汽车等领域,帮助数据团队有效的降低工作成本和数据维护成本、挖掘数据价值、为企业决策提供数据支撑。

  董宇辉单飞还拿1.4亿元奖励?离职细节曝光!与辉同行当晚涨粉10万,20万人涌进直播间,“恭喜”“祝福”刷屏

  社保入税动真格了!已有企业被警告!2024年,企业这些行为,再不收手就晚了!

  美媒:美副总统哈里斯会见以总理内塔尼亚胡,敦促其达成停火和释放人质协议

  7×8=56,8×7等于65???姐姐教弟弟背乘法口诀,小小年纪就有找规律的思维,“从某种角度来说他...

  与中坚力量共成长,2024建信信托艺术大奖评委会特别奖获奖艺术家凌海鹏

  三星Galaxy S25Ultra国行版完成备案 前奔驰首席设计官设计

  高效智能,创意迸发—— 华硕ProArt 创16 2024 AI专业创作本

  AMD锐龙9000中国超频首秀!9950X全核飙到6.5GHz CB R23得分超5.5万

  耕升携AIPC亮相ChinaJoy 2024:强大算力加持,轻松玩转AI