首页 > 其他分享 >火山引擎DataLeap:更强数据目录搜索能力,做到一步找数

火山引擎DataLeap:更强数据目录搜索能力,做到一步找数

时间:2023-08-04 11:56:53浏览次数:43  
标签:更强 找数 数据 Catalog 引擎 搜索 DataLeap Data

更多技术交流、求职机会,欢迎关注字节跳动数据平台微信公众号,回复【1】进入官方交流群
随着数据管理变得更加复杂,元数据的重要性呈指数级增加。   如今,Data Catalog(数据目录)被看成是元数据管理的最佳工具,而一个通用的Data Catalog平台,通常包含元数据管理,搜索,血缘,标签,术语等功能。   其中,搜索是Data Catalog的入口功能,承担着让用户“找到数”的主要能力。   通过汇总和组织各种元数据,火山引擎大数据研发治理套件DataLeap的Data Catalog系统,可以帮助企业梳理数据、查询数据和理解数据的业务场景。而在DataLeap的Data Catalog系统中,每天有70%以上的用户会使用搜索功能。   区别于需要指定具体资产类型,或在搜索结果页对不同的资产分栏显示的联合搜索,为了满足个性化、多语言、秒级实时性等需求,火山引擎DataLeap的Data Catalog的系统采用了个性化综合搜索的方案。   该综合搜索方案允许用户在同一个搜索框中进行搜索输入,而无需指定搜索的资产类型;同时,搜索服务会在同一个搜索结果页返回不同类型的相关资产,并根据匹配程度和用户的个性化数据,进行混合排序。不仅可以给到不同用户针对不同资产的搜索需求,提供高度统一的搜索体验,同时还提供了跨类型圈定资产的能力。   图:火山引擎DataLeap的Data Catalog系统整体架构 火山引擎DataLeap的Data Catalog搜索系统,采用了开源搜索引擎Elasticsearch。在海量数据下,其分布式的实时文件存储及实时分析搜索引擎,让每个字段都可以被索引且可用于搜索,可达到近实时秒级响应。同时,Elasticsearch采用的Restful api架构,天生的兼容多语言开发,且扩展能力强,可以处理PB级结构化或非结构化数据。   除了个性化的搜索需求,火山引擎DataLeap也支持单纯的列表模式,对于不要求精细度的查询需求,用户可以在此模式下,通过指定字段来对搜索结果进行简单排序。   未来,火山引擎DataLeap团队将进一步探索性能更完善的进阶搜索功能,包括查询语法功能的实现,以及血缘搜索和多租户之间模型的迁移。   除此之外,火山引擎DataLeap还可以提供数据集成、开发、运维、治理、资产等能力,帮助用户提升数据研发效率、降低管理成本,加速推动企业的数字化转型,目前已经应用于泛互联网、制造、新零售、汽车等领域,帮助数据团队有效的降低工作成本和数据维护成本、挖掘数据价值、为企业决策提供数据支撑。  

点击跳转大数据研发治理套件 DataLeap了解更多

标签:更强,找数,数据,Catalog,引擎,搜索,DataLeap,Data
From: https://www.cnblogs.com/bytedata/p/17605503.html

相关文章

  • 火山引擎DataLeap的Data Catalog系统搜索实践 (上)
    更多技术交流、求职机会,欢迎关注字节跳动数据平台微信公众号,回复【1】进入官方交流群摘要火山引擎大数据研发治理套件DataLeap的DataCatalog系统通过汇总和组织各种元数据,解决了数据生产者梳理数据、数据消费者找数和理解数的业务场景,其中搜索是DataCatalog的主要功能之一。本文......
  • 火山引擎DataLeap的Data Catalog系统搜索实践 (上)
    更多技术交流、求职机会,欢迎关注字节跳动数据平台微信公众号,回复【1】进入官方交流群摘要火山引擎大数据研发治理套件DataLeap的DataCatalog系统通过汇总和组织各种元数据,解决了数据生产者梳理数据、数据消费者找数和理解数的业务场景,其中搜索是DataCatalog的主要功能之......
  • EEZ H24005开源电源升级版EEZ BB3,性能更强,电压支持0-80V,电流0-10A
    软件包:https://github.com/eez-open/modular-psu-firmware硬件包:https://github.com/eez-open/modular-psu地址来源:https://www.crowdsupply.com/envox/eez-bb3视频展示:http://v.qq.com/x/page/u0957v1u11y.html规格:产品效果:基于自家的开源跨平台GUI设计平台EEZStudio设计的界面效......
  • 剑指 Offer 53 - I. 在排序数组中查找数字 I(简单)
    题目:classSolution{public:intsearch(vector<int>&nums,inttarget){intcount=0;for(auton:nums){if(n==target){count++;}}returncount;}};......
  • 活动回顾|火山引擎 DataLeap 分享:DataOps、数据治理、指标体系最佳实践(文中领取 PPT)
    更多技术交流、求职机会,欢迎关注字节跳动数据平台微信公众号,回复【1】进入官方交流群 在7月21日至22日举行的 ArchSummit全球架构师峰会(深圳站)及 DataFunCon.数据智能创新与实践大会(北京站)上,来自火山引擎DataLeap的三位专家分别就 DataOps、数据治理和指标体系等......
  • 寻找数组中重复的数字
    寻找数组中重复的数字​ 给定一个包含n+1个整数的数组nums,其数字都在[1,n]范围内(包括1和n),可知至少存在一个重复的整数。假设nums只有一个重复的整数,返回这个重复的数。1<=n<=\(10^5\)nums.length==n+11<=nums[i]<=nnums中只有一个整数出......
  • 火山引擎DataLeap如何解决SLA治理难题(三): 平台架构与未来展望
    更多技术交流、求职机会,欢迎关注字节跳动数据平台微信公众号,回复【1】进入官方交流群平台架构总结火山引擎DataLeapSLA平台整体主要分为基础组件、规划式治理服务、响应式治理服务三大块,系统组件架构图如下:规划式治理服务所谓“规划式治理”,即在问题发现前治理,通过主动规划约定SL......
  • 火山引擎DataLeap如何解决SLA治理难题(三): 平台架构与未来展望
    更多技术交流、求职机会,欢迎关注字节跳动数据平台微信公众号,回复【1】进入官方交流群平台架构总结火山引擎DataLeapSLA平台整体主要分为基础组件、规划式治理服务、响应式治理服务三大块,系统组件架构图如下: 规划式治理服务所谓“规划式治理”,即在问题发现前治理,......
  • 比Meta「分割一切AI」更全能!港科大版图像分割AI来了:实现更强粒度和语义功能
    前言 比Meta“分割一切”的SAM更全能的图像分割AI,来了!本文转载自量子位仅用于学术分享,若侵权请联系删除欢迎关注公众号CV技术指南,专注于计算机视觉的技术总结、最新技术跟踪、经典论文解读、CV招聘信息。CV各大方向专栏与各个部署框架最全教程整理【CV技术指南】CV全栈指导......
  • 火山引擎DataLeap如何解决SLA治理难题(一):应用场景与核心概念介绍
    更多技术交流、求职机会,欢迎关注字节跳动数据平台微信公众号,回复【1】进入官方交流群 基于火山引擎分布式治理的理念,数据平台数据治理团队自研了火山引擎DataLeapSLA保障平台,目前已在字节内部得到广泛使用,并支持了绝大部分数据团队的SLA治理需求,每天保障的SLA链路数量过千,解......