首页
学习
活动
专区
工具
TVP
发布
精选内容/技术社群/优惠产品,尽在小程序
立即前往

名,懂

做数据开发不能绕过数据仓库的建设,是数据分析/数据挖掘的基础料,更是描述一个企业蓝图的智库。...如何打造出一个反映企业全局的视图是“路漫漫其修远兮”的任重远道; 在数据公众号“数据指象”的上一篇推文《矛盾的演进之旅》中,描述了由简入繁的其中道理。今天我们接着了解数的名义。...数据集成性:集成是最重要的特点之一,也是突出与传统数据库的特性之一;没有集成数就没有价值;只有将:同义不同名、同名不同义、多数据源、码值分解等等杂乱无章的数据,以集成就行统一、进行归一、进行编排形成一致性统一的的...非易失性:不易丢失数据是的基本属性,承接经年累月的数据输入,保存历史的数据细节,在时间的作用慢慢地聚沙成塔,让微小的数据也能发出耀眼的光芒。...具体中粒度如何选择,后续将分享如何构建双粒度数 周末快乐

50820
  • 您找到你想要的搜索结果了吗?
    是的
    没有找到

    建设篇」主题域划分

    一、前言数据仓库具有面向主题的特性,那么就会有主题的概念,建设是遵循纵向分层开发,横向划分主题域设计,分层就不在这次谈了,这次我会结合本人数工作实践总结的经验来聊聊主题域划分,同时会引申出主题划分...这个对于工程师来说是必备的能力,比如当你面临着一个新业务的开启,需要从0到1开始搭建数据仓库或者数据集市,这时候就要考虑到主题域和主题的合理划分。二、建设的步骤1....业务调研开发侧是承上对接业务研发侧&承下对接数据分析侧,在数建设前期要对上游业务过程和对下游数据分析指标体系有所了解和熟知,然后拉齐上下游沟通数据口径和数搭建。2. 主题域划分3....分层设计模型表6. 公共层表迭代升级三、主题和主题域下面结合本人对搬家业务的建设,进行主题域划分和主题划分实践,当然项目的大小决定着这是一个小型的数据集市 还是 企业级的数据仓库。1....:「建设篇」主题域划分 另外,公众号有海量大数据领域资料 欢迎领取。同时也欢迎大家加我微信,拉你进大数据技术交流群,一同成长。图片

    2K01

    最新面试题_知行教育项目

    5、项目是如何分层的 6、一般怎么做分层处理呢? 7、分层的作用是什么? 8、项目中有做按照主题分析吗?...数据仓库主要用于数据挖掘和数据分析,辅助领导做决策; 它们的主要区别体现在数是综合的或提炼的,数据库是细节的,主要用星型模型或雪花模型;面向分析,支持决策需求;而数据库用的是实体-关系(E-R)...5、项目是如何分层的 一般分成三层 ODS DW ADS 也会有Dimen层 6、一般怎么做分层处理呢? ODS——》DWD——》DWM——》DWS 7、分层的作用是什么?...14、一个企业一般构建几个数据仓库最好,并说明 最好一个, 因为企业面临的困境就是数据孤岛问题,如果数据存储太过分散就无法发挥的优势。即使是两个数也会遇到数据同步问题,会浪费时间,降低效率。...同时对事务的支持性不行 适用的场景: 的特性很大一部分是针对列的过滤,列的搜索,列的匹配,所以很多数结构比较适合使用列存储 列存储也比较适合做OLAP 30、什么是Hive的分区?

    1.5K21

    如何设计

    一、为什么要分层?   合理的数据仓库分层一方面能够降低耦合性,提高重用性,可读性可维护性,另一方面也能提高运算的效率,影响到数据需求迭代的速度,近而影响到产品决策的及时性。...建立数据分层可以提炼公共层,避免烟囱式开发,可见一个合适且合理的分层是极其重要。...实际上cube的数据尽量放在ADS层,这样在开发数据接口或者应用层取时都会比较方便。...建设是一个不断迭代的过程,数据建模同样是一个不断迭代的过程。同时,业务是不断变化的,建模人员对业务的理解也是变化的,这些也就注定了建模是一个迭代过程。...由于的建设是与业务息息相关的,建设的方法论仅仅只是指引我们构建的一个方向,在实际的落地执行过程中会存在各种各样的问题,且不可被这些理论所禁锢。简单一句话就是:合适就好。

    1.4K30

    伴鱼演进

    整体架构的调整,明确新的分层方式,进行更加细化的建模。  职责划分 目前伴鱼团队,承接公司全部业务线的建设工作,对接公司内部各个业务线,每条业务线的形态不同,数据的使用方式也不同。...调研后发现大体有如下几种方式: 方式一(分总形式): 业务线或部门自建,各个业务线分别建设自己的之间无直接关系,使用其他业务线数据,通过权限申请拉取使用,或通过 FTP 文件的形式同步数据...方式二(分层形式): 划分基础与应用,基础通过自下而上,面向于主题的方式进行设计,更加专注的做好底层建设。应用通过自上而下,面向于应用的进行开发,更好的支持业务需求。...不同层级的目标不一致:基础的目标是合理的建设模型,模型排期是以周为单位,应用则是快速响应业务需求。...应用自建底层模型:为了快速响应业务需求,应用研发自己开发了所需的 DW 层表,等基础开发完后,无时间进行迁移改造,造成新的烟囱式问题。

    32320
    领券