E-COM-NET
首页
在线工具
Layui镜像站
SUI文档
联系我们
推荐频道
Java
PHP
C++
C
C#
Python
Ruby
go语言
Scala
Servlet
Vue
MySQL
NoSQL
Redis
CSS
Oracle
SQL Server
DB2
HBase
Http
HTML5
Spring
Ajax
Jquery
JavaScript
Json
XML
NodeJs
mybatis
Hibernate
算法
设计模式
shell
数据结构
大数据
JS
消息中间件
正则表达式
Tomcat
SQL
Nginx
Shiro
Maven
Linux
数仓技术知识
电商数据分析-02-电商业务介绍及表结构
参考电商业务简介大数据项目之电商
数仓
、电商业务简介、电商业务流程、电商常识、业务数据介绍、电商业务表、后台管理系统可以把excel复制为markdown的网站举个例子:1.1电商业务流程电商的业务流程可以以一个普通用户的浏览足迹为例进行说明
IT从业者张某某
·
2023-12-27 11:14
数据分析入门到进阶
数据分析
数据库开发常见面试题
ORACLE和kettle1、DeleteTruncateDrop区别2、DML、DDL3、经常使用到得函数4、KETTLE内存溢出解决方案5、kettle中黄色的锁,绿色的对勾,红色的停止代表的意思6、
数仓
架构
'接受现实'
·
2023-12-27 06:54
数据库开发
etl
数据库
hive学习笔记
一、Hive基本概念1.1hive是什么hive是基于hadoop的一个
数仓
分析工具,hive可以将hdfs上存储的结构化的数据,映射成一张表,然后让用户写HQL(类SQL)来分析数据telupdown138383843813451567138383843953451567138383844012411657713838384413453157571383838434353551567567
不爱吃鱼的馋猫
·
2023-12-27 06:05
hive
大数据
hadoop
大数据实战项目 -- 实时
数仓
文章目录一、实时数据1.1日志采集器1.1日志生成器1.3日志分发器1.4采集流脚本二、实时采集2.1项目搭建2.2Kafka数据获取2.3Redis数据去重2.4ES数据存储2.5精准一次性消费2.6Kibana可视化配置2.7发布数据接口三、实时监控3.1Canal3.1.1配置MySQL3.1.2安装canal3.2CanalODS层数据分流3.3Maxwell3.4MaxwellODS层数
L小Ray想有腮
·
2023-12-26 18:53
BigData
电商
数仓
笔记7_数据仓库系统(
数仓
搭建-DWD层,
数仓
搭建-DWS层,
数仓
搭建-DWT层,
数仓
搭建-ADS层)
电商
数仓
一、
数仓
搭建-DWD层1、DWD层(用户行为日志)(1)日志解析思路(2)get_json_object函数使用(3)启动日志表(4)页面日志表(5)动作日志表(6)曝光日志表(7)错误日志表(
明灭18
·
2023-12-26 17:47
笔记
大数据
hadoop
hive
电商
数仓
笔记6_数据仓库系统(
数仓
搭建-ODS层,
数仓
搭建-DIM层)
电商
数仓
一、
数仓
搭建-ODS层1、ODS层(用户行为数据)(1)创建日志表ods_log(2)Shell中单引号和双引号区别(3)ODS层日志表加载数据脚本2、ODS层(业务数据)(1)ODS层业务表首日数据装载脚本
明灭18
·
2023-12-26 17:17
笔记
数据仓库
hive
hadoop
大数据
四、电商数据仓库系统——第5章 数据仓库设计
5.1数据仓库分层规划优秀可靠的
数仓
体系,需要良好的数据分层结构。合理的分层,能够使数据体系更加清晰,使复杂问题得以简化。以下是该项目的分层规划。5.2数据仓库构建流程以下是构建数据仓库的完整流程。
怕被各位卷死
·
2023-12-26 17:47
离线电商数仓5.0搭建
大数据
hadoop
kafka
分布式
hdfs
电商
数仓
项目----笔记七(
数仓
DIM层)
所谓的维度层其实就是分析数据的角度,维度层保存的表其实是分析数据的角度,比如:--性别,年龄,品牌,品类这层的表主要用于统计分析,因此DIM层的数据存储格式为orc列式存储+snappy压缩(时间短)orc列式存储的好处:查询的时候不需要扫描全部的数据,而只需要读取每次查询涉及的列,这样可以将I/O消耗降低N倍,另外可以保存每一列的统计信息(min、max、sum等),实现部分的谓词下推。由于每一
zmx_messi
·
2023-12-26 17:16
笔记
spring之资源操作:Resources
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、SpringResources
哥的时代
·
2023-12-26 08:51
spring
java
数据库
Spring之国际化:i18n
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、i18n概述二、Java
哥的时代
·
2023-12-26 08:18
spring
python
java
Flink电商实时
数仓
(六)
交易域支付成功事务事实表从topic_db业务数据中筛选支付成功的数据从dwd_trade_order_detail主题中读取订单事实数据、LookUp字典表关联三张表形成支付成功宽表写入Kafka支付成功主题执行步骤设置ttl,通过Intervaljoin实现左右流的状态管理获取下单明细数据:用户必然要先下单才有可能支付成功,因此支付成功明细数据集必然是订单明细数据集的子集。要注意:Interv
十七✧ᐦ̤
·
2023-12-26 07:25
flink
数据库
java
打造绿色计算数智动力 HashData 入选“绿色计算最具价值解决方案”
酷克数据(HashData)作为国内云原生
数仓
领军企业,受邀参加本次大会,为观众呈现了HashData云
数仓
的技
HashData酷克数据
·
2023-12-26 00:53
postgresql
数据库
创新铸就卓越 HashData再度荣获 IT168技术卓越奖
12月20日,由国内专业数据库及架构技术社区ITPUB、IT垂直门户IT168联合主办的“2023技术卓越奖”评选结果正式揭晓,酷克数据基于云原生架构打造的HashData云
数仓
,凭借创新的技术架构、强大的性能表现
HashData酷克数据
·
2023-12-26 00:53
数据库
数据分析
大数据
幸福里基于 Flink & Paimon 的流式
数仓
实践
幸福里业务是一种典型的交易、事务类型的业务场景,这种业务场景在实时
数仓
建模中遇到了诸多挑战。
浪尖聊大数据-浪尖
·
2023-12-25 10:45
flink
大数据
ATT&CK权限提升-Linux提权总结
ATT&CK权限提升-Linux提权总结介绍MITREATT&CK®是一个全球可访问的基于真实世界观察的对手战术和
技术知识
库,本文根据MITREATT&CK框架总结了Linux系统下的权限提升技术,并且特指由普通用户提升到
black guest丶
·
2023-12-25 07:54
ATT&CK权限提升
linux
运维
服务器
Flink实时电商
数仓
(五)
FlinkSQL的joinRegularjoin普通join,两条流的数据都时存放在内存的状态中,如果两条流数据都很大,对内存压力很大。IntervalJoin:适合两条流到达时间有先后关系的;一条流的存活时间短,一条流的存活时间长。LookupJoin:适合主流特别大,从流特别小的情况;主流数据没到达一条,就会去查询从流的每一条数据。主流数据不存储在内存中。语法:主流使用时必须有处理时间,pro
十七✧ᐦ̤
·
2023-12-25 02:27
flink
大数据
Flink电商实时
数仓
(四)
日志数据结构业务数据:数据都是MySQL中的表格数据,使用FlinkSQL处理日志数据:分为page页面日志(页面信息,曝光信息,动作信息,报错信息)和启动日志(启动信息,报错信息),使用FlinkStreamAPI处理五种日志数据:“start”;启动信息“err”;错误信息“display”;曝光信息“action”;动作信息“page”;页面信息"actions":[{"action_id"
十七✧ᐦ̤
·
2023-12-25 02:57
flink
vscode
大数据
【黑马甄选离线
数仓
day10_会员主题域开发_DWS和ADS层】
day10_会员主题域开发会员主题_DWS和ADS层DWS层开发门店会员分类天表:维度指标:指标:新增注册会员数、累计注册会员数、新增消费会员数、累计消费会员数、新增复购会员数、累计复购会员数、活跃会员数、沉睡会员数、会员消费金额维度:时间维度(天、周、月)涉及表:门店会员分类天表表字段的组成:维度字段+指标结果字段建表语句:CREATETABLEIFNOTEXISTSdws.dws_mem_
LKL1026
·
2023-12-25 01:58
黑马甄选离线数仓项目
大数据
数据库
sql
数据仓库
2019-05-23
其他时间都在编写法院
数仓
重构项目建设方案。下午王伟离职,涉及到薪资结算不合理问题,他很生气,我建议他不要纠结这些小事,他貌似也没听进去。下午听了一个讲健康安全的课程,感觉很实用。晚11点半就寝。
bigtian
·
2023-12-24 15:11
天线设计(2)
spm=1001.2014.3001.5502【嵌牛导读】天线设计的相关
技术知识
【嵌牛鼻子】天线设计原理【嵌牛提问】天线设计在理论上是否还能继续优化?
2315789354
·
2023-12-24 15:41
电商
数仓
项目----笔记六(
数仓
ODS层)
ODS层的设计要点如下:(1)ODS层的表结构设计依托于从业务系统同步过来的数据结构。(2)ODS层要保存全部历史数据,故其压缩格式应选择压缩比较高的,此处选择gzip。(3)ODS层表名的命名规范为:ods_表名_单分区增量全量标识(inc/full)。同样的,需要将用户行为数据表和业务数据表放到ODS层。日志表DROPTABLEIFEXISTSods_log_inc;CREATEEXTERNA
zmx_messi
·
2023-12-24 12:38
笔记
电商
数仓
项目----笔记五(
数仓
架构和建模)
ODS:数据源DWD:加工数据DWS:统计数据ADS:分析数据DIM:维度层(大家都有可能用得上的部分)ER模型数据仓库之父BillInmon提出的建模方法是从全企业的高度,用实体关系(EntityRelationship,ER)模型来描述企业业务,并用规范化的方式表示出来,在范式理论上符合3NF。1)实体关系模型实体关系模型将复杂的数据抽象为两个概念——实体和关系。实体表示一个对象,例如学生、班
zmx_messi
·
2023-12-24 11:35
笔记
基于Hue,Dolphinscheduler,HIVE分析数据仓库层级实现及项目需求案例实践分析
目录一、
数仓
各个层级及作用1,ODS层(OperationDataStore-源数据层)2,DW层(DataWarehouse-数据仓库层)(1)DWD(DataWarehouseDetail-明细数据层
Len°
·
2023-12-24 11:32
Hadoop
hadoop
big
data
hive
常见的软件工程师认证
他们需要具备广泛的
技术知识
和丰富的经验,以解决各种系统和软件开发中的问题。2.软件设计师:软件设计师是负责软件系统设计和开发的专业人员。
如饥似渴的rocky
·
2023-12-24 07:42
职场和发展
技本功|Hive优化之监控(三)
Hive是大数据领域常用的组件之一,主要是大数据离线
数仓
的运算,关于Hive的性能调优在日常工作和面试中是经常涉及的一个点,因此掌握一些Hive调优是必不可少的技能。
云掣YUNCHE
·
2023-12-24 03:15
技术文档
数据库
运维
hive
大数据
mysql
技本功|Hive优化之Spark执行引擎参数调优(二)
Hive是大数据领域常用的组件之一,主要是大数据离线
数仓
的运算,关于Hive的性能调优在日常工作和面试中是经常涉及的的一个点,因此掌握一些Hive调优是必不可少的一项技能。
云掣YUNCHE
·
2023-12-24 03:44
技术文档
spark
hive
Spring之事务(1)
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、JdbcTemplate1
哥的时代
·
2023-12-24 01:00
Spring
spring
数据库
java
spring之单元测试:JUnit
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、整合JUnit51、
哥的时代
·
2023-12-24 01:30
Spring
spring
单元测试
junit
Spring之事务(2)
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、基于注解的声明式事务
哥的时代
·
2023-12-24 01:29
Spring
spring
java
数据库
产品经理必须懂的
技术知识
!
在互联网行业中,最重要的人员莫过于研发工程师,有了程序员的代码,才能跑起来应用,提供产品和服务给到用户。而我们程序员哥哥们又爱又恨的便是产品经理了,产品经理就是给程序员提需求的人,通过原型图绘制出整个功能的雏形、用户使用路径,然后交由程序员去实现。不过现在的互联网产品经理从业者大部分是非技术出身,有心理学专业、新闻专业、广告专业等等的人员加入,在他们与研发工程师进行交流时,往往就会出现GAP了。产
AI课工场
·
2023-12-23 22:27
【
数仓
_01】用户行为采集平台
1、
数仓
基础知识1.1描述1.2需求分析1.3选型考虑因素1.4项目流程设计1.5具体版本1.6集群规模2、用户行为数据生成2.1目标数据2.2埋点3、模拟数据3.1使用说明3.2集群日志生成脚本4、用户行为数据采集模块
温欣2030
·
2023-12-23 10:43
hadoop
CloudCanal x Debezium 打造实时数据流动新范式
CloudCanal近期实现了从Kafka消费Debezium格式数据,将其同步到StarRocks、Doris、Elasticsearch、MongoDB、ClickHouse等12种数据库和
数仓
,补全其数据到达能力
ClouGence
·
2023-12-22 16:48
CloudCanal
数据库
大数据
数据仓库
etl
Hive的联级(cascade)- 修改分区表的字段类型或者增加新字段
一、问题描述踩坑:
数仓
的分区表,由于需求需要,要把int类型的字段改为bigint,我直接执行的以下语句:altertabletable_namechangecolumn字段字段bigint;出现的问题
大数据点滴
·
2023-12-22 14:34
#
Hive
hive
字段类型
大数据
数据仓库-数据治理小厂实践
一、简介数据治理贯穿
数仓
中数据的整个生命周期,从数据的产生、加载、清洗、计算,再到数据展示、应用,每个阶段都需要对数据进行治理,像有些比较大的企业都是有自己的数据治理平台或者会开发一些便捷的平台,对于没有平台的公司
大数据点滴
·
2023-12-22 14:03
#
数据仓库
数据仓库
数据治理
一文读懂云原生一体化
数仓
简介:阿里云云原生一体化
数仓
产品技术深度解读。
阿里云云栖号
·
2023-12-22 07:19
云栖号技术分享
云原生
big
data
cloud
native
天津大数据培训机构品牌 数据分析师的发展方向
大数据专业还是有一定难度的,毕竟大数据开发技术所包含的编程
技术知识
是比较杂且多的如果是计算机专业的学生或者自身有一定基础的人学,相对来说会比较容易,但对于零基础小伙伴学习来说,想要学习大数据,难度还是很高的
qq_38453958
·
2023-12-22 03:49
大数据培训
天津大数据培训
天津大数据培训班
天津大数据培训机构
天津大数据培训学校
大数据培训
Impala 基于hive的交互式实时分析工具(二) 概念及原理介绍
impala和hive的区别概括:hive是【基于hadoop】的适合【离线批处理复杂sql分析的
数仓
工具】,impala是【基于hive】的适合【实时交互简单sql的
数仓
工具】执行计划1.hive:hive
章云邰
·
2023-12-22 01:34
Java入门基础知识点整理大放送,赶紧收藏吧!
为了方便大家学习JAVA,理顺java
技术知识
点,也可以助您尽快的努力成长起来,小编整理了以下JAVA入门基础知识,一起来学习吧!
知了堂_IT
·
2023-12-22 01:56
本地
数仓
项目(三)—— 数据可视化和任务调度
1背景本文基于《本地数据仓库项目(一)——
数仓
搭建详细流程》和《本地
数仓
项目(二)——搭建系统业务
数仓
详细流程》数据为依托,实现数据可视化和任务调度2构造可视化数据在mysql中新建ads_uv_count
不以物喜2020
·
2023-12-21 21:37
大数据数仓
数据仓库
数据分析
hive
Azkaban
任务调度
天软高频时序数据仓库
1天软高频时序
数仓
方案架构天软高频时序数据仓库是深圳天软科技开发有限公司专为金融用户提供的专业高频行情数据处理方案,集数据接入、检查、处理、存储、查询、订阅、计算于一体。
Tinysoft_SH
·
2023-12-21 18:51
数据仓库
区块链
时序数据库
数据库
数据库开发
大数据
Flink电商实时
数仓
(三)
DIM层代码流程图维度层的重点和难点在于实时电商
数仓
需要的维度信息一般是动态的变化的,并且由于实时
数仓
一般需要一直运行,无法使用常规的配置文件重启加载方式来修改需要读取的ODS层数据,因此需要通过Flink-cdc
十七✧ᐦ̤
·
2023-12-21 18:48
flink
linq
大数据
航空航天工业科研项目管理探析
航空航天型号的研制属于高新
技术知识
集成的复杂系统,从总体设计、结构设计到试飞定型,覆盖材料工程、航电控制、机械制造、电子、软件等多个学科,涉及到系统、子系统、组件、零件等多个层级,同时产业链上数以百计的企业以项目为驱动协同推进
捷为科技Jawave
·
2023-12-21 15:38
项目管理
Spring之手写IoC
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、回顾Java反射二、
哥的时代
·
2023-12-21 13:26
Spring
spring
python
java
spring之面向切面:AOP(1)
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、场景模拟1、声明接口
哥的时代
·
2023-12-21 13:26
Spring
spring
java
后端
spring之面向切面:AOP(2)
各位小伙伴,如果您:想系统/深入学习某
技术知识
点…一个人摸索学习很难坚持,想组团高效学习…想写博客但无从下手,急需写作干货注入能量…热爱写作,愿意让自己成为更好的人…文章目录前言一、基于注解的AOP1、
哥的时代
·
2023-12-21 13:22
Spring
spring
java
后端
基于 Flink 的典型 ETL 场景实现方案
目录1.实时
数仓
的相关概述1.1实时
数仓
产生背景1.2实时
数仓
架构1.3传统
数仓
vs实时
数仓
2.基于Flink实现典型的ETL场景2.1维表Join■2.1.1预加载维表方案1:方案2:■2.1.2热存储关联
话数Science
·
2023-12-21 11:59
Flink
大数据
Spark
flink
etl
大数据
数据中台之旅(五)数据开发介绍
功能介绍数据开发包含:作业开发(sqoop\hive\impala\python\shell)、实时开发(flink)、调度管理(工作流\定时调度\DAG查询)、日志管理(定时调度日志\作业运行日志)建设思路作业开发:
数仓
开发使用频率最高的一个功能
belialxing
·
2023-12-21 09:59
总结
数据平台
2019-05-24
周末取消钓鱼计划,继续学习
数仓
。晚上公司团建,吃了些垃圾食品,胃不舒服。晚12点就寝。
bigtian
·
2023-12-21 08:20
如何用CHAT写岗位职责概述?
由于他们的工作直接影响到产品或服务的运行效能和稳定性,因此他们必须拥有丰富的
技术知识
和经验、良好的团队管理能力。
慕斯女神
·
2023-12-20 19:14
服务器
运维
人工智能
CHAT
chatgpt
大数据
生活
【活动回顾】Databend 云
数仓
与 Databend Playground 扩展组件介绍
本次活动的核心议题为「Databend云
数仓
与DatabendPlayground扩展组件介绍」,此次分享由DatabendLabs的研发工程师尚卓燃担任主讲嘉宾,向与会者呈现了一场内容丰富的在线分享会
Databend
·
2023-12-20 13:02
数据库
云原生
上一页
6
7
8
9
10
11
12
13
下一页
按字母分类:
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z
其他