E-COM-NET
首页
在线工具
Layui镜像站
SUI文档
联系我们
推荐频道
Java
PHP
C++
C
C#
Python
Ruby
go语言
Scala
Servlet
Vue
MySQL
NoSQL
Redis
CSS
Oracle
SQL Server
DB2
HBase
Http
HTML5
Spring
Ajax
Jquery
JavaScript
Json
XML
NodeJs
mybatis
Hibernate
算法
设计模式
shell
数据结构
大数据
JS
消息中间件
正则表达式
Tomcat
SQL
Nginx
Shiro
Maven
Linux
spark性能调优
最In干货大赏,SDCC 2017·深圳站完整版日程大放送
秉承干货实料的内容原则,邀请业内顶尖的架构师和数据技术专家,共话高可用/高并发/高性能的系统架构设计、分布式缓存服务、WebApp前端架构、消息引擎架构、弹性计算、大数据平台构建、优化提升大数据平台的各项性能、
Spark
仲培艺
·
2024-01-02 07:00
SDCC
深圳
日程
架构
大数据
最容易出错的 Hive Sql 详解
前言在进行数仓搭建和数据分析时最常用的就是sql,其语法简洁明了,易于理解,目前大数据领域的几大主流框架全部都支持sql语法,包括hive,
spark
,flink等,所以sql在大数据领域有着不可替代的作用
奔跑者-辉
·
2024-01-02 07:30
hive
hive
sql
大数据
Intellij之
Spark
Scala开发环境搭建
https://www.jianshu.com/p/200473f264bchttps://blog.csdn.net/a2011480169/article/details/52712421参考博客:1、http://wwwlouxuemingcom.blog.163.com/blog/static/20974782201321953144457/2、http://blog.csdn.net/s
数据萌新
·
2024-01-02 06:27
用idea开发我们的
spark
项目
那么,你有必要花点时间,瞧一瞧这篇文章,正所谓,“工欲善其事,必先利其器”,它将指导你一步一步用idea开发出我们的
spark
程序,用maven编译打包我们的Scala(Scala与Java混合)代码。
NikolasNull
·
2024-01-02 00:46
Spark
项目实战-卡口流量统计
一、卡口介绍卡口摄像头正对车道安装,拍摄正面照片。功能:抓拍正面特征这种摄像头多安装在国道、省道、高速公路的路段上、或者城区和郊区交接的主要路口,用来抓拍超速、进出城区车辆等行为。它进行的是车辆正面抓拍,可以清晰地看到驾驶员及前台乘客的面容及行为。有一些则是专门摄像车的尾部,所以当车开过此类测速摄像头后不要马上提速,建议至少要跑出500米后再提速。这就是有人认为的没有超速为什么也照样被拍的原因。此
oifengo
·
2024-01-02 00:03
1024程序员节
Spark
SQL技巧-json数据操作
文章目录1、背景2from_json指定Schema3schema_of_json获取Schemapy
spark
案例1、背景有以下jason{"status":"0x0000","msg":"执⾏成功"
oifengo
·
2024-01-02 00:32
json
2023.12.31 Python 词频统计
练习:使用Python中的filter、map、reduce实现词频统计样例数据:helloworldjavapythonjavajavahadoop
spark
spark
python需求分析:1-文件中有如上的示例数据
白白的wj
·
2024-01-01 23:40
python
开发语言
学习
大数据
Day 24-重启商业捕鲸,日本要“竭泽而渔”?
标题:JapantoleaveInternationalWhaleCommission,resumecommercialhuntresume重新开始,继续进行...
spark
ingswiftcondemnationfromothergovernmentsandconservationgroupscondemnation
ShirleyYi
·
2024-01-01 22:00
Spark
高并发写Redis方案
需求利用
Spark
分布式集群强悍能力,实现高QPS写入Redis能力,QPS在一定范围内支持线性扩展。注意解决RedisPool不能序列化问题。
Only you, only you!
·
2024-01-01 21:54
大数据基础知识
redis
spark
Docker容器中配置和启用Java Flight Recorder(JFR)
1.简介和背景在Java应用程序
性能调优
中,JavaFlightRecorder(JFR)是一个非常强大的工具。它能够实时收集Java应用程序的运行数据,提供有关性能问题的深入见解。
ivwdcwso
·
2024-01-01 16:42
运维
docker
java
python
Spark
大数据分析与实战笔记(第二章
Spark
基础-01)
文章目录第2章
Spark
基础章节概要2.1初识
Spark
2.1.1
Spark
概述2.1.2
Spark
的特点2.1.3
Spark
应用场景2.1.4
Spark
与Hadoop对比第2章
Spark
基础章节概要
Spark
想你依然心痛
·
2024-01-01 14:16
#
Spark大数据分析与实战
spark
详解大数据数据仓库分层架构
大数据数据仓库是基于HIVE构建的数据仓库,分布文件系统为HDFS,资源管理为Yarn,计算引擎主要包括MapReduce/Tez/
Spark
等,分层架构如下:1、数据来源层:日志或者关系型数据库,并通过
Alukar
·
2024-01-01 14:47
大数据编程期末大作业
目录一、Hadoop基础操作二、RDD编程三、
Spark
SQL编程四、
Spark
Streaming编程五、Flume的安装配置一、Hadoop基础操作按要求完成以下操作:1、在HDFS中创建目录/user
Francek Chen
·
2024-01-01 14:50
Spark编程基础
spark
大数据
分布式
Spark
内容分享(三):
Spark
- 介绍及使用 Scala、Java、Python 三种语言演示
目录一、
Spark
1.
Spark
的优点:2.
Spark
中的组件3.
Spark
和Hadoop对比4.
Spark
运行模式二、
Spark
WordCount演示1.Scala语言2.Java语言3.Python
之乎者也·
·
2024-01-01 13:19
Spark
内容分享
大数据(Hadoop)内容分享
spark
scala
java
Spark
内容分享(一):
Spark
入门指南:
Spark
是什么
目录
Spark
是什么
Spark
基本概念
Spark
执行流程
Spark
运行模式RDD详解CheckPoint在这个数据驱动的时代,信息的处理和分析变得越来越重要。
之乎者也·
·
2024-01-01 13:48
Spark
内容分享
大数据(Hadoop)内容分享
spark
大数据
分布式
Spark
内容分享(二):
Spark
入门指南:基础概念
目录
Spark
-Submit
Spark
共享变量
Spark
SQL
Spark
StreamingStructuredStreaming总结
Spark
-Submit详细参数说明参数名参数说明—mastermaster
之乎者也·
·
2024-01-01 13:48
Spark
内容分享
大数据(Hadoop)内容分享
spark
大数据
分布式
20200912 001_Flink-Flink简介
20200912001_Flink-Flink简介第一章Flink简介主要内容•Flink是什么•为什么要用Flink•流处理的发展和演变•Flink的主要特点•Flinkvs
Spark
Streaming1.1
强哥带你飞
·
2024-01-01 13:02
Flink
Flink
大数据
2022-03-03
Spark
读取csv 全为NULL
#读取数据talrat=
spark
.read.csv("/data/talrat0225.csv",header=True,enforceSchema=True,sep=',',encoding='gb18030
Sharon_0403
·
2024-01-01 13:45
Flink Job 执行流程
FlinkOnYarn模式基于Yarn层面的架构类似
Spark
onYarn模式,都是由Client提交App到RM上面去运行,然后RM分配第一个container去运行AM,然后由AM去负责资源的监督和管理
程序猿进阶
·
2024-01-01 12:24
Flink
flink
大数据
java
面试
后端
性能优化
spark
(六)
Spark
SQL读写本地外部数据源
https://
spark
-packages.org/里有很多third-party数据源的package,
spark
把包加载进来就可以使用了csv格式在
spark
2.0版本之后是内置的,2.0之前属于第三方数据源一
白面葫芦娃92
·
2024-01-01 11:58
Spark
各组件功能简单理解(quick start)
各个组件conf/
spark
-env.sh配置
spark
的环境变量conf/
spark
-default.conf配置
spark
应用默认的配置项和
spark
-env.sh有重合之处,可在提交应用时指定要用的配置文件
祗談風月
·
2024-01-01 10:48
go语言切片详解,初始化、扩容、限容、底层
原文链接:https://www.cnblogs.com/
spark
dev/p/10704614.html切片(slice)是Golang中一种比较特殊的数据结构,这种数据结构更便于使用和管理数据集合。
Aiky哇
·
2024-01-01 10:59
go
go
Golang切片学习笔记
转载地址:https://studygolang.com/articles/31219,https://www.cnblogs.com/
spark
dev/p/10704614.html1切片的创建和初始化在
chc960609
·
2024-01-01 10:28
Golang
golang
介绍 Apache
Spark
的基本概念和在大数据分析中的应用。
Spark
的基本概念包括:弹性分布式数据集(ResilientDistributedDataset,简称RDD):它是
Spark
的核心数据结构,代表分布在集群中的可并行处理的数据集,可以在内存中存储。
程序猿~厾罗
·
2024-01-01 10:56
spark
数据分析
spark
数据分析
大数据
一文详解py
spark
常用算子与API
嵌套按照分区来进行rdd=sc.parallelize([1,2,3,4,5,6,7,8,9],2)print(rdd.glom().collect())输出:[[1,2,3,4],[5,6,7,8,9]]参考Py
Spark
不负长风
·
2024-01-01 10:25
数据分析
spark
最新ChatGPT网站源码,支持Midjourney绘画,GPT语音对话+GPT-4识图理解能力+ChatFile文档对话总结+DALL-E3文生图
一、前言
Spark
Ai创作系统是基于ChatGPT进行开发的Ai智能问答系统和Midjourney绘画系统,支持OpenAI-GPT全模型+国内AI全模型。
白云如幻
·
2024-01-01 08:59
人工智能
ChatGPT
网站源码
人工智能
chatgpt
语音识别
midjourney
计算机毕业设计hadoop+
spark
+hive知识图谱酒店推荐系统 酒店数据分析可视化大屏 酒店爬虫 高德地图API 酒店预测系统 大数据毕业设计
mysql中旅游数据进行数据清洗,使用高德API计算地理信息,最终转为.csv文件上传hdfs;3.hive建库建表导入.csv文件作为数据集;4.一半指标使用离线hive_sql分析完成,一半指标使用实时
Spark
计算机毕业设计大神
·
2024-01-01 06:52
Flink 内容分享(二十八):深度解析 Flink 是如何管理好内存的?
最着名的例子是ApacheHadoop,还有较新的框架,如Apache
Spark
、ApacheDrill、ApacheFlink。基于JVM的数据
之乎者也·
·
2024-01-01 05:23
Flink
内容分享
大数据(Hadoop)内容分享
flink
大数据
Flink 内容分享(二十七):Hadoop vs
Spark
vs Flink——大数据框架比较
大数据开发离不开各种框架,我们通过学习ApacheHadoop、
Spark
和Flink之间的特征比较,可以从侧面了解要学习的内容。
之乎者也·
·
2024-01-01 05:52
Flink
内容分享
大数据(Hadoop)内容分享
大数据
flink
hadoop
Spark
- 动态注册UDF
昨天有位大哥问小弟一个
Spark
问题,他们想在不停
Spark
程序的情况下动态更新UDF的逻辑,他一问我这个问题的时候,本猪心里一惊,
Spark
**还能这么玩?
kikiki2
·
2024-01-01 05:07
Spark
: 在master节点开启worker进程(将master当做slave节点来使用)
1.进入master节点:
spark
2/conf然后:vislaves对其他的slave节点进行同样的操作。
玉成226
·
2024-01-01 04:56
spark
大数据
分布式
二:
Spark
是什么?
(本人初次接触
spark
可能有些地方理解的不够到位,希望各位读者多多指正,对于不恰当的地方也会进行改进)一、
spark
:快速通用的大规模数据处理引擎。
玉成226
·
2024-01-01 04:26
【Spark】
spark
大数据
分布式
spark
(三):
spark
的数据读取和保存
一、
spark
支持的文件格式1、文本文件,每行一条记录使用sc.textFile来读取一个文件,使用saveAsTextFile方法将RDD保存为一个文件2、JSON格式文件,大多是每行一条记录这里需要注意是每一行是一个
_NeutronStar
·
2024-01-01 04:12
Spark
从入门到精通17:RDD的依赖关系
Spark
任务将一系列RDD(算子)组成一张有向无环图(DAG)。这些RDD之间会有一定的依赖关系,并且根据RDD之间的依赖关系来划分
Spark
任务的阶段(Stage)。
金字塔下的小蜗牛
·
2024-01-01 04:21
使用Docker安装Hadoop和
spark
使用docker配置安装hadoop和
spark
分别安装hadoop和
spark
镜像安装hadoop镜像选择的docker镜像地址,这个镜像提供的hadoop版本比较新,且安装的是jdk8,可以支持安装最新版本的
zealscott
·
2024-01-01 01:26
D.3 基于ERNIR3.0文本分类以CAIL2018-SMALL数据集罪名预测任务为例【多标签】
NLP专栏简介:数据增强、智能标注、意图识别算法|多分类算法、文本信息抽取、多模态信息抽取、可解释性分析、
性能调优
、模型压缩算法等专栏详细介绍:NLP专栏简介:数据增强、智能标注、意图识别算法|多分类算法
汀、人工智能
·
2023-12-31 23:22
分类
人工智能
机器学习
自然语言处理
算法
如何制定 Java
性能调优
标准?
Java
性能调优
全攻略来啦!我有一个朋友,有一次他跟我说,他们公司的系统从来没有经过
性能调优
,功能测试完成后就上线了,线上也没有出现过什么性能问题呀,那为什么很多系统都要去做
性能调优
呢?
java菜
·
2023-12-31 22:38
(转)Java
性能调优
:JMC性能分析
Java
性能调优
作为大型分布式系统提供高性能服务的必修课,其重要性不言而喻。好的分析工具能起到事半功倍的效果,利用分析利器JMC、JFR,可以实现性能问题的准确定位。
_王子_
·
2023-12-31 21:57
spark
streamnig实时处理入门
1.2
Spark
Streaming实时处理入门1.2.1工程创建导入maven依赖 org.apache.
spark
spark
-streaming_2.12 3.1.2 org.apache.
spark
Guff_hys
·
2023-12-31 18:47
spark
大数据
分布式
开发语言
后端
css3
jquery
2022-11-24 TIDB insert into on duplicate操作突然吞吐量降低
5ace0db02e29b3233ef3670c4ae02f7.png之前是发现有大量死锁,但是
spark
streaming程序处理速度还可以。image.png但是处理速度一直在4000/S左右。
felix_feng
·
2023-12-31 18:29
56.常用shell之 free - 查看内存使用情况 的用法及衍生用法
这个命令对于监控系统资源和
性能调优
非常有用。
三水青一人尤
·
2023-12-31 13:09
linux
服务器
运维
hive
sql
优化你的Java代码:
性能调优
技巧
Java是一种高级编程语言,随着云计算、大数据、人工智能等新一代计算技术的普及和发展,Java编程在企业级应用和数据处理方面的重要性越来越突出。优化Java代码是提高程序性能、加快运行速度的关键所在。本文将带您了解几种Java优化的技巧。使用基本类型insteadof包装类型Java中的基本类型(如int、float等)和包装类型(如Integer、Float等)存在差异。基本类型的数据直接存储在
naer_chongya
·
2023-12-31 12:56
java
开发语言
33、
Spark
内核源码深度剖析之
Spark
Context原理剖析与源码分析
原理剖析
Spark
Context原理剖析.png源码解读本系列文章
spark
版本为1.3.0入口org.apache.
spark
.
Spark
Context
Spark
Context要点TaskScheduler
ZFH__ZJ
·
2023-12-31 10:38
Zookeeper集群搭建
系列文章目录Ubuntu常见基本问题Hadoop3.1.3安装(单机、伪分布)Hadoop集群搭建HBase2.2.2安装(单机、伪分布)Zookeeper集群搭建HBase集群搭建
Spark
安装和编程实践
WE-ubytt
·
2023-12-31 08:53
大数据处理与应用
zookeeper
hadoop
大数据
Spark
的错误处理与调试技巧
Apache
Spark
是一个强大的分布式计算框架,用于处理大规模数据。在开发和运行
Spark
应用程序时,经常会遇到各种错误和问题。了解
Spark
的错误处理与调试技巧是解决这些问题的关键。
晓之以理的喵~~
·
2023-12-31 07:52
Spark
spark
ajax
大数据
Spark
作业的调度与执行流程
Apache
Spark
是一个分布式计算框架,用于处理大规模数据。了解
Spark
作业的调度与执行流程是构建高效分布式应用程序的关键。
晓之以理的喵~~
·
2023-12-31 07:22
Spark
spark
大数据
分布式
Spark
应用程序的结构与驱动程序
Apache
Spark
是一个强大的分布式计算框架,用于处理大规模数据。了解
Spark
应用程序的结构和驱动程序是构建高效应用的关键。
晓之以理的喵~~
·
2023-12-31 07:21
Spark
spark
大数据
分布式
Spark
任务调度与数据本地性
Apache
Spark
是一个分布式计算框架,用于处理大规模数据。了解
Spark
任务调度与数据本地性是构建高效分布式应用程序的关键。
晓之以理的喵~~
·
2023-12-31 07:21
Spark
spark
大数据
分布式
Spark
编程实验四:
Spark
Streaming编程
目录一、目的与要求二、实验内容三、实验步骤1、利用
Spark
Streaming对三种类型的基本数据源的数据进行处理2、利用
Spark
Streaming对Kafka高级数据源的数据进行处理3、完成DStream
Francek Chen
·
2023-12-31 06:24
Spark编程基础
spark
大数据
分布式
Spark
Streaming
【
Spark
精讲】一文讲透
Spark
SQL聚合过程以及UDAF开发
Spark
SQL聚合过程这里的Partial方式表示聚合函数的模式,能够支持预先局部聚合,这方面的内容会在下一节详细介绍。
话数Science
·
2023-12-31 06:48
Spark精讲
Spark
大数据
spark
hive
大数据
上一页
26
27
28
29
30
31
32
33
下一页
按字母分类:
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z
其他