daxia665544

Hadoop+Spark大数据巨量分析与机器学习整合开发实战

ISBN 978-7-302-45375-8

简介

Hadoop

大数据存储与处理平台

HDFS（Hadoop Distributed File System）

批处理，而非实时互动处理。提高存取大量数据的能力，牺牲响应时间。

文件存储架构：

文件分割
区块（block）副本
机架（rack）感知

NameNode：管理和维护HDFS目录系统并控制文件的读写操作

DataNode：存储数据

Hadoop MapReduce

Map：将任务分割成更小任务，由每台服务器分别运行

Reduce：将所有服务器的运算结果汇总整理，返回最后结果

MapReduce2：YARN（Yet Another Resource Negotiator）

Spark

集群运算框架（基于内存）

MapReduce在运算时，需要将中间数据存储在硬盘中，导致磁盘I/O成为性能瓶颈，出现读写数据延迟的问题。

in-memory计算框架：

HDFS读取 -> 内存写入 -> 内存读取 -> 内存写入 -> 内存读取 -> HDFS写入

MapReduce：

HDFS读取 -> HDFS写入 -> HDFS读取 -> HDFS写入 -> HDFS读取 -> HDFS写入

弹性：

streaming数据流处理
SQL互动分析
MLlib机器学习
图表计算

安装

test on Debian 9.9 Linux 4.9.0-8-amd64

Hadoop single node cluster

JDK

Hadoop是Java开发的，首先安装JDK。

java -version

系统中已经有OpenJDK 1.8了，考虑到实验（分布式大规模数据函数依赖发现）要求，后面编译时需要兼容JDK 1.7。

查看安装路径，一般为/usr/lib/jvm/java-8-openjdk-amd64。

update-alternatives --display java

SSH

NameNode远程连接DataNode进行管理，安装SSH并设置为无需手动输入密码。

sudo apt-get install ssh
sudo apt-get install rsync

产生SSH Key

ssh-keygen -t rsa -C "youremail@example.com"

公钥加入许可证文件，从而无密码登录本机。

cat .ssh/id_rsa.pub >> .ssh/authorized_keys

Hadoop

wget http://archive.apache.org/dist/hadoop/common/hadoop-2.7.3/hadoop-2.7.3.tar.gz
sudo tar -zxvf hadoop-2.7.3.tar.gz
sudo mv hadoop-2.7.3 /usr/local/hadoop

在.bashrc中设置环境变量：

export JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64
export HADOOP_HOME=/usr/local/hadoop
export PATH=$PATH:$HADOOP_HOME/bin
export PATH=$PATH:$HADOOP_HOME/sbin
export HADOOP_MAPRED_HOME=$HADOOP_HOME
export HADOOP_COMMON_HOME=$HADOOP_HOME
export HADOOP_HDFS_HOME=$HADOOP_HOME
export YARN_HOME=$HADOOP_HOME
export HADOOP_COMMON_HOME=$HADOOP_HOME
export HADOOP_HDFS_HOME=$HADOOP_HOME
export YARN_HOME=$HADOOP_HOME
export HADOOP_COMMON_LIB_NATIVE_DIR=$HADOOP_HOME/lib/native
export HADOOP_OPTS="-Djava.library.path=$HADOOP_HOME/lib"
export JAVA_LIBRARY_PATH=$HADOOP_HOME/lib/native:$JAVA_LIBRARY_PATH

修改Hadoop配置文件

/usr/local/hadoop/etc/hadoop/hadoop-env.sh

必须显式给出。

# The java implementation to use.
#export JAVA_HOME=${JAVA_HOME}
export JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64

/usr/local/hadoop/etc/hadoop/core-site.xml



  fs.default.name
  hdfs://localhost:9000

/usr/local/hadoop/etc/hadoop/yarn-site.xml






  yarn.nodemanager.aux-services.mapreduce.shuffle.class
  org.apache.hadoop.mapred.ShuffleHandler

设置监控Map与Reduce程序的JobTracker任务分配情况以及JobTracker任务运行情况。

sudo cp /usr/local/hadoop/etc/hadoop/mapred-site.xml.template /usr/local/hadoop/etc/hadoop/mapred-site.xml



  mapreduce.framework.name
  yarn

/usr/local/hadoop/etc/hadoop/hdfs-site.xml



  dfs.replication
  3


  dfs.namenode.name.dir
  file:/usr/local/hadoop/hadoop_data/hdfs/namenode


  dfs.datanode.data.dir
  file:/usr/local/hadoop/hadoop_data/hdfs/datanode

创建并格式化HDFS目录

sudo mkdir -p /usr/local/hadoop/hadoop_data/hdfs/namenode
sudo mkdir -p /usr/local/hadoop/hadoop_data/hdfs/datanode
sudo chown username:groupname -R /usr/local/hadoop
hadoop namenode -format

启动

start-dfs.sh
start-yarn.sh

查看

Java Virtual Machine Process Status Tool：jps

Web：

Hadoop ResourceManager：http://localhost:8088/
HDFS：http://localhost:50070/

Hadoop Multi Node Cluster

通过复制Single Node Cluster创建多个虚拟主机代替实体服务器的方法可以作为演练，但是不能享受并行处理的优势。

下面不采用书上多个虚拟机的方法，而是实现一个本机作为master，在docker上建立多个slave的架构。

Docker

安装
设置sudo权限
使用国内仓库镜像站：在/etc/default/docker文件最后加一行DOCKER_OPTS="--registry-mirror=https://registry.docker-cn.com"
制作docker容器镜像，也可以去docker hub下载。

制作Single Node Cluster镜像

启动一个ubuntu容器：docker container run -it ubuntu bash

按Ctrl-d退出，查看容器id：docker container ls --all

复制Hadoop安装包：docker cp hadoop-2.7.3.tar.gz id:/root/

回到容器：docker container start -i id

一些辅助工作，然后重复Single Node Cluster的步骤：

apt-get update
apt-get install openjdk-8-jdk
apt-get install vim
apt-get install net-tools
apt-get install inetutils-ping
mkdir /run/sshd
echo /usr/sbin/sshd >> ~/.bashrc

保存为新镜像：docker commit -a "author" -m "hadoop single node cluster on ubuntu" id hadoop

制作slave服务器镜像

启动：docker container run -it hadoop

修改/usr/local/hadoop/etc/hadoop/core-site.xml：


  fs.default.name
  hdfs://master:9000

修改/usr/local/hadoop/etc/hadoop/yarn-site.xml：


  yarn.resourcemanager.resource-tracker.address
  master:8025


  yarn.resourcemanager.scheduler.address
  master:8030


  yarn.resourcemanager.address
  master:8050

修改/usr/local/hadoop/etc/hadoop/mapred-site.xml：



  mapred.job.tracker
  master:54311

修改/usr/local/hadoop/etc/hadoop/hdfs-site.xml：

把host的SSH Key写入~/.ssh/authorized_keys。

保存镜像：docker commit -a "author" -m "hadoop slave on ubuntu" id hadoop-slave

实例化三个镜像容器：

docker container run -it -h slave1 --name slave1 hadoop-slave
docker container run -it -h slave2 --name slave2 hadoop-slave
docker container run -it -h slave3 --name slave3 hadoop-slave

分别在三个容器中使用ifconfig查看ip，然后设置/etc/hosts。

设置master服务器

网络配置：

172.17.0.1  master
172.17.0.2  slave1
172.17.0.3  slave2
172.17.0.4  slave3

修改下列文件同slave服务器：

/usr/local/hadoop/etc/hadoop/core-site.xml

/usr/local/hadoop/etc/hadoop/yarn-site.xml

/usr/local/hadoop/etc/hadoop/mapred-site.xml

修改/usr/local/hadoop/etc/hadoop/hdfs-site.xml：

设置/usr/local/hadoop/etc/hadoop/slaves文件。

设置~/.ssh/config默认登录用户名为root。

启动

在每个服务器上删除并重建namenode和datanode目录后，在master上格式化并启动。

问题：当master直接在host os上时，遇到了8088显示3 nodes，而50070显示0 live nodes的问题，把master也放到docker上就没有问题。试了很多解决方案都不行，看来只能先在docker中的master上继续了。

Hadoop HDFS 命令

hadoop fs -*

Hadoop MapReduce

WordCount

计算文件中每一个英文单词出现的次数，包含如下几步：

Map：将文字转换为(key,value)，其中key是word，value是其出现次数
Shuffle：将相同的key排列在一起
Reduce：将相同key的value相加

编辑WordCount.java

设置环境变量

export PATH=${JAVA_HOME}/bin:${PATH}
export HADOOP_CLASSPATH=${JAVA_HOME}/lib/tools.jar

编译（书上第一条命令有误，javac的j不大写）

hadoop com.sun.tools.javac.Main WordCount.java
jar cf wc.jar WordCount*.class

创建测试文本

cp /usr/local/hadoop/LICENSE.txt input/
cd input
hadoop fs -mkdir -p /user/root/wordcount/input
hadoop fs -copyFromLocal LICENSE.txt /user/root/wordcount/input
hadoop fs -ls -R /

运行并查看

hadoop jar wc.jar WordCount /user/root/wordcount/input/LICENSE.txt /user/root/wordcount/output
hadoop fs -ls /user/root/wordcount/output
hadoop fs -cat /user/root/wordcount/output/part-r-00000 | more

缺点

设计模式不易用，API较低级，开发效率低
中间数据保存到硬盘，运行效率低
不支持实时处理，原始设计以批处理为主

Spark

Cluster Manager运行模式：

Local Machine
Spark Standalone Cluster
Hadoop YARN
云端（例如AWS的EC2平台）

安装Scala

wget https://www.scala-lang.org/files/archive/scala-2.10.4.tgz
tar xvf scala-2.10.4.tgz
sudo mv scala-2.10.4 /usr/local/scala

export SCALA_HOME=/usr/local/scala
export PATH=$PATH:$SCALA_HOME/bin

安装Spark

wget https://archive.apache.org/dist/spark/spark-2.1.3/spark-2.1.3-bin-hadoop2.7.tgz
tar zxf spark-2.1.3-bin-hadoop2.7.tgz
sudo mv spark-2.1.3-bin-hadoop2.7 /usr/local/spark

export SPARK_HOME=/usr/local/spark
export PATH=$PATH:$SPARK_HOME/bin

使用spark-shell启动可以看到Spark和Scala的版本，由于Spark内置Scala的原因，显示的Scala版本可能与之前安装的不同。

配置spark-shell显示信息：

cd /usr/local/spark/conf
cp log4j.properties.template  log4j.properties

把log4j.rootCategory的值由INFO改为WARN。

Local Machine

启动Hadoop之后执行spark-shell --master local[4]。

读取本地文件：

var textFile=sc.textFile("file:/usr/local/spark/README.md")
textFile.count

读取HDFS文件：

var textFile=sc.textFile("hdfs://master:9000/user/root/wordcount/input/LICENSE.txt")
textFile.count

Hadoop YARN

书上的Spark版本较旧，已经不再适用。

Spark Standalone Cluster

配置/usr/local/spark/conf/spark-env.sh：

# - SPARK_NICENESS      The scheduling priority for daemons. (Default: 0)
export SPARK_MASTER_IP=master
export SPARK_WORKER_CORES=1
export SPARK_WORKER_MEMORY=800m
export SPARK_WORKER_INSTANCES=2

把spark目录复制到slave结点：

ssh slave1
mdkir /usr/local/spark
exit
scp -r /usr/local/spark/ root@slave1:/usr/local

配置/usr/local/spark/conf/slaves同/usr/local/hadoop/etc/hadoop/slaves。

启动/usr/local/spark/sbin/start-all.sh，可以看到服务器数*worker实例数（3*2）共6个worker。

在Spark Standalone运行spark-shell：spark-shell --master spark://master:7077。

在Spark Standalone Web UIhttp://master:8080可以看到启动的worker和当前运行的程序spark-shell。

停止：/usr/local/spark/sbin/stop-all.sh。

Spark WordCount

mkdir -p /root/projects/wordcount/data
cd /root/projects/wordcount/data
vim test.txt

Apple Apple Orange
Banana Grape Grape

spark-shell

val textFile=sc.textFile("file:/root/projects/wordcount/data/test.txt")
val stringRDD=textFile.flatMap(line => line.split(" "))
val countsRDD=stringRDD.map(word => (word, 1)).reduceByKey(_ + _)
countsRDD.saveAsTextFile("file:/root/projects/wordcount/data/output")

转载于:https://www.cnblogs.com/humz/p/10825214.html

你可能感兴趣的:(Hadoop+Spark大数据巨量分析与机器学习整合开发实战)

【Python爬虫(15)】从0到1：Python爬虫实战攻克电商网站动态数据堡垒奔跑吧邓邓子 Python爬虫 python 爬虫开发语言电商网站动态数据
【Python爬虫】专栏简介：本专栏是Python爬虫领域的集大成之作，共100章节。从Python基础语法、爬虫入门知识讲起，深入探讨反爬虫、多线程、分布式等进阶技术。以大量实例为支撑，覆盖网页、图片、音频等各类数据爬取，还涉及数据处理与分析。无论是新手小白还是进阶开发者，都能从中汲取知识，助力掌握爬虫核心技能，开拓技术视野。目录一、引言二、准备工作2.1环境搭建2.2目标电商网站分析三、攻克登
DeepSeek-R1驱动下一代AIGC安全：全面解析智能内容合规审查技术体系与实战案例 Coderabo DeepSeek R1模型企业级应用 AIGC 安全
DeepSeek-R1赋能AIGC内容合规审查：技术实践与案例解析一、AIGC内容合规审查技术架构（此处展开约1500字的技术原理说明，涵盖深度学习模型、规则引擎、多模态检测等核心组件）二、核心实施步骤与代码实现1.文本内容预处理模块importrefromdeepseek_nlpimportTextCleanerdeftext_preprocessing(text):#特殊字符过滤cleaner
机器学习基本库之Pandas 莫名其妙 pandas 机器学习 python 数据分析
Pandas是机器学习中专门用于数据处理的库，遇到很多数据时首先要使用Pandas进行预处理得到我们想要的信息，下面让我们来看一下Pandas中有哪些操作importpandasfood_info=pandas.read_csv("food_info.csv")#将csv文件中的数据进行读取print(type(food_info))#pandas中的核心结构叫做DATAFRAMEprint(fo
【SQL】SQL多表查询天生爱打工 SQL sql 数据库
概念一般我们说的多表查询都涉及外键和父子表之间的关系。比如一对多:一般前面指的是父表后面指的是子表。⭐分类一对多(多对一)多对多一对一⭐一对多案例：部门与员工的关系关系：一个部门对应多个员工，一个员工对应一个部门实现：在多的一方建立外键，指向一的一方的主键(例如上一章节的SQL约束示例)⭐多对多案例：学生与课程的关系关系：一个学生可以选修多门课程，一门课程也可以供多个学生选择实现：建立第三张中间表
高效知识管理与分类优化指南：从目录设计到实践应用思考在马桶上笔记经验分享其他生活学习方法程序人生职场和发展
摘要本文旨在帮助读者在信息爆炸时代构建高效的知识管理体系，提供了知识收藏目录、浏览器书签和电脑文件夹的优化分类方案。知识收藏目录方案包括工作与项目、记录与日常、知识管理等八大类，具有边界清晰、扩展灵活、贴合实际场景等优势。浏览器书签分类方案注重高频工具置顶、设置临时缓冲区和标签辅助管理。电脑文件夹分类方案按角色划分，实行项目制管理，通用层级不超过三层。文章还给出了使用建议，并展望了未来结合AI助手
Elasticsearch字段类型 java编程小帅 Elasticsearch 大数据 java elasticsearch 搜索引擎
每个字段都有一个字段数据类型或字段类型。此类型指示字段包含的数据类型（如strings或boolean）及其预期用途。例如，可以将strings索引到text和keyword字段。但是，text字段值将被分析以进行全文搜索，而keyword字符串则保留原样以进行过滤和排序。字段类型按家庭分组。同一家庭中的类型支持相同的搜索功能，但可能具有不同的空间使用或性能特征。目前，唯一的类型家庭是keywor
深度求索（DeepSeek）：中国AGI领域的新锐探索者 .猫的树 AGI-通用人工智能 AGI 人工智能深度学习
文章目录引言：当AGI照进现实一、DeepSeek技术亮点解析1.1模型架构创新1.2性能对标国际巨头二、开源生态建设2.1开源全家桶2.2开发者友好设计三、应用场景展望3.1智能编程助手3.2企业级解决方案四、AGI之路的挑战与思考结语：中国AI的新范式讨论话题：引言：当AGI照进现实在ChatGPT掀起全球AI热潮的今天，一家名为深度求索（DeepSeek）的中国公司正以独特的技术路径冲击AG
架构设计之服务分级你一身傲骨怎能输架构设计网络服务分级
架构设计之服务分级具体游戏案例详细分析过程架构设计之服务分级具体游戏案例详细分析过程在游戏开发中，架构设计和服务分级是确保游戏稳定性、可用性和用户体验的关键因素。以下是一个具体的游戏案例分析过程，展示如何进行服务分级和架构设计。案例背景假设我们正在开发一款大型多人在线角色扮演游戏（MMORPG），该游戏包含多个模块和服务，如用户认证、游戏逻辑、实时聊天、支付系统和数据存储等。为了确保游戏的高可用性
网络安全：从攻击到防御的全景解析一ge科研小菜鸡运维网络
个人主页：一ge科研小菜鸡-CSDN博客期待您的关注1.引言在互联网高度发达的今天，网络安全已成为影响社会稳定、国家安全和企业发展的关键因素。无论是个人用户的数据隐私，还是企业的商业机密，亦或是国家关键基础设施（如电网、金融系统、医疗网络），都面临着网络攻击的潜在威胁。近年来，网络攻击的方式越来越多样化，攻击规模越来越大，防御技术也在不断升级。本文将从攻击者的视角出发，分析网络攻击的主要手段，并探
【有啥问啥】DeepSeek 技术原理详解有啥问啥大模型深度学习
DeepSeek技术原理详解DeepSeek是一款具有突破性技术的大型语言模型，其背后的技术原理涵盖了多个方面，以下是对其主要技术原理的详细介绍：架构创新多头潜在注意力机制（MLA）传送门链接:DeepSeekV3中的Multi-HeadLatentAttention(MLA)：技术解析与应用DeepSeek引入了多头潜在注意力机制（Multi-headLatentAttention,MLA），这
字节跳动AI编程神器Trae深度解读与使用研究 LCG元大模型 AI编程
一、引言在软件开发领域，编程工具的效率和智能化程度对开发者的工作成效有着深远影响。随着人工智能技术的飞速发展，AI编程工具应运而生，为开发者带来了全新的编程体验和更高的效率提升潜力。字节跳动于2025年1月19日正式发布的AI编程工具Trae，凭借其独特的功能设计和对中文开发者需求的深入理解，在开发者社区中引起了广泛关注。本研究将对Trae进行全面解读，并详细介绍其使用方法，旨在帮助开发者深入了解
字节跳动后端或大数据基础知识面试题及参考答案（2万字长文）大模型大数据攻城狮大数据大厂面试数据结构算法 leetcode
目录Redis的数据类型Redis数据类型的底层数据结构三次握手、四次挥手Redis持久化机制购物车为什么用Redis存，是永久存储吗MySQL的InnoDB索引数据结构哪些SQL的关键字会让索引失效队列、栈、数组、链表有什么不同讲讲爬虫的构成爬虫抓到的数据不清洗吗？不去重吗？对爬虫的更多了解Linux进程间通信机制进程和线程的区别线程私有的数据讲一下堆排序，每次调整的时间复杂度？堆排序是稳定的吗
Python线程安全队列的使用与优化：单队列与多队列处理的对比 kdayjj966 python 开发语言
在多线程编程中，队列（Queue）是一个非常重要的工具，尤其是在需要线程安全时。本文通过一个实际案例，讲解如何在Python中高效使用队列，并介绍优化代码以提升灵活性和可扩展性的方法。问题背景在多线程环境中，我们常常需要共享数据，并对其进行并发操作。例如，一个线程对数据进行加1操作，另一个线程对数据进行减1操作，最终希望数据能正确处理并输出。以下是一个使用单队列的简单案例：代码如下：importt
跨境电商平台如何借助API接口实现无缝支付集成 Elijah Laam 跨境电商人工智能大数据
随着全球化的加速和互联网技术的不断进步，跨境电商平台已经成为国际贸易的重要组成部分。在跨境电商平台的运营中，支付环节是至关重要的一环。为了提升用户体验，简化支付流程，跨境电商平台需要借助API（ApplicationProgrammingInterface，应用程序编程接口）接口实现无缝支付集成。本文将深入分析跨境电商平台如何借助API接口实现这一目标，并探讨其带来的诸多优势。一、API接口的基本
PostgreSQL认证指南 leegong23111 postgresql 数据库
PostgreSQL作为一款强大的开源关系型数据库，深受开发者和企业的青睐。获得PostgreSQL专家认证，不仅能提升个人在数据库领域的专业能力，还能为职业发展增添有力筹码。下面为大家详细介绍PostgreSQL专家认证的学习路径。一、深入理解基础知识·数据类型与存储：PostgreSQL支持多种数据类型，如常见的整数、浮点数、字符串，还有特殊的几何类型、JSON类型等。深入了解每种数据类型的存
文件上传绕过 clown_YZ 网络安全
1.准备upload-labs靶场（此篇文章仅针对pass-20）2.打开pass-20并查看上传代码3.对上传代码进行分析$is_upload=false;$msg=null;if(!empty($_FILES['upload_file'])){//检查MIME$allow_type=array('image/jpeg','image/png','image/gif');if(!in_array
栈（Stack）教学资料羊儿~ python 开发语言数据结构线性回归
目录1.栈的基本概念2.栈的操作3.栈的实现4.C++实现栈1.使用C++STL实现栈2.手动实现栈（基于数组）5.栈的复杂度分析6.栈的扩展7.练习题练习1.练习2.练习3.8.总结1.栈的基本概念栈（Stack）是一种常见的数据结构，它遵循后进先出（LIFO,LastInFirstOut）的原则。这意味着最后进入栈的元素会最先被取出。栈的操作主要发生在栈的顶部。2.栈的操作栈的基本操作包括：P
信息技术导论第二章物联网技术笔记新世紀渾水摸魚戰士信息技术导论笔记信息与通信
第二章物联网技术2.1物联网概述2.1.1物联网的基本概念物联网的定义是：通过射频识别（RFID）装置、红外感应器、全球定位系统、激光扫描器等信息传感设备，按约定的协议，把任何物品与互联网相连接，进行信息交换和通信，以实现智能化识别、定位、跟踪、监控和管理的一种网络。当每个而不是每种物品能够被唯一标识后，利用识别、通信和计算等技术，在互联网基础上，构建的连接各种物品的网络，就是人们常说的物联网。物
DeepSeek系列模型：高效能推理与多模态处理的技术突破与实践路径张3蜂人工智能开源技术选型人工智能开源机器人
目录引言一、高效能推理的核心技术路径二、多模态处理的技术创新三、技术协同与落地实践四、未来技术演进方向结论引言背景与挑战AI模型规模化趋势下，推理效率与多模态融合成为关键瓶颈。DeepSeek系列模型的定位：平衡性能、效率与多模态能力的技术创新者。核心命题如何通过架构设计与算法优化实现高效推理？如何突破模态边界实现跨模态语义理解与生成？一、高效能推理的核心技术路径轻量化模型架构设计动态稀疏注意力机
《2025：中国行业新方向与民营企业的使命》晚风る传媒
2025年，中国经济正站在新的历史节点上，科技创新、数字经济、绿色经济等成为发展的核心驱动力。在这样的背景下，2025年民营企业座谈会的召开，无疑为中国未来行业的发展指明了方向。本文将结合座谈会内容，探讨中国未来行业发展的新方向。一、数字经济：创新驱动的核心引擎数字经济已成为全球经济增长的重要引擎，而民营企业在其中扮演着关键角色。2025年，数字经济将继续深化，涵盖云计算、大数据、人工智能、物联网
网络安全：挑战、技术与未来发展一ge科研小菜鸡运维网络运维
个人主页：一ge科研小菜鸡-CSDN博客期待您的关注1.引言在数字化时代，网络安全（Cybersecurity）已成为全球关注的焦点。随着云计算、大数据、人工智能（AI）、物联网（IoT）等技术的发展，企业和个人的敏感数据在互联网上的流通日益增加，黑客攻击、数据泄露、勒索软件等网络安全威胁也日趋严峻。本文将从网络安全的核心概念、常见攻击手段、防御技术、企业安全策略以及未来发展趋势等方面，深入探讨如
DeepSeek 的创新融合：多行业应用实践探索 ♡喜欢做梦人工智能 deepseek
引言在数字化转型的浪潮中，技术的融合与创新成为推动各行业发展的关键力量。蓝耘平台作为行业内备受瞩目的创新平台，以其强大的资源整合能力和灵活的架构，为企业提供了高效的服务支持。而DeepSeek凭借先进的人工智能技术，在自然语言处理、数据分析等领域展现出卓越的性能。当蓝耘平台与DeepSeek携手，二者的优势互补为多行业解决方案带来了全新的应用实践方向，为企业解决复杂业务问题、提升运营效率提供了强大
CSDN C知道接入DeepSeek-R1满血版，赋能开发者高效智能编程与问题解决 CSDN资讯人工智能
CSDN宣布旗下C知道产品将接入深度求索（DeepSeek）人工智能大模型，通过植入“深度思考模式”，全面升级用户的AI搜索体验，重新定义智能编程场景。“CSDN积极整合行业顶尖技术能力，现已引入以DeepSeek为代表的推理大模型，并与C知道AI搜索产品深度融合，致力于为开发者提供更高效、更智能的技术解决方案与学习辅助工具，助力开发者提升效率、解决技术难题。”CSDN技术负责人表示，持续升级的A
望获实时Linux系统在低空经济中的关键作用分析望获linux 飞控Linux linux 开源软件语言模型低空经济
在现代经济发展的新赛道上，低空经济正以前所未有的势头迅速崛起，成为一个备受瞩目的创新领域。这一新兴的经济形态，通过充分挖掘低空空域资源，整合有人驾驶与无人驾驶航空器的多元化飞行活动，正在重构传统产业边界，描绘出一幅跨界融合的经济蓝图。国家为何如此重视并大力支持这一充满潜力的产业？低空经济的定义与特点低空经济可以视为通用航空的全新升级版本，是一个多维度、跨领域的综合性产业生态系统。它巧妙地整合了航空
Express 项目基础设施搭建 yqcoder javascript 开发语言 ecmascript
搭建一个基本的Express项目基础设施，涵盖项目初始化、依赖安装、目录结构设计、基本路由与中间件设置等步骤。1.初始化项目首先要创建一个新的项目目录，接着在该目录下初始化`package.json`文件，此文件用于管理项目的依赖和脚本。#创建项目目录mkdirexpress-project#进入项目目录cdexpress-project#初始化package.json文件npminit-y2.安
【DeepSeek】DeepSeek 如何应用于政务系统？深度求索者政务
DeepSeek作为一款高性能、低成本的AI大模型，近期在政务系统中得到了广泛应用，其技术能力和场景适配性正在推动数字政府的智能化转型。以下从应用场景、技术支撑、实际成效及未来方向等方面进行深度解析：一、核心应用场景智能公文处理政策解读与文件起草：DeepSeek基于自然语言处理（NLP）技术，可自动生成公文初稿，结合政务语境提取关键信息，生成拟办意见。例如，深圳市龙岗区的公文校对时间从人工5分钟
NoSQL数据库介绍与分类码农老起 nosql 数据库
目录一.NoSQL数据库的定义及其特点二.NoSQL的四种主要类型2.1文档型数据库（Document-BasedDatabase）2.2键值型数据库（Key-ValueStore）2.3列族型数据库（Column-FamilyStore）2.4图数据库（GraphDatabase）三.主要的NoSQL数据库3.1MongoDB3.2Redis3.3Cassandra3.4Neo4j四.使用NoS
CPP集群聊天服务器开发实践（七）：Github上传项目杨枝甘露小码 CPP集群聊天服务器开发服务器 github
github链接：GitHub-arduino-ctrl/ClusterServer:基于json+muduo+mysql+nginx+redis的集群服务器与客户端通信源码步骤如下：1.github新建代码仓库，复制url2.gitclonehttps://github.com/arduino-ctrl/ClusterServer.git3.将项目文件移动到ClusterServer文件夹里面m
CPP集群聊天服务器开发实践（一）：用户注册与登录杨枝甘露小码 CPP集群聊天服务器开发服务器 c++数据库单例模式
目录1客户端用户注册与登录1.1主要思想1.2网络层1.3业务层1.4数据层1.5测试结果1客户端用户注册与登录1.1主要思想实现网络层、业务层、数据层的解耦，提高系统的可维护性。网络层：主要实现对客户端连接、客户端读写请求的捕获与回调，将其分发到多个线程中执行。业务层：主要实现客户端读写请求回调的具体操作，当前阶段主要包含：登录业务、注册业务、用户异常退出业务数据层：主要实现数据库中表的CUAD
斜面摩擦系数测量仪产品特点及参数介绍 milaiyiqi 测试工具功能测试
COF-05斜面摩擦系数仪是一种专门用于测量物体与表面之间摩擦系数的精密设备。它通过模拟不同倾斜角度下的滑动情况，来计算两个接触面之间的摩擦力大小，进而得出摩擦系数。这项技术在材料科学、工程学以及质量控制领域有着广泛的应用。工作原理斜面摩擦系数仪的基本工作原理基于牛顿力学定律，尤其是重力和摩擦力的相互作用。测试时，将待测样品放置于一个可以调节角度的斜面上，然后逐渐增加斜面的角度直到样品开始滑动。根
如何用ruby来写hadoop的mapreduce并生成jar包 wudixiaotie mapreduce
ruby来写hadoop的mapreduce，我用的方法是rubydoop。怎么配置环境呢： 1.安装rvm：不说了网上有 2.安装ruby：由于我以前是做ruby的，所以习惯性的先安装了ruby，起码调试起来比jruby快多了。 3.安装jruby： rvm install jruby然后等待安
java编程思想 -- 访问控制权限百合不是茶 java 访问控制权限单例模式
访问权限是java中一个比较中要的知识点,它规定者什么方法可以访问,什么不可以访问一:包访问权限; 自定义包: package com.wj.control; //包 public class Demo { //定义一个无参的方法 public void DemoPackage(){ System.out.println("调用
[生物与医学]请审慎食用小龙虾 comsci 生物
现在的餐馆里面出售的小龙虾,有一些是在野外捕捉的,这些小龙虾身体里面可能带有某些病毒和细菌,人食用以后可能会导致一些疾病,严重的甚至会死亡..... 所以,参加聚餐的时候,最好不要点小龙虾...就吃养殖的猪肉,牛肉,羊肉和鱼,等动物蛋白质
org.apache.jasper.JasperException: Unable to compile class for JSP: 商人shang maven 2.2 jdk1.8
环境： jdk1.8 maven tomcat7-maven-plugin 2.0 原因： tomcat7-maven-plugin 2.0 不知吃 jdk 1.8，换成 tomcat7-maven-plugin 2.2就行，即 <plugin>
你的垃圾你处理掉了吗?GC oloz GC
前序:本人菜鸟，此文研究学习来自网络，各位牛牛多指教　 1.垃圾收集算法的核心思想　　Java语言建立了垃圾收集机制，用以跟踪正在使用的对象和发现并回收不再使用(引用)的对象。该机制可以有效防范动态内存分配中可能发生的两个危险：因内存垃圾过多而引发的内存耗尽，以及不恰当的内存释放所造成的内存非法引用。　　垃圾收集算法的核心思想是：对虚拟机可用内存空间，即堆空间中的对象进行识别
shiro 和 SESSSION 杨白白 shiro
shiro 在web项目里默认使用的是web容器提供的session，也就是说shiro使用的session是web容器产生的，并不是自己产生的，在用于非web环境时可用其他来源代替。在web工程启动的时候它就和容器绑定在了一起，这是通过web.xml里面的shiroFilter实现的。通过session.getSession()方法会在浏览器cokkice产生JESSIONID，当关闭浏览器，此
移动互联网终端淘宝客如何实现盈利小桔子移動客戶端淘客淘寶App
2012年淘宝联盟平台为站长和淘宝客带来的分成收入突破30亿元，同比增长100%。而来自移动端的分成达1亿元，其中美丽说、蘑菇街、果库、口袋购物等App运营商分成近5000万元。可以看出，虽然目前阶段PC端对于淘客而言仍旧是盈利的大头，但移动端已经呈现出爆发之势。而且这个势头将随着智能终端(手机，平板)的加速普及而更加迅猛
wordpress小工具制作 aichenglong wordpress 小工具
wordpress 使用侧边栏的小工具，很方便调整页面结构小工具的制作过程 1 在自己的主题文件中新建一个文件夹(如widget)，在文件夹中创建一个php(AWP_posts-category.php) 小工具是一个类,想侧边栏一样，还得使用代码注册，他才可以再后台使用，基本的代码一层不变 <?php class AWP_Post_Category extends WP_Wi
JS微信分享 AILIKES js
// 所有功能必须包含在 WeixinApi.ready 中进行 WeixinApi.ready(function(Api) { // 微信分享的数据 var wxData = { &nb
封装探讨百合不是茶 JAVA面向对象封装
//封装属性方法将某些东西包装在一起，通过创建对象或使用静态的方法来调用，称为封装；封装其实就是有选择性地公开或隐藏某些信息，它解决了数据的安全性问题，增加代码的可读性和可维护性在 Aname类中申明三个属性，将其封装在一个类中：通过对象来调用例如 1： //属性将其设为私有姓名 name 可以公开
jquery radio/checkbox change事件不能触发的问题 bijian1013 JavaScript jquery
我想让radio来控制当前我选择的是机动车还是特种车，如下所示： <html> <head> <script src="http://ajax.googleapis.com/ajax/libs/jquery/1.7.1/jquery.min.js" type="text/javascript"><
AngularJS中安全性措施 bijian1013 JavaScript AngularJS 安全性 XSRF JSON漏洞
在使用web应用中，安全性是应该首要考虑的一个问题。AngularJS提供了一些辅助机制，用来防护来自两个常见攻击方向的网络攻击。一.JSON漏洞当使用一个GET请求获取JSON数组信息的时候（尤其是当这一信息非常敏感，
[Maven学习笔记九]Maven发布web项目 bit1129 maven
基于Maven的web项目的标准项目结构 user-project user-core user-service user-web src
【Hive七】Hive用户自定义聚合函数(UDAF) bit1129 hive
用户自定义聚合函数，用户提供的多个入参通过聚合计算(求和、求最大值、求最小值)得到一个聚合计算结果的函数。问题：UDF也可以提供输入多个参数然后输出一个结果的运算，比如加法运算add(3，5)，add这个UDF需要实现UDF的evaluate方法,那么UDF和UDAF的实质分别究竟是什么？ Double evaluate(Double a, Double b)
通过 nginx-lua 给 Nginx 增加 OAuth 支持 ronin47
前言：我们使用Nginx的Lua中间件建立了OAuth2认证和授权层。如果你也有此打算，阅读下面的文档，实现自动化并获得收益。SeatGeek 在过去几年中取得了发展，我们已经积累了不少针对各种任务的不同管理接口。我们通常为新的展示需求创建新模块，比如我们自己的博客、图表等。我们还定期开发内部工具来处理诸如部署、可视化操作及事件处理等事务。在处理这些事务中，我们使用了几个不同的接口来认证： &n
利用tomcat-redis-session-manager做session同步时自定义类对象属性保存不上的解决方法 bsr1983 session
在利用tomcat-redis-session-manager做session同步时，遇到了在session保存一个自定义对象时，修改该对象中的某个属性，session未进行序列化，属性没有被存储到redis中。在 tomcat-redis-session-manager的github上有如下说明： Session Change Tracking As noted in the &qu
《代码大全》表驱动法-Table Driven Approach-1 bylijinnan java 算法
关于Table Driven Approach的一篇非常好的文章： http://www.codeproject.com/Articles/42732/Table-driven-Approach package com.ljn.base; import java.util.Random; public class TableDriven { public
Sybase封锁原理 chicony Sybase
昨天在操作Sybase IQ12.7时意外操作造成了数据库表锁定，不能删除被锁定表数据也不能往其中写入数据。由于着急往该表抽入数据，因此立马着手解决该表的解锁问题。无奈此前没有接触过Sybase IQ12.7这套数据库产品，加之当时已属于下班时间无法求助于支持人员支持，因此只有借助搜索引擎强大的
java异常处理机制 CrazyMizzz java
java异常关键字有以下几个，分别为 try catch final throw throws 他们的定义分别为 try： Opening exception-handling statement. catch： Captures the exception. finally： Runs its code before terminating
hive 数据插入DML语法汇总 daizj hive DML 数据插入
Hive的数据插入DML语法汇总1、Loading files into tables语法：1) LOAD DATA [LOCAL] INPATH 'filepath' [OVERWRITE] INTO TABLE tablename [PARTITION (partcol1=val1, partcol2=val2 ...)]解释：1)、上面命令执行环境为hive客户端环境下： hive>l
工厂设计模式 dcj3sjt126com 设计模式
使用设计模式是促进最佳实践和良好设计的好办法。设计模式可以提供针对常见的编程问题的灵活的解决方案。工厂模式工厂模式（Factory）允许你在代码执行时实例化对象。它之所以被称为工厂模式是因为它负责“生产”对象。工厂方法的参数是你要生成的对象对应的类名称。 Example #1 调用工厂方法（带参数） <?phpclass Example{
mysql字符串查找函数 dcj3sjt126com mysql
FIND_IN_SET(str,strlist) 假如字符串str 在由N 子链组成的字符串列表strlist 中，则返回值的范围在1到 N 之间。一个字符串列表就是一个由一些被‘,’符号分开的自链组成的字符串。如果第一个参数是一个常数字符串，而第二个是type SET列，则 FIND_IN_SET() 函数被优化，使用比特计算。如果str不在strlist 或st
jvm内存管理 easterfly jvm
一、JVM堆内存的划分分为年轻代和年老代。年轻代又分为三部分：一个eden,两个survivor。工作过程是这样的：e区空间满了后，执行minor gc，存活下来的对象放入s0, 对s0仍会进行minor gc，存活下来的的对象放入s1中，对s1同样执行minor gc，依旧存活的对象就放入年老代中；年老代满了之后会执行major gc，这个是stop the word模式，执行
CentOS-6.3安装配置JDK-8 gengzg centos
JAVA_HOME=/usr/java/jdk1.8.0_45 JRE_HOME=/usr/java/jdk1.8.0_45/jre PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar:$JRE_HOME/lib export JAVA_HOME
【转】关于web路径的获取方法 huangyc1210 Web 路径
假定你的web application 名称为news,你在浏览器中输入请求路径： http://localhost:8080/news/main/list.jsp 则执行下面向行代码后打印出如下结果： 1、 System.out.println(request.getContextPath()); //可返回站点的根路径。也就是项
php里获取第一个中文首字母并排序远去的渡口数据结构 PHP
很久没来更新博客了，还是觉得工作需要多总结的好。今天来更新一个自己认为比较有成就的问题吧。最近在做储值结算，需求里结算首页需要按门店的首字母A-Z排序。我的数据结构原本是这样的： Array ( [0] => Array ( [sid] => 2885842 [recetcstoredpay] =&g
java内部类 hm4123660 java 内部类匿名内部类成员内部类方法内部类
　在Java中，可以将一个类定义在另一个类里面或者一个方法里面，这样的类称为内部类。内部类仍然是一个独立的类，在编译之后内部类会被编译成独立的.class文件，但是前面冠以外部类的类名和$符号。内部类可以间接解决多继承问题,可以使用内部类继承一个类，外部类继承一个类，实现多继承。 &nb
Caused by: java.lang.IncompatibleClassChangeError: class org.hibernate.cfg.Exten zhb8015
maven pom.xml关于hibernate的配置和异常信息如下，查了好多资料，问题还是没有解决。只知道是包冲突，就是不知道是哪个包....遇到这个问题的分享下是怎么解决的。。 maven pom: <dependency> <groupId>org.hibernate</groupId> <ar
Spark 性能相关参数配置详解－任务调度篇 Stark_Summer spark cache cpu 任务调度 yarn
随着Spark的逐渐成熟完善, 越来越多的可配置参数被添加到Spark中来, 本文试图通过阐述这其中部分参数的工作原理和配置思路, 和大家一起探讨一下如何根据实际场合对Spark进行配置优化。由于篇幅较长，所以在这里分篇组织，如果要看最新完整的网页版内容，可以戳这里：http://spark-config.readthedocs.org/，主要是便
css3滤镜 wangkeheng html css
经常看到一些网站的底部有一些灰色的图标，鼠标移入的时候会变亮，开始以为是js操作src或者bg呢，搜索了一下，发现了一个更好的方法：通过css3的滤镜方法。 html代码： <a href='' class='icon'><img src='utv.jpg' /></a> css代码： .icon{-webkit-filter: graysc

按字母分类： A B C D E F G H I J K L M N O P Q R S T U V W X Y Z 其他