运维派V

搞定 Linux Shell 文本处理工具，看完这篇集锦就够了

Linux Shell是一种基本功，由于怪异的语法加之较差的可读性，通常被Python等脚本代替。既然是基本功，那就需要掌握，毕竟学习Shell脚本的过程中，还是能了解到很多Linux系统的内容。

Linux脚本大师不是人人都可以达到的，但是用一些简单的Shell实现一些常见的基本功能还是很有必要的。

下面我介绍Linux下使用Shell处理文本时最常用的工具：

1、find 文件查找

查找txt和pdf文件

  find . ( -name "*.txt" -o -name "*.pdf" ) -print

正则方式查找.txt和pdf

  find . -regex  ".*(.txt|.pdf)$"

-iregex：忽略大小写的正则

否定参数

   find . ! -name "*.txt" -print

指定搜索深度

  find . -maxdepth 1 -type f

定制搜索

按类型搜索：

  find . -type d -print  //只列出所有目录

-type f 文件 / l 符号链接

按时间搜索：

  find . -atime 7 -type f -print

按大小搜索：

  find . -type f -size +2k

按权限查找：

  find . -type f -perm 644 -print //找具有可执行权限的所有文件

按用户查找：

  find . -type f -user weber -print// 找用户weber所拥有的文件

找到后的后续动作

删除：

  find . -type f -name "*.swp" -delete

执行动作（强大的exec）

  find . -type f -user root -exec chown weber {} ; //将当前目录下的所有权变更为weber

注：{}是一个特殊的字符串，对于每一个匹配的文件，{}会被替换成相应的文件名；

  find . -type f -mtime +10 -name "*.txt" -exec cp {} OLD ;

结合多个命令

  -exec ./commands.sh {} ;

-print的定界符

默认使用' '作为文件的定界符；

2、grep 文本搜索

grep match_patten file // 默认访问匹配行

常用参数VS -v 只输出没有匹配的文本行

  grep -c "text" filename

-n 打印匹配的行号

在多级目录中对文本递归搜索(程序员搜代码的最爱）：

  grep "class" . -R -n

匹配多个模式

  grep -e "class" -e "vitural" file

grep输出以作为结尾符的文件名：（-z）

  grep "test" file* -lZ| xargs -0 rm

3、xargs 命令行参数转换

xargs 能够将输入数据转化为特定命令的命令行参数；这样，可以配合很多命令来组合使用。比如grep，比如find；

将多行输出转化为单行输出

将单行转化为多行输出

xargs参数说明

-d 定义定界符（默认为空格多行的定界符为）

cat file.txt | xargs -I {} ./command.sh -p {} -1

-0：指定为输入定界符

find source_dir/ -type f -name "*.cpp" -print0 |xargs -0 wc -l

4、sort 排序

字段说明：

sort -nrk 1 data.txtsort -bd data // 忽略像空格之类的前导空白字符

5、uniq 消除重复行

消除重复行

  sort unsort.txt | uniq

统计各行在文件中出现的次数

  sort unsort.txt | uniq -c

找出重复行

  sort unsort.txt | uniq -d

可指定每行中需要比较的重复内容：-s 开始位置 -w 比较字符数

6、用tr进行转换

通用用法

  echo 12345 | tr '0-9' '9876543210' //加解密转换，替换对应字符  cat text| tr '	' ' '  //制表符转空格

tr删除字符

  cat file | tr -d '0-9' // 删除所有数字

-c 求补集

  cat file | tr -c '0-9' //获取文件中所有数字  cat file | tr -d -c '0-9
'  //删除非数字数据

tr压缩字符

  cat file | tr -s ' '

字符类

  eg: tr '[:lower:]' '[:upper:]'

7、cut 按列切分文本

截取文件的第2列和第4列：

  cut -f2,4 filename

去文件除第3列的所有列：

  cut -f3 --complement filename

-d 指定定界符：

  cat -f2 -d";" filename

cut 取的范围

cut 取的单位

eg:

  cut -c1-5 file //打印第一到5个字符  cut -c-2 file  //打印前2个字符

8、paste 按列拼接文本

将两个文本按列拼接到一起;

cat file112cat file2colinbookpaste file1 file21 colin2 book

默认的定界符是制表符，可以用-d指明定界符

9、wc 统计行和字符的工具

wc -l file // 统计行数

10、sed 文本替换利器

首处替换

  seg 's/text/replace_text/' file   //替换每一行的第一处匹配的text

全局替换

   seg 's/text/replace_text/g' file

默认替换后，输出替换后的内容，如果需要直接替换原文件,使用-i：

  seg -i 's/text/repalce_text/g' file

移除空白行：

  sed '/^$/d' file

变量转换

echo this is en example | seg 's/w+/[&]/g'$>[this]  [is] [en] [example]

子串匹配标记

  sed 's/hello([0-9])//'

双引号求值

  sed 's/$var/HLLOE/'

当使用双引号时，我们可以在sed样式和替换字符串中指定变量；

eg:p=pattenr=replacedecho "line con a patten" | sed "s/$p/$r/g"$>line con a replaced

其它示例

  sed 's/^.{3}/&//g' file

11、awk 数据流处理工具

awk脚本结构

工作方式

print 打印当前行

使用不带参数的print时，会打印当前行;

  echo -e "line1
line2" | awk 'BEGIN{print "start"} {print } END{ print "End" }'

print 以逗号分割时，参数以空格定界;

echo | awk ' {var1 = "v1" ; var2 = "V2"; var3="v3"; print var1, var2 , var3; }'$>v1 V2 v3

使用-拼接符的方式（""作为拼接符）;

echo | awk ' {var1 = "v1" ; var2 = "V2"; var3="v3"; print var1"-"var2"-"var3; }'$>v1-V2-v3

特殊变量：NR NF $0 $1 $2

NR:表示记录数量，在执行过程中对应当前行号；

echo -e "line1 f2 f3
 line2
 line 3" | awk '{print NR":"$0"-"$1"-"$2}'

打印每一行的第二和第三个字段：

  awk '{print $2, $3}' file

统计文件的行数：

  awk ' END {print NR}' file

累加每一行的第一个字段：

  echo -e "1
 2
 3
 4
" | awk 'BEGIN{num = 0 ;  print "begin";} {sum += $1;} END {print "=="; print sum }'

传递外部变量

var=1000echo | awk '{print vara}' vara=$var #  输入来自stdinawk '{print vara}' vara=$var file # 输入来自文件

用样式对awk处理的行进行过滤

awk 'NR < 5' #行号小于5

设置定界符

使用-F来设置定界符（默认为空格）

读取命令输出

使用getline，将外部shell命令的输出读入到变量cmdout中；

echo | awk '{"grep root /etc/passwd" | getline cmdout; print cmdout }'

在awk中使用循环

for(i=0;i<10;i++){print $i;}

eg:

seq 9| awk '{lifo[NR] = $0; lno=NR} END{ for(;lno>-1;lno--){print lifo[lno];}} '

awk实现head、tail命令

head:

  awk 'NR<=10{print}' filename

tail:

  awk '{buffer[NR%10] = $0;} END{for(i=0;i<11;i++){   print buffer[i %10]} } ' filename

打印指定列

awk方式实现：

  ls -lrt | awk '{print $6}'

cut方式实现

  ls -lrt | cut -f6

打印指定文本区域

确定行号

  seq 100| awk 'NR==4,NR==6{print}'

确定文本

  awk '/start_pattern/, /end_pattern/' filename

eg:

seq 100 | awk '/13/,/15/'cat /etc/passwd| awk '/mai.*mail/,/news.*news/'

awk常用内建函数

index(string,search_string):返回search_string在string中出现的位置

echo | awk '{"grep root /etc/passwd" | getline cmdout; print length(cmdout) }'

printf 类似c语言中的printf，对输出进行格式化

seq 10 | awk '{printf "->%4s
", $1}'

12、迭代文件中的行、单词和字符

1. 迭代文件中的每一行

while 循环法

while read line;doecho $line;done < file.txt改成子shell:cat file.txt | (while read line;do echo $line;done)

awk法：

2.迭代一行中的每一个单词

for word in $line;do echo $word;done

3. 迭代每一个字符

${string:start_pos:num_of_chars}：从字符串中提取一个字符；(bash文本切片）

for((i=0;i<${#word};i++))doecho ${word:i:1);done

来自：大CC

链接：http://www.cnblogs.com/me115/p/3427319.html

你可能感兴趣的:(搞定 Linux Shell 文本处理工具，看完这篇集锦就够了)

系统编程05-线程（pthread_create、pthread_join、pthread_exit） JAN JM 系统编程 linux 服务器 ubuntu
目录一、守护进程1.概念（简答题）1)怎样成为守护进程2.守护进程编写步骤1)忽略SIGHUP2)产生子进程3)创建新会话4)产生孙子进程5)进入新进程组6)关闭文件资源7)关闭文件权限掩码8)切换进程工作路径二、linux最小资源单位--线程。1.线程与进程2.线程函数接口特点？1）由于线程函数接口都是封装在一个线程库，所以我们是看不到源码的，查看线程的函数，都是在第3手册：man3xxxx2）
pthreadjoin 线程退出线程堆栈未释放 linux,linux线程——pthread_exit()与pthread_join()... weixin_39846364 pthreadjoin 线程退出线程堆栈未释放 linux
一、pthread_exit()函数简介：头文件：#include函数定义：voidpthread_exit(void*retval);描述：线程通过这个函数来终止执行，就如同进程在结束时候调用exit函数一样。这个函数的作用是终止调用它的线程，并且返回一个指向某个对象的指针。由于一个进程中的多个线程是共享数据段的，因此通常在线程自己调用pthread_exit函数推出以后，退出线程所占用的资源并
php linux 常用命令,Linux常用命令大全潘儒锋 php linux 常用命令
Linux常用命令大全,以前收集的系统信息arch显示机器的处理器架构(1)uname-m显示机器的处理器架构(2)uname-r显示正在使用的内核版本dmidecode-q显示硬件系统部件-(SMBIOS/DMI)hdparm-i/dev/hda罗列一个磁盘的架构特性hdparm-tT/dev/sda在磁盘上执行测试性读取操作cat/proc/cpuinfo显示CPUinfo的信息cat/pro
linux操作命令comm,史上最全的Linux常用命令云小牙 linux操作命令comm
系统信息arch显示机器的处理器架构(1)uname-m显示机器的处理器架构(2)uname-r显示正在使用的内核版本dmidecode-q显示硬件系统部件-(SMBIOS/DMI)hdparm-i/dev/hda罗列一个磁盘的架构特性hdparm-tT/dev/sda在磁盘上执行测试性读取操作cat/proc/cpuinfo显示CPUinfo的信息cat/proc/interrupts显示中断c
如何在 Linux 上安装 C 和 GCC 编译器？新华编程 C语言教程 linux c语言
概述Linux是一组开源的类UNIX操作系统，Ubuntu是一种基于Linux的操作系统，通常用于运行基于Linux的应用程序。要在Linux上安装C并在Ubuntu上构建和运行C程序文件，我们需要安装GCC编译器。在Ubuntu存储库中，GCC编译器是我们需要安装的构建基本包的一部分。我们知道在Linux上安装C语言可能看起来令人生畏，但不要担心;我们已经为您提供了分步指南！在Linux中使用终
Linux 权限体系详解:、777、755、644、600、chmod、chown、chgrp 和 umask；SUID、SGID 和 Sticky Bit；ACL (访问控制列表) 是什么？小胡说技书手册/开发图谱运维 linux 运维服务器
文章目录1.引言1.1为什么学习Linux权限？1.2本文目标2.Linux权限基础概念2.1权限模型2.2权限类型2.3权限表示法2.3.1字母表示法2.3.2数字表示法2.3.3字母与数字表示法对比2.3.4案例：字母与数字的权限切换3.常见权限分配方法对比表格3.1使用`chmod`分配权限3.2使用`chown`和`chgrp`修改拥有者和用户组3.3使用`umask`设置默认权限4.高级
ARM架构参考手册（ARMv7-A和ARMv7-R版）童伶影Bertha
ARM架构参考手册（ARMv7-A和ARMv7-R版）【下载地址】ARM架构参考手册ARMv7-A和ARMv7-R版分享ARMv7-A和ARMv7-R架构是ARM处理器家族中的关键成员，广泛应用于智能手机、嵌入式系统、汽车电子和实时操作系统等领域的高性能计算设备中。A系列面向应用程序处理器，支持丰富的操作系统如Android和Linux；而R系列则专为实时系统设计，保证了高可靠性和响应速度项目地址
【Linux】APT 密钥管理迁移指南：有效解决 apt-key 弃用警告丶2136 运维 #linux linux 数据库服务器
引言随着Debian11和Ubuntu22.04版本的推出，APT的密钥管理方式发生了重大的变化。apt-key命令被正式弃用，新的密钥管理机制要求使用/etc/apt/keyrings/或/etc/apt/trusted.gpg.d/来存储和管理密钥。这一变化对管理员和普通用户来说至关重要，特别是当通过aptupdate或aptupgrade执行系统更新时，可能会遇到关于apt-key弃用的警告
AI产品经理还不会数据挖掘❓看完这篇就够了脱泥不tony 人工智能产品经理数据挖掘 python tensorflow 开发语言 llama
前言在数字化时代的浪潮中，AI产品经理正成为推动科技与商业融合的重要力量。然而，面对海量的数据，如何从中挖掘出有价值的信息，为AI产品的开发提供有力支持？这已成为AI产品经理必须面对的挑战。今天，我们就来探讨一下数据挖掘在AI产品经理工作中的重要性，以及如何通过掌握数据挖掘方法论，打造卓越的AI产品。一、数据挖掘：AI产品经理的必备技能在AI产品的世界中，大数据是构建一切的基础。无论是算法组件、知
20250120 Flink 的缓冲区超时（Buffer Timeout）靈臺清明 flink
Flink的缓冲区超时（BufferTimeout）机制确实类似于一辆车等待乘客的过程，如果车每次只载一个乘客就发车，会导致效率低下，资源浪费。同样，在Flink的数据流处理中，缓冲区超时的设置对吞吐量和延迟的权衡至关重要。以下是更详细的原因解析和背后的机制：1.什么是缓冲区超时（BufferTimeout）？在Flink中，算子之间的数据通过网络传输。为了提高传输效率，Flink会在发送数据之前
33.Java读写锁（认识读写锁、读写锁案例、锁降级、锁的演变）我命由我12345 Java -基础入门 java 开发语言 java-ee intellij-idea intellij idea spring boot 后端
一、锁概述1、悲观锁每个人进行操作时都进行上锁解锁，能解决并发问题，但不支持并发操作，只能逐个进行操作，效率低2、乐观锁通过版本号进行控制，谁先提交就先修改版本号，其他人因为版本号不相同就不能进行提交3、表锁对整个表加锁，不会发生死锁4、行锁对表中的单独一行加锁，会发生死锁5、读锁共享锁，可以有多个人读，会发生死锁6、写锁独占锁，只能有一个人写，会发生死锁二、读写锁1、基本介绍对共享资源有读和写的
Python操作MongoDB看这一篇就够了 Python3.7 Python进阶 python
MongoDB是由C++语言编写的非关系型数据库，是一个基于分布式文件存储的开源数据库系统，其内容存储形式类似JSON对象，它的字段值可以包含其他文档、数组及文档数组，非常灵活。在这一节中，我们就来看看Python3下MongoDB的存储操作。1.准备工作在开始之前，请确保已经安装好了MongoDB并启动了其服务，并且安装好了Python的PyMongo库。2.连接MongoDB连接MongoDB
全网最详细Gradio教程系列2——Gradio的安装与运行龙焰智能 Gradio全解教程 Gradio 安装运行热重载
全网最详细Gradio教程系列2——Gradio的安装与运行前言实战导论：2.Gradio的安装与运行2.1安装2.1.1Windows安装Gradio2.1.2MacOS/Linux安装Gradio2.2运行2.2.1普通方式运行2.2.2热重载运行2.2.2.1命令行式热重载2.2.2.2Notebook热重载2.2.2.3控制热重载参考文献前言本系列文章主要介绍WEB界面工具Gradio。G
五子棋人机对战（续）打开秋天的内核深度学习 python 五子棋
五子棋人机对战（续）参考五子棋人机对战从tkinter改成pygame，主要是熟悉一下pygame的编程模式，具体的也没有什么好说的，就是觉得程序稍微简洁些，计时功能好像比前面那个要强，还增加了一个辅助功能，即鼠标移动到有效区域显示模拟落子。感到郁闷的是，回放后程序的退出按钮就失效了，网上查了查，也没有根本解决这个问题，只好增加一个退出按钮，外加键盘按键退出，凑合用吧。importosimport
嵌入式专业英语(第二周) 佩佩(@ 。 @) c语言 linux
在第一周的基础上增加一、学预科准备、linux基础接触的专业英文、知识点Crack：破解，裂开virtualmachine：虚拟机terminal：终端，站台Permissiondenied：权限不允许password：密码remove：删除regular：普通的empty：空的directory：目录、路径、文件夹名cannot：不能necessary：必须的catch：抓取omitting：省
Kafka后台启动命令费曼乐园 kafka kafka
#保存日志nohup./kafka-server-start.sh../config/server.properties>/path/to/logfile.log2>&1&#不保存日志nohup./kafka-server-start.sh../config/server.properties>/dev/null2>&1&nohup:是一个Unix/Linux命令，用于运行一个命令并忽略挂断（ha
题目：解码方法（来自leetcode）动态规划----斐波那契模型清风逸梦 leetcode 动态规划算法
解码方法题目动态规划（5步走）状态表示状态转移方程初始化填表顺序返回值代码题目链接题目动态规划（5步走）状态表示dp[i]表示为从下标i之前的的解码数。状态转移方程以i位置为终点，下标为i的位置有两种方式：第一种就是单独解码，第二种就是与前面的一位数合并解码。单独解码有分两种情况：第一种是：当s[i]在[1，9]时可以单独解码，就相当于在dp[i-1]种情况后接上一个单独解码，所以dp[i]=dp
嵌入式驱动开发详解10（MISC杂项实现）嵌入~狮 Linux驱动驱动开发
文章目录前言MISC设备驱动简介重要结构体API函数MISC实现框架后续参考文献前言MISC驱动也叫做杂项驱动，也就是当我们板子上的某些外设无法进行分类的时候就可以使用MISC驱动。MISC驱动其实就是最简单的字符设备驱动，通常嵌套在platform总线驱动中，MISC设备驱动简介所有的MISC设备驱动的主设备号都为10，不同的设备使用不同的从设备号。随着Linux字符设备驱动的不断增加，设备号变
搭建k8s集群 zhen24 kubernetes 容器云原生
一、准备工作（所有节点）在开始部署之前，我们需要对所有节点进行以下准备工作。1.1、关闭防火墙#关闭防火墙systemctlstopfirewalld#禁止防火墙开机自启systemctldisablefirewalld1.2、关闭SELinux#永久关闭SELinuxsed-i's/enforcing/disabled/'/etc/selinux/config#重启系统使更改生效reboot#临
20 条实用的创业实战指南：初创项目如何提升竞争力？人工智能
作者：LmrankHan，AllianceDao核心贡献者编译：J1N，TechubNews我最近在SolanaBreakpoint上发表了主题演讲，目的是在有限的时间内为加密货币项目创始人提供尽可能多有价值的信息。我的演讲反响很好，所以我想花点时间详细整理阐述一下，让人们可以快速从中获得收益。从解决小问题开始从解决小问题或设计一个小的领域开始。而不是一开始就瞄准一个庞大的市场，创始人应该专注于解
CityMaker教程初级篇（一）如何加载三维控件风起于青萍初级篇 CityMaker .net 控件三维
.Net中如何加载CityMaker的三维控件-自从使用COM开始，小编就遇到关于如何加载COM控件的诸多问题，不夸张的说这是每个在.NET使用COM的人都无可避免的问题。要么加载不上，要么就是加载上了，窗体设计器出不来，还有可能是加载正常，但无法初始化。愚笨的小编是一次又一次的尝试，终于梳理通了从COM到.Net的思路。为此小编特地写一篇教程，帮助那些使用COM组件，尤其是CityMaker的C
[Linux 基础] -- 内核探究：regmap 机制 BestW2Y Linux基础 linux regmap
前言：regmap机制是在Linux3.1加入的新特性。主要目的是减少I/O驱动上的重复逻辑代码，提供一种通用的接口来操作底层硬件上的寄存器。比如，之前如果要操作i2c设备的寄存器，我们要调用i2c_transfer接口，要操作spi设备的寄存器，就要调用spi_write/spi_read等接口，如果把它们抽象为regmap结构，那么只要调用regmap_read/regmap_write就可以
icm20608 linux驱动 regmap spi的方式读写寄存器 Embedded-Alien linux kernel linux driver arm linux
开发版芯片imx6ull驱动测量了系统调用read10000次的时间验证了开启硬件浮点和不开启硬件浮点的运算浮点数时间基本相同1.驱动代码#include#include#include#include#include#include#include#include#include#include#include#include#include#include#include#include#in
记录一次RPC服务有损上线的分析过程京东云开发者 rpc java sql
作者：京东零售郭宏宇1.问题背景某应用在启动完提供JSF服务后，短时间内出现了大量的空指针异常。分析日志，发现是服务依赖的藏经阁配置数据未加载完成导致。即所谓的有损上线或者是直接发布，当****应用启动时，service还没加载完，就开始对外提供服务，导致失败调用。关键代码如下数据的初始化加载是通过实现CommandLineRunner接口完成的@ComponentpublicclassLoadS
Linux 存储设备和 Ventoy 启动盘制作指南小白也有IT梦 linux 运维服务器
一、Linux存储设备基础知识1.设备路径（/dev）设备路径是Linux系统中物理存储设备的唯一标识，类似设备的"身份证号"。命名规则解析/dev/sda：/dev：device（设备）的缩写，存放设备文件的目录sd：源自SCSIdevice，现在用于表示存储设备a：表示第一个检测到的存储设备数字（如sda1）：表示该设备上的分区编号2.挂载点与挂载过程挂载点是访问存储设备内容的入口，本质是一个
在VSCode中更改专用终端的Conda环境小白也有IT梦 python vscode
步骤打开VSCode：启动VSCode并打开你需要的工作目录。打开命令面板：使用快捷键Ctrl+Shift+P（Windows/Linux）或Cmd+Shift+P（macOS）打开命令面板。选择Conda环境：在命令面板中输入Python:SelectInterpreter并选择该选项。在出现的列表中选择你需要的Conda环境。这个步骤会改变当前工作目录下Python解释器的环境。打开终端：使用
RocketMQ源码之消息刷盘分析小虾米 ~ RocketMQ rocketmq
前言刷盘是将内存中的消息写入磁盘，分为同步刷盘和异步刷盘。同步刷盘指一条消息写入磁盘才返回成功，异步刷盘指写入内存就返回成功，稍后异步线程刷盘。在创建CommitLog对象的时候，会初始化刷盘服务：//代码位置：org.apache.rocketmq.store.CommitLogpublicCommitLog(finalDefaultMessageStoredefaultMessageStore
深度学习环境配置指南！（Windows、Mac、Ubuntu全讲解） Charmve #AI学习指导：从入门到进阶软件安装环境配置计算机视觉实战文档详细开放源码 cuda linux gpu anaconda ubuntu
关注“迈微AI研习社”，内容首发于公众号作者：伍天舟、马曾欧、陈信达入门深度学习，很多人经历了从入门到放弃的心酸历程，且千军万马倒在了入门第一道关卡：环境配置问题。俗话说，环境配不对，学习两行泪。如果你正在面临配置环境的痛苦，不管你是Windows用户、Ubuntu用户还是苹果死忠粉，这篇文章都是为你量身定制的。接下来就依次讲下Windows、Mac和Ubuntu的深度学习环境配置问题。一、Win
C++ 数据结构——二叉树（最最最最最实用的二叉树教程）我是阿核 C++算法 c++数据结构 leetcode 笔记经验分享
本文章以实用为主，所以不多废话直接开整本文所介绍的二叉树是最基础的二叉树，不是二叉搜索树，也不是平衡二叉树，就基本的二叉树若需要Python版，请跳转到Python数据结构——二叉树（最最最最最实用的二叉树教程）二叉树的构建二叉树为一个父节点连接到两个子节点，若还要加入新的节点，那么此时的子节点将会变成新加入节点的父节点，以此类推，每一个父节点最多只有两个节点（所以叫二叉树）structTreeN
如何查看和终止正在运行的Python进程 weixin_48705841 python 开发语言
如何查看和终止正在运行的Python进程无论是在开发过程中测试脚本，还是在生产环境中运行数据分析任务，了解如何查看和控制正在运行的Python进程对于维护系统状态和资源利用率至关重要。本文将介绍在两个主要操作平台（Unix/Linux/macOS和Windows）上执行这些任务的方法。在Unix/Linux/macOS上查看Python进程打开你的终端应用程序。输入以下命令并执行：ps-ef|gr
如何用ruby来写hadoop的mapreduce并生成jar包 wudixiaotie mapreduce
ruby来写hadoop的mapreduce，我用的方法是rubydoop。怎么配置环境呢： 1.安装rvm：不说了网上有 2.安装ruby：由于我以前是做ruby的，所以习惯性的先安装了ruby，起码调试起来比jruby快多了。 3.安装jruby： rvm install jruby然后等待安
java编程思想 -- 访问控制权限百合不是茶 java 访问控制权限单例模式
访问权限是java中一个比较中要的知识点,它规定者什么方法可以访问,什么不可以访问一:包访问权限; 自定义包: package com.wj.control; //包 public class Demo { //定义一个无参的方法 public void DemoPackage(){ System.out.println("调用
[生物与医学]请审慎食用小龙虾 comsci 生物
现在的餐馆里面出售的小龙虾,有一些是在野外捕捉的,这些小龙虾身体里面可能带有某些病毒和细菌,人食用以后可能会导致一些疾病,严重的甚至会死亡..... 所以,参加聚餐的时候,最好不要点小龙虾...就吃养殖的猪肉,牛肉,羊肉和鱼,等动物蛋白质
org.apache.jasper.JasperException: Unable to compile class for JSP: 商人shang maven 2.2 jdk1.8
环境： jdk1.8 maven tomcat7-maven-plugin 2.0 原因： tomcat7-maven-plugin 2.0 不知吃 jdk 1.8，换成 tomcat7-maven-plugin 2.2就行，即 <plugin>
你的垃圾你处理掉了吗?GC oloz GC
前序:本人菜鸟，此文研究学习来自网络，各位牛牛多指教　 1.垃圾收集算法的核心思想　　Java语言建立了垃圾收集机制，用以跟踪正在使用的对象和发现并回收不再使用(引用)的对象。该机制可以有效防范动态内存分配中可能发生的两个危险：因内存垃圾过多而引发的内存耗尽，以及不恰当的内存释放所造成的内存非法引用。　　垃圾收集算法的核心思想是：对虚拟机可用内存空间，即堆空间中的对象进行识别
shiro 和 SESSSION 杨白白 shiro
shiro 在web项目里默认使用的是web容器提供的session，也就是说shiro使用的session是web容器产生的，并不是自己产生的，在用于非web环境时可用其他来源代替。在web工程启动的时候它就和容器绑定在了一起，这是通过web.xml里面的shiroFilter实现的。通过session.getSession()方法会在浏览器cokkice产生JESSIONID，当关闭浏览器，此
移动互联网终端淘宝客如何实现盈利小桔子移動客戶端淘客淘寶App
2012年淘宝联盟平台为站长和淘宝客带来的分成收入突破30亿元，同比增长100%。而来自移动端的分成达1亿元，其中美丽说、蘑菇街、果库、口袋购物等App运营商分成近5000万元。可以看出，虽然目前阶段PC端对于淘客而言仍旧是盈利的大头，但移动端已经呈现出爆发之势。而且这个势头将随着智能终端(手机，平板)的加速普及而更加迅猛
wordpress小工具制作 aichenglong wordpress 小工具
wordpress 使用侧边栏的小工具，很方便调整页面结构小工具的制作过程 1 在自己的主题文件中新建一个文件夹(如widget)，在文件夹中创建一个php(AWP_posts-category.php) 小工具是一个类,想侧边栏一样，还得使用代码注册，他才可以再后台使用，基本的代码一层不变 <?php class AWP_Post_Category extends WP_Wi
JS微信分享 AILIKES js
// 所有功能必须包含在 WeixinApi.ready 中进行 WeixinApi.ready(function(Api) { // 微信分享的数据 var wxData = { &nb
封装探讨百合不是茶 JAVA面向对象封装
//封装属性方法将某些东西包装在一起，通过创建对象或使用静态的方法来调用，称为封装；封装其实就是有选择性地公开或隐藏某些信息，它解决了数据的安全性问题，增加代码的可读性和可维护性在 Aname类中申明三个属性，将其封装在一个类中：通过对象来调用例如 1： //属性将其设为私有姓名 name 可以公开
jquery radio/checkbox change事件不能触发的问题 bijian1013 JavaScript jquery
我想让radio来控制当前我选择的是机动车还是特种车，如下所示： <html> <head> <script src="http://ajax.googleapis.com/ajax/libs/jquery/1.7.1/jquery.min.js" type="text/javascript"><
AngularJS中安全性措施 bijian1013 JavaScript AngularJS 安全性 XSRF JSON漏洞
在使用web应用中，安全性是应该首要考虑的一个问题。AngularJS提供了一些辅助机制，用来防护来自两个常见攻击方向的网络攻击。一.JSON漏洞当使用一个GET请求获取JSON数组信息的时候（尤其是当这一信息非常敏感，
[Maven学习笔记九]Maven发布web项目 bit1129 maven
基于Maven的web项目的标准项目结构 user-project user-core user-service user-web src
【Hive七】Hive用户自定义聚合函数(UDAF) bit1129 hive
用户自定义聚合函数，用户提供的多个入参通过聚合计算(求和、求最大值、求最小值)得到一个聚合计算结果的函数。问题：UDF也可以提供输入多个参数然后输出一个结果的运算，比如加法运算add(3，5)，add这个UDF需要实现UDF的evaluate方法,那么UDF和UDAF的实质分别究竟是什么？ Double evaluate(Double a, Double b)
通过 nginx-lua 给 Nginx 增加 OAuth 支持 ronin47
前言：我们使用Nginx的Lua中间件建立了OAuth2认证和授权层。如果你也有此打算，阅读下面的文档，实现自动化并获得收益。SeatGeek 在过去几年中取得了发展，我们已经积累了不少针对各种任务的不同管理接口。我们通常为新的展示需求创建新模块，比如我们自己的博客、图表等。我们还定期开发内部工具来处理诸如部署、可视化操作及事件处理等事务。在处理这些事务中，我们使用了几个不同的接口来认证： &n
利用tomcat-redis-session-manager做session同步时自定义类对象属性保存不上的解决方法 bsr1983 session
在利用tomcat-redis-session-manager做session同步时，遇到了在session保存一个自定义对象时，修改该对象中的某个属性，session未进行序列化，属性没有被存储到redis中。在 tomcat-redis-session-manager的github上有如下说明： Session Change Tracking As noted in the &qu
《代码大全》表驱动法-Table Driven Approach-1 bylijinnan java 算法
关于Table Driven Approach的一篇非常好的文章： http://www.codeproject.com/Articles/42732/Table-driven-Approach package com.ljn.base; import java.util.Random; public class TableDriven { public
Sybase封锁原理 chicony Sybase
昨天在操作Sybase IQ12.7时意外操作造成了数据库表锁定，不能删除被锁定表数据也不能往其中写入数据。由于着急往该表抽入数据，因此立马着手解决该表的解锁问题。无奈此前没有接触过Sybase IQ12.7这套数据库产品，加之当时已属于下班时间无法求助于支持人员支持，因此只有借助搜索引擎强大的
java异常处理机制 CrazyMizzz java
java异常关键字有以下几个，分别为 try catch final throw throws 他们的定义分别为 try： Opening exception-handling statement. catch： Captures the exception. finally： Runs its code before terminating
hive 数据插入DML语法汇总 daizj hive DML 数据插入
Hive的数据插入DML语法汇总1、Loading files into tables语法：1) LOAD DATA [LOCAL] INPATH 'filepath' [OVERWRITE] INTO TABLE tablename [PARTITION (partcol1=val1, partcol2=val2 ...)]解释：1)、上面命令执行环境为hive客户端环境下： hive>l
工厂设计模式 dcj3sjt126com 设计模式
使用设计模式是促进最佳实践和良好设计的好办法。设计模式可以提供针对常见的编程问题的灵活的解决方案。工厂模式工厂模式（Factory）允许你在代码执行时实例化对象。它之所以被称为工厂模式是因为它负责“生产”对象。工厂方法的参数是你要生成的对象对应的类名称。 Example #1 调用工厂方法（带参数） <?phpclass Example{
mysql字符串查找函数 dcj3sjt126com mysql
FIND_IN_SET(str,strlist) 假如字符串str 在由N 子链组成的字符串列表strlist 中，则返回值的范围在1到 N 之间。一个字符串列表就是一个由一些被‘,’符号分开的自链组成的字符串。如果第一个参数是一个常数字符串，而第二个是type SET列，则 FIND_IN_SET() 函数被优化，使用比特计算。如果str不在strlist 或st
jvm内存管理 easterfly jvm
一、JVM堆内存的划分分为年轻代和年老代。年轻代又分为三部分：一个eden,两个survivor。工作过程是这样的：e区空间满了后，执行minor gc，存活下来的对象放入s0, 对s0仍会进行minor gc，存活下来的的对象放入s1中，对s1同样执行minor gc，依旧存活的对象就放入年老代中；年老代满了之后会执行major gc，这个是stop the word模式，执行
CentOS-6.3安装配置JDK-8 gengzg centos
JAVA_HOME=/usr/java/jdk1.8.0_45 JRE_HOME=/usr/java/jdk1.8.0_45/jre PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar:$JRE_HOME/lib export JAVA_HOME
【转】关于web路径的获取方法 huangyc1210 Web 路径
假定你的web application 名称为news,你在浏览器中输入请求路径： http://localhost:8080/news/main/list.jsp 则执行下面向行代码后打印出如下结果： 1、 System.out.println(request.getContextPath()); //可返回站点的根路径。也就是项
php里获取第一个中文首字母并排序远去的渡口数据结构 PHP
很久没来更新博客了，还是觉得工作需要多总结的好。今天来更新一个自己认为比较有成就的问题吧。最近在做储值结算，需求里结算首页需要按门店的首字母A-Z排序。我的数据结构原本是这样的： Array ( [0] => Array ( [sid] => 2885842 [recetcstoredpay] =&g
java内部类 hm4123660 java 内部类匿名内部类成员内部类方法内部类
　在Java中，可以将一个类定义在另一个类里面或者一个方法里面，这样的类称为内部类。内部类仍然是一个独立的类，在编译之后内部类会被编译成独立的.class文件，但是前面冠以外部类的类名和$符号。内部类可以间接解决多继承问题,可以使用内部类继承一个类，外部类继承一个类，实现多继承。 &nb
Caused by: java.lang.IncompatibleClassChangeError: class org.hibernate.cfg.Exten zhb8015
maven pom.xml关于hibernate的配置和异常信息如下，查了好多资料，问题还是没有解决。只知道是包冲突，就是不知道是哪个包....遇到这个问题的分享下是怎么解决的。。 maven pom: <dependency> <groupId>org.hibernate</groupId> <ar
Spark 性能相关参数配置详解－任务调度篇 Stark_Summer spark cache cpu 任务调度 yarn
随着Spark的逐渐成熟完善, 越来越多的可配置参数被添加到Spark中来, 本文试图通过阐述这其中部分参数的工作原理和配置思路, 和大家一起探讨一下如何根据实际场合对Spark进行配置优化。由于篇幅较长，所以在这里分篇组织，如果要看最新完整的网页版内容，可以戳这里：http://spark-config.readthedocs.org/，主要是便
css3滤镜 wangkeheng html css
经常看到一些网站的底部有一些灰色的图标，鼠标移入的时候会变亮，开始以为是js操作src或者bg呢，搜索了一下，发现了一个更好的方法：通过css3的滤镜方法。 html代码： <a href='' class='icon'><img src='utv.jpg' /></a> css代码： .icon{-webkit-filter: graysc

按字母分类： A B C D E F G H I J K L M N O P Q R S T U V W X Y Z 其他