weixin_30246221

R语言-字符串处理函数

R语言中的字符串处理函数

内容概览

尽管R是一门以数值向量和矩阵为核心的统计语言，但字符串有时候也会在数据分析中占到相当大的份量。

R语言是一个擅长处理数据的语言，但是也不可避免的需要处理一些字符串（文本数据）。如何高效地处理文本数据，将看似杂乱无章的数据整理成可以进行统计分析的规则数据，是『数据玩家』必备的一项重要技能。

在编程语言里，文本处理绝对是一大热门，作为数据统计分析最热门的R语言，虽然处理方法没有其他的文本的编程语言丰富，但其处理文本的能力也是非常实用的。特别是在文本数据挖掘日趋重要的背景下，在数据预处理阶段你需要熟练的操作字符串对象去处理文本数据。如果你擅长其它的处理软件，比如Python，可以让它来负责前期的脏活，当然你也可以直接用R进行处理。

今天，我们要学习的『正则表达式』和『字符处理函数』将助你成为点石成金的数据魔法师。下面介绍在R语言里面常用的文本处理函数和方法。

获取字符串长度：nchar()能够获取字符串的长度，它也支持字符串向量操作。注意它和length()的结果是有区别的。
字符串粘合：paste()负责将若干个字符串相连结，返回成单独的字符串。其优点在于，就算有的处理对象不是字符型也能自动转为字符型。
字符串分割：strsplit()负责将字符串按照某种分割形式将其进行划分，它正是paste()的逆操作。
字符串截取：substr()能对给定的字符串对象取出子集，其参数是子集所处的起始和终止位置。
字符串替代：gsub()负责搜索字符串的特定表达式，并用新的内容加以替代。sub()函数是类似的，但只替代第一个发现结果。
字符串匹配：grep()负责搜索给定字符串对象中特定表达式，并返回其位置索引。grepl()函数与之类似，但其后面的"l"则意味着返回的将是逻辑值。

字符(串)的格式化(定制)输出：R中将字符或字符串按照一定的格式和要求输出。

  字符串分割函数：strsplit()
  字符串连接函数：paste()及paste0()
  计算字符串长度：nchar()及length()
  字符串截取函数：substr()及substring()
  字符串替换函数：chartr()、sub()及gsub()
  字符串匹配函数：grep()及grepl()
  大小写转换函数：toupper()、tolower()及casefold()
  字符(串)的格式化(定制)输出函数：sprintf()、sink()、cat()、print()、strtrim()、strwrap()

字符串函数参数详解及示例

1. 字符串分割函数：strsplit()

strsplit()是一个拆分函数，该函数可以使用正则表达式进行匹配拆分。

其命令形式为：strsplit(x, split, fixed= F, perl= F, useBytes= F)

在R里面，strsplit一般用来进行字符串分割操作，我们先来看下strsplit函数有哪些选项：x、split、fixed、perl这四个选项是我们会经常用到的。

参数x为字符串格式向量，函数依次对向量的每个元素进行拆分
参数split为拆分位置的字串向量，即在哪个字串处开始拆分；该参数默认是正则表达式匹配；若设置fixed= T则表示是用普通文本匹配或者正则表达式的精确匹配。用普通文本来匹配的运算速度要快些。
参数perl的设置和perl的版本有关，表示可以使用perl语言里面的正则表达式。如果正则表达式过长，则可以考虑使用perl的正则来提高运算速度。
参数useBytes表示是否逐字节进行匹配，默认为FALSE，表示是按字符匹配而不是按字节进行匹配。

Example1

  ### strsplit()函数用于字符串分割，其中split是分割参数。所得结果以默认以list形式展示。
  ### 首先x和split是两个必须的选项：
  > x = "character vector, each element of which is to be split. Other inputs, including a factor, will give an error."
  > x
  [1] "character vector, each element of which is to be split. Other inputs, including a factor, will give an error."
  > strsplit(x,split = "\\s+")
  [[1]]
   [1] "character" "vector,"   "each"      "element"   "of"        "which"     "is"        "to"        "be"        "split."    "Other"    
  [12] "inputs,"   "including" "a"         "factor,"   "will"      "give"      "an"        "error."   

  > strsplit(x,split = " ")
  [[1]]
   [1] "character" "vector,"   "each"      "element"   "of"        "which"     "is"        "to"        "be"        "split."    "Other"    
  [12] "inputs,"   "including" "a"         "factor,"   "will"      "give"      "an"        "error."   

  > strsplit(x,split = "")
  [[1]]
    [1] "c" "h" "a" "r" "a" "c" "t" "e" "r" " " "v" "e" "c" "t" "o" "r" "," " " "e" "a" "c" "h" " " "e" "l" "e" "m" "e" "n" "t" " " "o" "f" " " "w"
   [36] "h" "i" "c" "h" " " "i" "s" " " "t" "o" " " "b" "e" " " "s" "p" "l" "i" "t" "." " " "O" "t" "h" "e" "r" " " "i" "n" "p" "u" "t" "s" "," " "
   [71] "i" "n" "c" "l" "u" "d" "i" "n" "g" " " "a" " " "f" "a" "c" "t" "o" "r" "," " " "w" "i" "l" "l" " " "g" "i" "v" "e" " " "a" "n" " " "e" "r"
  [106] "r" "o" "r" "."


  ###在上面的例子中我们可以看到，我们对split选项设置了三个不同的参数，第一个是`\\s+`，第二个是一个空格，第三个一个空字符。
  ###第一个参数`\\s+`和第二个参数空格达到了相同的效果，都是把x字符串按照空白进行分割。那个这里为什么是`\\s+`呢？相信对正则表达式有一点了解的同学一定会知道`\s+`是什么意思。`\s+`是表示匹配一个或一个以上的空白字符，包括空格、制表符和换行符等。这里的第一个`\` 是用来转义第二个`\` 符号的。
  ###那么第三个参数里面，我们设置 `split=""` 又是什么意思呢？当设置为空字符的时候，`strsplit` 函数会把字符串按照字符一个个进行分割。

Example2

  ### strsplit默认支持正则表达式
  ###在上面的例子中我们也可以看到strsplit默认是支持正则表达式的。
  ###那么如果我要不支持正则表达式强行按照固定字符匹配怎么办呢？除了我们用更加高级的正则表达式达到这一目的我们还可以通过设定fixed参数来达到目的：

  > x = "asdas\\sasdasd"
  > x
  [1] "asdas\\sasdasd"
  > strsplit(x,split = "\\s")
  [[1]]
  [1] "asdas\\sasdasd"

  > strsplit(x,split = "\\s",fixed = T)
  [[1]]
  [1] "asdas"  "asdasd"

  > strsplit(x,split = "\s")
  Error: '\s' is an unrecognized escape in character string starting ""\s"

  ###比如这里的 x 字符串，它带有两个`\`，我要以`\\s`来进行分割。如果我直接设定`split='\\s'`参数时，`strsplit`函数无法正确的分割字符串，但是当我加了`fixed=T`参数后，`strsplit`函数可以正确分割这些字符串。
  ###在strsplit函数中，是默认支持正则表达式的，我们可以通过设置perl来支持使用perl兼容的正则表达式。也可以通过fixed来设置不支持正则表达式，而且fixed选项拥有比perl更高的优先级。

Example3

  ###fixed为TRUE表示精确匹配，否则表示可以使用正则表达式另外需要说明一点的是：直接使用split函数得到的结果是一个列表，如果希望得到一个向量，可以使用 unlist() 函数。
  # 由于split是正则表达式，所以在切割包含.的字符串的时候万分小心
  unlist(strsplit("a.b.c", "."))
  ## [1] "" "" "" "" ""
  ## following are right answers
  unlist(strsplit("a.b.c", "[.]"))
  ## [1] "a" "b" "c"
  unlist(strsplit("a.b.c", ".", fixed = TRUE))
  unlist(strsplit("a.b.c","\\."))
  ## 编写逆写字符串
  ## a useful function: rev() for strings
  strReverse <- function(x)
          sapply(lapply(strsplit(x, NULL), rev), paste, collapse = "")
  strReverse(c("abc", "Statistics"))

  ## 得到R核心团队成员的名First Name
  ## get the first names of the members of R-core
  a <- readLines(file.path(R.home("doc"),"AUTHORS"))[-(1:8)]
  a <- a[(0:2)-length(a)]
  (a <- sub(" .*","", a))
  # and reverse them
  strReverse(a)
  # 注意：最后一个空字符串将会被忽略
  strsplit(paste(c("", "a", ""), collapse="#"), split="#")[[1]]
  # [1] ""  "a"

  # split=NULL逐个切割字符串
  strsplit("abcde",NULL)

2. 字符串连接函数：paste() 及 paste0()

主要参数： paste(..., sep = " ", collapse = NULL)

paste0(..., collapse = NULL)

paste()函数用于字符串连接，其中 sep 负责两组字符串间的连接； collapse 负责一组字符串内部的连接，常常在一些作图的标题中看到paste的使用。

Example1

  ### paste()函数可以将多个字符型向量连接成一个向量。如果要将一个不同类型的向量连接起来，这个向量首先会被转换成字符型向量。

  > x <- c("a","b", "c", "d", "e")
  > y <- c("A", "B", "C", "D","E")
  > paste(x, y)
  [1] "a A" "b B" "c C" "d D" "e E"

Example2

  ### 在默认情况下，向量的值之间使用空格进行分隔的。 若想使用其他分隔符，可以使用sep参数进行设置，例如：

  > paste(x, y, sep = "-")
  [1] "a-A" "b-B" "c-C" "d-D" "e-E"
  > paste(x, y, sep = "")
  [1] "aA" "bB" "cC" "dD" "eE"

  > paste(letters[1:6],1:6,sep="-")
  [1] "a-1" "b-2" "c-3" "d-4" "e-5" "f-6"

Example3

  ### 若将返回的所有向量都连成一个字符串，那么则需要collapse参数来指定这些值之间的连接符。例如：

  > paste(x, y, sep = "-", collapse = "#")
  [1] "a-A#b-B#c-C#d-D#e-E"

  > paste(letters[1:6],1:6,sep="-",collapse=";")
  [1] "a-1;b-2;c-3;d-4;e-5;f-6"

  > nth <- paste0(1:12, c("st", "nd", "rd", rep("th", 9)))
  > paste(month.abb, "is the", nth, "month of the year.", sep = "_*_")
  [1] "Jan_*_is the_*_1st_*_month of the year."  "Feb_*_is the_*_2nd_*_month of the year."
  [3] "Mar_*_is the_*_3rd_*_month of the year."  "Apr_*_is the_*_4th_*_month of the year."
  [5] "May_*_is the_*_5th_*_month of the year."  "Jun_*_is the_*_6th_*_month of the year."
  [7] "Jul_*_is the_*_7th_*_month of the year."  "Aug_*_is the_*_8th_*_month of the year."
  [9] "Sep_*_is the_*_9th_*_month of the year."  "Oct_*_is the_*_10th_*_month of the year."
  [11] "Nov_*_is the_*_11th_*_month of the year." "Dec_*_is the_*_12th_*_month of the year."

Example4

  ### paste()在不指定分割符的情况下，默认分割符是空格；paste0()在不指定分割符的情况下，默认分割符是空。

  # 默认以空格隔开
  paste("Hello","world")
  [1] "Hello world"

  # 没有空格
  paste0("Hello","world")
  [1] "Helloworld"

  # 指定分割符
  paste("abc", "efg", "hijk", sep = "-")
  [1] "abc-efg-hijk"

  # 分别对向量的每一个元素进行连接
  paste0("A", 1:6, sep = "")
  [1] "A1" "A2" "A3" "A4" "A5" "A6"

  # collapse参数：每一个元素操作之后，再把向量的每一个元素进行连接
  paste0("A", 1:6, sep = "",collapse = "-")
  [1] "A1-A2-A3-A4-A5-A6"

3. 计算字符串长度：nchar()及length()

nchar()返回字符串的长度，取字符数量的函数。length与nchar不同，length是取向量的长度（nchar用于计算 x 中的字符数量，length函数返回 x 的集合长度）。

用法：nchar(x, type = "chars", allowNA = FALSE, keepNA = FALSE)

nzchar(x)用于判断一个变量的长度是否为0。

需要注意的是，对于缺失值NA，nzchar()的结果为TRUE，而函数nchar()的返回结果为2。所以在对字符串进行测量之前，最好先使用is.na()函数判断一下是否是NA值。

Example

  x <- c("asfef", "qwerty", "yuiop[", "b", "stuff.blah.yech")
  > nchar(x)
  # 5  6  6  1 15

  #现R语言设定为NA长度为2
  > nchar(NA) 
  ## [1] 2
  > nzchar(NA)
  [1] TRUE
  > x <- ''
  > nzchar(x)
  [1] FALSE
  > nchar("你好",type="chars")   #默认情况
  ## [1] 2
  > nchar("你好",type="bytes")   #每个中文字符占2个bytes
  ## [1] 4
  > nchar("你好",type="width")
  ## [1] 4

  > m<-"who wins 123"
  > nchar(m)
  [1] 12
  > length(m)
  [1] 1

  # nchar表示字符串中的字符的个数
  > nchar("abcd")
  [1] 4

  # length表示向量中元素的个数
  > length("abcd")
  [1] 1
  > length(c("hello", "world"))
  [1] 2
  > length("")  #虽然字符为空，但是它仍然是一个元素。
  [1] 1

4. 字符串截取函数：substr()；substring()

substr()函数和substring()函数是截取字符串最常用的函数，两个函数功能方面是一样的，只是其中参数设置不同。

substr()函数：必须设置参数start和stop，如果缺少将出错。

substring()函数：可以只设置first参数，last参数若不设置，则默认为1000000L，通常是指字符串的最大长度。

substr(x, start, stop)

substring(text, first, last = 1000000L)

substr(x, start, stop) <- value

substring(text, first, last = 1000000L) <- value

Example1

  ### substr能够提取或替换一个字符向量中的子串或替换子字符串
  > substr('abcdef',2,4)
  [1] "bcd"
  > substr("abcdef", 2, 4)   #两种表达方式等价
  [1] "bcd"
  > x <- "abcdef"
  > substr(x, 1, 1) <- "ccc"
  > x
  [1] "cbcdef"
  > x <- "abcdef"
  > substr(x, 1, 1) <- ""
  > x
  [1] "abcdef"
  > x <- "abcdef"
  > substr(x, 1, 1) <- " "
  > x
  [1] " bcdef"
  > #如果start大于字符串长度，则返回""
  > x <- c("asfef", "qwerty", "yuiop[", "b", "stuff.blah.yech")
  > substr(x, 2, 5)
  [1] "sfef" "wert" "uiop" ""     "tuff"

  > m<-"who wins 123"
  > substr(m,1,8)
  [1] "who wins"
  > substr(m,1,3)<-"Tom"
  > m
  [1] "Tom wins 123"

Example2

  ### substring函数则可以对字符串向量进行提取或替换

  > substring('abcdef', 1, 6)
  [1] "abcdef"

  > substring('abcdef', 1:6, 6)
  [1] "abcdef" "bcdef"  "cdef"  
  [4] "def"    "ef"     "f"  

  ### 切割字符串另类方法，但速度不如strsplit
  >substring('abcdef',1：6，1：6)
  [1] "a" "b" "c" "d" "e" "f"

  ### 替换字符串向量中的部分元素
  > x <- c("asfef", "qwerty", "yuiop[", "b", "stuff.blah.yech")
  ### 由于x长度为5，赋值向量会循环补齐，相当于 c("..", "+++", "..", "+++", "..")
  ### substring(x, 2) <- c("..", "+++", "..", "+++", "..")
  > substring(x, 2) <- c("..", "+++")
  > x
  [1] "a..ef"           "q+++ty"         
  [3] "y..op["          "b"              
  [5] "s..ff.blah.yech"

Example3

  ### 两者的一些区别：substr返回的字串个数等于第一个参数的长度，而substring返回字串个数等于三个参数中最长向量长度，短向量循环使用。

  > substr("abcdef", 1:6, 1:6) 
  [1] "a"

  #注意还有一个substring函数，效果就不一样了：
  > substring("abcdef",1:6,1:6) 
  [1] "a" "b" "c" "d" "e" "f"

  #等价于：substr("123456789", 2, 4)
  > substr("123456789", c(2, 3), c(4, 5, 6))  
  [1] "234"

  #最长的向量长度为3，其它向量都循环补齐
  > substring("123456789", c(2, 3), c(4,5,6)) 
  [1] "234"   "345"   "23456"

5. 字符串替换函数：chartr()、sub()及gsub()

chartr()函数：将原有字符串中特定字符替换成所需要的字符。其中参数old 表示原有字符串中内容；new 表示替换后的字符内容。

chartr (old,new,x)，chartr-将对象中旧的字符用新的字符替代。

这种功能和shell里面的rename有点类似，但old的字符数不能大于new，new字符数大于old的字符也将会被忽略，相当于重命名的意思。不同于rename的是chartr不能随意的替换字符串，用起来也有一定的局限性。

Example1

  > m<-"who wins 123"
  > chartr("w","W",m)
  [1] "Who Wins 123"

  > chartr(old="a", new="c", x="a123")
  [1] "c123"

  > chartr(old="a", new="A", x="data")
  [1] "dAtA"

Example2

  ### gsub() 替换匹配到的全部；sub() 替换匹配到的第一个。
  ### sub()函数可以用来替换字符串。需要注意的是我们需要设置一个变量来接受这个替换操作后的字符，sub()函数不会对原变量进行操作。

  ######正则表达式解释######
  ## /^\d+$/ 是正则表达式
  ## ^和$用来匹配位置:^表示行首,$表示行尾
  ## \d表示数字,即0-9
  ## +表示重复1次以上
  ## 综合起来,/^\d+$/ 这个正则表达式就是匹配一整行1个以上的数字
  ## /^\d+$/ 就相当于 $_=~/^\d+$/ 
  ## 就是对默认变量$_进行匹配,匹配成功就返回'真',否则就返回'假'
  ## !/^\d+$/ 就是对~/^\d+$/返回的布尔值取反
  ######正则表达式解释######
  > str <- "Now is the time      "
  > sub(" +$", " 12:00", str)  ## spaces only
  [1] "Now is the time 12:00"
  ##几种错误写法##
  > sub(" +s", " 12:00", str)
  [1] "Now is the time      "
  > sub(" ", " 12:00", str)
  [1] "Now 12:00is the time      "
  > sub("     ", " 12:00", str)
  [1] "Now is the time 12:00 "

  # 将b替换为B
  > gsub(pattern = "b", replacement = "B", x = "baby")
  [1] "BaBy"
  > gsub(pattern = "b", replacement = "B", x = c("abcb", "boy", "baby"))
  [1] "aBcB" "Boy"  "BaBy"
  # 只替换第一个b
  > sub(pattern = "b", replacement = "B", x = "baby")
  [1] "Baby"
  > sub(pattern = "b", replacement = "B", x = c("abcb", "baby"))
  [1] "aBcb" "Baby"

6. 字符串匹配函数：grep()及grepl()

其表达式为：

grep(pattern, x, ignore.case = FALSE, perl = FALSE, value = FALSE,fixed = FALSE, useBytes = FALSE, invert = FALSE)

grepl(pattern, x, ignore.case = FALSE, perl = FALSE,fixed = FALSE, useBytes = FALSE)

可以理解为搜索字符向量中匹配参数pattern的模型，fixed的逻辑值决定将pattern视为正则表达式或一个文本字符串，若fixed=TURE，则视pattern为文本字符串（精确匹配）；fixed=FALSE，则视之为正则表达式，正则表达式则相当于一种条件，函数返回匹配值的下标；perl=TURE，使用perl风格的正则表达式；value则决定返回的类型是匹配值的下标还是匹配的值。

Example1

  > x = "Hello World"
  > grep(pattern = "Hello",x = x)
  [1] 1
  > grep(pattern = "l",x = x)
  [1] 1
  > grepl(pattern = "l",x = x)
  [1] TRUE

Example2

  ### grep和grepl的区别在于grep返回的是匹配正确的字符串在 x 向量中的元素下标。而grepl返回的则是逻辑变量TRUE和FALSE。
  ### 如果我们想要返回匹配正确字符的值要怎么办呢？我们可以通过设置grep中的value=T来达到目的。如：

  > x = c("Hello","Bye","Hi")
  > grep(pattern = "l",x = x,value = T)
  [1] "Hello"
  > grep(pattern = "H",x = x,value = T)
  [1] "Hello" "Hi"   
  > grep(pattern = "H",x = x,value = F)
  [1] 1 3

Example3

  ### 在grep和grepl中，fixed和perl两个参数的用法跟strsplit中的用法是一致的。
  ### 正则表达式中，“[a-z]”就表示匹配a～z，所以[a-f]表示匹配正则表达式前面6个
  > grep("[a-f]",letters)      
  [1] 1 2 3 4 5 6

Example4

  ### 使用fixed=T,因为我们匹配的类型是精确匹配，so
  >grep("[a-f]",letters,fixed=T)      
  integer(0)    #精确匹配中，[a-f]代表的是字符，所以就不能匹配到

Example5

  ### 匹配的 fixed 默认为F，这也提示我们应尽量的去使用正则表达式去匹配
  > txt <- c("arm","foot","lefroo", "bafoobar")
  > grep("foo",txt)
  [1] 2 4

Example6

  ### ignore.case 决定匹配是否对大小写敏感，为了达到精确匹配，默认为对大小写敏感；你完全可以设置不敏感，比如一些开头字母大写的问题。例如：

  > grep("Foo",txt)
  integer(0)

  > grep("Foo",txt,ignore.case=TRUE)
  [1] 2 4

  > grep("Foo",txt,ignore.case=T,value=T)
  [1] "foot"     "bafoobar"

Example7

  ### invert 参数非常实用，它决定返回的的是匹配值还是非匹配值，往往我们要的结果就是非匹配值，例如在众多的邮件中根据内容不含”xxx”进行保留。

  > grep("Foo",txt,ignore.case=T,invert=T,value=T)
  [1] "arm"    "lefroo"

Example8

  ### grepl函数与grep函数不同的地方在于返回的形式是否为布尔值（是 true 或 false 中的一个），grepl返回TURE或者FALSE，而grep函数返回匹配值下标或者匹配值本身，使用什么函数要看我们的需要。

  > grepl("Foo",txt,ignore.case=T)
  [1] FALSE  TURE FALSE  TURE

7. 大小写替换函数：toupper()、tolower()、casefold()

toupper()函数：将字符串统一转换为大写。

tolower()函数：将字符串统一转换为小写。

casefold()函数：根据参数转换大小写。

tolower(x)

toupper(x)

casefold(x, upper = FALSE)

chartr(old, new, x)

Example

  ### 这两个函数就不用多介绍了，按字面意思就是把对象转换成大写或小写，应用于全部的对象，例如：

  >toupper("abc")
  [1]"ABC"
  >tolower("ABC")
  [1]"abc"
  >x<-c("My","First","Trip")
  >tolower(x)
  [1] "my" "first" "trip"

  > casefold('ABDATA', upper = FALSE)
  [1] "abdata"
  > casefold('baorui', upper = FALSE)
  [1] "baorui"
  > casefold('baorui', upper = TRUE)
  [1] "BAORUI"

  # 这里这只提供全部应用的大小写转换，部分转换可以参照函数chartr()。
  chartr(old, new, x)

8. 字符(串)的格式化(定制)输出

字符格式化输出

  使用%s替代字符变量
  a <- "string"
  sprintf("This is where a %s goes.", a)
  # "This is where a string goes."

  # 使用%d替代整数
  x <- 8
  sprintf("Regular:%d", x)
  # "Regular:8"
  # Can print to take some number of characters, leading with spaces.
  sprintf("Leading spaces:%4d", x)
  # "Leading spaces:   8"
  # Can also lead with zeros instead.
  sprintf("Leading zeros:%04d", x)
  #"Leading zeros:0008:"

  #使用%f替代浮点数
  # %m.nf m为输出字符宽度，即最小包含的字符量。如果字符串没有达到m长度，那么可以通过补0或者空格，n表示小数的精度
  sprintf("%f", pi)         # "3.141593"
  sprintf("%.3f", pi)       # "3.142"
  sprintf("%1.0f", pi)      # "3"
  sprintf("%5.1f", pi)      # "  3.1"
  sprintf("%05.1f", pi)     # "003.1"
  sprintf("%+f", pi)        # "+3.141593"
  sprintf("% f", pi)        # " 3.141593"
  sprintf("%-10f", pi)      # "3.141593  "   (left justified)
  sprintf("%e", pi)         #"3.141593e+00"
  sprintf("%E", pi)         # "3.141593E+00"
  sprintf("%g", pi)         # "3.14159"
  sprintf("%g",   1e6 * pi) # "3.14159e+06"  (exponential)
  sprintf("%.9g", 1e6 * pi) # "3141592.65"   ("fixed")
  sprintf("%G", 1e-6 * pi)  # "3.14159E-06"

  x <- "string"
  sprintf("Substitute in multiple strings: %s %s", x, "string2")
  # "Substitute in multiple strings: string string2"

  # To print a percent sign, use "%%"
  sprintf("A single percent sign here %%")
  # "A single percent sign here %"
  #写入文件，重定向sink()
  #sink()重定向文件写入

  # Start writing to an output file
  sink('analysis-output.txt')

  set.seed(12345)
  x <-rnorm(10,10,1)
  y <-rnorm(10,11,1)
  # Do some stuff here
  cat (sprintf("x has %d elements:\n", length(x)))
  print(x)
  cat ("y =", y, "\n")

  cat("=============================\n")
  cat("T-test between x and y\n")
  cat("=============================\n")
  t.test(x,y)

  # Stop writing to the file
  sink()


  # Append to the file
  sink('analysis-output.txt', append=TRUE)
  cat("Some more stuff here...\n")
  sink()

字符串的定制输出

这个内容有点类似于字符串的连接。这里用到了strtrim()，用于将字符串修剪到特定的显示宽度，其命令形式如下：strtrim(x, width)该函数返回的字符串向量的长度等于参数x的长度。

  strtrim(c("abcde", "abcde", "abcde"), c(1, 5, 10))
  ## [1] "a"     "abcde" "abcde"
  strtrim(c(1, 123, 12345), 4)  #短向量循环
  ## [1] "1"    "123"  "1234"

strtrim()会根据width参数提供的数字来修剪字符串，若width提供的数字大于字符串的字符数的话，则该字符串会保持原样，不会增加空格之类的东西。

strwrap()会把字符串当成一个段落来处理（不管段落中是否有换行），按照段落的格式进行缩进和分行，返回结果就是一行行的字符串，其命令形式如下：strwrap(x, width, indent= 0, exdent= 0, prefix= “”, simplify= T, initial= prefix)函数返回结果中的每一行的字符串中的字符数目等于参数width。

  string <- "Each character string in the input is first split into\n paragraphs (or lines containing whitespace only). The paragraphs are then formatted by breaking lines at word boundaries."
  string
  ## [1] "Each character string in the input is first split into\n paragraphs (or lines containing whitespace only). The paragraphs are then formatted by breaking lines at word boundaries."
  cat(string)
  ## Each character string in the input is first split into
  ##  paragraphs (or lines containing whitespace only). The paragraphs are then formatted by breaking lines at word boundaries.
  strwrap(string)  #直接将换行符忽略了
  ## [1] "Each character string in the input is first split into paragraphs"
  ## [2] "(or lines containing whitespace only). The paragraphs are then"   
  ## [3] "formatted by breaking lines at word boundaries."
  strwrap(string, width = 40, indent = 4)  #首行缩进
  ## [1] "    Each character string in the input"
  ## [2] "is first split into paragraphs (or"    
  ## [3] "lines containing whitespace only). The"
  ## [4] "paragraphs are then formatted by"      
  ## [5] "breaking lines at word boundaries."
  strwrap(string, width = 40, exdent = 4)  #除了首行的其余行缩进
  ## [1] "Each character string in the input is" 
  ## [2] "    first split into paragraphs (or"   
  ## [3] "    lines containing whitespace only)."
  ## [4] "    The paragraphs are then formatted" 
  ## [5] "    by breaking lines at word"         
  ## [6] "    boundaries."
  strwrap(string, width = 40, simplify = F)  # 返回结果是个列表，而不再是个字符串向量
  ## [[1]]
  ## [1] "Each character string in the input is"
  ## [2] "first split into paragraphs (or lines"
  ## [3] "containing whitespace only). The"     
  ## [4] "paragraphs are then formatted by"     
  ## [5] "breaking lines at word boundaries."
  strwrap(string, width = 40, prefix = "******")
  ## [1] "******Each character string in the"    
  ## [2] "******input is first split into"       
  ## [3] "******paragraphs (or lines containing" 
  ## [4] "******whitespace only). The paragraphs"
  ## [5] "******are then formatted by breaking"  
  ## [6] "******lines at word boundaries."

参考资料

R中的普通文本处理-汇总
R中的正则表达式及字符处理函数总结
正则表达式及R字符串处理之终结版
字符串操作的那些事
字符串处理函数
R语言与字符串处理函数

转载于:https://www.cnblogs.com/cloudtj/articles/5495773.html

你可能感兴趣的:(R语言-字符串处理函数)

R语言学习实例：使用R进行数据可视化 PixelCoder 信息可视化 r语言学习 R语言
R语言学习实例：使用R进行数据可视化R语言是一种功能强大且广泛使用的统计分析和数据可视化工具。在本实例中，我们将使用R语言来创建一些常见的数据可视化图表，包括散点图、柱状图和折线图。我们将展示如何使用R的基本绘图功能和一些常用的绘图库来生成这些图表。散点图是一种用于显示两个变量之间关系的图表。我们可以使用R的基本绘图功能来创建散点图。下面是一个示例代码，展示如何使用R创建散点图：#创建示例数据x<
探索R语言：经典案例解析与源代码翠绿探寻 r语言信息可视化开发语言 R语言
探索R语言：经典案例解析与源代码引言：R语言是一种流行的数据分析和统计建模工具，具有丰富的功能和广泛的应用领域。在本文中，我们将通过经典案例来探索R语言的一些重要功能和技术。我们将提供相应的源代码，以便读者能够实际运行并理解这些示例。案例一：数据导入与处理在数据分析中，数据导入和处理是首要任务。R语言提供了丰富的函数和包，用于处理各种数据格式。下面是一个简单的示例，演示了如何导入和处理CSV格式的
R语言dataframe数据索引、访问: 使用attach函数绑定dataframe数据、这样可以直接使用列名称访问dataframe的列数据 omhdxgb R语言123 r语言数据挖掘人工智能机器学习数据分析
R语言dataframe数据索引、访问:使用attach函数绑定dataframe数据、这样可以直接使用列名称访问dataframe的列数据目录R语言dataframe数据索引、访问:使用attach函数绑定dataframe数据、这样可以直接使用列名称访问dataframe的列数据R语言特点R语言dataframe数据索引、访问:使用attach函数绑定dataframe数据、这样可以直接使用列
R语言向量vector数据类型元素索引、访问：使用中括号[]和:符号以及乘法符号获取向量中指定范围内的偶数索引元素 omhdxgb R语言123 r语言机器学习数据挖掘人工智能数据分析
R语言向量vector数据类型元素索引、访问：使用中括号[]和:符号以及乘法符号获取向量中指定范围内的偶数索引元素目录R语言向量vector数据类型元素索引、访问：使用中括号[]和:符号以及乘法符号获取向量中指定范围内的偶数索引元素R语言特点R语言向量vector数据类型元素索引、访问：使用中括号[]和:符号以及乘法符号获取向量中指定范围内的偶数索引元素R可以在CRAN（Comprehensive
R语言安装github包出现的错误，object "XXX" is not exported by "namespace:viridisLite" momo酱豆是沃 anaconda各种问题
自己遇上了类似的问题，当时是把所有导致这个问题出现时安装的所有包我都卸载了，再次重装的。弄了很久，我发现都是在安装各种包让我更新我不更新导致的后果R，告诉我一个道理，一定要听话，让你更新就更新，不然我的bug出到让你崩溃。下图借用以为博主的图（https://blog.csdn.net/yw_vine/article/details/79631042）原连接R语言安装github包出现的错误，ob
R语言 ggplot2 可视化生成高分辨率图片实战 PixelEnigma r语言开发语言 R语言
R语言ggplot2可视化生成高分辨率图片实战在数据分析和可视化领域，R语言一直是研究人员和数据科学家们的首选工具。其中，ggplot2包是R语言中最受欢迎和强大的可视化工具之一。它提供了许多灵活且精美的图形选项，使用户能够轻松创建具有吸引力和信息丰富的图表。本文将介绍如何使用ggplot2包在R语言中生成高分辨率的图片。我们将探索不同的保存选项，以确保我们获得清晰、适应各种输出需求的图像。首先，
C语言【进阶篇】之指针——涵盖基础、数组与高级概念 EnigmaCoder C语言 c语言开发语言学习
目录前言指针是什么指针基础内存与地址指针变量指针类型const修饰指针指针运算野指针和assert断言数组与指针数组名的理解使用指针访问数组一维数组传参的本质指针数组✍️高级指针概念二级指针函数指针函数指针数组回调函数qsort的使用与模拟实现⚙️指针与字符串字符指针字符串处理函数（如strlen和sizeof的对比）总结前言大家好！我是EnigmaCoder。本文收录于我的专栏C，感谢您的支持！
Java 中操作 R：深度整合与高效应用 froginwe11 开发语言
Java中操作R：深度整合与高效应用引言随着大数据和机器学习的快速发展，R语言在数据分析和可视化方面扮演着越来越重要的角色。而Java作为一种广泛应用于企业级应用开发的语言，其强大的功能和稳定性使其成为构建高性能应用的首选。本文将探讨Java如何操作R语言，实现高效的数据分析应用。一、Java操作R的背景R语言优势：R语言拥有丰富的统计分析、数据可视化工具和机器学习算法库，是数据分析领域的首选语言
R语言对高频交易订单流进行建模分析 4 oxuzhenyi 实验楼课程机器学习 R
一、实验介绍--订单流模型拟合1.1实验知识点指数核hawkes过程拟合正反馈强度分析订单量影响分析1.2实验环境R3.4.1Rstudio二、订单流模型拟合在上节中我们对订单流数据做了一些统计分析，对交易的一些特征有了一些粗浅的理解，在本节中我们要做的是利用实际数据来拟合hawkes过程，看一看真实数据的订单流动力学中有什么特征。首先我们仍是选出交易时间内的数据：library(tidyvers
R语言对高频交易订单流进行建模分析 3 oxuzhenyi 实验楼课程机器学习 R
一、实验介绍--订单流数据描述分析1.1实验知识点订单流数据表示订单间隔分析订单信息率平稳性研究订单流动性研究限价单相对价格分析1.2实验环境R3.4.1Rstudio二、订单流数据描述分析2.1订单流数据表示当我们在金融市场上做交易时，可以看到一个委托单簿，上面陈列着买价和卖价以及它们对应的量，举个例子，比特币市场的订单簿：可以看到红色代表的是卖价，或者说是ask,而绿色代表的是买价，或者说是b
【自学笔记】R语言基础知识点总览-持续更新 Long_poem 笔记 r语言开发语言
提示：文章写完后，目录可以自动生成，如何生成可参考右边的帮助文档文章目录R语言基础知识点总览1.R语言简介2.R语言安装与环境配置3.R语言基础语法3.1数据类型3.2向量与矩阵3.3数据框与列表4.控制结构4.1条件语句4.2循环结构5.函数6.数据可视化总结R语言基础知识点总览1.R语言简介R是一种用于统计计算和图形的编程语言和软件环境。R语言由RossIhaka和RobertGentlema
R语言决策树、svm支持向量机、随机森林别叫我名字20 R语言决策树支持向量机 r语言
本人正在学习R语言，想利用这个平台记录自己一些自己的学习情况，方便以后查找，也想分享出来提供一些资料给同样学习R语言的同学们。（如果内容有错误，欢迎大家批评指正）1.决策树我们使用的还是RStudio自带的数据集iris。#######################决策树模型install.packages("rpart")#安装库library("rpart")dt<-function(dat
决策树、朴素贝叶斯、随机森林、支持向量机、XGBoost 和 LightGBM算法的R语言实现生信与基因组学生信分析项目进阶技能合集算法机器学习 r语言
基本逻辑（1）使用rnorm函数生成5个特征变量x1到x5，并根据这些特征变量的线性组合生成一个二分类的响应变量y；（2）将生成的数据存储在数据框中，处理缺失值，并将响应变量转换为因子类型；（3）使用决策树、朴素贝叶斯、随机森林、支持向量机、XGBoost和LightGBM六种机器学习模型算法对数据进行训练和评估；（4）将各个模型的准确率和AUC值存储在结果数据框中，并通过柱状图展示结果。1.R包
R语言2——数据类型和基本运算朝荣 #R语言 R语言运算 R数据类型
R语言2——数据类型和基本运算目录R语言2——数据类型和基本运算1.R的数据类型1.R的数据类型（1）Logical（逻辑型）：只有两个值TRUE,FALSE（2）Numeric（数字）：整数、小数等（3）Complex（复合型）：带有虚数i的数，如1+2i（4）Character（字符）：包含在“”之中，如“hello！”（5）Vectors向量：c()函数，将元素组合成一个向量。c(1,2,3
R语言获取数据——手工输入数据蜗牛数据分析 R语言从入门到实战 r语言开发语言
在R语言中获取数据集的方法有多种，例如读取Excel文件、数据库中的文件，而当我们没有这些渠道能够获取到数据集时，也可以手工输入数据，即通过键盘输入数据，它是获取数据集的最简单方法。另外，还可以在代码中直接输入数据，下面分别进行介绍。数据编辑器R提供了内置的数据编辑器，通过edit()函数调用该编辑器就可以实现手工输入数据。举例1：通过数据编辑器创建学生成绩表下面实现“学生成绩表”，具体步骤如下：
R语言——数据框高现实 r语言
R语言——数据框data.table/data.frame1、数据框数据框是R的一个重要数据类型,用来存储表格数据2、可认为是特殊类型的列表,列表中每个元素(每类)都有同样的长度每一列3、可以是不同的类型(矩阵是相同的)特殊属性:行名row.names4、可以通过读取表格函数read.table()或read.csv()读取数据框5、可以通过调用data.matrix()将数据框转化为矩阵x<-d
R语言入门——数据类型和数据结构 Sean1014 r语言数据结构 r语言
变量基本说明R语言计算的过程中，通常需要使用变量来存放中间结果。变量相当于给定一个空间，只能保存一种数据结构，只保存最后一次被赋值的数据。无需事先声明。命名规则变量名应该尽可能简单、意义明确，命名遵循一定规律，以便与他人交流理解。只能使用字母（区分大小写）、数字、下划线“_”和英文句点“.”给变量命名；不能以数字、下划线作为开头；若以句点开头，第二位不能是数字；变量名有效性原因var_name1.
探索大数据分析的无限可能：R语言的应用与实践 Echo_Wish 大数据数据分析 r语言数据挖掘
探索大数据分析的无限可能：R语言的应用与实践随着数据时代的来临，大数据已经成为各行各业的重要资产。如何从海量数据中挖掘出有价值的信息，成为了企业和研究人员关注的焦点。在众多的数据分析工具中，R语言因其强大的统计分析功能和丰富的生态系统，备受青睐。本文将深入探讨使用R语言进行大数据分析的方法和实践，并通过实例代码加以说明。为什么选择R语言？R语言是一种专门用于统计分析和数据可视化的编程语言，具有以下
利用R语言irr包计算ICC值（组内相关系数） mlhylzqwxli r语言
ICC值是一个较为陌生的概念，在统计学中应用较多，引用百度百科的介绍：组内相关系数(ICC)是衡量和评价观察者间信度(inter-observerreliability)和复测信度(test-retestreliability)的信度系数(reliabilitycoefficient)指标之一。它最先由Bartko于1966年用于测量和评价信度的大小。ICC等于个体的变异度除以总的变异度，故其值介
R语言机器学习系列-随机森林回归代码解读 Mrrunsen R语言大学作业机器学习回归 r语言
回归问题指的是因变量或者被预测变量是连续性变量的情形，比如预测身高体重的具体数值是多少的情形。整个代码大致可以分为包、数据、模型、预测评估4个部分，接下来逐一解读。1、包部分，也就是加载各类包，包括随机森林包randomForest，数据相关包tidyverse、skimr、DataExplorer，模型评估包caret。2、数据部分，主要是读取数据，处理缺失值，转换变量类型。3、模型部分。为了对
r语言手动算两个C指数p值,如何用R语言进行Pvalue显著性标记？蒲牢森 r语言手动算两个C指数p值
作者：一只想飞的喵审稿：童蒙编辑：angelica箱线图是统计学中较常见的图形之一。这篇文章将讲述如何简单比较两组或多组的平均值，且添加显著性标记。通常情况根据显著性p值的数值大小，分为四类：(1)0.01≤p<0.05，*(2)0.001≤p<0.01，**(3)0.0001≤p<0.001，***(4)p<0.0001,****接下来会讲述三种添加显著性标记的方法。方法1-手动添加1：创建数据
使用geom_bracket函数为指定水平箱图之间添加假设检验名称以及显著性水平p值（R语言）认真写代码i r语言开发语言 R语言
使用geom_bracket函数为指定水平箱图之间添加假设检验名称以及显著性水平p值（R语言）在R语言中，我们经常使用箱图（boxplot）来可视化数据的分布和比较不同组之间的差异。当我们进行假设检验时，除了展示箱图之间的差异，还需要在图形上添加假设检验的名称和显著性水平p值，以便更清晰地表达结果。在本文中，我们将介绍如何使用ggplot2包中的geom_bracket函数为指定水平箱图之间添加假
R语言绘图：韦恩图善木科研 R语言 r语言生信分析生物信息数据分析
韦恩分析韦恩分析（VennAnalysis）常用于可视化不同数据集之间的交集和并集。维恩图（Venndiagram），也叫文氏图、温氏图、韦恩图、范氏图，用于显示元素集合重叠区域的关系型图表，通过图形与图形之间的层叠关系，来反应数据集之间的相交关系。在R语言中，进行韦恩分析（Venn图绘制）可以通过多个不同的包来实现，常用的包括VennDiagram、venn和ggVenn等。本文案使用ggVen
在R语言中，要在图形中添加组间p值，可以使用`geom_bracket`函数 ByteWhisper r语言 python 开发语言 R语言
在R语言中，要在图形中添加组间p值，可以使用geom_bracket函数。geom_bracket函数可以用来创建一个带有括号标记的图形，用于表示组间的显著性差异。本文将详细介绍如何使用geom_bracket函数来添加组间p值，并提供相应的源代码示例。首先，我们需要安装并加载ggplot2包，因为geom_bracket函数是ggplot2包中的一部分。可以使用以下代码安装和加载ggplot2包
R语言使用fs包的file_copy函数、dir_copy函数、link_copy函数将文件、目录、超链接从一个位置拷贝（copy）到另一个位置 statistics.insight R语言入门课 r语言数据挖掘机器学习开发语言
R语言使用fs包的file_copy函数、dir_copy函数、link_copy函数将文件、目录、超链接从一个位置拷贝（copy）到另一个位置目录R语言使用fs包的file_copy函数、dir_copy函数、link_copy函数将文件、目录、超链接从一个位置拷贝（copy）到另一个位置#包和库的安装、导入#R语言使用fs包的dir_ls函数列出指定文件夹下面的所有文件和文件夹（listfil
R语言使用table1包绘制（生成）三线表实战：单变量分列构建三线表、使用render参数设置显示的统计量以及换行方式、使用topclass参数自定义设置显示网络和居中对齐 statistics.insight R语言入门课 r语言开发语言数据挖掘机器学习
R语言使用table1包绘制（生成）三线表实战：单变量分列构建三线表、使用render参数设置显示的统计量以及换行方式、使用topclass参数自定义设置显示网络和居中对齐目录R语言使用table1包绘制（生成）三线表、使用单变量分列构建三线表、使用render参数设置显示的统计量以及换行方式、使用topclass参数自定义设置显示网络和居中对齐#三线表是什么？#导入包并构建仿真数据#R语言使用t
R语言广义加性模型：使用广义线性加性模型GAMs构建logistic回归 TechInk r语言回归开发语言 R语言
R语言广义加性模型：使用广义线性加性模型GAMs构建logistic回归在数据分析和建模领域，广义加性模型（GeneralizedAdditiveModels，简称GAMs）是一种常用的非参数统计方法。它结合了广义线性模型（GeneralizedLinearModels，简称GLMs）的灵活性和非线性关系的建模能力，可以适用于各种类型的响应变量，包括二元回归（logistic回归）。本文将介绍如何
R语言广义加型模型（GAM）的运用例子及实现教程 Mrrunsen R语言大学作业 r语言开发语言
文章目录步骤1：加载所需包和数据步骤2：数据预处理步骤3：拟合广义加型模型步骤4：查看模型摘要和诊断模型摘要系数估计平滑项模型质量步骤5：预测和可视化结论广义加型模型（GeneralizedAdditiveModel，简称GAM）是一种灵活的非线性建模方法，在统计学和机器学习领域被广泛应用。GAM可以用于拟合非线性关系，适用于多个预测变量之间的复杂关系，并且可以处理连续和分类变量。本教程将向您展示
数据清洗与统计分析原理与代码实战案例讲解 AI天才研究院 ChatGPT AI大模型企业级应用开发实战 DeepSeek R1 &大数据AI人工智能大模型大厂Offer收割机面试题简历程序员读书硅基计算碳基计算认知计算生物计算深度学习神经网络大数据 AIGC AGI LLM Java Python 架构设计 Agent 程序员实现财富自由
《数据清洗与统计分析原理与代码实战案例讲解》关键词：数据清洗、统计分析、Python、R语言、数据预处理、数据分析、机器学习、大数据摘要：本文将深入探讨数据清洗与统计分析的原理，并通过丰富的实战案例展示如何在实际项目中应用这些技术。我们将详细讲解数据清洗的基本概念、流程和方法，以及统计分析的各种技术和应用。通过本文的学习，您将掌握数据清洗与统计分析的核心技能，提升数据处理和分析的能力，为后续的数据
2小时学懂【多元统计分析】——聚类分析（R语言）木小鹿多元统计 R语言代码机器学习算法人工智能开发语言数据挖掘数据分析
聚类分析是一种无监督学习方法，用于将相似的观测值（或对象）分组到集群中。下面我将展示如何使用几种常见的聚类方法：K-均值（K-means）、层次聚类（HierarchicalClustering）和DBSCAN。1.K-均值聚类（K-meansClustering）K-均值是一种迭代的聚类算法，它将数据划分为K个预定义的集群。#加载需要的包library(cluster)#假设我们有一些二维数据s
面向对象面向过程 3213213333332132 java
面向对象：把要完成的一件事，通过对象间的协作实现。面向过程：把要完成的一件事，通过循序依次调用各个模块实现。我把大象装进冰箱这件事为例，用面向对象和面向过程实现，都是用java代码完成。 1、面向对象 package bigDemo.ObjectOriented; /** * 大象类 * * @Description * @author FuJian
Java Hotspot: Remove the Permanent Generation bookjovi HotSpot
openjdk上关于hotspot将移除永久带的描述非常详细，http://openjdk.java.net/jeps/122 JEP 122: Remove the Permanent Generation Author Jon Masamitsu Organization Oracle Created 2010/8/15 Updated 2011/
正则表达式向前查找向后查找,环绕或零宽断言 dcj3sjt126com 正则表达式
向前查找和向后查找 1. 向前查找：根据要匹配的字符序列后面存在一个特定的字符序列(肯定式向前查找)或不存在一个特定的序列(否定式向前查找)来决定是否匹配。.NET将向前查找称之为零宽度向前查找断言。对于向前查找，出现在指定项之后的字符序列不会被正则表达式引擎返回。 2. 向后查找：一个要匹配的字符序列前面有或者没有指定的
BaseDao 171815164 seda
import java.sql.Connection; import java.sql.DriverManager; import java.sql.SQLException; import java.sql.PreparedStatement; import java.sql.ResultSet; public class BaseDao { public Conn
Ant标签详解--Java命令 g21121 Java命令
这一篇主要介绍与java相关标签的使用终于开始重头戏了，Java部分是我们关注的重点也是项目中用处最多的部分。 1
[简单]代码片段_电梯数字排列 53873039oycg 代码
今天看电梯数字排列是9 18 26这样呈倒N排列的,写了个类似的打印例子，如下: import java.util.Arrays; public class 电梯数字排列_S3_Test { public static void main(S
Hessian原理云端月影 hessian原理
Hessian 原理分析一．远程通讯协议的基本原理网络通信需要做的就是将流从一台计算机传输到另外一台计算机，基于传输协议和网络 IO 来实现，其中传输协议比较出名的有 http 、 tcp 、 udp 等等， http 、 tcp 、 udp 都是在基于 Socket 概念上为某类应用场景而扩展出的传输协
区分Activity的四种加载模式----以及Intent的setFlags aijuans android
在多Activity开发中，有可能是自己应用之间的Activity跳转，或者夹带其他应用的可复用Activity。可能会希望跳转到原来某个Activity实例，而不是产生大量重复的Activity。这需要为Activity配置特定的加载模式，而不是使用默认的加载模式。加载模式分类及在哪里配置 Activity有四种加载模式： standard singleTop
hibernate几个核心API及其查询分析 antonyup_2006 html .net Hibernate xml 配置管理
(一) org.hibernate.cfg.Configuration类读取配置文件并创建唯一的SessionFactory对象.(一般,程序初始化hibernate时创建.) Configuration co
PL/SQL的流程控制百合不是茶 oracle PL/SQL编程循环控制
PL/SQL也是一门高级语言,所以流程控制是必须要有的,oracle数据库的pl/sql比sqlserver数据库要难,很多pl/sql中有的sqlserver里面没有流程控制; 分支语句 if 条件 then 结果 else 结果 end if ; 条件语句 case when 条件 then 结果; 循环语句 loop
强大的Mockito测试框架 bijian1013 mockito 单元测试
一.自动生成Mock类在需要Mock的属性上标记@Mock注解，然后@RunWith中配置Mockito的TestRunner或者在setUp()方法中显示调用MockitoAnnotations.initMocks(this);生成Mock类即可。二.自动注入Mock类到被测试类 &nbs
精通Oracle10编程SQL(11)开发子程序 bijian1013 oracle 数据库 plsql
/* *开发子程序 */ --子程序目是指被命名的PL/SQL块，这种块可以带有参数，可以在不同应用程序中多次调用 --PL/SQL有两种类型的子程序：过程和函数 --开发过程 --建立过程：不带任何参数 CREATE OR REPLACE PROCEDURE out_time IS BEGIN DBMS_OUTPUT.put_line(systimestamp); E
【EhCache一】EhCache版Hello World bit1129 Hello world
本篇是EhCache系列的第一篇，总体介绍使用EhCache缓存进行CRUD的API的基本使用，更细节的内容包括EhCache源代码和设计、实现原理在接下来的文章中进行介绍环境准备 1.新建Maven项目 2.添加EhCache的Maven依赖 <dependency> <groupId>ne
学习EJB3基础知识笔记白糖_ bean Hibernate jboss webservice ejb
最近项目进入系统测试阶段，全赖袁大虾领导有力，保持一周零bug记录，这也让自己腾出不少时间补充知识。花了两天时间把“传智播客EJB3.0”看完了，EJB基本的知识也有些了解，在这记录下EJB的部分知识，以供自己以后复习使用。 EJB是sun的服务器端组件模型，最大的用处是部署分布式应用程序。EJB (Enterprise JavaBean)是J2EE的一部分，定义了一个用于开发基
angular.bootstrap boyitech AngularJS AngularJS API angular中文api
angular.bootstrap 描述：手动初始化angular。这个函数会自动检测创建的module有没有被加载多次，如果有则会在浏览器的控制台打出警告日志，并且不会再次加载。这样可以避免在程序运行过程中许多奇怪的问题发生。使用方法： angular .
java-谷歌面试题-给定一个固定长度的数组，将递增整数序列写入这个数组。当写到数组尾部时，返回数组开始重新写，并覆盖先前写过的数 bylijinnan java
public class SearchInShiftedArray { /** * 题目：给定一个固定长度的数组，将递增整数序列写入这个数组。当写到数组尾部时，返回数组开始重新写，并覆盖先前写过的数。 * 请在这个特殊数组中找出给定的整数。 * 解答： * 其实就是“旋转数组”。旋转数组的最小元素见http://bylijinnan.iteye.com/bl
天使还是魔鬼？都是我们制造 ducklsl 生活教育情感
----------------------------剧透请原谅，有兴趣的朋友可以自己看看电影，互相讨论哦！！！从厦门回来的动车上，无意中瞟到了书中推荐的几部关于儿童的电影。当然，这几部电影可能会另大家失望，并不是类似小鬼当家的电影，而是关于“坏小孩”的电影！自己挑了两部先看了看，但是发现看完之后，心里久久不能平
[机器智能与生物]研究生物智能的问题 comsci 生物
我想,人的神经网络和苍蝇的神经网络,并没有本质的区别...就是大规模拓扑系统和中小规模拓扑分析的区别.... 但是,如果去研究活体人类的神经网络和脑系统,可能会受到一些法律和道德方面的限制,而且研究结果也不一定可靠,那么希望从事生物神经网络研究的朋友,不如把
获取Android Device的信息 dai_lm android
String phoneInfo = "PRODUCT: " + android.os.Build.PRODUCT; phoneInfo += ", CPU_ABI: " + android.os.Build.CPU_ABI; phoneInfo += ", TAGS: " + android.os.Build.TAGS; ph
最佳字符串匹配算法（Damerau-Levenshtein距离算法）的Java实现 datamachine java 算法字符串匹配
原文：http://www.javacodegeeks.com/2013/11/java-implementation-of-optimal-string-alignment.html------------------------------------------------------------------------------------------------------------
小学5年级英语单词背诵第一课 dcj3sjt126com english word
long 长的 show 给...看，出示 mouth 口，嘴 write 写 use 用，使用 take 拿，带来 hand 手 clever 聪明的 often 经常 wash 洗 slow 慢的 house 房子 water 水 clean 清洁的 supper 晚餐 out 在外 face 脸，
macvim的使用实战 dcj3sjt126com mac vim
macvim用的是mac里面的vim, 只不过是一个GUI的APP, 相当于一个壳 1. 下载macvim https://code.google.com/p/macvim/ 2. 了解macvim :h vim的使用帮助信息 :h macvim
java二分法查找蕃薯耀 java二分法查找二分法 java二分法
java二分法查找 >>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>> 蕃薯耀 2015年6月23日 11:40:03 星期二 http:/
Spring Cache注解+Memcached hanqunfeng spring memcached
Spring3.1 Cache注解依赖jar包：  <dependency> <groupId>com.google.code.simple-spring-memcached</groupId> <artifactId>simple-s
apache commons io包快速入门 jackyrong apache commons
原文参考 http://www.javacodegeeks.com/2014/10/apache-commons-io-tutorial.html Apache Commons IO 包绝对是好东西，地址在http://commons.apache.org/proper/commons-io/，下面用例子分别介绍： 1）工具类 2
如何学习编程 lampcy java 编程 C++c
首先,我想说一下学习思想.学编程其实跟网络游戏有着类似的效果.开始的时候,你会对那些代码,函数等产生很大的兴趣,尤其是刚接触编程的人,刚学习第一种语言的人.可是,当你一步步深入的时候,你会发现你没有了以前那种斗志.就好象你在玩韩国泡菜网游似的,玩到一定程度,每天就是练级练级,完全是一个想冲到高级别的意志力在支持着你.而学编程就更难了,学了两个月后,总是觉得你好象全都学会了,却又什么都做不了,又没有
架构师之spring-----spring3.0新特性的bean加载控制@DependsOn和@Lazy nannan408 Spring3
1.前言。如题。 2.描述。 @DependsOn用于强制初始化其他Bean。可以修饰Bean类或方法，使用该Annotation时可以指定一个字符串数组作为参数，每个数组元素对应于一个强制初始化的Bean。 @DependsOn({"steelAxe","abc"}) @Comp
Spring4+quartz2的配置和代码方式调度 Everyday都不同代码配置 spring4 quartz2.x 定时任务
前言：这些天简直被quartz虐哭。。因为quartz 2.x版本相比quartz1.x版本的API改动太多，所以，只好自己去查阅底层API…… quartz定时任务必须搞清楚几个概念： JobDetail——处理类 Trigger——触发器，指定触发时间，必须要有JobDetail属性，即触发对象 Scheduler——调度器，组织处理类和触发器，配置方式一般只需指定触发
Hibernate入门 tntxia Hibernate
前言使用面向对象的语言和关系型的数据库，开发起来很繁琐，费时。由于现在流行的数据库都不面向对象。Hibernate 是一个Java的ORM（Object/Relational Mapping）解决方案。 Hibernte不仅关心把Java对象对应到数据库的表中，而且提供了请求和检索的方法。简化了手工进行JDBC操作的流程。如
Math类 xiaoxing598 Math
一、Java中的数字（Math）类是final类，不可继承。 1、常数 PI：double圆周率 E：double自然对数 2、截取（注意方法的返回类型） double ceil(double d) 返回不小于d的最小整数 double floor(double d) 返回不大于d的整最大数 int round(float f) 返回四舍五入后的整数 long round