friklogff

爬虫数据清洗可视化实战-就业形势分析

基于采集和分析招聘网站的数据的芜湖就业形势的调查研究

一、引言

本报告旨在分析基于大数据的当地就业形势，并提供有关薪资、工作地点、经验要求、学历要求、公司行业、公司福利以及公司类型及规模的详细信息。该分析是通过网络爬虫技术对招聘网站的数据进行采集和分析而得出的。
本文部分内容来自网上搜集与个人实践。如果任何信息存在错误,欢迎读者批评指正。本文仅用于学习交流,不用作任何商业用途。

二、薪资范围分布分析

1. 薪资范围分布直方图

在薪资范围分布直方图中，我们对薪资范围的分布情况进行了分析。以下是主要结果：

图表内容：包括最低薪资和最高薪资的直方图，以薪资范围为 x 轴，招聘数量为 y 轴，以不同颜色表示最低薪资和最高薪资。
本地数据存储：我们保存了薪资范围、最低薪资数量和最高薪资数量的文本文件 salary_distribution.txt，以及直方图图像文件 salary_distribution.png。

根据提供的薪资范围和数量数据，我们可以分析出不同薪资范围的招聘情况。以下是对数据的分析：

分析：
- 最低薪资数量大部分集中在0.0-25000.0的范围内，共计521个职位。
- 最高薪资数量也主要分布在0.0-25000.0范围内，有444个职位。
- 平均薪资数量在不同薪资范围内有较大差异，最高的平均薪资数量在0.0-25000.0范围内，为498。
- 在其他薪资范围内，最低薪资数量、最高薪资数量和平均薪资数量相对较少。
结论：
- 大多数招聘职位的薪资范围集中在较低的区间（0.0-25000.0），这可能是大多数职位的薪资水平。
- 在更高薪资范围内的职位数量较少，但平均薪资水平可能更高。
- 从薪资范围的分布情况来看，职位的薪资差异较大，求职者需要根据自身情况和期望进行选择。

这个分析可以帮助求职者了解不同薪资范围内的招聘情况，有助于他们做出更明智的职业决策。

三、工作地点分析

2. 不同地点的招聘数量柱状图

我们分析了不同工作地点的招聘数量情况。以下是主要结果：

图表内容：柱状图展示了不同工作地点的招聘数量，x 轴表示工作地点，y 轴表示招聘数量。
本地数据存储：我们保存了地点和对应招聘数量的文本文件 location_counts.txt，以及柱状图图像文件 location_counts.png。
分析：
- 芜湖是最活跃的招聘地点，共有279个招聘职位。
- 芜湖的各个区域也有一定数量的招聘职位，包括芜湖·鸠江区（80个职位）、芜湖·弋江区（58个职位）、芜湖·芜湖县（23个职位）、芜湖·繁昌县（13个职位）、芜湖·镜湖区（10个职位）和芜湖·三山区（10个职位）。
- 南京·江北新区、芜湖·无为市、滁州、芜湖·南陵县等地也有一些招聘职位，但数量较少。
- 其他城市和地区，如马鞍山、宣城、黔南、合肥、安徽省、苏州·姑苏区、镇江、合肥·蜀山区、郑州·高新区、石家庄、上海·嘉定区、南京·鼓楼区、深圳·福田区、淮南、合肥·高新区、宿州、南京·溧水区、商丘、南京·高淳区、杭州·余杭区、上海·闵行区、大连·金州区、南京和郑州等地的招聘数量相对较少，每个地点只有1或2个职位。
结论：
- 芜湖是招聘活动最为集中的地点，有着最多的招聘职位。
- 除芜湖外，南京的江北新区也有一定数量的招聘职位。
- 对于求职者来说，了解不同地点的招聘情况有助于选择适合自己的工作地点，以及更好地规划求职策略。

3. 不同地点的平均薪资柱状图

我们进一步分析了不同工作地点的平均薪资情况。以下是主要结果：

图表内容：柱状图展示了不同工作地点的平均薪资，x 轴表示工作地点，y 轴表示平均薪资。
本地数据存储：我们保存了工作地点和对应平均薪资的文本文件 avg_salary_by_location.txt，以及柱状图图像文件 avg_salary_by_location.png。
分析：
- 郑州·高新区的平均薪资最高，为150,000.0元。
- 滁州、合肥、黔南和安徽省的平均薪资也在较高水平，分别为119,750.0元、82,500.0元、79,000.0元和53,000.0元。
- 芜湖、南京、杭州、石家庄等地的平均薪资相对较低，不超过15,000.0元。
- 其他地点的平均薪资也有所不同，显示了不同地区的薪资差异。
结论：
- 工作地点对于平均薪资有显著影响，一些地区的平均薪资明显高于其他地区。
- 郑州·高新区、滁州、合肥等地的平均薪资较高，可能反映了这些地区的经济发展水平和就业机会较多。
- 薪资水平相对较低的地区可能需要考虑其他因素，如生活成本和就业机会。

这个分析可以帮助求职者了解不同地点的平均薪资情况，有助于他们在选择工作地点时做出更明智的决策。

四、经验和学历要求分析

4. 不同经验要求和学历要求的招聘数量柱状图

我们分析了不同经验要求和学历要求的招聘数量情况。以下是主要结果：

图表内容：包括两个子图，左侧子图展示不同经验要求的招聘数量，右侧子图展示不同学历要求的招聘数量。
本地数据存储：我们保存了经验要求和对应招聘数量、学历要求和对应招聘数量的文本文件 experience_education_counts.txt，以及柱状图图像文件 experience_education_counts.png。
经验要求分析：
- 最常见的经验要求是3-4年，共有180个职位要求此经验。
- 其次是2年经验，有102个职位。
- 1年经验和5-7年经验的职位数量相近，分别为101和88个职位。
- 无需经验的职位也有一定数量，为52个职位。
- 对于更高级别的经验要求，10年以上和8-9年的职位数量相对较少，分别为10和9个职位。
学历要求分析：
- 最常见的学历要求是大专，共有257个职位要求此学历。
- 本科学历要求的职位数量也相对较多，为188个职位。
- 中技/中专、高中和初中及以下学历要求的职位数量依次减少，分别为52、33和9个职位。
- 硕士学历要求的职位数量最少，仅有3个职位。
结论：
- 大多数职位对于经验要求集中在1-4年范围内，以及无需经验。
- 学历要求方面，大专和本科是最常见的学历要求，占据了绝大多数职位。
- 对于求职者来说，了解不同经验和学历要求的职位分布有助于更好地匹配自己的背景和目标，以寻找适合的工作机会。

五、公司信息分析

5. 不同公司行业的招聘数量柱状图

我们分析了不同公司行业的招聘数量情况。以下是主要结果：

图表内容：柱状图展示了不同公司行业的招聘数量，x 轴表示公司行业，y 轴表示招聘数量。
本地数据存储：我们保存了公司行业和对应招聘数量的文本文件 industry_counts.txt，以及柱状图图像文件 industry_counts.png。
分析：
- 汽车行业
  是招聘数量最多的行业，拥有142个职位。
- 新能源和电子技术/半导体/集成电路行业分别拥有59和56个职位，排名第二和第三。
- 机械/设备/重工、汽车零配件、计算机软件等行业也有一定数量的职位，分别为46、39和28个。
- 金融/投资/证券、多元化业务集团公司、环保、仪器仪表/工业自动化等行业的招聘数量相对较少，都在10个以下。
结论：
- 不同公司行业的招聘情况差异较大，一些行业拥有大量的职位，而其他行业则拥有相对较少的职位。
- 汽车行业、新能源和电子技术/半导体/集成电路行业可能是求职者关注的热门行业，因为它们有较多的职位机会。
- 需要注意的是，金融/投资/证券、多元化业务集团公司等行业的招聘数量相对较少，可能竞争较激烈。

这个分析可以帮助求职者了解不同公司行业的招聘情况，有助于他们根据自己的兴趣和专业选择适合的行业和职位。

6. 不同公司行业的平均薪资柱状图

我们进一步分析了不同公司行业的平均薪资情况。以下是主要结果：

图表内容：柱状图展示了不同公司行业的平均薪资，x 轴表示公司行业，y 轴表示平均薪资。
本地数据存储：我们保存了公司行业和对应平均薪资的文本文件 avg_salary_by_industry.txt，以及柱状图图像文件 avg_salary_by_industry.png。
分析：
- 医疗/护理/卫生行业拥有最高的平均薪资，达到116,000元。这可能是因为医疗行业对专业人员有较高的薪资标准。
- 电子技术/半导体/集成电路行业和计算机软件行业的平均薪资也相对较高，分别为24,696元和19,071元。
- 金融/投资/证券行业的平均薪资为47,857元，属于高薪行业之一。
- 汽车、快速消费品(食品、饮料、化妆品)、汽车零配件、建筑/建材/工程等行业的平均薪资也较高，都在10,000元以上。
- 一些行业如广告、生活服务、中介服务等平均薪资较低，都在10,000元以下。
结论：
- 不同公司行业的平均薪资差异很大，一些行业的平均薪资相对较高，而其他行业则平均薪资较低。
- 求职者可以根据自己的职业目标和薪资期望选择适合的行业和公司。
- 需要注意的是，平均薪资只是一个参考指标，实际薪资还会受到个人经验、职位级别、地区等多种因素的影响。

这个分析有助于求职者了解不同行业的薪资水平，以便做出更明智的职业选择。

六、公司福利和类型规模分析

7. 公司福利项出现次数柱状图

我们分析了不同公司福利项的出现次数情况。以下是主要结果：

图表内容：柱状图展示了不同公司福利项的出现次数，x 轴表示公司福利项，y 轴表示出现次数。
本地数据存储：我们保存了公司福利项和对应出现次数的文本文件 welfare_counts.txt，以及柱状图图像文件 welfare_counts.png。
分析：
- 从柱状图中，你可以看到"五险一金"是最受欢迎的公司福利项，出现次数最多，表明公司普遍提供这项福利以满足员工的基本社会保障需求。
- "绩效奖金"和"年终奖金"紧随其后，这表明公司也非常重视员工的绩效评估和激励措施。
- 一些其他福利项，如"员工旅游"和"免费班车"，出现次数相对较低，但仍然受到一定关注。
- "免费员工餐"和"包吃包住"等福利项的出现次数较少，可能只有少数公司提供。
- 常见福利项：出现次数最多的公司福利项是"五险一金"，出现了372次，这表明这是大多数公司都提供的标准福利。其他常见福利项包括"绩效奖金"、“年终奖金”、“餐饮补贴"和"专业培训”。
- 标配福利：除了"五险一金"外，“员工旅游”、“免费班车”、“交通补贴”、“定期体检”、"通讯补贴"等福利项也被多家公司采用，这些福利通常是吸引员工和提高员工满意度的常见选择。
- 行业相关福利：某些福利项可能与公司所属行业有关，例如"汽车行业"和"汽车零部件"相关的福利项，包括"汽车"、“出厂检验报告"和"车补”。
- 个性化福利：还有一些公司可能提供一些较为个性化的福利，如"中医平台推广"、“口吃矫正”、"深度学习"等，这些福利可能根据公司的特殊需求或员工的特殊要求而设定。
结论：
- 福利改进：通过分析这些福利项，您可以了解到其他公司提供的福利，有助于您了解市场竞争和吸引员工的策略。您可以根据这些信息来考虑是否需要改进或新增公司的福利政策，以更好地吸引和留住人才。
- 这些分析可以帮助你了解不同公司在福利方面的偏好，以及哪些福利项可能对员工招聘和保留产生积极影响。当然，具体的福利选择还可能受到公司规模、行业、地理位置等因素的影响。

8. 不同公司类型及规模的招聘数量柱状图

我们分析了不同公司类型及规模的招聘数量情况。以下是主要结果：

图表内容：柱状图展示了不同公司类型及规模的招聘数量，x 轴表示公司类型及规模，y 轴表示招聘数量。
本地数据存储：我们保存了公司类型及规模和对应招聘数量的文本文件 company_type_and_size_counts.txt，以及柱状图图像文件 company_type_and_size_counts.png。
分析：
- 民营公司在不同规模下都有较多的招聘需求，其中民营公司规模在150-500人之间的需求最高，为102个职位。
- 其次是500-1000人规模的民营公司，招聘数量为66个职位。
- 国企中，规模在10000人以上的需求较高，有26个职位。
- 合资公司的需求也相对均衡，500-1000人规模的公司需求最多，为22个职位。
- 有一些公司没有具体规模标识，招聘数量为16个职位，可能是小型的创业公司或者其他类型的公司。
- 外资公司在不同规模下的需求相对较少，多数集中在150-500人规模的公司，有16个职位。
- 已上市的公司需求较为有限，多数集中在10000人以上和500-1000人规模的公司。
结论：
- 民营公司和国企是招聘需求较高的公司类型，尤其是规模在150-500人之间的民营公司。
- 合资公司和外资公司的需求相对较少，主要集中在500-1000人和150-500人规模的公司。
- 已上市公司的招聘需求相对较低，多数分布在较大规模的公司中。
- 招聘者可以根据公司类型和规模的分布情况来更好地选择适合自己的职位和公司。

这个分析有助于求职者了解不同公司类型和规模下的招聘情况，以便做出更明智的职业决策。

七、关键词分析

9. 公司行业词云图

我们生成了公司行业的词云图，以展示公司行业的关键词。以下是主要结果：

图表内容：词云图展示了不同公司行业的关键词，以词语频率为基础生成，文字颜色随机。
本地数据存储：我们保存了公司行业文本数据到本地文件 industry_wordcloud.txt，以及词云图像文件 industry_wordcloud.png。
分析：
- 词云图中显示了不同行业的关键词，其中最常出现的词语包括"汽车"、“电子”、“技术”、“新能源”、"医疗"等。
- "汽车"是出现频率最高的词语，表明汽车行业在招聘市场上占据重要地位。
- "电子"和"技术"也是热门行业关键词，说明这两个行业也有较多的招聘机会。
结论：
- 从词云图中可以看出，汽车、电子、技术等行业是当前招聘市场的热门领域，求职者可以关注这些行业的职业机会。
- 词云图提供了对公司行业数据的可视化呈现，有助于直观地了解不同行业的招聘情况。

10. 公司福利词云图

我们还生成了公司福利的词云图，以展示公司福利的关键词。以下是主要结果：

图表内容：词云图展示了不同公司福利的关键词，以词语频率为基础生成，文字颜色随机。
本地数据存储：我们保存了公司福利文本数据到本地文件 welfare_wordcloud.txt，以及词云图像文件 welfare_wordcloud.png。
以下是根据福利文本数据生成的词云图和分析：
分析：
- 词云图中显示了不同公司提供的福利待遇，其中最常出现的福利包括"五险一金"、“年终奖金”、“餐饮补贴”、“通讯补贴”、"员工旅游"等。
- "五险一金"是出现频率最高的福利之一，表明大多数公司提供这一基本的社保福利。
- "年终奖金"也是一个常见的福利，可能吸引了求职者的关注。
- 餐饮补贴、通讯补贴等福利也受到一定程度的关注，这些福利有助于提高员工的生活质量。
结论：
- 从词云图中可以看出，五险一金、年终奖金、餐饮补贴等福利是吸引求职者的亮点，公司在招聘时可以重点突出这些福利待遇。
- 词云图提供了对公司福利数据的可视化呈现，有助于求职者了解不同公司的福利待遇。

八、总结与展望

通过对招聘数据的多维度分析和可视化呈现，我们得出了关于当地就业形势的一系列重要信息。这些信息不仅有助于学生了解就业市场的趋势，还可以为学校和社会提供有关就业形势的重要参考。

未来，我们可以进一步扩展和改进这项调研工作，包括更多数据源的采集、深入的数据分析方法以及更准确的预测模型的建立，以帮助更多人做出明智的职业选择。

九、致谢

感谢你的关注和阅读，希望这份报告对你的职业生涯规划有所帮助。如果有任何问题或需要进一步的咨询，请随时与我们联系。
这份报告代表了我们对就业形势的深入研究，希望这些分析结果对大家有所帮助。

十、相关代码

11. 数据收集代码

# -*- coding = utf-8 -*-
import csv
import time
import random
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.chrome.options import Options

option = Options()
option.add_experimental_option('excludeSwitches', ['enable-automation'])
option.add_argument('--disable-blink-features=AutomationControlled')

driver = webdriver.Chrome(options=option)
driver.execute_script("window.scrollTo(0, document.body.scrollHeight)")
headers = ['职位名称', '薪资范围', '工作地点', '经验要求', '学历要求', '公司名称', '公司类型及规模',
           '公司行业', '公司福利']

jobs_list = []
count = 1
error_time = 0
try:
    driver.get("https://we.51job.com/pc/search?jobArea=150300&keyword=&searchType=2&sortType=0&metro=")
    driver.implicitly_wait(10)
    for j in range(1, 30):
        for i in range(1, 21):
            try:
                job = driver.find_element(By.CSS_SELECTOR, f'div.j_joblist > div:nth-child({i})')
                # print(job.get_attribute('innerHTML'))
                job_name = job.find_element(By.CSS_SELECTOR, '.el > div > span').text
                salary = job.find_element(By.CSS_SELECTOR, '.el > p.info > span.sal').text
                location = job.find_element(By.CSS_SELECTOR, '.el > p.info > span.d.at > span:nth-child(1)').text
                exp = job.find_element(By.CSS_SELECTOR, '.el > p.info > span.d.at > span:nth-child(3)').text
                edu = job.find_element(By.CSS_SELECTOR, '.el > p.info > span.d.at > span:nth-child(5)').text
                company = job.find_element(By.CSS_SELECTOR, '.er > a').text
                company_type_scale = job.find_element(By.CSS_SELECTOR, '.er > p.dc.at').text
                industry = job.find_element(By.CSS_SELECTOR, '.er > p.int.at').text
                try:
                    tag = job.find_element(By.CSS_SELECTOR, '.el > p.tags').text
                except:
                    tag = ''
            except:
                print("error:" + str(i))
                error_time += 1
                if error_time >= 3:
                    input("网络可能断开，输入任意值继续")
                    error_time = 0
                continue
            job_item = {
                '职位名称': job_name,
                '薪资范围': salary,
                '工作地点': location,
                '经验要求': exp,
                '学历要求': edu,
                '公司名称': company,
                '公司类型及规模': company_type_scale,
                '公司行业': industry,
                '公司福利': tag
            }

            jobs_list.append(job_item)

            # 随机等待1-5秒,防止被识别
            time.sleep(random.randint(2, 6))
            print(j,i)
        error_time = 0
        driver.find_element(By.CSS_SELECTOR,
                            f'div.bottom-page > div > div > div> button.btn-next').click()
        time.sleep(random.randint(2, 6))
except Exception as e:
    print("Error:", e)
    input("网络可能断开，输入任意值继续")


finally:
    with open('51job.csv', 'w', newline='', encoding='utf-8-sig') as f:
        writer = csv.writer(f)
        writer.writerow(headers)

        for job_item in jobs_list:
            row = list(job_item.values())
            writer.writerow(row)

    driver.quit()

12.数据清洗与分析代码

from collections import Counter
import pandas as pd
import matplotlib.pyplot as plt
from matplotlib.font_manager import FontProperties
import jieba
from wordcloud import WordCloud
import re
# 设置中文字体
font = FontProperties(fname="C:/Windows/Fonts/simhei.ttf", size=12)
plt.rcParams['font.sans-serif'] = ['SimHei']
# 读取CSV文件
df = pd.read_csv('51job.csv')
# 定义提取薪资函数
def extract_salary(s):
    pattern1 = '([0-9]+\.?[0-9]*)千-([0-9]+\.?[0-9]*)万·([0-9]+\.?[0-9]*)薪'
    pattern2 = '([0-9]+\.?[0-9]*)-([0-9]+\.?[0-9]*)千'
    pattern3 = '([0-9]+\.?[0-9]*)千-([0-9]+\.?[0-9]*)万'
    pattern4 = '([0-9]+\.?[0-9]*)-([0-9]+\.?[0-9]*)千·([0-9]+\.?[0-9]*)薪'
    pattern5 = '([0-9]+\.?[0-9]*)-([0-9]+\.?[0-9]*)万'
    pattern6 = '([0-9]+\.?[0-9]*)-([0-9]+\.?[0-9]*)万·([0-9]+\.?[0-9]*)薪'
    pattern7 = '([0-9]+)元/天'
    match1 = re.search(pattern1, s)
    match2 = re.search(pattern2, s)
    match3 = re.search(pattern3, s)
    match4 = re.search(pattern4, s)
    match5 = re.search(pattern5, s)
    match6 = re.search(pattern6, s)
    match7 = re.search(pattern7, s)
    if match1:
        low, high, extra = match1.groups()
        low, high, extra = float(low), float(high), float(extra)
        return low * 1000, high * 10000, extra
    elif match2:
        low, high = match2.groups()
        low, high = float(low), float(high)
        return low * 1000, high * 1000
    elif match3:
        low, high = match3.groups()
        low, high = float(low), float(high)
        return low * 1000, high * 10000
    elif match4:
        low, high, extra = match4.groups()
        low, high, extra = float(low), float(high), float(extra)
        return low * 1000, high * 1000, extra
    elif match5:
        low, high = match5.groups()
        low, high = float(low), float(high)
        return low * 10000, high * 10000
    elif match6:
        low, high, extra = match6.groups()
        low, high, extra = float(low), float(high), float(extra)
        return low * 10000, high * 10000, extra
    elif match7:
        day = float(match7.group(1))
        return day
    else:
        print(s)
        return None


# 计算平均薪资
try:
    df['最低薪资'] = df['薪资范围'].apply(lambda x: extract_salary(x)[0])
    df['最高薪资'] = df['薪资范围'].apply(lambda x: extract_salary(x)[1])
    df['平均薪资'] = (df['最低薪资'].astype(float) + df['最高薪资'].astype(float)) / 2
except:
    df['日结'] = df['薪资范围'].apply(lambda x: extract_salary(x)[0])
    df['平均薪资'] = df['日结'] * 30

try:
    df['加成'] = df['薪资范围'].apply(lambda x: extract_salary(x)[2])
    df['平均薪资'] += df['加成'] * ((df['最低薪资'].astype(float) + df['最高薪资'].astype(float)) / 2) / 12
except:
    print('无加成')
# 1. 薪资范围分布直方图
plt.figure(figsize=(20, 10))
hist_low = plt.hist(df['最低薪资'], bins=10, alpha=0.5, color='blue', label='最低薪资')
hist_high = plt.hist(df['最高薪资'], bins=30, alpha=0.5, color='red', label='最高薪资')
hist_ave = plt.hist(df['平均薪资'], bins=20, alpha=0.5, color='yellow', label='平均薪资')
plt.xlabel('薪资范围 (k RMB)')
plt.ylabel('招聘数量')
plt.legend()
plt.title('薪资范围分布')

# 添加数据标签和保存数据到文本文件
with open('salary_distribution.txt', 'w', encoding='utf-8') as file:
    # 写入列名
    file.write('薪资范围\t最低薪资数量\t最高薪资数量\t平均薪资数量\n')
    # 遍历直方图的每个x轴区间
    for i in range(len(hist_low[0])):
        # 构造该区间的字符串
        bin_str = f'{hist_low[1][i]}-{hist_low[1][i + 1]}'
        # 获取该区间对应的最低薪资频数
        low_count = int(hist_low[0][i])
        # 获取该区间对应的最高薪资频数
        high_count = int(hist_high[0][i])
        # 获取该区间对应的平均薪资频数
        ave_count = int(hist_ave[0][i])
        # 拼接并写入行数据
        file.write(f'{bin_str}\t{low_count}\t{high_count}\t{ave_count}\n')
plt.savefig('salary_distribution.png')
# 显示图表
plt.show()

# 2. 不同地点的招聘数量柱状图
location_counts = df['工作地点'].value_counts()
# 绘制柱状图
plt.figure(figsize=(20, 10))
location_counts.plot(kind='bar', color='skyblue')
# 设置中文标签
plt.xlabel('工作地点', fontproperties=font)
plt.ylabel('招聘数量', fontproperties=font)
plt.title('不同地点的招聘数量', fontproperties=font)
plt.xticks(rotation=90)
# 添加数据标签和保存数据到文本文件
with open('location_counts.txt', 'w', encoding='utf-8') as file:
    file.write('地点\t招聘数量\n')
    for location, count in location_counts.items():
        file.write(f'{location}\t{count}\n')
plt.savefig('location_counts.png')
# 显示图表
plt.show()

# 3. 不同地点的平均薪资柱状图
avg_salary_by_location = df.groupby('工作地点')['最低薪资'].mean()
# 可以选择展示前几个地点的数据
top_avg_salary_by_location = avg_salary_by_location.sort_values(ascending=False)
# 绘制柱状图
plt.figure(figsize=(20, 10))
top_avg_salary_by_location.plot(kind='bar', color='lightgreen')
# 设置中文标签
plt.xlabel('工作地点', fontproperties=font)
plt.ylabel('平均薪资 (k RMB)', fontproperties=font)
plt.title('不同地点的平均薪资', fontproperties=font)
plt.xticks(rotation=90)
# 添加数据标签和保存数据到文本文件
with open('avg_salary_by_location.txt', 'w', encoding='utf-8') as file:
    file.write('工作地点\t平均薪资\n')
    for location, avg_salary in top_avg_salary_by_location.items():
        file.write(f'{location}\t{avg_salary}\n')
plt.savefig('avg_salary_by_location.png')
# 显示图表
plt.show()

# 4. 不同经验要求和学历要求的招聘数量柱状图
# 统计不同经验要求的招聘数量
exp_counts = df['经验要求'].value_counts()
# 统计不同学历要求的招聘数量
edu_counts = df['学历要求'].value_counts()
# 可视化经验要求的招聘数量
plt.figure(figsize=(20, 10))
plt.subplot(1, 2, 1)
exp_counts.plot(kind='bar', color='skyblue')
plt.xlabel('经验要求', fontproperties=font)
plt.ylabel('招聘数量', fontproperties=font)
plt.title('不同经验要求的招聘数量', fontproperties=font)
# 可视化学历要求的招聘数量
plt.subplot(1, 2, 2)
edu_counts.plot(kind='bar', color='lightgreen')
plt.xlabel('学历要求', fontproperties=font)
plt.ylabel('招聘数量', fontproperties=font)
plt.title('不同学历要求的招聘数量', fontproperties=font)
plt.tight_layout()
# 添加数据标签和保存数据到文本文件
with open('experience_education_counts.txt', 'w', encoding='utf-8') as file:
    file.write('经验要求\t招聘数量\n')
    for experience, count in exp_counts.items():
        file.write(f'{experience}\t{count}\n')

    file.write('学历要求\t招聘数量\n')
    for education, count in edu_counts.items():
        file.write(f'{education}\t{count}\n')
plt.savefig('experience_education_counts.png')
# 显示图表
plt.show()

# 5. 不同公司行业的招聘数量柱状图
# 统计不同公司行业的招聘数量
industry_counts = df['公司行业'].value_counts()

# 可视化不同公司行业的招聘数量
plt.figure(figsize=(20, 10))
industry_counts.plot(kind='bar', color='skyblue')
plt.xlabel('公司行业', fontproperties=font)
plt.ylabel('招聘数量', fontproperties=font)
plt.title('不同公司行业的招聘数量', fontproperties=font)
plt.xticks(rotation=90)

# 添加数据标签和保存数据到文本文件
with open('industry_counts.txt', 'w', encoding='utf-8') as file:
    file.write('公司行业\t招聘数量\n')
    for industry, count in industry_counts.items():
        file.write(f'{industry}\t{count}\n')
plt.savefig('industry_counts.png')
# 显示图表
plt.show()

# 6. 不同公司行业的平均薪资柱状图
# 计算不同公司行业的平均薪资水平
avg_salary_by_industry = df.groupby('公司行业')['平均薪资'].mean()
# 可视化不同公司行业的平均薪资水平
plt.figure(figsize=(20, 10))
avg_salary_by_industry.plot(kind='bar', color='lightgreen')
plt.xlabel('公司行业', fontproperties=font)
plt.ylabel('平均薪资 (k RMB)', fontproperties=font)
plt.title('不同公司行业的平均薪资', fontproperties=font)
plt.xticks(rotation=90)
# 添加数据标签和保存数据到文本文件
with open('avg_salary_by_industry.txt', 'w', encoding='utf-8') as file:
    file.write('公司行业\t平均薪资\n')
    for industry, avg_salary in avg_salary_by_industry.items():
        file.write(f'{industry}\t{avg_salary}\n')
plt.savefig('avg_salary_by_industry.png')
# 显示图表
plt.show()


# 7. 公司福利项出现次数柱状图
# 统计不同公司福利的出现次数
def extract_welfare(welfare_str):
    if isinstance(welfare_str, str):
        return welfare_str.split('\n')
    else:
        return []


# 将福利信息分割成列表
df['公司福利'] = df['公司福利'].apply(extract_welfare)
# 统计不同福利项的出现次数
welfare_counts = df['公司福利'].explode().str.strip().value_counts()
# 处理没有福利信息的公司
if '' in welfare_counts:
    no_welfare_count = welfare_counts['']
    welfare_counts = welfare_counts.drop('')
    welfare_counts['无福利'] = no_welfare_count
# 可视化不同福利项的出现次数
plt.figure(figsize=(20, 10))
welfare_counts.nlargest(20).plot(kind='bar', color='lightblue')
plt.xlabel('公司福利项', fontproperties=font)
plt.ylabel('出现次数', fontproperties=font)
plt.title('不同公司福利项的出现次数', fontproperties=font)
plt.xticks(rotation=90)
# 添加数据标签和保存数据到文本文件
with open('welfare_counts.txt', 'w', encoding='utf-8') as file:
    file.write('公司福利项\t出现次数\n')
    for welfare, count in welfare_counts.items():
        file.write(f'{welfare}\t{count}\n')
plt.savefig('welfare_counts.png')
# 显示图表
plt.show()

# 8. 不同公司类型及规模的招聘数量柱状图
# 统计不同公司类型及规模的招聘数量
company_type_and_size_counts = df['公司类型及规模'].value_counts()
# 可视化不同公司类型及规模的招聘数量
plt.figure(figsize=(20, 10))
company_type_and_size_counts.plot(kind='bar', color='skyblue')
plt.xlabel('公司类型及规模', fontproperties=font)
plt.ylabel('招聘数量', fontproperties=font)
plt.title('不同公司类型及规模的招聘数量', fontproperties=font)
plt.xticks(rotation=90)
# 添加数据标签和保存数据到文本文件
with open('company_type_and_size_counts.txt', 'w', encoding='utf-8') as file:
    file.write('公司类型及规模\t招聘数量\n')
    for company_type, count in company_type_and_size_counts.items():
        file.write(f'{company_type}\t{count}\n')
plt.savefig('company_type_and_size_counts.png')
# 显示图表
plt.show()

# 9. 公司行业词云图
# 合并公司行业文本
industry_text = ' '.join(df['公司行业'].dropna())
# 使用jieba分词
seg_list = jieba.cut(industry_text)
# 创建词云
wordcloud = WordCloud(width=800, height=400, background_color='white',
                      font_path='C:/Windows/Fonts/simhei.ttf').generate(' '.join(seg_list))
# 可视化词云
plt.figure(figsize=(20, 10))
plt.imshow(wordcloud, interpolation='bilinear')
plt.axis('off')
plt.title('公司行业词云', fontproperties=font)
# 将公司行业词频信息保存到本地文件
industry_words = list(jieba.cut(industry_text))
industry_word_counts = Counter(industry_words)
with open('industry_wordcloud.txt', 'w', encoding='utf-8') as file:
    for word, count in industry_word_counts.items():
        file.write(f'{word}: {count}\n')
# 保存词云图像
wordcloud.to_file('industry_wordcloud.png')
# 显示词云图像
plt.show()

# 10. 公司福利词云图
# 合并公司福利文本
welfare_text = ' '.join(df['公司福利'].explode().dropna())
# 使用jieba分词
seg_list = jieba.cut(welfare_text)
# 创建词云
wordcloud = WordCloud(width=800, height=400, background_color='white',
                      font_path='C:/Windows/Fonts/simhei.ttf').generate(' '.join(seg_list))
# 可视化词云
plt.figure(figsize=(20, 10))
plt.imshow(wordcloud, interpolation='bilinear')
plt.axis('off')
plt.title('公司福利词云', fontproperties=font)
# 保存词云图像
wordcloud.to_file('welfare_wordcloud.png')
# 将公司福利文本数据保存到本地文件
welfare_words = list(jieba.cut(welfare_text))
welfare_word_counts = Counter(welfare_words)
with open('welfare_wordcloud.txt', 'w', encoding='utf-8') as file:
    for word, count in welfare_word_counts.items():
        file.write(f'{word}: {count}\n')
# 显示词云图像
plt.show()

你可能感兴趣的:(爬虫,python,python,css,selenium)

系统学习Python——并发模型和异步编程：进程、线程和GIL
分类目录：《系统学习Python》总目录在文章《并发模型和异步编程：基础知识》我们简单介绍了Python中的进程、线程和协程。本文就着重介绍Python中的进程、线程和GIL的关系。Python解释器的每个实例都是一个进程。使用multiprocessing或concurrent.futures库可以启动额外的Python进程。Python的subprocess库用于启动运行外部程序（不管使用何种
Flask框架入门：快速搭建轻量级Python网页应用「已注销」 python-AI python基础网站网络 python flask 后端
转载：Flask框架入门：快速搭建轻量级Python网页应用1.Flask基础Flask是一个使用Python编写的轻量级Web应用框架。它的设计目标是让Web开发变得快速简单，同时保持应用的灵活性。Flask依赖于两个外部库：Werkzeug和Jinja2，Werkzeug作为WSGI工具包处理Web服务的底层细节，Jinja2作为模板引擎渲染模板。安装Flask非常简单，可以使用pip安装命令
Python Flask 框架入门：快速搭建 Web 应用的秘诀 Python编程之道 Python人工智能与大数据 Python编程之道 python flask 前端 ai
PythonFlask框架入门：快速搭建Web应用的秘诀关键词Flask、微框架、路由系统、Jinja2模板、请求处理、WSGI、Web开发摘要想快速用Python搭建一个灵活的Web应用？Flask作为“微框架”代表，凭借轻量、可扩展的特性，成为初学者和小型项目的首选。本文将从Flask的核心概念出发，结合生活化比喻、代码示例和实战案例，带你一步步掌握：如何用Flask搭建第一个Web应用？路由
python_虚拟环境阿_焦 python
第一、配置虚拟环境：virtualenv（1）pipvirtualenv>安装虚拟环境包（2）pipinstallvirtualenvwrapper-win>安装虚拟环境依赖包（3）c盘创建虚拟目录>C:\virtualenv>配置环境变量【了解一下】：（1）如何使用virtualenv创建虚拟环境a、cd到C:\virtualenv目录下：b、mkvirtualenvname>创建虚拟环境nam
精通Canvas：15款时钟特效代码实现指南烟幕缭绕
本文还有配套的精品资源，点击获取简介：HTML5的Canvas是一个用于绘制矢量图形的API，通过JavaScript实现动态效果。本项目集合了15种不同的时钟特效代码，帮助开发者通过学习绘制圆形、线条、时间更新、旋转、颜色样式设置及动画效果等概念，深化对Canvas的理解和应用。项目中的CSS文件负责时钟的样式设定，而JS文件则包含实现各种特效的逻辑，通过不同的函数或类处理时间更新和动画绘制，提
Python爱心光波
系列文章序号直达链接Tkinter1Python李峋同款可写字版跳动的爱心2Python跳动的双爱心3Python蓝色跳动的爱心4Python动漫烟花5Python粒子烟花Turtle1Python满屏飘字2Python蓝色流星雨3Python金色流星雨4Python漂浮爱心5Python爱心光波①6Python爱心光波②7Python满天繁星8Python五彩气球9Python白色飘雪10Pyt
Python流星雨 Want595 python 开发语言
文章目录系列文章写在前面技术需求完整代码代码分析1.模块导入2.画布设置3.画笔设置4.颜色列表5.流星类(Star)6.流星对象创建7.主循环8.流星运动逻辑9.视觉效果10.总结写在后面系列文章序号直达链接表白系列1Python制作一个无法拒绝的表白界面2Python满屏飘字表白代码3Python无限弹窗满屏表白代码4Python李峋同款可写字版跳动的爱心5Python流星雨代码6Python
Python之七彩花朵代码实现 PlutoZuo Python python 开发语言
Python之七彩花朵代码实现文章目录Python之七彩花朵代码实现下面是一个简单的使用Python的七彩花朵。这个示例只是一个简单的版本，没有很多高级功能，但它可以作为一个起点，你可以在此基础上添加更多功能。importturtleastuimportrandomasraimportmathtu.setup(1.0,1.0)t=tu.Pen()t.ht()colors=['red','skybl
Python 脚本最佳实践2025版
前文可以直接把这篇文章喂给AI,可以放到AI角色设定里,也可以直接作为提示词.这样,你只管提需求,写脚本就让AI来.概述追求简洁和清晰：脚本应简单明了。使用函数(functions)、常量(constants)和适当的导入(import)实践来有逻辑地组织你的Python脚本。使用枚举(enumerations)和数据类(dataclasses)等数据结构高效管理脚本状态。通过命令行参数增强交互性
（Python基础篇）了解和使用分支结构 EternityArt 基础篇 python
目录一、引言二、Python分支结构的类型与语法（一）if语句（单分支）（二）if-else语句（双分支）（三）if-elif-else语句（多分支）三、分支结构的应用场景（一）提示用户输入用户名，然后再提示输入密码，如果用户名是“admin”并且密码是“88888”则提示正确，否则，如果用户名不是admin还提示用户用户名不存在,（二）提示用户输入用户名，然后再提示输入密码，如果用户名是“adm
（Python基础篇）循环结构 EternityArt 基础篇 python
一、什么是Python循环结构？循环结构是编程中重复执行代码块的机制。在Python中，循环允许你：1.迭代处理数据：遍历列表、字典、文件内容等。2.自动化重复任务：如批量处理数据、生成序列等。3.控制执行流程：根据条件决定是否继续或终止循环。二、为什么需要循环结构？假设你需要打印1到100的所有偶数：没有循环：需手动编写100行print()语句。print(0)print(2)print(4)
（Python基础篇）字典的操作 EternityArt 基础篇 python 开发语言
一、引言在Python编程中，字典（Dictionary）是一种极具灵活性的数据结构，它通过“键-值对”（key-valuepair）的形式存储数据，如同现实生活中的字典——通过“词语（键）”快速查找“释义（值）”。相较于列表和元组的有序索引访问，字典的优势在于基于键的快速查找，这使得它在处理需要频繁通过唯一标识获取数据的场景中极为高效。掌握字典的操作，能让我们更高效地组织和管理复杂数据，是Pyt
Python七彩花朵 Want595 python 开发语言
系列文章序号直达链接Tkinter1Python李峋同款可写字版跳动的爱心2Python跳动的双爱心3Python蓝色跳动的爱心4Python动漫烟花5Python粒子烟花Turtle1Python满屏飘字2Python蓝色流星雨3Python金色流星雨4Python漂浮爱心5Python爱心光波①6Python爱心光波②7Python满天繁星8Python五彩气球9Python白色飘雪10Pyt
用OpenCV标定相机内参应用示例（C++和Python）
下面是一个完整的使用OpenCV进行相机内参标定（CameraCalibration）的示例，包括C++和Python两个版本，基于棋盘格图案标定。一、目标：相机标定通过拍摄多张带有棋盘格图案的图像，估计相机的内参：相机矩阵（内参）K畸变系数distCoeffs可选外参（R,T）标定精度指标（如重投影误差）二、棋盘格参数设置（根据自己的棋盘格设置）：棋盘格角点数：9x6（内角点，9列×6行）；每个
Anaconda 详细下载与安装教程
Anaconda详细下载与安装教程1.简介Anaconda是一个用于科学计算的开源发行版，包含了Python和R的众多常用库。它还包括了conda包管理器，可以方便地安装、更新和管理各种软件包。2.下载Anaconda2.1访问官方网站首先，打开浏览器，访问Anaconda官方网站。2.2选择适合的版本在页面中，你会看到两个主要的下载选项：AnacondaIndividualEdition：适用于
python中 @注解及内置注解的使用方法总结以及完整示例慧一居士 Python python
在Python中，装饰器（Decorator）使用@符号实现，是一种修改函数/类行为的语法糖。它本质上是一个高阶函数，接受目标函数作为参数并返回包装后的函数。Python也提供了多个内置装饰器，如@property、@staticmethod、@classmethod等。一、核心概念装饰器本质：@decorator等价于func=decorator(func)执行时机：在函数/类定义时立即执行装饰
Python中的静态方法和类方法详解
在Python中，`@staticmethod`和`@classmethod`是两种装饰器，它们用于定义类中的方法，但是它们的行为和用途有所不同。###@staticmethod`@staticmethod`装饰器用于定义一个静态方法。静态方法不接收类或实例的引用作为第一个参数，因此它不能访问类的状态或实例的状态。静态方法可以看作是与类关联的普通函数，但它们可以通过类名直接调用。classMath
Python中类静态方法：@classmethod/@staticmethod详解和实战示例
在Python中，类方法(@classmethod)和静态方法(@staticmethod)是类作用域下的两种特殊方法。它们使用装饰器定义，并且与实例方法(deffunc(self))的行为有所不同。1.三种方法的对比概览方法类型是否访问实例(self)是否访问类(cls)典型用途实例方法✅是❌否访问对象属性类方法@classmethod❌否✅是创建类的替代构造器，访问类变量等静态方法@stati
Python多版本管理与pip升级全攻略：解决冲突与高效实践码界奇点 Python python pip 开发语言 python3.11 源代码管理虚拟现实依赖倒置原则
引言Python作为最流行的编程语言之一，其版本迭代速度与生态碎片化给开发者带来了巨大挑战。据统计，超过60%的Python开发者需要同时维护基于Python3.6+和Python2.7的项目。本文将系统解决以下核心痛点：如何安全地在同一台机器上管理多个Python版本pip依赖冲突的根治方案符合PEP标准的生产环境最佳实践第一部分：Python多版本管理核心方案1.1系统级多版本共存方案Wind
基于Python的健身数据分析工具的搭建流程day1 weixin_45677320 python 开发语言数据挖掘爬虫
基于Python的健身数据分析工具的搭建流程分数据挖掘、数据存储和数据分析三个步骤。本文主要介绍利用Python实现健身数据分析工具的数据挖掘部分。第一步：加载库加载本文需要的库，如下代码所示。若库未安装，请按照python如何安装各种库（保姆级教程）_python安装库-CSDN博客https://blog.csdn.net/aobulaien001/article/details/133298
seaborn又一个扩展heatmapz qq_21478261 #Python可视化 matplotlib
推荐阅读：Pythonmatplotlib保姆级教程嫌Matplotlib繁琐？试试Seaborn！
NGS测序基础梳理01-文库构建（Library Preparation） qq_21478261 #生物信息生物学
本文介绍Illumina测序平台文库构建（LibraryPreparation）步骤，文库结构。写作时间：2020.05。推荐阅读：10W字《Python可视化教程1.0》来了！一份由公众号「pythonic生物人」精心制作的PythonMatplotlib可视化系统教程，105页PDFhttps://mp.weixin.qq.com/s/QaSmucuVsS_DR-klfpE3-Q10W字《Rg
Python 常用内置函数详解（七）：dir()函数——获取当前本地作用域中的名称列表或对象的有效属性列表
目录一、功能二、语法和示例一、功能dir()函数获取当前本地作用域中的名称列表或对象的有效属性列表。二、语法和示例dir()函数有两种形式，如果没有实参，则返回当前本地作用域中的名称列表。如果有实参，它会尝试返回该对象的有效属性列表。如果对象有一个名为__dir__()的方法，那么该方法将被调用，并且必须返回一个属性列表。dir()函数的语法格式如下：C:\Users\amoxiang>ipyth
pythonjson中list操作_Python json.dumps 特殊数据类型的自定义序列化操作
场景描述：Python标准库中的json模块，集成了将数据序列化处理的功能；在使用json.dumps()方法序列化数据时候，如果目标数据中存在datetime数据类型，执行操作时，会抛出异常：TypeError:datetime.datetime(2016,12,10,11,04,21)isnotJSONserializable那么遇到json.dumps序列化不支持的数据类型，该怎么办！首先，
Python 日期格式转json.dumps的解决方法 douyaoxin python json 开发语言
classDateEncoder(json.JSONEncoder):defdefault(self,obj):ifisinstance(obj,datetime.datetime):returnobj.strftime('%Y-%m-%d%H:%M:%S')elifisinstance(obj,datetime.date):returnobj.strftime("%Y-%m-%d")json.d
Python 爬虫实战：视频平台播放量实时监控（含反爬对抗与数据趋势预测）西攻城狮北 python 爬虫音视频
一、引言在数字内容蓬勃发展的当下，视频平台的播放量数据已成为内容创作者、营销人员以及行业分析师手中极为关键的情报资源。它不仅能够实时反映内容的受欢迎程度，更能在竞争分析、营销策略制定以及内容优化等方面发挥不可估量的作用。然而，视频平台为了保护自身数据和用户隐私，往往会设置一系列反爬虫机制，对数据爬取行为进行限制。这就向我们发起了挑战：如何巧妙地突破这些限制，同时精准地捕捉并预测播放量的动态变化趋势
Python技能手册 - 模块module 金色牛神 Python python windows 开发语言
系列Python常用技能手册-基础语法Python常用技能手册-模块modulePython常用技能手册-包package目录module模块指什么typing数据类型int整数float浮点数str字符串bool布尔值TypeVar类型变量functools高阶函数工具functools.partial()函数偏置functools.lru_cache()函数缓存sorted排序列表排序元组排序
Ubuntu基础（Python虚拟环境和Vue） aaiier ubuntu python linux
Python虚拟环境sudoaptinstallpython3python3-venv进入项目目录cdXXX创建虚拟环境python3-mvenvvenv激活虚拟环境sourcevenv/bin/activate退出虚拟环境deactivateVue安装Node.js和npm#安装Node.js和npm（Ubuntu默认仓库可能版本较旧，适合入门）sudoaptinstallnodejsnpm#验
苦练Python第9天：if-else分支九剑 python后端前端人工智能
苦练Python第9天：if-else分支九剑前言大家好，我是倔强青铜三。是一名热情的软件工程师，我热衷于分享和传播IT技术，致力于通过我的知识和技能推动技术交流与创新，欢迎关注我，微信公众号：倔强青铜三。欢迎点赞、收藏、关注，一键三连！！！欢迎来到100天Python挑战第9天！今天我们不练循环，改磨“分支剑法”——ifelse三式：单分支、双分支、多分支，以及嵌套和三元运算符，全部实战演练，让
苦练Python第8天：while 循环之妙用 python后端前端人工智能
苦练Python第8天：while循环之妙用原文链接：https://dev.to/therahul_gupta/day-9100-while-loops-with-real-world-examples-528f作者：RahulGupta译者：倔强青铜三前言大家好，我是倔强青铜三。是一名热情的软件工程师，我热衷于分享和传播IT技术，致力于通过我的知识和技能推动技术交流与创新，欢迎关注我，微信公众
Algorithm 香水浓 java Algorithm
冒泡排序 public static void sort(Integer[] param) { for (int i = param.length - 1; i > 0; i--) { for (int j = 0; j < i; j++) { int current = param[j]; int next = param[j + 1];
mongoDB 复杂查询表达式开窍的石头 mongodb
1:count Pg: db.user.find().count(); 统计多少条数据 2:不等于$ne Pg: db.user.find({_id:{$ne:3}},{name:1,sex:1,_id:0}); 查询id不等于3的数据。 3：大于$gt $gte(大于等于) &n
Jboss Java heap space异常解决方法, jboss OutOfMemoryError : PermGen space 0624chenhong jvm jboss
转自 http://blog.csdn.net/zou274/article/details/5552630 解决办法： window->preferences->java->installed jres->edit jre 把default vm arguments 的参数设为-Xms64m -Xmx512m ----------------
文件上传下载解析相对路径不懂事的小屁孩文件上传
有点坑吧，弄这么一个简单的东西弄了一天多，身边还有大神指导着，网上各种百度着。下面总结一下遇到的问题：文件上传，在页面上传的时候，不要想着去操作绝对路径，浏览器会对客户端的信息进行保护，避免用户信息收到攻击。在上传图片，或者文件时，使用form表单来操作。前台通过form表单传输一个流到后台，而不是ajax传递参数到后台，代码如下: <form action=&
怎么实现qq空间批量点赞换个号韩国红果果 qq
纯粹为了好玩！！逻辑很简单 1 打开浏览器console；输入以下代码。先上添加赞的代码 var tools={}; //添加所有赞 function init(){ document.body.scrollTop=10000; setTimeout(function(){document.body.scrollTop=0;},2000);//加
判断是否为中文灵静志远中文
方法一： public class Zhidao { public static void main(String args[]) { String s = "sdf灭礌 kjl d{';\fdsjlk是"; int n=0; for(int i=0; i<s.length(); i++) { n = (int)s.charAt(i); if((
一个电话面试后总结 a-john 面试
今天，接了一个电话面试，对于还是初学者的我来说，紧张了半天。面试的问题分了层次，对于一类问题，由简到难。自己觉得回答不好的地方作了一下总结：在谈到集合类的时候，举几个常用的集合类，想都没想，直接说了list,map。然后对list和map分别举几个类型： list方面：ArrayList,LinkedList。在谈到他们的区别时，愣住了
MSSQL中Escape转义的使用 aijuans MSSQL
IF OBJECT_ID('tempdb..#ABC') is not null drop table tempdb..#ABC create table #ABC ( PATHNAME NVARCHAR(50) ) insert into #ABC SELECT N'/ABCDEFGHI' UNION ALL SELECT N'/ABCDGAFGASASSDFA' UNION ALL
一个简单的存储过程 asialee mysql 存储过程构造数据批量插入
今天要批量的生成一批测试数据，其中中间有部分数据是变化的，本来想写个程序来生成的，后来想到存储过程就可以搞定，所以随手写了一个，记录在此： DELIMITER $$ DROP PROCEDURE IF EXISTS inse
annot convert from HomeFragment_1 to Fragment 百合不是茶 android 导包错误
创建了几个类继承Fragment, 需要将创建的类存储在ArrayList<Fragment>中; 出现不能将new 出来的对象放到队列中,原因很简单; 创建类时引入包是:import android.app.Fragment; 创建队列和对象时使用的包是:import android.support.v4.ap
Weblogic10两种修改端口的方法 bijian1013 weblogic 端口号配置管理 config.xml
一.进入控制台进行修改 1.进入控制台: http://127.0.0.1:7001/console 2.展开左边树菜单域结构->环境->服务器-->点击AdminServer(管理) &
mysql 操作指令征客丶 mysql
一、连接mysql 进入 mysql 的安装目录； $ bin/mysql -p [host IP 如果是登录本地的mysql 可以不写 -p 直接 -u] -u [userName] -p 输入密码，回车，接连；二、权限操作［如果你很了解mysql数据库后，你可以直接去修改系统表，然后用 mysql> flush privileges; 指令让权限生效］ 1、赋权 mys
【Hive一】Hive入门 bit1129 hive
Hive安装与配置 Hive的运行需要依赖于Hadoop，因此需要首先安装Hadoop2.5.2，并且Hive的启动前需要首先启动Hadoop。 Hive安装和配置的步骤 1. 从如下地址下载Hive0.14.0 http://mirror.bit.edu.cn/apache/hive/ 2.解压hive，在系统变
ajax 三种提交请求的方法 BlueSkator Ajax jqery
1、ajax 提交请求 $.ajax({ type:"post", url : "${ctx}/front/Hotel/getAllHotelByAjax.do", dataType : "json", success : function(result) { try { for(v
mongodb开发环境下的搭建入门 braveCS 运维
linux下安装mongodb 1）官网下载mongodb-linux-x86_64-rhel62-3.0.4.gz 2）linux 解压 gzip -d mongodb-linux-x86_64-rhel62-3.0.4.gz; mv mongodb-linux-x86_64-rhel62-3.0.4 mongodb-linux-x86_64-rhel62-
编程之美-最短摘要的生成 bylijinnan java 数据结构算法编程之美
import java.util.HashMap; import java.util.Map; import java.util.Map.Entry; public class ShortestAbstract { /** * 编程之美最短摘要的生成 * 扫描过程始终保持一个[pBegin,pEnd]的range,初始化确保[pBegin,pEnd]的ran
json数据解析及typeof chengxuyuancsdn js typeof json解析
// json格式 var people='{"authors": [{"firstName": "AAA","lastName": "BBB"},' +' {"firstName": "CCC&
流程系统设计的层次和目标 comsci 设计模式数据结构 sql 框架脚本
流程系统设计的层次和目标
RMAN List和report 命令 daizj oracle list report rman
LIST 命令使用RMAN LIST 命令显示有关资料档案库中记录的备份集、代理副本和映像副本的信息。使用此命令可列出： • RMAN 资料档案库中状态不是AVAILABLE 的备份和副本 • 可用的且可以用于还原操作的数据文件备份和副本 • 备份集和副本，其中包含指定数据文件列表或指定表空间的备份 • 包含指定名称或范围的所有归档日志备份的备份集和副本 • 由标记、完成时间、可
二叉树:红黑树 dieslrae 二叉树
红黑树是一种自平衡的二叉树,它的查找,插入,删除操作时间复杂度皆为O(logN),不会出现普通二叉搜索树在最差情况时时间复杂度会变为O(N)的问题. 红黑树必须遵循红黑规则,规则如下 1、每个节点不是红就是黑。 2、根总是黑的 &
C语言homework3，7个小题目的代码 dcj3sjt126com c
1、打印100以内的所有奇数。 # include <stdio.h> int main(void) { int i; for (i=1; i<=100; i++) { if (i%2 != 0) printf("%d ", i); } return 0; } 2、从键盘上输入10个整数，
自定义按钮, 图片在上, 文字在下, 居中显示 dcj3sjt126com 自定义
#import <UIKit/UIKit.h> @interface MyButton : UIButton -(void)setFrame:(CGRect)frame ImageName:(NSString*)imageName Target:(id)target Action:(SEL)action Title:(NSString*)title Font:(CGFloa
MySQL查询语句练习题，测试足够用了 flyvszhb sql mysql
http://blog.sina.com.cn/s/blog_767d65530101861c.html 1.创建student和score表 CREATE TABLE student ( id INT(10) NOT NULL UNIQUE PRIMARY KEY , name VARCHAR
转：MyBatis Generator 详解 happyqing mybatis
MyBatis Generator 详解 http://blog.csdn.net/isea533/article/details/42102297 MyBatis Generator详解 http://git.oschina.net/free/Mybatis_Utils/blob/master/MybatisGeneator/MybatisGeneator.
让程序员少走弯路的14个忠告 jingjing0907 工作计划学习
无论是谁，在刚进入某个领域之时，有再大的雄心壮志也敌不过眼前的迷茫：不知道应该怎么做，不知道应该做什么。下面是一名软件开发人员所学到的经验，希望能对大家有所帮助 1.不要害怕在工作中学习。只要有电脑，就可以通过电子阅读器阅读报纸和大多数书籍。如果你只是做好自己的本职工作以及分配的任务，那是学不到很多东西的。如果你盲目地要求更多的工作，也是不可能提升自己的。放
nginx和NetScaler区别流浪鱼 nginx
NetScaler是一个完整的包含操作系统和应用交付功能的产品，Nginx并不包含操作系统，在处理连接方面，需要依赖于操作系统，所以在并发连接数方面和防DoS攻击方面，Nginx不具备优势。 2.易用性方面差别也比较大。Nginx对管理员的水平要求比较高，参数比较多，不确定性给运营带来隐患。在NetScaler常见的配置如健康检查，HA等，在Nginx上的配置的实现相对复杂。 3.策略灵活度方
第11章动画效果（下） onestopweb 动画
index.html <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/
FAQ - SAP BW BO roadmap blueoxygen BO BW
http://www.sdn.sap.com/irj/boc/business-objects-for-sap-faq Besides, I care that how to integrate tightly. By the way, for BW consultants, please just focus on Query Designer which i
关于java堆内存溢出的几种情况 tomcat_oracle java jvm jdk thread
【情况一】：　　 java.lang.OutOfMemoryError: Java heap space：这种是java堆内存不够，一个原因是真不够，另一个原因是程序中有死循环；　　如果是java堆内存不够的话，可以通过调整JVM下面的配置来解决：　　<jvm-arg>-Xms3062m</jvm-arg> 　　<jvm-arg>-Xmx
Manifest.permission_group权限组阿尔萨斯 Permission
结构继承关系 public static final class Manifest.permission_group extends Object java.lang.Object android. Manifest.permission_group 常量 ACCOUNTS 直接通过统计管理器访问管理的统计 COST_MONEY可以用来让用户花钱但不需要通过与他们直接牵涉的权限 D