FerventDesert

Hawk： 20分钟无编程抓取大众点评17万数据

1. 主角出场：Hawk介绍

Hawk是沙漠之鹰开发的一款数据抓取和清洗工具，目前已经在Github开源。详细介绍可参考：http://www.cnblogs.com/buptzym/p/5454190.html
强烈建议先读这篇文章，该文介绍了详细原理和抓取链家二手房的攻略，以此为基础，才能较好的理解整个操作。
GitHub地址：https://github.com/ferventdesert/Hawk
本文将讲解通过本软件，获取大众点评的所有美食数据，可选择任一城市，也可以很方便地修改成获取其他生活门类信息的爬虫。
在这个过程中你可以学会：

自动登录
自动翻页
组合多种情况，以破解翻页限制
自动获取页面的表格数据

本文将省略原理，一步步地介绍如何在20分钟内完成爬虫的设计，基本不需要编程，还能自动并行抓取。
看完这篇文章，你应该就能举一反三地抓取绝大多数网站的数据了。Hawk是一整套工具，它的能力取决于你的设计和思路。希望你会喜欢它。
详细过程视频可参考：http://v.qq.com/page/z/g/h/z01891n1rgh.html，值得注意的是，由于软件不断升级，因此细节和视频可能有所出入。
准备好了么？Let's do it!

2. 菜场买菜：编译和安装

编译可使用VS2015(推荐)，否则可直接从网盘下载可执行程序：
http://pan.baidu.com/s/1c8zBiQ 密码：4iy0
之后双击Hawk.exe，即可运行。
依赖环境要求.NET Framework 4.5, win7和以上版本。没有其他依赖项。

3. 做饭先生火：自动设置cookie：

我们先打开大众点评的美食列表页面：
http://www.dianping.com/search/category/2/10/g311

这是北京的"北京菜"列表，但你会注意到，只能抓取前50页数据（如箭头所示），是一种防爬虫策略，我们之后来破解它。
我们双击打开一个网页采集器：

之后在最上方的地址栏里填写地址：

但会发现远程服务器拒绝了请求，原因是大众点评认为Hawk是爬虫而不是浏览器。
没有关系，我们让Hawk来监控浏览器的行为，在右侧的自动嗅探窗口中，填写url过滤和内容筛选，之后点击开始。浏览器会自动打开该网页，程序后台自动记录了所有的行为，之后点击关闭按钮（切记点击关闭）。

(此处大概介绍原理：Hawk在点击开始之后，会自动成为代理，所有的浏览器请求都会经过Hawk，在输入特定的URL筛选前缀和关键字，则Hawk会自动拦截符合要求的Request，并将其详细信息记录下来，并最终模拟它)。

之后，我们点击右方的“高级设置”里，能够看到Hawk已经把这次访问的cookie和headers自动保存下来：

我们再次点击刷新网页，可以看到已经能成功获取网页内容：

完成这一步之后，我们就能够像普通网页那样免登陆抓取信息了。这也适合需要登录的各类网站。

4.洗菜切菜：获取门店列表

我们通过自动和手动两种方式来获取门店列表，你可以两种都试试。

4.1 全自动获取

直接点击手气不错即可，不需要其他操作：

4.2 纯手工获取

我们先手工输入筛选条件吧：

输入上面的关键字3774，命名为点评：

接着，填入89,你会发现是下面这样：

注意XPath表达式和点评的表达式不大一样，这是因为89太普通，在网页中出现多次，再次点击搜索XPath，即可找到正确的位置。
类似地，将所有你认为需要的属性添加进去，加上合适的命名，大概是这个样子：

当然，我们还需要门店的ID，但在页面上并不提供，那在浏览器上点击那个“四季民福烤鸭店”（沙漠君厌恶吃鸭子），你会看到它的链接为：

我们将18002657添加并搜索，发现不论怎么点都搜索不到，此时勾选提取标签，系统会在标签中搜索：

之后获取了全部属性后，点击提取测试，系统会自动优化XPath，列表父节点会显示在下方。

笔者建议自动加手动配合的方式，自动抓取大部分数据，再用手动修改调整，手气不错虽然智能，但并不是什么时候都管用。

将本模块命名为门店列表，供之后备用：

5.餐前甜点：获取50页数据

我们先用50页数据试试手，在刚才那个浏览器页面的最下方，点击翻页，可以发现是如下的结构：

http://www.dianping.com/search/category/2/10/g311p2
http://www.dianping.com/search/category/2/10/g311p3
http://www.dianping.com/search/category/2/10/g311p4
...

好，新建数据清洗，随便给它起个名字，从左面拖入生成区间数，双击配置列名为page，最大值填50，再拖入合并多列到page列，配置如下：

其中Format设置为：
http://www.dianping.com/search/category/2/10/g311p{0}
这是C#的一种字符串替换语法，{0}会被依次替换为1,2,3...
最后，拖从爬虫转换到url列，奇迹出现了吧？
为了保存结果，我们拖写入数据表到任意一列,这里选择了名称列，配置如下：

之后，在右侧选择并行或串行模式（随你），点击执行即可。

数据采集完成了！

如果看到这一步累了，可以不看下面的内容，但如果想获取全部内容，步骤就复杂多了，如果你下决心学习，我们接着往下看

5. 准备葱蒜：获取城市的美食门类

解决问题的办法是分而治之，获取每个区县（如北京的海淀区）下的某一种美食门类（东北菜），自然就没50页那么多了。所以，要获取美食门类，再获取所有的区域。

先找到所有美食门类的位置：
http://www.dianping.com/shopall/2/0
为了获取此页面上的信息，我们再新建一个网页采集器，命名为通用采集器，它的目标是获取整个HTML页面，因此
读取模式改成One,将刚才门店列表采集器里的高级设置->Parameters的内容拷贝到本采集器对应的窗口中。
(其实也可以做嗅探，但这个更快一些)。
之后，我们来获取这个页面上的所有美食门类，新建数据清洗，命名为门类，然后从左侧拖从文本生成到右侧任意一列，命名如下：

再拖入从爬虫转换，配置如下：

即可调用刚才的通用采集器。另外，左侧的工具栏支持搜索，直接关键字即可快速定位，结果如下：

为了获取下图的北京菜所在的位置，虽然可以用Hawk，但为了方便可以使用Chrome，搜狗和360浏览器的F12开发者工具功能，找到对应的元素，点击右键，拷贝XPath:

内容为：//*[@id="top"]/div[6]/div/div[1]/dl[1]/dd/ul/li[1]，
因为要获取所有的子li，在刚才的数据清洗中，向Content列拖入XPath筛选器，配置如下：

由于要获取所有的li子节点，所以去掉了最后的1，可以适当复习XPath语法。
奇迹出现了：

接下来步骤很简单，我不截图了：

拖入HTML字符转义到Text列，可以清除该列的乱码
再拖入字符串分割到Text，勾选空格分割，可对该数据用空格分割，并获取默认的第一个子串
拖入删除该列到OHTML,该列没有用
再拖入正则转换器到HTML，配置如下：

g\d+代表匹配那个门类的ID，比如刚才的g311
拖入删除该列到HTML
直接在Text列的上方修改名称为门类

最终结果如下：

6.获取北京的区域

这一步和上一步非常类似，因此我很简明地介绍一下。
区域在这个页面：
http://www.dianping.com/search/category/2/10/g311p2

这些节点的XPath是：//*[@id="region-nav"]/a
你可以按照刚才类似的步骤进行，也是创建新的数据清洗，把这个子模块命名为区域，最终结果如下：

如果自己做不下来，也没有关系，加载Github上大众点评的教程.xml，可以直接用这个现成的模块，也可以单步调试之，看看它是怎么写的。

7.正菜开始：主流程

下面是最难也是最复杂的部分。我们的思路是，组合所有的门类和区域，构成m*n的一组序对，如海淀区-北京菜，朝阳区-火锅等等，获取对应序对的页数，再将所有结果拼接起来。
准备好了么？我们继续。

新建数据清洗，命名为主流程，我们要调用刚才定义的模块，拖入子流-生成到任意一列，配置如下：

记得要勾选启用，这些模块默认是不启用的。
再拖入子流-生成到任意一列，配置如下：

注意生成模式改为Cross。
具体不同模式的工作方式，可参考这篇文章：http://www.cnblogs.com/buptzym/p/5501003.html
之后，就是这个样子：

我们将两列组合起来，可看到Url为如下的形式：
http://www.dianping.com/search/category/2/10/**g311r14**
拖合并多列到type，配置如下：

{0}{1}相当于组合了多个元素，拖入的当前列为第0元素，其他项用空格分割，分别代表第1,2...个元素。
为了获取每个门类的页数，需要在页面上找一下：

它的XPath是/html[1]/body[1]/div[6]/div[1]/span[7]

拖入从爬虫转换到url列，配置爬虫选择为通用采集器，就能获取对应的HTML
拖入XPath筛选器到HTML所在的Content列，XPath表达式如上/html[1]/body[1]/div[6]/div[1]/span[7]。只获取一个数据，新列名为count
拖入删除该列到Content列。
拖入提取数字到count列
拖入Python转换器到count列，这是本文唯一要写的代码：
配置如下：

代码在下面：
```
v=int(value)
50 if v>750 else int(v/15)+1
```
Python代码很好理解吧，大概是说超过750个就按50页处理，页数等于数量除以每页15个，取整后+1,截图中的代码是错误的，感谢热心网友提醒

你会发现即使这样，每个门类还是超过了50页，这个问题我们之后再讨论。
为了方便并行，拖入流实例化到任意一列，配置如下：
。
执行器会将每一个门类区县对分配一个独立的线程，注意方括号[url]的写法，系统会把url列的内容赋值到这里，如果你只写url，那所有的线程名称都叫url了。你可以不添加流实例化，看看系统最后是怎么工作的。

接下来，我们要把page列展开，生成[0-page]的区间数，一页一页去抓取。拖生成区间数到page列，配置如下：

注意Cross和[page]，我就不多解释了。
把刚才的url和现在的p列合并，就构成了每一页的真实url.
拖入合并多列到url，配置如下：

仔细理解一下配置的意思，尤其是{0}p{1}，我觉得读者到了这一步，已经对整个系统有点感觉了。
雄关漫道真如铁，我们马上到达目的地了。
现在url列已经是这个样子了（点击查看样例即可）

将从爬虫转换到url，配置爬虫来源为门店列表！然后等待奇迹出现
（卖个关子，我就不截图了）
然后拖入写入数据表到任意一列，为表名起个名字，点击执行去跑就可以了。
如果你到这一步就满意了，那么文章可以不用往下看了。

8.注重细节

一道大菜要非常注意细节，爬虫也一样。

8.1 保留原始表的信息

你看到数据表里没有这家店的区县，也没有所在的页数，感觉从爬虫转换丢失了原始表的一部分信息，事实上它在1转多的时候，原始表默认都会丢掉。
因此在下图的位置，点击编辑集合，选择最后的那个从爬虫转换，配置如下：

它会将p和区域两列，添加到新表中。

8.2 我想写入数据库

目前Hawk没有强的自动建表功能，因此建议使用MongoDB,如果你已经安装了，在模块管理的数据源哪里，点击右键，可新建MongoDB连接器。
可以在主流程的最后位置，在拖入写入数据库，即可。

8.3 还是没有获取所有数据

即使是刚才这样的复杂操作，依然不能获取所有的美食，因为火锅太火，朝阳海淀的火锅都超过了50页，解决方法是再细分商区，比如朝阳的三元桥，国贸，望京...这样就能完整解决了。但本文限于篇幅就不讨论了。

8.4 如何将数据表导出到文件？

在右下角的数据管理，在要导出的表上点右键，建议输出为xml,json和txt文件，excel文件在数据量较大（5万以上）会有性能问题。

8.5 这种图形化操作有什么优势？

效率！所见即所得！你可以试着用任意一种代码去写，烦死你

8.6 如何保存所有操作？

会将所有刚才的操作保存在工程文件中。

8.6 我的服务器在Linux上，怎么办

Hawk是WPF,C#开发的，因此只能在Windows上运行，不过它生成的xml可以被Python解释，参考github上的etlpy.

8.7 Hawk是你一个人写的吗？用了多久

目前来看是这样的。业余时间四年

8.8我想获取各个城市的，不限于美食的数据

这个就更复杂了，可以借助脚本实现，这是下一篇的话题。

9.总结

为了方便大家学习使用，刚才的整个操作已经上传到了Github。地址为https://github.com/ferventdesert/Hawk-Projects
大众点评-教程.xml

本软件是我在.NET领域最后的绝唱，估计以后不会再继续开发C#相关的东西了。
有任何问题，欢迎留言。

Python基础——类和对象十二测试录 Python基础 java 开发语言 python 经验分享程序人生
目录1.定义类2.创建对象3.类和对象的示例4.类的方法4.1实例方法4.2类方法4.3静态方法5.类的继承6.封装与多态在Python中，类（Class）和对象（Object）是面向对象编程的核心概念。通过类和对象，可以组织和管理代码，使得代码更加模块化、可重用和易于维护。下面详细介绍类和对象的概念、定义方法和使用方法。1.定义类类是创建对象的模板或蓝图。类定义了对象的属性（成员变量）和行为（方
C/C++联合体(union)完全指南：从内存共享到高级用法
1.联合体基础概念联合体(union)是一种特殊的数据类型，允许在相同内存位置存储不同的数据类型，但同一时间只能使用一个成员。unionData{inti;floatf;charstr[20];};核心特性所有成员共享同一块内存大小由最大成员决定同一时间只有一个成员有效常用于节省内存或类型转换场景2.C语言中的联合体2.1基本用法unionNumber{intinteger;floatreal;}
NT内核函数原型 C+V代码搬运工 C/C++运维网络 linux
NT内核函数原型加粗样式NtLoadDriver服务控制管理器加载设备驱动.NtUnloadDriver服务控制管理器支持卸载指定的驱动程序.NtRegisterNewDevice加载新驱动文件.NtQueryIntervalProfile返回数据.NtSetIntervalProfile指定采样间隔.NtStartProfile开始取样.NtStopProfile停止采样.NtSystemDeb
HTTP代理：网络世界的智能中转站
在互联网信息高速流动的时代，HTTP代理作为一种基础却强大的网络工具，正在各类网络活动中扮演着越来越重要的角色。它就像一位经验丰富的网络向导，不仅能够优化访问路径，还能在用户与目标网站之间建立起安全屏障，让网络体验更加流畅和安全。HTTP代理最基本的功能是作为网络请求的中转站。当用户通过代理访问网站时，请求首先发送到代理服务器，再由代理服务器向目标网站获取数据。这种间接访问的方式带来了多重优势：一
16.6 《3分钟扩容20实例！LanguageMentor容器化部署实战：高并发下的负载均衡与自动扩展方案》少林码僧负载均衡运维人工智能语言模型机器学习 langchain llama
LanguageMentorAgent容器化部署与发布：高并发场景下的负载均衡与自动扩展关键词：KubernetesHPA,AWSAutoScaling,会话亲和性,监控指标,滚动更新1.高并发场景下的架构挑战LanguageMentor作为对话式Agent需要处理多用户同时在线会话，容器化部署需解决两个核心问题：
【ARM 芯片安全与攻击 5.7 -- 码重用攻击】主公讲 ARM #【ARM 芯片安全与攻击专栏】arm开发安全代码重用攻击
文章目录什么是代码重用攻击？ROP攻击示例示例背景攻击步骤假设的ROP链构建输入数据使用payload进行攻击防御措施Summary什么是代码重用攻击？代码重用攻击（CodeReuseAttack,CRA）是一种利用现有的合法代码片段来执行恶意行为的攻击方法。由于现代操作系统和处理器通常会采用数据执行保护（DEP）等安全机制，直接在堆栈或堆上执行注入的恶意代码变得困难。代码重用攻击通过拼接或链接现
ROP和Ret2libc漏洞卍king卐然 web安全经验分享 ROP攻击
一、ROP攻击原理ROP全称为Return-orientedProgramming（返回导向式编程）是一种新型的基于代码复用技术的攻击，攻击者从已有的库或可执行文件中提取指令片段，构建恶意代码。ROP攻击同缓冲区溢出攻击，格式化字符串漏洞攻击不同，是一种全新的攻击方式,它利用代码复用技术。ROP的核心思想：攻击者扫描已有的动态链接库和可执行文件，提取出可以利用的指令片段(gadget)，这些指令片
Python批量下载网易云音乐飙升榜所有音乐文件 Python_小屋 graphviz netty gpu ai webgl
Python小屋刷题神器最近升级的新功能介绍推荐教材：《Python程序设计基础与应用》（ISBN：9787111606178），董付国，机械工业出版社，2018.8出版，2021.3第11次印刷作者荣誉：机械工业出版社计算机分社成立20周年本科教材”金牌作者“，机械工业出版社高等教育教材专家咨询委员会委员，机械工业出版社”面向新工科高等院校大数据专业系列教材“编审委员会委员，全国高等院校计算机基
反调试实战案例之-----九酷音乐网
一、目标网站分析九酷音乐网采用了较为严格的反调试措施，使得常规的数据抓取方法难以奏效。其主要的反调试手段体现在频繁调用window.close关闭窗口以及history.back进行页面跳转，干扰正常的抓包流程。二、解决方案设计为了能够有效抓取数据包，本案例采用以下策略：hook关键方法：通过自定义window.close和history.back方法，在其执行时输出调试信息并设置断点，阻止其正常
11套宝藏特效视频素材大约263GB 免费分享最爱吃南瓜 html5
链接：阿里云盘分享https://www.aliyundrive.com/s/DZJmfKb4c3m链接：百度网盘请输入提取码百度网盘为您提供文件的网络备份、同步和分享服务。空间大、速度快、安全稳固，支持教育网加速，支持手机端。注册使用百度网盘即可享受免费存储空间https://pan.baidu.com/s/1JwY0kIqLOafHw-YFdgdHDQ?pwd=2022
史上最全的CTF保姆教程从入门到入狱【带工具】最爱吃南瓜网络安全 web安全 windows
下面分享的资源包含国内9套教程教程1-CTF从入门到提升四周学习视频教程教程2-信息安全CTF比赛培训教程教程3-CTF从入门到提升教程4-CTF培训web网络安全基础入门渗透测试教程教程5-CTF入门课程教程6-CTF夺旗全套视频教程教程7-网络安全课程新手入门必看教程8-bugku_CTF_Web视频教程网络安全预科班课程CTF入门国外3套教程国外教程1套-GoogleCTF2018Begin
网络安全是什么？ Gappsong874 网络安全网络 web安全安全网络安全大数据黑客
网络安全的概念网络安全是指通过技术手段和管理措施，保护网络系统及其数据不受未经授权的访问、破坏、泄露或篡改。其核心目标是确保信息的机密性、完整性和可用性，同时维护网络服务的正常运行。随着互联网的普及和数字化进程的加速，网络安全已成为全球关注的焦点。网络安全涵盖多个领域，包括硬件、软件、数据、通信和用户行为。它不仅涉及技术层面的防护，还需要法律、政策和教育等多方面的协同配合。网络安全的威胁形式多样，
黑客入门 | 用ROP和shellcode攻击SolarWinds Serv-U SSH漏洞廖致君安全网络攻击模型
（备注：黑客Hacker并不等同于信息安全罪犯。）最近花了些时间学习bufferoverflow安全漏洞，做了大名鼎鼎的CSAPP课程里的attacklab,学到了return-orientedprogramming(ROP)这种让我大开眼界的进攻方式。于是想要趁热打铁，来详细研究一下现实世界中的黑客进攻案例。本篇文章挑选的是2021年SolarWindsServ-UFTP软件中的漏洞，记录编号C
音频单声道跟立体声道的区别张海森_168820 音视频
音频单声道跟立体声道的区别摘自chatgpt单声道（Mono）和立体声（Stereo）的区别，主要在于声道数与空间感的不同：1.定义对比：项目单声道（Mono）立体声（Stereo）声道数1个2个（左声道+右声道）声音来源所有声音都从一个声道发出声音分布在两个声道，模拟空间感空间效果无空间感有方向、空间定位感（左右差异）文件大小相对较小文件更大（多一倍音频数据）常见应用电话、对讲机、语音识别等音乐
什么是区块链的跨链操作？ MonkeyKing.sun 区块链
什么是跨链操作？跨链操作是指在不同的区块链网络之间实现资产、数据或功能的互操作和交互。由于不同的区块链（如比特币、以太坊、波卡等）通常是独立的网络，具有不同的协议、共识机制和数据结构，跨链技术旨在打破这些孤岛，实现多链之间的互联互通。跨链操作可以让用户在一条链上使用另一条链的资产或服务，比如将比特币转移到以太坊网络进行DeFi应用。跨链技术的核心目标资产转移：在不同区块链之间转移代币或资产（如BT
什么是WebAssembly（WASM） MonkeyKing.sun wasm 区块链
WebAssembly（WASM）是一种高性能的低级编程语言字节码格式，可在网页和非网页环境中运行，支持多语言编译，运行速度接近原生代码。它在区块链中的作用是：作为智能合约的执行引擎，被多条非以太坊链（如Polkadot、EOS、CosmWasm）采用。Polkadot和EOS是使用WebAssembly的两个代表性区块链平台，它们与Solidity+EVM（以太坊生态）形成鲜明对比。一、什么是W
g711a/g711u音频播放器和原始音频参考文件 sunflavor g711 音视频
g711ag711u测试数据，g711播放器下载,调试声音时很不方便，下载附件包后，你要的都有了。下载地址：https://download.csdn.net/download/sunflavor/88603724
智能合约安全审计平台——以太坊虚拟机安全沙箱闲人编程智能合约安全区块链安全沙箱隔离层以太坊 EVM
目录以太坊虚拟机安全沙箱——理论、设计与实战1.引言2.理论背景与安全原理2.1以太坊虚拟机（EVM）概述2.2安全沙箱的基本概念2.3安全证明与形式化验证3.系统架构与模块设计3.1模块功能说明3.2模块之间的数据流与安全性4.安全性与密码学考量4.1密码学保障在沙箱中的应用4.2防御策略与安全规范5.实战演示与GUI设计5.1设计目标5.2GUI模块设计5.3数学公式与数据展示6.沙箱模拟运行
为什么Move将超越Solidity成为主流编程语言？初晓链研究员智能合约区块链区块链智能合约
最近Aptos、Sui的新热潮带火了Move相关的生态概念。我们团队从事Move相关的工作一年多，算是全球最经验最多、踩坑最多的开发者团队之一，借此分享一下对Move的看法与理解。最近Aptos、Sui的新热潮带火了Move相关的生态概念。我们团队从事Move相关的工作一年多，算是全球最经验最多、踩坑最多的开发者团队之一，借此分享一下对Move的看法与理解。我们团队过往在Ethereum、Sola
通达信智尊多空擒底系统 - 综合趋势交易指标主图 q125500612 通达信指标 python 前端通达信指标
用法说明：基本信息显示：在K线图右上角显示个股所属行业(HYBLOCK)、地域(DYBLOCK)和概念(GNBLOCK)信息均线系统：包含5/10/20/60/120/250日多条均线用于判断不同周期的趋势方向买卖信号："↖注意买入"：当满足多个条件时提示买入机会"双买"信号：当现价同时上穿买筹和卖筹线时提示"智尊擒底"：出现底部信号时提示顶部预警："见顶"：短期顶部信号"大顶"：重要顶部信号"危
通达信强势突破战法：百战百成量价齐升+均线多头擒牛指标幅图指标 q125500612 通达信指标通达信指标
指标用法详解核心逻辑该指标旨在筛选强势突破+量价齐升+趋势向上的个股，适用于短线或波段交易策略。一、趋势判断条件均线系统股价开盘低于20日/40日/60日均线（短期调整后蓄势）收盘价突破20/40/60日均线的最高值（确认趋势反转）5/10/30/60/120日均线呈多头排列（开盘在最低均线下，收盘站上最高均线，代表短期强势）EXPMA趋势强化股价站稳50日EXPMA（指数平滑均线）上方50日EX
十八、windows系统安全---利用Hydra获得账号密码 midsummer_woo Windows 系统安全安全 windows
环境靶机：windowsserver2012攻击机：kalilinux靶机环境密码为弱口令设定登录失败的次数锁定用户账号，关闭密码复杂度步骤1.在kali上探测目标主机（可在目标主机通过ipconfig查看目标主机IP）是否开启445端口nmap192.168.99.105-p4452.使用hydra对已知的administrator账号进行爆破（注意pass.txt的路径）hydra-ladmi
人们开始向 AI 倾诉, Claude 正变成 “树洞“ Code Agent AI Agent 人工智能
大家好,这里是CodeAgent.当AI不再只是生产力工具,它还能成为情绪的出口吗？──────Start──────今天看到一篇有趣的文章,讲的是:Anthropic分享了Claude用户如何与AI展开深层情感对话的真实情况.他们通过匿名化系统Clio,分析了450万次ClaudeFree与Pro用户的真实对话.主要集中在下面几个方面：心理咨询（Counseling）生活建议（Advice）情绪
Windows Server 2012-等保三级基线 DK_Allen 安全 windows 安全
一、身份鉴别1.1、应对登录的用户进行身份标识和鉴别，身份标识具有唯一性，身份鉴别信息具有复杂度要求并定期更换描述检查是否创建了除默认管理员之外的普通用户账户；是否启用密码复杂性配置，密码最小长度设置为8以上；以及是否设置密码使用期限策略，最长使用期限设置为30-180之间，最短使用期限设置为1-14之间；是否将强制密码历史设置为5-24之间；启用自动登陆策略为已禁用；无克隆帐户。检查提示--加固
使用 SQLite 和 Brighter 实现发件箱模式 actor_dev c#.net brighter sqlite
简介本指南演示如何使用SQLite和.NET8，结合Brighter库实现**发件箱模式（OutboxPattern）**，以确保数据库更新与消息发布之间的事务一致性。项目目标处理CreateNewOrder命令，在事务成功时发布两个事件（OrderPlaced,OrderPaid）。如果发生错误（例如业务规则冲突），则回滚数据库更改和消息发布。要求.NET8+使用Podman（或Docker）运
Elixir 中的状态管理：进程、Agent 与 GenServer 实践 actor_dev elixir erlang state
简介当我第一次学习Elixir时，我曾困惑于如何管理状态。与通过可变全局变量实现状态管理的命令式语言不同，Elixir的不可变数据模型和基于BEAM虚拟机的并发设计要求采用不同的方法。本文将探讨Elixir中状态的处理方式。上下文：BEAM虚拟机与并发Elixir运行在专为高并发和容错设计的BEAM虚拟机上。受Actor模型启发，BEAM将进程视为通过消息传递通信的轻量级实体。由于数据不可变，状态
在Brighter中通过PostgreSQL实现出站箱模式 actor_dev c#.net brighter postgresql outbox
介绍在我们之前对SQLServer使用出站箱（Outbox）模式的探索基础上，本文将该模式适配到PostgreSQL，并探讨其局限性。目标是确保数据库更新与消息发布之间的事务一致性。我们将使用.NET8、Brighter和PostgreSQL实现跨分布式系统的订单创建与事件发布。项目本项目的核心是发送一个创建订单的命令。当订单成功创建后，会发布两条消息OrderPlaced与OrderPaid。若
使用 MySQL 和 Brighter 实现出站箱模式 actor_dev .net c#brighter rabbitmq mysql 发件箱模式
简介本指南演示了如何使用Brighter库在MySQL和.NET8中实现Outbox模式(出站箱模式),以确保数据库更新和消息发布之间的事务一致性。项目目标处理一个CreateNewOrder命令，并且只有在事务成功时才发布两个事件(OrderPlaced,OrderPaid）。如果发生错误(例如业务规则冲突),则数据库更改和消息发布都将回滚。要求.NET8+Podman(或Docker)运行本地
Brighter 与发件箱模式：实现弹性系统的至少一次消息交付 actor_dev c#.net brighter 发件箱模式 design pattern 设计语言
简介我将开启一个关于Brighter的系列，重点探讨**发件箱模式**（OutboxPattern）。本文将深入解析发件箱模式的工作原理，以及Brighter如何通过原生支持实现这一模式。在分布式系统中，当需要将数据库更新与消息发布结合时（尤其是传统两阶段提交协议不可行的场景），该模式是确保事务一致性的重要工具。背景在深入探讨发件箱模式之前，先看它解决的问题。问题1：数据库更新后的单条消息发布假设
一文搞懂JS中数组与对象的几种循环方式前端没钱前端基础与进阶 javascript 开发语言 ecmascript
文章目录一、引言二、数组的循环方式2.1for循环：最经典的遍历手段2.2forEach循环：简洁的数组迭代器2.3map循环：强大的数组映射工具2.4forof循环：ES6的迭代新宠2.5filter循环：精准的数据筛选器2.6every循环：全量条件判断专家2.7some循环：存在性条件探测器2.8find循环：快速查找首个满足项三、对象的循环方式3.1forin循环：遍历对象的基础工具3.2
js动画html标签（持续更新中） 843977358 html js 动画 media opacity
1.jQuery 效果 - animate() 方法改变 "div" 元素的高度： $(".btn1").click(function(){ $("#box").animate({height:"300px
springMVC学习笔记 caoyong springMVC
1、搭建开发环境 a>、添加jar文件，在ioc所需jar包的基础上添加spring-web.jar,spring-webmvc.jar b>、在web.xml中配置前端控制器 <servlet> &nbs
POI中设置Excel单元格格式 107x poi style 列宽合并单元格自动换行
引用：http://apps.hi.baidu.com/share/detail/17249059 POI中可能会用到一些需要设置EXCEL单元格格式的操作小结：先获取工作薄对象: HSSFWorkbook wb = new HSSFWorkbook(); HSSFSheet sheet = wb.createSheet(); HSSFCellStyle setBorder = wb.
jquery 获取A href 触发js方法的this参数无效的情况一炮送你回车库 jquery
html如下： <td class=\"bord-r-n bord-l-n c-333\"> <a class=\"table-icon edit\" onclick=\"editTrValues(this);\">修改</a> </td>" j
md5 3213213333332132 MD5
import java.security.MessageDigest; import java.security.NoSuchAlgorithmException; public class MDFive { public static void main(String[] args) { String md5Str = "cq
完全卸载干净Oracle11g sophia天雪 orale数据库卸载干净清理注册表
完全卸载干净Oracle11g A、存在OUI卸载工具的情况下：第一步：停用所有Oracle相关的已启动的服务；第二步：找到OUI卸载工具：在“开始”菜单中找到“oracle_OraDb11g_home”文件夹中 &
apache 的access.log 日志文件太大如何解决 darkranger apache
CustomLog logs/access.log common 此写法导致日志数据一致自增变大。直接注释上面的语法 #CustomLog logs/access.log common 增加： CustomLog "|bin/rotatelogs.exe -l logs/access-%Y-%m-d.log
Hadoop单机模式环境搭建关键步骤 aijuans 分布式
Hadoop环境需要sshd服务一直开启，故，在服务器上需要按照ssh服务，以Ubuntu Linux为例，按照ssh服务如下： sudo apt-get install ssh sudo apt-get install rsync 编辑HADOOP_HOME/conf/hadoop-env.sh文件，将JAVA_HOME设置为Java
PL/SQL DEVELOPER 使用的一些技巧 atongyeye java sql
1 记住密码这是个有争议的功能，因为记住密码会给带来数据安全的问题。但假如是开发用的库，密码甚至可以和用户名相同，每次输入密码实在没什么意义，可以考虑让PLSQL Developer记住密码。位置：Tools菜单－－Preferences－－Oracle－－Logon HIstory－－Store with password 2 特殊Copy 在SQL Window
PHP：在对象上动态添加一个新的方法 bardo 方法动态添加闭包
有关在一个对象上动态添加方法，如果你来自Ruby语言或您熟悉这门语言，你已经知道它是什么...... Ruby提供给你一种方式来获得一个instancied对象，并给这个对象添加一个额外的方法。好！不说Ruby了，让我们来谈谈PHP PHP未提供一个“标准的方式”做这样的事情，这也是没有核心的一部分... 但无论如何，它并没有说我们不能做这样
ThreadLocal与线程安全 bijian1013 java java多线程 threadLocal
首先来看一下线程安全问题产生的两个前提条件： 1.数据共享，多个线程访问同样的数据。 2.共享数据是可变的，多个线程对访问的共享数据作出了修改。实例：定义一个共享数据： public static int a = 0;
Tomcat 架包冲突解决征客丶 tomcat Web
环境： Tomcat 7.0.6 win7 x64 错误表象：【我的冲突的架包是：catalina.jar 与 tomcat-catalina-7.0.61.jar 冲突，不知道其他架包冲突时是不是也报这个错误】严重: End event threw exception java.lang.NoSuchMethodException: org.apache.catalina.dep
【Scala三】分析Spark源代码总结的Scala语法一 bit1129 scala
Scala语法 1. classOf运算符 Scala中的classOf[T]是一个class对象，等价于Java的T.class,比如classOf[TextInputFormat]等价于TextInputFormat.class 2. 方法默认值 defaultMinPartitions就是一个默认值，类似C++的方法默认值
java 线程池管理机制 BlueSkator java线程池管理机制
编辑 Add Tools jdk线程池一、引言第一：降低资源消耗。通过重复利用已创建的线程降低线程创建和销毁造成的消耗。第二：提高响应速度。当任务到达时，任务可以不需要等到线程创建就能立即执行。第三：提高线程的可管理性。线程是稀缺资源，如果无限制的创建，不仅会消耗系统资源，还会降低系统的稳定性，使用线程池可以进行统一的分配，调优和监控。
关于hql中使用本地sql函数的问题（问-答） BreakingBad HQL 存储函数
转自于：http://www.iteye.com/problems/23775 问：我在开发过程中，使用hql进行查询（mysql5）使用到了mysql自带的函数find_in_set()这个函数作为匹配字符串的来讲效率非常好，但是我直接把它写在hql语句里面（from ForumMemberInfo fm,ForumArea fa where find_in_set(fm.userId,f
读《研磨设计模式》-代码笔记-迭代器模式-Iterator bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ import java.util.Arrays; import java.util.List; /** * Iterator模式提供一种方法顺序访问一个聚合对象中各个元素，而又不暴露该对象内部表示 * * 个人觉得，为了不暴露该
常用SQL chenjunt3 oracle sql C++c C#
--NC建库 CREATE TABLESPACE NNC_DATA01 DATAFILE 'E:\oracle\product\10.2.0\oradata\orcl\nnc_data01.dbf' SIZE 500M AUTOEXTEND ON NEXT 50M EXTENT MANAGEMENT LOCAL UNIFORM SIZE 256K ; CREATE TABLESPA
数学是科学技术的语言 comsci 工作活动领域模型
从小学到大学都在学习数学，从小学开始了解数字的概念和背诵九九表到大学学习复变函数和离散数学，看起来好像掌握了这些数学知识，但是在工作中却很少真正用到这些知识，为什么？最近在研究一种开源软件-CARROT2的源代码的时候，又一次感觉到数学在计算机技术中的不可动摇的基础作用，CARROT2是一种用于自动语言分类（聚类）的工具性软件，用JAVA语言编写，它
Linux系统手动安装rzsz 软件包 daizj linux sz rz
1、下载软件 rzsz-3.34.tar.gz。登录linux，用命令 wget http://freeware.sgi.com/source/rzsz/rzsz-3.48.tar.gz下载。 2、解压 tar zxvf rzsz-3.34.tar.gz 3、安装 cd rzsz-3.34 ; make posix 。注意：这个软件安装与常规的GNU软件不
读源码之:ArrayBlockingQueue dieslrae java
ArrayBlockingQueue是concurrent包提供的一个线程安全的队列,由一个数组来保存队列元素.通过 takeIndex和 putIndex来分别记录出队列和入队列的下标,以保证在出队列时不进行元素移动. //在出队列或者入队列的时候对takeIndex或者putIndex进行累加,如果已经到了数组末尾就又从0开始,保证数
C语言学习九枚举的定义和应用 dcj3sjt126com c
枚举的定义 # include <stdio.h> enum WeekDay { MonDay, TuesDay, WednesDay, ThursDay, FriDay, SaturDay, SunDay }; int main(void) { //int day; //day定义成int类型不合适 enum WeekDay day = Wedne
Vagrant 三种网络配置详解 dcj3sjt126com vagrant
Forwarded port Private network Public network Vagrant 中一共有三种网络配置，下面我们将会详解三种网络配置各自优缺点。端口映射(Forwarded port)，顾名思义是指把宿主计算机的端口映射到虚拟机的某一个端口上，访问宿主计算机端口时，请求实际是被转发到虚拟机上指定端口的。Vagrantfile中设定语法为： c
16.性能优化-完结 frank1234 性能优化
性能调优是一个宏大的工程，需要从宏观架构(比如拆分，冗余，读写分离，集群，缓存等)，软件设计（比如多线程并行化，选择合适的数据结构），数据库设计层面（合理的表设计，汇总表，索引，分区，拆分，冗余等）以及微观（软件的配置，SQL语句的编写，操作系统配置等）根据软件的应用场景做综合的考虑和权衡，并经验实际测试验证才能达到最优。性能水很深，笔者经验尚浅，赶脚也就了解了点皮毛而已，我觉得
Word Search hcx2013 search
Given a 2D board and a word, find if the word exists in the grid. The word can be constructed from letters of sequentially adjacent cell, where "adjacent" cells are those horizontally or ve
Spring4新特性——Web开发的增强 jinnianshilongnian spring spring mvc spring4
Spring4新特性——泛型限定式依赖注入 Spring4新特性——核心容器的其他改进 Spring4新特性——Web开发的增强 Spring4新特性——集成Bean Validation 1.1(JSR-349)到SpringMVC Spring4新特性——Groovy Bean定义DSL Spring4新特性——更好的Java泛型操作API Spring4新
CentOS安装配置tengine并设置开机启动 liuxingguome centos
yum install gcc-c++ yum install pcre pcre-devel yum install zlib zlib-devel yum install openssl openssl-devel Ubuntu上可以这样安装 sudo aptitude install libdmalloc-dev libcurl4-opens
第14章工具函数（上） onestopweb 函数
index.html <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/
Xelsius 2008 and SAP BW at a glance blueoxygen BO Xelsius
Xelsius提供了丰富多样的数据连接方式，其中为SAP BW专属提供的是BICS。那么Xelsius的各种连接的优缺点比较以及Xelsius是如何直接连接到BEx Query的呢？以下Wiki文章应该提供了全面的概览。 http://wiki.sdn.sap.com/wiki/display/BOBJ/Xcelsius+2008+and+SAP+NetWeaver+BW+Co
oracle表空间相关 tongsh6 oracle
在oracle数据库中，一个用户对应一个表空间，当表空间不足时，可以采用增加表空间的数据文件容量，也可以增加数据文件，方法有如下几种： 1.给表空间增加数据文件 ALTER TABLESPACE "表空间的名字" ADD DATAFILE '表空间的数据文件路径' SIZE 50M; &nb
.Net framework4.0安装失败 yangjuanjava .net windows
上午的.net framework 4.0，各种失败，查了好多答案，各种不靠谱，最后终于找到答案了和Windows Update有关系，给目录名重命名一下再次安装，即安装成功了！下载地址：http://www.microsoft.com/en-us/download/details.aspx?id=17113 方法： 1.运行cmd，输入net stop WuAuServ 2.点击开