- 如何高效训练通义万相2.1的LoRA:从原理到实战指南
Liudef06小白
AI作画图生视频lora通义万相WAN2.1
在AI图像生成领域,通义万相2.1作为领先的扩散模型,其官方API虽功能强大,但定制能力有限。LoRA(Low-RankAdaptation)技术正是解决这一痛点的关键钥匙——它允许开发者以极低成本实现模型个性化定制。本文将详细解析训练通义万相2.1LoRA的全流程,助你掌握定制专属AI艺术家的核心技能。一、认识通义万相2.1与LoRA1.1通义万相2.1核心特性多模态理解:精准解析复杂文本提示(
- RAGFlow是一个基于深度文档理解的开源RAG引擎
lyh1344
深度优先
RAGFlow概述RAGFlow是一款基于深度文档理解的开源RAG(检索增强生成)引擎,专注于处理复杂文档结构并提供精准的语义检索与生成能力。其核心优势在于结合多模态文档解析和智能分段技术,优化传统RAG流程中的信息提取与答案生成效果。核心特性深度文档理解支持PDF、PPT、Word、Excel等格式的解析,通过OCR、表格识别、布局分析等技术提取文本、图表及结构化数据,解决传统RAG中非文本内容
- 从实验室到产业:IndexTTS 在六大核心场景的落地实践
gogoMark
人工智能
一、内容创作:重构数字内容生产范式在短视频创作领域,IndexTTS的语音克隆技术彻底改变了配音流程。B站UP主通过5秒参考音频即可克隆出郭老师音色,生成的“各位吴彦祖们大家好”语音相似度达97%,单条视频播放量突破百万。其核心优势在于支持多语言混合输入,中英文混杂文本(如“大家好,我现在正在bilibili体验AI科技”)的自然度评分达0.796,接近人类基准0.85。通过批次推理模式,用户可将
- SQL字符串截取函数全解析:LEFT、RIGHT、SUBSTRING 实战指南
阿蒙Armon
SQLServersql算法数据库sqlserver
SQL字符串截取函数全解析:LEFT、RIGHT、SUBSTRING实战指南一、引言:字符串处理在SQL中的核心地位在数据清洗、报表开发、ETL流程中,字符串处理是SQL编程的高频操作。无论是从复杂文本中提取关键信息,还是对数据进行格式化处理,掌握字符串截取函数都是必备技能。本文将系统解析SQL中最常用的三个字符串截取函数:LEFT、RIGHT和SUBSTRING,通过语法解析、参数说明和实战示例
- LayoutLM模型使用记录
Mark_Aussie
nlp人工智能
在文档处理和信息提取领域,如何让机器精准地理解和处理复杂文档是一个挑战。文档不仅包含文本信息,还包括布局、图像等非文本元素,这些元素在传递信息时起着至关重要的作用,而传统的NLP模型通常忽略了这些视觉元素。LayOutLM是一种创新的深度学习模型,结合了传统的文本处理能力和对文档布局的理解,从而在处理包含丰富布局信息的文档时表现出色。例如,在处理一份报告时,用户不仅关注报告中的文字内容,还会关注图
- 本地部署dify+ragflow+deepseek ,结合小模型实现故障预测,并结合本地知识库和大模型给出维修建议
算法小菜鸟成长心得
语言模型
1.准备工作使用ollama拉取deepseek-r1:7b官网下载ollamaollamarundeepseek-r1:7bollamalistRagflow专注于构建基于检索增强生成(RAG)的工作流,强调模块化和轻量化,适合处理复杂文档格式和需要高精度检索的场景。Dify则旨在降低大型语言模型(LLM)应用开发的门槛,提供低代码甚至无代码的开发体验,适合快速构建和部署多种AI应用。因此文档处
- 【课堂笔记】生成对抗网络 Generative Adversarial Network(GAN)
zyq~
机器学习笔记生成对抗网络人工智能机器学习概率论GAN
文章目录问题背景原理更新过程判别器生成器问题背景 一方面,许多机器学习任务需要大量标注数据,但真实数据可能稀缺或昂贵(如医学影像、稀有事件数据)。如何在少量数据中达到一个很好的训练效果是一个很重要的问题。 另一方面,传统生成模型(如变分自编码器VAE)生成的样本往往模糊或缺乏多样性,难以捕捉真实数据的复杂分布(如高分辨率图像、复杂文本等)。 生成式对抗网络(GAN)提出了用生成器(Gener
- 高精度文档解析利器:Mistral OCR 全面解析与技术应用
gs80140
AIocrMistral
目录高精度文档解析利器:MistralOCR全面解析与技术应用一、什么是MistralOCR?二、MistralOCR的核心特点✅1.支持复杂文档结构解析✅2.高识别精度✅3.与AI系统深度集成✅4.可扩展性与容错能力三、技术原理简述四、如何在OpenWebUI中启用MistralOCR?✅步骤一:上传文档✅步骤二:选择加载器为"MistralOCR"✅步骤三:进入对话或知识检索五、应用场景与实践
- Hive优化原则及对应优化方法
datacode_wud
Hivehivehadoopbigdata
Hive优化未经允许禁止转载A、执行过程查询B、优化原则1、提前过滤数据列剪裁子查询过滤分区剪裁写明连接条件2、减少Job多表选用相同key连接unionall减少groupby使用使用同一表unionall合理使用UDTF函数3、解决数据倾斜小表放前大表放后使用mapjoin使用map端groupby4、设置合理的mapreduce的task数复杂文件增加map个数小文件合并map前合并mapr
- AI日报 - 2025年05月19日
NingboWill
AI日报人工智能
一、【行业深度】1.腾讯混元图像2.0发布:实时生图毫秒级速度与超写实画质热点聚焦:腾讯发布了混元图像2.0模型,大幅提升了AI图像生成的速度和质量,并新增了实时绘画板功能。新模型结合高效的图像编解码器和全新的扩散架构,实现了毫秒级响应速度,同时增强了图像的真实感与细节丰富度,在GenEval基准测试中表现出色。⚡进展追踪:腾讯混元2.0不仅在生图速度上领先,还提升了复杂文本指令的理解准确率至95
- Python爬虫学习路径与实战指南 05
晨曦543210
学习
一、数据清洗与预处理的魔鬼细节1.非结构化文本处理正则表达式进阶:用命名分组提取复杂文本。importretext="价格:¥199.00折扣价:¥159.00"pattern=r"价格:¥(?P\d+\.\d{2})折扣价:¥(?P\d+\.\d{2})"match=re.search(pattern,text)print(match.groupdict())#{'price':'199.00'
- 【Python爬虫实战】正则:从基础字符匹配到复杂文本处理的全面指南
易辰君
python爬虫python爬虫开发语言
个人主页:https://blog.csdn.net/2401_86688088?type=blog系列专栏:https://blog.csdn.net/2401_86688088/category_12797772.html目录前言一、正则表达式(一)正则表达式的基本作用(二)正则表达式的基本组成(三)常用的正则表达式示例(四)正则表达式的应用场景二、re模块的介绍(一)re模块中的常用函数(二
- Windows系统下MinerU的CUDA加速配置指南
林语微光
论文翻译python从入门到实践windowsmineru接口调用人工智能
Windows系统下MinerU的CUDA加速配置指南快速解锁GPU性能,提升文档解析效率1、简介MinerU是一款高效的文档解析工具,支持通过CUDA加速显著提升处理速度。本指南详细说明如何在Windows系统中配置CUDA环境,并启用MinerU的GPU加速功能,帮助用户充分利用NVIDIA显卡的计算能力,优化复杂文档的解析效率。2、前提条件在开始配置前,请确保满足以下条件:硬件要求:NVID
- 【RAG 篇】【多模态文档理解框架与文档大模型全景解析【开发者实战指南】
大F的智能小课
大模型理论和实战人工智能深度学习算法
引言随着金融票据、医疗报告等场景的数字化需求激增,传统OCR技术已无法满足复杂文档的理解需求。本文将深入解析6多模态文档理解框架和3大文档专用LLM,提供从技术选型到落地评估的全链路指南,所有项目均经2024年6月实测验证。一、多模态文档理解框架(一)Donut(NAVER,2022)技术亮点:端到端无OCR架构,直接解析PDF/图片。支持文档视觉问答(DocVQA)。在CORD数据集F1达95.
- 文件有几十个T,需要做rag,用ragFlow能否快速落地呢?
努力努力再努力呐
PyTorchpython多模态RAG学习pytorchhuggingface多模态OpenCompass
一、RAGFlow的优势1、RAGFlow处理大规模数据性能:(1)、RAGFlow支持分布式索引构建,采用分片技术,能够处理TB级数据。(2)、它结合向量搜索和关键词搜索,提高检索效率。(3)、通过智能文档分块和混合检索机制,优化大规模数据处理。2、实际应用案例:(1)、RAGFlow被用于历史辅导助手、机加工行业设备维保等场景。(2)、这些案例展示了RAGFlow在解析复杂文档和提高检索效率方
- WPS Office安卓版文档编辑功能与兼容性评测【高效编辑】
电脑高手-小林
wpsandroid
一、界面设计与操作体验WPSOffice安卓版采用简洁直观的界面设计,首页默认展示近期文档列表,支持一键新建文档、表格或演示文稿。整体操作逻辑与PC端保持一致,新用户也能快速上手。编辑工具栏设计合理,常用功能如字体设置、段落调整、插入图片等均可直接访问,提升编辑效率。文档编辑过程中支持多指缩放、滑动对齐、长按选中等移动端专属操作,使得在手机上处理复杂文档成为可能。此外,WPS提供了云文档功能,可实
- Python正则表达式有哪些常用匹配字符?
程序员总部
pythonpython正则表达式mysql
处理文本数据时,我们经常需要查找、提取或替换特定模式的字符串。这时候正则表达式就成了程序员最强大的武器之一。今天我们就来详细聊聊Python中那些最常用的正则表达式字符和它们的实际用法。为什么要学正则表达式?假设你遇到这些场景:从日志中提取所有日期时间验证用户输入的邮箱格式是否正确批量修改代码中的变量名抓取网页中的特定数据用普通字符串方法处理这些需求会很麻烦!正则表达式能让你用简洁的模式描述复杂文
- 图像处理有哪些核心技术?技术发展现状如何?
合合信息解决方案
图像处理
在数字化信息爆炸的时代,文档图像预处理技术正悄然改变着我们处理文字信息的方式。无论是手持拍摄的收据、扫描仪中的身份证,还是工业机器人采集的复杂文档,预处理技术都在背后默默提升着OCR(光学字符识别)系统的性能。在合合信息发布的《2025智能文档技术与应用白皮书》一书中,视角也集中在了文档图像预处理技术上!在白皮书介绍中,作为OCR流程中的关键一步,在文档图像预处理领域,核心技术进一步细化为切边处理
- 两层检索策略:摘要检索 + 内容检索在 RAG 中的实践
佑瞻
RAGRAGpythonllamaindex分层检索
在企业级RAG系统开发中,面对成百上千的复杂文档,我们常常会陷入这样的困境:直接检索原始内容容易被海量细节淹没,只依赖摘要又担心丢失关键信息。有没有一种方案能兼顾「全局视角」和「细节把控」?今天我们分享一种「摘要检索+内容检索」的两层检索策略,通过LlamaIndex框架实现摘要与原始内容的分层管理与递归检索,帮我们在复杂知识环境中找到精准答案。一、分层检索的核心思想:先定位「知识地图」,再深挖「
- 开源的7B参数OCR视觉大模型:RolmOCR
Panesle
前沿ocr人工智能大模型开源
1.背景介绍早些时候,AllenInstituteforAI发布了olmOCR,这是一个基于Qwen2-VL-7B视觉语言模型(VLM)的开源工具,用于处理PDF和其他复杂文档的OCR(光学字符识别)。开发团队对该工具的高质量和开源特性感到兴奋,并探索了如何利用更新的基础模型和一些轻量级优化来进一步改进它。2.RolmOCR的发布开发团队开发了RolmOCR,作为olmOCR的替代方案。它具有以下
- 小体积大智慧!IBM开源的文档解析神器SmolDocling如何让复杂文档处理变得简单高效?
遇见小码
AI棱镜实验室开源人工智能运维AIGC
每天面对扫描文件、手写笔记、代码截图等复杂文档,你是否还在手动整理排版?今天介绍的这款由IBM与HuggingFace联合推出的开源模型SmolDocling,或许能成为你的效率救星。它仅需256MB内存,就能将图片中的文字、代码、公式、图表等元素一键转为结构化文档,彻底解放你的双手!一、SmolDocling是什么?SmolDocling是基于视觉语言模型(VLM)技术开发的文档处理工具,属于轻
- 日常偷懒(一)正则表达式小记
不知道叫什么呀
用AI满足我的好奇心正则表达式学习AIGC我的AI老师python
平时工作中有很多dritywork,学会偷懒之后真的可以帮我们省很多时间来摸鱼!而正则表达式是我们的偷懒必备装备,会用以后用起来会特别爽~。正则表达式(RegularExpression,简称Regex)是一种用于匹配和操作文本模式的字符串工具,通过特殊语法规则可以快速搜索、替换或提取复杂文本中的特定内容。以下通过概念拆解与实例说明其核心用法:一、基础概念1.核心功能模式匹配:验证字符串是否符合特
- LangChain教程 - RAG - PDF解析
花千树-010
LangChainlangchainpdfpythonAIGC
系列文章索引LangChain教程-系列文章在现代人工智能和自然语言处理(NLP)应用中,处理PDF文档是一项常见且重要的任务。由于PDF格式的复杂性,包含文本、图像、表格等多种内容结构,高效、准确地解析PDF需要强大的工具支持。LangChain提供了一套完善的PDF加载器(PDFLoader),支持从纯文本提取到复杂文档解析,并集成了OCR(光学字符识别)功能,能够处理扫描版PDF或包含嵌入图
- Java动态生成Word终极指南:poi-tl与Aspose.Words性能对比及选型建议
天机️灵韵
开源项目编程语言vscodeJavaword模板
在Java中实现复杂文档生成(如合同、报表)时,poi-tl、Aspose.Words和docx4j是三个主流的模板技术方案。以下是它们的核心对比和选型建议:1.poi-tl(基于ApachePOI的模板引擎)定位:轻量级开源库,基于ApachePOI封装,简化模板操作。核心优势:模板语法灵活:通过{{@var}}、{{?section}}等标签实现文本、表格、列表、图片的动态插入。代码简洁:相比
- 解析稳定率达99.99%!合合信息“大模型加速器2.0”助力AI打破“幻觉”
算法大数据人工智能图表表格
随着大模型在社会应用中逐渐普及,人们在享受便利的同时,也面临着“AI幻觉”产生的风险。训练数据是影响大模型“认知能力”的关键要素,近期,上海合合信息科技股份有限公司(简称“合合信息”)TextIn“大模型加速器2.0”版本正式上线,基于领先的智能文档处理技术,对复杂文档的版式、布局和元素进行精准解析及结构化处理,从数据源头降低大模型“幻觉”风险,让大模型在与人类的沟通中“更靠谱”。“大模型加速器2
- 如何快速提取PDF中的图片?这款免费工具让你事半功倍!
10211234567890
pdf编辑pdfpdf提取图片pdf数据提取pdf提取
在日常学习和工作中,PDF文件几乎成了我们处理文档的标配。但你是否遇到过这样的烦恼:想从PDF里提取图片,却只能手动截图,效率低还容易模糊?尤其是面对几十页的复杂文档,简直让人抓狂……别急!今天分享一个亲测高效的解决方案——完全免费、无需注册、一键提取PDF图片的工具,3分钟搞定难题!为什么你需要专业的PDF图片提取工具?手动截图太麻烦:图片位置分散、尺寸不一,截图后还需裁剪整理,耗时耗力。图片质
- 主流开源大模型能力对比矩阵
时光旅人01号
人工智能开源python深度学习pytorch
模型名称核心优势主要局限Llama2/3✅多语言生态完善✅Rotary位置编码✅GQA推理加速⚠️数据时效性差⚠️隐私保护不足Qwen✅千亿参数规模✅中文语境优化✅复杂文本生成⚠️需高性能硬件⚠️领域知识需二次训练ChatGLM-3✅多轮对话支持✅中英双语流畅✅对话记忆优秀⚠️计算资源消耗大⚠️长文本易发散DeepSeek✅代码注释生成✅技术文档规范✅全流程方案生成⚠️逻辑错误较多⚠️数据更新延迟
- 正则表达式捕获组详解:从入门到掌握
漠月瑾-西安
前端小问题点记录正则表达式javascript前端
正则表达式捕获组详解:从入门到掌握1.什么是捕获组(CaptureGroup)?捕获组是正则表达式中用于==捕获子匹配内容==的语法,通过()包裹的部分会被单独记录。它是处理复杂文本匹配时最常用的功能之一。关键特性提取子内容:从完整匹配中分离出特定部分索引编号:从左到右按(出现的顺序分配编号(从1开始)复用匹配:可在同个正则表达式中反向引用2.基础语法与示例2.1简单捕获组cons
- Mistral 发布 Mistral OCR,号称「世界上最好的 OCR 模型」
自不量力的A同学
ocr
Mistral发布的MistralOCR号称“世界上最好的OCR模型”,以下是对它的详细介绍:产品概述MistralOCR是一种光学字符识别API,以图像和PDF作为输入,可从有序交错的文本和图像中提取内容,能理解文档的每个元素,包括媒体、文本、表格、公式等,可与RAG系统结合,处理多模式文档。核心优势顶尖的复杂文档理解能力:可精准识别科学论文、技术文献中的图表、公式(含LaTeX)、表格及混合排
- Hive之正则表达式RLIKE详解及示例
三生暮雨渡瀟瀟
hivehive正则表达式
目录一、RLIKE语法及核心特性1.基本语法2.核心特性二、常见业务场景及示例场景1:过滤包含特定模式的日志(如错误日志)场景2:验证字段格式(如邮箱、手机号)场景3:提取复杂文本中的关键词场景4:排除无效数据(如非数字字符)三、高级用法与技巧1.忽略大小写匹配2.匹配多行文本3.组合多个条件四、性能优化建议1.避免全表扫描2.预编译正则模式3.简化正则表达式五、常见问题与注意事项1.转义字符问题
- apache 安装linux windows
墙头上一根草
apacheinuxwindows
linux安装Apache 有两种方式一种是手动安装通过二进制的文件进行安装,另外一种就是通过yum 安装,此中安装方式,需要物理机联网。以下分别介绍两种的安装方式
通过二进制文件安装Apache需要的软件有apr,apr-util,pcre
1,安装 apr 下载地址:htt
- fill_parent、wrap_content和match_parent的区别
Cb123456
match_parentfill_parent
fill_parent、wrap_content和match_parent的区别:
1)fill_parent
设置一个构件的布局为fill_parent将强制性地使构件扩展,以填充布局单元内尽可能多的空间。这跟Windows控件的dockstyle属性大体一致。设置一个顶部布局或控件为fill_parent将强制性让它布满整个屏幕。
2) wrap_conte
- 网页自适应设计
天子之骄
htmlcss响应式设计页面自适应
网页自适应设计
网页对浏览器窗口的自适应支持变得越来越重要了。自适应响应设计更是异常火爆。再加上移动端的崛起,更是如日中天。以前为了适应不同屏幕分布率和浏览器窗口的扩大和缩小,需要设计几套css样式,用js脚本判断窗口大小,选择加载。结构臃肿,加载负担较大。现笔者经过一定时间的学习,有所心得,故分享于此,加强交流,共同进步。同时希望对大家有所
- [sql server] 分组取最大最小常用sql
一炮送你回车库
SQL Server
--分组取最大最小常用sql--测试环境if OBJECT_ID('tb') is not null drop table tb;gocreate table tb( col1 int, col2 int, Fcount int)insert into tbselect 11,20,1 union allselect 11,22,1 union allselect 1
- ImageIO写图片输出到硬盘
3213213333332132
javaimage
package awt;
import java.awt.Color;
import java.awt.Font;
import java.awt.Graphics;
import java.awt.image.BufferedImage;
import java.io.File;
import java.io.IOException;
import javax.imagei
- 自己的String动态数组
宝剑锋梅花香
java动态数组数组
数组还是好说,学过一两门编程语言的就知道,需要注意的是数组声明时需要把大小给它定下来,比如声明一个字符串类型的数组:String str[]=new String[10]; 但是问题就来了,每次都是大小确定的数组,我需要数组大小不固定随时变化怎么办呢? 动态数组就这样应运而生,龙哥给我们讲的是自己用代码写动态数组,并非用的ArrayList 看看字符
- pinyin4j工具类
darkranger
.net
pinyin4j工具类Java工具类 2010-04-24 00:47:00 阅读69 评论0 字号:大中小
引入pinyin4j-2.5.0.jar包:
pinyin4j是一个功能强悍的汉语拼音工具包,主要是从汉语获取各种格式和需求的拼音,功能强悍,下面看看如何使用pinyin4j。
本人以前用AscII编码提取工具,效果不理想,现在用pinyin4j简单实现了一个。功能还不是很完美,
- StarUML学习笔记----基本概念
aijuans
UML建模
介绍StarUML的基本概念,这些都是有效运用StarUML?所需要的。包括对模型、视图、图、项目、单元、方法、框架、模型块及其差异以及UML轮廓。
模型、视与图(Model, View and Diagram)
&
- Activiti最终总结
avords
Activiti id 工作流
1、流程定义ID:ProcessDefinitionId,当定义一个流程就会产生。
2、流程实例ID:ProcessInstanceId,当开始一个具体的流程时就会产生,也就是不同的流程实例ID可能有相同的流程定义ID。
3、TaskId,每一个userTask都会有一个Id这个是存在于流程实例上的。
4、TaskDefinitionKey和(ActivityImpl activityId
- 从省市区多重级联想到的,react和jquery的差别
bee1314
jqueryUIreact
在我们的前端项目里经常会用到级联的select,比如省市区这样。通常这种级联大多是动态的。比如先加载了省,点击省加载市,点击市加载区。然后数据通常ajax返回。如果没有数据则说明到了叶子节点。 针对这种场景,如果我们使用jquery来实现,要考虑很多的问题,数据部分,以及大量的dom操作。比如这个页面上显示了某个区,这时候我切换省,要把市重新初始化数据,然后区域的部分要从页面
- Eclipse快捷键大全
bijian1013
javaeclipse快捷键
Ctrl+1 快速修复(最经典的快捷键,就不用多说了)Ctrl+D: 删除当前行 Ctrl+Alt+↓ 复制当前行到下一行(复制增加)Ctrl+Alt+↑ 复制当前行到上一行(复制增加)Alt+↓ 当前行和下面一行交互位置(特别实用,可以省去先剪切,再粘贴了)Alt+↑ 当前行和上面一行交互位置(同上)Alt+← 前一个编辑的页面Alt+→ 下一个编辑的页面(当然是针对上面那条来说了)Alt+En
- js 笔记 函数
征客丶
JavaScript
一、函数的使用
1.1、定义函数变量
var vName = funcation(params){
}
1.2、函数的调用
函数变量的调用: vName(params);
函数定义时自发调用:(function(params){})(params);
1.3、函数中变量赋值
var a = 'a';
var ff
- 【Scala四】分析Spark源代码总结的Scala语法二
bit1129
scala
1. Some操作
在下面的代码中,使用了Some操作:if (self.partitioner == Some(partitioner)),那么Some(partitioner)表示什么含义?首先partitioner是方法combineByKey传入的变量,
Some的文档说明:
/** Class `Some[A]` represents existin
- java 匿名内部类
BlueSkator
java匿名内部类
组合优先于继承
Java的匿名类,就是提供了一个快捷方便的手段,令继承关系可以方便地变成组合关系
继承只有一个时候才能用,当你要求子类的实例可以替代父类实例的位置时才可以用继承。
在Java中内部类主要分为成员内部类、局部内部类、匿名内部类、静态内部类。
内部类不是很好理解,但说白了其实也就是一个类中还包含着另外一个类如同一个人是由大脑、肢体、器官等身体结果组成,而内部类相
- 盗版win装在MAC有害发热,苹果的东西不值得买,win应该不用
ljy325
游戏applewindowsXPOS
Mac mini 型号: MC270CH-A RMB:5,688
Apple 对windows的产品支持不好,有以下问题:
1.装完了xp,发现机身很热虽然没有运行任何程序!貌似显卡跑游戏发热一样,按照那样的发热量,那部机子损耗很大,使用寿命受到严重的影响!
2.反观安装了Mac os的展示机,发热量很小,运行了1天温度也没有那么高
&nbs
- 读《研磨设计模式》-代码笔记-生成器模式-Builder
bylijinnan
java设计模式
声明: 本文只为方便我个人查阅和理解,详细的分析以及源代码请移步 原作者的博客http://chjavach.iteye.com/
/**
* 生成器模式的意图在于将一个复杂的构建与其表示相分离,使得同样的构建过程可以创建不同的表示(GoF)
* 个人理解:
* 构建一个复杂的对象,对于创建者(Builder)来说,一是要有数据来源(rawData),二是要返回构
- JIRA与SVN插件安装
chenyu19891124
SVNjira
JIRA安装好后提交代码并要显示在JIRA上,这得需要用SVN的插件才能看见开发人员提交的代码。
1.下载svn与jira插件安装包,解压后在安装包(atlassian-jira-subversion-plugin-0.10.1)
2.解压出来的包里下的lib文件夹下的jar拷贝到(C:\Program Files\Atlassian\JIRA 4.3.4\atlassian-jira\WEB
- 常用数学思想方法
comsci
工作
对于搞工程和技术的朋友来讲,在工作中常常遇到一些实际问题,而采用常规的思维方式无法很好的解决这些问题,那么这个时候我们就需要用数学语言和数学工具,而使用数学工具的前提却是用数学思想的方法来描述问题。。下面转帖几种常用的数学思想方法,仅供学习和参考
函数思想
把某一数学问题用函数表示出来,并且利用函数探究这个问题的一般规律。这是最基本、最常用的数学方法
- pl/sql集合类型
daizj
oracle集合typepl/sql
--集合类型
/*
单行单列的数据,使用标量变量
单行多列数据,使用记录
单列多行数据,使用集合(。。。)
*集合:类似于数组也就是。pl/sql集合类型包括索引表(pl/sql table)、嵌套表(Nested Table)、变长数组(VARRAY)等
*/
/*
--集合方法
&n
- [Ofbiz]ofbiz初用
dinguangx
电商ofbiz
从github下载最新的ofbiz(截止2015-7-13),从源码进行ofbiz的试用
1. 加载测试库
ofbiz内置derby,通过下面的命令初始化测试库
./ant load-demo (与load-seed有一些区别)
2. 启动内置tomcat
./ant start
或
./startofbiz.sh
或
java -jar ofbiz.jar
&
- 结构体中最后一个元素是长度为0的数组
dcj3sjt126com
cgcc
在Linux源代码中,有很多的结构体最后都定义了一个元素个数为0个的数组,如/usr/include/linux/if_pppox.h中有这样一个结构体: struct pppoe_tag { __u16 tag_type; __u16 tag_len; &n
- Linux cp 实现强行覆盖
dcj3sjt126com
linux
发现在Fedora 10 /ubutun 里面用cp -fr src dest,即使加了-f也是不能强行覆盖的,这时怎么回事的呢?一两个文件还好说,就输几个yes吧,但是要是n多文件怎么办,那还不输死人呢?下面提供三种解决办法。 方法一
我们输入alias命令,看看系统给cp起了一个什么别名。
[root@localhost ~]# aliasalias cp=’cp -i’a
- Memcached(一)、HelloWorld
frank1234
memcached
一、简介
高性能的架构离不开缓存,分布式缓存中的佼佼者当属memcached,它通过客户端将不同的key hash到不同的memcached服务器中,而获取的时候也到相同的服务器中获取,由于不需要做集群同步,也就省去了集群间同步的开销和延迟,所以它相对于ehcache等缓存来说能更好的支持分布式应用,具有更强的横向伸缩能力。
二、客户端
选择一个memcached客户端,我这里用的是memc
- Search in Rotated Sorted Array II
hcx2013
search
Follow up for "Search in Rotated Sorted Array":What if duplicates are allowed?
Would this affect the run-time complexity? How and why?
Write a function to determine if a given ta
- Spring4新特性——更好的Java泛型操作API
jinnianshilongnian
spring4generic type
Spring4新特性——泛型限定式依赖注入
Spring4新特性——核心容器的其他改进
Spring4新特性——Web开发的增强
Spring4新特性——集成Bean Validation 1.1(JSR-349)到SpringMVC
Spring4新特性——Groovy Bean定义DSL
Spring4新特性——更好的Java泛型操作API
Spring4新
- CentOS安装JDK
liuxingguome
centos
1、行卸载原来的:
[root@localhost opt]# rpm -qa | grep java
tzdata-java-2014g-1.el6.noarch
java-1.7.0-openjdk-1.7.0.65-2.5.1.2.el6_5.x86_64
java-1.6.0-openjdk-1.6.0.0-11.1.13.4.el6.x86_64
[root@localhost
- 二分搜索专题2-在有序二维数组中搜索一个元素
OpenMind
二维数组算法二分搜索
1,设二维数组p的每行每列都按照下标递增的顺序递增。
用数学语言描述如下:p满足
(1),对任意的x1,x2,y,如果x1<x2,则p(x1,y)<p(x2,y);
(2),对任意的x,y1,y2, 如果y1<y2,则p(x,y1)<p(x,y2);
2,问题:
给定满足1的数组p和一个整数k,求是否存在x0,y0使得p(x0,y0)=k?
3,算法分析:
(
- java 随机数 Math与Random
SaraWon
javaMathRandom
今天需要在程序中产生随机数,知道有两种方法可以使用,但是使用Math和Random的区别还不是特别清楚,看到一篇文章是关于的,觉得写的还挺不错的,原文地址是
http://www.oschina.net/question/157182_45274?sort=default&p=1#answers
产生1到10之间的随机数的两种实现方式:
//Math
Math.roun
- oracle创建表空间
tugn
oracle
create temporary tablespace TXSJ_TEMP
tempfile 'E:\Oracle\oradata\TXSJ_TEMP.dbf'
size 32m
autoextend on
next 32m maxsize 2048m
extent m
- 使用Java8实现自己的个性化搜索引擎
yangshangchuan
javasuperword搜索引擎java8全文检索
需要对249本软件著作实现句子级别全文检索,这些著作均为PDF文件,不使用现有的框架如lucene,自己实现的方法如下:
1、从PDF文件中提取文本,这里的重点是如何最大可能地还原文本。提取之后的文本,一个句子一行保存为文本文件。
2、将所有文本文件合并为一个单一的文本文件,这样,每一个句子就有一个唯一行号。
3、对每一行文本进行分词,建立倒排表,倒排表的格式为:词=包含该词的总行数N=行号