LtMamba

Other -- ChatGPT 原理

本文为个人理解，帮助小白（本人就是）了解正在创建新时代的 AI 产品，如文中理解有误欢迎留言。

[参考链接--](https://baijiahao.baidu.com/s?id=1765556782543603120&wfr=spider&for=pc)

1. 了解一些基本概念

大语言模型（Large Language Model，LLM）
是指使用大量文本数据训练的深度学习模型，可以生成自然语言文本或理解语言文本的含义。大语言模型可以处理多种自然语言任务，如文本分类、问答、对话等，是通向人工智能的一条重要途径。
GPT（Generative Pre-Trained Transformer，生成式预训练变换器）
是一种基于互联网的、可用数据来训练的、文本生成的深度学习模型。
Transformer
Transformer 模型是一种基于自注意力机制的深度学习模型，它可以用于各种自然语言处理任务.
语言信息处理（LIP，Language Information Processing）
是语言学与计算机科学交叉形成的一门以计算语言学理论为基础，具有广泛应用价值的语言工程学科，是应用语言学的重要组成部分。有时也称作自然语言处理（NLP， Natural Language Processing）或自然语言理解（NLU， Natural Language Understanding）术语辨析：自然语言处理是上位概念，包括理解和生成，而语言信息处理可以分别理解为语言信息 | 处理” 和 “语言 | 信息处理”。前者指的是对各种语言信息进行处理，后者指对语言本身进行信息化的处理。
NLP 相关产品（如 ChatGPT）将其拆分为两个关键步骤：自然语言理解（NLU，Natural Language Understanding）和自然语言生成（NLG，Natural Language Generation）。下文详解。
LLM 和 NLP 间关系
在 NLP 领域，LLM 被视为一种重要的基础模型，它可以为各种自然语言处理任务提供强大的支持。LLM 与 NLP 之间有着密切的联系。LLM 可以通过学习大量文本数据来掌握语言知识和语法规则，这使得它在许多 NLP 任务中表现出色。例如，在文本分类、情感分析、文本摘要、机器翻译等任务中，LLM 都展现出了极高的性能和效果。此外， LLM 还可以从海量文本中提取语义信息和知识，这有助于提高 NLP 应用的准确性和效率。
GPT 和 LLM 关系：
GPT 模型可以看作是 LLM 的一种实现方式。GPT 模型使用 Transformer 结构进行训练，这种结构可以学习文本生成过程中的长距离依赖关系和上下文信息。通过训练 GPT 模型，我们可以生成高质量的文本，这有助于提高 NLP 应用的效率和准确性。
其次，LLM 和 GPT 模型之间也存在一些差异。GPT 模型强调生成文本的能力，它通过预测文本的后续内容来生成文本。而 LLM 则更注重从海量文本中学习语言规律和知识，它可以通过无监督学习来提高性能和效率。因此，在具体应用中，我们需要根据任务的不同来选择适合的模型。
Transformer 和 LLM 及 GPT 间的关系
Transformer是 LLM和 GPT 模型的基础。无论是 LLM 还是 GPT 模型，它们的核心结构都是基于 Transformer 模型搭建的。通过在海量文本数据上进行训练，Transformer模型可以学习到文本中的语义信息和语法规则，从而为各种NLP任务提供支持。
传统 AI 和现在的基于 LLM 的 AI 的联系
传统 AI ：也要训练，但专注于某一个领域，因此只能处理特定问题。也就是一个完整的模型数据量相对较小。如很会下棋的 AlphaGO，它的输入可能就是一个开始下棋的命令。
那么以传统 AI 理念衍生出的 NLP 相关产品概念拆分为两个关键步骤：自然语言理解（NLU）和自然语言生成（NLG，Natural Language Generation）
如：
以 SIRI 为代表的人工智能助手统一了 NLU 层，用一个模型理解用户的需求，然后将需求分配给特定的 AI 模型进行处理，实现 NLG 并向用户反馈。然而，这种模式存在显著缺点。如微软官方图例所示，和传统 AI 一样，用户每遇到一个新的场景，都需要训练一个相应的模型，费用高昂且发展缓慢，NLG 层亟需改变。
基于 LLM 的 AI：也要训练，但专注的是通用领域（也就是人类所能了解的所有知识，如下象棋、画图等等），那么也就意味着它需要进行各种不同领域的训练（这个训练就基于 LLM ）。同时这种模型都是针对用户输入的文本或语音进行理解处理后回复相应的结果给用户。
如：
大型语言模型（如GPT）采用了一种截然不同的策略，实现了 NLG 层的统一。秉持着“大力出奇迹”的理念，将海量知识融入到一个统一的模型中，而不针对每个特定任务分别训练模型，使 AI 解决多类型问题的能力大大加强。
以 GPT-3 为例，其训练数据源为互联网的各种精选信息以及经典书籍，规模达到了 45 TB，相当于阅读了一亿本书。GPT-4的模型参数量甚至达到了GPT-3.5的五倍之多，这也解释了为何GPT-4表现得如此聪明（因为它啥都知道啊，你要是看过那么多资料并且全都记住，那你比它牛多了，别人问你啥你都能多少知道点）。
总结：
由上可知以特定领域数据训练实现的 NLP 相关的 AI 产品一套下来占用空间很小，响应速度会快，而基于 LLM 实现的 NLP 相关的 AI 产品占用空间会特别大，响应速度可想而知会相对较慢。

2. 了解什么是 NLP 类的 AI 产品（以 ChatGPT 为例）

ChatGPT 是基于 GPT 模型的 AI 聊天产品，一般也称为 GPT。也就是上文提到的 NLP 相关的 AI 产品。输入主要是人类输入的文本或语音，然后进行相应的处理并返回结果给用户。

3. 了解 NLP 类 AI 产品的实现原理（ ChatGPT 为例）

上文提过 NLP 由 NLU 和 NLG 组成。

NLU 都是基于 LLM 的，大都大差不差，但是注意这里有一个语言类型的区别，即中文和英文的区别，如 ChatGPT 等美国的 NLP 产品的训练数据主要是英文，而国内如文心一言基于中文的数据，那么输入相同的文本或语音就会有很大的差别，如果大家都用同一个数据源去训练，也会因为不同公司对 NLG 的不同实现而呈现出不同的结果。

3.1 理解 NLG (ChatGPT为例)

不同 NLP 产品类公司产品好不好用的最大区别就是 NLG 的实现区别，也是这类公司的核心技术。

一个简单地 NLG 实现的例子
AI 本质上就是个逆概率问题。以 GPT 的自然语言生成实际上是一个基于概率的“文字接龙”游戏。我们可以将GPT模型简化为一个拥有千亿参数的“函数”。当用户输入“提示词（prompt）”时，模型按照以下步骤执行：
①将用户的“提示词”转换为token（准确地说是“符号”，近似为“词汇”，下同）+ token的位置。
②将以上信息“向量化”，作为大模型“函数”的输入参数。
③大模型根据处理好的参数进行概率猜测，预测最适合回复用户的词汇，并进行回复。
④将回复的词汇（token）加入到输入参数中，重复上述步骤，直到最高概率的词汇是【END】，从而实现一次完整的回答。这种方法使得GPT模型能够根据用户的提示，生成连贯、合理的回复，从而实现自然语言处理任务。
上下文理解的关键技术
GPT 不仅能理解用户当前的问题，还能基于前文理解问题背景。这得益于 Transformer 架构中的“自注意力机制（Self-attention）”。该机制使得 GPT 能够捕捉长文本中的依赖关系。通俗地说，GPT 在进行文字接龙判断时，不仅基于用户刚输入的“提示”，还会将之前多轮对话中的“提示”和“回复”作为输入参数。然而，这个距离长度是有限的。对于 GPT-3.5 来说，其距离限制为 4096 个词汇（tokens）；而对于 GPT-4，这个距离已经大幅扩展至 3.2 万个tokens。
这也就是不同公司 NLP 类产品间存在差异的地方，

3. 等等其他技术

当然这两个只是很小的例子来帮助理解 NLP 产品 NLG 的实现。

4. 基于大模型的 ChatGPT 为何如此惊艳

①自监督学习：利用海量的文本进行自学，让 ChatGPT 具备预测上下文概率的基本能力。

②监督学习：人类参与，帮助 ChatGPT 理解人类喜好和期望的答案，本质为微调（fine-tune）【不同公司 NLG 的实现】。

③强化学习：根据用户使用时的反馈，持续优化和改进回答质量。

其中，自监督学习最关键。因为，大模型的魅力在于其“大”——大在两个方面：

①训练数据量大：

即训练大模型的数据规模，以ChatGPT -3为例，其训练数据源为互联网的各种精选信息以及经典书籍，规模达到了 45TB，相当于阅读了一亿本书。

②模型参数量大：

参数是神经网络中的一个术语，用于捕捉数据中的规律和特征。通常，宣称拥有百亿、千亿级别参数的大型模型，指的都是其参数量。

追求大型模型的参数量是为了利用其神奇的“涌现能力”，实现所谓的“量变引起质变”。举例来说，如果要求大模型根据emoji猜电影名称，如代表《海底总动员》。可以看到，当模型参数达到千亿级别时，匹配准确度大幅度提升。这表明模型参数量的增加对提高模型表现具有重要意义。

只有当模型参数达到千亿级别，大模型的优势才得以凸显。GPT 之外的其他大模型，也有类似的表现。

为什么？

目前主流观点认为，要完整完成一个任务，实际上需要经过很多子步骤。当模型大小不足时，大语言模型无法理解或执行所有步骤，导致最终结果不正确，达到千亿级参数时，其解决问题的全链路能力已经足够。人们以最终结果的正误作为评判标准，导致认为是一种“涌现”。

在“涌现”问题上，人与猩猩的比喻很有趣。人类的大脑容量比猩猩大3倍，这种差异使得人类能够进行更复杂的思考、沟通和创造。两者的结构没有显著差异，这不也是“涌现”吗？

ChatGPT -3.5正是千亿模型，参数达到了1750亿。相较于 ChatGPT -3，ChatGPT -3.5主要针对模型参数进行了微调，使其在问答时更符合人类的习惯。据悉，ChatGPT -4 的模型参数量甚至达到了 ChatGPT -3.5的五倍之多，这也解释了为何 ChatGPT -4 表现得如此聪明（体验过的人应该都能理解）。下面是GPT模型演进历史：

5. 基于 LLM 的 GPT 的优势及其局限性

5.1 优势

GPT模型具有明显的、突破性的优势。

典型的优势包括：

①强大的语言理解能力；

②极为广泛的知识储备；

③学习能力与推理能力等等。

这些能力让人们感觉人工智能真正拥有了“脑子”，想象着使用GPT解决一切问题。

5.2 局限性

1.逻辑不透明

GPT模型的回答本质上是概率。传统的软件开发中，接口的输入和输出参数都是确定的，而在给定输入参数（即提示词）的情况下，GPT的回复却有一定随机性。当大家将ChatGPT作为聊天工具使用时，这种不精确可以是用户的谈资；当涉及到商业化软件应用时，设计时就需要特别注意降低不确定性，在大部分产品场景下，用户都很重视确定性。

2.短期记忆差

得益于自注意力机制，ChatGPT具备了多轮对话能力。然而，它的记忆长度相当有限，GPT-3.5模型仅支持向前追溯4096个tokens用于回复的参考。更糟糕的是，这4096个tokens还包括ChatGPT之前回复用户的部分！这使得其捉襟见肘的记忆更加难堪，堪称电子金鱼。好在GPT-4已经将上下文token上限扩展至3.2万个，一定程度上缓解了这个问题。

3.资源消耗多

ChatGPT的智能需要消耗大量算力，而运行大规模高端显卡需要消耗大量电力。在五年之内，依靠半导体制程的进一步升级和大模型的广泛应用，算力与电力的边际成本将逐渐转变为固定成本，也就解决了本问题。

4.响应速度慢

由于模型极大，ChatGPT 在回复时也无法做到瞬时响应，正如用户实际体验，ChatGPT是逐词回复的。企业在设计相关产品时需要特别关注应用场景：

①需要避免将 ChatGPT 用于高并发的场景，本服务依赖的接口调用并发上限非常低。

②产品设计上避免用户急切需要结果的应用场景，确保用户能够“等得起”。

5.行业认知浅

诚然，ChatGPT 拥有来自互联网和经典书籍的丰富知识。然而，真正的企业级专业知识往往源于特定领域的深入研究和实践，这些真知灼见无法仅凭互联网上的知识获取。因此，若希望ChatGPT 充当企业参谋，只能帮助梳理战略框架，但难以为企业提供颇具洞察的策略建议。

6.价值未对齐

①在自监督学习阶段，以 ChatGPT 为例训练数据英文占比高达92%。

②在监督学习阶段，以 ChatGPT 为例传授道德观的工程师主要来自英语世界。

③在强化学习环节，也可能受到恶意用户输入错误价值观的影响。

因此，目前主流 NLP 类产品（以 ChatGPT 为例）的“精神内核”是以西方价值观为基石的，这可能导致生成的文字难以符合我国的文化背景和价值观。

6. NLP 类 AI 产品的应用

详请百度吧。

7. 总结

总之是个足以创建时代的产品，简单点预测依靠电脑的重复劳动将会消失，因为大模型最擅长学这个了。所以 AI 时代真的已经到来。

Flutter基础（项目1结构）
123lib/├──api/#网络请求层├──common/#公共类、常量、工具函数├──models/#数据模型├──providers/#状态管理（Provider/Riverpod）├──routes/#⭐路由集中管理（核心）│└──app_routes.dart#路由配置入口├──views/#⭐页面文件（一个页面一个.dart）│├──home_page.dart│├──detail_p
接口自动化测试框架（pytest+allure+aiohttp+用例自动生成）
点击文末小卡片，免费获取软件测试全套资料，资料在手，涨薪更快近期准备优先做接口测试的覆盖，为此需要开发一个测试框架，经过思考，这次依然想做点儿不一样的东西。接口测试是比较讲究效率的，测试人员会希望很快能得到结果反馈，然而接口的数量一般都很多，而且会越来越多，所以提高执行效率很有必要接口测试的用例其实也可以用来兼做简单的压力测试，而压力测试需要并发接口测试的用例有很多重复的东西，测试人员应该只需要关
GO 语言学习之函数唯独不开心 golang 学习 go 开发语言
函数我们一直都在使用，但是还是有很多细节的内容需要深入了解一下，方便后续的编码实践。函数定义：func函数名([参数列表])[返回值]{函数体}funcadd(aint,bint)int{returna+b}基本概念：函数签名（FunctionSignature）：包含函数名、参数列表（参数的类型和顺序）以及返回值类型。在示例中add(aint,bint)int就是函数签名。它定义了函数的外部接口
AD20学习笔记——BOM表输出 Fz@ EDA学习学习笔记
BOM表输出脚本链接GitHub上-lianlian33/InteractiveHtmlBomForAD网盘链接链接：https://pan.baidu.com/s/1uGpwDyWKNgzghY5EH1Aj8A?pwd=72tx提取码：72tx1、下载文件并解压2、复制文件路径3、将脚本导入AD①点击设置中的ScriptingSystem中的GlobalProjects，选择从文件夹安装。②粘贴
SpringAI系列 - MCP篇（二） - MCP Server Boot Starter 罗小爬EX Spring AI SpringAI MCP
目录一、MCPJavaSDKMCPClientMCPServer二、SpringAIMcp集成三、SpringAIMCPBootStater四、spring-ai-starter-mcp-server-webmvc集成示例4.1集成Tools4.2集成Resources4.3集成Prompts4.4监听MCPClient端Roots变更通知五、通过SSE连接MCPServer六、通过STDIO连接
DeepSeek在性能测试中的应用：AI驱动的性能优化之旅程序员小雷性能优化功能测试测试工具单元测试测试用例 postman selenium
上次我们讨论了DeepSeek在自动化测试中的应用，今天我们继续深入探讨如何使用DeepSeek来进行性能测试。性能测试往往涉及大量数据分析和性能瓶颈诊断，这正是AI的强项。让我们看看如何借助DeepSeek的强大能力，让性能测试变得更智能、更高效。1.性能测试场景生成器首先，我们需要一个智能的性能测试场景生成器：classPerformanceScenarioGenerator:def__ini
对话式数据分析与Text2SQL Agent产品可行性分析思考
Text2SQLAgent产品可行性分析报告版本BG：基于一些手撸Text2SQL的产品MVP，进一步进行商业化思考。目标输出包含市场、技术、开发、商业模式及护城河策略的完整可行性分析报告，支撑产品决策。✅市场调研与竞品分析研究内容：市场现状与趋势全球Text2SQL技术应用场景（金融、零售、医疗等）2023-2028年复合增长率（CAGR）及驱动因素（如低代码、AI民主化）竞品分析矩阵竞品类型代
MCP 与 AI 任务分解：如何让 AI 高效执行复杂任务？ Echo_Wish Python 进阶人工智能
MCP与AI任务分解：如何让AI高效执行复杂任务？在人工智能应用中，任务分解（TaskDecomposition）是一个绕不开的话题。无论是自动驾驶、智能客服，还是代码生成，AI都需要将复杂问题拆解成可执行的小任务，逐步完成目标。而在AI领域，MCP（Multi-StepCognitiveProcessing，多步认知处理）是一种前沿技术，旨在提升AI的任务分解能力，使其能够更精准、高效地执行复杂
一键字幕翻译配音！这个免费神器让外语视频秒变母语版，AI翻译官已就位[特殊字符] 人工智能我来了人工智能 AI 音视频人工智能
一键字幕翻译配音！这个免费神器让外语视频秒变母语版，AI翻译官已就位字幕组连夜辞职！这年头谁还手动做字幕啊？最近挖到个叫pyVideoTrans的开源神器，直接把视频翻译玩成全自动流水线——语音识别、字幕翻译、AI配音、视频合成四步打包完成，连手都不用动一下！外语生肉党狂喜！管你是追剧还是学网课，把视频往里一丢，喝着奶茶的功夫就能收获带双语字幕+地道配音的熟肉成品。关键是免费！开源！离线也能用！程
Redis（十五）Bitmap、Hyperloglog、GEO案例、布隆过滤器 Lucky_Turtle Java redis 面试数据库
文章目录面试题常见统计类型聚合统计排序统计二值统计基数统计Hyperloglog专有名词UV（UniqueVisitor）独立访客PV（PageView）页面浏览量DAU（DailyActiveUser）日活跃用户量MAU（MonthlyActiveUser）需求原理亿级UV的Redis统计方案GEO面试题命令GEOADD获取某位置的经纬度GEOPOS返回坐标的Geohash表示GEOHASH两个
大模型——Obsidian加Cursor就是最强个人AI知识库不二人生大模型人工智能爬虫大模型 Obsidian cursor
大模型——Obsidian加Cursor就是最强个人AI知识库这几天因为看到了Obsidian的浏览器剪藏插件的强大（这个下节讲）所以开始玩Obsidian，想要搞一个符合自己要求的本地知识库再加上AI的加持。也装了几个Obsidian的AI插件，结果发现配置非常复杂，体验不太行，想要顺畅使用的话得看文档，甚至还有看文档都无法结局的恶性Bug，我得搜Github其他人的问题才能搞定。这些插件的作用
UR Studio仿真工具上线助力协作机器人快速部署与精准配置模拟欣佰特cnbestec 机器人优傲优傲机器人 UR Studio PolyScopeXAI 协作机器人
URStudio仿真工具是专为协作机器人自动化部署打造的一款集成化、在线式仿真平台。它基于PolyScopeXAI平台开发，提供从方案设计到仿真验证的一体化流程，帮助企业提升自动化项目的设计效率与实施成功率。工程师无需复杂操作即可快速上手，轻松应对多变的生产需求。无论是初学者还是资深用户，都能通过直观的界面完成仿真任务，实现智能制造的高效转型。URStudio仿真工具核心优势平台集成，提升协作效率
git配置(1): 根据remote自动选择账号执行commit ArthurBreeze git
git配置(1):根据remote自动选择账号执行commit在公司电脑上，克隆了github的仓库，也克隆了内网gitlab的仓库。希望commit和push到内网gitlab时，使用公司账号；commit和push到github时，使用个人账号。原本以为~/.gitconfig只能配置单个账户：[user]name=my_personal_nameemail=my_personal_email
AutoGPT，自主完成复杂任务小雷FansUnion AI2025 人工智能
AutoGPT是一个开源的AIAgent项目，它的核心目标是让AI能够自主完成复杂任务，而不仅仅是回答单个问题。简单来说，它让AI具备了"自主思考和行动"的能力。1.AutoGPT的核心概念什么是AIAgent？AIAgent（智能代理）是一种能够：自主规划：将大任务分解成小步骤自主决策：根据情况选择最佳行动自主执行：调用各种工具和API完成任务自主反思：评估结果并调整策略AutoGPT的独特之处
从阻塞到异步：Java NIO与AIO的高性能网络编程实战全解析小张在编程网络 java nio
引言在高并发网络时代，传统BIO的“一个连接一个线程”模式早已力不从心——当万级连接涌来时，服务器线程池瞬间告急，资源耗尽的警报此起彼伏。JavaNIO与AIO的出现，如同为网络编程装上了“多线程调度器”和“异步引擎”：NIO用非阻塞机制化解并发瓶颈，让单线程管理千个连接成为可能；AIO则更进一步，通过事件回调实现真正异步，让程序在I/O等待时不再“干瞪眼”。本文将从原理到实战，带您揭开这两大高级
baidusitemap.php,生成百度sitemap站点地图的php类墨墨张
简介：/**SiteMap接口类*/classSitemapActionextendsAction{privatestatic$baseURL='';//URL地址privatestatic$askMobileUrl='http://m.xxx.cn/ask/';//问答移动版地址privatestatic$askPcUrl="http://www.xxx.cn/ask/";//问答pc地址pri
【LangChain】langchain.chains.create_sql_query_chain() 函数：基于自然语言生成 SQL 查询的链（Chain）彬彬侠 LangChain langchain chains create_sql_quer sql_database sql
langchain.chains.create_sql_query_chain函数是LangChain库中的一个函数，用于创建基于自然语言生成SQL查询的链（Chain），结合语言模型（LLM）和数据库上下文生成可执行的SQL语句。本文基于LangChain0.3.x，详细介绍create_sql_query_chain的定义、参数、方法和典型场景，并提供一个独立示例，展示如何使用create_s
什么是零知识证明（Zero-Knowledge Proof, ZKP） MonkeyKing.sun 零知识证明区块链
零知识证明（Zero-KnowledgeProof,ZKP）是一种密码学技术，它允许你向对方证明你“知道一个秘密”，但又不泄露这个秘密的任何信息。它的最大特点是：✅证明有效性，❌不暴露内容。一、零知识证明是什么？（通俗理解）想象你是爱丽丝（Alice），你知道一个藏宝图的密码，你想向鲍勃（Bob）证明你确实知道这个密码，但又不想告诉他密码是什么。零知识证明就像魔法一样地完成这件事：你证明你知道答案
SmartSoftHelp NetCoreApi+MySQL/Oracle/SqlServer 部署Windows/Linux--深度优化版：SmartSoftHelp DeepCore XSuite SmartSoftHelp魔法精灵工作室优化安全科技 mysql oracle sqlserver
NetCoreAPI优势明显：SmartSofHelp菜单之Net9API智能微代码(SmartNetCoreAIDeep)NetCoreAPI与数据库组合在Linux/Windows部署的深度分析一、跨平台部署基础架构对比组合类型Linux部署方案Windows部署方案NetCoreAPI+MySQLDocker+MySQLDockerImageIIS+MySQLInstaller(MSI)Ne
AIDeepSeekLe - Typecho AI摘要生成插件独立开发者阿乐原创人工智能数据库 ai AI写作
文章目录生成文章标题的方法标题优化技巧功能特点安装方法配置说明使用方法手动生成摘要自动生成摘要摘要显示插件优势框架设计核心文件工作流程数据存储常见问题生成文章标题的方法理解文章的核心主题和关键信息，确保标题能准确概括内容。分析目标读者群体，根据受众的兴趣和需求调整标题风格。使用简洁有力的词语，避免冗长或复杂的表达，保持标题清晰易懂。考虑使用疑问句或数字列表等吸引眼球的句式，增加标题的吸引力。标题优
BaiduSitemap - Typecho站点地图生成与多搜索引擎推送插件独立开发者阿乐原创 javascript 云计算自动化大数据数据分析
文章目录BaiduSitemap-Typecho站点地图生成与多搜索引擎推送插件✨功能特点插件架构核心模块文件结构安装方法方法一：手动安装方法二：Git克隆⚙️配置说明站点地图基本设置搜索引擎配置百度搜索引擎必应（Bing）搜索引擎谷歌（Google）搜索引擎使用指南站点地图访问手动操作站点地图包含内容高级功能图片索引优化推送状态监控技术实现详解站点地图生成流程搜索引擎推送机制缓存机制❓常见问题站
Failed opening the RDB file dump.rdb ... for saving: No space left on device 潇凝子潇 bootstrap java 前端 redis
[op@test]$tail-f/project/logs/redis/redis.log1550:M24Jun202502:22:40.084*100changesin300seconds.Saving...1550:M24Jun202502:22:40.087*Backgroundsavingstartedbypid182388182388:C24Jun202502:22:40.088#Fai
Definition of a Stakeholder workflower 软件工程开发语言软件需求需求分析敏捷流程
利益相关者定义Theterm“stakeholder”hasalreadybeenusedwithoutgivingadefinition:Stakeholder:Anindividual,groupofpeople,organisationorotherentitythathasadirectorindirectinterest(orstake)inasystem.Astakeholder’si
【赵渝强老师】OceanBase数据库从零开始：Oracle模式
这里我们来介绍一下新上线的课程《OceanBase数据库从零开始：Oracle模式》，本门课程共11章，视频讲解如下：https://www.bilibili.com/video/BV1r4NCzHEka/?aid=114720556191...下面详细介绍一下每一章的主要内容：第01章-OceanBase的体系架构本章主要介绍OceanBase分布式数据库集群的体系架构，包括：OBServer节
git的author和commiter的修改 weixin_34161032 git 开发工具 python
2019独角兽企业重金招聘Python工程师标准>>>git的author和commiter的修改.git的文件夹，进去，就会看到有一个config文件,编辑,加上===========================================[user]#设置用户名name=xxx#设置用户的邮箱[email protected],=========================
AIGC领域Prompt工程：原理、方法与行业应用 AI天才研究院 ChatGPT 计算 AI大模型应用入门实战与进阶 AIGC prompt ai
AIGC领域Prompt工程：原理、方法与行业应用关键词：Prompt工程、大语言模型（LLM）、提示设计、少样本学习、AIGC应用、思维链（CoT）、提示优化摘要：随着AIGC（人工智能生成内容）技术的爆发式发展，大语言模型（如GPT-4、LLaMA、通义千问）的性能已达到前所未有的高度。然而，模型的强大能力能否被充分释放，很大程度上依赖于"提示（Prompt）"的设计质量。本文系统解析Prom
DevEco Studio3.1报错：预览器使用报错，显示Prepare previewer Reource faileD和Build task failed. Open the Run window Ailerx 鸿蒙 harmonyos 华为 web app
对于刚下载DevEcoStudio3.0的小伙伴，不知道有没有遇到这种情况：previewlog：显示：Buildtaskfailed.OpentheRunwindowtoviewdetails.网上搜了好久，终于找到解决办法了，具体解决方法是：打开设置，构建，执行，部署下面的Hvigor，然后，关掉最下面那个就好了：
Spring AI 中 MCP 架构与工具调用技术详解小W求学之旅 spring mcp spring ai agent
这篇文章主要是概述MCP是什么，SpringAI如何结合它。如果想要了解如何搭建spring工程并结合MCP开发，可以看我的另外一篇：SpringAI+MCP最详细实践：从配置开始到服务搭建（踩坑无数版）一、MCP架构概述MCP（MessageCommunicationProtocol）是SpringAI用于支持AI模型交互的消息通信协议，在客户端与服务端之间搭建桥梁，支持多种传输层协议，提供标准
Promptify：简化NLP任务的高效工具箱金斐茉
Promptify：简化NLP任务的高效工具箱PromptifyPromptEngineering|PromptVersioning|UseGPTorotherpromptbasedmodelstogetstructuredoutput.JoinourdiscordforPrompt-Engineering,LLMsandotherlatestresearch项目地址:https://gitcod
从指令设计到系统集成：提示词工具链与GPTs插件的效率革命 charles666666 人工智能自然语言处理语言模型知识图谱 transformer
一、提示词工程工具链：概念与架构解析1.1为什么需要工具链？大模型交互的本质是“指令设计”，但人工编写提示词存在三大痛点：效率低（重复调试耗时）、质量不稳定（依赖个人经验）、复用性差（场景迁移成本高）。例如，某电商企业要求AI生成500种商品描述时，人工逐条调整提示词需耗费数周，且风格难以统一。工具链的价值在于通过模块化设计与自动化流程解决上述问题。其核心架构包含三个层级：需求解析层：将用户需求拆
Java实现的基于模板的网页结构化信息精准抽取组件：HtmlExtractor yangshangchuan 信息抽取 HtmlExtractor 精准抽取信息采集
HtmlExtractor是一个Java实现的基于模板的网页结构化信息精准抽取组件，本身并不包含爬虫功能，但可被爬虫或其他程序调用以便更精准地对网页结构化信息进行抽取。 HtmlExtractor是为大规模分布式环境设计的，采用主从架构，主节点负责维护抽取规则，从节点向主节点请求抽取规则，当抽取规则发生变化，主节点主动通知从节点，从而能实现抽取规则变化之后的实时动态生效。如
java编程思想 -- 多态百合不是茶 java 多态详解
一: 向上转型和向下转型面向对象中的转型只会发生在有继承关系的子类和父类中（接口的实现也包括在这里）。父类：人子类：男人向上转型： Person p = new Man() ; //向上转型不需要强制类型转化向下转型： Man man =
[自动数据处理]稳扎稳打,逐步形成自有ADP系统体系 comsci dp
对于国内的IT行业来讲,虽然我们已经有了"两弹一星",在局部领域形成了自己独有的技术特征,并初步摆脱了国外的控制...但是前面的路还很长.... 首先是我们的自动数据处理系统还无法处理很多高级工程...中等规模的拓扑分析系统也没有完成,更加复杂的
storm 自定义日志文件商人shang storm cluster logback
Storm中的日志级级别默认为INFO，并且，日志文件是根据worker号来进行区分的，这样，同一个log文件中的信息不一定是一个业务的，这样就会有以下两个需求出现： 1. 想要进行一些调试信息的输出 2. 调试信息或者业务日志信息想要输出到一些固定的文件中不要怕，不要烦恼，其实Storm已经提供了这样的支持，可以通过自定义logback 下的 cluster.xml 来输
Extjs3 SpringMVC使用 @RequestBody 标签问题记录 21jhf
springMVC使用 @RequestBody(required = false) UserVO userInfo 传递json对象数据，往往会出现http 415，400,500等错误，总结一下需要使用ajax提交json数据才行，ajax提交使用proxy，参数为jsonData，不能为params；另外，需要设置Content-type属性为json，代码如下：（由于使用了父类aaa
一些排错方法文强chu 方法
1、java.lang.IllegalStateException: Class invariant violation at org.apache.log4j.LogManager.getLoggerRepository(LogManager.java:199)at org.apache.log4j.LogManager.getLogger(LogManager.java:228) at o
Swing中文件恢复我觉得很难小桔子 swing
我那个草了！老大怎么回事，怎么做项目评估的？只会说相信你可以做的，试一下，有的是时间！用java开发一个图文处理工具，类似word，任意位置插入、拖动、删除图片以及文本等。文本框、流程图等，数据保存数据库，其余可保存pdf格式。ok,姐姐千辛万苦，
php 文件操作 aichenglong PHP 读取文件写入文件
1 写入文件 @$fp=fopen("$DOCUMENT_ROOT/order.txt", "ab"); if(!$fp){ echo "open file error" ; exit; } $outputstring="date:"." \t tire:".$tire."
MySQL的btree索引和hash索引的区别 AILIKES 数据结构 mysql 算法
Hash 索引结构的特殊性，其检索效率非常高，索引的检索可以一次定位，不像B-Tree 索引需要从根节点到枝节点，最后才能访问到页节点这样多次的IO访问，所以 Hash 索引的查询效率要远高于 B-Tree 索引。可能很多人又有疑问了，既然 Hash 索引的效率要比 B-Tree 高很多，为什么大家不都用 Hash 索引而还要使用 B-Tree 索引呢
JAVA的抽象--- 接口 --实现百合不是茶
抽象接口实现接口 //抽象类 ,方法 //定义一个公共抽象的类 ,并在类中定义一个抽象的方法体抽象的定义使用abstract abstract class A 定义一个抽象类例如： //定义一个基类 public abstract class A{ //抽象类不能用来实例化，只能用来继承 //
JS变量作用域实例 bijian1013 作用域
<script> var scope='hello'; function a(){ console.log(scope); //undefined var scope='world'; console.log(scope); //world console.log(b);
TDD实践（二） bijian1013 java TDD
实践题目：分解质因数 Step1：单元测试： package com.bijian.study.factor.test; import java.util.Arrays; import junit.framework.Assert; import org.junit.Before; import org.junit.Test; import com.bijian.
[MongoDB学习笔记一]MongoDB主从复制 bit1129 mongodb
MongoDB称为分布式数据库，主要原因是1.基于副本集的数据备份， 2.基于切片的数据扩容。副本集解决数据的读写性能问题，切片解决了MongoDB的数据扩容问题。事实上，MongoDB提供了主从复制和副本复制两种备份方式，在MongoDB的主从复制和副本复制集群环境中，只有一台作为主服务器，另外一台或者多台服务器作为从服务器。本文介绍MongoDB的主从复制模式，需要指明
【HBase五】Java API操作HBase bit1129 hbase
import java.io.IOException; import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.hbase.HBaseConfiguration; import org.apache.hadoop.hbase.HColumnDescriptor; import org.apache.ha
python调用zabbix api接口实时展示数据 ronin47
zabbix api接口来进行展示。经过思考之后，计划获取如下内容： 1、获得认证密钥 2、获取zabbix所有的主机组 3、获取单个组下的所有主机 4、获取某个主机下的所有监控项
jsp取得绝对路径 byalias 绝对路径
在JavaWeb开发中，常使用绝对路径的方式来引入JavaScript和CSS文件，这样可以避免因为目录变动导致引入文件找不到的情况，常用的做法如下：一、使用${pageContext.request.contextPath} 　　代码” ${pageContext.request.contextPath}”的作用是取出部署的应用程序名，这样不管如何部署，所用路径都是正确的。
Java定时任务调度：用ExecutorService取代Timer bylijinnan java
《Java并发编程实战》一书提到的用ExecutorService取代Java Timer有几个理由，我认为其中最重要的理由是：如果TimerTask抛出未检查的异常，Timer将会产生无法预料的行为。Timer线程并不捕获异常，所以 TimerTask抛出的未检查的异常会终止timer线程。这种情况下，Timer也不会再重新恢复线程的执行了;它错误的认为整个Timer都被取消了。此时，已经被
SQL 优化原则 chicony sql
一、问题的提出　在应用系统开发初期，由于开发数据库数据比较少，对于查询SQL语句，复杂视图的的编写等体会不出SQL语句各种写法的性能优劣，但是如果将应用系统提交实际应用后，随着数据库中数据的增加，系统的响应速度就成为目前系统需要解决的最主要的问题之一。系统优化中一个很重要的方面就是SQL语句的优化。对于海量数据，劣质SQL语句和优质SQL语句之间的速度差别可以达到上百倍，可见对于一个系统
java 线程弹球小游戏 CrazyMizzz java 游戏
最近java学到线程，于是做了一个线程弹球的小游戏，不过还没完善这里是提纲 1.线程弹球游戏实现 1.实现界面需要使用哪些API类 JFrame JPanel JButton FlowLayout Graphics2D Thread Color ActionListener ActionEvent MouseListener Mouse
hadoop jps出现process information unavailable提示解决办法 daizj hadoop jps
hadoop jps出现process information unavailable提示解决办法 jps时出现如下信息： 3019 -- process information unavailable3053 -- process information unavailable2985 -- process information unavailable2917 --
PHP图片水印缩放类实现 dcj3sjt126com PHP
<?php class Image{ private $path; function __construct($path='./'){ $this->path=rtrim($path,'/').'/'; } //水印函数，参数：背景图，水印图，位置，前缀,TMD透明度 public function water($b,$l,$pos
IOS控件学习：UILabel常用属性与用法 dcj3sjt126com ios UILabel
参考网站： http://shijue.me/show_text/521c396a8ddf876566000007 http://www.tuicool.com/articles/zquENb http://blog.csdn.net/a451493485/article/details/9454695 http://wiki.eoe.cn/page/iOS_pptl_artile_281
完全手动建立maven骨架 eksliang java eclipse Web
建一个 JAVA 项目： mvn archetype:create -DgroupId=com.demo -DartifactId=App [-Dversion=0.0.1-SNAPSHOT] [-Dpackaging=jar] 建一个 web 项目： mvn archetype:create -DgroupId=com.demo -DartifactId=web-a
配置清单 gengzg 配置
1、修改grub启动的内核版本 vi /boot/grub/grub.conf 将default 0改为1 拷贝mt7601Usta.ko到/lib文件夹拷贝RT2870STA.dat到 /etc/Wireless/RT2870STA/文件夹拷贝wifiscan到bin文件夹，chmod 775 /bin/wifiscan 拷贝wifiget.sh到bin文件夹，chm
Windows端口被占用处理方法 huqiji windows
以下文章主要以80端口号为例，如果想知道其他的端口号也可以使用该方法..........................1、在windows下如何查看80端口占用情况?是被哪个进程占用?如何终止等. 这里主要是用到windows下的DOS工具,点击"开始"--"运行",输入&
开源ckplayer 网页播放器，跨平台(html5, mobile)，flv, f4v, mp4, rtmp协议. webm, ogg, m3u8 ！天梯梦 mobile
CKplayer，其全称为超酷flv播放器，它是一款用于网页上播放视频的软件，支持的格式有：http协议上的flv,f4v,mp4格式，同时支持rtmp视频流格式播放，此播放器的特点在于用户可以自己定义播放器的风格，诸如播放/暂停按钮，静音按钮，全屏按钮都是以外部图片接口形式调用，用户根据自己的需要制作出播放器风格所需要使用的各个按钮图片然后替换掉原始风格里相应的图片就可以制作出自己的风格了，
简单工厂设计模式 hm4123660 java 工厂设计模式简单工厂模式
简单工厂模式（Simple Factory Pattern）属于类的创新型模式，又叫静态工厂方法模式。是通过专门定义一个类来负责创建其他类的实例，被创建的实例通常都具有共同的父类。简单工厂模式是由一个工厂对象决定创建出哪一种产品类的实例。简单工厂模式是工厂模式家族中最简单实用的模式，可以理解为是不同工厂模式的一个特殊实现。
maven笔记 zhb8015 maven
跳过测试阶段： mvn package -DskipTests 临时性跳过测试代码的编译： mvn package -Dmaven.test.skip=true maven.test.skip同时控制maven-compiler-plugin和maven-surefire-plugin两个插件的行为，即跳过编译，又跳过测试。指定测试类 mvn test
非mapreduce生成Hfile，然后导入hbase当中 Stark_Summer map hbase reduce Hfile path实例
最近一个群友的boss让研究hbase，让hbase的入库速度达到5w+/s，这可愁死了，4台个人电脑组成的集群，多线程入库调了好久，速度也才1w左右，都没有达到理想的那种速度，然后就想到了这种方式，但是网上多是用mapreduce来实现入库，而现在的需求是实时入库，不生成文件了，所以就只能自己用代码实现了，但是网上查了很多资料都没有查到，最后在一个网友的指引下，看了源码，最后找到了生成Hfile
jsp web tomcat 编码问题王新春 tomcat jsp pageEncode
今天配置jsp项目在tomcat上，windows上正常，而linux上显示乱码，最后定位原因为tomcat 的server.xml 文件的配置，添加 URIEncoding 属性： <Connector port="8080" protocol="HTTP/1.1" connectionTi