Yurakucho

【学习笔记】transformer是什么？专给非计算机专业看的超直观解读

写在前面：作者本是个计算机小白，因为最近对chatGPT产生了兴趣，开始尝试了解背后的算法，因此有了这篇文章。因为作者是计算机小白（只在学过一点C语言，交完大作业就忘了个干净），所以写出来文章应该没啥门槛，希望可以帮助和我一样不懂计算机但感兴趣的朋友了解什么是transformer模型，即chatGPT中的"T"。

本文主要以我和chatGPT一问一答的形式进行（这部分完全没有门槛，中学数学就可以理解）。因为GPT有胡说八道之嫌，所以我很少直接让GPT介绍某个概念，而是我先看别人的文章形成对某概念的理解，再向GPT确认理解是否准确。当然，这也无法排除GPT仍然胡说八道，因此，如果有错误，还请各位大佬不吝赐教。注意本文是解释这个模型是什么，不涉及具体的实操过程，因此有些地方可能和实际情况有些出入。

transformer的整体架构如下，可以分为四个部分：输入，Encoder，Decoder，输出。我先只把它当一个目录，一步步解释每个框的含义是什么，最后再串起来解释整个架构。

输入和输出

1.1 输入（Inputs & Embedding）

拆开transformer这个黑盒子之前，我们先看它的输入和输出是什么。transformer的输入是一个形状为(batch_size, sequence_length, embedding_dim) 的张量。其中 batch_size 表示批次大小（有几句话），sequence_length 表示序列长度（一句话有多少个词）（实际上我们是需要用零填充同意长度的，详见3.1节），embedding_dim 表示词向量的维度（一个词用几维向量表示）（是一个超参数，也写作d_model，实际模型中一般为512）。

下面涉及第一个概念：词向量。简单地说，电脑无法直接理解我们的语言，词向量就是把单词翻译成了它能听得懂的语言。很容易想到，我们可以用单词在字典中出现的顺序进行编码。例如字典中只有”我“，”吃“，”苹果“三个单词，那么”我吃苹果“就可以编码为”123“。但从数学上看，1和2之间的欧式距离是1，1和3之间的欧氏距离是2；而从语义上看，“我”和“吃”之间语义的差异并不比“我”和“苹果”之间更小。因此，这种编码方式不利于理解。那么如何根据语义编码呢？可以这样操作：首先，字典序只是一个数字，其能储存的信息有限，因此可以先通过“独热编码”（one-hot encoding）对单词进行升维；然后再通过机器学习，将独热编码转化为它所"理解"的语义信息。看下面的对话。

我：请把”我吃苹果“转化为独热编码。

GPT：独热编码是一种将离散特征转换为向量的方法，每个特征对应一个唯一的向量，其中只有一个元素为 1，其他元素都为 0。以“我吃苹果”为例，如果我们将这个句子中的单词进行独热编码，可以得到如下的结果：

- 我：[1, 0, 0,]

- 吃：[0, 1, 0 ]

- 苹果：[0, 0, 1]

这种编码方式可以保留单词的语义信息，同时便于计算和处理。在 Transformer 模型中，输入的单词通常会被转换为对应的词向量，而不是独热编码。

我：关于词向量，我可否这么理解，它其实就是根据语义对单词进行分门别类，每个维度表示特定特征——当然，这些特征每次训练可能都不一样，是一种抽象的特征，未必具有人类能理解的含义。

GPT：您的理解是正确的。词向量是一种用来表示单词的向量，每个维度表示的是抽象的特征，这些特征是通过机器学习算法从大规模文本数据中学习得到的，通常不具有人类能理解的含义。这些特征的选择和权重是根据语义和上下文来确定的，因此词向量可以捕捉单词之间的语义关系，如近义词和反义词之间的相似性和差异性。

我：我可否理解成电脑计算词向量类似于人在进行分类任务，比如假设词向量是五维的，我可以把第一个维度表示词性（是名词还是形容词等），第二个维度表示(如果是名词)名词是动物还是植物；第三个维度表示是脊椎动物还是无脊椎动物，第四个维度表示颜色等等。如此，可以将五个单词，”马“，”狗“，”蜗牛“，”“苹果”，“红色”，分类成：马[1,1,1,1]，狗[1,1,1,0]，蜗牛[1,1,0,0]，苹果[1,0,0,1]，红色[0,0,0,1]。

GPT：可以说是类似的思路。词向量是将单词映射到一个高维向量空间中，而这些维度可以表示单词的不同语义或属性。例如，一个表示动物的维度可以使得“马”和“狗”的词向量在该维度上更加接近，而表示颜色的维度可以使得“红色”和“橙色”的词向量在该维度上更加接近。在训练过程中，模型会自动学习到哪些维度对于正确的预测输出更加重要。

（拓展：那么“通过机器学习，让电脑将位置信息转化为它所能理解的语义信息”是如何实现的？

GPT：word2vec是一种用于将单词映射到向量空间的高效算法，它可以在大规模语料库上进行训练，从而得到高质量的词向量。word2vec算法的核心思想是利用单词在上下文中的共现关系来学习单词的向量表示。具体来说，word2vec算法有两个模型：CBOW模型和Skip-gram模型。CBOW模型的目标是根据上下文中的单词预测当前单词，而Skip-gram模型的目标则是根据当前单词预测上下文中的单词。这两个模型都是基于神经网络的，通过学习神经网络的参数来得到单词的向量表示。）

—————

1.2 位置编码（Positional Embedding）

Positional Embedding就是根据单词所在的位置产生一个与词向量维数相同的位置向量，并将该向量与词向量相加，从而把位置信息补充到原始的词向量中。

(不想看具体怎么计算的可以跳过这一段)假如某单词在句子中的位置为pos，则该单词词向量的第2i/2i+1个维度的PE值为：

（有一个疑问，PE是储存位置信息的，词向量（WE）是储存语义信息的，直接把它俩的元素相加不就分不出来源了吗？我简要查了一下，大概的解释可能是：词向量的维度足够丰富，而PE的信息主要储存在靠前的一小部分维度，因此即便相加也不会引起混淆）

1.3 输出 (output probabilities)

transformer的输出为output probabilities，即输出的token是各个词的概率分别是多少。具体而言：

我：output probabilities是几维的？

GPT：这个概率分布的维度通常等于词汇表的大小，即输出序列中可能出现的单词数。例如，如果词汇表中有10,000个单词，则输出概率分布的维度为10,000。每个维度上的值表示该单词在该位置上的概率。

我：也就是说，transformer输入和输出单词不是同一个形式，单词是以词向量的形式输入的，但却是以概率分布的形式输出的？

GPT：是的，Transformer模型的输入是经过词嵌入（word embedding）处理后的词向量序列，而输出则是每个位置上单词的概率分布。在训练过程中，我们希望模型能够根据输入序列预测出正确的输出序列，因此在输出端需要将每个位置上的词汇表中的所有单词都考虑到，并计算出对应的概率分布。在训练过程中，我们会根据预测输出与真实输出之间的差异来更新模型参数，以便模型能够更好地预测正确的输出序列。在推理阶段，我们则可以根据模型输出的概率分布来选择最有可能的单词作为模型的预测输出。

————

2. Encoder

2.1 多头注意力(Multihead Attention)

将输入的语句转化为词向量并加入位置信息后，下一步就是计算注意力了。啥是注意力？有点类似于普通神经网络中的“权重”，即对于某个输入单词，我们应该给予其多大的关注。

(不关心具体计算方法的可以跳过这一段)multi-head attention具体的计算方式不难，attention is all you need的原文写的很清楚了。简单说下，假设只有一个序列，那么本层的输入是一个加入位置信息的词向量序列，形状为(seq_len, d_model) ，其先被线性变换为同形状的Q,K,V（具体怎么变换通过学习得到）；然后将QKV依次与每个注意力头的W_Q，W_K和W_V相乘并进行注意力计算，产生h个形状为(seq_len, d_v)的序列，将这些序列拼在一起，然后与一个形状为(h*d_v,d_model)的矩阵W_O相乘，得到一个形状为(seq_len, d_model)（即与input形状相同）的输出。W_Q，W_K，W_V和W_O也都通过学习得到。（想详细了解推荐这篇文章：超详细图解Self-Attention - 知乎 (zhihu.com)，稍微有一点数学内容，但写的也非常直观。）

这里我们主要关注的不是计算方式，而是”注意力“和”多头“具体起到什么作用，看下面的对话：

我：关于语言模型的”注意力“机制，我是否可以这样理解：注意力集中在哪个词，就主要依据哪个单词判断接下来要输出的内容？例如，对”爱因斯坦是科学家，贝多芬是__“这句话，如果注意力全部集中在”爱因斯坦“上，则__的位置更可能被填入”科学家“，如果注意力集中在”贝多芬“上，则__更可能被填入”音乐家“？

GPT：您的理解是正确的。在语言模型中，注意力机制可以帮助模型在生成下一个单词时，更加关注输入序列中与当前单词相关的部分，以提高模型的生成准确性。在您的例子中，如果注意力机制集中在“爱因斯坦”上，模型会更有可能生成与“科学家”相关的单词，而如果注意力机制集中在“贝多芬”上，模型则更有可能生成与“音乐家”相关的单词。

我：但如果只把注意力集中在”贝多芬“一个词上，则输出”男人“似乎也对，但整体看这显然不是最合理的答案。因此要选取合理的注意力分配方式？

GPT：您的理解是正确的。在实际应用中，注意力机制并不是单纯地只关注当前单词，而是会综合考虑前文、当前单词等多个因素，以分配合理的注意力权重。在您的例子中，如果只关注“贝多芬”一个词，输出“男人”似乎也是合理的，但如果综合考虑前文，就可以发现应该类比前文的“爱因斯坦是科学家”，因此更合理的答案应该是“音乐家”或者“作曲家”。因此，选择合理的注意力分配方式对于语言模型的生成结果至关重要。

我：何为”多头注意力“机制？

GPT：多头注意力机制可以进一步提高模型对于输入序列和上下文信息的建模能力。它通过将输入序列分成多个子序列，然后对每个子序列进行单独的注意力计算，最后将所有子序列的注意力结果合并起来，从而得到更加全面、准确的注意力表示。举个例子，如果将注意力头数设置为8，那么就会得到8组不同的查询、键和值的线性变换结果。对于每组结果，都会计算一个注意力权重向量，然后将这8个注意力权重向量拼接在一起，再进行一次线性变换得到最终的输出向量。因此，“多头”指的是在注意力机制中使用了多组查询、键和值的线性变换结果，从而增强了模型的表达能力。通过使用多头注意力，模型可以同时关注不同的语义信息，从而更好地捕捉输入序列的语义信息，提高模型的性能。

我：如此说来，注意力头，有点类似于CNN中的卷积核？

GPT：在某种程度上，可以将多头注意力中的注意力头类比为CNN中的卷积核。不同之处在于，卷积核在卷积操作中是对输入数据进行局部的线性变换，而注意力头则是对输入数据进行全局的权重计算。在多头注意力中，每个注意力头都是由不同的查询、键和值组合计算得到的，可以自适应地计算不同位置之间的权重，从而实现对输入数据的全局关注。因此，虽然注意力头和卷积核在实现细节上有所不同，但都是用来提高模型表达能力的重要组件。

——————

接下来的两层更像是构建深度网络的技巧，对理解transformer本身的帮助不大，不关心具体计算方法的可以跳过，只需要知道它们都不改变输入的形状就好。

2.2 加和并归一化（Add & LayerNorm）

上面已经说过，Multi-Head Attetion层的输入和输出是同形状的，因此可以直接相加。这一层就其实是把MHA层的输入和输出相加（残差连接），并进行归一化。这一步不改变输入的形状。不了解残差连接的朋友可以看下面的对话：

我：简单地说，残差连接就是跨层连接，目的是让梯度更加平滑，对吗？

GPT：您的理解基本正确。残差连接是一种跨层连接技术，其目的是解决深层神经网络中的梯度消失和梯度爆炸问题，从而使得网络更容易训练和优化。具体来说，残差连接的基本思想是在网络中添加跨层连接，这样可以使得网络更容易学习到残差函数，从而更好地优化网络。在训练过程中，梯度可以通过跨层连接反向传播到前面的层，从而避免了梯度消失和梯度爆炸问题，使得梯度更加平滑。除了平滑梯度之外，残差连接还有其他一些好处。例如，它可以加速模型的训练，提高模型的准确性和泛化能力，以及减少模型的参数量等。

——————

2.3 前馈传播(Feed Forward)

（不关注具体实现方法可直接跳过）这部分是先用一个全连接处理上一层的输出，然后进行ReLU激活，再跟第二个全连接层。这样可以提升模型拟合能力，同样引入了残差连接机制。这一步不改变输入的形状，没什么好说的。

至此，整个Endocder的组成解释完毕。实际模型中是6个Encoder串联的，即第一张图中的N=6。

3. Decoder

Decoder所要进行的计算和Encoder大部分都一样，依然是多头注意力、相加并归一、前馈、残差传播等，因此这里主要讨论几个关键区别。（ps：实际模型中decoder也是有6个串联的）

3.1 将已有输出作为输入

和RNN类似，Decoder的输入包括两部分，第一部分是Encoder的输出（输入1），第二部分输入（以下简称输入2）是整个模型上一步的输出，也就是下图中的内容。

需要注意的是，这一部分输入内容在训练时和预测时是不一样的。看下面的对话：

我：关于decoder，如果输入transformer的原句是“你爱吃啥”，那么训练时，输入2处会直接输入答案“我爱吃鱼和肉”(但需要掩盖，下一节细说)。而预测时，最开始输入2=“ ”，然后模型预测“我”(t=0)；然后输入2=“我”，模型预测“我爱”(t=1)；输入2=“我爱”，模型预测“我爱吃”(t=2)...。显然，这个序列长度一直在变，那怎么避免形状不一致的问题？答案是短补长截。如果输入2过短，则通过补零(zero-pad masking)使得其与原句长度相同（同理，encoder是输入其实也是需要零填充的，不然稍微长一点的句子都无法处理）。即，模型输出的“我”，放到输入2时会变成“我_ _ _“。而如果模型已经预测了”我爱吃鱼和“，则此时这个预测的seq_len = 5，而原句的seq_len = 4，于是此时模型会从预测结果的第二位开始截取，即输入2是”爱吃鱼和“。是这样吗？

GPT：是的，您的理解基本正确。在训练时，输入2会被直接输入答案，并进行掩盖，防止模型在预测时使用到未来的信息。在预测时，输入2会根据模型的预测结果不断变长，如果长度不足，则通过补零的方式进行填充，如果长度过长，则进行截取。这样可以避免形状不一致的问题，使得模型能够正确地处理变长的输入2。

我：所以，论文中shifted right是否可以理解为，当我们把当前输入作为下一步的输入时，每进行一步，长度固定的“输入框”就向右移动一位？

GPT：是的，你可以将shifted right理解为将目标序列向右移动一位，这样解码器在每个时间步都能够看到前一个时间步生成的单词，以便更好地预测下一个单词。你的理解也是正确的，可以将shifted right看作是将"输入框"向右移动一位，以便将前一个时间步生成的单词作为当前时间步的输入。

——————

3.2 遮盖的多头注意力（Masked Multi-Head Attention）

与上文的补零(zero-pad masking)相区别，这里说的mask（sequence mask）只有在训练的时候才需要进行，这是为了避免decoder在训练时直接看到后面的信息。上一小节我们说，如果输入transformer的原句是“你爱吃啥”，那么训练时，输入2直接输入答案“我爱吃鱼和肉“。但如果不进行任何处理，模型就会直接把这个结果输出出去，显然，这样就起不到训练的效果了。因此，我们需要把当前时间步之后的内容全部隐藏起来。

3.3 线性层和Softmax层

最后，加入一个单层的全连接神经网络，其输入形状仍然为(batch_size, seq_leng, hidden_size)（注意我们上面提到的注意力、add&norm，feed forward等层都没有改变输入的形状，因此到这里还是这个形状），输出是一个维度为dim_V的向量，”一个“的含义是模型每步只下一个最可能的词是什么，"dim_V"也记作vocab_size，就是词库的大小。经过softmax函数转化，这个向量的每个分量就是用词库中对应单词作为回复的概率（参见1.3节）。至此，大功告成！

总结，我觉得理解transformer的关键，其一在于弄清楚"注意力"到底起到什么作用。这是transformer的核心的，理解了它才能知道transformer回复的内容到底是根据什么生成的。其二是弄清楚在训练和预测的时候，decoder的输入2是不同的，我一开始疑惑了好久，decoder刚回复第一个词的时候，后面不都是零填充的空白吗？为什么要mask起来。

推荐另一篇也很直白的解读文章：(30条消息) 史上最小白之Transformer详解_Stink1995的博客-CSDN博客

情绪觉察日记第37天露露_e800
今天是家庭关系规划师的第二阶最后一天，慧萍老师帮我做了个案，帮我处理了埋在心底好多年的一份恐惧，并给了我深深的力量！这几天出来学习，爸妈过来婆家帮我带小孩，妈妈出于爱帮我收拾东西，并跟我先生和婆婆产生矛盾，妈妈觉得他们没有照顾好我…。今晚回家见到妈妈，我很欣赏她并赞扬她，妈妈说今晚要跟我睡我说好，当我们俩躺在床上准备睡觉的时候，我握着妈妈的手对她说:妈妈这几天辛苦你了，你看你多利害把我们的家收拾得
机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
铭刻于星（四十二）随风至
69夜晚，绍敏同学做完功课后，看了眼房外，没听到动静才敢从书包的夹层里拿出那个心形纸团。折痕压得很深，都有些旧了，想来是已经写好很久了。绍敏同学慢慢地、轻轻地捏开折叠处，待到全部拆开后，又反复抚平纸张，然后仔细地一字字默看。只是开头的三个字是第一次看到，让她心漏跳了几拍。“亲爱的绍敏：从四年级的时候，我就喜欢你了，但是我一直不敢说，怕影响你学习。六年级的时候听说有人跟你表白，你接受了，我很难过，但
UI学习——cell的复用和自定义cell Magnetic_h ui 学习
目录cell的复用手动（非注册）自动（注册）自定义cellcell的复用在iOS开发中，单元格复用是一种提高表格（UITableView）和集合视图（UICollectionView）滚动性能的技术。当一个UITableViewCell或UICollectionViewCell首次需要显示时，如果没有可复用的单元格，则视图会创建一个新的单元格。一旦这个单元格滚动出屏幕，它就不会被销毁。相反，它被添
10月|愿你的青春不负梦想-读书笔记-01 Tracy的小书斋
本书的作者是俞敏洪，大家都很熟悉他了吧。俞敏洪老师是我行业的领头羊吧，也是我事业上的偶像。本日摘录他书中第一章中的金句：『一个人如果什么目标都没有，就会浑浑噩噩，感觉生命中缺少能量。能给我们能量的，是对未来的期待。第一件事，我始终为了进步而努力。与其追寻全世界的骏马，不如种植丰美的草原，到时骏马自然会来。第二件事，我始终有阶段性的目标。什么东西能给我能量？答案是对未来的期待。』读到这里的时候，我便
学点心理知识，呵护孩子健康静候花开_7090
昨天听了华中师范大学教育管理学系副教授张玲老师的《哪里才是学生心理健康的最后庇护所，超越教育与技术的思考》的讲座。今天又重新学习了一遍，收获匪浅。张玲博士也注意到了当今社会上的孩子由于心理问题导致的自残、自杀及伤害他人等恶性事件。她向我们普及了一个重要的命题，她说心理健康的一些基本命题，我们与我们通常的一些教育命题是不同的，她还举了几个例子，让我们明白我们原来以为的健康并非心理学上的健康。比如如果
《投行人生》读书笔记小蘑菇的树洞
《投行人生》----作者詹姆斯-A-朗德摩根斯坦利副主席40年的职业洞见-很短小精悍的篇幅，比较适合初入职场的新人。第一部分成功的职业生涯需要规划1.情商归为适应能力分享与协作同理心适应能力，更多的是自我意识，你有能力识别自己的情并分辨这些情绪如何影响你的思想和行为。2.对于初入职场的人的建议，细节，截止日期和数据很重要截止日期，一种有效的方法是请老板为你所有的任务进行优先级排序。和老板喝咖啡的好
ArcGIS栅格计算器常见公式（赋值、0和空值的转换、补充栅格空值）研学随笔 arcgis 经验分享
我们在使用ArcGIS时通常经常用到栅格计算器，今天主要给大家介绍我日常中经常用到的几个公式，供大家参考学习。将特定值（-9999）赋值为0，例如-9999.Con("raster"==-9999,0,"raster")2.给空值赋予特定的值（如0）Con(IsNull("raster"),0,"raster")3.将特定的栅格值(如1)赋值为空值，其他保留原值SetNull("raster"==
【一起学Rust | 设计模式】习惯语法——使用借用类型作为参数、格式化拼接字符串、构造函数广龙宇一起学Rust #Rust设计模式 rust 设计模式开发语言
提示：文章写完后，目录可以自动生成，如何生成可参考右边的帮助文档文章目录前言一、使用借用类型作为参数二、格式化拼接字符串三、使用构造函数总结前言Rust不是传统的面向对象编程语言，它的所有特性，使其独一无二。因此，学习特定于Rust的设计模式是必要的。本系列文章为作者学习《Rust设计模式》的学习笔记以及自己的见解。因此，本系列文章的结构也与此书的结构相同（后续可能会调成结构），基本上分为三个部分
回溯 Leetcode 332 重新安排行程 mmaerd Leetcode刷题学习记录 leetcode 算法职场和发展
重新安排行程Leetcode332学习记录自代码随想录给你一份航线列表tickets，其中tickets[i]=[fromi,toi]表示飞机出发和降落的机场地点。请你对该行程进行重新规划排序。所有这些机票都属于一个从JFK（肯尼迪国际机场）出发的先生，所以该行程必须从JFK开始。如果存在多种有效的行程，请你按字典排序返回最小的行程组合。例如，行程[“JFK”,“LGA”]与[“JFK”,“LGB
Python数据分析与可视化实战指南 William数据分析 python python 数据
在数据驱动的时代，Python因其简洁的语法、强大的库生态系统以及活跃的社区，成为了数据分析与可视化的首选语言。本文将通过一个详细的案例，带领大家学习如何使用Python进行数据分析，并通过可视化来直观呈现分析结果。一、环境准备1.1安装必要库在开始数据分析和可视化之前，我们需要安装一些常用的库。主要包括pandas、numpy、matplotlib和seaborn等。这些库分别用于数据处理、数学
git常用命令笔记咩酱-小羊 git 笔记
###用习惯了idea总是不记得git的一些常见命令，需要用到的时候总是担心旁边站了人~~~记个笔记@_@，告诉自己看笔记不丢人初始化初始化一个新的Git仓库gitinit配置配置用户信息gitconfig--globaluser.name"YourName"gitconfig--globaluser.email"[email protected]"基本操作克隆远程仓库gitclone查看
2019-12-22-22:30 涓涓1016
今天是冬至，写下我的日更，是因为这两天的学习真的是能量的满满，让我看到了自己，未来另外一种可能性，也让我看到了这两年这几年的过程中我所接受那些痛苦的来源。一切的根源和痛苦都来自于人生，家庭，而你的原生家庭，你的爸爸和妈妈，是因为你这个灵魂在那一刻选择他们作为你的爸爸和妈妈来的，所以你得接受他，你得接纳他，他就是因为他的存在而给你的学习和成长带来这些痛苦，那其实是你必然要经历的这个过程，当你去接纳的
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
509. 斐波那契数(每日一题) lzyprime
lzyprime博客(github)创建时间：2021.01.04qq及邮箱：2383518170leetcode笔记题目描述斐波那契数，通常用F(n)表示，形成的序列称为斐波那契数列。该数列由0和1开始，后面的每一项数字都是前面两项数字的和。也就是：F(0)=0，F(1)=1F(n)=F(n-1)+F(n-2)，其中n>1给你n，请计算F(n)。示例1：输入：2输出：1解释：F(2)=F(1)+
拥有断舍离的心态，过精简生活--《断舍离》读书笔记爱吃丸子的小樱桃
不知不觉间房间里的东西越来越多，虽然摆放整齐，但也时常会觉得空间逼仄，令人心生烦闷。抱着断舍离的态度，我开始阅读《断舍离》这本书，希望从书中能找到一些有效的方法，帮助我实现空间、物品上的断舍离。《断舍离》是日本作家山下英子通过自己的经历、思考和实践总结而成的，整体内涵也从刚开始的私人生活哲学的“断舍离”升华成了“人生实践哲学”，接着又成为每个人都能实行的“改变人生的断舍离”，从“哲学”逐渐升华成“
四章-32-点要素的聚合彩云飘过
本文基于腾讯课堂老胡的课《跟我学Openlayers--基础实例详解》做的学习笔记，使用的openlayers5.3.xapi。源码见1032.html，对应的官网示例https://openlayers.org/en/latest/examples/cluster.htmlhttps://openlayers.org/en/latest/examples/earthquake-clusters.
高端密码学院笔记285 柚子_b4b4
高端幸福密码学院（高级班）幸福使者：李华第（598）期《幸福》之回归内在深层生命原动力基础篇——揭秘“激励”成长的喜悦心理案例分析主讲：刘莉一，知识扩充:成功=艰苦劳动+正确方法+少说空话。贪图省力的船夫，目标永远下游。智者的梦再美，也不如愚人实干的脚印。幸福早课堂2020.10.16星期五一笔记:1，重视和珍惜的前提是知道它的价值非常重要，当你珍惜了，你就真正定下来，真正的学到身上。2，大家需要
GitHub上克隆项目 bigbig猩猩 github
从GitHub上克隆项目是一个简单且直接的过程，它允许你将远程仓库中的项目复制到你的本地计算机上，以便进行进一步的开发、测试或学习。以下是一个详细的步骤指南，帮助你从GitHub上克隆项目。一、准备工作1.安装Git在克隆GitHub项目之前，你需要在你的计算机上安装Git工具。Git是一个开源的分布式版本控制系统，用于跟踪和管理代码变更。你可以从Git的官方网站（https://git-scm.
HTML网页设计制作大作业（div+css）云南我的家乡旅游景点带文字滚动二挡起步 web前端期末大作业 web设计网页规划与设计 html css javascript dreamweaver 前端
Web前端开发技术描述网页设计题材，DIV+CSS布局制作,HTML+CSS网页设计期末课程大作业游景点介绍|旅游风景区|家乡介绍|等网站的设计与制作HTML期末大学生网页设计作业HTML：结构CSS：样式在操作方面上运用了html5和css3，采用了div+css结构、表单、超链接、浮动、绝对定位、相对定位、字体样式、引用视频等基础知识JavaScript：做与用户的交互行为文章目录前端学习路线
Day17笔记-高阶函数 ~在杰难逃~ Python 笔记 python 开发语言 pycharm 数据分析
高阶函数【重点掌握】函数的本质：函数是一个变量，函数名是一个变量名，一个函数可以作为另一个函数的参数或返回值使用如果A函数作为B函数的参数，B函数调用完成之后，会得到一个结果，则B函数被称为高阶函数常用的高阶函数：map(),reduce(),filter(),sorted()1.map()map(func,iterable)，返回值是一个iterator【容器，迭代器】func:函数iterab
Day1笔记-Python简介&标识符和关键字&输入输出 ~在杰难逃~ Python python 开发语言大数据数据分析数据挖掘
大家好，从今天开始呢，杰哥开展一个新的专栏，当然，数据分析部分也会不定时更新的，这个新的专栏主要是讲解一些Python的基础语法和知识，帮助0基础的小伙伴入门和学习Python，感兴趣的小伙伴可以开始认真学习啦！一、Python简介【了解】1.计算机工作原理编程语言就是用来定义计算机程序的形式语言。我们通过编程语言来编写程序代码，再通过语言处理程序执行向计算机发送指令，让计算机完成对应的工作，编程
人工智能时代，程序员如何保持核心竞争力？ jmoych 人工智能
随着AIGC（如chatgpt、midjourney、claude等）大语言模型接二连三的涌现，AI辅助编程工具日益普及，程序员的工作方式正在发生深刻变革。有人担心AI可能取代部分编程工作，也有人认为AI是提高效率的得力助手。面对这一趋势,程序员应该如何应对?是专注于某个领域深耕细作，还是广泛学习以适应快速变化的技术环境?又或者，我们是否应该将重点转向AI无法轻易替代的软技能？让我们一起探讨程序员
node.js学习小猿L node.js node.js 学习 vim
node.js学习实操及笔记温故node.js，node.js学习实操过程及笔记~node.js学习视频node.js官网node.js中文网实操笔记githubcsdn笔记为什么学node.js可以让别人访问我们编写的网页为后续的框架学习打下基础，三大框架vuereactangular离不开node.jsnode.js是什么官网：node.js是一个开源的、跨平台的运行JavaScript的运行
阶段总结反思轻争
马上就要进入10月份了，今天做一下前段时间的总结和反思。前段时间，日更、英语、健身、护肤坚持的比较好。阅读、书法坚持的不好。1.中间被迫停更半个多月，其余时间一直在坚持日更挑战。偶尔也有不想写的时候，就做一下摘抄。因为阅读（输入）没跟上来，所以写作（输出）质量有待进一步加强。2.英语做到了一周至少学习5天，每次不少于30分钟，但是小班课没有跟上更新速度，下一步要争取利用零碎时间补听小班课。3.减肥
数据仓库——维度表一致性墨染丶eye 背诵数据仓库
数据仓库基础笔记思维导图已经整理完毕，完整连接为：数据仓库基础知识笔记思维导图维度一致性问题从逻辑层面来看，当一系列星型模型共享一组公共维度时，所涉及的维度称为一致性维度。当维度表存在不一致时，短期的成功难以弥补长期的错误。维度时确保不同过程中信息集成起来实现横向钻取货活动的关键。造成横向钻取失败的原因维度结构的差别，因为维度的差别，分析工作涉及的领域从简单到复杂，但是都是通过复杂的报表来弥补设计
ARM驱动学习之基础小知识 JT灬新一 ARM 嵌入式 arm开发学习
ARM驱动学习之基础小知识•sch原理图工程师工作内容–方案–元器件选型–采购（能不能买到，价格）–原理图（涉及到稳定性）•layout画板工程师–layout（封装、布局，布线，log）（涉及到稳定性）–焊接的一部分工作（调试阶段板子的焊接）•驱动工程师–驱动，原理图，layout三部分的交集容易发生矛盾•PCB研发流程介绍–方案，原理图(网表)–layout工程师（gerber文件）–PCB板
ARM驱动学习之5 LEDS驱动 JT灬新一嵌入式 C 底层 arm开发学习单片机
ARM驱动学习之5LEDS驱动知识点：•linuxGPIO申请函数和赋值函数–gpio_request–gpio_set_value•三星平台配置GPIO函数–s3c_gpio_cfgpin•GPIO配置输出模式的宏变量–S3C_GPIO_OUTPUT注意点：DRIVER_NAME和DEVICE_NAME匹配。实现步骤：1.加入需要的头文件：//Linux平台的gpio头文件#include//三
ARM驱动学习之4小结 JT灬新一嵌入式 C++arm开发学习 linux
ARM驱动学习之4小结#include#include#include#include#include#defineDEVICE_NAME"hello_ctl123"MODULE_LICENSE("DualBSD/GPL");MODULE_AUTHOR("TOPEET");staticlonghello_ioctl(structfile*file,unsignedintcmd,unsignedlo
展现思维导图魅力，不断挖掘人生宝藏思维导图讲师Mandy
第13期最强思维导图训练营已经结束一周了，但是我依旧是感觉所有学员还在努力的学习，这些学员中有教师、学生、白领、公务员、宝妈等等，只要你努力，只要你想改变自己，任何行业，任何岗位都可以参与进来，28天足以让你见成效，在这28天中，我们的学员不仅仅是收获了一枚毕业证，最重要的是让自己的思维方式得到升级，今天的你为自己投资，明天的你就会感谢你今天的付出，我们来听一听来自13期最强思维导图训练营优秀学员
ztree设置禁用节点 3213213333332132 JavaScript ztree json setDisabledNode Ajax
ztree设置禁用节点的时候注意，当使用ajax后台请求数据,必须要设置为同步获取数据，否者会获取不到节点对象，导致设置禁用没有效果。 $(function(){ showTree(); setDisabledNode(); });
JVM patch by Taobao bookjovi java HotSpot
在网上无意中看到淘宝提交的hotspot patch，共四个，有意思，记录一下。 7050685：jsdbproc64.sh has a typo in the package name 7058036：FieldsAllocationStyle=2 does not work in 32-bit VM 7060619：C1 should respect inline and
将session存储到数据库中 dcj3sjt126com sql PHP session
CREATE TABLE sessions ( id CHAR(32) NOT NULL, data TEXT, last_accessed TIMESTAMP NOT NULL, PRIMARY KEY (id) ); <?php /** * Created by PhpStorm. * User: michaeldu * Date
Vector 171815164 vector
public Vector<CartProduct> delCart(Vector<CartProduct> cart, String id) { for (int i = 0; i < cart.size(); i++) { if (cart.get(i).getId().equals(id)) { cart.remove(i);
各连接池配置参数比较 g21121 连接池
排版真心费劲，大家凑合看下吧，见谅~ Druid DBCP C3P0 Proxool 数据库用户名称 Username Username User 数据库密码 Password Password Password 驱动名
[简单]mybatis insert语句添加动态字段 53873039oycg mybatis
mysql数据库,id自增,配置如下： <insert id="saveTestTb" useGeneratedKeys="true" keyProperty="id" parameterType=&
struts2拦截器配置云端月影 struts2拦截器
struts2拦截器interceptor的三种配置方法方法1. 普通配置法 <struts> <package name="struts2" extends="struts-default"> &
IE中页面不居中，火狐谷歌等正常 aijuans IE中页面不居中
问题是首页在火狐、谷歌、所有IE中正常显示，列表页的页面在火狐谷歌中正常，在IE6、7、8中都不中，觉得可能那个地方设置的让IE系列都不认识，仔细查看后发现，列表页中没写HTML模板部分没有添加DTD定义，就是<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3
String,int,Integer,char 几个类型常见转换 antonyup_2006 html sql .net
如何将字串 String 转换成整数 int? int i = Integer.valueOf(my_str).intValue(); int i=Integer.parseInt(str); 如何将字串 String 转换成Integer ? Integer integer=Integer.valueOf(str); 如何将整数 int 转换成字串 String ? 1.
PL/SQL的游标类型百合不是茶显示游标(静态游标)隐式游标游标的更新和删除 %rowtype ref游标(动态游标)
游标是oracle中的一个结果集,用于存放查询的结果; PL/SQL中游标的声明; 1,声明游标 2,打开游标(默认是关闭的); 3,提取数据 4,关闭游标注意的要点:游标必须声明在declare中,使用open打开游标,fetch取游标中的数据,close关闭游标隐式游标:主要是对DML数据的操作隐
JUnit4中@AfterClass @BeforeClass @after @before的区别对比 bijian1013 JUnit4 单元测试
一.基础知识 JUnit4使用Java5中的注解（annotation），以下是JUnit4常用的几个annotation： @Before：初始化方法对于每一个测试方法都要执行一次（注意与BeforeClass区别，后者是对于所有方法执行一次）@After：释放资源对于每一个测试方法都要执行一次（注意与AfterClass区别，后者是对于所有方法执行一次
精通Oracle10编程SQL(12)开发包 bijian1013 oracle 数据库 plsql
/* *开发包 *包用于逻辑组合相关的PL/SQL类型（例如TABLE类型和RECORD类型）、PL/SQL项（例如游标和游标变量）和PL/SQL子程序（例如过程和函数） */ --包用于逻辑组合相关的PL/SQL类型、项和子程序，它由包规范和包体两部分组成 --建立包规范：包规范实际是包与应用程序之间的接口，它用于定义包的公用组件，包括常量、变量、游标、过程和函数等 --在包规
【EhCache二】ehcache.xml配置详解 bit1129 ehcache.xml
在ehcache官网上找了多次，终于找到ehcache.xml配置元素和属性的含义说明文档了，这个文档包含在ehcache.xml的注释中！ ehcache.xml ： http://ehcache.org/ehcache.xml ehcache.xsd ： http://ehcache.org/ehcache.xsd ehcache配置文件的根元素是ehcahe ehcac
java.lang.ClassNotFoundException: org.springframework.web.context.ContextLoaderL 白糖_ java eclipse spring tomcat Web
今天学习spring+cxf的时候遇到一个问题：在web.xml中配置了spring的上下文监听器： <listener> <listener-class>org.springframework.web.context.ContextLoaderListener</listener-class> </listener> 随后启动
angular.element boyitech AngularJS AngularJS API angular.element
angular.element 描述: 包裹着一部分DOM element或者是HTML字符串，把它作为一个jQuery元素来处理。（类似于jQuery的选择器啦）如果jQuery被引入了，则angular.element就可以看作是jQuery选择器，选择的对象可以使用jQuery的函数；如果jQuery不可用，angular.e
java-给定两个已排序序列，找出共同的元素。 bylijinnan java
import java.util.ArrayList; import java.util.Arrays; import java.util.List; public class CommonItemInTwoSortedArray { /** * 题目：给定两个已排序序列，找出共同的元素。 * 1.定义两个指针分别指向序列的开始。 * 如果指向的两个元素
sftp 异常，有遇到的吗？求解 Chen.H java jcraft auth jsch jschexception
com.jcraft.jsch.JSchException: Auth cancel at com.jcraft.jsch.Session.connect(Session.java:460) at com.jcraft.jsch.Session.connect(Session.java:154) at cn.vivame.util.ftp.SftpServerAccess.connec
[生物智能与人工智能]神经元中的电化学结构代表什么? comsci 人工智能
我这里做一个大胆的猜想,生物神经网络中的神经元中包含着一些化学和类似电路的结构,这些结构通常用来扮演类似我们在拓扑分析系统中的节点嵌入方程一样,使得我们的神经网络产生智能判断的能力,而这些嵌入到节点中的方程同时也扮演着"经验"的角色.... 我们可以尝试一下...在某些神经
通过LAC和CID获取经纬度信息 dai_lm lac cid
方法1：用浏览器打开http://www.minigps.net/cellsearch.html，然后输入lac和cid信息(mcc和mnc可以填0)，如果数据正确就可以获得相应的经纬度方法2：发送HTTP请求到http://www.open-electronics.org/celltrack/cell.php?hex=0&lac=<lac>&cid=&
JAVA的困难分析 datamachine java
前段时间转了一篇SQL的文章（http://datamachine.iteye.com/blog/1971896），文章不复杂，但思想深刻，就顺便思考了一下java的不足，当砖头丢出来，希望引点和田玉。 -----------------------------------------------------------------------------------------
小学5年级英语单词背诵第二课 dcj3sjt126com english word
money 钱 paper 纸 speak 讲，说 tell 告诉 remember 记得，想起 knock 敲，击，打 question 问题 number 数字，号码 learn 学会，学习 street 街道 carry 搬运，携带 send 发送，邮寄，发射 must 必须 light 灯，光线，轻的 front
linux下面没有tree命令 dcj3sjt126com linux
centos p安装 yum -y install tree mac os安装 brew install tree 首先来看tree的用法 tree 中文解释：tree 功能说明：以树状图列出目录的内容。语　　法：tree [-aACdDfFgilnNpqstux][-I <范本样式>][-P <范本样式
Map迭代方式，Map迭代，Map循环蕃薯耀 Map循环 Map迭代 Map迭代方式
Map迭代方式，Map迭代，Map循环 >>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>> 蕃薯耀 2015年
Spring Cache注解+Redis hanqunfeng spring
Spring3.1 Cache注解依赖jar包：  <dependency> <groupId>org.springframework.data</groupId> <artifactId>spring-data-redis</artifactId>
Guava中针对集合的 filter和过滤功能 jackyrong filter
在guava库中，自带了过滤器(filter)的功能，可以用来对collection 进行过滤，先看例子： @Test public void whenFilterWithIterables_thenFiltered() { List<String> names = Lists.newArrayList("John"
学习编程那点事 lampcy 编程 android PHP html5
一年前的夏天，我还在纠结要不要改行，要不要去学php？能学到真本事吗？改行能成功吗？太多的问题，我终于不顾一切，下定决心，辞去了工作，来到传说中的帝都。老师给的乘车方式还算有效，很顺利的就到了学校，赶巧了，正好学校搬到了新校区。先安顿了下来，过了个轻松的周末，第一次到帝都，逛逛吧！接下来的周一，是我噩梦的开始，学习内容对我这个零基础的人来说，除了勉强完成老师布置的作业外，我已经没有时间和精力去
架构师之流处理---------bytebuffer的mark,limit和flip nannan408 ByteBuffer
1.前言。如题，limit其实就是可以读取的字节长度的意思，flip是清空的意思，mark是标记的意思。 2.例子. 例子代码: String str = "helloWorld"; ByteBuffer buff = ByteBuffer.wrap(str.getBytes()); Sy
org.apache.el.parser.ParseException: Encountered " ":" ": "" at line 1, column 1 Everyday都不同 $转义 el表达式
最近在做Highcharts的过程中，在写js时，出现了以下异常：严重: Servlet.service() for servlet jsp threw exception org.apache.el.parser.ParseException: Encountered " ":" ": "" at line 1,
用Java实现发送邮件到163 tntxia java实现
/* 在java版经常看到有人问如何用javamail发送邮件？如何接收邮件？如何访问多个文件夹等。问题零散，而历史的回复早已经淹没在问题的海洋之中。本人之前所做过一个java项目，其中包含有WebMail功能，当初为用java实现而对javamail摸索了一段时间，总算有点收获。看到论坛中的经常有此方面的问题，因此把我的一些经验帖出来，希望对大家有些帮助。此篇仅介绍用
探索实体类存在的真正意义 java小叶檀 POJO
一. 实体类简述实体类其实就是俗称的POJO,这种类一般不实现特殊框架下的接口，在程序中仅作为数据容器用来持久化存储数据用的 POJO（Plain Old Java Objects）简单的Java对象它的一般格式就是 public class A{ private String id; public Str

【学习笔记】transformer是什么？专给非计算机专业看的超直观解读

你可能感兴趣的:(学习,笔记,transformer)