AI技术学长

让我们用 PyTorch 从头开始构建我们自己的 GPT 模型

今天，我们将离开Vision Transformer系列，并讨论构建生成预训练 Transformer (GPT) 的基本变体。

更准确地说，我们将构建一个自回归（二元语法）模型，即每次根据所有先前的标记生成一个标记。自回归模型通常会根据账户中的先前标记按顺序生成标记（字符或单词）。例如，在句子“我喜欢吃”中， 的后续标记可能是、等。

统计/经典自回归模型指定输出变量线性依赖于其自身的先前值和随机项（不完全可预测的项）；

这个不完全可预测或随机的项可以非常松散地[1]与我们在“我喜欢吃”的例子中预测的下一个标记相关，我们通过让模型随机选择下一个标记进行预测（即、等），来帮助模型在选择时不那么确定，我们将在本文后面了解这一点。

由于我们正在实现一个非常基础的自回归模型，所以我们将从头开始所有事情，使用一个数据集来生成威廉·莎士比亚风格的文本。这将是我迄今为止最长的文章，所以请深呼吸，随时可以休息一下。让我们开始吧！

内容

加载数据——创建数据批量加载器和数据分割。

BigramLanguageModel — 语言模型编码

训练——训练模型并生成文本。

加载数据

# 导入 torch 特定模块 import torch import torch.nn as nn from torch.nn import functional as F # 我们首先下载莎士比亚 txt 文件（存储为名称 input.txt）！wget https://raw.githubusercontent.com/karpathy/char-rnn/master/data/tinyshakespeare/ input .txt */ # 读取 txt 文件（编码解码） text = open（'input.txt'，'r'，）.read() vocab = sorted（list（set（text））） encode = lambda s：[vocab.index(c) for c in s] decode = lambda l：[vocab[c] for c in l]

我们没有使用外部标记器，而是实现了自定义 lambda 函数来对我们的数据执行字符级标记化。

ids = encode( "我喜欢吃" ) txt = decoder( f "ids: {ids} " ) print ( f"txt: {txt} " ) print ( f"" .join(txt)) #输出：- ids : [ 21 , 1 , 50 , 47 , 49 , 43 , 1 , 58 , 53 , 1 , 43 , 39 , 58 ] txt: [ 'I' , ' ' , 'l' , 'i' , 'k ' , ' e' , ' ' , 't' , 'o' , ' ' , 'e' , 'a' , 't' ]我喜欢吃

按照 90/10 分割数据

x = int( 0.9 *len( text )) # text 是一个包含我们整个数据的大字符串 text = torch.tensor(encode( text ), dtype=torch. long ) train, val = text [:x], text [x:]

请记住，当我们在字符级别进行标记时，我们也将在字符级别生成，这里谨慎的方法是在语料库中创建批量随机句子，以输入到我们的模型中进行训练。

batch_size = 32 #batch_size - 我们将并行处理多少个独立序列？ block_size = 8 #block_size = 预测的最大上下文长度 device = 'cuda' if torch.cuda.is_available() else 'cpu' def get_batch ( split ): # 生成一小批输入 x 和目标 y 数据 data = train if split == 'train' else val ix = torch.randint(len(data) - block_size, (batch_size,)) x = torch.stack([data[ i: i+block_size] for i in ix]) y = torch.stack([data[i+ 1 :i+block_size+ 1 ] for i in ix]) return x.to(device), y.to(device) xb, yb = get_batch( 'train' )

批次按以下方式创建...

我们希望从语料库中获取块大小（8）的随机句子，因此我们生成批量大小（32）的索引（ix），并且对于每个索引，我们取接下来的 8 个标记 id 并为批量（ix）中的每个索引堆叠，但是我们的目标（y）生成的索引比 x（i+1, i + block_size + 1）多一个，因为我们需要预测序列中的下一个标记。

例子：-

ix = [33] for i in ix: print (train[i:i+18]) print (train[i+3:i+18+3]) # 我选择 +3 而不是 +1 只是为了举例 for i in ix: print ( "" . join (decode(train[i:i+18])).replace( "\n" , "" )) print ( "" . join (decode(train[i+3:i+18+3])).replace( "\n" , "" )) # 输出：- tensor([39, 52, 63, 1, 44, 59, 56, 58, 46, 43, 56, 6, 1, 46, 43, 39, 56, 1]) tensor([ 1, 44, 59, 56, 58, 46, 43, 56, 6, 1, 46, 43, 39, 56, 1, 51, 43, 1]）再往前走，听我说，听我说

双元语言模型

二元语法是n =2的一种，表示文本中两个连续词汇单位（例如单词或字符）的序列。

“我喜欢吃”的1-gram（Unigram）：["i", "like", "to", "eat"]

“我喜欢吃”的2-gram（Bigram）：["i like", "like to", "to eat"]

“我喜欢吃”的三元组（Trigram）：["i like to", "like to eat"]

由于我们正在执行自回归任务，因此我们需要以二元语法格式加载数据，就像我们在上面的代码块中所做的那样。

现在让我们进入本文的核心——多头注意力机制。由于我已经在 Vision Transformer 系列的十几篇文章中实现过这部分内容，所以我会尽量不浪费大家的时间，直接讲解这个概念。（天哪……我本来可以很容易地把这篇博客分成两部分，不过管他呢，反正我们就这样吧。）

我们看到，GPT 借鉴了《Attention is all you need》论文中提出的 Transformer 架构。然而，它的不同之处在于，它只堆叠了解码器部分中的多头注意力机制。

二元语言模型。

class BigramLanguageModel (nn.Module): def __init__ ( self, vocab_size ): super ().__init__() # 每个 token 直接从查找表中读取下一个 token 的 logits self.token_embedding_table = nn.Embedding(vocab_size, embed_size) self.possitional_embedding = nn.Embedding(block_size, embed_size) self.linear = nn.Linear(embed_size, vocab_size) self.block = nn.Sequential(*[Block(embed_size, num_head) for _ in range (num_layers)]) self.layer_norm = nn.LayerNorm(embed_size) def forward ( self, idx, target= None ): B, T = idx.shape # idx 和 target 都是 (B,T) 整数张量 logits = self.token_embedding_table(idx) # (B,T,C) ps = self.possitional_embedding(torch.arange(T, device=device)) x = logits + ps #(B, T, C) logits = self.block(x) #(B, T, c) logits = self.linear（self.layer_norm（logits））# 这假设 embed_size 和 Vocab_size 之间进行映射 B、T、C = logits.shape logits = logits.view(B*T, C) target = target.view(B*T) loss = F.cross_entropy(logits, target) 返回logits、loss

这里的输入 idx 是我们之前生成的形状为 (B, T) 的批次，其中 T 是块大小或令牌长度。

正向传递首先为每个形状为 (B, T, C) 的 token 生成嵌入。如上图所示，我们需要在 token 嵌入中添加位置嵌入。我们为输入 (idx) 创建嵌入，以便能够在固定的嵌入维度中表示 token 所包含的信息，但这并不能提供任何关于 token 位置（即位置）的信息，因此我们必须额外添加位置嵌入，以确保模型能够获取 token 位置的上下文信息。

nn.EmbeddingPyTorch 中有一个层，用于将离散的分类值（例如单词索引）映射到连续的稠密向量。该层以整数索引作为输入，每个索引代表一个唯一的分类项（例如，单词、token 或其他分类数据）。在内部，nn.Embedding它维护一个形状为的嵌入矩阵num_embeddings, embedding_dim，以便为每个 token 创建一个稠密的表示。由于我们想要一个简化版的 GPT，因此我们直接使用 nn.Embeddings 来生成位置嵌入，而不是采用其他标准方法。

从这里开始就很简单了...我们有我们的块（一堆解码器模块），最后，我们生成与输入具有相同形状的新注意力矩阵，但其中每个标记都包含有关其之前的所有标记的一些信息。

最后，我们应用层范数（Layer Norm，这是稳定训练的常用方法），然后将其传递到线性层，将嵌入 C 映射到词汇维度。词汇维度就是 input.txt 中所有唯一字符的数量。定义预测准确性的常用方法之一是将模块（注意力模块）的输出与目标索引进行比较。

输出对数函数可以简单地理解为词汇量 V 上的概率分布，用于预测序列中的下一个词（目标词）。因此，我们使用交叉熵损失来生成一个损失函数，以确定我们的输出与目标词序列的接近程度。

我们已经介绍了 Bigram 的实现。现在来看看 Block 如何使用多头注意力机制 (MHA) 来创建注意力指标。

多头注意力机制

使用多头注意力的原因是我们可以直接将输入（B、T、embedding_size）传递给注意力块，但更快的方法是，不是直接生成 Q、K、V 并计算维度 embedding_size 的注意力权重，而是创建注意力模块的各个部分，分别计算注意力权重，然后在最后将它们连接起来。

类 Head（nn.Module）： def __init__（self，head_size）： super（）。__init__（） self.head_size = head_size self.key = nn.Linear（embed_size，head_size，bias= False） self.query = nn.Linear（embed_size，head_size，bias= False） self.value = nn.Linear（embed_size，head_size，bias= False） def forward（self，x）： B，T，C = x.shape k = self.key（x） q = self.query（x） v = self.value（x） wei = [email protected]（2，1）/self.head_size** 0.5

因此，按照上述逻辑，我们创建了一个单独的注意力头。现在让我们开始理解它。

添加位置嵌入后，我们得到一个维度为 (批量大小、token 长度、嵌入维度) 的输入。这里，输入中的每个 token 都由一个 embed_dim (64) 表示。但是，没有一个 token 包含其之前所有 token 的信息。

为了创建富含此类信息的嵌入，我们使用注意力机制，通过生成键、查询和值向量。

该类中的注意力机制Head旨在帮助模型在生成输出时关注输入序列的不同部分，这在语言建模等任务中特别有用。

key、query和投影的概念value源于查询与序列中每个标记的上下文相关的信息。每个标记都用一个向量 ( x) 表示，通过将其线性变换为单独的key、query和value向量，我们可以计算出序列中哪些标记应该相互关注。

当(查询) 和(键)q点缀时，结果 ( ) 告诉我们每个标记与其他标记之间的“相关性”或“注意力”得分。得分越高，表示一个标记在该上下文中对另一个标记越相关或“重要”。缩放因子可以防止这些得分过大，否则会导致 softmax 分布过于尖锐，难以优化。kwei1 / sqrt(head_size)

类 Head（nn.Module）： def __init__（self，head_size）： super（）。__init__（） self.head_size = head_size self.key = nn.Linear（embed_size，head_size，bias= False） self.query = nn.Linear（embed_size，head_size，bias= False） self.value = nn.Linear（embed_size，head_size，bias= False） self.register_buffer（'tril'，torch.tril（torch.ones（block_size，block_size））） self.dropout = nn.Dropout（dropout） def forward（self，x）： B，T，C = x.shape k = self.key（x） q = self.query（x）v = self.value（ x ） wei = [email protected]（2，1）/self.head_size** 0.5 wei = wei.masked_fill(self.tril[:T, :T] == 0 , float ( '-inf' )) wei = F.softmax(wei, dim= 2 ) # (B , block_size, block_size) wei = self.dropout(wei) out = wei@v return out

因果掩码tril的作用是确保每个 token 只能“看到”自身和之前的 token。这对于文本生成等自回归任务至关重要，因为模型在预测下一个 token 时不应考虑未来的 token。将不相关的位置设置为负无穷，masked_fill会使它们在 softmax 之后变为零，因此它们不会参与最终的注意力计算。这可以防止模型在我们想要预测未来 token 时，通过考虑未来的 token 来作弊。最后，我们对权重和价值指标进行点积，并返回输出。

您可以检查此示例输出以更好地了解发生的转换：

q = torch.randint( 10 , ( 1 , 3 , 3 )) v = torch.randint( 10 , ( 1 , 3 , 3 )) print ( "查询:\n" ,q) print ( "值:\n" ,v) wei = [email protected]( 2 , 1 )/ 3 ** 0.5 print ( "权重:\n" , wei) tril = torch.tril(torch.ones( 3 , 3 )) print ( "三角指标:\n" ,tril) wei = wei.masked_fill(tril == 0 , float ( '-inf' )) print ( "掩蔽权重\n" , wei) print ( "Softmax ( e^-inf = 0 )\n" , F.softmax(wei, dim= 2 )) #输出：- 查询：张量（[[[ 2 , 8 , 8 ]， [ 4 , 2 , 4 ]， [ 1 , 2 , 9 ]]]）值：张量（[[[ 9 , 5 , 7 ]， [ 3 , 1 , 4 ]， [ 6 , 2 , 9 ]]]）权重：张量（[[[ 65.8179 , 26.5581 , 57.7350 ]， [ 42.7239 , 17.3205 , 36.9504 ]， [ 47.3427 , 23.6714 , 52.5389 ]]]）三角度量：张量（[[ 1. , 0. , 0. ]， [ 1. , 1. , 0. ], [ 1. , 1. , 1. ]]) 掩蔽权重张量([[[ 65.8179 , -inf, -inf], [ 42.7239 , 17.3205 , -inf], [ 47.3427 , 23.6714 ,52.5389 ]]]) Softmax（e ^ - inf = 0）张量（[[[ 1.0000e+00 , 0.0000e+00 , 0.0000e+00 ], [ 1.0000e+00 , 9.2777e-12 , 0.0000e+00 ], [ 5.5073e-03 , 2.8880e-13 , 9.9449e-01 ]]])

由于我们使用多头注意力，因此我们将这样实现它：

类 MultiHeadAttention (nn.Module): def __init__ ( self , head_size, num_head ): super ().__init__() self .sa_head = nn.ModuleList([Head(head_size) for _ in range(num_head)]) self .dropout = nn.Dropout(dropout) self .proj = nn.Linear(embed_size, embed_size) def forward ( self , x ): x = torch.cat([head(x) for head in self .sa_head], dim= - 1 ) x = self .dropout( self .proj(x)) 返回x

在这里，我们将输入 x (B, T, E) 传递给不同的注意力头，每个注意力头返回大小为 (B, T, head_size) 的最终向量，其中头部大小 = E (64) / num heads (4) = 16，正如我们在范围 (num_head(4)) 的 for 循环中所做的那样，我们将其连接回其原始大小 (B, T, 4*16)。

在嵌入维度更大的规模上，多头注意力被认为更快、更高效。

连接后，我们将最终输出传递到线性投影层，这样做的目的是使最终向量中的嵌入能够进一步交流它们在注意力权重计算过程中彼此学到的知识。之后，它被传递到dropout层并返回。

综合起来，标准解码器块的实现如上图 1 所示。

类 FeedForward（nn.Module）： def __init__（self，embed_size）： super（）。__init__（） self.ff = nn.Sequential（ nn.Linear（embed_size，4 *embed_size）， nn.ReLU（）， nn.Linear（4 *embed_size，embed_size）， nn.Dropout（dropout）） def forward（self，x）：返回self.ff（x）类 Block（nn.Module）： def __init__（self，embed_size，num_head）： super（）。__init__（） head_size = embed_size // num_head self.multihead = MultiHeadAttention（head_size，num_head） self.ff = FeedForward（embed_size） self.ll1 = nn.LayerNorm（embed_size） self.ll2 = nn.LayerNorm（embed_size） def forward（self，x）： x = x + self.multihead(self.ll1(x)) x = x + self.ff(self.ll2(x)) 返回x

头部尺寸的计算如前所述，输入只是通过一个层规范，然后是我们的多头注意力网络，然后是另一个层规范，最后通过前馈网络。

回到二元模型

class BigramLanguageModel (nn.Module): def __init__ ( self, vocab_size ): super ().__init__() # 每个 token 直接从查找表中读取下一个 token 的 logits self.token_embedding_table = nn.Embedding(vocab_size, embed_size) self.possitional_embedding = nn.Embedding(block_size, embed_size) self.linear = nn.Linear(embed_size, vocab_size) self.block = nn.Sequential(*[Block(embed_size, num_head) for _ in range (num_layers)]) self.layer_norm = nn.LayerNorm(embed_size) def forward ( self, idx, target= None ): B, T = idx.shape # idx 和 target 都是 (B,T) 整数张量 logits = self.token_embedding_table(idx) # (B,T,C) ps = self.possitional_embedding(torch.arange(T, device=device)) x = logits + ps #(B, T, C) logits = self.block(x) #(B, T, c) logits = self.linear(self.layer_norm(logits)) # 假设在 head_size 和 Vocab_size 之间进行映射 if targets is None : loss = None else : B, T, C = logits.shape logits = logits.view(B*T, C) targets = targets.view(B*T) loss = F.cross_entropy(logits, targets) return logits, loss def generate ( self, idx, max_new_tokens ): # idx 是当前上下文中的 (B, T) 索引数组 for _ in range (max_new_tokens): # 将 idx 裁剪为最后的 block_size 个标记 crop_idx= idx[:, -block_size:].to(device) # 获取预测 logits, loss = self(crop_idx) # 仅关注最后的时间步 logits = logits[:, - 1 , :] # 从 (B, T, C) 变为 (B, C) # 应用 softmax 获取概率 probs = F.softmax(logits, dim=- 1 ) # (B, C) # 我们从滤波分布中抽取一个索引 idx_next = torch.multinomial(probs, num_samples= 1 ).to(device) # 将抽样索引附加到正在运行的序列 idx = torch.cat((idx, idx_next), dim= 1 )# (B, T+1) 返回idx

这里我们看到通过层数的范围来调用Sequential层下的Block。

正在生成令牌...

首先，将单维 idx 张量（我们标记的索引）以及我们想要生成的新标记的最大数量传递给generate函数。由于我们的模型是为块大小 8 构建的，我们一次只能传递 8 个标记，因此我们裁剪了 idx 中的最后 8 个标记（如果 idx 长度小于块大小，则选择所有标记）。

我们将 crop idx 传递给我们的 BigramLanguageModel，因为我们生成的 logits 具有目标标记的可能分布，我们只对最后一个标记感兴趣，因为目标的最后一个标记（y）是序列（x）中的下一个（在批量加载器部分中解释）。

我们现在得到的 logits 向量形状为 (B, C)，其中 C 是词汇大小，表示最后一个词条索引在整个词汇表中的概率分布。现在我们只需对其应用 softmax 函数，即可将该向量转换为概率向量（即元素和 = 1）。

现在，还记得我们在文章一开始讨论的不完全可预测或随机项，以及我们如何让模型随机选择序列中的下一个标记吗？为此，我们使用torch.multinomial，这是一种统计策略，用于从给定的概率分布中抽取样本。在这里，它根据指定的概率随机抽取索引。

然后我们最终得到预测的下一个 idx，将其与前一个 idx 连接起来，然后继续 for 循环，根据前一个索引不断生成下一个索引，直到达到最大标记。

训练

幸运的是，训练部分非常简单。

m = BigramLanguageModel( 65 ).to(device) optimizer = torch.optim.AdamW(m.parameters(), lr= 1e-3 ) # 训练模型，因为我不会不战而降 batch_size = 32 for epoch in range ( 5000 ): # 打印训练和验证损失 if epoch% 1000 == 0 : m. eval () Loss= 0.0 Val_Loss = 0.0 for k in range ( 200 ): x, y = get_batch( True ) val_ , val_loss = m(x, y) x1, y1 = get_batch( False ) _, train_loss = m(x1, y1) Loss += train_loss.item() Val_Loss += val_loss.item() avg_loss = Val_Loss/(k+ 1 ) avg_train_loss = Loss/(k+ 1 ) m.train() print ( "Epoch: {} \n 验证损失为：{} 损失为：{}" . format (epoch, avg_loss, avg_train_loss)) # 前向 data, target = get_batch( False ) logits, loss = m(data, target) # 后向优化器.zero_grad（set_to_none = True） loss.backward（）优化器.step（）

在这里，我们将训练进行 5000 个时期，在 4 GB VRAM Nvidia RTX 3050 中，这大约需要 2 分钟。

我们从正向传递开始，从get_batch() 获取批次并将其传递给 BigramLanguageModel。设置optimizer.zero_grad()，执行loss.backward()，并执行optimizer.step()，我们使用了 AdamW 优化器，它足以满足我们的需求。

现在正是您等待的时刻……

我们为以下句子创建一个张量：

ids = torch.tensor(encode( "我喜欢吃食物" ), dtype=torch.long).unsqueeze( 0 )

ids 的形状为 (1, 18)（批量大小，标记）。从 18 个标记（代表词汇表中的索引）开始，生成另外 2000 个字符。为了便于理解，我们的词汇表是 input.txt 中所有唯一字符的集合，我们之前在数据加载部分中实现了这个集合，即vocab = sorted(list(set(text)))

打印（“”。加入（解码（m.generate（torch.zeros（[ 1 , 1 ]，dtype=torch.long），max_new_tokens= 2000）[ 0 ].tolist（））））

输出：- 我喜欢吃东西，没有 BANIO：在这里，我和已婚的女人们握手恳求，因为你们在这沼泽之间，就像坟墓一样，是他的太阳。路森修：去吧，多么双重的情妇啊。尾巴，别忘了，豌豆帽你；——是主人，你指挥着为slawake跳跃和离开这沙发；彼特鲁乔？可怜的这只公鸡从未如此做老路，我评论和curh 并blate确保poccient你miad曾经a参加， Unory speitied在哪里buzzarr'd formorns， Pitedame，海滩，和我firit。安藤：哦，美德鹦鹉，那是至少，不是因为吮吸可以mighreature好；你的，我会在counteent之后toence， Signior到paptista？你还敢跟我玩吗？比安卡：哪里有女人会让他偷偷摸摸地溜走。普洛斯彼罗：我，既然已经成功了，这一切都不是真的，因为岛上的一切都很好；我穿着这身行头；那就结婚吧。特拉尼奥：是的，伙计。格鲁乔：我肯定能证明我出身。普洛斯彼特鲁乔：这东西是我的；它就是我的。

我知道……这说不通。但我们必须意识到，语言模型并非仅仅基于莎士比亚作品的数据集进行训练。这需要强大的 GPU 算力、更先进的分词技术以及海量的数据集。

由于我们在一个非常小的模型上进行训练，我们的表现还不错，输出仍然有意义，并且已经学会使用实际的英语单词而不是生成随机的胡言乱语。

您可以尝试针对不同的数据集和 Token Size、Batch Size、Number of Layers 等试验该模型。

谢谢你！

本博客的主要目标是向您详细解释如何从头开始构建语言模型并在数据集上对其进行训练......好吧，现在您知道了！！！

在此，我由衷感谢你给予我学习的机会并阅读本文，希望你喜欢这篇文章。完整的代码可以在我的

男士护肤品哪个牌子好？十大男士护肤品排行榜高省APP珊珊
很多男生意识到护肤的必要性，开始着手护肤，但不知道该选哪个男士护肤品品牌使用好。目前市面上很多男士护肤品品牌，可谓琳琅满目，让人眼花缭乱。男士挑选护肤品时，根据自己皮肤需求去正规渠道挑选合适的知名护肤品比较放心靠谱。高省APP，是2021年推出的平台，0投资，0风险、高省APP佣金更高，模式更好，终端用户不流失。【高省】是一个自用省钱佣金高，分享推广赚钱多的平台，百度有几百万篇报道，也期待你的加入
《玉骨遥》：大司命为什么不杀朱颜？原因没那么简单 windy天意晚晴
《玉骨遥》里，朱颜就是时影的命劫之人。重明与时影早就知道，他们一直瞒着大司命，如今大司命也知道了真相。可是大司命却没有杀朱颜，而是给朱颜下了诛心咒，还说时影的命劫已经破了，真的如此吗？1、计划总是赶不上变化的大司命从目前剧情来说，大司命还不如时影，他信心十足的事情总会有纰漏。他不让时影见命劫之女，结果时影还是遇上了。他想让时影走火入魔，一心复仇，结果时影在朱颜的劝说下放下了仇恨。大司命让时影开山收
【C++算法】76.优先级队列_前 K 个高频单词流星白龙优选算法C++c++算法开发语言
文章目录题目链接：题目描述：解法C++算法代码：题目链接：692.前K个高频单词题目描述：解法利用堆来解决TopK问题预处理一下原始的字符串数组，用一个哈希表统计一下每一个单词出现的频次。创建一个大小为k的堆频次：小根堆字典序（频次相同的时候）：大根堆循环让元素依次进堆判断提取结果C++算法代码：classSolution{//定义类型别名，PSI表示对typedefpairPSI;//自定义比较
JVM 内存模型深度解析：原子性、可见性与有序性的实现练习时长两年半的程序员小胡 JVM 深度剖析：从面试考点到生产实践 jvm java 内存模型
在了解了JVM的基础架构和类加载机制后，我们需要进一步探索Java程序在多线程环境下的内存交互规则。JVM内存模型（JavaMemoryModel，JMM）定义了线程和主内存之间的抽象关系，它通过规范共享变量的访问方式，解决了多线程并发时的数据一致性问题。本文将从内存模型的核心目标出发，详解原子性、可见性、有序性的实现机制，以及volatile、synchronized等关键字在其中的作用。一、J
Flowable 实战落地核心：选型决策与坑点破解练习时长两年半的程序员小胡 Flowable 流程引擎实战指南低代码 BPMN 流程引擎 flowable 后端 java
在企业级流程引擎的落地过程中，选型的准确性和坑点的预见性直接决定项目成败。本文聚焦Flowable实战中最关键的“选型决策”与“常见坑点”，结合真实项目经验，提供可落地的解决方案。一、流程引擎选型：从业务本质出发1.1选型的三大核心维度企业在选择流程引擎时，需避免陷入“技术崇拜”，应回归业务本质。评估Flowable是否适用，可从三个维度判断：业务复杂度若流程涉及动态审批链（如按金额自动升级审批）
SpringMVC的执行流程
1、什么是MVCMVC是一种设计模式。MVC的原理图如下所示M-Model模型（完成业务逻辑：有javaBean构成，service+dao+entity）V-View视图（做界面的展示jsp，html……）C-Controller控制器（接收请求—>调用模型—>根据结果派发页面2、SpringMVC是什么SpringMVC是一个MVC的开源框架，SpringMVC=Struts2+Spring，
Aop +反射实现方法版本动态切换
需求分析在做技术选型的时候一直存在着两个声音，mongo作为数据库比较mysql好，mysql做为该数据比mongo好。当然不同数据库都有有着自己的优势，我们在做技术选型的时候无非就是做到对数据库的扬长避短。mysql最大的优势就是支持事务，事务的五大特性保证的业务可靠性，随之而来的就是事务会产生的问题：脏读、幻读、不可重复度，当然我们也会使用不同的隔离级别来解决。（最典型的业务问题：银行存取钱）
通义万相2.2：开启高清视频生成新纪元 Liudef06小白特殊专栏 AIGC 人工智能人工智能通义万相2.2 图生视频
通义万相2.2：开启高清视频生成新纪元2025年7月28日，中国AI领域迎来里程碑时刻——通义万相团队正式开源其革命性视频生成模型Wan2.2的核心权重，这标志着开源社区首次获得支持720P高清视频生成的先进模型架构。一、架构革新：混合专家系统1.1MoE视频扩散架构通义万相2.2首次将混合专家（MoE）架构引入视频扩散模型，通过双专家系统实现计算效率与模型容量的平衡：classMoEVideoD
今晚吃太饱了爱伤心的蚂蚁
今晚吃太饱了，两碗干饭，两碗肉汤，一碗牛奶银耳汤，感觉肚子都顶出来了，圆滚滚的！明早要早起，出发去小蚂蚁家！看着剩下的肉汤，倒掉多可惜，干掉了！看着小蚂蚁熬的银耳汤，倒掉多可惜，于是热了一下，顺便热袋牛奶倒进去，大娃喝点，小蚂蚁喝点，还剩下一大碗，继续干掉！吃的太饱，人也懒洋洋的，躺床上不想动，感受的肚子撑撑的感觉，好久没吃这么饱了！这一晚灌的都是汤汤水水的，天冷的晚上，半夜要睡不安稳咯！哈哈！小
你对待万事万物的态度行靜
昨晚爸爸把洒水壶灌满水，对我说：你也该去浇浇你阳台上的花咯。这么大的天气，几天没浇水都快死了。我才意识到自己容易突然间忽视一些事情。尤其是身旁的一些事，可能它们呆久了，反而习以为常。想想每天的生活状态就是在不断的重复着一些事，有点固定模式。没有什么特别发生。记录我的一天：上班，挤公交，用手机或电脑，吃饭，上课。没有
编程算法：技术创新的引擎与业务增长的核心驱动力
在数字经济时代，算法已成为推动技术创新与业务增长的隐形引擎。从存内计算突破冯·诺依曼瓶颈，到动态规划优化万亿级金融交易，编程算法正在重塑产业竞争格局。一、存内计算：突破冯·诺依曼瓶颈的算法革命1.1存内计算的基本原理传统计算架构中90%的能耗消耗在数据搬运上。存内计算（Processing-in-Memory）通过直接在存储单元执行计算，实现能效10-100倍提升：#传统计算vs存内计算能耗模型i
承德十大亲子鉴定医院名单(附2024年10所正规医院) 国医基因陈主任
承德哪家医院可以做亲子鉴定？承德市中心医院、中国人民解放军第二六六医院、承德医学院附属医院等都可以做常规亲子鉴定采样采集，一般的医院并不可以为你提供常规亲子鉴定检测的服务。承德亲子鉴定中心地址：承德市西大街路北11号（承德国医基因）。一般只有少数三甲医院可以做亲子鉴定采样，或者当地亲子鉴定中心可以做亲子鉴定。如果想做亲子鉴定，最好直接到亲子鉴定中心内或亲子鉴定医院采样点内进行双方抽血鉴定，这样会更
践行8.0~第六周11.25-12.02 初队长
突破后的喜悦最可怕的不是自己不清楚，而是自己清楚了，却依然不心动，我想这就是我们每个人的惰性存在，在这一周的践行，我发现自己依然是停留在自己的模式当中，不断的恶性的轮回，虽然的话，那再晨间日记方面是纸质的填写，但是对一天的工作没有起到应有的计划和推动的作用而我自己呢，也有些时候的话会处于一个相对来讲放松的一个状态，时间的把控的话也有一些点的消极，所以在这周的间隙，重点是关注自己的三大目标为目标来进
5G基站信号加速器！AD8021ARZ-REEL7亚德诺超低噪声高速电压放大器专利失真消除技术! 深圳市尚想信息技术有限公司 5G通信高速运放 ADI黑科技 8K视频医疗超声
AD8021ARZ-REEL7ADI：重新定义高速放大器的性能极限！一、产品简介AD8021ARZ-REEL7是ADI（亚德诺半导体）推出的超低噪声高速电压反馈放大器，采用XFCB工艺和专利失真消除技术，专为4K/8K视频处理、医疗成像、5G通信等超高频应用设计。以1.8GHz带宽和0.1nV/√Hz超低噪声，成为高速信号调理的终极解决方案！二、五大颠覆性优势军工级信号保真度1.8GHz-3dB带
打造自己的梦想生态系统轻风style
今天听了第5周5.1的梦想系统和随堂练习：梦想仓库与八大关注表。参照老师给出的例子，列出了八大关注对应的自己的梦想。有些写的时候内心都在怀疑，但因为老师有说到，要没有分别心的去列出，不管是近的，远的，小的，大的，自己觉得可以实现的，或者觉得根本不可能实现的，都统统的列出来。就像音频中提到的，林语堂说过的话，梦想无论怎样模糊，总潜伏在我们心底，使我们的心境永远得不到宁静，直到这些梦想成为事实才止；像
我是孩子妈妈，我会让孩子饿着吗？松玲子
回老家过年，就是一场在关于喂养孩子问题上与老人的巅峰对决。前天我们回老家了，他爷爷奶奶就说孩子瘦了，就说我喂的不好，不按时喂，第一天夜里孩子总是睡一会就哭，睡一会就哭，夜里不知醒了多少次，弄得我真是几乎彻夜未眠。一大早，我还没起，我就听见他爷爷奶奶在外边说，今黑夜阳阳怎么老哭，是不是饿的，然后又延伸到我喂养的问题上，说不吃盐不行，不吃盐孩子没劲，吃蛋光吃个蛋黄，吃不饱，给他吃全蛋就行，哎呀我去，我
心力践行营十二期一阶学习打卡 LX_王彤彤
姓名：王彤彤时间：2021年4月24日一：朗读师父的十大人生哲学二：师父的早安分享感悟很喜欢这句话：所有的行动都是基于目标的尝试，没有所谓的失败，只是不同尝试后得到的不同结果，让我们更好地调整下一次的行动。三：感恩日记1.我太幸福了，我很感恩姑姑，因为姑姑放假又投喂了我，还给我带了饺子回家，这让我感觉很幸福。谢谢，谢谢，谢谢。2.我太幸福了，我很感恩师父晚上的直播，因为听他的分享我知道怎么更好的去
为了在未来的人工智能世界中取得成功，学生们必须学习人类写作的优点睿邸管家
澳大利亚各地的学生在新学年开始使用铅笔、钢笔和键盘学习写字。在工作场所，机器也在学习写作，如此有效，几年之内，它们可能会写得比人类更好。有时它们已经做到了，就像Grammarly这样的应用程序所展示的那样。当然，人类现在的日常写作可能很快就会由具有人工智能(AI)的机器来完成。手机和电子邮件软件常用的预测文本是无数人每天都在使用的一种人工智能写作形式。据AI行业研究机构称，到2022年，人工智能及
京东中秋节会打折吗？京东中秋节活动力度大吗？高省APP珊珊
京东中秋节会打折，并且活动力度通常是比较大的。以下是具体分析：京东中秋节打折情况降价促销：京东在中秋节期间会推出大规模的降价促销活动，涵盖食品、家居、家电等多个品类，以及众多热门品牌。消费者可以在此期间享受到实实在在的降价优惠。多种优惠形式：除了直接的降价促销，京东还会通过满减优惠、折扣促销、限时秒杀等多种形式的优惠活动来吸引消费者。这些优惠活动通常具有较高的吸引力，能够激发消费者的购买欲望。目前
Android 应用权限管理详解
文章目录1.权限类型2.权限请求机制3.权限组和分级4.权限管理的演进5.权限监控和SELinux强制访问控制6.应用权限审核和GooglePlayProtect7.开发者最佳实践8.用户权限管理9.Android应用沙箱模型10.ScopedStorage（分区存储）11.背景位置权限（BackgroundLocationAccess）12.权限回收和自动清理13.权限请求的用户体验设计14.G
AI模型训练中过拟合和欠拟合的区别是什么？ workflower 人工智能算法人工智能数据分析
在AI模型训练中，过拟合和欠拟合是两种常见的模型性能问题，核心区别在于模型对数据的学习程度和泛化能力：欠拟合（Underfitting）-定义：模型未能充分学习到数据中的规律，对训练数据的拟合程度较差，在训练集和测试集上的表现都不好（如准确率低、损失值高）。-原因：-模型结构过于简单（如用线性模型解决非线性问题）；-训练数据量不足或特征信息不充分；-训练时间太短，模型尚未学到有效模式。-表现：训练
农场种蔬菜赚钱小游戏有哪些五大可以赚钱的小游戏APP 氧惠帮朋友一起省
喜欢种菜吗？我特意带来农场种蔬菜赚钱小游戏排行榜2022，线上汇集了超多模拟种菜玩法，玩家可以免费种植赚钱哦！每天都有大量的种植任务，线上完成就能赚钱哦！快来下载吧！1.氧惠APP购物、看电影、点外卖、用氧惠APP！更优惠！氧惠（全网优惠上氧惠）——是与以往完全不同的抖客+淘客app！2023全新模式，我的直推也会放到你下面，送1:1超级补贴(邀请好友自购多少，你就推广得多少，非常厉害)，欢迎各位
严重的DDoS 攻击澳大利亚主要宽带提供商 Fancy1816575412
本周早些时候，澳大利亚最大的固定无线宽带运营商CirrusCommunications遭受了一次重大的DDoS攻击，导致其一半以上的网络瘫痪。该公司在其网站上声称：“强大的架构、数百个传输站点以及光纤和微波回程的使用使其能够以非常高的正常运行时间提供高速”。CirrusCommunications表示，它覆盖了澳大利亚十大人口中心以及几个主要的区域中心，主要为企业和政府客户提供服务。然而，据The
3次创业身价百亿，2年前却被大众判“死刑”，李想如今怎样了？职心眼儿
他，19岁放弃高考去创业；25岁，成为亿万富豪，被央视评为“80后创业”领军人物；39岁，身价再次暴涨，一夜间闯过200亿大关。他，在3个领域连续创业20年，一家公司市值700亿，一家公司市值2000亿。而他的最高学历，却只有高中。这个人，就是理想汽车的创始人——李想。纵观李想的创业史，可谓是颇为传奇：一个既没背景，又没资金高中毕业生，怎么就让3位互联网巨头（张一鸣、王兴、程维）同时为自己站台？更
【备孕故事】她一直想做个大差不离的人，没想到在这件事上拔了尖儿宜嘉阿姨
图片发自App杨婷说从小到大自己就是个中规中矩的人，不出格，不落单，一直随着大流。学业上从未出类拔萃，却也跟着大部队一起考上了一本；做事从不冒尖，搞个大差不离就行，因此，这么多年以来，差不多就行成了她对自己人生的要求。22岁大学毕业进了一家国企，外型不出挑但文静可人的她也遇上了两位追求者，简单的观察和交往后，她从中选了李广作为自己的婚恋对象。25岁那年，在父母亲朋的祝福声中杨婷和李广步入了婚姻。婚
黛玉葬花是一种什么心情爱的生命力
图片发自App小区里的花终于开了，带着孩子在小区散步的时候，无意间我注意到了玉兰，第一次我发现原来它是先开花后长叶子的，洁白如玉的花高耸入云，那种洁白，让人敬畏。因为有风，所以带孩子在楼遮挡的草坪上玩，发现紫叶李的花也开了，并且随着风的吹动，落了满地，孩子捡起一朵花，拿到我面前，细声细气的说“花”，我的大脑细胞瞬间激活，为什么不和孩子一起捡花呢！这可是一项好玩的游戏，于是我给孩子拿了一个大的挖土用
Anaconda 和 Miniconda：功能详解与选择建议古月฿ python入门 python conda
Anaconda和Miniconda详细介绍一、Anaconda的详细介绍1.什么是Anaconda？Anaconda是一个开源的包管理和环境管理工具，在数据科学、机器学习以及科学计算领域发挥着关键作用。它以Python和R语言为基础，为用户精心准备了大量预装库和工具，极大地缩短了搭建数据科学环境的时间。对于那些想要快速开展数据分析、模型训练等工作的人员来说，Anaconda就像是一个一站式的“数
今天的彭格列依然被世界游戏吓得瑟瑟发抖呢云染舒倦
前言有一天，有一个白兰的大魔王想要毁灭世界，创世者非常不高兴，于是，创始者用吞噬一切，包容一切的大空（泽田纲吉）、捉摸不定的雾（六道骸）、孤高的浮云（云雀恭弥）、愤怒的忠岚（狱寺隼人）、晕染一切的雨（山本武）、守护之雷（蓝波）、热血之晴（晴川了平）创造了七位拯救世界的勇士（用属性制造勇士），让他们跟白兰对抗。。。［白兰的力量是游戏，于是要打败他，只要同样在世界布置的游戏中，赢过白兰就行了~］图片发
MySQL复习题
一.填空题1.关系数据库的标准语言是SQL。2.数据库发展的3个阶段中，数据独立性最高的是阶段数据库系统。3.概念模型中的3种基本联系分别是一对一、一对多和多对多。4.MySQL配置文件的文件名是my.ini或my.cnf。5.在MySQL配置文件中，datadir用于指定数据库文件的保存目录。6.添加IFNOTEXISTS可在创建的数据库已存在时防止程序报错。7.MySQL提供的SHOWCREA
Qwen3 大模型实战：使用 vLLM 部署与函数调用（Function Call）全攻略曦紫沐大模型大模型部署 Qwen3 vLLM 函数调用
文章摘要本文将带你从零开始，深入掌握如何使用Qwen3-8B大语言模型，结合vLLM进行高性能部署，并通过函数调用（FunctionCall）实现模型与外部工具的智能联动。我们将详细讲解部署命令、调用方式、代码示例及实际应用场景，帮助你快速构建基于Qwen3的智能应用。一、Qwen3简介与部署环境准备Qwen3是通义千问系列的最新一代大语言模型，具备强大的自然语言理解和生成能力，尤其在函数调用、工
项目中枚举与注解的结合使用飞翔的马甲 java enum annotation
前言：版本兼容，一直是迭代开发头疼的事，最近新版本加上了支持新题型，如果新创建一份问卷包含了新题型，那旧版本客户端就不支持，如果新创建的问卷不包含新题型，那么新旧客户端都支持。这里面我们通过给问卷类型枚举增加自定义注解的方式完成。顺便巩固下枚举与注解。一、枚举 1.在创建枚举类的时候，该类已继承java.lang.Enum类，所以自定义枚举类无法继承别的类，但可以实现接口。
【Scala十七】Scala核心十一：下划线_的用法 bit1129 scala
下划线_在Scala中广泛应用，_的基本含义是作为占位符使用。_在使用时是出问题非常多的地方，本文将不断完善_的使用场景以及所表达的含义 1. 在高阶函数中使用 scala> val list = List(-3,8,7,9) list: List[Int] = List(-3, 8, 7, 9) scala> list.filter(_ > 7) r
web缓存基础：术语、http报头和缓存策略 dalan_123 Web
对于很多人来说，去访问某一个站点，若是该站点能够提供智能化的内容缓存来提高用户体验，那么最终该站点的访问者将络绎不绝。缓存或者对之前的请求临时存储，是http协议实现中最核心的内容分发策略之一。分发路径中的组件均可以缓存内容来加速后续的请求，这是受控于对该内容所声明的缓存策略。接下来将讨web内容缓存策略的基本概念，具体包括如如何选择缓存策略以保证互联网范围内的缓存能够正确处理的您的内容，并谈论下
crontab 问题周凡杨 linux crontab unix
一： 0481-079 Reached a symbol that is not expected. 背景： */5 * * * * /usr/IBMIHS/rsync.sh
让tomcat支持2级域名共享session g21121 session
tomcat默认情况下是不支持2级域名共享session的，所有有些情况下登陆后从主域名跳转到子域名会发生链接session不相同的情况，但是只需修改几处配置就可以了。打开tomcat下conf下context.xml文件找到Context标签,修改为如下内容如果你的域名是www.test.com <Context sessionCookiePath="/path&q
web报表工具FineReport常用函数的用法总结（数学和三角函数）老A不折腾 Web finereport 总结
ABS ABS(number):返回指定数字的绝对值。绝对值是指没有正负符号的数值。 Number:需要求出绝对值的任意实数。示例: ABS(-1.5)等于1.5。 ABS(0)等于0。 ABS(2.5)等于2.5。 ACOS ACOS(number):返回指定数值的反余弦值。反余弦值为一个角度，返回角度以弧度形式表示。 Number:需要返回角
linux 启动java进程 sh文件墙头上一根草 linux shell jar
#!/bin/bash #初始化服务器的进程PId变量 user_pid=0; robot_pid=0; loadlort_pid=0; gateway_pid=0; ######### #检查相关服务器是否启动成功 #说明： #使用JDK自带的JPS命令及grep命令组合，准确查找pid #jps 加 l 参数，表示显示java的完整包路径 #使用awk，分割出pid
我的spring学习笔记5-如何使用ApplicationContext替换BeanFactory aijuans Spring 3 系列
如何使用ApplicationContext替换BeanFactory？ package onlyfun.caterpillar.device; import org.springframework.beans.factory.BeanFactory; import org.springframework.beans.factory.xml.XmlBeanFactory; import
Linux 内存使用方法详细解析 annan211 linux 内存 Linux内存解析
来源 http://blog.jobbole.com/45748/ 我是一名程序员，那么我在这里以一个程序员的角度来讲解Linux内存的使用。一提到内存管理，我们头脑中闪出的两个概念，就是虚拟内存，与物理内存。这两个概念主要来自于linux内核的支持。 Linux在内存管理上份为两级，一级是线性区，类似于00c73000-00c88000，对应于虚拟内存，它实际上不占用
数据库的单表查询常用命令及使用方法(-) 百合不是茶 oracle 函数单表查询
创建数据库; --建表 create table bloguser(username varchar2(20),userage number(10),usersex char(2)); 创建bloguser表,里面有三个字段 &nbs
多线程基础知识 bijian1013 java 多线程 thread java多线程
一．进程和线程进程就是一个在内存中独立运行的程序，有自己的地址空间。如正在运行的写字板程序就是一个进程。 “多任务”：指操作系统能同时运行多个进程（程序）。如WINDOWS系统可以同时运行写字板程序、画图程序、WORD、Eclipse等。线程：是进程内部单一的一个顺序控制流。线程和进程 a. 每个进程都有独立的
fastjson简单使用实例 bijian1013 fastjson
一.简介阿里巴巴fastjson是一个Java语言编写的高性能功能完善的JSON库。它采用一种“假定有序快速匹配”的算法，把JSON Parse的性能提升到极致，是目前Java语言中最快的JSON库；包括“序列化”和“反序列化”两部分，它具备如下特征：
【RPC框架Burlap】Spring集成Burlap bit1129 spring
Burlap和Hessian同属于codehaus的RPC调用框架，但是Burlap已经几年不更新，所以Spring在4.0里已经将Burlap的支持置为Deprecated,所以在选择RPC框架时，不应该考虑Burlap了。这篇文章还是记录下Burlap的用法吧，主要是复制粘贴了Hessian与Spring集成一文，【RPC框架Hessian四】Hessian与Spring集成
【Mahout一】基于Mahout 命令参数含义 bit1129 Mahout
1. mahout seqdirectory $ mahout seqdirectory --input (-i) input Path to job input directory(原始文本文件). --output (-o) output The directory pathna
linux使用flock文件锁解决脚本重复执行问题 ronin47 linux lock　重复执行
linux的crontab命令，可以定时执行操作，最小周期是每分钟执行一次。关于crontab实现每秒执行可参考我之前的文章《linux crontab 实现每秒执行》现在有个问题，如果设定了任务每分钟执行一次，但有可能一分钟内任务并没有执行完成，这时系统会再执行任务。导致两个相同的任务在执行。例如： <? // test .php
java-74-数组中有一个数字出现的次数超过了数组长度的一半，找出这个数字 bylijinnan java
public class OcuppyMoreThanHalf { /** * Q74 数组中有一个数字出现的次数超过了数组长度的一半，找出这个数字 * two solutions: * 1.O(n) * see <beauty of coding>--每次删除两个不同的数字，不改变数组的特性 * 2.O(nlogn) * 排序。中间
linux 系统相关命令 candiio linux
系统参数 cat /proc/cpuinfo cpu相关参数 cat /proc/meminfo 内存相关参数 cat /proc/loadavg 负载情况性能参数 1）top M：按内存使用排序 P：按CPU占用排序 1：显示各CPU的使用情况 k：kill进程 o：更多排序规则回车：刷新数据 2）ulimit ulimit -a：显示本用户的系统限制参
[经营与资产]保持独立性和稳定性对于软件开发的重要意义 comsci 软件开发
一个软件的架构从诞生到成熟，中间要经过很多次的修正和改造如果在这个过程中，外界的其它行业的资本不断的介入这种软件架构的升级过程中那么软件开发者原有的设计思想和开发路线
在CentOS5.5上编译OpenJDK6 Cwind linux OpenJDK
几番周折终于在自己的CentOS5.5上编译成功了OpenJDK6，将编译过程和遇到的问题作一简要记录，备查。 0. OpenJDK介绍 OpenJDK是Sun（现Oracle）公司发布的基于GPL许可的Java平台的实现。其优点： 1、它的核心代码与同时期Sun（-> Oracle）的产品版基本上是一样的，血统纯正，不用担心性能问题，也基本上没什么兼容性问题；（代码上最主要的差异是
java乱码问题 dashuaifu java乱码问题 js中文乱码
swfupload上传文件参数值为中文传递到后台接收中文乱码在js中用setPostParams（{"tag" : encodeURI( document.getElementByIdx_x("filetag").value，"utf-8")}）; 然后在servlet中String t
cygwin很多命令显示command not found的解决办法 dcj3sjt126com cygwin
cygwin很多命令显示command not found的解决办法修改cygwin.BAT文件如下 @echo off D: set CYGWIN=tty notitle glob set PATH=%PATH%;d:\cygwin\bin;d:\cygwin\sbin;d:\cygwin\usr\bin;d:\cygwin\usr\sbin;d:\cygwin\us
[介绍]从 Yii 1.1 升级 dcj3sjt126com PHP yii2
2.0 版框架是完全重写的，在 1.1 和 2.0 两个版本之间存在相当多差异。因此从 1.1 版升级并不像小版本间的跨越那么简单，通过本指南你将会了解两个版本间主要的不同之处。如果你之前没有用过 Yii 1.1，可以跳过本章，直接从"入门篇"开始读起。请注意，Yii 2.0 引入了很多本章并没有涉及到的新功能。强烈建议你通读整部权威指南来了解所有新特性。这样有可能会发
Linux SSH免登录配置总结 eksliang ssh-keygen Linux SSH免登录认证 Linux SSH互信
转载请出自出处：http://eksliang.iteye.com/blog/2187265 一、原理我们使用ssh-keygen在ServerA上生成私钥跟公钥，将生成的公钥拷贝到远程机器ServerB上后,就可以使用ssh命令无需密码登录到另外一台机器ServerB上。生成公钥与私钥有两种加密方式，第一种是
手势滑动销毁Activity gundumw100 android
老是效仿ios，做android的真悲催！有需求：需要手势滑动销毁一个Activity 怎么办尼？自己写？不用~，网上先问一下百度。结果： http://blog.csdn.net/xiaanming/article/details/20934541 首先将你需要的Activity继承SwipeBackActivity，它会在你的布局根目录新增一层SwipeBackLay
JavaScript变换表格边框颜色 ini JavaScript html Web html5 css
效果查看：http://hovertree.com/texiao/js/2.htm代码如下，保存到HTML文件也可以查看效果： <html> <head> <meta charset="utf-8"> <title>表格边框变换颜色代码-何问起</title> </head> <body&
Kafka Rest : Confluent kane_xie kafka REST confluent
最近拿到一个kafka rest的需求，但kafka暂时还没有提供rest api（应该是有在开发中，毕竟rest这么火），上网搜了一下，找到一个Confluent Platform，本文简单介绍一下安装。这里插一句，给大家推荐一个九尾搜索，原名叫谷粉SOSO，不想fanqiang谷歌的可以用这个。以前在外企用谷歌用习惯了，出来之后用度娘搜技术问题，那匹配度简直感人。环境声明：Ubu
Calender不是单例 men4661273 单例 Calender
在我们使用Calender的时候，使用过Calendar.getInstance()来获取一个日期类的对象，这种方式跟单例的获取方式一样，那么它到底是不是单例呢，如果是单例的话，一个对象修改内容之后，另外一个线程中的数据不久乱套了吗？从试验以及源码中可以得出，Calendar不是单例。测试： Calendar c1 =
线程内存和主内存之间联系 qifeifei java thread
1， java多线程共享主内存中变量的时候，一共会经过几个阶段， lock:将主内存中的变量锁定，为一个线程所独占。 unclock:将lock加的锁定解除，此时其它的线程可以有机会访问此变量。 read:将主内存中的变量值读到工作内存当中。 load:将read读取的值保存到工作内存中的变量副本中。
schedule和scheduleAtFixedRate tangqi609567707 java timer schedule
原文地址：http://blog.csdn.net/weidan1121/article/details/527307 import java.util.Timer;import java.util.TimerTask;import java.util.Date; /** * @author vincent */public class TimerTest {
erlang 部署 wudixiaotie erlang
1.如果在启动节点的时候报这个错： {"init terminating in do_boot",{'cannot load',elf_format,get_files}} 则需要在reltool.config中加入 {app, hipe, [{incl_cond, exclude}]}, 2.当generate时，遇到： ERROR

让我们用 PyTorch 从头开始构建我们自己的 GPT 模型

内容

加载数据

双元语言模型

训练

谢谢你！

你可能感兴趣的:(PyTorch,GPT,大模型,机器学习,深度学习,计算机视觉,人工智能)