当前位置：首页 > article >正文

研1日记9

article 2025/1/11 2:21:06

1.理解conv1d和conv2d

a. 1和2处理的数据不同，1维数据和图像

b. 例如x输入形状为(32,19,512)时，卷积公式是针对512的，而19应该变换为参数中指定的输出通道。

2.“SE块”（Squeeze-and-Excitation Block）它可以帮助模型自动学习不同特征的重要性，然后增强有用的特征，抑制不那么重要的特征。SE块的工作流程就是：首先通过自适应平均池化“挤压”出全局信息，然后通过两次一维卷积和ReLU激活函数学习不同特征的重要性，最后通过Sigmoid函数将这些重要性转换为0到1之间的权重。这些权重随后可以用于对原始特征图进行重新标定，即根据权重增强或抑制不同的特征。

3.Pointwise Convolution（点卷积）

点卷积，也称为1x1卷积，是一种特殊的卷积操作，其中卷积核的大小为1x1（对于二维卷积是1x1x输入通道数，对于一维卷积是1x输入通道数）。这种卷积操作不会改变输入数据在空间维度（对于一维数据是长度，对于二维数据是高度和宽度）上的大小，但它可以改变数据的深度（即通道数），常用于构建更复杂的网络结构。

4. 位置编码

pos：位置，0~seq_len-1

i: 0~embedding/2 embedding = dmodel

5. zip （），对三维数组迭代时：

for x in zip（X）：，X形状为（3,4,5）,则循环3次，x的形状是（4,5）

6. torch.stack 把多个2维的张量合成一个3维的张量

7.如果你有一个形状为(3, 4, 5)的tensor，并且你调用.sum(dim=0)，那么你会沿着第一个维度（大小为3的那个维度）求和，结果是一个形状为(4, 5)的tensor，因为第一个维度被求和掉了。

8.torch.max ,0是行，1是列

9. loss 和train_loss 的计算

9. 当你在使用val_loader（或任何用于验证/测试的数据加载器）时，你会使用model.train()时训练好的参数。但是，重要的是要注意，尽管你使用的是训练好的参数，但在进行验证或测试时，你应该将模型设置为评估模式（使用model.eval()），而不是训练模式。

http://www.kler.cn/a/301795.html

相关文章：

ue5 蒙太奇，即上半身动画和下半身组合在一起，并使用。学习b站库得科技

Nature Electronics——近传感器计算：50 nm异构集成技术的革命

OpenAI CEO 奥特曼发长文《反思》

uniapp实现后端数据i18n国际化

数仓建模：如何判断一个数仓模型的好坏？

Redis 数据库源码分析

【C++多线程编程】线程安全与对象生命周期管理

Docker Compose与私有仓库部署

10分钟在企业微信中集成一个 AI 助手

汽车EDI：montaplast EDI对接

XWiki中添加 html 二次编辑失效

C# WinForm：禁用Panel容器滚动条自动移动位置的功能

leetcode 刷题周报（9.3-9.10）

java框架第五课(终极版本)SpringBoot

QT 中使用QXlsx 读写文件

Linux学习-Docker文件系统

3. 轴指令（omron 机器自动化控制器）——＞MC_PowerMC_MoveJog

mysql的zip解压缩版安装

MySQL根据日期统计时没有数据的日期也需要返回0

图计算：基于SparkGrpahX计算聚类系数

在Linux系统中“普通场景”下隐匿操作痕迹

算法学习攻略总结 : 入门至进阶，通关之路指南

jmeter依赖jar包找不到类路径

CTF（misc）

微调语言模型前，需要考虑这三个关键方面

pwn题目搭建过程中glibc出现问题的解决方案