Keras网络层之常用层Core

常用层

常用层对应于core模块，core内部定义了一系列常用的网络层，包括全连接、激活层等

Dense层

keras.layers.core.Dense(units, activation=None, use_bias=True, kernel_initializer=‘glorot_uniform‘, bias_initializer=‘zeros‘, kernel_regularizer=None, bias_regularizer=None, activity_regularizer=None, kernel_constraint=None, bias_constraint=None)

Dense就是常用的全连接层，所实现的运算是output = activation(dot(input ,kernel) + bias ).其中activation是逐元素计算的激活函数，kernel是本层的权值矩阵，bias为偏置向量，只有当use_bias=True才会添加。

如果本层的输入数据的维度大于2，则会先被压为与kernel相匹配的大小。

#as first Layer in a sequential model:
#as first Layer in a sequential model:
model = Sequential()
model.add(Dense(32, input_shape=(16,)))
#now the model will take as input arrays of shape(* , 16)
#and output arrays of shape (* , 32)
#after the first layer , you don‘t need to specify
#the size of the input anymore:
model.add(Dense(32))

units：大于0的整数，代表该层的输出维度
activation：激活函数，为预定义的激活函数名，或逐元素（element-wise）的Theano函数。如果不指定该参数，将不会使用任何激活函数（即使用线性激活函数：a（x） = x）
use_bias：布尔值，是否使用偏置项
kernel_initializer：权值初始化方法，为预定义初始化方法名的字符串，或用于初始化权重的初始化器。
bias_initializer：权值初始化方法，为预定义初始化方法名的字符串，或用于初始化权重的初始化器。
kernel_regularizer：施加在权重上的正则项，为Regularizer对象
bias_regularizer：施加在偏置向量上的正则项，为Regularizer对象
activity_regularizer：施加在输出上的正则项，为Regularizer对象
kernel_constraints：施加在权重上的约束项，为Constraints对象
bias_constraints：施加在偏置上的约束项，为Constraints对象

输入

形如（batch_size，.......，input_dim）的nD张量，最常见的情况为(batch_size，input_dim)的2D张量

输出

形如（batch_size，..........，units）的nD张量，最常见的情况为（batch_size，units）的2D张量

Activation层

keras.layers.core.Activation(activation)

激活层对一个层的输出施加激活函数

参数

activation：将要使用的激活函数，为预定义激活函数名或一个Tensorflow/theano的函数。

输入shape

任意，当使用激活层作为第一层时，要指定input_shape

输出shape

与输入shape相同

Dropout层

keras.layers.core.Dropout(rate , noise_shape=None ,seed=None)

为输入数据施加Dropout。Dropout将在训练过程中每次更新参数时按一定概率(rate)随机断开输入神经元，Dropout层用于防止过拟合。

参数

rate：0~1的浮点数，控制需要断开的神经元的比例
noise_shape：整数张量，为将要应用在输入上的二值Dropout mask的shape，例如你的输入为（batch_size，timesteps，features），并且你希望在各个时间步上的Dropout mask都相同，则可传入noise_shape=（batch_size，1，features）
seed：整数，使用随机数种子

Flatten层

keras.layers.core.Flatten()

Flatten层用来将输入“压平”，即把多维的输入一维化，常用在从卷积层到全连接层的过度。Flatten不影响batch的大小。

例子

model = Sequential()
model.add(Convolution2D(64,3,3,border_mode=‘same‘,input_shape=(3,32,32)))

#now:model.output_shape ==(None,64,32,32)

model.add(Flatten())
#now:model.output_shape == (None,65536)

Reshape层

keras.layers.core.Reshape(target_shape)

Reshape层用来将输入shape转换为特定的shape

参数

target_shape：目标shape，为整数的tuple，不包含样本数目的维度（batch大小）

输入shape

任意，但输入的shape必须固定。当使用该层为模型首层时，需要指定input_shape参数

输出shape

(batch_size,)+target_shape

例子

#as first Layer in a Sequential model
model = Sequential()
model.add(Reshape((3,4),input_shape=(12,)))
#now:model.output_shape == (None,3,4)
#note: ‘None‘ is the batch dimension

# as intermediate layer in a Sequential model
model.add(Reshape((6, 2)))
# now: model.output_shape == (None, 6, 2)

# also supports shape inference using `-1` as dimension
model.add(Reshape((-1, 2, 2)))
# now: model.output_shape == (None, 3, 2, 2)

Permute层

keras.layers.core.Permute(dims)

Permute层将输入的维度按照给定模式进行重排，例如，当需要将RNN和CNN网络连接时，可能会用到该层。

参数

dims：整数tuple，指定重排的模式，不包含样本数的维度。重排模式的下标从1开始。例如（2,1）代表将输入的第二个维度重排到第二个维度

例子

model = Sequential()
model.add(Permute((2,1), input_shape=(10,64)))
#now:model.output_shape == (None, 64,10)
#note: ‘None‘ is the batch dimension

输入shape

任意，当使用激活层作为第一层时，要指定input_shape

输出shape

与输入相同，但是其维度按照指定的模式重新排列

RepeatVecor层

keras.layers.core.RepeatVector(n)

RepeatVector层将输入重复n次

参数

n：整数，重复的次数

输入shape

形如（nb_samples，features）的2D张量

输出shape

形如（nb_samples，features）的3D张量

例子

model = Sequential()
model.add(Dense(32,input_dim=32))

#now:model.output_shape == (None,32)
#note:‘None‘ is the batch dimension

model.add(RepeatVector(3))
#now:model.output_shape == (None,3,32)

Lambda层

keras.layers.core.Lambda(function,output_shape,mask=None,arguments=None)

本函数用以对上一层的输出施以任何Theano/TensorFlow表达式

参数

function：要实现的函数，该函数仅接受一个变量，即上一层的输出
output_shape：函数应该返回的值的shape，可以是一个tuple，也可以是一个根据输入shape计算输出的shape的函数
mask：掩膜
arguments：可选，字典，用来记录向函数中传递的其他关键字参数

例子

# add a x -> x^2 layer
model.add(Lambda(lambda x: x ** 2))

def antirectifier(x):
    x -= K.mean(x, axis=1, keepdims=True)
    x = K.l2_normalize(x, axis=1)
    pos = K.relu(x)
    neg = K.relu(-x)
    return K.concatenate([pos, neg], axis=1)

def antirectifier_output_shape(input_shape):
    shape = list(input_shape)
    assert len(shape) == 2  # only valid for 2D tensors
    shape[-1] *= 2
    return tuple(shape)

model.add(Lambda(antirectifier,
         output_shape=antirectifier_output_shape))

输入shape

任意，当使用该层作为第一层时，要指定input_shape

输出shape

由output_shape参数指定的输出shape，当使用tensorflow时可自动推断

ActivityRegularizer层

keras.layers.core.ActivityRegularization(l1=0.0,l2=0.0)

经过本层的数据不会有任何变化，但会基于其激活值更新损失函数值

参数

l1:1范数正则因子（正浮点数）
l2:2范数正则因子（正浮点数）

输入shape

任意，当使用该层作为第一层时，要指定input_shape

输出shape

与输入shape相同

Masking层

keras.layers.core.Masking(mask_value=0.0)

使用给定的值对输入的序列信号进行“屏蔽”，用以定位需要跳过的时间步

对于输入张量的时间步，即输入张量的第1维度（维度从0开始算），如果输入张量在该时间步上都等于mask_value，则该时间步在模型接下来的所有层（只需要支持masking）被跳过（屏蔽）。

如果模型接下来的一些层不支持masking，却接受到masking过的数据，则抛出异常，则抛出异常。

例子

考虑输入数据x是一个形如（samples，timesteps，features）的张量，现将其送入LSTM层。因为你缺少时间步为3和5的信号，所以你希望将其掩盖。这时候应该：

赋值x[:,3,:] = 0. , x[:,5,:] = 0.
在LSTM层之前插入mask_value=0.的Masking

model = Sequential()
model.add(Masking(mask_value=0,input_shape=(timesteps,features)))
model.add(LSTM(32))

时间： 2024-10-05 21:00:32

Keras网络层之常用层Core的相关文章

Keras网络层之卷积层

卷积层 Cov1D层 keras.layers.convolutional.Conv1D(filters, kernel_size, strides=1, padding='valid', dilation_rate=1, activation=None, use_bias=True, kernel_initializer='glorot_uniform', bias_initializer='zeros', kernel_regularizer=None, bias_regularizer=N

17、Cocos2dx 3.0游戏开发找小三之内置的常用层：三剑客LayerColor、LayerGradient、Menu

重开发者的劳动成果,转载的时候请务必注明出处:http://blog.csdn.net/haomengzhu/article/details/30477587 为了方便游戏开发者,Cocos2d-x 内置了 3 种特殊的 Layer: 具体如下所示: LayerColor:一个单纯的实心色块. LayerGradient:一个色块,但可以设置两种颜色的渐变效果. Menu:十分常用的游戏菜单. LayerColor 与与 LayerGradient 这两个层十分简单,都仅仅包含一个色块. 不同

Cocos2d-x内置的常用层

为了方便游戏开发者,Cocos2d-x内置了3种特殊的CCLayer,具体如下所示. CCLayerColor:一个单纯的实心色块. CCLayerGradient:一个色块,但可以设置两种颜色的渐变效果. CCMenu:十分常用的游戏菜单 CCLayerColor与CCLayerGradient 这两个层十分简单,都仅仅包含一个色块.不同的是,前者创建的是一个实色色块,而后者创建的是一个渐变色块.图3-7 展示了 Cocos2d-x 测试样例中 CCLayerColor 与 CCLayerGr

转 Caffe学习系列(5)：其它常用层及参数

本文讲解一些其它的常用层,包括:softmax_loss层,Inner Product层,accuracy层,reshape层和dropout层及其它们的参数配置. 1.softmax-loss softmax-loss层和softmax层计算大致是相同的.softmax是一个分类器,计算的是类别的概率(Likelihood),是Logistic Regression 的一种推广.Logistic Regression 只能用于二分类,而softmax可以用于多分类. softmax与softm

【转】Caffe初试（七）其它常用层及参数

本文讲解一些其它的常用层,包括:softmax-loss层,Inner Product层,accuracy层,reshape层和dropout层及它们的参数配置. 1.softmax-loss softmax-loss层和softmax层计算大致是相同的.softmax是一个分类器,计算的是类别的概率(Likelihood),是Logistic Regression的一种推广. Logistic Regression只能用于二分类,而softmax可以用于多分类. softmax与softmax

网络协议概述：物理层、连接层、网络层、传输层、应用层详解（转载）

这篇文章主要介绍了网络协议概述:物理层.连接层.网络层.传输层.应用层详解,本文用生活中的邮差与邮局来帮助理解复杂的网络协议,通俗易懂,文风幽默,是少见的好文章,需要的朋友可以参考下信号的传输总要符合一定的协议(protocol).比如说长城上放狼烟,是因为人们已经预先设定好狼烟这个物理信号代表了“敌人入侵”这一抽象信号.这样一个“狼烟=敌人入侵”就是一个简单的协议.协议可以更复杂,比如摩尔斯码(Morse Code),使用短信号和长信号的组合,来代表不同的英文字母.比如SOS(***---*

Caffe学习系列(5)：其它常用层及参数

网络协议分为哪几层---物理层，连接层，网络层，传输层，应用层详解

这篇文章主要介绍了网络协议概述:物理层.连接层.网络层.传输层.应用层详解,本文用生活中的邮差与邮局来帮助理解复杂的网络协议,通俗易懂,文风幽默,是少见的好文章,需要的朋友可以参考下信号的传输总要符合一定的协议(protocol).比如说长城上放狼烟,是因为人们已经预先设定好狼烟这个物理信号代表了"敌人入侵"这一抽象信号.这样一个"狼烟=敌人入侵"就是一个简单的协议.协议可以更复杂,比如摩尔斯码(Morse Code),使用短信号和长信号的组合,来代表不同的英文字

Keras网络层之“关于Keras的层(Layer)”

关于Keras的"层"(Layer) 所有的Keras层对象都有如下方法: layer.get_weights():返回层的权重(numpy array) layer.set_weights(weights):从numpy array中将权重加载到该层中,要求numpy array的形状与layer.get_weights()的形状相同 layer.get_config():返回当前层配置信息的字典,层也可以借由配置信息重构: layer = Dense(32) config = la