【发布时间】:2018-12-26 13:55:45
【问题描述】:
我正在使用带有 tensorflow 后端的 keras。我的目标是在 custom loss 函数中查询当前批次的batchsize。这是计算自定义损失函数的值所必需的,这些值取决于特定观察的索引。鉴于下面的最小可重复示例,我想更清楚地说明这一点。
(顺便说一句:我当然可以使用为训练过程定义的批量大小,并在定义自定义损失函数时插入它的值,但是这可能会有所不同,特别是如果epochsize % batchsize(epochsize modulo batchsize)不等零,那么最后一批epoch的大小不同。我在stackoverflow中没有找到合适的方法,尤其是例如
Tensor indexing in custom loss function 和 Tensorflow custom loss function in Keras - loop over tensor 和 Looping over a tensor 因为显然在构建图形时无法推断出任何张量的形状,这是损失函数的情况 - 只有在评估给定数据时才能进行形状推断,这只是可能给定图表。因此,我需要告诉自定义损失函数在不知道维度长度的情况下沿某个维度对特定元素执行某些操作。
(这在所有示例中都是相同的)
from keras.models import Sequential
from keras.layers import Dense, Activation
# Generate dummy data
import numpy as np
data = np.random.random((1000, 100))
labels = np.random.randint(2, size=(1000, 1))
model = Sequential()
model.add(Dense(32, activation='relu', input_dim=100))
model.add(Dense(1, activation='sigmoid'))
示例 1:没有什么特别的问题,没有自定义损失
model.compile(optimizer='rmsprop',
loss='binary_crossentropy',
metrics=['accuracy'])
# Train the model, iterating on the data in batches of 32 samples
model.fit(data, labels, epochs=10, batch_size=32)
(省略输出,运行良好)
示例 2:没什么特别的,有一个相当简单的自定义损失
def custom_loss(yTrue, yPred):
loss = np.abs(yTrue-yPred)
return loss
model.compile(optimizer='rmsprop',
loss=custom_loss,
metrics=['accuracy'])
# Train the model, iterating on the data in batches of 32 samples
model.fit(data, labels, epochs=10, batch_size=32)
(省略输出,运行良好)
示例 3:问题
def custom_loss(yTrue, yPred):
print(yPred) # Output: Tensor("dense_2/Sigmoid:0", shape=(?, 1), dtype=float32)
n = yPred.shape[0]
for i in range(n): # TypeError: __index__ returned non-int (type NoneType)
loss = np.abs(yTrue[i]-yPred[int(i/2)])
return loss
model.compile(optimizer='rmsprop',
loss=custom_loss,
metrics=['accuracy'])
# Train the model, iterating on the data in batches of 32 samples
model.fit(data, labels, epochs=10, batch_size=32)
当然,张量还没有形状信息,这在构建图形时无法推断,只能在训练时推断。因此for i in range(n) 出现错误。有没有办法做到这一点?
-------
顺便说一句,如果有任何问题,这是我真正的自定义损失函数。为了清楚和简单起见,我在上面跳过了它。
def neg_log_likelihood(yTrue,yPred):
yStatus = yTrue[:,0]
yTime = yTrue[:,1]
n = yTrue.shape[0]
for i in range(n):
s1 = K.greater_equal(yTime, yTime[i])
s2 = K.exp(yPred[s1])
s3 = K.sum(s2)
logsum = K.log(y3)
loss = K.sum(yStatus[i] * yPred[i] - logsum)
return loss
这是 cox 比例风险模型的部分负对数似然图。
这是为了澄清 cmets 中的一个问题以避免混淆。我认为没有必要详细了解这一点来回答这个问题。
【问题讨论】:
-
答案是:不要迭代。我会帮忙,但是你的损失函数中有很多奇怪的东西,我无法理解。但是您知道
yTrue和yPred具有始终相同的形状,对吧?以你为例,没有yTrue[:,1]。 -
我添加了损失函数的图片。尽管确实没有必要克服这个问题(示例 3),但我想避免混淆。
-
亲爱的丹尼尔,感谢您的时间和精力。我发现了两种解决方案(1)一种使用循环的非高效解决方案(2)一种使用 tensorflow 后端及其矢量化的解决方案。在我做了一些改进后,我会在这里发布并回答你所有的问题。
-
@Thomas,你是怎么解决这个问题的?可以发在这里吗?我真的很想知道。
-
@DanielMöller,其实y_pred和y_true可以有不同的形状……
标签: python tensorflow keras loss-function