【发布时间】:2021-09-23 09:12:32
【问题描述】:
我正在做多类语义分割(4类+背景)。我的掩码维度是 (256, 256, 3),输出掩码维度是 (256, 256, 5)。我拿了5,因为这是班级的数量。
骰子损失函数
inputs = inputs.view(-1)
targets = targets.view(-1)
intersection = (inputs * targets).sum() ---> error
dice = (2.*intersection + smooth)/(inputs.sum() + targets.sum() + smooth)
return 1 - dice
我应该怎么做才能使两个维度相同?掩码是从 TIF 文件中提取的。
【问题讨论】:
-
你能显示错误信息吗?
inputs和targets的形状是什么。另外,“我的掩码维度是 (256, 256, 3),输出掩码维度是 (256, 256, 5)” 这两个张量相对于inputs和 @ 987654327@? -
@Ivan 我正在做语义分割。输入图像大小为 (256, 256, 3),模型输出为 (256, 256, 5),因为图像中有 5 个标签。目标是大小为 (256, 256, 3) 的图像的掩码,即问题中的图像。
-
我已经提供了答案,见下文。
标签: deep-learning computer-vision pytorch image-segmentation