การสูญเสียการตรวจสอบและความถูกต้องยังคงอยู่


12

ฉันพยายามที่จะใช้กระดาษนี้ในชุดของภาพทางการแพทย์ ฉันกำลังทำอยู่ใน Keras เครือข่ายประกอบด้วยเลเยอร์ Conv 4 และ max-pool ตามด้วยเลเยอร์ที่เชื่อมต่อเต็มที่และซอฟต์แวร์ลักษณนามสูงสุด

เท่าที่ฉันรู้ฉันได้ปฏิบัติตามสถาปัตยกรรมที่กล่าวถึงในกระดาษ อย่างไรก็ตามการสูญเสียการตรวจสอบและความถูกต้องเพียงแค่คงอยู่ตลอด ความแม่นยำดูเหมือนจะถูกแก้ไขที่ ~ 57.5%

ความช่วยเหลือใด ๆ ที่ฉันอาจจะผิดพลาดจะได้รับการชื่นชมอย่างมาก

รหัสของฉัน:

from keras.models import Sequential
from keras.layers import Activation, Dropout, Dense, Flatten  
from keras.layers import Convolution2D, MaxPooling2D
from keras.optimizers import SGD
from keras.utils import np_utils
from PIL import Image
import numpy as np
from sklearn.utils import shuffle
from sklearn.cross_validation import train_test_split
import theano
import os
import glob as glob
import cv2
from matplotlib import pyplot as plt

nb_classes = 2
img_rows, img_cols = 100,100
img_channels = 3


#################### DATA DIRECTORY SETTING######################

data = '/home/raghuram/Desktop/data'
os.chdir(data)
file_list = os.listdir(data)
##################################################################

## Test lines
#I = cv2.imread(file_list[1000])
#print np.shape(I)
####
non_responder_file_list = glob.glob('0_*FLAIR_*.png')
responder_file_list = glob.glob('1_*FLAIR_*.png')
print len(non_responder_file_list),len(responder_file_list)

labels = np.ones((len(file_list)),dtype = int)
labels[0:len(non_responder_file_list)] = 0
immatrix = np.array([np.array(cv2.imread(data+'/'+image)).flatten() for image in file_list])
#img = immatrix[1000].reshape(100,100,3)
#plt.imshow(img,cmap = 'gray')


data,Label = shuffle(immatrix,labels, random_state=2)
train_data = [data,Label]
X,y = (train_data[0],train_data[1])
# Also need to look at how to preserve spatial extent in the conv network
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.3, random_state=4)
X_train = X_train.reshape(X_train.shape[0], 3, img_rows, img_cols)
X_test = X_test.reshape(X_test.shape[0], 3, img_rows, img_cols)
X_train = X_train.astype('float32')
X_test = X_test.astype('float32')

X_train /= 255
X_test /= 255

Y_train = np_utils.to_categorical(y_train, nb_classes)
Y_test = np_utils.to_categorical(y_test, nb_classes)

model = Sequential()

## First conv layer and its activation followed by the max-pool layer#
model.add(Convolution2D(16,5,5, border_mode = 'valid', subsample = (1,1), init = 'glorot_normal',input_shape = (3,100,100))) # Glorot normal is similar to Xavier initialization
model.add(Activation('relu'))
model.add(MaxPooling2D(pool_size = (2,2),strides = None))
# Output is 48x48

print 'First layer setup'
###########################Second conv layer#################################
model.add(Convolution2D(32,3,3,border_mode = 'same', subsample = (1,1),init = 'glorot_normal'))
model.add(Activation('relu'))
model.add(Dropout(0.6))
model.add(MaxPooling2D(pool_size = (2,2),strides = None))
#############################################################################

print ' Second layer setup'
# Output is 2x24

##########################Third conv layer###################################
model.add(Convolution2D(64,3,3, border_mode = 'same', subsample = (1,1), init = 'glorot_normal'))
model.add(Activation('relu'))
model.add(Dropout(0.6))
model.add(MaxPooling2D(pool_size = (2,2),strides = None))
#############################################################################
# Output is 12x12

print ' Third layer setup'
###############################Fourth conv layer#############################
model.add(Convolution2D(128,3,3, border_mode = 'same', subsample = (1,1), init = 'glorot_normal'))
model.add(Activation('relu'))
model.add(Dropout(0.6))
model.add(MaxPooling2D(pool_size = (2,2),strides = None))
############################################################################# 

print 'Fourth layer setup'

# Output is 6x6x128
# Create the FC layer of size 128x6x6#
model.add(Flatten()) 
model.add(Dense(2,init = 'glorot_normal',input_dim = 128*6*6))
model.add(Dropout(0.6))
model.add(Activation('softmax'))

print 'Setting up fully connected layer'
print 'Now compiling the network'
sgd = SGD(lr=0.01, decay=1e-4, momentum=0.6, nesterov=True)
model.compile(loss = 'mse',optimizer = 'sgd', metrics=['accuracy'])

# Fit the network to the data#
print 'Network setup successfully. Now fitting the network to the data'
model. fit(X_train,Y_train,batch_size = 100, nb_epoch = 20, validation_split = None,verbose = 1)
print 'Testing'
loss,accuracy = model.evaluate(X_test,Y_test,batch_size = 32,verbose = 1)
print "Test fraction correct (Accuracy) = {:.2f}".format(accuracy)

การสูญเสียการฝึกอบรมลดลงหรือไม่
Jan van der Vegt

ไม่การสูญเสียการฝึกอบรมยังคงที่ตลอด
Raghuram

คุณยังไม่ได้ตั้งค่าข้อมูลการตรวจสอบความถูกต้องหรือ validation_split ในการโทรแบบพอดีมันจะตรวจสอบอะไรบ้าง หรือคุณหมายถึงการทดสอบ?
Jan van der Vegt

นั่นคือหลังจากการทดลองรอบ ๆ ฉันตั้งค่า validation_split = 0.2 ก่อนที่จะตั้งค่าเป็นไม่มีและทดลองรอบ ๆ ด้วย
Raghuram

2
คุณสามารถใส่หนึ่งชุดสำหรับหลาย ๆ ครั้งเพื่อดูว่าคุณจะได้รับการฝึกอบรมที่ลดลงหรือไม่?
แจนแวนเดอร์เวอท์ท์

คำตอบ:


4

ดูเหมือนว่าคุณใช้ MSE เป็นฟังก์ชั่นการสูญเสียจากการเหลือบบนกระดาษดูเหมือนว่าพวกเขาใช้ NLL (cross entropy), MSE ถือว่ามีแนวโน้มที่จะอ่อนไหวต่อความไม่สมดุลของข้อมูลท่ามกลางปัญหาอื่น ๆ และอาจเป็นสาเหตุของปัญหาของคุณ ประสบการณ์ฉันจะลองฝึกอบรมโดยใช้การสูญเสีย categorical_crossentropy ในกรณีของคุณนอกจากนี้อัตราการเรียนรู้ที่ 0.01 ดูเหมือนว่าใหญ่เกินไปฉันจะลองเล่นกับมันและลอง 0.001 หรือแม้แต่ 0.0001


2

แม้ว่าฉันจะสายไปนิดหน่อยฉันอยากจะใส่สองเซ็นต์ไว้เพราะมันช่วยฉันแก้ปัญหาที่คล้ายกันเมื่อเร็ว ๆ นี้ สิ่งที่มาช่วยเหลือฉันคือการปรับคุณสมบัติให้อยู่ในช่วง (0,1) นอกเหนือจากการสูญเสียข้ามเอนโทรปีอย่างเด็ดขาด อย่างไรก็ตามมันก็คุ้มค่าที่จะบอกว่าการปรับขนาดคุณสมบัติจะช่วยได้ก็ต่อเมื่อคุณลักษณะนั้นเป็นของตัวชี้วัดที่แตกต่างกันและมีวิธีการแปรผันมากขึ้น (ตามลำดับของขนาด) เมื่อเปรียบเทียบกับอีกแบบ นอกจากนี้การปรับสเกลอาจมีประโยชน์จริง ๆ หากใช้การhingeสูญเสียเนื่องจากตัวจําแนก max-margin มักไวต่อระยะทางระหว่างค่าคุณลักษณะ หวังว่านี่จะช่วยผู้เข้าชมในอนาคต!

โดยการใช้ไซต์ของเรา หมายความว่าคุณได้อ่านและทำความเข้าใจนโยบายคุกกี้และนโยบายความเป็นส่วนตัวของเราแล้ว
Licensed under cc by-sa 3.0 with attribution required.