【发布时间】:2020-11-09 20:58:38
【问题描述】:
我正在做一个简单的垃圾邮件/垃圾邮件文本分类。我的 Keras NN 进行了适当的训练和评估;但是,当我尝试预测以下格式的新文本时,出现“IndexError: list index out of range”错误:
model.predict(cleaning_funcs('my bus departs in five minutes'))
如果有帮助,我还使用了以下内容:
from keras.preprocessing.text import Tokenizer
tokenizer = Tokenizer(num_words=5000)
tokenizer.fit_on_texts(x_train)
x_train = tokenizer.texts_to_sequences(x_train)
x_test = tokenizer.texts_to_sequences(x_test)
vocab_size = len(tokenizer.word_index) + 1
print(x_train[2])
from keras.preprocessing.sequence import pad_sequences
maxlen = 100
x_train = pad_sequences(x_train, padding='post', maxlen=maxlen)
x_test = pad_sequences(x_test, padding='post', maxlen=maxlen)
【问题讨论】:
标签: python machine-learning keras neural-network data-analysis