【发布时间】:2018-04-16 16:13:59
【问题描述】:
我正在尝试使用加载的标记器对文本进行编码,但出现以下错误
AttributeError: 'Tokenizer' object has no attribute 'oov_token'
我包含以下代码:
from keras.preprocessing.text import Tokenizer
from keras.preprocessing import sequence
from keras.models import Model, Input, Sequential, load_model
import pickle
import h5py
maxlen = 100
tok = open('tokenizer.pickle', 'rb')
tokenizer = pickle.load(tok)
tok.close()
model = load_model('weights.h5')
def predict():
new_text = sequence.pad_sequences((tokenizer.texts_to_sequences(['heyyyy'])), maxlen=maxlen)
prediction = model.predict(new_text,batch_size=1,verbose=2)
问题出现在tokenizer.texts_to_sequences(['heyyyy']) 行上,我不知道为什么。是泡菜的问题吗? tokenizer.texts_to_sequences 与 'hey'、'heyy' 和 'heyyy' 一起使用。
感谢任何指导!
【问题讨论】:
-
你能发布你的完整代码吗?
-
我用所有代码更新了帖子
标签: python nlp keras pickle tokenize