【发布时间】:2022-01-15 11:00:48
【问题描述】:
我正在做一个自然语言处理项目。
为此,我使用来自 tensorflow 的一种热编码。
from keras.preprocessing.text import one_hot
我已经为一个特定的句子生成了一个数字序列。 即[7473, 7491, 6019, 5950, 7562, 1396, 4641, 7098, 135, 6836, 4566, 934, 5085, 5521, 5786, 第2854章
现在。我创建了一个 lstm 模型并希望使用 Flask API 进行部署。 但是,现在,最热门的不是为相同的句子生成相同的数字序列。
我曾尝试使用 pickle 文件保存一个热文件..但它没有奏效。
import joblib
joblib.dump(one_hot,"encoder.pkl")
我什至尝试在终端中使用 PythonHashSeed。他们只在同一时间在同一环境中工作。
!PYTHONHASHSEED=0
但它们都不适用于其他地方/未来用途。
是否有任何方法可以使用 dict、json 或任何其他方法保存一个热编码列表?
【问题讨论】:
-
那么您的问题是如何将数字列表保存到文件中?那里有很多答案。还是您在问如何使编码可重现?
-
我想保存编码字典 .. 就像现在编码器将“地球”转换为 100... “地球”,它应该给 100..
-
回答有用吗?
标签: python tensorflow nlp tensorflow2.0 one-hot-encoding