【发布时间】:2019-02-07 05:35:26
【问题描述】:
假设我们有 2 个组中的 6 个文本文件,每个组由 3 个文件组成,例如,
- 第 1 组:1.a、1.b、1.c
- 第 2 组:2.a、2.b、2.c
给定一个固定阈值rand 和来自random 模块的random(),我希望得到3 个张量:
- x 组:x_a、x_b、x_c
其中每个文件的行数相同且对齐,x_a 的第 n 行将是:
- 第一步:
'<nth line from 1.a>' if rand < random() else '<nth line from 2.a>'
x_b 和 x_c 的第 n 行也将是:
- 第二步:
<'nth line from 1.b>' if '<nth row of x_a from 1.a>' else '<nth line from 2.b>' - 第 3 步:
<'nth line from 1.c>' if '<nth row of x_a from 1.a>' else '<nth line from 2.c>'(按照第 2 步但适用于 x_c)
使得 x_a、x_b 和 x_c 都对齐。
我使用的工具是tf.data.TextLineDataset,你能告诉我如何进行随机选择并保持选择轨迹吗?谢谢!
【问题讨论】:
标签: python tensorflow-datasets