【发布时间】:2021-08-11 03:37:01
【问题描述】:
我一直在尝试导入我在 google 表格中拥有超过 100 行数据的表,但 read_html 函数只读取前 100 行,我该如何扩展或设置此行数限制?
A = pd.read_html('https://docs.google.com/spreadsheets/d/1SqqSwGUvYAA33eV_B93nPtOQshZ2TIf8XGgkc90lnpQ/view#gid=0')
C = np.array((np.array(A[0]))[2:,7:12])
C[0,0:3] = ("Día", "Vacunas a 0:00", "Vacunas Día")
F = np.zeros((99,5))
for i in range(1,98):
for j in range(1,5):
F[i,j] = float(C[i,j])
F = np.nan_to_num(F)
【问题讨论】:
-
没有看到您的代码,我们无法告诉您任何事情。你为什么使用
read_html?你在抓取网站吗?如果是这样,为什么? Google 拥有完整而强大的 API,可让您直接访问 Google 表格文件。在浏览器中,您的文件一次显示一个页面,您必须滚动才能获得其余部分。 -
@TimRoberts 你说得对,我的代码如下
A=pd.read_html('https://docs.google.com/spreadsheets/d/1SqqSwGUvYAA33eV_B93nPtOQshZ2TIf8XGgkc90lnpQ/view#gid=0') C=np.array((np.array(A[0]))[2:,7:12]) C[0,0:3]=("Día","Vacunas a 0:00","Vacunas Día") F=np.zeros((99,5)) for i in range(1,98): for j in range (1,5): F[i,j]=float(C[i,j]) F=np.nan_to_num(F)它是一个导入数据并将其转换为浮点数组的代码,我通过它进行进一步的操作。我对您所说的 API 不太了解,但肯定会调查它!谢谢
标签: python pandas dataframe google-sheets