【发布时间】:2018-12-29 07:25:18
【问题描述】:
我有点新手。所以我试图解析html页面并将内容放在MySQL的列中,但是我似乎无法让实际的外来字符出现,例如我得到xc3xa1而不是á。我的表有 utf8mb4 作为其字符集和排序规则 utf8mb4_unicode_ci。我有以下设置:
Database_cnx = pymysql.connect(user='XXXX', password='XXXX',
host='XXXX',
database='XXXX',
use_unicode=True,
charset='utf8mb4')
article_content = str(row[3].encode("utf-8")).replace("'", "\'").replace("\"", "\'")
q_i = ("INSERT INTO article_items (" + ", ".join(article_table_col_name_new) + ")"
"VALUES ({:d}, \"{:s}\", \"{:s}\", \"{:s}\", \"{:s}\", \"{:s}\", \"{:s}\")".format(row[0], urlparse(row[1]).netloc, row[1], row[2].replace("\"", "'"), article_content, datetime.fromtimestamp(row[4]).strftime("%Y-%m-%d"), updated)
)
那么我怎样才能让我的专栏中只出现实际的文章内容,而不是 b' 字节和 utf-8 文字。谢谢
【问题讨论】:
标签: python mysql utf-8 python-3.5 utf8mb4