【发布时间】:2012-01-12 19:38:57
【问题描述】:
客户端浏览器正在发送标头HTTP_ACCEPT_CHARSET: ISO-8859-1,utf-8;q=0.7,*;q=0.3。我只提供带有正确标题的 utf8 网页,但浏览器正在发布来自使用 ISO-8859-1 字符集编码的表单的数据。我的问题是,浏览器是否总是更喜欢按其 ACCEPT_CHARSET 标头顺序排列的字符集,以便我可以可靠地编写一个中间件,该中间件将使用第一个条目(在本例中为 ISO-8859-1)解码任何已发布的数据,并将其编码为 utf8。
更新:
我用accept-charset="utf-8" 更新了表单标签,但我仍然看到出现非Unicode 字符。用户从其他地方(lastpass、excel 文件)复制/粘贴密码是否可能会注入非 unicode 字符?
【问题讨论】:
标签: python html character-encoding