代码之家  ›  专栏  ›  技术社区  ›  NotSoShabby

在抓取网站时尝试对位置进行编码/解码

  •  1
  • NotSoShabby  · 技术社区  · 7 年前

    我试图刮一个网站,并在网址上得到的城市和社区参数。这些参数显示在以下编码中:

    例如城市-%E7%E9%F4%E4 例如-%E1%FA+%E2%EC%E9%ED

    任何工具的想法,以帮助我解码/编码这种类型或这种编码的名称甚至是什么都会很有帮助。

    注意:我用python抓取

    尝试使用python复制此操作时,我做到了:

    >>> import urllib.parse
    >>> diction = {"City": "חיפה"}
    >>> urllib.parse.urlencode(diction)
    

    输出为:

    'City=%D7%97%D7%99%D7%A4%D7%94'
    

    这似乎是朝着正确的方向迈出的一步,但仍然不是网站本身使用的编码。

    0 回复  |  直到 7 年前