日韩久久久精品,亚洲精品久久久久久久久久久,亚洲欧美一区二区三区国产精品 ,一区二区福利

python之爬取百度貼吧

系統 1746 0

有道翻譯

            
              import urllib.request
import urllib.parse
url='http://fanyi.youdao.com/translate?smartresult=dict&smartresult=rule'   # 有道翻譯錯誤代碼50時,去掉translate_o?的_o
headers={"User-Agent":"Mozilla/5.0 (Windows NT 6.1; Win64; x64; rv:69.0) Gecko/20100101 Firefox/69.0"}   # 編碼錯誤時,檢查用戶代理是否有省略號
formdata={
    "i":"你",        # 要翻譯的內容 
    "from":"en",     # 翻譯成英文
    "to":"zh-CHS",   # 從中文
    "smartresult":"dict",
    "client":"fanyideskweb",
    "doctype":"json",
    "version":"2.1",
    "keyfrom":"fanyi.web",
    "action":"FY_BY_CLICKBUTTION"
}
data=urllib.parse.urlencode(formdata).encode('utf-8')
request=urllib.request.Request(url,data=data,headers=headers)
response=urllib.request.urlopen(request)
print(response.read().decode('utf-8'))

            
          

在這里插入圖片描述 requests庫的使用:

            
              import requests
url="https://tieba.baidu.com/f?"
param={"kw":"囚徒健身"}
headers={"User-Agent":"Mozilla/5.0 (Windows NT 6.1; Win64; x64; rv:69.0) Gecko/20100101 Firefox/69.0"}
res=requests.get(url,params=param,headers=headers)
print(res.text)

            
          

python之爬取百度貼吧_第1張圖片
爬取百度貼吧的網頁

            
              import requests
def tieba_spider(url,begin_page,end_page):
    for page in range(begin_page,end_page):
        pn=(page-1)*50
        file_name="第"+str(page)+"頁.html"
        full_url=url+"&pn="+str(pn)
        html=load_page(full_url,file_name)
        write_page(html,file_name)
def load_page(url,filename):
    headers={"User-Agent":"Mozilla/5.0 (Windows NT 6.1; Win64; x64; rv:69.0) Gecko/20100101 Firefox/69.0"}
    return requests.get(url,params=param,headers=headers).text
def write_page(html,filename):
    print("正在保存"+filename)
    with open(filename,'w',encoding='utf-8') as file:
        file.write(html)
if __name__=="__main__":
    kw=input("請輸入需要爬取的貼吧名:")
    begin_page=int(input("請輸入起始頁:"))
    end_page=int(input("請輸入結束頁:"))
    url="https://tieba.baidu.com/f?"
    param={"kw":kw}
    tieba_spider(url,begin_page,end_page)

            
          

python之爬取百度貼吧_第2張圖片
python之爬取百度貼吧_第3張圖片


更多文章、技術交流、商務合作、聯系博主

微信掃碼或搜索:z360901061

微信掃一掃加我為好友

QQ號聯系: 360901061

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描下面二維碼支持博主2元、5元、10元、20元等您想捐的金額吧,狠狠點擊下面給點支持吧,站長非常感激您!手機微信長按不能支付解決辦法:請將微信支付二維碼保存到相冊,切換到微信,然后點擊微信右上角掃一掃功能,選擇支付二維碼完成支付。

【本文對您有幫助就好】

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描上面二維碼支持博主2元、5元、10元、自定義金額等您想捐的金額吧,站長會非常 感謝您的哦?。?!

發表我的評論
最新評論 總共0條評論
主站蜘蛛池模板: 疏附县| 新野县| 咸阳市| 文成县| 宝应县| 九龙坡区| 依安县| 泰州市| 深州市| 中阳县| 偏关县| 台南县| 贞丰县| 娄底市| 临江市| 盐山县| 平远县| 锡林浩特市| 禄劝| 唐河县| 锦州市| 陆丰市| 炉霍县| 虹口区| 衡南县| 河北区| 四平市| 通城县| 绵阳市| 西乡县| 隆尧县| 五河县| 高碑店市| 辽中县| 古浪县| 凯里市| 桐乡市| 涞源县| 云龙县| 方城县| 微博|