亚洲影院天堂中文AV色,国产激情精品一区二区三区 ,一级片一级片免费观看

人妖在线一区,国产日韩欧美一区二区综合在线,国产啪精品视频网站免费,欧美内射深插日本少妇

公司動(dòng)態(tài)

產(chǎn)品資訊

行業(yè)資訊

自定義函數(shù)

import requests
from bs4 import BeautifulSoup
headers={'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:93.0) Gecko/20100101 Firefox/93.0'}
def baidu(company):
 url = 'https://www.baidu.com/s?rtt=4&tn=news&word=' + company
 print(url)
 html = requests.get(url, headers=headers).text
 s = BeautifulSoup(html, 'html.parser')
 title=s.select('.news-title_1YtI1 a')
 for i in title:
  print(i.text)
# 批量調(diào)用函數(shù)
companies = ['騰訊', '阿里巴巴', '百度集團(tuán)']
for i in companies:
 baidu(i)

批量輸出多個(gè)搜索結(jié)果的標(biāo)題

結(jié)果保存為文本文件

import requests
from bs4 import BeautifulSoup
headers={'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:93.0) Gecko/20100101 Firefox/93.0'}
def baidu(company):
 url = 'https://www.baidu.com/s?rtt=4&tn=news&word=' + company
 print(url)
 html = requests.get(url, headers=headers).text
 s = BeautifulSoup(html, 'html.parser')
 title=s.select('.news-title_1YtI1 a')
 fl=open('test.text','a', encoding='utf-8')
 for i in title:
  fl.write(i.text + '\n')
# 批量調(diào)用函數(shù)
companies = ['騰訊', '阿里巴巴', '百度集團(tuán)']
for i in companies:
 baidu(i)

寫入代碼

fl=open('test.text','a', encoding='utf-8')
for i in title:
	fl.write(i.text + '\n')

異常處理

for i in companies:
 try:
  baidu(i)
  print('運(yùn)行成功')
 except:
  print('運(yùn)行失敗')

寫在循環(huán)中不會(huì)讓程序停止運(yùn)行而會(huì)輸出運(yùn)行失敗

休眠時(shí)間

import time
for i in companies:
 try:
  baidu(i)
  print('運(yùn)行成功')
 except:
  print('運(yùn)行失敗')
time.sleep(5)

time.sleep(5)

括號(hào)里的單位是秒

放在什么位置則在什么位置休眠（暫停）

爬取多頁(yè)內(nèi)容

百度搜索騰訊

切換到第二頁(yè)

去掉多多余的

https://www.baidu.com/s?wd=騰訊&pn=10

分析出

https://www.baidu.com/s?wd=騰訊&pn=0 為第一頁(yè)
https://www.baidu.com/s?wd=騰訊&pn=10 為第二頁(yè)
https://www.baidu.com/s?wd=騰訊&pn=20 為第三頁(yè)
https://www.baidu.com/s?wd=騰訊&pn=30 為第四頁(yè)
..........

代碼

from bs4 import BeautifulSoup
import time
headers={'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:93.0) Gecko/20100101 Firefox/93.0'}
def baidu(c):
 url = 'https://www.baidu.com/s?wd=騰訊&pn=' + str(c)+'0'
 print(url)
 html = requests.get(url, headers=headers).text
 s = BeautifulSoup(html, 'html.parser')
 title=s.select('.t a')
 for i in title:
  print(i.text)
for i in range(10):
 baidu(i)
 time.sleep(2)

到此這篇關(guān)于Python爬蟲必備技巧詳細(xì)總結(jié)的文章就介紹到這了,更多相關(guān)Python 爬蟲技巧內(nèi)容請(qǐng)搜索本站以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持本站！

版權(quán)聲明：本站文章來(lái)源標(biāo)注為YINGSOO的內(nèi)容版權(quán)均為本站所有，歡迎引用、轉(zhuǎn)載，請(qǐng)保持原文完整并注明來(lái)源及原文鏈接。禁止復(fù)制或仿造本網(wǎng)站，禁止在非www.sddonglingsh.com所屬的服務(wù)器上建立鏡像，否則將依法追究法律責(zé)任。本站部分內(nèi)容來(lái)源于網(wǎng)友推薦、互聯(lián)網(wǎng)收集整理而來(lái)，僅供學(xué)習(xí)參考，不代表本站立場(chǎng)，如有內(nèi)容涉嫌侵權(quán)，請(qǐng)聯(lián)系alex-e#qq.com處理。

排名優(yōu)化：網(wǎng)站排名優(yōu)化方法有什么，如何做有效果

老域名：怎樣才算老域名，老域名建站有什么影響

內(nèi)容優(yōu)化：關(guān)鍵字排名要做哪些方面的優(yōu)化，怎樣做

技巧：網(wǎng)站轉(zhuǎn)化率究竟是什么，有什么提升的技巧

一下吧：外貿(mào)站優(yōu)化有哪些基本的做法和注意事項(xiàng)

概要：競(jìng)價(jià)推廣費(fèi)用大概要多少呢，競(jìng)價(jià)推廣好不好

一下吧：SEO中site是什么意思，作用和應(yīng)用是怎樣的

郵箱：付費(fèi)郵箱有哪些優(yōu)勢(shì)，付費(fèi)郵箱挑選要考慮什么

集群是什么意思：集群是什么意思，都有哪些優(yōu)勢(shì)呢