1. 碁峰資訊新書快報

[簡例] (檔名:gotopNewBooks.py)

爬取碁峰網站「http://books.gotop.com.tw/default.aspx」網頁,顯示最新消息區域中新書快報的資訊內容。

[結果]

說明

  1. 4~5行:傳回Response物件,該物件名稱為responseObj,此物件可取得「基峰資訊圖書」 網頁資訊。
  2. 6行: 使用BeautifulSoup函式建立解析html網頁程式碼(responseObj.text)
  3. 8行:顯示網頁標題。
  4. 11行: 使用select()方法取得id「ctl00_labNews」的串列物件並指定給data
  5. 12行:因為data[0]為串列第一個元素,即是新書快報的區域,所以由data[0]執行find_all()方法取得該元素內所有的<a>標籤並指定給link串列。
  6. 14~15行:使用迴圈印出所有新書名稱,即印出link串列中<a>標籤的內容。

2. 自動產生長峰資訊產品新訊網頁

[簡例] (檔名:evertopNewProducts.py)

取得長峰資訊網站「http://www.evertop.com.tw/」產品新訊的內容,並配合檔案存取自動建置產品新訊網頁。

[結果]

自動產生網頁也擁有響應式網頁的效果。

  1. 請連上 http://www.evertop.com.tw/ 網頁,並透過瀏覽器檢視此網頁的程式碼,結果發現商品新訊內容置於第2<select class="mb">內。

  2. 如下圖,第2<select class="mb">內的<img>可取得產品新訊的圖:第2<select class="mb"><div class="mtitle">內的<a>可取得產品新訊息標題。

說明
40行: 由於此行敘述過長無法排成一行,請讀者實際撰寫程式時將此行敘述撰寫成一行。


相關主題與延伸閱讀