單元 1、為什麼需要網路爬蟲
單元 2、起手式:建置學習環境並開始看網頁原始碼
單元 3、看懂負責網頁內容架構的HTML
單元 4、看懂負責網頁外觀與排版的CSS
單元 5、看懂負責網頁互動機制的JavaScript
單元 6、儲存與傳輸資料的重要格式:CSV與Json
單元 7、跟伺服器溝通:Get封包介紹
單元 8、跟伺服器溝通:Post封包介紹
單元 9、用Anaconda建置Python開發環境
單元 10、用Get方法打造Python爬蟲
單元 11、用Post方法打造Python爬蟲
單元 12、用Beautifulsoup解析HTML
單元 13、用Regular Expression解析HTML
單元 14、混合運用Beautifulsoup和Regular Expression
單元 15、如何爬取下載網頁圖片
單元 16、如何爬取表格資料
單元 17、如何設定自動抓取網頁
單元 18、如何繞掉網頁驗證碼
單元 19、如何大量爬取單一頁面
單元 20、如何定時爬取網頁更新資訊
單元 21、使用SQLite資料儲存
Python 網路爬蟲上課講義
此單元不開放免費瀏覽