python訪問數據庫框架（python構建數據庫）

本文目錄一覽：

1、Python 有哪些好的 Web 框架
2、python的爬蟲框架有哪些？
3、Python中的爬蟲框架有哪些呢？

Python 有哪些好的 Web 框架

常見的5種Web框架：

第一個：Django

Django是一個開源的Web應用框架，由Python寫成，支持許多數據庫引擎，可以讓Web開發變得迅速和可擴展，並會不斷的版本更新以匹配Python最新版本，如果是新手程序員，可以從這個框架入手。

第二個：Flask

Flask是一個輕量級的Web應用框架，使用Python編寫。基於WerkzeugWSGI工具箱和JinJa2模板引擎，使用BSD授權。

Flask也被稱為microframework，因為它使用簡單的核心，用extension增加其他功能。Flask沒有默認使用的數據庫、窗體驗證工具。然而Flask保留了擴增的彈性，可以用Flask-extension加入這些功能：ORM、窗體驗證工具、文件上傳、各種開放式身份驗證技術。

第三個：Web2py

Web2py是一個用Python語言編寫的免費的開源Web框架，旨在敏捷快速的開發Web應用，具有快速、可擴展、安全以及可移植的數據庫驅動的應用，遵循LGPLv3開源協議。

Web2py提供一站式的解決方案，整個開發過程都可以在瀏覽器上進行，提供了Web版的在線開發，HTML模板編寫，靜態文件的上傳，數據庫的編寫的功能。其他的還有日誌功能，以及一個自動化的admin接口。

第四個：Tornado

Tornado即是一個Webserver，同時又是一個類web.py的micro-framework，作為框架的Tornado的思想主要來源於web.PY，大家在web.PY的網站首頁也可以看到Tornado的大佬Bret

Taylor的這麼一段話：「[web.py inspired the] Web framework we use at FriendFeed [and] thewebapp framework that ships with App Engine…」，因為這層關係，後面不再單獨討論Tornado。

第五個：CherryPy

CherryPy是一個用於Python的、簡單而非常有用的Web框架，其主要作用是以儘可能少的操作將Web服務器與Python代碼連接，其功能包括內置的分析功能、靈活的插件系統以及一次運行多個HTTP服務器的功能，可運行在最新版本的Python、Jython、android上。

python的爬蟲框架有哪些？

1.Scrapy是一個為了爬取網站數據，提取結構性數據而編寫的應用框架。可以應用在包括數據挖掘，信息處理或存儲歷史數據等一系列的程序中

2.pyspider 是一個用python實現的功能強大的網絡爬蟲系統，能在瀏覽器界面上進行腳本的編寫，功能的調度和爬取結果的實時查看，後端使用常用的數據庫進行爬取結果的存儲，還能定時設置任務與任務優先級等。

3.Crawley可以高速爬取對應網站的內容，支持關係和非關係數據庫，數據可以導出為JSON、XML等

4.Beautiful Soup 是一個可以從HTML或XML文件中提取數據的Python庫.它能夠通過你喜歡的轉換器實現慣用的文檔導航,查找,修改文檔的方式.Beautiful Soup會幫你節省數小時甚至數天的工作時間。

還有很多，比如Newspaper，Grab，Cola等等

爬蟲框架學習可以看一下黑馬程序員視頻庫的學習視頻，免費學習哦！很高興能為你提供幫助

Python中的爬蟲框架有哪些呢？

實現爬蟲技術的編程環境有很多種，Java、Python、C++等都可以用來爬蟲。但很多人選擇Python來寫爬蟲，為什麼呢？因為Python確實很適合做爬蟲，豐富的第三方庫十分強大，簡單幾行代碼便可實現你想要的功能。更重要的，Python也是數據挖掘和分析的好能手。那麼，Python爬蟲一般用什麼框架比較好？

一般來講，只有在遇到比較大型的需求時，才會使用Python爬蟲框架。這樣的做的主要目的，是為了方便管理以及擴展。本文我將向大家推薦十個Python爬蟲框架。

1、Scrapy：Scrapy是一個為了爬取網站數據，提取結構性數據而編寫的應用框架。可以應用在包括數據挖掘，信息處理或存儲歷史數據等一系列的程序中。它是很強大的爬蟲框架，可以滿足簡單的頁面爬取，比如可以明確獲知url pattern的情況。用這個框架可以輕鬆爬下來如亞馬遜商品信息之類的數據。但是對於稍微複雜一點的頁面，如weibo的頁面信息，這個框架就滿足不了需求了。它的特性有：HTML, XML源數據選擇及提取的內置支持；提供了一系列在spider之間共享的可復用的過濾器(即 Item Loaders)，對智能處理爬取數據提供了內置支持。

2、Crawley：高速爬取對應網站的內容，支持關係和非關係數據庫，數據可以導出為JSON、XML等。

3、Portia：是一個開源可視化爬蟲工具，可讓使用者在不需要任何編程知識的情況下爬取網站！簡單地注釋自己感興趣的頁面，Portia將創建一個蜘蛛來從類似的頁面提取數據。簡單來講，它是基於scrapy內核；可視化爬取內容，不需要任何開發專業知識；動態匹配相同模板的內容。

4、newspaper：可以用來提取新聞、文章和內容分析。使用多線程，支持10多種語言等。作者從requests庫的簡潔與強大得到靈感，使用Python開發的可用於提取文章內容的程序。支持10多種語言並且所有的都是unicode編碼。

5、Python-goose：Java寫的文章提取工具。Python-goose框架可提取的信息包括：文章主體內容、文章主要圖片、文章中嵌入的任何Youtube/Vimeo視頻、元描述、元標籤。

6、Beautiful Soup：名氣大，整合了一些常用爬蟲需求。它是一個可以從HTML或XML文件中提取數據的Python庫。它能夠通過你喜歡的轉換器實現慣用的文檔導航,查找,修改文檔的方式.Beautiful Soup會幫你節省數小時甚至數天的工作時間。Beautiful Soup的缺點是不能加載JS。

7、mechanize：它的優點是可以加載JS。當然它也有缺點，比如文檔嚴重缺失。不過通過官方的example以及人肉嘗試的方法，還是勉強能用的。

8、selenium：這是一個調用瀏覽器的driver，通過這個庫你可以直接調用瀏覽器完成某些操作，比如輸入驗證碼。Selenium是自動化測試工具，它支持各種瀏覽器，包括 Chrome，Safari，Firefox等主流界面式瀏覽器，如果在這些瀏覽器裏面安裝一個 Selenium 的插件，可以方便地實現Web界面的測試. Selenium支持瀏覽器驅動。Selenium支持多種語言開發，比如 Java，C，Ruby等等，PhantomJS 用來渲染解析JS，Selenium 用來驅動以及與Python的對接，Python進行後期的處理。

9、cola：是一個分佈式的爬蟲框架，對於用戶來說，只需編寫幾個特定的函數，而無需關注分佈式運行的細節。任務會自動分配到多台機器上，整個過程對用戶是透明的。項目整體設計有點糟，模塊間耦合度較高。

10、PySpider：一個國人編寫的強大的網絡爬蟲系統並帶有強大的WebUI。採用Python語言編寫，分佈式架構，支持多種數據庫後端，強大的WebUI支持腳本編輯器，任務監視器，項目管理器以及結果查看器。Python腳本控制，可以用任何你喜歡的html解析包。

原創文章，作者：小藍，如若轉載，請註明出處：https://www.506064.com/zh-hk/n/191971.html

python訪問數據庫框架（python構建數據庫）

本文目錄一覽：

Python 有哪些好的 Web 框架

python的爬蟲框架有哪些？

Python中的爬蟲框架有哪些呢？

相關推薦

發表回復