python爬虫】Python为什么叫爬虫

2020-09-04 10:53发布

17条回答
清屿
2楼 · 2020-09-04 11:04

因为Python可以做数据分析  数据挖掘,数据挖掘的话简单来说就是爬虫工程师

@CcCc
3楼 · 2020-09-04 14:11

因为Python可以做数据分析  数据挖掘,数据挖掘的话简单来说就是爬虫工程师

freediandianer
4楼 · 2020-09-04 14:16

python能做爬虫,但是不叫爬虫。。

因为它的数据分析能力强,代码简单,爬取速度快

任@先生
5楼 · 2020-09-04 15:19

爬虫是属于Python中的一个阶段,但是总的不是叫爬虫,而且因为python的抓取数据能力比较好,所以才会这样去叫

敦敦宁
6楼 · 2020-09-04 15:28

爬虫从原理上来,简单来讲就是发送http/https请求+解析html页面,获取页面上的目标数据。所以任何一个编程语言理论上都可以写爬虫,不过写起来可用的库或者难易程度有所不同罢了!


用python可以用别人封装好的爬虫框架如scrapy。不用框架,也可以用requests + beautifusoup,其中requests是用来建立http请求的,beautifusoup是用来解析页面的;当然也可以用其他各种库来完成类似的操作;

用java也一样,既可以直接用框架如WebMagic,也可以自己发送http请求+html页面解析,譬如发送http请求可以用apache的httpclient,也可以用java自带的HttpURLConnection,html解析可以用jsoup等;

c/c++也一样,本质上还是发请求+html解析,但是到这里,可用的开源库相比于python/java来说,就会少很多,如果不用开源库、自己发请求 + 自己来解析html,那将是一个庞大浩瀚的工程



苏橙C
7楼 · 2020-09-04 15:52

python能做爬虫,但是不叫爬虫。。

一碗馄饨皮儿
8楼 · 2020-09-04 16:18

Python是一种面向对象的解释型计算机程序设计语言,具有丰富和强大的库,所以常被称为胶水语言,能够把用其他语言制作的各种模块(尤其是C/C++)很轻松地联结在一起,是国内外众多企业使用的关键开发语言之一。python的创始人为Guido van Rossum,python的开发受到Modula-3语言的影响,python具有易读、可扩展、简洁等特点,被一些知名大学当做主要编程语言教授给学生。业内人士一般称python为高级动态编程语言,可以用于大规模软件开发。


Python的应用领域非常广泛,诸如后端开发、全栈开发、爬虫开发、人工智能、金融量化分析、大数据、物联网等,Python应用无处不在。Google、YouTube、豆瓣网等这些大型的知名网站都使用了Python完成核心代码的编写,可见Python的发展前景是不可估量的。


如果你对爬虫、人工智能等方向感兴趣,就可以考虑学习python。欢迎加群978525548,交流最新的行业资讯,解答学习疑问,以便更好更快的入门。


小杨小杨
9楼 · 2020-09-04 16:28

因为Python做数据分析的时候可以爬取很多数据

相关问题推荐

  • 回答 5

    现在是大数据人工智能时代,数据是核心资源。但大部分企业是没有数据的,或者数据很少。要得到数据,要么花钱购买,要么使用爬虫进行爬取。所以,爬虫是大数据和人工智能的基础。这是智联招聘网站爬虫岗位最新的招聘信息。可以看出工资水平还是相当高的。在掌...

  • 回答 2

    爬虫也是python一个很重要的一个应用方向,那么爬虫需要哪些知识呢?1 要具备扎实的python语法基础,这是一切的根基2 对前端知识有一定的了解,起码做到能看懂3 如何获取目标数据:requests模块等4 如何解析目标数据:正则,xpath,jsonpath等5 如何做到做到...

  • 回答 4

    爬虫是python的一个使用方向,包含网页数据爬取和手机app数据爬取。爬下来数据之后,还有数据存储和清洗等工作要做。爬虫程序代码编写完成,还需要进行部署、启动、暂停、维护等一系列工作。现在是大数据人工智能时代,大数据的主要来源之一就是爬虫。因此,...

  • 回答 3

    小伙伴们,大家好!这次来填坑了,关于前后端分离这个话题,我必须要交作业了,因为在私信里实在被问得太频繁了。前后端分离的开发模式,这两年确实被炒得如火如荼,导致这个话题也成了面试极其爱问的一个问题,尤其是换工作、跳槽,之前不管你是做后端,还是...

  • 回答 2

    转载请注明作者和出处:http://blog.csdn.net/c406495762Github代码获取:https://github.com/Jack-Cherish/python-spiderPython版本:Python3.x运行平台:WindowsIDE:Sublimetext3 更多教程,请查看:https://cuijiahua.com/blog/spider/ 一前言**强烈建议...

  • 回答 7

    代理ip网址http://www.goubanjia.com/http://www.ip181.com/https://www.kuaidaili.com/python 环境安装requests库安装bs4库proxies设置代理服务器地址proxies = {'http':  'http://61.155.164.110:3128'}http://www.goub......

  • 回答 2

    import  requestsimport  jsonfrom bs4 import BeautifulSoupfrom    urllib.request import urlretrieve#构造函数def sk():    #请求头    header={        'user-Agent':'Mozilla/5.0 (Windows NT 10.0; W...

  • 回答 3

    针对字符串中本身含有双引号,我们可以利用单引号进行字符串的定义来解决这个问题。使用单引号作为字符串的界限就不会引起识别异常问题,保证字符串的合理定义

  • 回答 2

    要用unicode编码来替换。

  • 回答 4
    已采纳

    百科中的定义,网络爬虫(又称为网页蜘蛛,网络机器人,在FOAF社区中间,更经常的称为网页追逐者),是一种按照一定的规则,自动地抓取万维网信息的程序或者脚本。这里面关键在于自动获取,相比手动通过浏览器获取信息,自动脚本执行的效率会大大提高,现代社...

  • 回答 2

    首先要认识爬虫请求模块requests,会对网页进行简单的分析。了解爬虫提取数据的xpath、re两个方法,有助于爬虫方面的提取。最后就是爬虫框架Scrapy,可以提高爬取速度,增加效率。

  • 回答 1

    python工程师是从事以Python编程语言为核心技术的工作,包含多中岗位多个工种(有WEB开发工程师、运维工程师、测试工程师、爬虫工程师、数据分析工程师、算法工程师等等);Python爬虫工程师是一个Python所有岗位中的一个工作方向,主要负责数据采集和基本筛...

  • 回答 1

    爬虫,顾名思义,就是爬取别人数据,是当前社会必不可少的一项技术

  • 回答 1

    三种方法可以获得免费股票数据1 用tushare库 http://tushare.org2 python量化平台提供 例如聚宽https://www.joinquant.com3 利用现成的交易软件 写一个获取数据 输出的指标

  • 回答 1

    举一些例子:知乎:爬取优质答案,为你筛选出各话题下最优质的内容。淘宝、京东:抓取商品、评论及销量数据,对各种商品及用户的消费场景进行分析。安居客、链家:抓取房产买卖及租售信息,分析房价变化趋势、做不同区域的房价分析。拉勾网、智联:爬取各类职...

  • 回答 1

    欢迎关注天善智能,我们是专注于商业智能BI,人工智能AI,大数据分析与挖掘领域的垂直社区,学习,问答、求职一站式搞定!对商业智能BI、大数据分析挖掘、机器学习,python,R等数据领域感兴趣的同学加微信:tstoutiao,邀请你进入数据爱好者交流群,数据爱好...

没有解决我的问题,去提问