楼主: EroicaCMCS
跳转到指定楼层
上一主题 下一主题
收起左侧

手把手教你用python抓网页数据

   
🔗
 楼主| EroicaCMCS 2014-11-5 02:16:44 | 只看该作者
全局:
pijefreskue 发表于 2014-10-28 22:16
你好,我想问一下我用Python得到网页的源代码之后,如何能知道我想要的代码是什么呢?比如我知道我想下图片 ...
. From 1point 3acres bbs
一般来说,网络上每一个东西都有一个URL(统一定位符)。不知道URL,可以用一些工具(比如: firebug)来找。 ..

至于找到了然后不知道怎么获取,可以看这里:
https://docs.python.org/2/howto/urllib2.html
回复

使用道具 举报

🔗
masa 2014-11-5 03:12:51 | 只看该作者
全局:
好棒!收藏一下
回复

使用道具 举报

🔗
meggie1111 2014-12-16 04:42:14 | 只看该作者
全局:
I don`t understand the usage of header. Does it tell the server who is crawling the webpage? Thanks
回复

使用道具 举报

🔗
turmud 2015-3-26 14:05:07 | 只看该作者
全局:
请问如果数据是动态的怎么办,动态数据在这里指的是网页中由Javascript动态生成的页面内容,即网页源文件中没有,在页面加载到浏览器后动态生成的。简而言之,数据在网页源码中是一个公式计算出来的怎么
回复

使用道具 举报

🔗
jacksterling 2015-5-6 14:56:13 | 只看该作者
全局:
楼主用过Python的scrapy吗?求指导啊
回复

使用道具 举报

🔗
parachutemd 2015-5-14 22:09:56 | 只看该作者
全局:
victorsterling 发表于 2015-5-6 14:56
楼主用过Python的scrapy吗?求指导啊
..
你需要用scrapy做什么 可以问我
回复

使用道具 举报

🔗
jacksterling 2015-5-14 22:38:56 | 只看该作者
全局:
parachutemd 发表于 2015-5-14 22:09
你需要用scrapy做什么 可以问我

网络爬虫从网上搞数据哈,暂时没啥问题了,等再有问题了,再过来请教大神哈
回复

使用道具 举报

🔗
jjj111q 2015-7-13 15:41:30 | 只看该作者
全局:
想请教一下楼主和各位大神们。第一,我是在mac上用,所以最后一步我把txt改成了doc,请问这样有用吗?第二,我运行完所有程序之后,idle上没有任何反应,也没发现哪有文件创立,请问我是需要等,还是我哪里做错了?谢谢!
回复

使用道具 举报

🔗
rojya 2015-7-20 15:57:02 | 只看该作者
全局:
楼主,你好~你写的帖子写的太赞了!可是我是一个小小白,还是遇到了问题 sigh...
就是头文件那里,怎么写header啊?就是我怎么也不知道应该怎样查看,怎样知道userAgent。
虽然过了很久,但是希望楼主能帮我解答一下。谢谢!
回复

使用道具 举报

全局:
为何 soap, 不用XML 或JSON?
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 注册账号
隐私提醒:
  • ☑ 禁止发布广告,拉群,贴个人联系方式:找人请去🔗同学同事飞友,拉群请去🔗拉群结伴,广告请去🔗跳蚤市场,和 🔗租房广告|找室友
  • ☑ 论坛内容在发帖 30 分钟内可以编辑,过后则不能删帖。为防止被骚扰甚至人肉,不要公开留微信等联系方式,如有需求请以论坛私信方式发送。
  • ☑ 干货版块可免费使用 🔗超级匿名:面经(美国面经、中国面经、数科面经、PM面经),抖包袱(美国、中国)和录取汇报、定位选校版
  • ☑ 查阅全站 🔗各种匿名方法

本版积分规则

>
快速回复 返回顶部 返回列表