码迷,mamicode.com
首页 > 编程语言 > 详细

python测试抓取今日头条

时间:2017-04-28 23:41:43      阅读:749      评论:0      收藏:0      [点我收藏+]

标签:返回   blog   offset   load   set   images   logs   word   测试   

# coding:utf-8
import requests
import json

url = ‘http://www.toutiao.com/search_content/?offset=0&format=json&keyword=%E5%B0%8F%E5%BA%B7%E7%A4%BE%E4%BC%9A&autoload=true&count=20&cur_tab=1‘
wbdata = requests.get(url).text

data = json.loads(wbdata)
news = data[‘data‘]

for n in news:
    if ‘title‘ in n:
      title = n[‘title‘]
      source = n[‘source‘]
      url = n[‘article_url‘]
      keyword = n[‘keywords‘]
      print(title,url,keyword,source)

 

1.浏览器中找到内容的接口

技术分享

2.找到需要的内容和url

技术分享

3.返回结果

技术分享

python测试抓取今日头条

标签:返回   blog   offset   load   set   images   logs   word   测试   

原文地址:http://www.cnblogs.com/bincoding/p/6783579.html

踩
(0)
赞
(0)
   
举报
评论 一句话评论(0)
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!