发布于 2014-10-18 18:53:28 | 165 次阅读 | 评论: 0 | 来源: 网友投递

这里有新鲜出炉的Python教程,程序狗速度看过来!

Python编程语言

Python 是一种面向对象、解释型计算机程序设计语言,由Guido van Rossum于1989年底发明,第一个公开发行版发行于1991年。Python语法简洁而清晰,具有丰富和强大的类库。它常被昵称为胶水语言,它能够把用其他语言制作的各种模块(尤其是C/C++)很轻松地联结在一起。


文本是一个python抓取网页内容示例的代码,在抓取的时候对于gbk编码网页还需要转化一下,感兴趣的同学参考下.


import socket
def open_tcp_socket(remotehost,servicename):
    s=socket.socket(socket.AF_INET,socket.SOCK_STREAM)
    portnumber=socket.getservbyname(servicename,'tcp')
    s.connect((remotehost,portnumber))
    return s
mysocket=open_tcp_socket('www.taobao.com','http')
mysocket.send('hello')
while(1):
    data=mysocket.recv(1024)
    if(data):
        print data.decode('gbk').encode('utf-8')#对于gbk编码网页必须这样转化一下
    else:
        break
mysocket.close()

 



相关阅读 :
python抓取网页内容示例
python抓取网页图片示例(python爬虫的实现)
python抓取网页正文的示例代码
python抓取网页中的图片示例
零基础写python爬虫之使用urllib2组件抓取网页内容
Python实现周期性抓取网页内容的方法
python抓取网页时字符集转换方法
python抓取网页图片并放到指定文件夹
Python 抓取网页并且解析的方法
python抓取网页中图片并保存到本地
python通过urllib2抓取网页上种子并下载示例
Python 抓取动态网页内容方案详解
最新网友评论  共有(0)条评论 发布评论 返回顶部

Copyright © 2007-2017 PHPERZ.COM All Rights Reserved   冀ICP备14009818号  版权声明  广告服务