paip.抓取网页内容--java php python
paip.抓取网页内容--java php python.txt
作者Attilax  艾龙, EMAIL:1466519819@qq.com
来源:attilax的专栏
地址:http://blog.csdn.net/attilax
//////////java 
String urlContent = WebpageContent("http://www.123cha.com/ip/?q="+ip,"utf-8");
///////////php
file_get_contents($url); 
 curl_init()>>>curl_exec
 fopen->fread->fclose 
 
 
 /////python
 urllib.urlopen(url).read()
 response = urllib2.urlopen('http://www.baidu.com/')  
html = response.read()  
 
 ///ahk
 UrlDownloadToFile, URL, Filename 
 
 
 public String downloadPage(String Url, String encode) {
        try {
            URL pageUrl = new URL(Url);
            // Open connection to URL for reading.
            BufferedReader reader = new BufferedReader(new InputStreamReader(
                    pageUrl.openStream(), encode));
            // BufferedReader br = new BufferedReader(new InputStreamReader(in,
            // "gbk"));
            // Read page into buffer.
            String line;
            StringBuffer pageBuffer = new StringBuffer();
            while ((line = reader.readLine()) != null) {
                pageBuffer.append(line);
            }
            String s = pageBuffer.toString();
            return s;
            // System.out.println(s);
            // return pageBuffer.toString();
        } catch (Exception e) {
            // return null;
            throw new RuntimeException(e);
        }
    }
 
 
 参考:
 php获取网页内容方法总结_php技巧_脚本之家.htm
 Python 3 抓取网页资源的 N 种方法.htm
paip.抓取网页内容--java php python的更多相关文章
- 使用Jsoup函数包抓取网页内容
		之前写过一篇用Java抓取网页内容的文章,当时是用url.openStream()函数创建一个流,然后用BufferedReader把这个inputstream读取进来.抓取的结果是一整个字符串.如果 ... 
- 爬虫学习一系列:urllib2抓取网页内容
		爬虫学习一系列:urllib2抓取网页内容 所谓网页抓取,就是把URL地址中指定的网络资源从网络中读取出来,保存到本地.我们平时在浏览器中通过网址浏览网页,只不过我们看到的是解析过的页面效果,而通过程 ... 
- paip. uapi 过滤器的java php python 实现aop filter
		paip. uapi 过滤器的java php python 实现aop filter filter 是面向切面编程AOP.. 作者Attilax 艾龙, EMAIL:1466519819@qq. ... 
- paip.字符串操作uapi java php python总结..
		paip.字符串操作uapi java php python总结.. java and php 相互转换.. import strUtil>>> requiry(strUtil.p ... 
- Asp.Net 之 抓取网页内容
		一.获取网页内容——html ASP.NET 中抓取网页内容是非常方便的,而其中更是解决了 ASP 中困扰我们的编码问题. 需要三个类:WebRequest.WebResponse.StreamRea ... 
- ASP.NET抓取网页内容的实现方法
		这篇文章主要介绍了ASP.NET抓取网页内容的实现方法,涉及使用HttpWebRequest及WebResponse抓取网页内容的技巧,需要的朋友可以参考下 一.ASP.NET 使用HttpWebRe ... 
- ASP.NET抓取网页内容
		原文:ASP.NET抓取网页内容 一.ASP.NET 使用HttpWebRequest抓取网页内容 这种方式抓取某些页面会失败 不过,有时候我们会发现,这个程序在抓取某些页面时,是获不到所需的内容的, ... 
- c#抓取网页内容乱码的解决方案
		写过爬虫的同学都知道,这是个很常见的问题了,一般处理思路是: 使用HttpWebRequest发送请求,HttpWebResponse来接收,判断HttpWebResponse中”Content-Ty ... 
- C# 抓取网页内容的方法
		1.抓取一般内容 需要三个类:WebRequest.WebResponse.StreamReader 所需命名空间:System.Net.System.IO 核心代码: view plaincopy ... 
随机推荐
- C#WebClient常见用法
			System.Net.WebClient.DownloadFile(Uri address, String fileName) namespace:System.Net 参数: address:The ... 
- Android体系结构及activity生命周期
			Android的系统架构采用了分层架构的思想,如图1所示.从上层到底层共包括四层,分别是应用程序程序层.应用框架层.系统库和Android运行时和Linux内核 Android的系统架构图 每层 ... 
- PHP的OB缓存(输出缓存)
			使用PHP自带的缓存机制 原则:如果ob缓存打开,则echo的数据首先放在ob缓存.如果是header信息,直接放在程序缓存.当页面执行到最后,会把ob缓存的数据放到程序缓存,然后依次返回给浏览器. ... 
- wpf 旋转效果
			<Grid> <Grid.Triggers> <EventTrigger RoutedEvent="Page.Loaded"> <Begi ... 
- iOS 地图
			MapKit框架使用前提 导入框架 导入主头文件 #import <MapKit/MapKit.h> MapKit框架使用须知 MapKit框架中所有数据类型的前缀都是MK MapKi ... 
- flex 正则 验证
			验证数字:^[-]*$ 验证n位的数字:^\d{n}$ 验证至少n位数字:^\d{n,}$ 验证m-n位的数字:^\d{m,n}$ 验证零和非零开头的数字:^(|[-][-]*)$ 验证有两位小数的正 ... 
- MSVC 报错 unable to use inline in declaration get error C2054
			晚上用cmake生成了一份lua-cjson的工程文件,msvc6的 编译时报错 后来再stackoverflow找到答案:unable to use inline in declaration ge ... 
- [转]初探 PhoneGap 框架在 Android 上的表现
			原文地址:http://topmanopensource.iteye.com/blog/1486929 phonegap是由温哥华的一家小公司研发的多平台的移动开发框架,支持流行的大多数移动设备(iP ... 
- 20145321 Git的安装使用及今后学习规划
			20145321 Git的安装使用及今后学习规划 Git安装使用及解决遇到的问题 之前上传代码都没有按照老师的方法弄,当时看到git教程感觉很麻烦,于是都是写完之后再一个个 程序贴上去,而现在使用过后 ... 
- 【java】:解析xml
			==========================================xml文件<?xml version="1.0" encoding="GB231 ... 
