PHP中的CURL函数库(Client URL Library Function)常用函数如下:
- curl_close — 关闭一个curl会话
- curl_copy_handle — 拷贝一个curl连接资源的所有内容和参数
- curl_errno — 返回一个包含当前会话错误信息的数字编号
- curl_error — 返回一个包含当前会话错误信息的字符串
- curl_exec — 执行一个curl会话
- curl_getinfo — 获取一个curl连接资源句柄的信息
- curl_init — 初始化一个curl会话
- curl_multi_add_handle — 向curl批处理会话中添加单独的curl句柄资源
- curl_multi_close — 关闭一个批处理句柄资源
- curl_multi_exec — 解析一个curl批处理句柄
- curl_multi_getcontent — 返回获取的输出的文本流
- curl_multi_info_read — 获取当前解析的curl的相关传输信息
- curl_multi_init — 初始化一个curl批处理句柄资源
- curl_multi_remove_handle — 移除curl批处理句柄资源中的某个句柄资源
- curl_multi_select — Get all the sockets associated with the cURL extension, which can then be "selected"
- curl_setopt_array — 以数组的形式为一个curl设置会话参数
- curl_setopt — 为一个curl设置会话参数
- curl_version — 获取curl相关的版本信息
- curl_init()函数的作用初始化一个curl会话,curl_init()函数唯一的一个参数是可选的,表示一个url地址。
- curl_exec()函数的作用是执行一个curl会话,唯一的参数是curl_init()函数返回的句柄。
- curl_close()函数的作用是关闭一个curl会话,唯一的参数是curl_init()函数返回的句柄。
基本例子
输出到屏幕上。 curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1); // 运行cURL,请求网页 $data = curl_exec($curl); // 关闭URL请求 curl_close($curl); // 显示获得的数据 var_dump($data); ?>
POST数据
接受两个表单域,一个是电话号码,一个是短信内容。
使用代理服务器
模拟登录
模拟登录 discuz 程序。
/i', $contents, $matches);
if(!empty($matches)) {
$formhash = $matches[1];
} else {
die('Not found the forumhash.');
}
//POST数据,获取COOKIE
$cookie_file = dirname(__FILE__) . '/cookie.txt';
//$cookie_file = tempnam('/tmp');
$ch = curl_init($login_url);
curl_setopt($ch, CURLOPT_HEADER, 0);
curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);
curl_setopt($ch, CURLOPT_POST, 1);
curl_setopt($ch, CURLOPT_POSTFIELDS, $post_fields);
curl_setopt($ch, CURLOPT_COOKIEJAR, $cookie_file);
curl_exec($ch);
curl_close($ch);
//带着上面得到的COOKIE获取需要登录后才能查看的页面内容
$ch = curl_init($get_url);
curl_setopt($ch, CURLOPT_HEADER, 0);
curl_setopt($ch, CURLOPT_RETURNTRANSFER, 0);
curl_setopt($ch, CURLOPT_COOKIEFILE, $cookie_file);
$contents = curl_exec($ch);
curl_close($ch);
var_dump($contents);
?>
http://www.bkjia.com/PHPjc/752496.htmlwww.bkjia.comtruehttp://www.bkjia.com/PHPjc/752496.htmlTechArticle使用PHP的cURL库可以简单和有效地去抓网页。你只需要运行一个脚本,然后分析一下你所抓取的网页,然后就可以以程序的方式得到你想要的...