linux下为php添加curl扩展的方法及curl_init函数用法案例详解

简介:

一般php源码的扩展库里已经带了curl的扩展,所以没有必要下载,直接将编译扩展即可

步骤如下: 

1. 进到对应扩展目录 

# cd /usr/local/src/php-5.2.12/ext/curl 

2. 调用phpize程序生成编译配置文件 

# /usr/local/php5/bin/phpize 

3. 调用configure生成Makefile文件,然后调用make编译,make install安装 

# ./configure -with-curl=/usr/local/curl -with-php-config=/usr/local/php5/bin/php-config

# make

# make install 

4. 修改php配置文件 

修改扩展库目录 extension_dir = "/usr/local/php5/lib/php/extensions/no-debug-non-zts-20060613/"

添加curl扩展 extension = curl.so 
5. 重启Apache即可。

/etc/init.d/httpd restart



使用PHPcURL库可以简单和有效地去抓网页。
只需要运行一个脚本,然后分析一下你所抓取的网页,然后就可以以程序的方式得到你想要的数据了

无论是你想从从一个链接上取部分数据,或是取一个XML文件并把其导入数据库,那怕就是简单的获取网页内容,cURL 是一个功能强大的PHP库。
PHP中的CURL函数库(Client URL Library Function)
curl_close — 关闭一个curl会话
curl_copy_handle — 拷贝一个curl连接资源的所有内容和参数
curl_errno — 返回一个包含当前会话错误信息的数字编号
curl_error — 返回一个包含当前会话错误信息的字符串
curl_exec — 执行一个curl会话
curl_getinfo — 获取一个curl连接资源句柄的信息
curl_init — 初始化一个curl会话
curl_multi_add_handle — 向curl批处理会话中添加单独的curl句柄资源
curl_multi_close — 关闭一个批处理句柄资源
curl_multi_exec — 解析一个curl批处理句柄
curl_multi_getcontent — 返回获取的输出的文本流
curl_multi_info_read — 获取当前解析的curl的相关传输信息
curl_multi_init — 初始化一个curl批处理句柄资源
curl_multi_remove_handle — 移除curl批处理句柄资源中的某个句柄资源
curl_multi_select — Get all the sockets associated with the cURL extension, which can then be "selected"
curl_setopt_array — 以数组的形式为一个curl设置会话参数
curl_setopt — 为一个curl设置会话参数
curl_version — 获取curl相关的版本信息
curl_init()函数的作用初始化一个curl会话,curl_init()函数唯一的一个参数是可选的,表示一个url地址。
curl_exec()函数的作用是执行一个curl会话,唯一的参数是curl_init()函数返回的句柄。
curl_close()函数的作用是关闭一个curl会话,唯一的参数是curl_init()函数返回的句柄。
例子一: 基本例子

基本例子

  1. <?php

  2. // 初始化一个 cURL 对象

  3. $curl = curl_init();

  4. // 设置你需要抓取的URL

  5. curl_setopt($curl, CURLOPT_URL, 'http://www.jbxue.com');

  6. // 设置header

  7. curl_setopt($curl, CURLOPT_HEADER, 1);

  8. // 设置cURL 参数,要求结果保存到字符串中还是输出到屏幕上。

  9. curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);

  10. // 运行cURL,请求网页

  11. $data = curl_exec($curl);

  12. // 关闭URL请求

  13. curl_close($curl);

  14. // 显示获得的数据

  15. var_dump($data);

  16. ?>

例子二: POST数据
sendSMS.php,其可以接受两个表单域,一个是电话号码,一个是短信内容。
POST数据

  1. <?php

  2. $phoneNumber = '13812345678';

  3. $message = 'This message was generated by curl and php';

  4. $curlPost = 'pNUMBER=' . urlencode($phoneNumber) . '&MESSAGE=' . urlencode($message) . '&SUBMIT=Send';

  5. $ch = curl_init();

  6. curl_setopt($ch, CURLOPT_URL, 'http://www.jbxue.com /sendSMS.php');

  7. curl_setopt($ch, CURLOPT_HEADER, 1);

  8. curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);

  9. curl_setopt($ch, CURLOPT_POST, 1);

  10. curl_setopt($ch, CURLOPT_POSTFIELDS, $curlPost);

  11. $data = curl_exec();

  12. curl_close($ch);

  13. ?>

例子三:使用代理服务器
使用代理服务器

  1. <?php 

  2. $ch = curl_init();

  3. curl_setopt($ch, CURLOPT_URL, 'http://www.jbxue.com');

  4. curl_setopt($ch, CURLOPT_HEADER, 1);

  5. curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);

  6. curl_setopt($ch, CURLOPT_HTTPPROXYTUNNEL, 1);

  7. curl_setopt($ch, CURLOPT_PROXY, 'proxy.lxvoip.com:1080');

  8. curl_setopt($ch, CURLOPT_PROXYUSERPWD, 'user:password');

  9. $data = curl_exec();

  10. curl_close($ch);

  11. ?>

例子四: 模拟登录
Curl 模拟登录 discuz 程序,适合DZ7.0,将username改成你的用户名,userpass改成你的密码就可以了.
Curl 模拟登录 discuz 程序

  1. <?php 

  2. !extension_loaded('curl') && die('The curl extension is not loaded.'); 


  3. $discuz_url = 'http://www.jbxue.com';//论坛地址 

  4. $login_url = $discuz_url .'/logging.php?action=login';//登录页地址 

  5. $get_url = $discuz_url .'/my.php?item=threads'; //我的帖子 


  6. $post_fields = array(); 

  7. //以下两项不需要修改 

  8. $post_fields['loginfield'] = 'username'; 

  9. $post_fields['loginsubmit'] = 'true'; 

  10. //用户名和密码,必须填写 

  11. $post_fields['username'] = 'lxvoip'; 

  12. $post_fields['password'] = '88888888'; 

  13. //安全提问 

  14. $post_fields['questionid'] = 0; 

  15. $post_fields['answer'] = ''; 

  16. //@todo验证码 

  17. $post_fields['seccodeverify'] = ''; 


  18. //获取表单FORMHASH 

  19. $ch = curl_init($login_url); 

  20. curl_setopt($ch, CURLOPT_HEADER, 0); 

  21. curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); 

  22. $contents = curl_exec($ch); 

  23. curl_close($ch); 

  24. preg_match('//i'\s*type="hidden"\s*name="formhash"\s*value="(.*?)"\s*\>, $contents, $matches); 

  25. if(!empty($matches)) { 

  26.     $formhash = $matches[1]; 

  27. } else { 

  28.     die('Not found the forumhash.'); 

  29. } 


  30. //POST数据,获取COOKIE 

  31. $cookie_file = dirname(__FILE__) . '/cookie.txt'; 

  32. //$cookie_file = tempnam('/tmp'); 

  33. $ch = curl_init($login_url); 

  34. curl_setopt($ch, CURLOPT_HEADER, 0); 

  35. curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); 

  36. curl_setopt($ch, CURLOPT_POST, 1); 

  37. curl_setopt($ch, CURLOPT_POSTFIELDS, $post_fields); 

  38. curl_setopt($ch, CURLOPT_COOKIEJAR, $cookie_file); 

  39. curl_exec($ch); 

  40. curl_close($ch); 


  41. //带着上面得到的COOKIE获取需要登录后才能查看的页面内容 

  42. $ch = curl_init($get_url); 

  43. curl_setopt($ch, CURLOPT_HEADER, 0); 

  44. curl_setopt($ch, CURLOPT_RETURNTRANSFER, 0); 

  45. curl_setopt($ch, CURLOPT_COOKIEFILE, $cookie_file); 

  46. $contents = curl_exec($ch); 

  47. curl_close($ch); 

  48. var_dump($contents);



本文转自 小杨_Ivan 51CTO博客,原文链接:http://blog.51cto.com/aqiang/1892114


相关文章
|
8月前
|
运维 监控 Java
Linux常用命令行大全:14个核心指令详解+实战案例
在服务器管理与开发运维领域,Linux 指令是构建技术能力体系的基石。无论是日常的系统监控、文件操作,还是复杂的服务部署与故障排查,熟练掌握指令的使用逻辑都是提升工作效率的核心前提。然而,对于初学者而言,Linux 指令体系往往呈现出“参数繁多易混淆”“组合使用门槛高”“实际场景适配难”等痛点——例如 ls 命令的 -l 与 -a 参数如何搭配查看隐藏文件详情,grep 与管道符结合时如何精准过滤日志内容,这些问题常常成为技术进阶的阻碍。
|
Linux
linux常用命令详细说明以及案例
本文介绍了Linux中几个常用的命令及其用法,包括:`ls`(列出目录内容)、`cd`(切换目录)、`mkdir`(创建目录)、`rm -p`(删除目录及内容)和`mv`(移动或重命名文件/目录)。每个命令都配有详细说明、语法格式、常见选项及实用案例,帮助用户更好地理解和使用这些基础命令。内容源自[linux常用命令详细说明以及案例](https://linux.ciilii.com/show/news-285.html)。
503 159
|
Linux
linux命令详细说明以及案例
本文介绍了常用的 Linux 命令及其详细说明和示例,包括:`ls`(列出目录内容)、`cd`(更改目录)、`rm` 和 `mv`(删除与移动文件)、`grep`(搜索文本)、`cat`(显示文件内容)以及 `chmod`(更改文件权限)。每个命令均配有功能描述、选项说明及实际案例,帮助用户更好地掌握 Linux 命令的使用方法。
768 157
|
10月前
|
监控 Linux 应用服务中间件
linux查看日志文件tail -f用法
在 Linux 中,查看和监控日志文件是系统管理员和开发者常用的操作之一。tail 命令就是用来查看文件内容的,它默认显示文件的最后部分。tail -f 是 tail 命令的一个非常有用的选项,用于实时查看和跟踪日志文件的更新,尤其是在监控运行中的服务时非常有用。
1236 0
|
12月前
|
数据挖掘 Linux 数据库
服务器数据恢复—Linux系统服务器数据恢复案例
服务器数据恢复环境: linux操作系统服务器中有一组由4块SAS接口硬盘组建的raid5阵列。 服务器故障: 服务器工作过程中突然崩溃。管理员将服务器操作系统进行了重装。 用户方需要恢复服务器中的数据库、办公文档、代码文件等。
|
Shell Linux
【linux】Shell脚本中basename和dirname的详细用法教程
本文详细介绍了Linux Shell脚本中 `basename`和 `dirname`命令的用法,包括去除路径信息、去除后缀、批量处理文件名和路径等。同时,通过文件备份和日志文件分离的实践应用,展示了这两个命令在实际脚本中的应用场景。希望本文能帮助您更好地理解和应用 `basename`和 `dirname`命令,提高Shell脚本编写的效率和灵活性。
1366 32
|
JSON 运维 Ubuntu
Linux下如何使用Curl进行网络请求
希望这篇文章能帮助您在Linux下更好地使用Curl进行网络请求。如有疑问,请随时提问!
793 10
|
存储 Linux
linux中的目录操作函数
本文详细介绍了Linux系统编程中常用的目录操作函数,包括创建目录、删除目录、读取目录内容、遍历目录树以及获取和修改目录属性。这些函数是进行文件系统操作的基础,通过示例代码展示了其具体用法。希望本文能帮助您更好地理解和应用这些目录操作函数,提高系统编程的效率和能力。
467 26
|
Linux API
Linux下载工具wget与curl
`wget` 是一个用于从网络下载文件的命令行工具,支持HTTP、HTTPS和FTP协议。它能自动处理下载中断,并支持递归下载网站内容。基本用法:`wget URL`,可指定文件名(`-O`)、保存目录(`-P`),还支持断点续传(`-c`)、限速(`--limit-rate`)和递归下载(`-r`)。相比之下,`curl` 更侧重于发送各种HTTP请求(如GET、POST),并支持文件上传、自定义请求头和cookie等功能。
676 10
|
Linux
【Linux】System V信号量详解以及semget()、semctl()和semop()函数讲解
System V信号量的概念及其在Linux中的使用,包括 `semget()`、`semctl()`和 `semop()`函数的具体使用方法。通过实际代码示例,演示了如何创建、初始化和使用信号量进行进程间同步。掌握这些知识,可以有效解决多进程编程中的同步问题,提高程序的可靠性和稳定性。
998 19