PHP抓取网页指定内容

2025-03-25 16:41:09
推荐回答(4个)
回答1:

/*
* 如下: 方法有点笨
* 抓取网页内容用 PHP 的正则
* 用JS每隔5分钟刷新当前页面---即重新获取网页内容
*
* 注: $mode中---更改为所需内容(如 $mode = "##";>获取所有链接)
*
* window.location.href="http://localhost/baidu/refesh.php";中的http://localhost/baidu/refesh.php
* 更改为自己的URL----作用:即刷新当前页面
*
* setInterval("ref()",300000);是每隔300000毫秒(即 5 * 60 *1000 毫秒即5分钟)执行一次函数 ref()
*
* print_r($arr);输出获得的所有内容 $arr是一个数组 可根据所需输出一部分(如 echo $arr[1][0];)
* 若要获得所有内容 可去掉
* $mode = "#(.*)#";
if(preg_match_all($mode,$content,$arr)){
print_r($arr);
echo "
";
echo $arr[1][0];
}
再加上 echo $content;
*/
$url = "http://www.baidu.com"; //目标站
$fp = @fopen($url, "r") or die("超时");

$content=file_get_contents($url);
$mode = "#(.*)#";
if(preg_match_all($mode,$content,$arr)){
//print_r($arr);
echo "
";
echo $arr[1][0];
}
?>

回答2:

RT:
用file_get_contents(内容地址);
之后用正则来匹配你要得到的内容!

回答3:

/*
*如下:方法有点笨
*抓取网页内容用PHP的正则
*用JS每隔5分钟刷新当前页面---即重新获取网页内容
*
*注:$mode中---更改为所需内容(如$mode="##";>获取所有链接)
*
*window.location.href="http://localhost/baidu/refesh.php";中的http://localhost/baidu/refesh.php
*更改为自己的URL----作用:即刷新当前页面
*
*setInterval("ref()",300000);是每隔300000毫秒(即5*60*1000毫秒即5分钟)执行一次函数ref()
*
*print_r($arr);输出获得的所有内容$arr是一个数组可根据所需输出一部分(如echo$arr[1][0];)
*若要获得所有内容可去掉
*$mode="#(.*)#";
if(preg_match_all($mode,$content,$arr)){
print_r($arr);
echo"
";
echo$arr[1][0];
}
再加上echo$content;
*/
$url="http://www.baidu.com";//目标站
$fp=@fopen($url,"r")ordie("超时");
$content=file_get_contents($url);
$mode="#(.*)#";
if(preg_match_all($mode,$content,$arr)){
//print_r($arr);
echo"
";
echo$arr[1][0];
}
?>

<--
functionref(){
window.location.href="http://localhost/baidu/refesh.php";
}
setInterval("ref()",300000);
//-->

回答4:

这个直接用乐思采集系统就可以搞定