php抓取頁面

發布時間: 2022-08-30 23:54:43

❶ 如何用php代碼循環抓取其他頁面的內容

1.用file_get_contents提取網後後用正則找出總頁數
2.程序自動寫出分頁的代碼放入到數組或資料庫
3.再用file_get_contents循環資料庫

原理就是如上

❷ 用php 怎麼抓取js+ajax動態生成的頁面內容

第一步，查看網頁源代碼，找到ajax請求的URL。
比如，js代碼為：
$.ajax({
url: 'ajax.php?id=100',
data: {ad_num:num,ad_str:str,cart_update_time:cart_update_time},
type: 'POST',
dataType: 'text',
async : false,
success: function(data){

}
其中的ajax.php?id=100就是ajax請求的URL。

第二步，拼接URL，用網站的域名加上這個找到的請求路徑。
比如，網站域名為： www.abc.com 拼接後的URL為：www.abc.com/ajax.php?id=100

第三步，用PHP讀取第二步拼接出的URL即可。

❸ PHP抓取網頁指定內容

<?php
/*
* 如下：方法有點笨
* 抓取網頁內容用 PHP 的正則
* 用JS每隔5分鍾刷新當前頁面---即重新獲取網頁內容
*
* 註： $mode中--<title></title>-更改為所需內容（如 $mode = "#<a(.*)</a>#";>獲取所有鏈接）
*
* window.location.href="http://localhost//refesh.php";中的http://localhost//refesh.php
* 更改為自己的URL----作用：即刷新當前頁面
*
* setInterval("ref()",300000);是每隔300000毫秒（即 5 * 60 *1000 毫秒即5分鍾）執行一次函數 ref()
*
* print_r($arr);輸出獲得的所有內容 $arr是一個數組可根據所需輸出一部分（如 echo $arr[1][0];）
* 若要獲得所有內容可去掉
* $mode = "#<title>(.*)</title>#";
if(preg_match_all($mode,$content,$arr)){
print_r($arr);
echo "<br/>";
echo $arr[1][0];
}
再加上 echo $content；
*/
$url = "http://www..com"; //目標站
$fp = @fopen($url, "r") or die("超時");

$content=file_get_contents($url);
$mode = "#<title>(.*)</title>#";
if(preg_match_all($mode,$content,$arr)){
//print_r($arr);
echo "<br/>";
echo $arr[1][0];
}
?>
<script language="javaScript" type="text/javascript">
<--
function ref(){
window.location.href="http://localhost//refesh.php";
}
setInterval("ref()",300000);
//-->
</script>

❹ 怎麼用php抓取網頁的快照

用curl，自己網路搜
或者file_get_content
$my_curl = curl_init(); //初始化一個curl對象
curl_setopt($my_curl, CURLOPT_URL, "http://www.jb51.net"); //設置你需要抓取的URL
curl_setopt($my_curl,CURLOPT_RETURNTRANSFER,1); //設置是將結果保存到字元串中還是輸出到屏幕上，1表示將結果保存到字元串
$str = curl_exec($curl); //執行請求
echo $str; //輸出抓取的結果
curl_close($curl); //關閉url請求

❺ PHP獲取網頁內容的幾種方法

簡單的收集下PHP下獲取網頁內容的幾種方法:
用file_get_contents,以get方式獲取內容。
用fopen打開url,以get方式獲取內容。
使用curl庫，使用curl庫之前，可能需要查看一下php.ini是否已經打開了curl擴展。
用file_get_contents函數，以post方式獲取url。
用fopen打開url，以post方式獲取內容。
用fsockopen函數打開url，獲取完整的數據，包括header和body。

❻ php curl 抓取頁面幾種方法介紹

使用代理進行抓取
為什麼要使用代理進行抓取呢？以google為例吧，如果去抓google的數據，短時間內抓的很頻繁的話，你就抓取不到了。google對你的ip地址做限制這個時候，你可以換代理重新抓。

代碼如下
<?php
$ch=curl_init();
curl_setopt($ch,CURLOPT_URL,"
);
curl_setopt($ch,CURLOPT_HEADER,false);
curl_setopt($ch,CURLOPT_RETURNTRANSFER,1);
curl_setopt($ch,CURLOPT_HTTPPROXYTUNNEL,TRUE);
curl_setopt($ch,CURLOPT_PROXY,125.21.23.6:8080);
//url_setopt($ch,CURLOPT_PROXYUSERPWD,'user:password');如果要密碼的話，加上這個
$result=curl_exec($ch);
curl_close($ch);
?>

❼ php獲取網頁源碼內容有哪些辦法

可以參考以下幾種方法：

方法一： file_get_contents獲取

<span style="white-space:pre"></span>$url="http://www..com/";

<span style="white-space:pre"></span>$fh= file_get_contents

('http://www.hxfzzx.com/news/fzfj/');<span style="white-space:pre"></span>echo $fh;

拓展資料

PHP（外文名:PHP: Hypertext Preprocessor，中文名：「超文本預處理器」）是一種通用開源腳本語言。語法吸收了C語言、Java和Perl的特點，利於學習，使用廣泛，主要適用於Web開發領域。PHP 獨特的語法混合了C、Java、Perl以及PHP自創的語法。它可以比CGI或者Perl更快速地執行動態網頁。

用PHP做出的動態頁面與其他的編程語言相比，PHP是將程序嵌入到HTML（標准通用標記語言下的一個應用）文檔中去執行，執行效率比完全生成HTML標記的CGI要高許多；PHP還可以執行編譯後代碼，編譯可以達到加密和優化代碼運行，使代碼運行更快。

❽ php抓取頁面內容

<?php
$rs=file_get_contents('http://www.boc.cn/sourcedb/whpj/enindex.html');
preg_match('/<tablewidth="600"border="0"cellpadding="5"cellspacing="1"bgcolor="#EAEAEA">(.*?)</table>/sS',$rs,$match);
//print_r($match);
$rs=str_replace(array('</tr>','</td>','<tralign="center">','<tdbgcolor="#FFFFFF">'),array('|',';'),$match[1]);
//www.hi-docs.com/php/str_replace.html
$data=array();
$rs=explode('|',$rs);
foreach($rsas$key=>$item){
	if($key>0){
		$arr=explode(';',$item);
		($a=@trim($arr[0]))&&($b=@trim($arr[5]))&&$data[]=array($a,$b);
	}
}
print_r($data);
?>

❾ 用PHP抓取一個頁面，但是這個頁面需要登錄才能顯示，怎麼抓取呢需要代碼

可以使用Snoopy.class.php這個類模擬登陸，然後再抓取你想要抓取的那個頁面。

❿ php抓取網頁源碼方法

可以使用file_get_content函數來獲取源代碼，你只需要把網站傳入這個函數，獲取後是一個字元串，你需要格式化代碼就可以了

閱讀全文

熱點內容

php批量查詢發布：2025-01-16 10:43:38 瀏覽：917

適合搭建代理伺服器的雲發布：2025-01-16 10:42:49 瀏覽：428

我的世界手機版伺服器怎麼注冊發布：2025-01-16 10:41:30 瀏覽：614

小米雲電視伺服器發布：2025-01-16 10:37:03 瀏覽：350

php開源wiki 發布：2025-01-16 10:27:19 瀏覽：189

sql加欄位備注發布：2025-01-16 10:21:49 瀏覽：565

線割編程教程發布：2025-01-16 10:21:03 瀏覽：18

谷歌瀏覽器緩存刪除發布：2025-01-16 10:19:36 瀏覽：414

資料庫txt 發布：2025-01-16 10:16:41 瀏覽：457

小米賬號王者傳奇腳本掛機發布：2025-01-16 10:07:25 瀏覽：917

php抓取頁面

與php抓取頁面相關的資訊