테스트 사이트 - 개발 중인 베타 버전입니다

php 파싱! 간편하면서 강력한 - PHP Simple HTML DOM Parser

· 12년 전 · 20702 · 14
http://simplehtmldom.sourceforge.net/

다운로드 링크  : http://sourceforge.net/projects/simplehtmldom/files/latest/download?source=files


해당 홈에 나와있는 예제입니다.
간단한 주석을 붙입니다.

//html 을 가져오고
$html = file_get_html('http://www.google.com/');            

// 모든 이미지태그를 찾아냅니다.
foreach($html->find('img') as $element) 
       echo $element->src . '<br>';                                  

// 모든 a태그를 찾아내어 href속성을 뿌려줍니다.
foreach($html->find('a') as $element)                             
       echo $element->href . '<br>';

// 컨텐츠내에 텍스트들만 가져옵니다.
echo file_get_html('http://www.google.com/')->plaintext

// css jquery 많이 만져보셨다면 선택자는 거의 동일합니다.
//몇번째 a태그 같은 경우도 가져올수 있구요
foreach($html->find('div.article') as $article) {
    $item['title']     = $article->find('div.title'0)->plaintext;
    $item['intro']    = $article->find('div.intro'0)->plaintext;
    $item['details'] = $article->find('div.details'0)->plaintext;
    $articles[] = $item;
}

//가져오기전 해당 태그내의 텍스트도 이렇게 간단히 변경가능합니다.
$html->find('div[id=hello]', 0)->innertext = 'foo';



현재 홈에는 예제가 별로 안나와있는데 파일받아보시면
풍부한 예제가 많습니다.
강력추천드립니다 ㅋㅎ



댓글 작성

댓글을 작성하시려면 로그인이 필요합니다.

로그인하기

댓글 14개

12년 전
서버 접속후에
grep allow_url_fopen /etc/php.ini
입력해보세요.

allow_url_fopen 설정이 on인지 off인지 보일꺼에요.
on이 되어있어야 합니다.

php.ini 파일 직접한번 봐보셔두 됩니다 ㅎㅎ
.htaccess 에
php_flag register_globals on 설정되어있습니다.
ㅠㅠ
감사드려요
좋긴 한데..메모리누수 버그가 있었는데..지금은 패치가 되엇나요??
clear, destruct, unset...등 조치해야 되었던거 같은데..
무지...편리하긴 한데..

게시글 목록

번호 제목
4405
17973
17969
30568
17965
17962
17959
17955
17953
17950
17947
4403
17944
17943
17941
17939
17935
17928
4391
17926
17923
17920
17917
26380
17916
30565
17910
17907
17905
30555
17904
30552
17901
17900
17898
30549
17895
26379
26378
26377
17893
17891
17888
17885
17883
17882
17861
17859
17857
4388
24413
4383
17849
17847
17845
17844
17839
17838
30548
17836
17833
17831
17827
17826
17823
17820
17818
24412
30547
17814
4377
30544
17813
17810
26373
17804
30543
17803
4370
17801
17796
26372
17794
30536
17791
4364
17789
30535
17788
30527
30525
30524
4358
30521
17781
26371
17776
4343
17772
17768