回文章列表
作者Chris7462.bbs@bbs.math.ncu.edu.tw (~烤焦麵包~) 看板: linux
標題Re: [問題] Wget抓文字檔的問題
時間織夢天堂 (2008/02/26 Tue 20:42:10)
※ 引述《marr.bbs@bbs.sayya.org (Penelope)》之銘言:
> ※ 引述《prokofieff.bbs@ptt.cc (普羅高菲夫)》之銘言:
> > 對不起我是新手,
> > 想請問我如果想去抓 http://www.milw0rm.com/exploits/5092 裡面的程式碼
> > 所以我打 wget http://www.milw0rm.com/exploits/5092
> > 可是抓回來的是HTML格式,
> > 要怎麼樣把那些只抓網頁上顯示出來的文字呢? 謝謝
> 如果不限定要用 wget ...
> 至少還可用
> 1. lynx
>  lynx -dump http://www.milw0rm.com/exploits/5092
> 2. Beautiful Soup
>  http://www.crummy.com/software/BeautifulSoup/

幫你補一個 curl
http://curl.haxx.se/

Perl 的 WWW::Mechanize 也可以達到同樣的效果


--
發信站 [中央數學  織夢天堂 bbs.math.ncu.edu.tw]
  ‧FROM [Chris7462 從 212-221.dorm.ncu.edu.tw 發表]
文章選讀←離開[主題上]主題下(k)上篇(j)下篇S/a搜尋 G串列 TAB精華 ↑↓捲 Pg/Space翻