回文章列表
作者marr.bbs@bbs.sayya.org (Penelope) 看板: linux
標題Re: [問題] Wget抓文字檔的問題
時間SayYA 資訊站 (2008/02/26 Tue 18:22:07)
※ 引述《prokofieff.bbs@ptt.cc (普羅高菲夫)》之銘言:
> 對不起我是新手,
> 想請問我如果想去抓 http://www.milw0rm.com/exploits/5092 裡面的程式碼
> 所以我打 wget http://www.milw0rm.com/exploits/5092
> 可是抓回來的是HTML格式,
> 要怎麼樣把那些只抓網頁上顯示出來的文字呢? 謝謝

如果不限定要用 wget ...
至少還可用
1. lynx
 lynx -dump http://www.milw0rm.com/exploits/5092
2. Beautiful Soup
 http://www.crummy.com/software/BeautifulSoup/

--
http://www.python.org.tw/marr
--
※ Origin: SayYA 資訊站 <bbs.sayya.org> 
◆ From: dhcp-22213.iis.sinica.edu.tw
文章選讀←離開[主題上]主題下(k)上篇(j)下篇S/a搜尋 G串列 TAB精華 ↑↓捲 Pg/Space翻