Zac*_*iro 7 ruby screen-scraping web-crawler nokogiri
我正在为自己创建一个小应用程序,我在其中运行Ruby脚本并将所有图像保存在我的博客中.
在我识别出图像文件后,我无法弄清楚如何保存图像文件.任何帮助将非常感激.
require 'rubygems'
require 'nokogiri'
require 'open-uri'
url = '[my blog url]'
doc = Nokogiri::HTML(open(url))
doc.css("img").each do |item|
#something
end
Run Code Online (Sandbox Code Playgroud)
Phr*_*ogz 26
URL = '[my blog url]'
require 'nokogiri' # gem install nokogiri
require 'open-uri' # already part of your ruby install
Nokogiri::HTML(open(URL)).xpath("//img/@src").each do |src|
uri = URI.join( URL, src ).to_s # make absolute uri
File.open(File.basename(uri),'wb'){ |f| f.write(open(uri).read) }
end
Run Code Online (Sandbox Code Playgroud)
使用代码从此处转换为绝对路径:如何在使用Nokogiri提取链接时获取绝对URL?
| 归档时间: |
|
| 查看次数: |
10785 次 |
| 最近记录: |