保存网站中的所有图像文件

Zac*_*iro 7 ruby screen-scraping web-crawler nokogiri

我正在为自己创建一个小应用程序,我在其中运行Ruby脚本并将所有图像保存在我的博客中.

在我识别出图像文件后,我无法弄清楚如何保存图像文件.任何帮助将非常感激.

require 'rubygems'
require 'nokogiri'
require 'open-uri'

url = '[my blog url]'
doc = Nokogiri::HTML(open(url))

doc.css("img").each do |item|
  #something
end
Run Code Online (Sandbox Code Playgroud)

Phr*_*ogz 26

URL = '[my blog url]'

require 'nokogiri' # gem install nokogiri
require 'open-uri' # already part of your ruby install

Nokogiri::HTML(open(URL)).xpath("//img/@src").each do |src|
  uri = URI.join( URL, src ).to_s # make absolute uri
  File.open(File.basename(uri),'wb'){ |f| f.write(open(uri).read) }
end
Run Code Online (Sandbox Code Playgroud)

使用代码从此处转换为绝对路径:如何在使用Nokogiri提取链接时获取绝对URL?