Ele*_*off 5 r pandoc r-markdown bookdown
我的 bookdown .Rmd 文件中有几个 html 格式的 URL,这些 URL 在生成的 PDF 中消失了。该链接似乎被忽略,PDF 仅显示应连接该链接的文本。
例如,<a href="https://www.cygwin.com" target="_blank">Cygwin</a>仅显示为 Cygwin(无超链接)。
但是,当网站与显示的文本匹配时,它就可以正常工作(例如<a href="https://www.cygwin.com" target="_blank">https://www.cygwin.com</a>:),大概是因为文本就是链接本身。
有没有办法让 bookdown 在 PDF 输出中保留这些 html 超链接?
我正在运行以下命令在 R Studio 中生成 PDF:
render_book("index.Rmd", "bookdown::pdf_book")
Run Code Online (Sandbox Code Playgroud)
index.Rmd 的顶部如下所示:
title: "My Title"
site: bookdown::bookdown_site
documentclass: book
link-citations: yes
output:
bookdown::pdf_book:
pandoc_args: [--wrap=none]
urlcolor: blue
Run Code Online (Sandbox Code Playgroud)
Pandoc 和扩展 R Markdown 只保留链接的原始 HTML。原始 HTML 块输出为支持 HTML 的格式(如 epub),但不支持 LaTeX(用于生成 PDF)。Pandoc 只会解析链接的内容,这就是为什么如果您的链接文本是 URL,它似乎可以工作的原因。
最简单的解决方案当然是使用 Markdown 语法作为链接,它与 HTML: 一样具有表现力[Cygwin](https://www.cygwin.com){target="_blank"}。然而,如果这不是一个选择,那么事情就会变得有点棘手。
这是仍然解析这些链接的方法。它使用Lua 过滤器将原始 HTML 转换为正确的链接。只需将以下脚本保存parse-html-links.lua到与 Rmd 文件相同的目录中,然后添加'--lua-filter=parse-html-links.lua'到pandoc_args.
local elements_in_link = {}
local link_start
local link_end
Inline = function (el)
if el.t == 'RawInline' and el.format:match'html.*' then
if el.text:match'<a ' then
link_start = el.text
return {}
end
if el.text:match'</a' then
link_end = el.text
local link = pandoc.read(link_start .. link_end, 'html').blocks[1].content[1]
link.content = elements_in_link
-- reset
elements_in_link, link_start, link_end = {}, nil, nil
return link
end
end
-- collect link content
if link_start then
table.insert(elements_in_link, el)
return {}
end
-- keep original element
return nil
end
Run Code Online (Sandbox Code Playgroud)