我想使用 R 获取引用科学期刊论文的文章列表。
我所掌握的唯一信息是文章的标题,例如“使用福林酚试剂进行蛋白质测量”。
有人能够通过制作一个我可以使用的可复制示例来帮助我吗?
这是我到目前为止所尝试的。
R 包fulltext似乎很有用,因为它允许检索链接到文章的 ID 列表。例如,我可以获得文章的 DOI:
library(fulltext)
res1 <- ft_search(query = "Protein measurement with the folin phenol reagent", from = "crossref")
res1 <- ft_links(res1)
res1$crossref$ids
Run Code Online (Sandbox Code Playgroud)
以同样的方式,我可以通过from = "scopus"在函数中设置fulltext::ft_search(并包含 Scopus API 密钥)来获取 scopus id。
如果使用 DOI,我可以使用 R 库获取文章的引用次数rcrossref:
rcrossref::cr_citation_count(res1$crossref$ids[1])
Run Code Online (Sandbox Code Playgroud)
rscopus同样,如果我想使用 scopus id 而不是 DOI,我可以使用 R 包。
不幸的是,这些信息对我来说还不够,因为我需要引用该论文的文章列表,而不是数量。
我在互联网上看到很多人使用该软件包scholar。但如果我理解正确的话,为了让它发挥作用,我需要文章的作者有一个谷歌学者ID,而且我必须找到一种方法来检索这个ID。所以它看起来不像是一个可行的解决方案。
有谁知道如何解决这个问题?
我已在http://www.developers.elsevier.com/action/devprojects注册。我创建了一个项目并获得了我的 scopus 密钥:
现在,使用这个生成的密钥,我想找到firstname、lastname和的作者subjectarea。我从我的大学网络发出请求,该网络允许访问 Scopus(我可以完全手动访问 Scopus 搜索,从 Firefox 使用它没有问题)。然而,我想通过编写一个简单的脚本来自动化我的 Scopus 挖掘。我想通过提供作者的 、 和 来查找该作者firstname的lastname出版物subjectarea。
这是我的代码:
# !/usr/bin/env python
# -*- coding: utf-8 -*-
import requests
import json
from scopus import SCOPUS_API_KEY
scopus_author_search_url = 'http://api.elsevier.com/content/search/author?'
headers = {'Accept':'application/json', 'X-ELS-APIKey': SCOPUS_API_KEY}
search_query = 'query=AUTHFIRST(%) AND AUTHLASTNAME(%s) AND SUBJAREA(%s)' % ('John', 'Kitchin', 'COMP')
# api_resource = "http://api.elsevier.com/content/search/author?apiKey=%s&" % (SCOPUS_API_KEY)
# request with first searching page
page_request = requests.get(scopus_author_search_url + …Run Code Online (Sandbox Code Playgroud) 我正在使用 Elsevier API 通过scopus-api 模块访问来自 Scopus 的引用计数数据(但很乐意使用 Elsevier 的elsapy 模块)。我可以访问我需要的数据,但每周可以发出的请求数量有限制。
如何获得一周的剩余请求数?
感谢所有帮助。
是否可以使用 Elsevier API 获取具体出版物的所有引用(通过 scopus_id、doi ...)?
我试图做到这一点,尽我所能,就是获取引用计数,但我至少需要作者和标题。
例如,如果我想做:
https://api.elsevier.com/content/abstract/citations?pubmed_id=3472723&httpAccept=application/json&apiKey={myKey}
Run Code Online (Sandbox Code Playgroud)
我得到:
"{"service-error":{"status":{"statusCode":"AUTHENTICATION_ERROR","statusText":"Requestor configuration settings insufficient for access to this resource."}}}"
Run Code Online (Sandbox Code Playgroud)
有可能得到我想要的吗?
谢谢
我正在使用Elsevier制作的Scopus API. http://dev.elsevier.com/sc_apis.html
我写了一篇简短的python脚本来提取有关论文的信息,例如标题,DOI号和引用该论文的论文的DOI号.
然而,我真正想要的是能够提取我正在从中提取信息的论文中引用的DOI数量的论文.
到目前为止,这是我的代码的重要部分
paper_info_search = requests.get(api_resource + 'query=doi(10.1016/j.fusengdes.2015.04.018)', headers=headers)
Run Code Online (Sandbox Code Playgroud)
这会在纸上提取大量信息(标题,作者等)
citations_of_paper = requests.get(api_resource + 'query=refeid(' + EID + ')', headers=headers)
Run Code Online (Sandbox Code Playgroud)
得到引用该论文的论文清单
有谁知道如何获得本文中出现的参考.
scopus ×6
python ×3
citations ×2
api ×1
r ×1
reference ×1
search ×1
web-crawler ×1
web-scraping ×1