我有一个项目在哪里,我会下载过去一年发送给名人的所有推文,并对他们做一个情绪分析,并评估谁是最积极的粉丝.
然后我发现你可以使用tweepy/twitter API在最近7天内检索twitter提及.我清理了网络,但在过去的一年里找不到任何下载推文的方法.
无论如何,我决定仅在过去7天内完成该项目的数据并编写以下代码:
try:
while 1:
for results in tweepy.Cursor(twitter_api.search, q="@celebrity_handle").items(9999999):
item = (results.text).encode('utf-8').strip()
wr.writerow([item, results.created_at]) # write to a csv (tweet, date)
Run Code Online (Sandbox Code Playgroud)
我正在使用Cursor搜索api,因为获取提及的另一种方式(更准确的方法)仅限于检索最后800条推文.
无论如何,在一夜之间运行代码之后,我只能下载32K的推文.其中约90%是转推.
是否有更好的方法来获取数据?
请记住:
任何建议都会受到欢迎,但在目前这一刻,我的想法不合时宜.
我在neo4j数据库中有近5000个节点Recipes和5个节点Meal_Types.现在他们之间没有任何关系.我在下面运行CQL:
MATCH (n) RETURN n LIMIT 100000
这样运行正常,但它只返回与之相关的节点Recipes.可能存在隐藏的东西,我的意思是可能存在与之相关的节点,Meal_Types但由于它们具有相同的颜色,因此很难区分它们.
那么有没有办法让所有节点分别用不同颜色显示?
假设我有以下列表:
candy = ['a','b','c']
fruit = ['d','e','f']
snack = ['g','h','i']
Run Code Online (Sandbox Code Playgroud)
和一个字符串
name = 'fruit'
Run Code Online (Sandbox Code Playgroud)
我想使用字符串name来访问列表及其内容.在这种情况下应该是fruit.我将name用于迭代列表.如:
for x in name:
print x
Run Code Online (Sandbox Code Playgroud)