首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >R:在LexisNexis-data上使用tm函数语料库时,下标越界

R:在LexisNexis-data上使用tm函数语料库时,下标越界
EN

Stack Overflow用户
提问于 2016-01-06 22:57:11
回答 1查看 399关注 0票数 0

我正在尝试用tm-package创建一个来自LexisNexis的文章语料库。文章已从LexisNexis导出为.html,并使用tm.plugin.lexisnexis-package解析为R,如下所示:

代码语言:javascript
复制
> library("tm")
> library("tm.plugin.lexisnexis")
> src <- LexisNexisSource("~/Desktop/lexisnexis.html")

按照tm.plugin.lexisnexis-documentation中的说明,然后使用tm-package创建一个语料库,如下所示:

代码语言:javascript
复制
> data <- Corpus(src, readerControl = list(language = NA))
Error in getNodeSet(tree, "//div[@class = 'c3']/p[@class = 'c1']/span[@class = 'c4']")[[1]] : 
  subscript out of bounds

这个错误是什么意思,我该如何修复它?

示例html-data:link

EN

回答 1

Stack Overflow用户

发布于 2016-01-10 05:47:12

我是这个包的作者。因为LexisNexis使用的格式没有文档记录,所以它现在已经失效了。我会试着修复它,但如果有人提出补丁,它会更快发生。:-)

票数 1
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/34636145

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档