首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >Syntaxnet土耳其语数据集不存在地图文件

Syntaxnet土耳其语数据集不存在地图文件
EN

Stack Overflow用户
提问于 2016-09-22 11:11:59
回答 1查看 349关注 0票数 4

我是语法网的新手,我试着通过这里指令使用预先训练过的土耳其语模型。

Point-1 :尽管我设置了MODEL_DIRECTORY环境变量,但tokenize.sh没有找到相关的路径,它给出了如下错误:

代码语言:javascript
复制
root@4562a2ee0202:/opt/tensorflow/models/syntaxnet# echo "Eray eve geldi." | syntaxnet/models/parsey_universal/tokenize.sh
F syntaxnet/term_frequency_map.cc:62] Check failed: ::tensorflow::Status::OK() == (tensorflow::Env::Default()->NewRandomAccessFile(filename, &file)) (OK vs. **Not found: label-map**)

Point-2 :所以,我通过注释MODEL_DIR=$1更改了tokenize.sh,并设置了如下所示的土耳其语模型路径:

代码语言:javascript
复制
PARSER_EVAL=bazel-bin/syntaxnet/parser_eval
CONTEXT=syntaxnet/models/parsey_universal/context.pbtxt
INPUT_FORMAT=stdin-untoken
MODEL_DIR=$1
MODEL_DIR=syntaxnet/models/etiya-smart-tr

Point-3 :之后,当我按规定运行它时,它会产生如下所示的错误:

代码语言:javascript
复制
root@4562a2ee0202:/opt/tensorflow/models/syntaxnet# echo "Eray eve geldi" | syntaxnet/models/parsey_universal/tokenize.sh
I syntaxnet/term_frequency_map.cc:101] Loaded 29 terms from syntaxnet/models/etiya-smart-tr/label-map.
I syntaxnet/embedding_feature_extractor.cc:35] Features: input.char input(-1).char input(1).char; input.digit input(-1).digit input(1).digit; input.punctuation-amount input(-1).punctuation-amount input(1).punctuation-amount 
I syntaxnet/embedding_feature_extractor.cc:36] Embedding names: chars;digits;puncts
I syntaxnet/embedding_feature_extractor.cc:37] Embedding dims: 16;16;16
F syntaxnet/term_frequency_map.cc:62] Check failed: ::tensorflow::Status::OK() == (tensorflow::Env::Default()->NewRandomAccessFile(filename, &file)) (OK vs. **Not found: syntaxnet/models/etiya-smart-tr/char-map**)

我通过跟踪类似于download.tensorflow.org/models/parsey_universal/.zip的链接模式和语言映射文件列表下载了土耳其包,如下所示:

  • -rw-r -rw-r -rw-r -rw-r -rw-r -rw-r -rw-r -rw-r -rw-r -rw-r -rw-r

问题1 :我知道目录中没有char-map文件,所以我得到了上面写的@ Point-3错误。那么,是否有人对如何进行土耳其语测试有意见,例如,结果被分享为%93,363 %?

问题2:如何找到土耳其语的char-map文件?

问题-3:如果没有char-map文件,我必须通过跟踪指示为SyntaxNet的获取数据和培训的步骤来训练吗?

问题4:有一种方法可以生成单词映射,字符映射.等等档案?是众所周知的word2vec方法可以用来生成映射文件,这些文件可以被处理成wt. Syntaxnet令牌吗?

EN

回答 1

Stack Overflow用户

回答已采纳

发布于 2017-01-11 08:07:56

尝试这个https://github.com/tensorflow/models/issues/830问题--它包含一个临时解决方案(此时)。

票数 1
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/39637442

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档