首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >模糊匹配Informatica vs SQL

模糊匹配Informatica vs SQL
EN

Stack Overflow用户
提问于 2014-08-21 22:54:19
回答 2查看 2.1K关注 0票数 0

我们目前正在讨论是在SQL中实现成对匹配函数来对发票参考号执行模糊匹配,还是沿着Informatica的路线走下去。

Informatica是一个很好的解决方案(我听说过),但是我不熟悉这个软件。

有没有人对它的模糊匹配功能有什么经验,以及它比用SQL构建一些逻辑更有优势。

谢谢

EN

回答 2

Stack Overflow用户

发布于 2014-09-22 23:47:16

可以在Informatica中使用解析器转换来完成这项工作。可以在Informatica中创建引用数据对象,用于搜索给定的字符串。参考数据对象具有以下类型-模式集、概率模型、参考表、正则表达式、令牌集。Pattern set -模式集包含识别数据模式的逻辑,例如区分姓名的首字母。概率模型-概率模型通过令牌包含的信息类型和输入字符串中的位置来识别令牌。概率模型包含以下列:表示输入端口上的数据的输入列。您可以使用来自输入端口的样本数据填充该列。该模型在解析和标记操作中使用样本数据作为参考数据。标识每个输入字符串中的信息类型的一个或多个标签列。将列添加到模型中,并将标签分配给每个字符串中的标记。使用标签列指示标记在字符串中的正确位置。当您在解析器转换中使用概率模型时,解析器根据与值匹配的标签将每个输入值写入输出端口。例如,解析器将字符串"Franklin Delano Roosevelt“写入FIRSTNAME、MIDDLENAME和LASTNAME输出端口。解析器转换可以推断输入端口数据值和模型数据值之间的匹配,即使端口数据没有在模型中列出。这意味着概率模型不需要列出数据集中的每个令牌来正确地标记或解析数据集中的令牌。转换使用概率或模糊逻辑来识别与概率模型中的令牌匹配的令牌。您可以在编译概率模型时更新模糊逻辑规则。Reference Table -这是一个用于搜索的数据库表

票数 0
EN

Stack Overflow用户

发布于 2014-10-02 13:45:07

在这里,您的数据似乎是非结构化的,您希望从中提取有意义的数据。如果您的数据遵循某种模式,Informatica DataTransformation(DT)工具是很好的工具。它与Informatica PowerCenter中的UDT转换一起使用。使用DT,您可以创建一个解析器来解析您的数据,并使用序列化程序将其写入您想要的任何形式,之后您可以使用Informatica PowerCenter的ETL功能对该数据进行聚合和其他转换。DT以其解析PDF、表单和发票的能力而闻名。我希望它能解决这个问题。

票数 0
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/25429546

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档