代码之家  ›  专栏  ›  技术社区  ›  Daniel

StanfordCoreNLP:为什么有两种不同的数据结构。解析和依赖解析?

  •  2
  • Daniel  · 技术社区  · 11 年前

    为什么斯坦福:CoreNLP使用不同的数据结构来表示其树(例如,带有“BasicDependenciesAnnotation”的dep.tree和带有“TreeAnnotation的cons.tree)? 这些注释似乎可以用相同的数据结构表示(就像带有标签的DAG)。有什么机制可以将它们相互传递吗?(至少对其中一些人来说)

    链接: http://nlp.stanford.edu/software/corenlp.shtml

    1 回复  |  直到 11 年前
        1
  •  2
  •   Jon Gauthier    11 年前

    依赖关系解析在折叠时不一定是DAG。从 Stanford Dependencies manual :

    折叠和CCprocessed依赖项不是DAG。图可以包含两个节点之间的小循环(仅限)。考虑到目前的代表性选择,这些似乎不可消除。它们出现在相关子句中,如 介绍你的那个女人 。当您希望表示 。在基本和额外的表示中 rcmod(woman, introduced) , nsubj(introduced, who) ref(woman, who) 。在折叠过程中,ref弧被折叠,因此有一个两节点循环: rcmod(女性,介绍) nsubj(introduced, woman) .