“论文理解1”的版本间的差异

来自SUDA-HLT
跳到导航 跳到搜索
第1行: 第1行:
 
《一种基于“是一个”模式的下位概念获取方法》  计算机科学  刘磊等  2006  北京工业大学
 
《一种基于“是一个”模式的下位概念获取方法》  计算机科学  刘磊等  2006  北京工业大学
 
+
*1.文章为了解决“是一个”模式中下位概念的获取,制定了一套规则系统,通过过滤、剥离、歧义三方面的词典和句库(词典和句库是通过训练语料获得,再通过测试语料验证的),对字符串进行分流,抽取出下位概念。
1.文章为了解决“是一个”模式中下位概念的获取,制定了一套规则系统,通过过滤、剥离、歧义三方面的词典和句库(词典和句库是通过训练语料获得,再通过测试语料验证的),对字符串进行分流,抽取出下位概念。
+
*2.文章针对的的是“是一个”这种句型,基于字符串的分析单元,在测试时准确率和召回率没有给出具体的计算方式,应该是抽样检测的。
 
+
*3.语料:是从百度语料中抽取的3000w句包含“是一个”类型字符串的句子,4/5作为训练语料,训练出词典和句库,1/5为测试语料,判断准确率和召回率。
2.文章针对的的是“是一个”这种句型,基于字符串的分析单元,在测试时准确率和召回率没有给出具体的计算方式,应该是抽样检测的。
 
 
 
3.语料:是从百度语料中抽取的3000w句包含“是一个”类型字符串的句子,4/5作为训练语料,训练出词典和句库,1/5为测试语料,判断准确率和召回率。
 

2019年10月24日 (四) 04:43的版本

《一种基于“是一个”模式的下位概念获取方法》 计算机科学 刘磊等 2006 北京工业大学

  • 1.文章为了解决“是一个”模式中下位概念的获取,制定了一套规则系统,通过过滤、剥离、歧义三方面的词典和句库(词典和句库是通过训练语料获得,再通过测试语料验证的),对字符串进行分流,抽取出下位概念。
  • 2.文章针对的的是“是一个”这种句型,基于字符串的分析单元,在测试时准确率和召回率没有给出具体的计算方式,应该是抽样检测的。
  • 3.语料:是从百度语料中抽取的3000w句包含“是一个”类型字符串的句子,4/5作为训练语料,训练出词典和句库,1/5为测试语料,判断准确率和召回率。