conll-2012

所需积分/C币:31 2019-01-11 10:38:28 67.81MB GZ
收藏 收藏
举报

OntoNotes 5.0的中文部分包括250K字的新闻专线数据,270K字的广播新闻和170K的广播会话。 新闻专线的数据来自中国树库5.0。 250K包括100K的新华新闻数据(chtb_001.fid到chtb_325.fid)和来自Sinorama新闻杂志的150K数据(chtb_1001.fid到chtb_1078.fid)。 广播新闻数据是来自TDT4的274K字,并且是从LDC为自动内容提取(ACE)程序注释的数据中选择的。已将这些文件的编号chtb_2000.fid分配给chtb_3145.fid。 广播对话数据是170K字,取自LDC的GALE数据。 50K的原始中文数

...展开详情
立即下载 低至0.43元/次 身份认证VIP会员低至7折
    一个资源只可评论一次,评论内容不能少于5个字
    放牛娃子 只有标注信息,没有原文章。到处都可以下载到,骗我5积分
    2019-02-15
    回复
    你是想要ontonotes? 这个收费的啊 我也没有
    关注 私信 TA的资源
    上传资源赚积分,得勋章
    最新推荐