0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

一些NER的英文数据集推荐

深度学习自然语言处理 来源:深度学习自然语言处理 作者:深度学习自然语言 2020-12-26 09:11 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

1MUC Data Sets

https://www-nlpir.nist.gov/related_projects/muc/

2CoNLL-2002
https://www.clips.uantwerpen.be/conll2002/ner/

3CoNLL-2003
CoNLL 2003是由新闻通讯社的文章以四种不同的语言(西班牙语、荷兰语、英语和德语)创建的,重点关注4个实体:PER(人员),LOC(位置),ORG(组织)和MISC(其他,包括所有其他类型的实体) https://www.clips.uantwerpen.be/conll2003/ner/


42010 I2B2
2010 I2B2 NER任务考虑了临床数据,重点关注临床问题、测试和治疗实体类型
https://www.i2b2.org/NLP/Relations/

5DDIExtraction2013(Drug NER)
重点关注药品、品牌、集团和药品n(未批准或新药)实体类型
https://www.cs.york.ac.uk/semeval-2013/task9/index.html

6CHEMPROT(Similar to 5)
相比5更侧重于化学和药物实体,例如缩写、配方、家族、标识符等
https://biocreative.bioinformatics.udel.edu/

7 microbiology NER datasets
从PubMed和生物学网站收集,并且主要关注细菌、栖息地和地理位置实体
http://2016.bionlp-st.org/tasks/bb2 (需要FQ访问)

责任编辑:xj

原文标题:一些NER的英文数据集

文章出处:【微信公众号:深度学习自然语言处理】欢迎添加关注!文章转载请注明出处。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 数据集
    +关注

    关注

    4

    文章

    1240

    浏览量

    26261
  • nlp
    nlp
    +关注

    关注

    1

    文章

    491

    浏览量

    23339

原文标题:一些NER的英文数据集

文章出处:【微信号:zenRRan,微信公众号:深度学习自然语言处理】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    如何使用 powerquad 加速器中的一些功能以及 CMSIS 原始实现中的一些功能?

    )。 如何使用 powerquad 加速器中的一些功能以及 CMSIS 原始实现中的一些功能。 Example: I do not want to call arm_mat_trans_q15 powerquad
    发表于 04-03 06:37

    时钟缓冲器的一些主要应用领域介绍

    电子设备和通信系统中都有广泛的应用,以下是一些主要的应用领域介绍:1.计算机与外设接口计算机内部的各种硬件设备需要通过总线相互通信,而这些设备的时钟信号通常是非常不稳
    的头像 发表于 04-02 16:30 8550次阅读
    时钟缓冲器的<b class='flag-5'>一些</b>主要应用领域介绍

    爬壁机器人磁铁的一些常见问题

    爬壁机器人近几年比较火,它是类能够在垂直墙面、天花板、倾斜表面上移动和作业的特种机器人,今天我们不聊其它,只聊下关于磁吸附应用中的磁铁,以下是小编整理的关于爬壁机器人中磁铁的一些常见问题。
    的头像 发表于 01-09 10:06 414次阅读
    爬壁机器人磁铁的<b class='flag-5'>一些</b>常见问题

    关于六类网线一些问题的解答

    今天我们就围绕网友一些常见的关于六类网线的问题进行下汇总式解答: 问 六类网线可以当电源用吗? 答 六类网线并不是设计用于传输电力的电缆,因此般不建议将其用于电源传输。 尽管六类网线的线芯可以
    的头像 发表于 12-09 11:13 745次阅读

    贴片电容精度J±5%的一些详细知识

    贴片电容精度J±5%表示电容的实际值与标称值之间的偏差范围在±5%以内 ,以下是关于贴片电容精度J±5%的一些详细知识: 、精度等级含义 J±5% :字母“J”在贴片电容的标识中通常表示标称精度
    的头像 发表于 11-20 14:38 944次阅读
    贴片电容精度J±5%的<b class='flag-5'>一些</b>详细知识

    蜂鸟E203的浮点指令F的一些实现细节

    蜂鸟E203的浮点指令F的一些实现细节 既然E203不是多发射,且为了节省面积,一些指令使用FPU内的同个子模块来执行,即FPU同时只能进行
    发表于 10-24 08:57

    Vector向量指令简介(

    3位标识数据位宽,高两位指示数据类型。 指令的类型由vetype的值进行标记,如果将vetype设为00000则会禁用向量寄存器。 对于vector指令来说,有一些必须要明白的名
    发表于 10-23 08:28

    在Ubuntu20.04系统中训练神经网络模型的一些经验

    本帖欲分享在Ubuntu20.04系统中训练神经网络模型的一些经验。我们采用jupyter notebook作为开发IDE,以TensorFlow2为训练框架,目标是训练个手写数字识别的神经网络
    发表于 10-22 07:03

    基于蜂鸟E203架构的指令K扩展

    扩展指令架构(RISC-V ISA)的K扩展。 K扩展是种可选的指令扩展,它增加了一些向量和矩阵操作的指令。这些指令可以利用硬件并行性,高效地处理大量
    发表于 10-21 09:38

    当不同的数据放在同个Flash页面上时,请问如何在不影响其他数据的情况下更改一些单独的数据

    当不同的数据放在同个Flash页面上时,如何在不影响其他数据的情况下更改一些单独的数据
    发表于 08-22 06:25

    AIcube1.4目标检测模型导入yolotxt格式数据直显示数据正在解析,为什么?

    AIcube1.4目标检测模型导入yolotxt格式数据直显示数据正在解析 数据有问题,把数据
    发表于 08-13 07:16

    云训练平台数据过大无法下载数据至本地怎么解决?

    起因是现在平台限制了图片数量,想要本地训练下载数据时发现只会跳出网络异常的错误,请问这有什么解决办法?
    发表于 07-22 06:03

    使用AICube导入数据点创建后提示数据不合法怎么处理?

    重现步骤 data目录下 labels.txt只有英文 **错误日志** 但是使用示例的数据可以完成训练并部署
    发表于 06-24 06:07

    数据下载失败的原因?

    数据下载失败什么原因太大了吗,小的可以下载,想把大的下载去本地训练报错网络错误 大的数据多大?数据量有多少?
    发表于 06-18 07:04

    Debian和Ubuntu哪个好一些

    兼容性对比Debian和Ubuntu哪个好一些,并为您揭示如何通过RAKsmart服务器释放Linux系统的最大潜能。
    的头像 发表于 05-07 10:58 1400次阅读