Articulo de referencia

Bioconservación

La bioconservación es el campo de las ciencias de la vida dedicado a organizar datos, información y conocimiento biomédicos en formatos estructurados, como hojas de cálculo , ta...

La bioconservación es el campo de las ciencias de la vida dedicado a organizar datos, información y conocimiento biomédicos en formatos estructurados, como hojas de cálculo , tablas y grafos de conocimiento . [ 1 ] [ 2 ] La bioconservación del conocimiento biomédico es posible gracias al trabajo cooperativo de bioconservadores, desarrolladores de software y bioinformáticos , y constituye la base del trabajo de las bases de datos biológicas . [ 1 ]

La bioconservación como profesión

Artículos sobre bioconservación en PubMed por año desde la primera mención en 2006 hasta finales de 2022.

Un bioconservador es un científico profesional que organiza , recopila, anota y valida información difundida por bases de datos de organismos biológicos y modelo . [ 3 ] [ 4 ] Es una profesión nueva, cuyas primeras menciones en la literatura científica datan de 2006 en el contexto del trabajo en bases de datos como la Base de Datos y Recurso de Análisis de Epítopos Inmunitarios . [ 5 ] [ 6 ] Los bioconservadores suelen tener un doctorado y una combinación de experiencia en laboratorio y representaciones computacionales del conocimiento (por ejemplo, mediante ontologías ). [ 7 ]

El rol de un bioconservador abarca el control de calidad de los datos de investigación biológica primaria destinados a la publicación, la extracción y organización de datos de la literatura científica original, y la descripción de los datos con protocolos y vocabularios de anotación estándar que permiten consultas potentes e interoperabilidad de bases de datos biológicas . Los bioconservadores se comunican con los investigadores para garantizar la precisión de la información curada y fomentar el intercambio de datos con laboratorios de investigación. [ 6 ]

Los bioconservadores están presentes en diversos entornos de investigación, pero es posible que no se identifiquen como tales. Proyectos como ELIXIR (Infraestructura Europea de Ciencias de la Vida para la Información Biológica) y GOBLET (Organización Global para el Aprendizaje, la Educación y la Formación en Bioinformática) [ 8 ] promueven la formación y apoyan la bioconservación como trayectoria profesional. [ 9 ] [ 10 ]

En 2011, la bioconservación ya era reconocida como una profesión, pero no existían cursos de grado formales para preparar a los conservadores de datos biológicos de manera específica. [ 11 ] Con el crecimiento del campo, la Universidad de Cambridge y el EMBL-EBI comenzaron a ofrecer conjuntamente un Certificado de Posgrado en Bioconservación, [ 12 ] considerado un paso hacia el reconocimiento de la bioconservación como una disciplina independiente. [ 13 ] Existe un aumento percibido en la demanda de bioconservación y una necesidad de capacitación adicional en bioconservación por parte de los programas de posgrado . [ 14 ]

Las organizaciones que emplean bioconservadores, como Clinical Genome Resource (ClinGen), suelen proporcionar materiales especializados y formación para la bioconservación. [ 15 ]

bases de conocimiento biológico

El papel de los bioconservadores es bien conocido en el campo de las bases de datos biológicas . Dichas bases de datos, como UniProt [ 16 ] y PDB [ 17 ], dependen de bioconservadores profesionales para organizar la información. Entre otras cosas, los bioconservadores trabajan para mejorar la calidad de los datos, por ejemplo, fusionando entradas duplicadas. [ 18 ]

Una parte importante de esas bases de conocimiento son las bases de datos de organismos modelo , que dependen de bioconservadores para curar información sobre organismos de tipos particulares. Algunos ejemplos notables de bases de datos de organismos modelo son FlyBase , [ 19 ] PomBase , [ 20 ] y ZFIN , [ 21 ] dedicadas a curar información sobre Drosophila , Schizosaccharomyces pombe y pez cebra respectivamente.

Curación y anotación

La bioconservación consiste en la integración de información biológica en bases de datos en línea de forma semánticamente estandarizada, utilizando identificadores únicos y rastreables adecuados, y proporcionando los metadatos necesarios, incluyendo la fuente y la procedencia.

Ontologías, vocabularios controlados y nombres estándar

Los biocuradores suelen emplear y participar en la creación y el desarrollo de ontologías biomédicas compartidas: vocabularios estructurados y controlados que abarcan numerosos dominios del conocimiento biológico y médico, como las Ontologías Biomédicas Abiertas . Estos dominios incluyen genómica y proteómica , anatomía , desarrollo animal y vegetal , bioquímica , vías metabólicas , clasificación taxonómica y fenotipos mutantes . Dada la variedad de ontologías existentes, existen directrices que orientan a los investigadores sobre cómo elegir la más adecuada. [ 22 ]

El Sistema Unificado de Lenguaje Médico es uno de esos sistemas que integra y distribuye millones de términos utilizados en el ámbito de las ciencias de la vida. [ 23 ]

Los bioconservadores velan por el uso coherente de las directrices de nomenclatura genética y participan en los comités de nomenclatura genética de diversos organismos modelo , a menudo en colaboración con el Comité de Nomenclatura Genética HUGO ( HGNC ). También velan por el cumplimiento de otras directrices de nomenclatura, como las proporcionadas por el Comité de Nomenclatura de la Unión Internacional de Bioquímica y Biología Molecular (IUBMB), un ejemplo de las cuales es el número EC de la Comisión de Enzimas .

En términos más generales, la comunidad elogia el uso de identificadores persistentes , por lo que mejoran la claridad y facilitan el conocimiento [ 24 ].

anotación de ADN

En la anotación del genoma , por ejemplo, los identificadores definidos por los ontólogos y consorcios se utilizan para describir partes del genoma. Por ejemplo, la ontología génica (GO) recopila términos para procesos biológicos, que se utilizan para describir lo que sabemos sobre genes específicos .

Anotaciones de un texto biomédico en la plataforma Europe PMC SciLite.

Anotación de texto

En 2021, la comunicación en ciencias de la vida aún se realizaba principalmente mediante lenguas naturales libres, como el inglés o el alemán , que presentan cierto grado de ambigüedad y dificultan la conexión del conocimiento. Por ello, además de anotar secuencias biológicas, los bioconservadores también anotan textos, vinculando palabras a identificadores únicos. Esto ayuda a desambiguar, a clarificar el significado previsto y a que los textos sean procesables por ordenadores. Una aplicación de la anotación de textos es especificar el gen exacto al que se refiere un científico. [ 25 ]

Las anotaciones de texto disponibles públicamente permiten a los biólogos aprovechar mejor los textos biomédicos. Europe PMC cuenta con una interfaz de programación de aplicaciones (API) que centraliza las anotaciones de texto de diversas fuentes y las pone a disposición en una interfaz gráfica de usuario (GPU ) llamada SciLite. [ 26 ] PubTator Central también proporciona anotaciones, pero se basa completamente en la minería de texto computarizada y no ofrece una interfaz de usuario. [ 27 ] También existen programas que permiten a los usuarios anotar manualmente los textos biomédicos de su interés, como el sistema ezTag. [ 28 ]

Curación de variantes

Un tipo de biocuración dentro del campo de la genética médica , la curación de variantes es un proceso para evaluar los cambios genéticos según la probabilidad de que puedan causar enfermedades. [ 29 ] Este es un proceso basado en la evidencia que utiliza datos de múltiples fuentes. Estas fuentes pueden incluir datos poblacionales, datos computacionales, datos funcionales, datos de segregación , datos de novo , datos alélicos , entre otros. [ 30 ] Es un proceso colaborativo que puede automatizarse, sin embargo, la curación manual se considera el estándar de oro. [ 31 ]

No existe un único proceso estandarizado de curación de variantes; diferentes investigadores y organizaciones utilizan distintos procesos de curación de variantes. [ 29 ] Sin embargo, el Colegio Americano de Genética Médica y la Asociación de Patología Molecular han desarrollado conjuntamente un conjunto de estándares y directrices internacionalmente aceptados [ 32 ] para la interpretación de variantes genéticas . [ 30 ] Estas se conocen como las directrices ACMG/AMP. Estas directrices proporcionan un marco para clasificar las variantes genéticas como "patogénicas", "probablemente patogénicas", "significado incierto", "probablemente benignas" o "benignas", en orden desde las más propensas a causar enfermedad hasta las menos propensas. Las directrices también enumeran varios niveles de evidencia que van desde muy fuerte, fuerte, moderada o de apoyo. [ 33 ] La combinación de los tipos de evidencia encontrados y los niveles en los que existen esas evidencias permite clasificar cada variante a lo largo de la escala de "patogénica" a "benigna". [ 32 ]

Sociedad Internacional de Bioconservación (ISB)

La Sociedad Internacional de Bioconservación (ISB) es una organización sin fines de lucro que "promueve el campo de la bioconservación y proporciona un foro para el intercambio de información a través de reuniones y talleres". Surgió de las Conferencias Internacionales de Bioconservación y fue fundada a principios de 2009. [ 4 ]

El ISB ofrece el Premio a la Trayectoria Profesional en Bioconservación a los bioconservadores de la comunidad: el Premio a la Trayectoria Profesional en Bioconservación (que se otorga anualmente) y el Premio ISB a las Contribuciones Excepcionales a la Bioconservación (que se otorga cada dos años).

La revista oficial del ISB, Database , es un espacio especializado en artículos sobre bases de datos y bioconservación. [ 34 ]

Curación comunitaria

Tradicionalmente, la bioconservación ha sido realizada por expertos especializados, quienes integran los datos en bases de datos. La curación comunitaria ha surgido como un enfoque prometedor para mejorar la difusión del conocimiento a partir de datos publicados y proporcionar una forma rentable de mejorar la escalabilidad de la bioconservación. En algunos casos, se aprovecha la ayuda de la comunidad en encuentros que introducen a expertos en el dominio a las tareas de curación, llevadas a cabo durante el evento, [ 35 ] mientras que otros se basan en contribuciones asíncronas de expertos y no expertos. [ 36 ]

Bases de datos biológicas

Portal de curación de la comunidad de WormBase
Portal de curación comunitaria de WormBase [ 37 ]

Varias bases de datos biológicas incluyen, en cierta medida, contribuciones de los autores en su estrategia de curación funcional, que puede abarcar desde la asociación de identificadores de genes con publicaciones o texto libre, hasta una anotación más estructurada y detallada de secuencias y datos funcionales, lo que resulta en una curación con los mismos estándares que los biocuradores profesionales. La mayor parte de la curación comunitaria en las Bases de Datos de Organismos Modelo implica la anotación por parte de los autores originales de las investigaciones publicadas (anotación inicial) para obtener identificadores precisos de los objetos que se van a curar o para identificar tipos de datos para una curación detallada. Por ejemplo:

  • WormBase solicita con éxito la anotación inicial de los usuarios y ha integrado la curación de autores con el proceso de micropublicación. [ 38 ] WormBase también integra la minería de texto en su plataforma, proporcionando sugerencias a los curadores de la comunidad. [ 37 ]
  • FlyBase envía solicitudes por correo electrónico a los autores de nuevas publicaciones, [ 39 ] invitándolos a enumerar los genes y tipos de datos descritos a través de una herramienta en línea y también ha movilizado a la comunidad para escribir párrafos de resumen de genes. [ 40 ]

Otras bases de datos, como PomBase , dependen de que los autores de las publicaciones envíen anotaciones muy detalladas basadas en ontologías para sus publicaciones, y metadatos asociados con conjuntos de datos genómicos utilizando vocabularios controlados. Se desarrolló una herramienta web , Canto [ 41 ] , para facilitar las contribuciones de la comunidad. Dado que Canto es de libre acceso, genérico y altamente configurable, ha sido adoptado por otros proyectos. [ 42 ] La curación está sujeta a revisión por curadores profesionales, lo que resulta en una curación exhaustiva y de alta calidad de todos los tipos de datos moleculares. [ 43 ]

La base de datos UniProt, ampliamente utilizada , también cuenta con un mecanismo de curación comunitaria que permite a los investigadores agregar información sobre proteínas. [ 44 ]

Recursos al estilo wiki

Las biowikis dependen de sus comunidades para proporcionar contenido y hay una serie de recursos de estilo wiki disponibles para la biocuración. [ 45 ] [ 46 ] AuthorReward , [ 47 ] por ejemplo, es una extensión de MediaWiki que cuantifica las contribuciones de los investigadores a las wikis de biología. RiceWiki fue un ejemplo de una base de datos basada en wiki para la curación comunitaria de genes de arroz equipada con AuthorReward . [ 48 ] [ 49 ] CAZypedia es otra wiki de este tipo para la biocuración comunitaria de información sobre enzimas activas en carbohidratos (CAZys). [ 50 ]

WikiProteins /WikiProfessional fue un proyecto para organizar semánticamente datos biológicos liderado por Barend Mons . [ 51 ] [ 52 ] El proyecto de 2007 contó con contribuciones directas de Jimmy Wales , cofundador de Wikipedia, y se inspiró en Wikidata . [ 51 ] Un proyecto actualmente activo que funciona con una adaptación del software MediaWiki es WikiPathways , que recopila información sobre rutas biológicas mediante crowdsourcing . [ 53 ]

Wikipedia

Hay cierta superposición entre el trabajo de los bioconservadores y Wikipedia , y los límites entre las bases de datos científicas y Wikipedia se vuelven cada vez más difusos. [ 54 ] [ 46 ] [ 55 ] Bases de datos como Rfam [ 56 ] [ 57 ] y el Protein Data Bank [ 58 ] por ejemplo hacen un uso intensivo de Wikipedia y sus editores para curar información. [ 59 ] [ 60 ] Sin embargo, la mayoría de las bases de datos ofrecen datos altamente estructurados que se pueden buscar en combinaciones complejas, lo que generalmente no es posible en Wikipedia, aunque Wikidata pretende resolver este problema en cierta medida.

El proyecto Gene Wiki utilizó Wikipedia para la curación colaborativa de miles de genes y productos genéticos, como la titina y la insulina . [ 61 ] Varios proyectos también emplean Wikipedia como plataforma para la curación de información médica. [ 36 ]

Otra forma en que Wikipedia se utiliza para la bioconservación es a través de sus artículos de lista . Por ejemplo, la Base de Datos Integral de Resistencia a los Antibióticos integra su evaluación de bases de datos sobre resistencia a los antibióticos en una lista específica de Wikipedia . [ 62 ]

Wikidata

La base de conocimiento Wikimedia Wikidata está siendo cada vez más utilizada por la comunidad de bioconservación como un repositorio integrador en todas las ciencias de la vida. [ 63 ] Algunos consideran a Wikidata como una alternativa con mejores perspectivas de mantenimiento e interoperabilidad que las bases de conocimiento biológicas independientes más pequeñas. [ 64 ] [ 65 ]

Wikidata se ha utilizado para curar información sobre el SARS-CoV-2 y la pandemia de COVID-19 [ 66 ] [ 67 ] y por el proyecto Gene Wiki para curar información sobre genes . [ 68 ] Los datos de la biocuración en Wikidata se reutilizan en recursos externos a través de consultas SPARQL . [ 69 ] Algunos proyectos utilizan la curación a través de Wikidata como una vía para mejorar la información sobre ciencias de la vida en Wikipedia. [ 70 ]

Recursos gamificados

Una forma de involucrar al público en la bioconservación es mediante plataformas gamificadas que utilizan principios de diseño de juegos para aumentar la participación. Algunos ejemplos son:

  • Mark2Cure, una plataforma gamificada para la curación comunitaria de resúmenes biomédicos [ 71 ] [ 72 ] [ 73 ]
  • Cochrane Crowd, [ 74 ] una plataforma de Cochrane para la curación de ensayos clínicos y para categorizar y resumir la literatura biomédica. [ 75 ]
  • CIViC, un portal para la anotación de variantes genómicas relacionadas con el cáncer [ 76 ] que registra puntuaciones y mantiene clasificaciones. [ 77 ]
  • APICURON, una base de datos para acreditar y reconocer el trabajo de los bioconservadores, que recopila y agrega eventos de bioconservación de recursos de terceros y genera logros y tablas de clasificación. [ 78 ]

Minería de texto computacional para la curación de contenidos

Ejemplo de extracción de una declaración biomédica de lenguaje no estructurado [ 79 ]

Las tecnologías de procesamiento del lenguaje natural y minería de texto pueden ayudar a los bioconservadores a extraer información para la curación manual. [ 80 ] La minería de texto puede ampliar los esfuerzos de curación, apoyando la identificación de nombres de genes, por ejemplo, así como para inferir parcialmente ontologías . [ 81 ] [ 82 ] La conversión de afirmaciones no estructuradas a información estructurada utiliza técnicas como el reconocimiento de entidades nombradas y el análisis de dependencias. [ 83 ] La minería de texto de conceptos biomédicos enfrenta desafíos con respecto a las variaciones en la presentación de informes, y la comunidad está trabajando para aumentar la legibilidad de los artículos por máquinas. [ 84 ]

Durante la pandemia de COVID-19 , la minería de textos biomédicos se utilizó ampliamente para hacer frente a la gran cantidad de investigaciones científicas publicadas sobre el tema (más de 50.000 artículos). [ 85 ]

El popular paquete de Python para PLN, SpaCy, tiene una modificación para textos biomédicos, SciSpaCy, que es mantenida por el Instituto Allen para la IA . [ 86 ]

Entre los desafíos para la minería de textos aplicada a la bioconservación se encuentra la dificultad de acceder a los textos completos de los artículos biomédicos debido a los muros de pago, lo que vincula los desafíos de la bioconservación con los del movimiento de acceso abierto . [ 87 ]

Un enfoque complementario a la bioconservación mediante minería de texto implica la aplicación de reconocimiento óptico de caracteres a figuras biomédicas, junto con algoritmos de anotación automática. Esto se ha utilizado para extraer información genética de figuras de vías metabólicas , por ejemplo. [ 88 ]

Las sugerencias para mejorar el texto escrito y facilitar las anotaciones van desde el uso de lenguajes naturales controlados [ 89 ] hasta proporcionar una asociación clara de conceptos (como genes y proteínas ) con la especie de interés en particular. [ 89 ]

Aunque persisten los desafíos, la minería de texto ya es una parte integral del flujo de trabajo de la bioconservación en varias bases de conocimiento biológicas . [ 90 ]

Desafíos biocreativos

El desafío BioCreAtivE (Evaluación Crítica de Sistemas de Extracción de Información en Biología) es un esfuerzo comunitario para desarrollar y evaluar sistemas de minería de texto y extracción de información para las ciencias de la vida. El desafío se lanzó por primera vez en 2004 y desde entonces se ha convertido en un evento importante en las comunidades de bioconservación y bioinformática. [ 91 ] El objetivo principal del desafío es fomentar el desarrollo de herramientas computacionales avanzadas que puedan extraer información de manera efectiva de la gran cantidad de datos biológicos disponibles.

Proceso típico para la curación biológica [ 91 ]

El Desafío BioCreativo se organiza en varias subtareas que abarcan diversos aspectos de la minería de texto y la extracción de información en las ciencias de la vida. Estas subtareas incluyen la normalización de genes, la extracción de relaciones, el reconocimiento de entidades y la clasificación de documentos. Los participantes en el desafío reciben un conjunto de datos anotados para desarrollar y probar sus sistemas, y su rendimiento se evalúa en función de diversas métricas, como la precisión, la exhaustividad y la puntuación F. [ 91 ]

El Desafío BioCreativo ha propiciado el desarrollo de numerosos sistemas innovadores de minería de texto y extracción de información que han mejorado notablemente la eficiencia y la precisión de las labores de bioconservación. Estos sistemas se han integrado en muchos flujos de trabajo de bioconservación y han contribuido a agilizar el proceso y a mejorar la calidad de los datos seleccionados.

Véase también

Referencias

  1. 1 2 "¿Qué es la bioconservación? | Sociedad Internacional para la Bioconservación" . www.biocuration.org . Consultado el 6 de septiembre de 2020 .
  2. Howe D, Costanzo M, Fey P, Gojobori T, Hannick L, Hide W, et al. (septiembre de 2008). "Big data: El futuro de la bioconservación" . Nature . 455 ( 7209): 47– 50. Bibcode : 2008Natur.455...47H . doi : 10.1038/455047a . PMC 2819144. PMID 18769432 .   
  3. Burge S, Attwood TK, Bateman A, Berardini TZ, Cherry M, O'Donovan C, et al. (2012-03-20). "Bioconservadores y bioconservación: análisis de los desafíos del siglo XXI" . Base de datos . 2012 bar059. doi : 10.1093/database/bar059 . PMC 3308150. PMID 22434828 .   
  4. 1 2 Bateman A (abril de 2010). "Curadores del mundo se unen: la Sociedad Internacional de Bioconservación" . Bioinformática . 26 (8): 991. doi : 10.1093/bioinformatics/btq101 . PMID 20305270 . 
  5. Bourne PE, McEntyre J (octubre de 2006). "Biocuradores: contribuyentes al mundo de la ciencia" . PLOS Computational Biology . 2 (10) e142. Bibcode : 2006PLSCB...2..142B . doi : 10.1371/journal.pcbi.0020142 . PMC 1626157. PMID 17411327 .  
  6. 1 2 Salimi N, Vita R (octubre de 2006). "El bioconservador: conectando y mejorando los datos científicos" . PLOS Computational Biology . 2 (10) e125. Bibcode : 2006PLSCB...2..125S . doi : 10.1371/ journal.pcbi.0020125 . PMC 1626147. PMID 17069454 .  
  7. Biocuración, Sociedad Internacional para (16 de abril de 2018). " Biocuración: Destilando datos en conocimiento" . PLOS Biology . 16 (4) e2002846. doi : 10.1371/JOURNAL.PBIO.2002846 . PMC 5919672. PMID 29659566 .  
  8. "GOBLET | La Organización Global para el Aprendizaje, la Educación y la Formación en Bioinformática" . Consultado el 19 de diciembre de 2020 .
  9. Alexandra Holinski; Melissa Burke; Sarah L Morgan; Peter McQuilton; Patricia M. Palagi (4 de septiembre de 2020). "Bioconservación: mapeo de recursos y necesidades" . F1000Research . 9 : 1094. doi : 10.12688/F1000RESEARCH.25413.1 . ISSN 2046-1402 . PMC 7590901. PMID 33145007. Wikidata Q101217428 .    
  10. EMBL-EBI. "Bioconservación | Formación EMBL-EBI" . www.ebi.ac.uk. Consultado el 6 de mayo de 2022 .
  11. Sanderson, Katharine (febrero de 2011). "Bioinformática: generación de curación" . Nature . 470 (7333): 295–296 . doi : 10.1038/nj7333-295a . ISSN 1476-4687 . PMID 21348148 .  
  12. Anónimo (30-10-2019). "Certificado de posgrado en bioconservación" . www.ice.cam.ac.uk. Consultado el 6-10-2020 .
  13. Tang YA, Pichler K, Füllgrabe A, Lomax J, Malone J, Munoz-Torres MC, et al. (mayo de 2019). "Diez consejos rápidos para la bioconservación" . PLOS Computational Biology . 15 (5) e1006906. Bibcode : 2019PLSCB..15E6906T . doi : 10.1371/journal.pcbi.1006906 . PMC 6497217. PMID 31048830 .   
  14. Harper, Lisa; Campbell, Jacqueline D.; Cannon, Ethalinda KS; Jung, Sook; Poelchau, Monica F.; Walls, Ramona L.; Andorf, Carson M.; Arnaud, Elizabeth; Berardini, Tanya Z.; Birkett, Clayton; Cannon, Steve (2018-01-01). "Recomendaciones del consorcio AgBioData para bases de datos de genómica y genética sostenibles para la agricultura" . Database . 2018 : 1–32 . doi : 10.1093 /DATABASE/BAY088 . PMC 6146126. PMID 30239679 .  
  15. "Biocurator - ClinGen | Recurso del Genoma Clínico" . www.clinicalgenome.org . Consultado el 26 de mayo de 2021 .
  16. " UniProt: la base de datos universal de conocimiento de proteínas" . Nucleic Acids Research . 45 (D1): D158– D169. 2016-11-29. doi : 10.1093/nar/gkw1099 . ISSN 0305-1048 . PMC 5210571. PMID 27899622 .   
  17. Berman, Helen M.; Westbrook, J.; Feng, Z.; Gilliland, G.; Bhat, TN; Weissig, H.; Shindyalov, Ilya; Bourne, Philip (2000-01-01). "The Protein Data Bank" . Nucleic Acids Research . 28 (1): 235– 242. doi : 10.1093/NAR/28.1.235 . PMC 102472. PMID 10592235 .  
  18. Chen, Qingyu; Britto, Ramona; Erill, Ivan; Jeffery, Constance J. ; Liberzon, Arthur; Magrane, Michele; Onami, Jun-Ichi; Robinson-Rechavi, Marc; Sponarova, Jana; Zobel, Justin; Verspoor, Karin (2020-07-08). "La calidad importa: expertos en bioconservación sobre el impacto de la duplicación y otros problemas de calidad de datos en bases de datos biológicas" . Genómica , proteómica y bioinformática . 18 (2): 91– 103. doi : 10.1016/J.GPB.2018.11.006 . PMC 7646089. PMID 32652120 .  
  19. ^ Flybase, Consorcio (1 de enero de 1998). "FlyBase: una base de datos de Drosophila. Consorcio Flybase" . Investigación de ácidos nucleicos . 26 (1): 85– 88. doi : 10.1093/nar/26.1.85 . ISSN 1362-4962 . PMC 147222 . PMID 9399806 .   
  20. ^ Rutherford KM, Lera-Ramírez M, Wood V (mayo de 2024). "PomBase: un recurso central global de biodatos: crecimiento, colaboración y sostenibilidad" . Genética . 227 (1) iyae007. doi : 10.1093/genetics/iyae007 . PMC 11075564 . PMID 38376816 .  
  21. Ruzicka, Leyla; Howe, Douglas G.; Ramachandran, Sridhar; Toro, Sabrina; Slyke, Ceri E. Van; Bradford, Yvonne M.; Eagle, Anne; Fashena, David; Frazer, Ken; Kalita, Patrick; Mani, Prita (2019-01-01). "La Red de Información del Pez Cebra: nuevo apoyo para genes no codificantes, anotaciones más ricas de Gene Ontology y la Alianza de Recursos Genómicos" . Nucleic Acids Research . 47 (D1): D867– D873. doi : 10.1093/NAR/GKY1090 . PMC 6323962. PMID 30407545 .  
  22. Malone J, Stevens R, Jupp S, Hancocks T, Parkinson H, Brooksbank C (febrero de 2016). " Diez reglas sencillas para seleccionar una bioontología" . PLOS Computational Biology . 12 (2) e1004743. Bibcode : 2016PLSCB..12E4743M . doi : 10.1371/journal.pcbi.1004743 . PMC 4750991. PMID 26867217 .  
  23. Bodenreider O (enero de 2004). " El Sistema Unificado de Lenguaje Médico (UMLS): integración de la terminología biomédica" . Nucleic Acids Research . 32 (número especial de bases de datos): D267-70. doi : 10.1093/nar/gkh061 . PMC 308795. PMID 14681409 .  
  24. McMurry JA, Juty N, Blomberg N, Burdett T, Conlin T, Conte N, et al. (junio de 2017). "Identificadores para el siglo XXI: cómo diseñar, proporcionar y reutilizar identificadores persistentes para maximizar la utilidad y el impacto de los datos de ciencias de la vida" . PLOS Biology . 15 (6) e2001414. doi : 10.1371/journal.pbio.2001414 . PMC 5490878. PMID 28662064 .   
  25. Mons B (junio de 2005). "¿A qué gen te referías?" . BMC Bioinformatics . 6 (1) 142. doi : 10.1186/1471-2105-6-142 . PMC 1173089 . PMID 15941477 .  
  26. Venkatesan A, Kim JH, Talo F, Ide-Smith M, Gobeill J, Carter J, et al. (12 de diciembre de 2016). "SciLite: una plataforma para mostrar anotaciones extraídas de texto como medio para vincular artículos de investigación con datos biológicos" . Wellcome Open Research . 1:25 . doi : 10.12688/wellcomeopenres.10210.1 . PMC 5527546. PMID 28948232 .   
  27. Wei CH, Allot A, Leaman R, Lu Z (julio de 2019). "PubTator central: anotación automatizada de conceptos para artículos biomédicos de texto completo" . Nucleic Acids Research . 47 (W1): W587– W593. doi : 10.1093/nar/gkz389 . PMC 6602571. PMID 31114887 .  
  28. Kwon D, Kim S, Wei CH, Leaman R, Lu Z (julio de 2018). "ezTag: etiquetado de conceptos biomédicos mediante aprendizaje interactivo" . Nucleic Acids Research . 46 (W1): W523– W529. doi : 10.1093/nar/gky428 . PMC 6030907. PMID 29788413 .  
  29. 1 2 Manotas, María Carolina; Rivera, Ana Lucia; Sanabria-Salas, María Carolina (2023-03-10). "Curación e interpretación de variantes en genes de cáncer hereditario: una experiencia institucional en América Latina" . Molecular Genetics & Genomic Medicine . 11 (5) e2141. doi : 10.1002/mgg3.2141 . ISSN 2324-9269 . PMC 10178801. PMID 36905130 .   
  30. 1 2 Richards, Sue; Aziz, Nazneen; Bale, Sherri; Bick, David; Das, Soma; Gastier-Foster, Julie; Grody, Wayne W.; Hegde, Madhuri; Lyon, Elaine; Spector, Elaine; Voelkerding, Karl; Rehm, Heidi L.; Comité de Garantía de Calidad de Laboratorio de ACMG (mayo de 2015). "Estándares y directrices para la interpretación de variantes de secuencia: una recomendación de consenso conjunta del Colegio Estadounidense de Genética Médica y Genómica y la Asociación de Patología Molecular" . Genetics in Medicine . 17 (5): 405– 424. doi : 10.1038/gim.2015.30 . ISSN 1530-0366 . PMC 4544753. PMID 25741868 .   
  31. Pandey, Kapil Raj; Maden, Narendra; Poudel, Barsha; Pradhananga, Sailendra; Sharma, Amit Kumar (diciembre de 2012). " La curación de variantes genéticas: dificultades y posibles soluciones" . Genómica, proteómica y bioinformática . 10 (6): 317–325 . doi : 10.1016/j.gpb.2012.06.006 . ISSN 1672-0229 . PMC 5054708. PMID 23317699 .   
  32. 1 2 "Empresa de pruebas genéticas para enfermedades raras | 3billion" . 3billion.io . Consultado el 18 de mayo de 2024 .
  33. "Directrices de buenas prácticas de la ACGS para la clasificación de variantes en enfermedades raras 2024" (PDF) . La Asociación para la Ciencia Genómica Clínica . Consultado el 18 de mayo de 2024 .
  34. Landsman, D.; Gentleman, R.; Kelso, J.; Francis Ouellette, BF (2010-01-05). "DATABASE: Un nuevo foro para bases de datos biológicas y curación" . Database . 2009 bap002 . doi : 10.1093/database/bap002 . ISSN 1758-0463 . PMC 2790300. PMID 20157475 .   
  35. Naithani, Sushma; Gupta, Parul; Preece, Justin; Garg, Priyanka; Fraser, Valerie; Padgitt-Cobb, Lillian K; Martin, Matthew; Vining, Kelly; Jaiswal, Pankaj (2019-01-01). "Involucrando a la comunidad en la curación de genes y vías metabólicas" . Base de datos . 2019. doi : 10.1093/database/bay146 . ISSN 1758-0463 . PMC 6334007. PMID 30649295 .   
  36. 1 2 Denise A. Smith (18 de febrero de 2020). Stefano Triberti (ed.). "Situando Wikipedia como un recurso de información sobre salud en diversos contextos: una revisión exploratoria" . PLOS One . 15 ( 2) e0228786. doi : 10.1371/JOURNAL.PONE.0228786 . ISSN 1932-6203 . PMC 7028268. PMID 32069322. Wikidata Q85632863 .    
  37. 1 2 Arnaboldi V, Raciti D, Van Auken K, Chan JN, Müller HM, Sternberg PW (enero de 2020). " La minería de texto se une a la curación comunitaria: una plataforma de curación de nuevo diseño para mejorar la experiencia y participación de los autores en WormBase" . Database . 2020 baaa006 . doi : 10.1093/database/baaa006 . PMC 7078066. PMID 32185395. S2CID 212750405 .   
  38. Lee RY, Howe KL, Harris TW, Arnaboldi V, Cain S, Chan J, et al. (enero de 2018). "WormBase 2017: mudando a una nueva etapa" . Nucleic Acids Research . 46 (D1): D869– D874. doi : 10.1093/nar/ gkx998 . PMC 5753391. PMID 29069413 .   
  39. Bunt SM, Grumbling GB, Field HI, Marygold SJ, Brown NH, Millburn GH (2012). "El envío directo de correos electrónicos a los autores de artículos recién publicados fomenta la curación de la comunidad" . Database . 2012 bas024 . doi : 10.1093/database/bas024 . PMC 3342516. PMID 22554788 .  
  40. Antonazzo G, Urbano JM, Marygold SJ, Millburn GH, Brown NH (enero de 2020). "Construyendo un sistema para solicitar conocimiento experto de la comunidad para ayudar a la curación de resúmenes de genes" . Base de datos . 2020 baz152. doi : 10.1093/database/baz152 . PMC 6971343. PMID 31960022 .  
  41. Rutherford KM, Harris MA, Lock A, Oliver SG, Wood V (junio de 2014). "Canto: una herramienta en línea para la curación de literatura comunitaria" . Bioinformatics . 30 ( 12): 1791–2 . doi : 10.1093/bioinformatics/btu103 . PMC 4058955. PMID 24574118 .  
  42. «pombase/canto» . PomBase. 25 de septiembre de 2020.
  43. Lock A, Harris MA, Rutherford K, Hayles J, Wood V (enero de 2020). "Curación comunitaria en PomBase: permitiendo a los expertos en levadura de fisión proporcionar anotaciones detalladas, estandarizadas y compartibles a partir de publicaciones de investigación" . Base de datos . 2020 baaa028. doi : 10.1093/database/baaa028 . PMC 7192550. PMID 32353878 .  
  44. " UniProt: la base de datos universal de conocimiento de proteínas" . Nucleic Acids Research . 45 (D1): D158– D169. 2016-11-29. doi : 10.1093/nar/gkw1099 . ISSN 0305-1048 . PMC 5210571. PMID 27899622 .   
  45. Khare, Ritu; Good, Benjamin M.; Leaman, Robert; Su, Andrew I.; Lu, Zhiyong (2016-01-01). " Crowdsourcing en biomedicina: desafíos y oportunidades" . Briefings in Bioinformatics . 17 (1): 23– 32. doi : 10.1093/BIB/BBV021 . PMC 4719068. PMID 25888696 .  
  46. 1 2 Finn RD, Gardner PP, Bateman A (enero de 2012). "Hacer que su base de datos esté disponible a través de Wikipedia: los pros y los contras" . Nucleic Acids Research . 40 (número especial sobre bases de datos): D9-12. doi : 10.1093/nar/gkr1195 . PMC 3245093. PMID 22144683 .  
  47. Dai L, Tian M, Wu J, Xiao J, Wang X, Townsend JP, Zhang Z (julio de 2013). "AuthorReward: aumentando la curación comunitaria en wikis de conocimiento biológico a través de la cuantificación automatizada de la autoría" . Bioinformatics . 29 ( 14): 1837–9 . doi : 10.1093/bioinformatics/btt284 . PMC 3702255. PMID 23732274 .  
  48. Zhang Z, Sang J, Ma L, Wu G, Wu H, Huang D, et al. (enero de 2014). "RiceWiki: una base de datos basada en wiki para la curación comunitaria de genes de arroz" . Nucleic Acids Research . 42 (número especial de bases de datos): D1222-8. doi : 10.1093/nar/gkt926 . PMC 3964990. PMID 24136999 .   
  49. "Os01g0883800 - RiceWiki" . 2017-10-20. Archivado del original el 2017-10-20 . Consultado el 2020-09-06 .
  50. Consorcio, CAZypedia (11 de octubre de 2017). "Diez años de CAZypedia: una enciclopedia viva de enzimas activas sobre carbohidratos" . Glycobiology . 28 (1): 3–8 . doi : 10.1093/GLYCOB/CWX089 . hdl : 21.11116/0000-0003-B7EB-6 . PMID 29040563 . 
  51. 1 2 Mons B, Ashburner M, Chichester C, van Mulligen E, Weeber M, den Dunnen J, et al. (2008-05-28). "Llamando a un millón de mentes para la anotación comunitaria en WikiProteins" . Genome Biology . 9 (5) R89. doi : 10.1186/gb-2008-9-5-r89 . PMC 2441475. PMID 18507872 .   
  52. Giles J (febrero de 2007). " Las bases de datos clave de biología se vuelven wiki" . Nature . 445 (7129): 691. Bibcode : 2007Natur.445..691G . doi : 10.1038/445691a . PMID 17301755. S2CID 4410783 .  
  53. "WikiPathways - WikiPathways" . www.wikipathways.org . Consultado el 14 de octubre de 2020 .
  54. Wodak SJ, Mietchen D, Collings AM, Russell RB, Bourne PE (2012). "Páginas temáticas: PLOS Computational Biology se encuentra con Wikipedia" . PLOS Computational Biology . 8 (3) e1002446. Bibcode : 2012PLSCB...8E2446W . doi : 10.1371/journal.pcbi.1002446 . PMC 3315447. PMID 22479174 .  
  55. Page RD (marzo de 2011). " Vinculando NCBI con Wikipedia: un enfoque basado en wikis" . PLOS Currents . 3 RRN1228. doi : 10.1371/currents.RRN1228 . PMC 3080707. PMID 21516242 .  
  56. Gardner PP, Daub J, Tate J, Moore BL, Osuch IH, Griffiths-Jones S, et al. (enero de 2011). "Rfam: Wikipedia, clanes y la versión "decimal"" . Nucleic Acids Research . 39 (número especial de bases de datos): D141-5. doi : 10.1093/nar/ gkq1129 . PMC 3013711. PMID 21062808 .   
  57. ^ Daub J, Gardner PP, Tate J, Ramsköld D, Manske M , Scott WG y col. (Diciembre de 2008). "El RNA WikiProject: anotación comunitaria de familias de RNA" . ARN . 14 (12): 2462– 4. doi : 10.1261/rna.1200508 . PMC 2590952 . PMID 18945806 .   
  58. Burkhardt K, Schneider B, Ory J (octubre de 2006). "Una perspectiva de bioconservación: anotación en el Banco de Datos de Proteínas del Laboratorio Colaborativo de Investigación para la Bioinformática Estructural" . PLOS Computational Biology . 2 (10) e99. Bibcode : 2006PLSCB...2...99B . doi : 10.1371/journal.pcbi.0020099 . PMC 1626146. PMID 17069453 .  
  59. Logan DW, Sandal M, Gardner PP, Manske M , Bateman A (septiembre de 2010). "Diez reglas sencillas para editar Wikipedia" . PLOS Computational Biology . 6 (9) e1000941. Bibcode : 2010PLSCB...6E0941L . doi : 10.1371/journal.pcbi.1000941 . PMC 2947980. PMID 20941386 .  Icono de acceso abierto
  60. Butler D (2008). "Publica en Wikipedia o perece: la revista exigirá a los autores que publiquen en la enciclopedia gratuita en línea". Nature . doi : 10.1038/news.2008.1312 .
  61. Huss JW, Lindenbaum P, Martone M, Roberts D, Pizarro A, Valafar F, et al. (enero de 2010). " The Gene Wiki: inteligencia comunitaria aplicada a la anotación de genes humanos" . Nucleic Acids Research . 38 (número especial de bases de datos): D633-9. doi : 10.1093/nar/gkp760 . PMC 2808918. PMID 19755503 .   
  62. Alcock, Brian P.; Raphenya, Amogelang R.; Lau, Tammy TY; Tsang, Kara K.; Bouchard, Mégane; Edalatmand, Arman; Huynh, William; Nguyen, Anna-Lisa V.; Cheng, Annie A.; Liu, Sihan; Min, Sally Y. (2020-01-01). "CARD 2020: vigilancia del resistoma antibiótico con la base de datos integral de resistencia a los antibióticos" . Nucleic Acids Research . 48 (D1): D517– D525. doi : 10.1093/NAR/GKZ935 . PMC 7145624. PMID 31665441 .  
  63. Waagmeester A, Stupp G, Burgstaller-Muehlbacher S, Good BM, Griffith M, Griffith OL, et al. (marzo de 2020). Rodgers P, Mungall C (eds.). "Wikidata como un grafo de conocimiento para las ciencias de la vida" . eLife . 9 e52614 . doi : 10.7554/eLife.52614 . PMC 7077981. PMID 32180547. S2CID 212739087 .    
  64. Rutz, Adriano; Sorokina, Maria; Galgonek, Jakub; Mietchen, Daniel; Willighagen, Egon; Gaudry, Arnaud; Graham, James G; Stephan, Ralf; Page, Roderic; Vondrášek, Jiří; Steinbeck, Christoph; Pauli, Guido F; Wolfender, Jean-Luc; Bisson, Jonathan; Allard, Pierre-Marie (26 de mayo de 2022). "La iniciativa LOTUS para la gestión abierta del conocimiento en la investigación de productos naturales" . eLife . 11 e70780 . Bibcode : 2022eLife..1170780R . doi : 10.7554 /eLife.70780 . PMC 9135406. PMID 35616633. S2CID 249064853 .   
  65. Rutz, Adriano; Sorokina, Maria; Galgonek, Jakub; Mietchen, Daniel; Willighagen, Egon; Gaudry, Arnaud; Graham, James G.; Stephan, Ralf; Page, Roderic; Vondrášek, Jiří; Steinbeck, Christoph; Pauli, Guido F.; Wolfender, Jean-Luc; Bisson, Jonathan; Allard, Pierre-Marie (2022). "La iniciativa LOTUS para la gestión abierta del conocimiento en la investigación de productos naturales" . eLife . 11 e70780: 2021.02.28.433265. Bibcode : 2022eLife..1170780R . bioRxiv 10.1101/2021.02.28.433265 . doi : 10.7554/eLife.70780 . 
  66. ^ Turki, Houcemeddine; Taieb, Mohamed Ali Hadj; Shafee, Thomas; Lubiana, Tiago; Jemielniak, Dariusz; Aouicha, Mohamed Ben; Gayo, José Emilio Labra; Youngstrom, Eric; Banato, Mossab; Das, Diptanshu; Mietchen, Daniel (18 de febrero de 2021). Haller, Armin (ed.). "Representación de información de COVID-19 en gráficos de conocimiento colaborativo: el caso de Wikidata" (PDF) .
  67. ^ Waagmeester, Andra; Willighagen, Egon L.; Su, Andrés I.; Kutmon, Martina; Gayo, José Emilio Labra; Fernández-Álvarez, Daniel; Novio, Quintín; Schaap, Peter J.; Verhagen, Lisa M.; Koehorst, Jasper J. (22 de enero de 2021). "Un protocolo para añadir conocimiento a Wikidata: alinear recursos sobre coronavirus humanos" . Biología BMC . 19 (1): 12. doi : 10.1186/s12915-020-00940-y . ISSN 1741-7007 . PMC 7820539 . PMID 33482803 .   
  68. ^ Burgstaller-Muehlbacher S, Waagmeester A, Mitraka E, Turner J, Putman T, Leong J, et al. (2016). "Wikidata como marco semántico para la iniciativa Gene Wiki" . Base de datos . 2016 baw015. doi : 10.1093/base de datos/baw015 . PMC 4795929 . PMID 26989148 .   
  69. ^ Willighagen, Egon; Martens, Marvin; Yasunori; Lubiana, Tiago; Nunogit; Mietchen, Daniel; Addshore (09 de agosto de 2020), egonw/SARS-CoV-2-Queries: Edición 1 , doi : 10.5281/zenodo.3977414 , consultado el 14 de abril de 2021
  70. Alexander Pfundner; Tobias Schönberg; John Horn; Richard D Boyce; Matthias Samwald (5 de mayo de 2015). "Utilización del sistema Wikidata para mejorar la calidad del contenido médico en Wikipedia en diversos idiomas: un estudio piloto" . Journal of Medical Internet Research . 17 (5): e110. doi : 10.2196 / JMIR.4163 . ISSN 1438-8871 . PMC 4468594. PMID 25944105. Wikidata Q21503276 .    
  71. Tsueng G , Nanis SM, Fouquier J, Good BM, Su AI (2016-12-31). "Ciencia ciudadana para la minería de la literatura biomédica" . Citizen Science . 1 (2): 14. doi : 10.5334/cstp.56 . PMC 6226017. PMID 30416754 .  
  72. Tsueng G, Nanis M, Fouquier JT, Mayers M, Good BM, Su AI (febrero de 2020). "Aplicación de la ciencia ciudadana a la extracción de relaciones entre genes, fármacos y enfermedades a partir de resúmenes biomédicos" . Bioinformatics . 36 ( 4): 1226– 1233. doi : 10.1093/bioinformatics/btz678 . PMC 8104067. PMID 31504205 .  
  73. "Juega a Mark2Cure, ayuda a identificar términos clave en resúmenes de investigación biomédica" . Citizen Science Games . Consultado el 6 de septiembre de 2020 .
  74. "Cochrane Crowd" . crowd.cochrane.org . Consultado el 25 de septiembre de 2020 .
  75. Gartlehner G, Affengruber L, Titscher V, Noel-Storr A, Dooley G, Ballarini N, König F (mayo de 2020). "La selección de resúmenes por un solo revisor omitió el 13 por ciento de los estudios relevantes: un ensayo controlado aleatorizado basado en la colaboración colectiva" . Journal of Clinical Epidemiology . 121 : 20–28 . doi : 10.1016/j.jclinepi.2020.01.005 . PMID 31972274 . 
  76. Griffith, Malachi; Spies, Nicholas C; Krysiak, Kilannin; McMichael, Joshua F; Coffman, Adam C; Danos, Arpad M; Ainscough, Benjamin J; Ramirez, Cody A; Rieke, Damian T; Kujan, Lynzey; Barnell, Erica K (2017-01-31). "CIViC es una base de conocimiento comunitaria para la colaboración de expertos en la interpretación clínica de variantes en cáncer" . Nature Genetics . 49 (2): 170– 174. doi : 10.1038/ng.3774 . hdl : 10230/46299 . ISSN 1061-4036 . PMC 5367263. PMID 28138153 .   
  77. "CIViC - Interpretación clínica de variantes en el cáncer" . civicdb.org . Consultado el 14 de abril de 2021 .
  78. Hatos, András; Quaglia, Federica; Piovesan, Damiano; Tosatto, Silvio CE (2021-04-21). "APICURON: una base de datos para acreditar y reconocer el trabajo de los biocuradores" . Database : The Journal of Biological Databases and Curation . 2021 baab019. doi : 10.1093/database/baab019 . ISSN 1758-0463 . PMC 8060004. PMID 33882120 .   
  79. Percha, Bethany; Altman, Russ B. (2018-08-01). "Una red global de relaciones biomédicas derivadas de texto" . Bioinformatics . 34 (15 ) : 2614– 2624. doi : 10.1093/bioinformatics/bty114 . ISSN 1367-4803 . PMC 6061699. PMID 29490008 .   
  80. Hirschman L, Burns GA, Krallinger M, Arighi C, Cohen KB, Valencia A, et al. (2012). " Minería de texto para el flujo de trabajo de bioconservación" . Base de datos . 2012 bas020. doi : 10.1093/database/bas020 . PMC 3328793. PMID 22513129 .   
  81. Ananiadou, Sophia; Kell, Douglas B.; Tsujii, Jun-ichi (diciembre de 2006). "Minería de texto y sus posibles aplicaciones en biología de sistemas". Trends in Biotechnology . 24 (12): 571– 579. doi : 10.1016/j.tibtech.2006.10.002 . ISSN 0167-7799 . PMID 17045684 .  
  82. Winnenburg, R.; Wachter, T.; Plake, C.; Doms, A.; Schroeder, M. (2008-07-11). "Datos a partir de texto: ¿puede la minería de texto ayudar a ampliar la curación manual de alta calidad de productos genéticos con ontologías?" . Briefings in Bioinformatics . 9 (6): 466– 478. doi : 10.1093/bib/bbn043 . ISSN 1467-5463 . PMID 19060303 .  
  83. Percha, Bethany; Altman, Russ (27 de febrero de 2018). " Una red global de relaciones biomédicas derivadas de texto" . Bioinformática . 34 (15): 2614–2624 . doi : 10.1093/BIOINFORMATICS/BTY114 . PMC 6061699. PMID 29490008 .  
  84. Robert Leaman; Chih-Hsuan Wei; Alexis Allot; Zhiyong Lu (1 de junio de 2020). "Diez consejos para un artículo listo para minería de texto: cómo mejorar la capacidad de descubrimiento e interpretabilidad automatizadas" . PLOS Biology . 18 ( 6) e3000716. doi : 10.1371/JOURNAL.PBIO.3000716 . ISSN 1544-9173 . PMC 7289435. PMID 32479517. Wikidata Q96032351 .    
  85. Wang, Lucy Lu; Lo, Kyle (2020-12-07). "Enfoques de minería de texto para abordar la literatura en rápida expansión sobre COVID-19" . Briefings in Bioinformatics . 22 (2): 781– 799. doi : 10.1093/BIB/BBAA296 . PMC 7799291. PMID 33279995 .  
  86. Neumann M, King D, Beltagy I, Ammar W (2019). "ScispaCy: Modelos rápidos y robustos para el procesamiento del lenguaje natural biomédico" . Actas del 18.º Taller BioNLP y Tarea Compartida . Florencia, Italia: Asociación de Lingüística Computacional: 319–327 . arXiv : 1902.07669 . doi : 10.18653/v1/W19-5034 . S2CID 67788603 . 
  87. Altman RB, Bergman CM, Blake J, Blaschke C, Cohen A, Gannon F, et al. (2008). " Minería de texto para biología: el camino a seguir: opiniones de científicos líderes" . Genome Biology . 9 (Supl. 2) S7. doi : 10.1186/gb-2008-9-s2-s7 . PMC 2559991. PMID 18834498 .   
  88. Hanspers, Kristina; Riutta, Anders; Summer-Kutmon, Martina; Pico, Alexander R. (2020-11-09). "Información de la vía metabólica extraída de 25 años de figuras de vías metabólicas" . Genome Biology . 21 (1): 273. doi : 10.1186/S13059-020-02181-2 . PMC 7649569. PMID 33168034 .  
  89. 1 2 Kuhn, Tobias; Royer, Loïc; Fuchs, Norbert E.; Schröder, Michael (2006-01-01). "Mejora de la minería de texto con lenguaje natural controlado: un estudio de caso para interacciones proteicas" . Integración de datos en las ciencias de la vida . Notas de clase en informática. Vol. 4075. págs. 66–81 . doi : 10.1007/11799511_7 . ISBN   978-3-540-36593-8.
  90. ^ Singhal, Ayush; Leaman, Robert; Catlett, Natalie; Lemberger, Thomas; McEntyre, Johanna; Polson, Shawn; Xenarios, Ioannis; Arighi, Cecilia; Lu, Zhiyong (2016). "Necesidades apremiantes de la minería de textos biomédicos en la biocuración y más allá: oportunidades y desafíos" . Base de datos . 2016 baw161. doi : 10.1093/base de datos/baw161 . ISSN 1758-0463 . PMC 5199160 . PMID 28025348 .   
  91. 1 2 3 Hirschman L, Yeh A, Blaschke C, Valencia A (2005). "Descripción general de BioCreAtIvE: evaluación crítica de la extracción de información para biología" . BMC Bioinformatics . 6 (Supl. 1) S1. doi : 10.1186/1471-2105-6-s1- s1 . PMC 1869002. PMID 15960821. S2CID 5119495 .   
  • Sociedad Internacional para la Bioconservación
  • Biocreativo
  • Curso online sobre bioconservación en EMBL-EBI