Articulo de referencia

Interactoma humano

El interactoma humano es el conjunto de interacciones proteína-proteína (el interactoma ) que ocurren en las células humanas. [ 1 ] [ 2 ] La secuenciación de genomas de referenc...

El interactoma humano es el conjunto de interacciones proteína-proteína (el interactoma ) que ocurren en las células humanas. [ 1 ] [ 2 ] La secuenciación de genomas de referencia, en particular el Proyecto Genoma Humano , ha revolucionado la genética humana , la biología molecular y la medicina clínica . Los resultados de los estudios de asociación de genoma completo han llevado a la asociación de genes con la mayoría de los trastornos mendelianos , [ 3 ] y más de 140 000 mutaciones de la línea germinal se han asociado con al menos una enfermedad genética. [ 4 ] Sin embargo, se hizo evidente que inherente a estos estudios hay un énfasis en el resultado clínico en lugar de una comprensión integral de la enfermedad humana; de hecho, hasta la fecha las contribuciones más significativas de los GWAS se han restringido a los "frutos fáciles de alcanzar" de los trastornos de mutación única directa, lo que impulsó un enfoque de biología de sistemas para el análisis genómico. [ 5 ] [ 6 ] La conexión entre genotipo y fenotipo (cómo la variación en el genotipo afecta la enfermedad o el funcionamiento normal de la célula y el cuerpo humano) sigue siendo esquiva, especialmente en el contexto de rasgos complejos poligénicos y cáncer. [ 7 ] Para asignar un contexto funcional a los cambios genotípicos, gran parte de los esfuerzos de investigación recientes se han dedicado al mapeo de las redes formadas por interacciones de componentes celulares y genéticos en humanos, así como a cómo estas redes se alteran por enfermedades genéticas y somáticas.

Fondo

Con la secuenciación de los genomas de una amplia gama de organismos modelo, quedó claro que el número de genes no se correlaciona con la percepción humana de la complejidad relativa de los organismos: el proteoma humano contiene unos 20 000 genes, [ 8 ] que es menor que el de algunas especies como el maíz. Un enfoque estadístico para calcular el número de interacciones en humanos da una estimación de alrededor de 650 000, un orden de magnitud mayor que Drosophila y 3 veces mayor que C. Elegans . [ 2 ] A partir de 2008, solo se ha identificado alrededor de <0,3% de todas las interacciones estimadas entre proteínas humanas, [ 9 ] aunque en los últimos años ha habido un crecimiento exponencial en el descubrimiento: a partir de 2015, [ 10 ] más de 210 000 interacciones proteína-proteína positivas humanas únicas están catalogadas actualmente, y la base de datos bioGRID contiene casi 750 000 PPI curadas en la literatura para 30 organismos modelo, 300 000 de las cuales son interacciones proteína-proteína físicas o genéticas humanas verificadas o predichas, un aumento del 50% desde 2013. [ 11 ] La información actualmente disponible sobre la red del interactoma humano se origina a partir de interacciones curadas en la literatura, [ 12 ] experimentos de alto rendimiento , [ 10 ] o de interacciones potenciales predichas a partir de datos del interactoma, ya sea a través de perfiles filogenéticos (similitud evolutiva), inferencia de redes estadísticas, [ 13 ] o métodos de minería de texto/literatura. [ 14 ]

Las interacciones proteína-proteína son solo la materia prima para las redes. Para formar bases de datos de interactomas útiles y crear redes integradas, otros tipos de datos que se pueden combinar con las interacciones proteína-proteína incluyen información sobre la expresión y coexpresión génica, la colocalización celular de proteínas (basada en microscopía ), información genética, vías metabólicas y de señalización , y más. [ 15 ] El objetivo final de desentrañar los interactomas de proteínas humanas es, en última instancia, comprender los mecanismos de las enfermedades y descubrir genes de enfermedades previamente desconocidos. Se ha descubierto que las proteínas con un alto número de interacciones (aristas externas) tienen una probabilidad significativamente mayor de ser nodos centrales en módulos que se correlacionan con enfermedades, [ 10 ] [ 16 ] probablemente porque las proteínas con más interacciones están involucradas en más funciones biológicas. Al mapear las alteraciones de las enfermedades al interactoma humano, podemos obtener una comprensión mucho mejor de las vías y los procesos biológicos de las enfermedades. [ 17 ]

Estudiando el interactoma humano

El análisis de las redes metabólicas de proteínas se remonta a la década de 1940, pero no fue hasta finales de la década de 1990 y principios de la de 2000 que los análisis genómicos computacionales basados ​​en datos para predecir el contexto funcional y las redes de asociaciones genéticas aparecieron en serio. [ 8 ] Desde entonces, se considera que los interactomas de muchos organismos modelo han sido bien caracterizados, en particular el interactoma de Saccharomyces cerevisiae [ 18 ] y el interactoma de Drosophila . [ 19 ]

Los enfoques experimentales de alto rendimiento para descubrir interacciones proteína-proteína suelen realizar una versión del método de cribado de doble híbrido o purificación por afinidad en tándem seguida de espectrometría de masas . [ 12 ] La información de los experimentos y la curación de la literatura se compila en bases de datos de interacciones proteicas, como DIP, [ 20 ] y BioGRID . [ 11 ] Un esfuerzo más reciente, HINT-KB, [ 10 ] intenta amalgamar la mayoría de las bases de datos PPI actuales, pero filtrando sistemáticamente las interacciones erróneas, así como tratando de corregir los sesgos de muestreo sociológico inherentes en los conjuntos de datos curados de la literatura.

Se han descrito redes de interactoma humano más pequeñas en el contexto específico de importantes impulsores de muchos trastornos diferentes, incluidos los trastornos neurodegenerativos , [ 21 ] el autismo y otros trastornos psiquiátricos, [ 22 ] y el cáncer. Las redes de genes del cáncer se han estudiado particularmente bien, debido en parte a grandes iniciativas genómicas como el Atlas del Genoma del Cáncer (TCGA). [ 23 ] Se ha mapeado una gran parte del panorama mutacional, incluida la heterogeneidad intratumoral, para la mayoría de los tipos comunes de cáncer [ 24 ] (por ejemplo, el cáncer de mama se ha estudiado bien), [ 25 ] y muchos estudios también han investigado la diferencia entre genes impulsores activos y mutaciones pasajeras pasivas en el contexto de las redes de interacción del cáncer. [ 16 ]

Los primeros intentos de mapeo integrativo a gran escala del interactoma humano ocurrieron alrededor de 2005. Stetzl et al. [ 26 ] utilizaron una matriz de proteínas de 4500 cebos y 5600 presas en un sistema de doble híbrido de levadura para reconstruir el interactoma, y ​​Rual et al. realizaron un estudio similar de doble híbrido de levadura verificado con purificación de coafinidad y correlación con otros atributos biológicos, revelando más de 300 conexiones con 100 proteínas asociadas a enfermedades. [ 12 ] Desde esos esfuerzos pioneros, se han realizado cientos de estudios similares. Las bases de datos compiladas como UniHI [ 27 ] proporcionan una plataforma para una sola entrada. Futschik et al. [ 28 ] realizaron un metaanálisis de ocho mapas de interactoma y encontraron que de 57 000 proteínas interactuantes en total, había una pequeña (aunque estadísticamente significativa ) superposición entre las diferentes bases de datos, lo que indica sesgos de selección y detección considerables.

En 2010, se describieron alrededor de 130 000 interacciones binarias en el interactoma en las bases de datos más populares, pero muchas se verificaron con una sola fuente. [ 15 ] Con el rápido desarrollo de métodos de alto rendimiento, los conjuntos de datos aún sufren altas tasas de falsos positivos y baja cobertura del interactoma. Tyagi et al. [ 29 ] describieron un marco novedoso para incorporar complejos estructurales e interfaces de unión para la verificación. Esto fue parte de esfuerzos mucho mayores para la verificación de PPI; las redes de interacción generalmente se validan aún más utilizando una combinación de perfiles de coexpresión , información estructural de proteínas, términos de ontología genética , consideraciones topológicas y colocalización [ 26 ] [ 30 ] antes de ser consideradas de "alta confianza".

Un artículo reciente (noviembre de 2014) [ 17 ] intenta proporcionar un mapa más completo del interactoma humano a nivel de proteoma . Encontró un vasto territorio inexplorado en el interactoma humano y utilizó diversos métodos para construir un nuevo mapa del interactoma corrigiendo el sesgo de curación, incluyendo el análisis de todas las combinaciones por pares de 13 000 productos proteicos para la interacción mediante el sistema de doble híbrido de levadura y la purificación por coafinidad, en un esfuerzo masivo coordinado entre laboratorios de investigación en Canadá y Estados Unidos. Sin embargo, esto aún representa la confirmación de solo una fracción de las interacciones esperadas: alrededor de 30 000 con alta confianza. A pesar de los esfuerzos coordinados de muchos, el interactoma humano aún está en desarrollo. [ 17 ] [ 30 ]

Véase también

Referencias

  1. Bonetta L (diciembre de 2010). " Interacciones proteína-proteína: Interactoma en construcción" . Nature . 468 (7325): 851–4 . Bibcode : 2010Natur.468..851B . doi : 10.1038/468851a . PMID 21150998. S2CID 205060874 .  
  2. 1 2 Stumpf MP, Thorne T, de Silva E, Stewart R, An HJ, Lappe M, Wiuf C (mayo de 2008). " Estimación del tamaño del interactoma humano" . Actas de la Academia Nacional de Ciencias de los Estados Unidos de América . 105 (19): 6959– 64. Bibcode : 2008PNAS..105.6959S . doi : 10.1073/pnas.0708078105 . PMC 2383957. PMID 18474861 .  
  3. Hamosh A, Scott AF, Amberger JS, Bocchini CA, McKusick VA (enero de 2005). "Online Mendelian Inheritance in Man (OMIM), una base de datos de genes humanos y trastornos genéticos" . Nucleic Acids Research . 33 (número especial sobre bases de datos): D514–7. doi : 10.1093/nar/ gki033 . PMC 539987. PMID 15608251 .  
  4. Stenson PD, Mort M, Ball EV, Shaw K, Phillips A, Cooper DN (enero de 2014). "La base de datos de mutaciones del gen humano: construcción de un repositorio integral de mutaciones para genética clínica y molecular, pruebas de diagnóstico y medicina genómica personalizada" . Human Genetics . 133 (1): 1– 9. doi : 10.1007/s00439-013-1358-4 . PMC 3898141. PMID 24077912 .  
  5. Chuang HY, Hofree M, Ideker T (2010). " Una década de biología de sistemas" . Annual Review of Cell and Developmental Biology . 26 : 721–44 . doi : 10.1146/annurev-cellbio-100109-104122 . PMC 3371392. PMID 20604711 .  
  6. Blow N (julio de 2009). "Biología de sistemas: Desentrañando la red de proteínas" . Nature . 460 (7253): 415–8 . Bibcode : 2009Natur.460..415B . doi : 10.1038/460415a . PMID 19606149 . 
  7. Vidal M, Cusick ME, Barabási AL (marzo de 2011). "Redes de interactoma y enfermedad humana" . Cell . 144 (6): 986–98 . doi : 10.1016/j.cell.2011.02.016 . PMC 3102045. PMID 21414488 .  
  8. 1 2 Amaral LA (mayo de 2008). "Una medida más veraz de nuestra ignorancia" . Actas de la Academia Nacional de Ciencias de los Estados Unidos de América . 105 ( 19): 6795– 6. Bibcode : 2008PNAS..105.6795A . doi : 10.1073/pnas.0802459105 . PMC 2383987. PMID 18474865 .  
  9. Bork P, Jensen LJ, von Mering C, Ramani AK, Lee I, Marcotte EM (junio de 2004). "Redes de interacción de proteínas desde la levadura hasta el ser humano". Current Opinion in Structural Biology . 14 (3): 292– 9. doi : 10.1016/j.sbi.2004.05.003 . PMID 15193308 . 
  10. ^ Konstantinos T, Dimitrakopoulos C, Kleftogiannis D , Charalampos M, Stergios P, Likothanassis S, Seferina M (2014 ) . "HINT-KB: la base de conocimientos de Human Interactome". Revisión de inteligencia artificial . 42 (3): 427– 443. doi : 10.1007/s10462-013-9409-8 . S2CID 16376962 . 
  11. 1 2 Chatr-Aryamontri A, Breitkreutz BJ, Oughtred R, Boucher L, Heinicke S, Chen D, Stark C, Breitkreutz A, Kolas N, O'Donnell L, Reguly T, Nixon J, Ramage L, Winter A, Sellam A, Chang C, Hirschman J, Theesfeld C, Rust J, Livstone MS, Dolinski K, Tyers M (Enero de 2015). "La base de datos de interacción BioGRID: actualización de 2015" . Investigación de ácidos nucleicos . 43 (Problema de la base de datos): D470–8. doi : 10.1093/nar/gku1204 . PMC 4383984 . PMID 25428363 .  
  12. 1 2 3 Rual JF, Venkatesan K, Hao T, Hirozane-Kishikawa T, Dricot A, Li N, et al. (octubre de 2005). "Hacia un mapa a escala del proteoma de la red de interacción proteína-proteína humana". Nature . 437 (7062): 1173– 8. Bibcode : 2005Natur.437.1173R . doi : 10.1038/nature04209 . PMID 16189514. S2CID 4427026 .   
  13. Margolin AA, Nemenman I, Basso K, Wiggins C, Stolovitzky G, Dalla Favera R, Califano A (marzo de 2006). "ARACNE: un algoritmo para la reconstrucción de redes reguladoras de genes en un contexto celular de mamíferos" . BMC Bioinformatics . 7 (Supl. 1) S7. arXiv : q-bio/0410037 . doi : 10.1186 / 1471-2105-7-S1-S7 . PMC 1810318. PMID 16723010 .  
  14. Jaeger S, Gaudan S, Leser U, Rebholz-Schuhmann D (julio de 2008). "Integración de interacciones proteína-proteína y minería de texto para la predicción de la función de las proteínas" . BMC Bioinformatics . 9 (Supl. 8) S2. doi : 10.1186/1471-2105-9-S8-S2 . PMC 2500093. PMID 18673526 .  
  15. 1 2 Bonetta L (diciembre de 2010). " Interacciones proteína-proteína: Interactoma en construcción" . Nature . 468 (7325): 851– 4. Bibcode : 2010Natur.468..851B . doi : 10.1038/468851a . PMID 21150998. S2CID 205060874 .  
  16. 1 2 Reimand J, Bader GD (2013). "Análisis sistemático de mutaciones somáticas en la señalización de fosforilación predice nuevos impulsores del cáncer" . Biología de sistemas moleculares . 9 : 637. doi : 10.1038/msb.2012.68 . PMC 3564258. PMID 23340843 .  
  17. 1 2 3 Rolland T, Taşan M, Charloteaux B, Pevzner SJ, Zhong Q, Sahni N, et al. (noviembre de 2014). " Un mapa a escala de proteoma de la red del interactoma humano" . Cell . 159 (5): 1212– 1226. doi : 10.1016/j.cell.2014.10.050 . PMC 4266588. PMID 25416956 .   
  18. Yu H, Braun P, Yildirim MA, Lemmens I, Venkatesan K, Sahalie J, et al. (octubre de 2008). "Mapa binario de alta calidad de la interacción de proteínas de la red del interactoma de levadura" . Science . 322 ( 5898): 104–10 . Bibcode : 2008Sci...322..104Y . doi : 10.1126/science.1158684 . PMC 2746753. PMID 18719252 .   
  19. ^ Giot L, Bader JS, Brouwer C, Chaudhuri A, Kuang B, Li Y, et al. (Diciembre de 2003). "Un mapa de interacción de proteínas de Drosophila melanogaster" . Ciencia . 302 (5651): 1727– 36. Bibcode : 2003Sci...302.1727G . doi : 10.1126/ciencia.1090289 . PMID 14605208 . S2CID 1642026 .   
  20. Xenarios I, Salwinski L, Duan XJ, Higney P, Kim SM, Eisenberg D (enero de 2002). "DIP, la base de datos de proteínas interactuantes: una herramienta de investigación para estudiar redes celulares de interacciones proteicas" . Nucleic Acids Research . 30 (1): 303–5 . doi : 10.1093 / nar/30.1.303 . PMC 99070. PMID 11752321 .  
  21. Lim J, Hao T, Shaw C, Patel AJ, Szabó G, Rual JF, Fisk CJ, Li N, Smolyar A, Hill DE, Barabási AL, Vidal M, Zoghbi HY (mayo de 2006). "Una red de interacción proteína-proteína para las ataxias hereditarias humanas y los trastornos de la degeneración de las células de Purkinje" . Cell . 125 (4): 801–14 . doi : 10.1016/j.cell.2006.03.032 . PMID 16713569 . 
  22. Chang J, Gilman SR, Chiang AH, Sanders SJ, Vitkup D (febrero de 2015). "Relaciones genotipo-fenotipo en los trastornos del espectro autista" . Nature Neuroscience . 18 (2): 191– 8. doi : 10.1038/nn.3907 . PMC 4397214. PMID 25531569 .  
  23. Cancer Genome Atlas Research Network (September 2012). "Comprehensive genomic characterization of squamous cell lung cancers". Nature. 489 (7417): 519–25. Bibcode:2012Natur.489..519T. doi:10.1038/nature11404. PMC 3466113. PMID 22960745.
  24. Gulati S, Cheng TM, Bates PA (August 2013). "Cancer networks and beyond: interpreting mutations using the human interactome and protein structure". Seminars in Cancer Biology. 23 (4): 219–26. doi:10.1016/j.semcancer.2013.05.002. PMID 23680723.
  25. Taylor IW, Linding R, Warde-Farley D, Liu Y, Pesquita C, Faria D, Bull S, Pawson T, Morris Q, Wrana JL (February 2009). "Dynamic modularity in protein interaction networks predicts breast cancer outcome". Nature Biotechnology. 27 (2): 199–204. doi:10.1038/nbt.1522. hdl:10451/14414. PMID 19182785. S2CID 11594017.
  26. 12Stelzl U, Worm U, Lalowski M, Haenig C, Brembeck FH, Goehler H, Stroedicke M, Zenkner M, Schoenherr A, Koeppen S, Timm J, Mintzlaff S, Abraham C, Bock N, Kietzmann S, Goedde A, Toksöz E, Droege A, Krobitsch S, Korn B, Birchmeier W, Lehrach H, Wanker EE (September 2005). "A human protein-protein interaction network: a resource for annotating the proteome". Cell. 122 (6): 957–68. doi:10.1016/j.cell.2005.08.029. hdl:11858/00-001M-0000-0010-8592-0. PMID 16169070. S2CID 8235923.
  27. Chaurasia G, Iqbal Y, Hänig C, Herzel H, Wanker EE, Futschik ME (January 2007). "UniHI: an entry gate to the human protein interactome". Nucleic Acids Research. 35 (Database issue): D590–4. doi:10.1093/nar/gkl817. PMC 1781159. PMID 17158159.
  28. Futschik ME, Chaurasia G, Herzel H (marzo de 2007). "Comparación de mapas de interacción proteína-proteína humanos" . Bioinformatics . 23 (5): 605–11 . doi : 10.1093/bioinformatics/btl683 . PMID 17237052 . 
  29. Tyagi M, Hashimoto K, Shoemaker BA, Wuchty S, Panchenko AR (marzo de 2012). "Mapeo a gran escala del interactoma de proteínas humanas mediante complejos estructurales" . EMBO Reports . 13 (3): 266–71 . doi : 10.1038/embor.2011.261 . PMC 3296913. PMID 22261719 .  
  30. 1 2 De Las Rivas J, Fontanillo C (junio de 2010). "Conceptos esenciales de las interacciones proteína-proteína: conceptos clave para construir y analizar redes de interactoma" . PLOS Computational Biology . 6 (6) e1000807. Bibcode : 2010PLSCB...6E0807D . doi : 10.1371/journal.pcbi.1000807 . PMC 2891586. PMID 20589078 .