
Los enfoques de la arquitectura de supercomputadoras han dado giros dramáticos desde que se introdujeron los primeros sistemas en la década de 1960. Las primeras arquitecturas de supercomputadoras iniciadas por Seymour Cray se basaban en diseños innovadores y compactos y en paralelismo local para lograr un rendimiento computacional máximo superior. [1] Sin embargo, con el tiempo la demanda de mayor potencia computacional marcó el comienzo de la era de los sistemas masivamente paralelos .
Mientras que las supercomputadoras de la década de 1970 utilizaban sólo unos pocos procesadores , en la década de 1990 comenzaron a aparecer máquinas con miles de procesadores y, a finales del siglo XX, las supercomputadoras masivamente paralelas con decenas de miles de procesadores comerciales listos para usar eran la norma. Las supercomputadoras del siglo XXI pueden utilizar más de 100.000 procesadores (algunos de ellos unidades gráficas ) conectados mediante conexiones rápidas. [2] [3]
A lo largo de las décadas, la gestión de la densidad térmica ha seguido siendo un tema clave para la mayoría de las supercomputadoras centralizadas. [4] [5] [6] La gran cantidad de calor generada por un sistema también puede tener otros efectos, como la reducción de la vida útil de otros componentes del sistema. [7] Ha habido diversos enfoques para la gestión del calor, desde bombear Fluorinert a través del sistema, hasta un sistema híbrido de refrigeración líquido-aire o refrigeración por aire con temperaturas normales de aire acondicionado . [8] [9]
Los sistemas con una gran cantidad de procesadores generalmente toman uno de dos caminos: en un enfoque, por ejemplo, en la computación en cuadrícula , la potencia de procesamiento de una gran cantidad de computadoras en dominios administrativos distribuidos y diversos se usa de manera oportunista siempre que haya una computadora disponible. [10] En otro enfoque, se usa una gran cantidad de procesadores en estrecha proximidad entre sí, por ejemplo, en un clúster de computadoras . En un sistema masivamente paralelo tan centralizado, la velocidad y la flexibilidad de la interconexión se vuelven muy importantes, y las supercomputadoras modernas han usado varios enfoques que van desde sistemas Infiniband mejorados hasta interconexiones de toro tridimensionales . [11] [12]
Contexto y visión general
Desde finales de los años 1960, el crecimiento de la potencia y la proliferación de supercomputadoras ha sido espectacular, y las direcciones arquitectónicas subyacentes de estos sistemas han dado giros significativos. Mientras que las primeras supercomputadoras dependían de una pequeña cantidad de procesadores estrechamente conectados que accedían a una memoria compartida , las supercomputadoras del siglo XXI utilizan más de 100.000 procesadores conectados por redes rápidas. [2] [3]
A lo largo de las décadas, la gestión de la densidad de calor ha seguido siendo una cuestión clave para la mayoría de las supercomputadoras centralizadas. [4] El lema de Seymour Cray "sacar el calor" fue central para su filosofía de diseño y ha seguido siendo una cuestión clave en las arquitecturas de supercomputadoras, por ejemplo, en experimentos a gran escala como Blue Waters . [4] [5] [6] La gran cantidad de calor generado por un sistema también puede tener otros efectos, como reducir la vida útil de otros componentes del sistema. [7]

Ha habido diversos enfoques para la gestión del calor, por ejemplo , el Cray 2 bombeó Fluorinert a través del sistema, mientras que el System X utilizó un sistema híbrido de enfriamiento líquido-aire y el Blue Gene/P se enfría con aire con temperaturas de aire acondicionado normales . [8] [13] [14] El calor de la supercomputadora Aquasar se utiliza para calentar un campus universitario. [15] [16]
La densidad de calor generada por una supercomputadora tiene una dependencia directa del tipo de procesador utilizado en el sistema, y los procesadores más potentes suelen generar más calor, dadas las tecnologías de semiconductores subyacentes similares . [7] Si bien las primeras supercomputadoras usaban unos pocos procesadores rápidos y muy compactos que aprovechaban el paralelismo local (por ejemplo, la canalización y el procesamiento vectorial ), con el tiempo el número de procesadores creció y los nodos de computación se podían colocar más lejos, por ejemplo, en un clúster de computadoras , o se podían dispersar geográficamente en la computación en cuadrícula . [2] [17] A medida que crece el número de procesadores en una supercomputadora, la " tasa de fallas de componentes " comienza a convertirse en un problema grave. Si una supercomputadora usa miles de nodos, cada uno de los cuales puede fallar una vez al año en promedio, entonces el sistema experimentará varias fallas de nodos cada día. [9]
A medida que la relación precio/rendimiento de los procesadores gráficos de propósito general (GPGPU) ha mejorado, una serie de supercomputadoras de petaflop como Tianhe-I y Nebulae han comenzado a depender de ellos. [18] Sin embargo, otros sistemas como la computadora K continúan utilizando procesadores convencionales como los diseños basados en SPARC y la aplicabilidad general de las GPGPU en aplicaciones informáticas de alto rendimiento de propósito general ha sido objeto de debate, en el sentido de que, si bien una GPGPU puede ajustarse para obtener una buena puntuación en puntos de referencia específicos, su aplicabilidad general a algoritmos cotidianos puede ser limitada a menos que se realice un esfuerzo significativo para ajustar la aplicación hacia ella. [19] Sin embargo, las GPU están ganando terreno y en 2012 la supercomputadora Jaguar se transformó en Titan al reemplazar las CPU por GPU. [20] [21] [22]
A medida que aumenta el número de procesadores independientes en una supercomputadora, la forma en que acceden a los datos en el sistema de archivos y cómo comparten y acceden a los recursos de almacenamiento secundario se vuelve prominente. A lo largo de los años se desarrollaron varios sistemas para la gestión distribuida de archivos , por ejemplo , IBM General Parallel File System , BeeGFS , Parallel Virtual File System , Hadoop , etc. [23] [24] Varias supercomputadoras en la lista TOP100 , como Tianhe-I, utilizan el sistema de archivos Lustre de Linux . [4]
Los primeros sistemas con unos pocos procesadores
La serie de computadoras CDC 6600 fue un intento muy temprano de supercomputación y obtuvo su ventaja sobre los sistemas existentes al delegar el trabajo a los dispositivos periféricos , liberando la unidad central de procesamiento (CPU) para procesar datos reales. Con el compilador FORTRAN de Minnesota , la 6600 podía mantener 500 kiloflops en operaciones matemáticas estándar. [25]

Otras supercomputadoras tempranas, como Cray 1 y Cray 2 que aparecieron después, utilizaban un pequeño número de procesadores rápidos que trabajaban en armonía y estaban conectados uniformemente a la mayor cantidad de memoria compartida que se podía gestionar en ese momento. [3]
Estas primeras arquitecturas introdujeron el procesamiento paralelo a nivel de procesador, con innovaciones como el procesamiento vectorial , en el que el procesador puede realizar varias operaciones durante un ciclo de reloj , en lugar de tener que esperar ciclos sucesivos.
Con el tiempo, a medida que aumentaba el número de procesadores, surgieron diferentes problemas arquitectónicos. Dos problemas que deben abordarse a medida que aumenta el número de procesadores son la distribución de la memoria y el procesamiento. En el enfoque de memoria distribuida, cada procesador está empaquetado físicamente cerca con algo de memoria local. La memoria asociada con otros procesadores está entonces "más alejada" en función de los parámetros de ancho de banda y latencia en un acceso a la memoria no uniforme .
En la década de 1960, el pipelining se consideraba una innovación y, en la década de 1970, el uso de procesadores vectoriales ya estaba bien establecido. En la década de 1980, muchas supercomputadoras usaban procesadores vectoriales paralelos. [2]
El número relativamente pequeño de procesadores en los primeros sistemas les permitió usar fácilmente una arquitectura de memoria compartida , que permite a los procesadores acceder a un grupo común de memoria. En los primeros días, un enfoque común era el uso del acceso uniforme a la memoria (UMA), en el que el tiempo de acceso a una ubicación de memoria era similar entre procesadores. El uso del acceso no uniforme a la memoria (NUMA) permitía a un procesador acceder a su propia memoria local más rápido que a otras ubicaciones de memoria, mientras que las arquitecturas de memoria solo caché (COMA) permitían que la memoria local de cada procesador se usara como caché, lo que requería coordinación a medida que cambiaban los valores de la memoria. [26]
A medida que aumenta el número de procesadores, la comunicación y sincronización eficientes entre procesadores en una supercomputadora se convierte en un desafío. Se pueden utilizar varios enfoques para lograr este objetivo. Por ejemplo, a principios de la década de 1980, en el sistema Cray X-MP , se utilizaron registros compartidos . En este enfoque, todos los procesadores tenían acceso a registros compartidos que no movían datos de un lado a otro, sino que solo se usaban para la comunicación y sincronización entre procesadores. Sin embargo, los desafíos inherentes a la gestión de una gran cantidad de memoria compartida entre muchos procesadores dieron como resultado un cambio hacia arquitecturas más distribuidas . [27]
Paralelismo centralizado masivo

Durante la década de 1980, a medida que aumentaba la demanda de potencia informática, comenzó la tendencia hacia un número mucho mayor de procesadores, marcando el comienzo de la era de los sistemas masivamente paralelos , con memoria distribuida y sistemas de archivos distribuidos , [2] dado que las arquitecturas de memoria compartida no podían escalar a un gran número de procesadores. [28] Los enfoques híbridos como la memoria compartida distribuida también aparecieron después de los primeros sistemas. [29]
El enfoque de agrupamiento de computadoras conecta una serie de nodos informáticos fácilmente disponibles (por ejemplo, computadoras personales utilizadas como servidores) a través de una red de área local privada y rápida . [30] Las actividades de los nodos informáticos están orquestadas por un "middleware de agrupamiento", una capa de software que se ubica sobre los nodos y permite a los usuarios tratar el clúster como una unidad informática cohesiva en general, por ejemplo, a través de un concepto de imagen de sistema único . [30]
La agrupación de ordenadores se basa en un enfoque de gestión centralizada que hace que los nodos estén disponibles como servidores compartidos orquestados . Se diferencia de otros enfoques como la computación entre pares o en cuadrícula que también utilizan muchos nodos, pero con una naturaleza mucho más distribuida . [30] En el siglo XXI, la lista semestral de la organización TOP500 de las 500 supercomputadoras más rápidas a menudo incluye muchos clústeres, por ejemplo, el más rápido del mundo en 2011, el ordenador K con una memoria distribuida , arquitectura de clúster. [31] [32]
Cuando se utiliza una gran cantidad de nodos de computación locales semi-independientes (por ejemplo, en una arquitectura de clúster), la velocidad y la flexibilidad de la interconexión se vuelven muy importantes. Las supercomputadoras modernas han adoptado diferentes enfoques para abordar este problema, por ejemplo, Tianhe-1 utiliza una red de alta velocidad patentada basada en Infiniband QDR, mejorada con CPU FeiTeng-1000 . [4] Por otro lado, el sistema Blue Gene /L utiliza una interconexión de toro tridimensional con redes auxiliares para comunicaciones globales. [11] En este enfoque, cada nodo está conectado a sus seis vecinos más cercanos. Un toro similar fue utilizado por el Cray T3E . [12]
Los sistemas centralizados masivos a veces utilizan procesadores de propósito especial diseñados para una aplicación específica, y pueden utilizar chips de matriz de puertas programables en campo (FPGA) para ganar rendimiento sacrificando la generalidad. Ejemplos de supercomputadoras de propósito especial incluyen Belle , [33] Deep Blue , [34] e Hydra , [35] para jugar ajedrez , Gravity Pipe para astrofísica, [36] MDGRAPE-3 para el cálculo de la estructura de proteínas y la dinámica molecular [37] y Deep Crack , [38] para descifrar el cifrado DES .
Paralelismo distribuido masivo

La computación en red utiliza una gran cantidad de computadoras en dominios administrativos distribuidos y diversos. Es un enfoque oportunista que utiliza recursos siempre que están disponibles. [10] Un ejemplo es BOINC , un sistema de red oportunista basado en voluntarios . [39] Algunas aplicaciones BOINC han alcanzado niveles de múltiples petaflops al utilizar cerca de medio millón de computadoras conectadas a Internet, siempre que los recursos voluntarios estén disponibles. [40] Sin embargo, este tipo de resultados a menudo no aparecen en las clasificaciones TOP500 porque no ejecutan el punto de referencia de propósito general Linpack .
Aunque la computación en cuadrícula ha tenido éxito en la ejecución de tareas paralelas, las exigentes aplicaciones de supercomputadoras como las simulaciones meteorológicas o la dinámica de fluidos computacional han permanecido fuera de su alcance, en parte debido a las barreras en la subasignación confiable de una gran cantidad de tareas, así como a la disponibilidad confiable de recursos en un momento dado. [39] [41] [42]
En la supercomputación cuasi-oportunista, una gran cantidad de computadoras geográficamente dispersas se orquestan con salvaguardas incorporadas . [43] El enfoque cuasi-oportunista va más allá de la computación voluntaria en sistemas altamente distribuidos como BOINC , o la computación en cuadrícula general en un sistema como Globus al permitir que el middleware proporcione acceso casi sin fisuras a muchos clústeres informáticos para que los programas existentes en lenguajes como Fortran o C puedan distribuirse entre múltiples recursos informáticos. [43]
La supercomputación cuasi-oportunista tiene como objetivo proporcionar una mayor calidad de servicio que el uso compartido de recursos oportunista . [44] El enfoque cuasi-oportunista permite la ejecución de aplicaciones exigentes dentro de las redes informáticas mediante el establecimiento de acuerdos de asignación de recursos a nivel de red y el paso de mensajes tolerantes a fallos para protegerse de forma abstracta contra las fallas de los recursos subyacentes, manteniendo así cierto oportunismo, al tiempo que permite un mayor nivel de control. [10] [43] [45]
Tendencias arquitectónicas del siglo XXI

La arquitectura de la supercomputadora IBM Blue Gene refrigerada por aire sacrifica velocidad del procesador por un bajo consumo de energía, de modo que se puede utilizar una mayor cantidad de procesadores a temperatura ambiente, utilizando aire acondicionado normal. [14] [46] El sistema Blue Gene/P de segunda generación tiene procesadores con lógica de comunicación de nodo a nodo integrada. [47] Es energéticamente eficiente, alcanzando 371 MFLOPS/W . [48]
El ordenador K es un sistema de memoria distribuida , procesador homogéneo refrigerado por agua y arquitectura de clúster . [32] [49] Utiliza más de 80.000 procesadores SPARC64 VIIIfx , cada uno con ocho núcleos , para un total de más de 700.000 núcleos, casi el doble que cualquier otro sistema. Comprende más de 800 gabinetes, cada uno con 96 nodos de computación (cada uno con 16 GB de memoria) y 6 nodos de E/S. Aunque es más potente que los siguientes cinco sistemas en la lista TOP500 combinados, con 824,56 MFLOPS/W tiene la relación potencia/rendimiento más baja de cualquier sistema de supercomputadora importante actual. [50] [51] El sistema de seguimiento del ordenador K, llamado PRIMEHPC FX10 , utiliza la misma interconexión de toro de seis dimensiones, pero todavía solo un procesador por nodo. [52]
A diferencia de la computadora K, el sistema Tianhe-1A utiliza una arquitectura híbrida e integra CPU y GPU. [4] Utiliza más de 14.000 procesadores de propósito general Xeon y más de 7.000 unidades de procesamiento gráfico de propósito general (GPGPU) Nvidia Tesla en alrededor de 3.500 blades . [53] Tiene 112 gabinetes de computadora y 262 terabytes de memoria distribuida; 2 petabytes de almacenamiento en disco se implementan a través de archivos agrupados Lustre . [54] [55] [56] [4] Tianhe-1 utiliza una red de comunicación de alta velocidad patentada para conectar los procesadores. [4] La red de interconexión patentada se basó en Infiniband QDR, mejorada con CPU FeiTeng-1000 de fabricación china . [4] En el caso de la interconexión, el sistema es dos veces más rápido que Infiniband, pero más lento que algunas interconexiones en otras supercomputadoras. [57]
Los límites de los enfoques específicos continúan siendo probados, a medida que se alcanzan los límites a través de experimentos a gran escala, por ejemplo, en 2011 IBM finalizó su participación en el proyecto de petaflops Blue Waters en la Universidad de Illinois. [58] [59] La arquitectura Blue Waters se basó en el procesador IBM POWER7 y pretendía tener 200.000 núcleos con un petabyte de "memoria direccionable globalmente" y 10 petabytes de espacio en disco. [6] El objetivo de un petaflop sostenido condujo a opciones de diseño que optimizaron el rendimiento de un solo núcleo y, por lo tanto, un menor número de núcleos. Se esperaba entonces que el menor número de núcleos ayudara al rendimiento en programas que no escalaban bien a un gran número de procesadores. [6] La gran arquitectura de memoria direccionable globalmente tenía como objetivo resolver problemas de direccionamiento de memoria de manera eficiente, para el mismo tipo de programas. [6] Se esperaba que Blue Waters funcionara a velocidades sostenidas de al menos un petaflop, y se basó en el enfoque específico de refrigeración por agua para gestionar el calor. En los primeros cuatro años de funcionamiento, la Fundación Nacional de la Ciencia gastó unos 200 millones de dólares en el proyecto. IBM lanzó el nodo informático Power 775 derivado de la tecnología de ese proyecto poco después, pero abandonó en la práctica el enfoque de Blue Waters. [58] [59]
Los experimentos arquitectónicos continúan en varias direcciones, por ejemplo, el sistema Cyclops64 utiliza un enfoque de "supercomputadora en un chip", en una dirección que se aleja del uso de procesadores distribuidos masivos. [60] [61] Cada chip Cyclops64 de 64 bits contiene 80 procesadores, y todo el sistema utiliza una arquitectura de memoria direccionable globalmente . [62] Los procesadores están conectados con un conmutador de barra cruzada sin bloqueo interno y se comunican entre sí a través de una memoria intercalada global. No hay caché de datos en la arquitectura, pero la mitad de cada banco de SRAM se puede utilizar como memoria de borrador. [62] Aunque este tipo de arquitectura permite un paralelismo no estructurado en un sistema de memoria dinámicamente no contiguo, también produce desafíos en el mapeo eficiente de algoritmos paralelos a un sistema de muchos núcleos . [61]
Véase también
- Sistemas operativos de supercomputadoras
- Supercomputación en China
- Supercomputación en Europa
- Historia de la supercomputación
- Supercomputación en la India
- Supercomputación en Japón
Referencias
- ^ Sao-Jie Chen; Guang-Huei Lin; Pao-Ann Hsiung; Yu-Hen Hu (9 de febrero de 2009). Diseño conjunto de hardware y software de una plataforma de SOC multimedia. Springer. pp. 70– 72. ISBN 978-1-4020-9622-8. Recuperado el 15 de junio de 2012 .
- ^ abcde Hoffman, Allan R. (1989). Supercomputadoras: direcciones en tecnología y aplicaciones . Washington, DC: National Academy Press. pp. 35– 47. ISBN 978-0-309-04088-4.
- ^ abcd Hill, Mark D.; Jouppi, Norman P .; Sohi, Gurindar (2000). Lecturas en arquitectura informática . San Francisco: Morgan Kaufmann. págs. 40– 49. ISBN 978-1-55860-539-8.
- ^ abcdefghi Yang, Xue-Jun; Liao, Xiang-Ke; Lu, Kai; Hu, Qing-Feng; Canción, Jun-Qiang; Su, Jin-Shu (2011). "La supercomputadora TianHe-1A: su hardware y software". Revista de Ciencias y Tecnología de la Computación . 26 (3): 344– 351. doi :10.1007/s02011-011-1137-8. S2CID 1389468.
- ^ ab Murray, Charles J. (1997). Los superhombres: la historia de Seymour Cray y los magos técnicos detrás de la supercomputadora. Nueva York: John Wiley. pp. 133–135. ISBN 978-0-471-04885-5.
- ^ abcde Biswas, Rupak, ed. (2010). Dinámica de fluidos computacional paralela: avances recientes y direcciones futuras: artículos de la 21.ª Conferencia internacional sobre dinámica de fluidos computacional paralela . Lancaster, Pensilvania: DEStech Publications. pág. 401. ISBN 978-1-60595-022-8.
- ^ a b C Yongge Huáng, ed. (2008). Avanza la investigación en supercomputación . Nueva York: Nova Science Publishers. págs. 313-314 . ISBN 978-1-60456-186-9.
- ^ ab Tokhi, MO; Hossain, MA; Shaheed, MH (2003). Computación paralela para procesamiento y control de señales en tiempo real . Londres [ua]: Springer. pp. 201– 202. ISBN 978-1-85233-599-1.
- ^ ab Vaidy S. Sunderam, ed. (2005). Computational science -- ICCS 2005. 5th international conference, Atlanta, GA, EE. UU., 22-25 de mayo de 2005: actas (1.ª ed.). Berlín: Springer. págs. 60-67 . ISBN 978-3-540-26043-1.
- ^ abc Prodan, Radu; Thomas Fahringer (2007). Gestión de experimentos de computación en cuadrícula, integración de herramientas y flujos de trabajo científicos . Berlín: Springer. pp. 1– 4. ISBN 978-3-540-69261-4.
- ^ ab Knight, Will (27 de junio de 2007). «IBM crea el ordenador más potente del mundo». New Scientist .
- ^ ab Adiga, NR; Blumrich, MA; Chen, D.; Coteo, P.; Gará, A.; Giampapa, ME; Heidelberger, P.; Singh, S.; Steinmacher-Burow, BD; Tomado, T.; Tsao, M.; Vranas, P. (marzo de 2005). «Red de interconexión toroidal Blue Gene/L» (PDF) . Revista IBM de investigación y desarrollo . 49 (2.3): 265– 276. doi :10.1147/rd.492.0265. Archivado desde el original (PDF) el 15 de agosto de 2011.
{{cite journal}}: CS1 maint: varios nombres: lista de autores ( enlace ) - ^ Varadarajan, S. (14 de marzo de 2005). "Keynote I: "System X construyendo la supercomputadora de Virginia Tech"". Actas de la 13.ª Conferencia internacional sobre comunicaciones y redes informáticas (IEEE Cat No 04EX969) ICCCN-04 . p. 1. doi :10.1109/ICCCN.2004.1401570. ISBN 978-0-7803-8814-7. ISSN 1095-2055.
- ^ ab Prickett Morgan, Timothy (22 de noviembre de 2010). "IBM revela el superordenador BlueGene/Q de 20 petaflops". The Register .
- ^ "La supercomputadora refrigerada por agua de IBM se pone en marcha en la ETH de Zúrich". HPCwire . Zúrich. 2 de julio de 2010. Archivado desde el original el 13 de agosto de 2012.
- ^ LaMonica, Martin (10 de mayo de 2010). «Supercomputadora refrigerada por líquido de IBM calienta un edificio». Green Tech . Cnet. Archivado desde el original el 1 de noviembre de 2013. Consultado el 5 de febrero de 2012 .
- ^ Henderson, Harry (2008). "Arquitectura de supercomputadoras". Enciclopedia de informática y tecnología . pág. 217. ISBN 978-0-8160-6382-6.
- ^ Prickett Morgan, Timothy (31 de mayo de 2010). "Top 500 supers – The Dawning of the GPUs" (Los 500 mejores supers: el amanecer de las GPU). The Register .
- ^ Rainer Keller; David Kramer; Jan-Philipp Weiss (1 de diciembre de 2010). Enfrentando el desafío de los núcleos múltiples: aspectos de nuevos paradigmas y tecnologías en computación paralela. Springer. pp. 118– 121. ISBN 978-3-642-16232-9. Recuperado el 15 de junio de 2012 .
- ^ Poeter, Damon (11 de octubre de 2011). "La supercomputadora Titan de Cray para ORNL podría ser la más rápida del mundo". PC Magazine .
- ^ Feldman, Michael (11 de octubre de 2011). "Las GPU transformarán el Jaguar de ORNL en un Titán de 20 petaflops". HPC Wire .
- ^ Prickett Morgan, Timothy (11 de octubre de 2011). "Oak Ridge cambia el foco de Jaguar de las CPU a las GPU". The Register .
- ^ Hai-Xiang Lin; Miguel Alejandro; Martti Forsell, eds. (2010). Talleres de procesamiento paralelo Euro-Par 2009: HPPC, HeteroPar, PROPER, ROIA, UNICORE, VHPC, Delft, Países Bajos, 25 al 28 de agosto de 2009; talleres (Online-Ausg. Ed.). Berlín: Springer. pag. 345.ISBN 978-3-642-14121-8.
- ^ Reiner Dumke; René Braungarten; Günter Büren (3 de diciembre de 2008). Medición de procesos y productos de software: conferencias internacionales, IWSM 2008, MetriKon 2008 y Mensura 2008, Munich, Alemania, 18 y 19 de noviembre de 2008: Actas. Saltador. págs. 144-117 . ISBN 978-3-540-89402-5. Recuperado el 15 de junio de 2012 .
- ^ Frisch, Michael J. (diciembre de 1972). "Observaciones sobre el algoritmo 352 [S22], el algoritmo 385 [S13], el algoritmo 392 [D3]". Comunicaciones de la ACM . 15 (12): 1074. doi : 10.1145/361598.361914 . S2CID 6571977.
- ^ El-Rewini, Hesham; Mostafa Abd-El-Barr (2005). Arquitectura informática avanzada y procesamiento paralelo . Hoboken, Nueva Jersey: Wiley-Interscience. pp. 77– 80. ISBN 978-0-471-46740-3.
- ^ JJ Dongarra; L. Grandinetti; J. Kowalik; GR Joubert (13 de septiembre de 1995). Computación de alto rendimiento: tecnología, métodos y aplicaciones. Elsevier. pp. 123– 125. ISBN 978-0-444-82163-8. Recuperado el 15 de junio de 2012 .
- ^ Greg Astfalk (1996). Aplicaciones en computadoras de arquitectura avanzada. SIAM. p. 62. ISBN 978-0-89871-368-8. Recuperado el 15 de junio de 2012 .
- ^ Jelica Protic; Milo Tomašević; Milo Tomasevic; Veljko Milutinović (1998). Memoria compartida distribuida: conceptos y sistemas. Prensa de la Sociedad de Computación IEEE. págs. ix- x. ISBN 978-0-8186-7737-3. Recuperado el 15 de junio de 2012 .
- ^ abc Tomoya Enokido; Leonard Barolli; Makoto Takizawa, eds. (2007). Sistemas de información basados en redes: primera conferencia internacional, NBiS 2007, Regensburg, Alemania, 3-7 de septiembre de 2007: actas . Berlín: Springer. p. 375. ISBN 978-3-540-74572-3.
- ^ Lista TOP500 Para ver todos los clústeres de la lista TOP500, seleccione "clúster" como arquitectura en el "menú de sublista" en el sitio TOP500.
- ^ ab Yokokawa, M.; Shoji, Fumiyoshi; Uno, Atsuya; Kurokawa, Motoyoshi; Watanabe, Tadashi (22 de agosto de 2011). "El ordenador K: proyecto japonés de desarrollo de superordenadores de próxima generación". Simposio internacional IEEE/ACM sobre electrónica de bajo consumo y diseño . pp. 371– 372. doi :10.1109/ISLPED.2011.5993668. ISBN 978-1-61284-658-3. Número de identificación del sujeto 13436840.
- ^ Condon, JH y K.Thompson, "Belle Chess Hardware", en Avances en ajedrez informático 3 (ed.MRBClarke), Pergamon Press, 1982.
- ^ Hsu, Feng-hsiung (2002). Detrás de Deep Blue: la construcción de la computadora que derrotó al campeón mundial de ajedrez . Princeton University Press . ISBN 978-0-691-09065-8.
- ^ Donninger, Chrilly; Ulf Lorenz (2004). "La hidra, el monstruo del ajedrez". Field Programmable Logic and Application . Apuntes de clase en informática. Vol. 3203. págs. 927– 932. doi :10.1007/978-3-540-30117-2_101. ISBN 978-3-540-22989-6. Número de identificación del sujeto 5467762.
- ^ Makino, Junichiro; Makoto Taiji (1998). Simulaciones científicas con computadoras de propósito especial: los sistemas GRAPE . Chichester [ua]: Wiley. ISBN 978-0-471-96946-4.
- ^ Nota de prensa de RIKEN, Finalización de un sistema informático de un petaflops para la simulación de la dinámica molecular Archivado el 2 de diciembre de 2012 en Wayback Machine
- ^ Electronic Frontier Foundation (1998). Cracking DES – Secretos de la investigación de cifrado, políticas de escuchas telefónicas y diseño de chips. Oreilly & Associates Inc. ISBN 978-1-56592-520-5.
- ^ ab Vega, Francisco Fernández de Vega (2010). Erick Cantú-Paz (ed.). Inteligencia computacional paralela y distribuida (Online-Ausg. ed.). Berlín: Springer-Verlag. págs. 65 a 68. ISBN 978-3-642-10674-3.
- ^ Estadísticas BOIN, 2011 Archivado el 19 de septiembre de 2010 en Wayback Machine.
- ^ Guang R. Gao, ed. (2010). Lenguajes y compiladores para computación paralela: 22.º taller internacional, LCPC 2009, Newark, DE, EE. UU., 8-10 de octubre de 2009, artículos seleccionados revisados (1.ª ed.). Berlín: Springer. pp. 10-11 . ISBN 978-3-642-13373-2.
- ^ Mario R. Guarracino, ed. (24 de junio de 2011). Euro-par 2010, Talleres de Procesamiento Paralelo Heteropar, Hpcc, Hibb, Coregrid, Uchpc, Hpcf, Proper, Ccpi, Vhpc, Iscia, Italia, 31 de agosto - 3 de septiembre de 2010 . Berlín [ua]: Springer-Verlag New York Inc. págs. 274–277 . ISBN 978-3-642-21877-4.
- ^ abc Kravtsov, Valentin; David Carmeli; Werner Dubitzky; Ariel Orda; Assaf Schuster; Benny Yoshpa (2007). "Supercomputación cuasi-oportunista en redes". Simposio Internacional IEEE sobre Computación Distribuida de Alto Rendimiento : 233– 244.
- ^ Marian Bubak, ed. (2008). Computational science -- ICCS 2008 : 8th international conference, Cracovia, Polonia, 23-25 de junio de 2008; actas (edición en línea). Berlín: Springer. pp. 112– 113. ISBN 978-3-540-69383-3.
- ^ Gabrielle Allen , ed. (2009). Computational science - ICCS 2009: 9th international conference, Baton Rouge, LA, EE. UU., 25-27 de mayo de 2009; actas . Berlín: Springer. pp. 387– 388. ISBN 978-3-642-01969-2.
- ^ Cunha, José C. (2005). Procesamiento paralelo Euro-Par 2005 . [Nueva York]: Springer-Verlag Berlín/Heidelberg. págs. 560–567 . ISBN 978-3-540-28700-1.
- ^ "IBM triplica el rendimiento de la supercomputadora más rápida y de mayor eficiencia energética del mundo". 27 de junio de 2007. Archivado desde el original el 8 de julio de 2007. Consultado el 24 de diciembre de 2011 .
- ^ "La lista Green500". Archivado desde el original el 26 de agosto de 2016. Consultado el 13 de febrero de 2020 .
- ^ Lista TOP500 Archivado el 20 de enero de 2012 en Wayback Machine.
- ^ Takumi Maruyama (2009). SPARC64(TM) VIIIfx: procesador octa-core de nueva generación de Fujitsu para computación a escala PETA (PDF) . Actas de Hot Chips 21. IEEE Computer Society.
- ^ "RIKEN Advanced Institute for Computational Science" (PDF) . RIKEN . Archivado desde el original (PDF) el 27 de julio de 2011 . Consultado el 20 de junio de 2011 .
- ^ Fujitsu presenta la supercomputadora Post-K HPC Wire 7 de noviembre de 2011
- ^ "MSN". Archivado desde el original el 7 de octubre de 2010.
- ^ "China..." 28 de octubre de 2010.
- ^ "Top100..." 28 de octubre de 2010.
- ^ "Tianhe-1A". Archivado desde el original el 20 de abril de 2020. Consultado el 5 de febrero de 2012 .
- ^ Thibodeau, Patrick (4 de noviembre de 2010). «EE.UU. afirma que China está construyendo una supercomputadora 'enteramente autóctona'». Computerworld . Archivado desde el original el 11 de octubre de 2012. Consultado el 5 de febrero de 2012 .
- ^ ab The Register: IBM le da un tirón de orejas al superdeportivo 'Blue Waters'
- ^ ab "The Statesman El negocio de los ordenadores Unix de IBM está en auge". Archivado desde el original el 2011-08-06 . Consultado el 2012-02-05 .
- ^ Niu, Yanwei; Ziang Hu; Kenneth Barner ; Guang R. Gao (2005). "Modelado del rendimiento y optimización del acceso a la memoria en la arquitectura de computación celular Cyclops64". Computación en red y paralela . Apuntes de clase en informática. Vol. 3779. págs. 132– 143. doi :10.1007/11577188_18. ISBN 978-3-540-29810-6.
{{cite book}}:|journal=ignorado ( ayuda ) - ^ ab Tan, Guangming; Sreedhar, Vugranam C.; Gao, Guang R. (13 de noviembre de 2009). "Análisis y resultados de rendimiento de la computación de centralidad de intermediación en IBM Cyclops64". The Journal of Supercomputing . 56 (1): 1– 24. doi :10.1007/s11227-009-0339-9. S2CID 10976819.
- ^ ab Hai Jin; Daniel A. Reed; Wenbin Jiang (2005). Computación en red y paralela: Conferencia internacional IFIP, NPC 2005, Pekín, China, 30 de noviembre - 3 de diciembre de 2005; Actas. Birkhäuser. págs. 132-133 . ISBN 978-3-540-29810-6. Recuperado el 15 de junio de 2012 .