Acelere la Innovación en la Nube

Diagnóstico de cáncer. Predicción de huracanes. Automatización de operaciones empresariales. Estos son algunos de los avances posibles cuando se usa la computación acelerada para revelar la información oculta en vastos volúmenes de datos. Amazon Web Services (AWS) y NVIDIA han colaborado desde 2010 para ofrecer la nube acelerada por GPU más potente y avanzada, con el fin de para ayudar a los clientes a desarrollar un futuro más inteligente.

Como se anunció en GTC 2026, varias colaboraciones nuevas que se expanden desde el procesamiento de datos impulsado por NVIDIA en AWS a la familia de modelos NVIDIA Nemotron™ continúan ofreciendo innovación de pila completa. Lea los anuncios aquí.

Impulse Nuevas Capacidades con AWS y NVIDIA

Área de la Salud

Acelere el descubrimiento de fármacos y el análisis genómico mediante los microservicios NVIDIA BioNeMo™ y NIM™ en AWS HealthOmics. Los investigadores pueden acceder a modelos de IA optimizados para la predicción de estructuras de proteínas y la química generativa, lo que reduce el tiempo de obtención de información y posibilita workflows de biología rentables y escalables.

Servicios Financieros

Mejore la detección de fraudes y la verificación de identidad con NVIDIA AI Blueprint para la detección de fraudes financieros en AWS, para que las instituciones financieras identifiquen patrones y anomalías sutiles en los datos de transacciones.

Manufactura y Automotores

Simule gemelos digitales, procesos y operaciones industriales físicamente precisos con NVIDIA Omniverse™ en AWS. Los fabricantes de automóviles y las empresas de logística, incluido Amazon Robotics, simulan líneas de producción y robots móviles autónomos en entornos virtuales para optimizar los workflows antes de la implementación física.

Sector Público

Permitir que las agencias aprovechen la IA y la HPC a gran escala con computación acelerada de pila completa para respaldar misiones como la IA generativa, el análisis de datos a gran escala, las simulaciones de física y la IA física. AWS European Sovereign Cloud, impulsada por la plataforma NVIDIA Blackwell, NVIDIA Run:ai y NVIDIA IA de NVIDIA Enterprise, permite a las organizaciones europeas implementar aplicaciones de IA de forma segura.

Telecomunicaciones

Optimice las operaciones de red y las experiencias de los clientes con Telco AI Fellowship, una colaboración entre AWS y NVIDIA. Utilice la IA agéntica para impulsar la eficiencia operativa y nuevas fuentes de ingresos en voz, video y datos.

Medios y Entretenimiento

Agilice la creación de contenido con workstations virtuales basadas en la nube mediante NVIDIA RTX™ en AWS. Los pipelines de producción acelerados por IA ofrecen contenido de mayor calidad más rápido, el análisis de datos proporciona perspectivas más profundas, la distribución y la monetización están optimizadas y la infraestructura definida por software está mejorando el entretenimiento en vivo.

Energía

Acelerar la exploración y la producción del subsuelo, optimizar los equipos y las operaciones de campo, aumentar la confiabilidad y la resiliencia de la red e impulsar la generación de energía renovable.

Explore las Historias de Éxito

Perplexity: Atención de Más de 800 Millones de Consultas de Usuario por Mes con IA

Perplexity desarrolló pplx-api mediante las GPU NVIDIA A100 Tensor Core en AWS y NVIDIA TensorRT™-LLM, logrando una latencia hasta 3.1 veces menor y una latencia del primer token 4.3 veces menor en comparación con otras plataformas. La startup redujo 4 veces los costos de inferencia, lo que genera un ahorro de USD 600,000 anuales, a la vez que escaló a cientos de GPU, y las GPU NVIDIA H100 ofrecen una latencia un 50 % menor y un rendimiento un 200 % mayor que las A100.

Noetik: impulsar las Terapias de Precisión Contra el Cáncer con Machine Learning

Noetik, un miembro del Programa NVIDIA Inception, usa las GPU NVIDIA Hopper™ Tensor Core en AWS SageMaker HyperPod para entrenar modelos fundacionales multimodales para la inmunoterapia de precisión contra el cáncer. Esto permite el procesamiento de 1 petabyte de datos de tumores humanos (lo que crea perfiles de más de 200 millones de células) para acelerar el descubrimiento terapéutico y habilitar tratamientos adaptados para pacientes individuales.

Fireworks.ai: Inferencia de IA Generativa para Desarrolladores

Fireworks.ai desarrolló una solución de inferencia de IA generativa ultrarrápida y con costo optimizado mediante instancias de Amazon EC2 P5 impulsadas por las GPU NVIDIA H100 Tensor Core. La plataforma ofrece un rendimiento por instancia 4 veces mayor que las soluciones de código abierto, reduce la latencia en hasta un 50 % y reduce 4 veces los costos generales para algunos clientes. Los desarrolladores pueden ejecutar, ajustar y personalizar modelos fundacionales, como Llama 2, Stable Diffusion XL y StarCoder, a la vez que cumplen con los estándares de cumplimiento de HIPAA y SOC2 Tipo II.

A-Alpha Bio: Descubrimiento de Fármacos Acelerado por IA

A-Alpha Bio aceleró el descubrimiento de fármacos al implementar NVIDIA BioNeMo™ en AWS, lo que logró una inferencia 12 veces más rápida y el procesamiento de 108 millones de predicciones de unión a proteínas, diez veces más de lo planificado inicialmente. Mediante las instancias de Amazon EC2 P5 impulsadas por las GPU NVIDIA H100 Tensor Core, la startup de biotecnología redujo los ciclos experimentales en 1 o 2 iteraciones, lo que reduce los costos a la vez que descubre candidatos a anticuerpos monoclonales superiores para la terapéutica.

Synthesia: Producción de Video Mejorada por IA

Synthesia transformó la producción de video de IA mediante la implementación de instancias de Amazon EC2 impulsadas por GPU de NVIDIA, lo que logra una mejora de 30 veces en el rendimiento de entrenamiento de modelos de ML. Mediante las instancias de Amazon EC2 P5 con las GPU NVIDIA H100 Tensor Core e instancias P4 con las GPU NVIDIA A100, la startup de IA redujo el tiempo de entrenamiento para modelos de voz de días a horas, a la vez que admite un crecimiento de usuarios del 456 %.

Innophore: Avance de la Velocidad, la Precisión y la Escala en el Descubrimiento de Fármacos

Innophore acelera el descubrimiento de fármacos mediante NVIDIA BioNeMo para analizar estructuras de proteínas con su tecnología Catalophore. La plataforma completó el mapeo de las estructuras de proteínas de todo el organismo humano en dos semanas, una tarea que anteriormente tomaba más de un año. Esto mejora la precisión en la predicción de los efectos de fármacos fuera del objetivo en un 30 % dentro de los éxitos de clasificación superior.

Infraestructura Acelerada de NVIDIA (de Cloud al Edge) en AWS

Amazon Elastic Cloud Compute (EC2)

Acceda a una amplia gama de instancias aceleradas por GPU de NVIDIA en Amazon EC2 on demand para cumplir con los diversos requisitos computacionales de IA, machine learning, análisis de datos, gráficos, juegos en la nube, escritorios virtuales y aplicaciones de HPC. Desde las instancias de una sola GPU hasta miles de GPU en EC2 UltraClusters, los clientes de AWS pueden aprovisionar la GPU del tamaño adecuado para acelerar el tiempo de la solución y reducir los costos totales de la ejecución de sus cargas de trabajo en la nube.

Amazon EC2 P6e con NVIDIA GB300 NVL72

Los Amazon EC2 P6e UltraServers, impulsados por los sistemas NVIDIA GB300 NVL72, ofrecen un desempeño de IA innovador. P6e-GB300 proporciona 1.5 veces más memoria de GPU y computación para modelos de vanguardia, lo que lo vuelve ideal para entrenar modelos de razonamiento (incluidas las arquitecturas de mezcla de expertos o MoE) y para la inferencia de copilotos empresariales y aplicaciones de IA agéntica.

Amazon EC2 P6 con NVIDIA B300

Las instancias de Amazon EC2 P6, impulsadas por la plataforma NVIDIA Blackwell, ofrecen mejoras de desempeño de hasta dos veces para el entrenamiento y la inferencia de IA. P6-B300 proporciona 1.5 veces la memoria y computación de GPU 1.5 veces que ofrece P6-B200, lo que resulta ideal para el entrenamiento distribuido a gran escala. Perfecto para modelos de MoE de mediana a gran escala y aplicaciones de IA de agentes.

Amazon EC2 G7e con NVIDIA RTX PRO 6000 Blackwell Server Edition

Las instancias de Amazon EC2 G7e con NVIDIA RTX PRO 6000 Blackwell Server Edition están disponibles para avanzar en las cargas de trabajo de inferencia de IA, computación científica y computación espacial. Las instancias G7e ofrecen hasta 2.3 veces el desempeño de inferencia que ofrecen las de G6e con un 1.85 veces más ancho de banda de memoria de GPU. Las instancias G7e, que se basan en el sistema AWS Nitro para optimizar la administración de recursos de computación y memoria, protegen las cargas de trabajo y los datos de IA confidenciales.

Integración de AWS con NVLink Fusion

AWS admitirá NVIDIA NVLink™ Fusion (una plataforma para la infraestructura de IA personalizada), lo que permite la implementación de su chip de silicio diseñado a medida, incluidos los chips Trainium4 para la inferencia y el entrenamiento de modelos de IA agéntica, las CPU Graviton para una amplia gama de cargas de trabajo y la infraestructura de virtualización de Nitro System.

AWS e IA Física de NVIDIA

AWS y NVIDIA están profundizando su colaboración para acelerar la IA física, lo que permite a las máquinas autónomas como los robots y los automóviles de conducción autónoma percibir, comprender, razonar y realizar acciones complejas en el mundo real y físico. Al combinar la infraestructura de nube escalable de AWS con la solución de pila completa de NVIDIA, los desarrolladores pueden entrenar, simular e implementar la IA física de manera más eficiente.

Entrene en los Modelos Fundacionales del Mundo NVIDIA Cosmos

Los modelos fundacionales del mundo (WFM) de NVIDIA Cosmos™, disponibles como microservicios NVIDIA NIM en Amazon EKS y AWS Batch, ayudan a los desarrolladores a crear aplicaciones de IA física que entienden las interacciones físicas complejas. Estos modelos simulan la física y los escenarios del mundo real, lo que permite a los robots razonar sobre sus entornos. Son críticos para entrenar modelos fundacionales de propósito general para robots humanoides, como NVIDIA GR00T, en la infraestructura de AWS.

Simule mediante NVIDIA Isaac Lab e Isaac Sim

Los frameworks abiertos NVIDIA Isaac™ Lab e Isaac Sim™ ahora están disponibles en las instancias de Amazon EC2 G6e, lo que brinda a los equipos una forma escalable de ejecutar el aprendizaje y la simulación de robots en la nube. Los desarrolladores pueden entrenar políticas en Isaac Lab y validar el comportamiento en Isaac Sim mediante entornos virtuales físicamente precisos y la generación de datos sintéticos antes de implementarlos en robots reales. El workflow puede conectarse con AWS para acelerar el entrenamiento de modelos de percepción y el aprendizaje por refuerzo a escala.

Implemente en NVIDIA Jetson Thor

Los módulos de la serie NVIDIA Jetson Thor proporcionan la mejor plataforma para la IA física y la robótica, que ofrece hasta 2070 FP4 TFLOPS de computación de IA y 128 GB de memoria. La supercomputadora de robótica impulsada por NVIDIA Blackwell permite cargas de trabajo clave en toda la robótica humanoide, la inteligencia espacial, el procesamiento de múltiples sensores y la IA de agentes.

Simplifique el desarrollo y maximice el desempeño con el software optimizado para NVIDIA

Software optimizado por NVIDIA en AWS

Acceda a la potencia de computación de las instancias aceleradas por GPU de NVIDIA en AWS para desarrollar e implementar sus aplicaciones a escala con menos recursos de computación, lo que acelera el tiempo de solución y reduce el costo total de propiedad. Para maximizar el desempeño y la productividad de los desarrolladores, NVIDIA ofrece una amplia variedad de software optimizado para GPU para una amplia gama de cargas de trabajo, incluida la ciencia de datos, el análisis de datos, el entrenamiento de IA y machine learning, la inferencia de IA y machine learning, HPC y gráficos.

NVIDIA Nemotron Nano 3 en Amazon Bedrock

Amazon Bedrock ahora admite el modelo NVIDIA Nemotron™ 3 Nano 30B A3B, el último avance de NVIDIA en el la elaboración de modelos de lenguaje eficientes que ofrece un alto desempeño de razonamiento, compatibilidad nativa de llamada de herramientas y procesamiento contextual extendido con la ventana contextual de 256k tokens. Este modelo emplea una arquitectura MoE híbrida eficiente para garantizar un mayor rendimiento que sus predecesores para cargas de trabajo basadas en agentes y de codificación, a la vez que mantiene la profundidad de razonamiento de un modelo más grande.

NVIDIA AI Enterprise en AWS Marketplace

NVIDIA AI Enterprise es un conjunto de software de IA seguro, integral y nativo de la nube. Acelera los pipelines de ciencia de datos y agiliza el desarrollo, la implementación y la administración de modelos de IA predictiva para automatizar procesos esenciales y ofrecer información rápida a partir de los datos. NVIDIA AI Enterprise incluye una extensa biblioteca de software de pila completa, incluidos los workflows de IA de NVIDIA, frameworks, modelos previamente entrenados y la optimización de la infraestructura. El soporte empresarial global y las revisiones periódicas de seguridad garantizan la continuidad empresarial y que los proyectos de IA se mantengan encaminados.

NVIDIA Run:ai en AWS Marketplace

NVIDIA Run:ai simplifica la administración de la infraestructura de IA para las organizaciones al proporcionar un plano de control para la infraestructura de GPU en entornos nativos de Kubernetes. La plataforma aborda la utilización de GPU, la priorización de cargas de trabajo y la visibilidad del consumo de GPU al introducir un grupo de GPU virtual y permitir la programación dinámica y basada en políticas. NVIDIA Run:ai se integra con varios servicios de AWS, incluidos Amazon EC2, EKS, SageMaker HyperPod, IAM y CloudWatch, para optimizar el desempeño, simplificar las operaciones y proporcionar una base unificada para las cargas de trabajo de IA/ML.

Servicios de AWS Acelerados por NVIDIA

NVIDIA y AWS colaboran estrechamente en integraciones para llevar el poder de la computación acelerada por NVIDIA a una amplia gama de servicios de AWS. Ya sea que aprovisione y administre las instancias aceleradas por GPU de NVIDIA en AWS usted mismo o las aproveche en servicios administrados como Amazon SageMaker o Amazon Elastic Kubernetes Service (EKS), tiene la flexibilidad para elegir el nivel óptimo de abstracción que necesita.

Amazon EMR

Aproveche NVIDIA RAPIDS™ Accelerator para Apache Spark dentro de Amazon EMR para acelerar los pipelines de ciencia de datos de Apache Spark 3.x sin ningún cambio de c&digo en las instancias de AWS aceleradas por GPU de NVIDIA. Esta integración permite a los científicos de datos ejecutar pipelines de extraer, transformar y cargar (ETL), procesamiento de datos y machine learning a escala masiva y costos de nube más bajos, al hacer más en menos tiempo y con menos instancias basadas en la nube.

Amazon SageMaker AI

El software de IA de NVIDIA y las instancias aceleradas por GPU pueden acelerar cada paso de los workflows de IA y machine learning dentro de Amazon Sagemaker, incluida la preparación de datos, el entrenamiento de modelos y el servicio de inferencia. Para implementar modelos de IA en la producción más rápido y con costos de inferencia más bajos, Amazon SageMaker ha integrado NVIDIA Triton Inference Server™, lo que permite funciones como la compatibilidad con múltiples frameworks, el procesamiento dinámico y la ejecución simultánea de modelos que maximizan el desempeño en las instancias de CPU y GPU en AWS.

Amazon Bedrock con Mantle

Amazon Bedrock permite a las empresas y startups desarrollar aplicaciones de IA basadas en agentes a escala de producción. La plataforma incluye modelos de NVIDIA Nemotron disponibles directamente en el catálogo de modelos de Amazon Bedrock, los microservicios NVIDIA NIM en Amazon Bedrock Marketplace y SageMaker Jumpstart, el kit de herramientas NVIDIA NeMo Agent integrado con Amazon Bedrock AgentCore para servicios componibles impulsados por agentes y la inferencia vectorial sin servidor acelerada por GPU.

Recursos para Desarrolladores y Guías de Inicio Rápido

Programa para Desarrolladores de NVIDIA

Obtenga acceso a un espacio en línea dedicado a sus necesidades, incluidas las herramientas de software avanzadas, la documentación técnica, los recursos de aprendizaje y la ayuda de pares y expertos de dominio para acelerar su trabajo en IA.

Deep Learning Institute (DLI) de NVIDIA

Desarrolle y domine las habilidades que necesita para avanzar en su conocimiento en IA, computación acelerada, ciencia de datos, gráficos, simulación y más con cursos prácticos y capacitación dirigida por expertos.

Programa NVIDIA Inception para Startups

Únase a este programa gratuito diseñado para ayudar a las startups de IA a evolucionar más rápido con tecnología avanzada, oportunidades para conectarse con los inversores y acceso a las últimas herramientas de desarrolladores y recursos técnicos de NVIDIA.

Accede a la Potencia de AWS y NVIDIA

Instancias de Amazon EC2

NVIDIA AI Enterprise

Modelos de NVIDIA Nemotron en AWS