AWS lanza Graviton5, GPUs Blackwell y Bedrock AgentCore en su Summit de Nueva York
AWS presentó instancias EC2 M9g con Graviton5, instancias EC2 G7 con GPUs NVIDIA Blackwell y la disponibilidad general de Amazon Bedrock AgentCore en su Summit de Nueva York del 17 y 18 de junio. Los anuncios consolidan a AWS como la capa de infraestructura por defecto para despliegues de agentes de IA en producción.
AWS utilizó su Summit de Nueva York del 17 y 18 de junio para lanzar la actualización de infraestructura de IA más amplia de su historia. El nuevo hardware, la plataforma de orquestación de agentes en disponibilidad general y una nueva capacidad en S3 apuntan al mismo objetivo: convertir AWS en el lugar por defecto para ejecutar agentes de IA en producción.
Graviton5 y EC2 M9g. Las nuevas instancias M9g sobre Graviton5 ofrecen un 25% más de rendimiento de cómputo respecto a la generación anterior, con una caché L3 cinco veces mayor y soporte de memoria DDR5-8800. Los chips Graviton son la columna vertebral de cómputo que hace todo lo demás más económico: no las instancias GPU de gran visibilidad, sino las que procesan millones de llamadas de inferencia en cargas de trabajo sensibles al precio.
EC2 G7 con NVIDIA RTX PRO 4500 Blackwell. La historia de las GPU es arquitectónica, no incremental. Las instancias G7 ofrecen una mejora del 4,6× en rendimiento de inferencia de IA sobre la generación G6 y un 2,1× más en gráficos. Blackwell representa un cambio generacional en capacidad de procesamiento, y que AWS lo lleve a instancias G7 lo hace accesible en producción a precios cloud en lugar de mediante la adquisición de clusters personalizados.
Amazon Bedrock AgentCore en disponibilidad general. Este es el anuncio más relevante para los desarrolladores que construyen sistemas de IA reales. AgentCore coordina agentes autónomos, gestiona su estado de ejecución e integra los controles de acceso de AWS, sin necesidad de que los equipos construyan su propia infraestructura de orquestación. Se complementa con Amazon Quick, una capa de agentes autónomos que opera de forma continua en aplicaciones empresariales —Salesforce, Slack, Snowflake, correo electrónico— incluso cuando los usuarios están desconectados. Los agentes describen sus necesidades en lenguaje natural; Quick gestiona la ejecución con niveles de autonomía configurables, desde la aprobación paso a paso hasta la ejecución orientada a objetivos amplios.
Amazon Bedrock Managed Knowledge Base. Un pipeline RAG completamente gestionado que se encarga de la ingesta, el fragmentado y la recuperación desde S3, SharePoint, Confluence y Google Drive, sin necesidad de gestionar bases vectoriales manualmente. Elimina las tareas de fontanería que han sido la principal fuente de fricción en los despliegues RAG empresariales.
S3 Annotations. Los desarrolladores pueden adjuntar ahora hasta 1 GB de contexto consultable —JSON, XML o YAML— directamente a objetos de S3, descubrible por agentes de IA a través de un servidor MCP de S3 Tables en lenguaje natural. Diseñado específicamente para flujos de trabajo agénticos donde los agentes necesitan entender datos empresariales sin mantener sistemas de indexación externos.
AWS Continuum. Un servicio de seguridad que descubre, prioriza, valida y remedia continuamente vulnerabilidades de código mediante agentes de IA, con un “modo de aprendizaje” supervisado que requiere ampliación de permisos explícita antes de actuar de forma autónoma.
El hilo conductor de todos estos anuncios es el mismo: AWS no está construyendo herramientas para demostraciones de IA, sino la pila de infraestructura que las empresas necesitan para ejecutar agentes con controles de acceso reales, registros de auditoría reales y capacidad de ejecución real.
Fuentes
Lecturas relacionadas
- Cloud e Infraestructura Cloudflare y Stripe Lanzan un Protocolo para que los Agentes de IA Aprovisionen Infraestructura en la Nube sin Intervención Humana
- Cloud e Infraestructura AWS Lanza Lambda S3 Files, Bedrock AgentCore CLI y Aurora Serverless v4 en Una Sola Semana
- Cloud e Infraestructura AWS Compromete 200.000 Millones en 2026, Elimina Más de 12 Servicios y Lanza 'AI Factories' para Despliegues On-Premises