search

Secciones

Architect

159 artículos

Palantir: ¿Puede alguien más hacer lo mismo?
architect

Palantir: ¿Puede alguien más hacer lo mismo?

Palantir es una empresa estadounidense de defensa e inteligencia, nacida a partir del brazo de inversión de la CIA, que ahora opera en el sector público del Reino Unido. Analizamos la afirmación de que su tecnología puede hacer algo que ningún otro proveedor puede.

ComputerWeekly.com ·
Garantizar la IA a escala empresarial: El plan de Google Kubernetes Engine
architect

Garantizar la IA a escala empresarial: El plan de Google Kubernetes Engine

La inteligencia artificial está evolucionando rápidamente, lo que requiere estrategias de seguridad sólidas que los métodos tradicionales no pueden seguir. Los directores de seguridad de la información (CISOs) deben proteger los pesos de los modelos de IA, defenderse de amenazas como la inyección de prompts y cumplir con las regulaciones sin obstaculizar el desarrollo. Google Cloud ofrece un plan integral para proteger las cargas de trabajo de IA en Google Kubernetes Engine (GKE), enfatizando capas de seguridad efectivas desde la seguridad de la infraestructura hasta la seguridad de las aplicaciones. Este enfoque incluye el cifrado a nivel de hardware, redes de confianza cero, controles de integridad del modelo y defensas contra amenazas específicas de la IA. Promueve una estrategia de seguridad por fases: implementar configuraciones básicas, fortalecer los sistemas de producción y automatizar el cumplimiento. Al aprovechar GKE, los equipos pueden garantizar una mayor seguridad sin comprometer la velocidad de implementación de la IA.

Cloud Blog ·
Ejecutar un LLM autoalojado en Kubernetes con vLLM
architect

Ejecutar un LLM autoalojado en Kubernetes con vLLM

Ejecutar cargas de trabajo de modelos de lenguaje grandes (LLM) internamente es una de varias opciones que adoptan los equipos junto con servicios de API gestionados. Los servicios de API gestionados son convenientes y bien adaptados a muchas cargas de trabajo. El auto-alojamiento es una opción complementaria que algunos…

Cloud Native Computing Foundation ·
Los agentes de IA con credenciales en la nube están superando los límites de facturación diseñados para los errores de velocidad humana.
architect

Los agentes de IA con credenciales en la nube están superando los límites de facturación diseñados para los errores de velocidad humana.

Una agencia de tres personas recibió una factura de AWS de 14.000 dólares en un solo día después de que los atacantes extrajeran claves de acceso estáticas y consumieran invocaciones de Claude en Bedrock. Combinado con el incidente de DN42 en mayo, donde un agente autónomo consumió 6.531 dólares en infraestructura excesiva en 24 horas, los expertos advierten que la facturación en la nube se demora aproximadamente un día con respecto al gasto realizado por los agentes. Por Steef-Jan Wiggers

InfoQ - Architecture & Design - News ·
¿Ha sobreextendido Microsoft su elasticidad en la nube?
architect

¿Ha sobreextendido Microsoft su elasticidad en la nube?

Microsoft prometió una escalabilidad ilimitada en la nube, pero las señales de sobrecarga y los retrocesos regionales sugieren que podría estar sobrecargada, lo que obliga a los clientes a reconsiderar el bloqueo del proveedor.

ComputerWeekly.com ·
Cómo analizar y gestionar el uso de la aplicación Gemini Enterprise a gran escala con BigQuery
architect

Cómo analizar y gestionar el uso de la aplicación Gemini Enterprise a gran escala con BigQuery

El despliegue de la aplicación Gemini Enterprise mejora significativamente la productividad organizacional al ofrecer herramientas y soluciones de IA avanzadas. Sin embargo, a medida que aumenta su uso, la gestión de los datos de telemetría plantea desafíos en auditoría, gobernanza y extracción de información. Google Cloud aborda esto con paneles precalculados e integración con BigQuery, lo que permite un análisis mejorado de los patrones de uso, verificación de cumplimiento y auditorías de seguridad. Utilizando las capacidades de BigQuery, los administradores pueden visualizar datos, optimizar las consultas y generar información de manera efectiva, lo que garantiza una integración y gobernanza exitosas de la aplicación Gemini Enterprise dentro de sus organizaciones.

Cloud Blog ·
Cómo solucionar las limitaciones de búsqueda de texto completo multilingüe de PostgreSQL con AlloyDB AI
architect

Cómo solucionar las limitaciones de búsqueda de texto completo multilingüe de PostgreSQL con AlloyDB AI

AlloyDB mejora la búsqueda empresarial al integrar capacidades híbridas avanzadas que combinan búsquedas de texto, vectores y palabras clave en una sola consulta SQL. La reciente adición del soporte de índice RUM mejora aún más la búsqueda de texto completo, especialmente para idiomas logográficos como chino, japonés y coreano, donde la indexación tradicional tiene dificultades debido a la falta de espacios en blanco. Mediante las funciones de IA de AlloyDB, los usuarios pueden utilizar los modelos multilingües de Gemini para el análisis y segmentación de texto eficientes, sin la complejidad de las tuberías de procesamiento externas. Este enfoque facilita búsquedas de alta precisión, optimizadas para el manejo de texto continuo. La integración nativa en AlloyDB simplifica las operaciones manteniendo el procesamiento de datos dentro de la base de datos, mejorando el rendimiento y simplificando la gestión de datos.

Cloud Blog ·
HAMi se convierte en un proyecto en incubación de CNCF
architect

HAMi se convierte en un proyecto en incubación de CNCF

El Comité de Supervisión Técnica de CNCF (TOC) ha votado para aceptar HAMi como un proyecto en fase de incubación de CNCF. Los equipos de infraestructura de IA moderna se enfrentan al mismo problema una y otra vez: las GPU costosas a menudo permanecen sin utilizar y…

Cloud Native Computing Foundation ·
IDC: ¿Por qué el enfoque de red adecuado es fundamental para la inteligencia artificial centrada en el agente?
architect

IDC: ¿Por qué el enfoque de red adecuado es fundamental para la inteligencia artificial centrada en el agente?

El informe especial de IDC sobre IA en redes de 2026 revela que, si bien las empresas están implementando rápidamente iniciativas de IA, la transición del ensayo a la producción está principalmente obstaculizada por problemas de infraestructura, particularmente en redes. Las principales preocupaciones incluyen desafíos de seguridad (32,6%), dificultades de automatización (26,8%) y restricciones de talento (24,7%). El auge de la IA orientada a agentes intensifica estos problemas debido a su naturaleza compleja y distribuida, lo que enfatiza la necesidad de una infraestructura de redes robusta y consistente para respaldar el control y la gobernanza operativa. Las organizaciones deben equilibrar las soluciones basadas en plataformas con capacidades de “lo mejor del mercado” para garantizar la seguridad, reducir la complejidad y facilitar la implementación rápida. Una infraestructura adaptable y extensible es vital para gestionar eficazmente las demandas de los sistemas de IA orientados a agentes.

Cloud Blog ·