Ejecutar un LLM autoalojado en Kubernetes con vLLM
Ejecutar cargas de trabajo de modelos de lenguaje grandes (LLM) internamente es una de varias opciones que adoptan los equipos junto con servicios de API gestionados. Los servicios de API gestionados son convenientes y bien adaptados a muchas cargas de trabajo. El auto-alojamiento es una opción complementaria que algunos…
Artículos relacionados
El WAF de Cloudflare protege las aplicaciones de WordPress de dos vulnerabilidades de alta gravedad
Cloudflare ha implementado dos reglas de WAF en respuesta a las vulnerabilidades de alta gravedad que nos informaron el equipo de seguridad de WordPress. Las nuevas reglas protegen a todos los clientes de Cloudflare que utilizan las versiones de WordPress afectadas, pero los clientes deben actualizar inmediatamente a una versión parcheada.
Componentes de Eclipse Dataspace en AWS: Estrategias de optimización de costes
Al desplegar los conectores de Eclipse Dataspace Components (EDC) en AWS, uno de los primeros desafíos que enfrentará es predecir y controlar el costo de la infraestructura necesaria. Sin criterios claros, es difícil tomar decisiones informadas sobre el dimensionamiento de la carga de trabajo, la configuración del entorno y la inversión a largo plazo. La parte 1 de esta serie de 3 artículos cubrió los fundamentos
Componentes de Eclipse Dataspace en AWS: Patrones de arquitectura en producción
Ejecutar los componentes de Eclipse Dataspace (EDC) en producción en AWS requiere decisiones de arquitectura deliberadas sobre aislamiento, servicios gestionados y capas de seguridad. En la Parte 1 de esta serie, analizamos los fundamentos de las arquitecturas de espacios de datos y el EDC según los estándares de la International Data Space Association (IDSA). Si es nuevo en EDC, recomendamos comenzar por ahí.