Saltar al contenido principal

Amazon ElastiCache

Amazon ElastiCache

Servicio de almacenamiento en caché completamente administrado y sin servidor que ofrece un rendimiento de latencia de microsegundos con compatibilidad total con Valkey, Memcached y Redis OSS

¿Qué es ElastiCache?

ElastiCache sin servidor ofrece administración de infraestructura cero, mantenimiento sin tiempo de inactividad y escalado instantáneo, lo que permite gestionar miles de millones de solicitudes por segundo en cientos de miles de clientes. ElastiCache potencia las cargas de trabajo de IA agéntica con un almacenamiento en caché de peticiones y semántico, lo que reduce los costos de inferencia de LLM y la latencia al ofrecer respuestas en caché para consultas repetidas o semánticamente similares. Para aumentar la resiliencia, puede habilitar la durabilidad para una protección de datos persistente contra los errores. Para las aplicaciones multirregionales, Global Datastore de ElastiCache ofrece lecturas locales mediante una replicación entre regiones completamente administrada. Como ElastiCache es totalmente compatible con el código abierto, puede migrar a una solución administrada con cambios mínimos o nulos en el código de la aplicación.

Casos de uso

    Amplíe a cientos de millones de operaciones por segundo con una latencia de microsegundos y un alto rendimiento, al tiempo que reduce los costos al almacenar en caché los datos de uso frecuente en la memoria. 

    Logre la menor latencia en la búsqueda vectorial con el mayor rendimiento y la mejor relación entre precio y rendimiento con una tasa de recuperación del 95 % entre las bases de datos vectoriales más populares en AWS mediante el uso de la caché semántica para casos de uso de IA agencial (como la memoria conversacional) y de IA generativa (como la generación aumentada por recuperación). 

    Proteja sus datos contra el extraño caso de que se produzca un error y mantenga una latencia de lectura de microsegundos para las cargas de trabajo, como las bases de conocimiento para la RAG, la memoria a largo plazo de los agentes de IA, la tokenización de pagos y la administración del inventario en tiempo real. 

    Personalice los juegos, el comercio electrónico, las redes sociales y las aplicaciones en línea con una latencia de microsegundos almacenando en caché los datos de sesión efímeros. 

    Simplifique el desarrollo de aplicaciones con estructuras de datos integradas en ElastiCache, como hashes, listas, conjuntos ordenados y mucho más.