Amazon ElastiCache
완벽한 Valkey, Memcached 및 Redis OSS 호환성과 함께 마이크로초 단위의 지연 시간 성능을 제공하는 서버리스 완전 관리형 캐싱 서비스
ElastiCache란 무엇인가
ElastiCache Serverless는 인프라 관리가 전혀 필요 없고, 유지 보수로 인한 가동 중지 시간이 없고, 즉시 확장할 수 있어 수십만 고객이 보내는 초당 수십억 건의 요청을 처리합니다. ElastiCache는 시맨틱 및 프롬프트 캐싱을 통해 에이전틱 AI 워크로드를 지원하며, 반복적이거나 의미상 유사한 쿼리에 대해 캐시된 응답을 제공함으로써 LLM 추론 비용과 지연 시간을 줄입니다. 복원력 강화를 위해 내구성을 활성화하여 장애 발생 시 데이터를 지속적으로 보호할 수 있습니다. 다중 리전 애플리케이션에 ElastiCache 글로벌 데이터 저장소를 사용하면 완전관리형 크로스 리전 복제를 통해 현지화된 읽기 작업을 수행할 수 있습니다. ElastiCache는 오픈 소스와 완벽하게 호환되므로 애플리케이션 코드를 거의 또는 전혀 변경하지 않고도 관리형 솔루션으로 마이그레이션할 수 있습니다.
ElastiCache의 이점
사용 사례
자주 사용하는 데이터를 메모리에 캐싱하여 비용을 절감하는 동시에 마이크로초의 지연 시간과 높은 처리량으로 초당 수억 건의 작업으로 확장할 수 있습니다.
에이전틱 AI(대화형 메모리 등)와 생성형 AI(검색 증강 생성 등) 사용 사례 모두에 시맨틱 캐싱을 사용하여 AWS 기반의 인기 벡터 데이터베이스 중 95% 재현율로 가장 낮은 지연 시간의 벡터 검색, 최고의 처리량, 최상의 가격 대비 성능을 달성합니다.
RAG용 지식 베이스, AI 에이전트 장기 메모리, 결제 토큰화, 실시간 인벤토리 관리 등의 워크로드에 대해 마이크로초 단위의 읽기 지연 시간을 유지하면서 드물게 발생하는 장애로부터 데이터를 보호할 수 있습니다.
임시 세션 데이터를 캐싱하여 게임, 전자 상거래, 소셜 미디어, 온라인 애플리케이션을 마이크로초 단위의 지연 시간으로 개인화할 수 있습니다.
해시, 목록, 정렬된 세트 등 ElastiCache의 기본 데이터 구조로 애플리케이션 개발을 간소화합니다.