View a markdown version of this page

Cómo funciona la ElastiCache habilidad - Amazon ElastiCache

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Cómo funciona la ElastiCache habilidad

La ElastiCache habilidad dirige tu solicitud al área de flujo de trabajo adecuada en función de tu intención. Carga solo el material de referencia necesario para la tarea actual. En la siguiente tabla se describen las áreas de flujo de trabajo incluidas en la habilidad.

Área de flujo de trabajo Finalidad
Solución adecuada Reúne los requisitos de carga de trabajo y recomienda si ElastiCache es la adecuada para su aplicación.
Crea y conecta Ayuda a crear cachés, elegir motores, configurar redes, configurar la autenticación y conectar aplicaciones.
Patrones de aplicación Ayuda a elegir los esquemas clave, los TTL, las estrategias de invalidación y las estructuras de datos de Redis o Valkey.
Cargas de trabajo vectoriales y de IA Ayuda a implementar el almacenamiento semántico en caché, la memoria de los agentes, el RAG, las recomendaciones, la personalización y los patrones de búsqueda vectorial.
Opere y observe Ayuda a configurar los cuadros de mando, las alarmas, los registros, la solución de problemas, los informes de costes y las auditorías de seguridad.
Migración Ayuda a planificar y ejecutar las migraciones desde Redis autogestionado, Redis OSS u otro modelo de implementación. ElastiCache

Configuración y creación de redes

Esta habilidad ayuda a los agentes a identificar la configuración de despliegue adecuada para una carga de trabajo antes de generar instrucciones o comandos de configuración. Ayuda a los agentes a considerar la elección del motor, la implementación sin servidor o basada en nodos, la compatibilidad de las funciones y otros requisitos. Luego, la habilidad guía a los agentes a través de la configuración de la red, incluida la ubicación de las VPC, la configuración de subredes y grupos de seguridad y la conectividad de las aplicaciones.

Para el desarrollo local, la habilidad guía a los agentes a utilizar patrones de acceso compatibles, como un host de salto o un túnel del administrador de sesiones de AWS Systems Manager, en lugar de suponer que tienen acceso directo a un ElastiCache punto final desde una máquina local.

La habilidad almacena el contexto ElastiCache-specific del proyecto en un archivo estatal en.elasticache/requirements.json. Este archivo ayuda al agente a evitar pedir la misma información repetidamente. Puede incluir valores como el motor, la AWS región y los puntos finales de la memoria caché. Si este archivo existe, la habilidad lo lee antes de hacer nuevas preguntas.

Estimación de costos

Esta habilidad puede ayudar a los agentes a proporcionar una guía preliminar sobre los precios de ElastiCache las cargas de trabajo. La habilidad incluye una calculadora de precios para estimar los costos mensuales a partir de las entradas de la carga de trabajo, como el tamaño de los datos, el volumen de solicitudes, los tipos de comandos y el tamaño de la carga útil.

AWS no se requieren credenciales para generar estimaciones de precios. La calculadora de precios utiliza datos de AWS precios disponibles públicamente, por lo que puede estimar los costes sin servidor y basados en nodos antes de aprovisionar recursos o conectar una cuenta. AWS Las estimaciones de precios son solo para fines de planificación y pueden variar de los costos reales. Antes del despliegue, confirme los precios actuales en la página ElastiCache de precios.

Supervisión y solución de problemas

El flujo de trabajo de monitoreo ayuda a diagnosticar los problemas operativos al comenzar con las métricas relevantes y luego recomendar el cambio efectivo más pequeño. Esta habilidad puede usar scripts agrupados para recopilar métricas, generar paneles, ejecutar auditorías de seguridad y respaldar el análisis de costos.

Utilice esta ElastiCache habilidad para investigar problemas de rendimiento, disponibilidad y costos, como los siguientes:

  • Alta latencia

  • Bajas tasas de aciertos de caché

  • Presión de CPU o memoria

  • Retraso de replicación

  • Picos de conexión

  • Teclas de acceso rápido y teclas grandes

  • Desequilibrio entre fragmentos

  • Comandos lentos

  • Incrementos de costes inesperados

  • CloudWatch configuración de alarmas

  • Entrega de registro

Guía sobre cargas de trabajo vectoriales y GenAI

Esta habilidad ayuda a los agentes a proporcionar orientación sobre los patrones de aplicación de la IA, como el almacenamiento en caché semántico, la memoria de los agentes de IA, la generación con recuperación aumentada (RAG), los sistemas de recomendación y la búsqueda vectorial. Esta habilidad ayuda a los agentes a identificar la intención del usuario, seleccionar el flujo de trabajo adecuado y generar implementaciones que se ajusten a las capacidades. ElastiCache

Para estas cargas de trabajo, la habilidad proporciona una guía detallada sobre la integración del almacenamiento, el diseño clave, la estrategia TTL, el ajuste del umbral de similitud, las integraciones de marcos y las consideraciones operativas.