View a markdown version of this page

Como a ElastiCache habilidade funciona - Amazon ElastiCache

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Como a ElastiCache habilidade funciona

A ElastiCache habilidade direciona sua solicitação para a área de fluxo de trabalho apropriada com base em sua intenção. Ele carrega somente o material de referência necessário para a tarefa atual. A tabela a seguir descreve as áreas de fluxo de trabalho incluídas na habilidade.

Área de fluxo de trabalho Finalidade
Solução adequada Reúne os requisitos de carga de trabalho e recomenda se ElastiCache é a opção certa para sua aplicação.
Crie e conecte-se Ajuda a criar caches, escolher mecanismos, configurar redes, configurar autenticação e conectar aplicativos.
Padrões de aplicação Ajuda a escolher os principais esquemas, TTLs, estratégias de invalidação e estruturas de dados Redis ou Valkey.
Cargas de trabalho vetoriais e de IA Ajuda a implementar cache semântico, memória do agente, RAG, recomendação, personalização e padrões de pesquisa vetorial.
Opere e observe Ajuda a configurar painéis, alarmes, registros, solução de problemas, relatórios de custos e auditorias de segurança.
Migração Ajuda a planejar e executar migrações do Redis autogerenciado, do Redis OSS ou de outro modelo de implantação. ElastiCache

Configuração e rede

A habilidade ajuda os agentes a identificar a configuração de implantação apropriada para uma carga de trabalho antes de gerar orientações ou comandos de configuração. Ele orienta os agentes a considerar a escolha do mecanismo, a implantação sem servidor ou baseada em nós, a compatibilidade de recursos e outros requisitos. Em seguida, a habilidade orienta os agentes na configuração da rede, incluindo posicionamento da VPC, configuração de sub-rede e grupos de segurança e conectividade de aplicativos.

Para o desenvolvimento local, a habilidade orienta os agentes a usar padrões de acesso compatíveis, como um host de salto ou um túnel do AWS Systems Manager Session Manager, em vez de assumir o acesso direto a um ElastiCache endpoint a partir de uma máquina local.

A habilidade armazena o contexto ElastiCache-specific do projeto em um arquivo de estado em.elasticache/requirements.json. Esse arquivo ajuda o agente a evitar a solicitação repetida das mesmas informações. Ele pode incluir valores como motor, AWS região e endpoints de cache. Se esse arquivo existir, a habilidade o lê antes de fazer novas perguntas.

Estimativa de custos

A habilidade pode ajudar os agentes a fornecer orientações preliminares de preços para ElastiCache cargas de trabalho. A habilidade inclui uma calculadora de preços para estimar os custos mensais a partir das entradas da carga de trabalho, como tamanho dos dados, volume de solicitações, tipos de comando e tamanho da carga útil.

AWS não são necessárias credenciais para gerar estimativas de preços. A calculadora de preços usa dados de AWS preços disponíveis publicamente, para que você possa estimar os custos sem servidor e baseados em nós antes de provisionar recursos ou conectar uma conta. AWS As estimativas de preços são apenas para fins de planejamento e podem variar dos custos reais. Antes da implantação, confirme os preços atuais na página ElastiCache de preços.

Monitoramento e solução de problemas

O fluxo de trabalho de monitoramento ajuda a diagnosticar problemas operacionais começando com métricas relevantes e, em seguida, recomendando a menor mudança efetiva. A habilidade pode usar scripts agrupados para coletar métricas, gerar painéis, executar auditorias de segurança e apoiar a análise de custos.

Use a ElastiCache habilidade para investigar problemas de desempenho, disponibilidade e custo, como os seguintes:

  • Alta latência

  • Baixas taxas de acerto do cache

  • Pressão da CPU ou da memória

  • Lag de replicação

  • Picos de conexão

  • Teclas de atalho e teclas grandes

  • Desequilíbrio de fragmentos

  • Comandos lentos

  • Aumentos inesperados de custos

  • CloudWatch configuração de alarme

  • Entrega de logs

GenAI e orientação de carga de trabalho vetorial

A habilidade ajuda os agentes a fornecer orientação sobre padrões de aplicativos de IA, como cache semântico, memória do agente de IA, geração aumentada de recuperação (RAG), sistemas de recomendação e pesquisa vetorial. A habilidade ajuda os agentes a identificar a intenção do usuário, selecionar o fluxo de trabalho apropriado e gerar implementações alinhadas aos recursos. ElastiCache

Para essas cargas de trabalho, a habilidade fornece orientação detalhada para incorporação de armazenamento, design de chaves, estratégia TTL, ajuste de limites de similaridade, integrações de estruturas e considerações operacionais.