View a markdown version of this page

Come funziona l' ElastiCache abilità - Amazon ElastiCache

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Come funziona l' ElastiCache abilità

L' ElastiCache abilità indirizza la tua richiesta all'area del flusso di lavoro appropriata in base al tuo intento. Carica solo il materiale di riferimento necessario per l'attività corrente. La tabella seguente descrive le aree del flusso di lavoro incluse nella competenza.

Area del flusso di lavoro Scopo
Adattamento della soluzione Raccoglie i requisiti del carico di lavoro e consiglia se ElastiCache è la soluzione giusta per la tua applicazione.
Crea e connettiti Aiuta a creare cache, scegliere motori, configurare la rete, configurare l'autenticazione e connettere le applicazioni.
Modelli di applicazione Aiuta a scegliere schemi chiave, TTL, strategie di invalidazione e strutture di dati Redis o Valkey.
Carichi di lavoro vettoriali e AI Aiuta a implementare la memorizzazione nella cache semantica, la memoria degli agenti, il RAG, la raccomandazione, la personalizzazione e i modelli di ricerca vettoriale.
Operate e osservate Aiuta a configurare dashboard, allarmi, registri, risoluzione dei problemi, rendicontazione dei costi e controlli di sicurezza.
Migrazione Aiuta a pianificare ed eseguire le migrazioni da Redis, Redis OSS autogestiti o un altro modello di implementazione. ElastiCache

Configurazione e rete

Questa competenza aiuta gli agenti a identificare la configurazione di implementazione appropriata per un carico di lavoro prima di generare linee guida o comandi di configurazione. Guida gli agenti a prendere in considerazione la scelta del motore, l'implementazione senza server o basata su nodi, la compatibilità delle funzionalità e altri requisiti. L'abilità guida quindi gli agenti attraverso la configurazione della rete, incluso il posizionamento del VPC, la configurazione di sottoreti e gruppi di sicurezza e la connettività delle applicazioni.

Per lo sviluppo locale, la competenza guida gli agenti a utilizzare modelli di accesso supportati come un jump host o un tunnel AWS Systems Manager Session Manager, invece di presupporre l'accesso diretto a un ElastiCache endpoint da un computer locale.

La skill memorizza il contesto ElastiCache-specific del progetto in un file di stato in. .elasticache/requirements.json Questo file aiuta l'agente a evitare di richiedere ripetutamente le stesse informazioni. Può includere valori come motore, AWS regione e endpoint della cache. Se questo file esiste, l'abilità lo legge prima di porre nuove domande.

Stima dei costi

Questa competenza può aiutare gli agenti a fornire indicazioni preliminari sui prezzi per i ElastiCache carichi di lavoro. La competenza include un calcolatore dei prezzi per stimare i costi mensili in base agli input del carico di lavoro, come la dimensione dei dati, il volume delle richieste, i tipi di comandi e la dimensione del carico utile.

AWS non sono necessarie credenziali per generare stime dei prezzi. Il calcolatore dei prezzi utilizza dati AWS sui prezzi disponibili al pubblico, in modo da poter stimare i costi basati su server e nodi prima di fornire risorse o collegare un account. AWS Le stime dei prezzi sono solo a scopo di pianificazione e possono variare rispetto ai costi effettivi. Prima dell'implementazione, conferma i prezzi correnti nella pagina ElastiCache dei prezzi.

Monitoraggio e risoluzione dei problemi

Il flusso di lavoro di monitoraggio aiuta a diagnosticare i problemi operativi iniziando con le metriche pertinenti e quindi consigliando la minima modifica effettiva. L'abilità può utilizzare script raggruppati per raccogliere metriche, generare dashboard, eseguire controlli di sicurezza e supportare l'analisi dei costi.

Utilizza l' ElastiCache abilità per analizzare problemi di prestazioni, disponibilità e costi, come i seguenti:

  • Latenza elevata

  • Basse percentuali di accesso alla cache

  • Pressione della CPU o della memoria

  • Ritardo di replica

  • Picchi di connessione

  • Tasti di scelta rapida e tasti grandi

  • Forte squilibrio

  • Comandi lenti

  • Aumenti imprevisti dei costi

  • CloudWatch configurazione degli allarmi

  • Consegna dei log

Guida al carico di lavoro GenAI e vettoriale

Questa competenza aiuta gli agenti a fornire indicazioni per modelli applicativi di intelligenza artificiale come la memorizzazione nella cache semantica, la memoria degli agenti AI, la generazione aumentata di recupero (RAG), i sistemi di raccomandazione e la ricerca vettoriale. L'abilità aiuta gli agenti a identificare l'intento dell'utente, selezionare il flusso di lavoro appropriato e generare implementazioni in linea con le funzionalità. ElastiCache

Per questi carichi di lavoro, la competenza fornisce indicazioni dettagliate per l'integrazione di storage, progettazione delle chiavi, strategia TTL, ottimizzazione della soglia di somiglianza, integrazioni di framework e considerazioni operative.