Estoy ejecutando un AWS EC2 m5.large (una instancia no ampliable). Configuré una de las métricas predeterminadas de AWS CloudWatch (% de CPU) + algunas métricas personalizadas (memoria + uso de disco) en mi tablero.
Pero cuando comparo los números que me informa CloudWatch, están bastante lejos del uso real del servidor Ubuntu 20.04 cuando inicio sesión en él...
Uso actual:
CPU: ~ 35 % Memory: ~ 33 %Informe de CloudWatch:
CPU ~ 10 % Memory: ~ 50-55https://www.screencast.com/t/o1nAnOFjVZW
He seguido las propias instrucciones de AWS para agregar las métricas para el uso de la memoria y el disco (porque CloudWatch no tiene acceso inmediato a las cosas del nivel del sistema operativo): https://docs.aws.amazon.com/AWSEC2/latest /UserGuide/mon-scripts.html
Cuando los números están tan lejos unos de otros, sería imposible configurar alarmas y notificaciones útiles. No puedo creer que eso sea lo que AWS quiere proporcionar a las personas que optaron por seguir sus instrucciones originales. Lo único que coincide exactamente es el porcentaje de uso del disco.
1. sudo wget https://s3.amazonaws.com/amazoncloudwatch-agent/debian/amd64/latest/amazon-cloudwatch-agent.deb 2. sudo dpkg -i -E ./amazon-cloudwatch-agent.deb 3. sudo /opt/aws/amazon-cloudwatch-agent/bin/amazon-cloudwatch-agent-config-wizard 4. Go through all the steps in the wizard (The result is saved here: /opt/aws/amazon-cloudwatch-agent/bin/config.json)Pista: respondí:
- Default to most questions and otherwise: - NO --> Do you want to store the config in the SSM parameter store? (Because when I answered YES it failed later on because of some permission-issue and I didn't know how to make it happy and I don't think I need SSM in regards to this) - YES --> Do you want to turn on StatsD daemon? - YES --> Do you want to monitor metrics from CollectD? - NO --> Do you have any existing CloudWatch Log Agent?Ahora, para evitar este error: Error al analizar /opt/aws/amazon-cloudwatch-agent/etc/amazon-cloudwatch-agent.toml, abra /usr/share/collectd/types.db: no existe tal archivo o directorio https:// github.com/awsdocs/amazon-cloudwatch-user-guide/issues/1
5. sudo mkdir -p /usr/share/collectd/ 6. sudo touch /usr/share/collectd/types.db 7. sudo /opt/aws/amazon-cloudwatch-agent/bin/amazon-cloudwatch-agent-ctl -a fetch-config -m ec2 -c file:/opt/aws/amazon-cloudwatch-agent/bin/config.json -s 8. /opt/aws/amazon-cloudwatch-agent/bin/amazon-cloudwatch-agent-ctl -m ec2 -a status { "status": "running", "starttime": "2020-06-07T10:04:41+00:00", "version": "1.245315.0" }Me di cuenta de que, en el momento en que entro en la máquina, el porcentaje de uso de la CPU aumenta del 10 % al 30 % y permanece allí (por supuesto, se esperaba algún aumento, pero no tanto en mi opinión), lo que en mi caso explica el gran diferencia antes... Sinceramente, no sé si de esta manera es más precisa que la secuencia de comandos anterior, pero esta debería ser la forma correcta de hacerlo en el año 2020 :-) Y obtienes acceso a 179 métricas personalizadas al seleccionar " Avanzado" durante el asistente (aunque solo unos pocos serían valiosos para la mayoría de las personas)