Lecciones en español / Server+ / Hoja de repaso · English
Hoja de repaso de Server+ SK0-005
Dominio 1: Server hardware installation and management (18%)
Consejos para el examen
- Si una pregunta te pide dónde colocar el UPS o el dispositivo más pesado, la respuesta es la parte inferior del rack. Si pregunta cómo evitar que el aire caliente recircule por espacios vacíos del rack, la respuesta son los paneles ciegos.
- Los blades ganan en densidad y cableado, pero dependen de un gabinete compartido y de un solo proveedor. Si una pregunta enfatiza menos cables, energía y enfriamiento compartidos y administración centralizada, piensa en blade.
- Las PSU redundantes conectadas a la misma PDU o al mismo circuito no son realmente redundantes. Las respuestas del examen favorecen alimentaciones A y B en circuitos separados, y la autonomía del UPS la determina la carga, no solo el tamaño del UPS.
- La distancia decide la mayoría de las preguntas de cableado: DAC para unos pocos metros, multimodo para tramos dentro del centro de datos, monomodo para kilómetros. Cat6a es la respuesta en cobre para 10 Gbps a 100 metros.
- Más RPM significa más IOPS pero menos capacidad y más costo por GB. Las controladoras SAS aceptan discos SATA pero no al revés, y hot-swap no requiere preparación del sistema operativo, mientras que hot-plug puede requerirla.
- Memoriza las fórmulas: RAID 5 = N-1, RAID 6 = N-2, RAID 1 y 10 = N/2. Las penalizaciones de escritura son 2, 4 y 6 para espejo, RAID 5 y RAID 6. RAID nunca reemplaza a los respaldos.
- Compartir a nivel de archivos (SMB, NFS) significa NAS; a nivel de bloques (LUN sobre FC o iSCSI) significa SAN. iSCSI viaja sobre IP; FCoE viaja directamente sobre Ethernet sin IP. Los discos se venden en base 10 pero se reportan en base 2.
- Si el sistema operativo no funciona o el servidor está apagado y debes llegar a él de forma remota, la respuesta es la administración fuera de banda (BMC, iLO, iDRAC, IPMI). Asegurarla significa una red de administración separada y credenciales predeterminadas cambiadas.
- Secure Boot verifica las firmas del código de arranque; el TPM almacena claves y mide la integridad del arranque. En las actualizaciones, las respuestas del examen favorecen probar primero, seguir el orden y la matriz de compatibilidad del fabricante y tener un plan de reversión.
- ECC corrige errores; la memoria registrada almacena señales en búfer para lograr capacidad. No mezcles RDIMM y UDIMM. Los discos, las PSU y los ventiladores son las piezas habituales de intercambio en caliente; las CPU y la RAM normalmente requieren tiempo de inactividad.
Términos clave
- Rack unit (U) (unidad de rack)
- La medida vertical estándar para equipos de rack: 1.75 pulgadas (44.45 mm).
- Hot aisle/cold aisle (pasillo caliente/pasillo frío)
- Una disposición en la que los frentes de los racks dan a un pasillo compartido de aire frío y las partes traseras a un pasillo compartido de escape, manteniendo separados el aire de entrada y el de salida.
- Blanking panel (panel ciego)
- Una placa que cubre un espacio vacío del rack para que el aire caliente de escape no regrese a las tomas de aire de los equipos.
- Cable management arm (CMA) (brazo de gestión de cables)
- Un brazo articulado en la parte trasera de un servidor deslizante que lleva sus cables para que el servidor pueda extenderse sin desconectarlos.
- Tower server (servidor torre)
- Un servidor independiente en un gabinete vertical, adecuado para sitios pequeños sin rack.
- Rack mount server (servidor de montaje en rack)
- Un servidor diseñado para atornillarse en un rack de 19 pulgadas, dimensionado en unidades de rack (1U, 2U, 4U).
- Blade enclosure (gabinete blade)
- Un chasis montado en rack que suministra energía, enfriamiento, red y administración compartidos a los servidores blade insertados en él.
- Blade server (servidor blade)
- Un módulo de servidor delgado que contiene CPU y memoria y que depende de su gabinete para la energía, el enfriamiento y la conectividad.
- Redundant power supply (fuente de alimentación redundante)
- Una segunda PSU que puede soportar toda la carga si la primera falla, normalmente intercambiable en caliente.
- PDU (power distribution unit) (unidad de distribución de energía)
- Una regleta de tomacorrientes montada en rack; los modelos con medición reportan la carga y los modelos conmutados permiten controlar las tomas de forma remota.
- UPS (uninterruptible power supply) (sistema de alimentación ininterrumpida)
- Un dispositivo con respaldo de baterías que mantiene alimentados los equipos durante cortes breves y acondiciona la energía entrante.
- Automatic transfer switch (ATS) (interruptor de transferencia automática)
- Un dispositivo que traslada la carga de la red eléctrica a un generador cuando falla la energía de la red.
- Cat6a
- Cable de par trenzado Categoría 6 aumentada que admite Ethernet de 10 Gbps hasta 100 metros.
- Single-mode fiber (fibra monomodo)
- Fibra con un núcleo muy pequeño que transporta una sola trayectoria de luz a largas distancias, usada para enlaces entre edificios y de larga distancia.
- Multimode fiber (fibra multimodo)
- Fibra con un núcleo más grande que transporta múltiples trayectorias de luz a distancias más cortas, común dentro de los centros de datos.
- DAC (direct attach copper) (cobre de conexión directa)
- Un cable twinax con extremos tipo transceptor fijos, usado para enlaces cortos, de bajo costo y alta velocidad dentro de un rack o entre racks adyacentes.
- IOPS
- Operaciones de entrada/salida por segundo, una medida de cuántas lecturas y escrituras puede manejar el almacenamiento.
- SAS (Serial Attached SCSI)
- Una interfaz de discos empresarial con soporte de puerto dual y manejo robusto de errores; las controladoras SAS también pueden operar discos SATA.
- NVMe
- Un protocolo de almacenamiento que conecta discos flash directamente al bus PCIe para lograr una latencia muy baja y un alto rendimiento.
- Hot-swap (intercambio en caliente)
- Reemplazar un componente mientras el sistema funciona, sin necesidad de apagarlo ni de una acción especial del sistema operativo.
- Parity (paridad)
- Datos calculados almacenados en RAID 5 o 6 que permiten al arreglo reconstruir el contenido de un disco que falló.
- Write penalty (penalización de escritura)
- El número de operaciones de E/S físicas que requiere una escritura lógica: 1 para RAID 0, 2 para RAID 1 y 10, 4 para RAID 5, 6 para RAID 6.
- Hot spare (disco de repuesto en caliente)
- Un disco en espera que la controladora usa automáticamente para reconstruir un arreglo después de que falla un miembro.
- JBOD
- Just a bunch of disks: discos presentados de forma individual o concatenados, sin redundancia.
- NAS (almacenamiento conectado a la red)
- Network-attached storage: un dispositivo que comparte archivos a través de la red con protocolos como SMB y NFS.
- SAN (red de área de almacenamiento)
- Storage area network: una red dedicada que presenta almacenamiento a nivel de bloques (LUN) a los servidores.
- iSCSI
- Un protocolo que transporta comandos de bloques SCSI sobre TCP/IP, usando iniciadores en los servidores y destinos (targets) en el almacenamiento.
- LUN
- Logical unit number (número de unidad lógica): un volumen de almacenamiento en bloques que una SAN presenta a un servidor.
- BMC (baseboard management controller) (controlador de administración de la placa base)
- Un controlador independiente en la placa madre que proporciona monitoreo y control remoto incluso cuando el sistema operativo no funciona.
- IPMI
- Intelligent Platform Management Interface, un protocolo estándar para comunicarse con los BMC.
- IP KVM
- Un switch de teclado-video-mouse accesible a través de la red, que da acceso remoto a la consola, incluidas las pantallas del BIOS.
- Crash cart (carrito de emergencia)
- Un carrito móvil con monitor, teclado y mouse que se usa para conectarse localmente a un servidor.
- UEFI
- Unified Extensible Firmware Interface, el firmware moderno que reemplaza al BIOS, con soporte para GPT y Secure Boot.
- Secure Boot (arranque seguro)
- Una función de UEFI que solo permite ejecutar al inicio gestores de arranque y drivers de confianza con firma digital.
- TPM (Trusted Platform Module)
- Un chip de seguridad de hardware que almacena claves criptográficas y registra mediciones del proceso de arranque.
- Boot order (orden de arranque)
- La secuencia de dispositivos que el firmware intenta al buscar un sistema operativo para iniciar.
- ECC memory (memoria ECC)
- RAM que usa bits adicionales para detectar y corregir errores de un solo bit, evitando la corrupción silenciosa.
- Registered memory (RDIMM) (memoria registrada)
- Memoria con un registro que almacena en búfer las señales, lo que permite más módulos y mayor capacidad por servidor.
- Core (núcleo)
- Una unidad de procesamiento independiente dentro de una CPU; un socket puede contener muchos núcleos.
- Hot-swappable (intercambiable en caliente)
- Que puede reemplazarse mientras el sistema permanece encendido y funcionando.
Dominio 2: Server administration (30%)
Consejos para el examen
- Las instalaciones core o sin interfaz son la respuesta cuando una pregunta enfatiza una superficie de ataque más pequeña y menos actualizaciones. Conoce qué sistema de archivos corresponde a cada plataforma: NTFS/ReFS para Windows, ext4/XFS para Linux, VMFS para datastores de VMware.
- PXE depende de DHCP y TFTP, además del arranque por red en el orden de arranque. Generaliza siempre una imagen de Windows (Sysprep) antes de clonarla para que las máquinas no compartan identificadores.
- Los servidores obtienen direcciones estáticas o reservas, no concesiones dinámicas. La deriva del reloj rompe la autenticación Kerberos. El teaming LACP necesita configuración en el switch; el teaming simple de failover no.
- Cuando una pregunta te pide qué recurso importa más: las bases de datos y los hosts de virtualización quieren memoria y almacenamiento rápido, los servidores de archivos quieren capacidad y rendimiento de red, y DNS/DHCP quieren redundancia más que potencia.
- El quórum y los testigos existen para evitar el split brain. Round robin supone servidores y solicitudes iguales; least connections es adecuado para sesiones desiguales o largas. Los nodos activo-activo necesitan capacidad de sobra para absorber la carga de un compañero que falló.
- Tolerante a fallos significa cero interrupciones; alta disponibilidad significa una breve interrupción durante el failover. MPIO es la respuesta para rutas de almacenamiento redundantes, y NIC teaming para enlaces de red redundantes.
- El Tipo 1 se ejecuta en bare metal y se usa en centros de datos; el Tipo 2 se ejecuta sobre un sistema operativo host. Los snapshots son para revertir a corto plazo y afectan el rendimiento si se conservan; nunca sustituyen a los respaldos.
- Pregúntate quién aplica los parches al sistema operativo: tú lo haces en IaaS, el proveedor lo hace en PaaS y SaaS. El cliente siempre es responsable de los datos y del acceso de los usuarios, sin importar el modelo.
- Identifica el lenguaje por las pistas: variables con $ junto con -eq y cmdlets como Get-Item indican PowerShell; shebang y pruebas con [ ] indican Bash; %var% indica batch; sangría con == indica Python.
- Los cambios necesitan una solicitud documentada, aprobación, una ventana de mantenimiento y un plan de reversión. Una línea base es aquello con lo que comparas para saber si el comportamiento actual es anormal.
- Las CAL de usuario son para personas con muchos dispositivos; las CAL de dispositivo son para dispositivos compartidos por muchas personas. Más núcleos pueden significar costos más altos con licenciamiento por núcleo, aunque el hardware sea barato.
Términos clave
- HCL (hardware compatibility list) (lista de compatibilidad de hardware)
- La lista de un fabricante con el hardware probado y soportado con un sistema operativo o hipervisor determinado.
- Server Core
- Una opción de instalación de Windows Server sin la GUI de escritorio, administrada desde la línea de comandos o de forma remota.
- ReFS
- Resilient File System, un sistema de archivos de Windows enfocado en la integridad y en volúmenes grandes, usado a menudo para almacenamiento de virtualización y de respaldos.
- VMFS
- El sistema de archivos en clúster de VMware que permite que varios hosts ESXi compartan un datastore.
- PXE
- Preboot Execution Environment: arrancar una computadora a través de la red usando DHCP y TFTP para cargar un instalador o una imagen.
- Answer file (archivo de respuesta)
- Un archivo que proporciona automáticamente las respuestas del instalador, como unattend.xml o Kickstart.
- Sysprep
- Una herramienta de Windows que generaliza una instalación, eliminando los identificadores únicos antes de capturarla como imagen.
- P2V
- Conversión de físico a virtual de un servidor físico existente en una máquina virtual.
- DHCP reservation (reserva DHCP)
- Una configuración de DHCP que siempre asigna la misma dirección IP a la dirección MAC de un dispositivo específico.
- NIC teaming/bonding
- Combinar varios adaptadores de red en una sola interfaz lógica para redundancia y posiblemente más ancho de banda.
- 802.1Q
- El estándar para el etiquetado de VLAN, que marca las tramas Ethernet con un ID de VLAN para que un solo enlace pueda transportar varias VLAN.
- NTP
- Network Time Protocol, usado para mantener sincronizados los relojes del sistema; usa el puerto UDP 123.
- Server role (rol de servidor)
- La función principal que un servidor proporciona a los clientes, como servicios web, de base de datos o de archivos.
- Domain controller (controlador de dominio)
- Un servidor que ejecuta servicios de directorio, almacena cuentas y autentica usuarios y equipos en un dominio.
- Application server (servidor de aplicaciones)
- Un servidor que ejecuta la lógica de negocio, a menudo ubicado entre los front ends web y las bases de datos.
- Sizing (dimensionamiento)
- Elegir la capacidad de CPU, memoria, almacenamiento y red para cubrir las necesidades de una carga de trabajo más el crecimiento y un margen.
- Active-passive cluster (clúster activo-pasivo)
- Un clúster en el que un nodo atiende mientras otro espera para tomar el control en caso de falla.
- Heartbeat (latido)
- Una señal periódica que los nodos intercambian para confirmar que el otro sigue vivo.
- Quorum (quórum)
- La mayoría de votos que un clúster requiere para seguir funcionando, lo que evita el split brain.
- Least connections (menos conexiones)
- Un método de balanceo de carga que envía las nuevas solicitudes al servidor con menos conexiones activas.
- Single point of failure (SPOF) (punto único de falla)
- Cualquier componente cuya falla, por sí sola, detiene todo el sistema.
- MPIO (multipath I/O) (E/S de múltiples rutas)
- Software que usa varias rutas físicas hacia el mismo almacenamiento para failover y balanceo de carga, presentándolas como un solo disco.
- Fault tolerance (tolerancia a fallos)
- La capacidad de seguir operando sin interrupción cuando falla un componente.
- High availability (alta disponibilidad)
- Un diseño que minimiza el tiempo de inactividad, permitiendo una breve interrupción mientras ocurre el failover.
- Type 1 hypervisor (hipervisor Tipo 1)
- Un hipervisor bare metal instalado directamente en el hardware, usado en producción.
- Overcommitment (sobreasignación)
- Asignar a las VM más CPU virtual o memoria de la que el host tiene físicamente.
- Snapshot
- Una captura del estado de una VM en un momento determinado, usada para revertir a corto plazo, no como respaldo.
- Live migration (migración en vivo)
- Mover una VM en ejecución de un host a otro sin apagarla.
- IaaS
- Infrastructure as a Service: VM, almacenamiento y redes rentados en los que el cliente administra el sistema operativo y lo que está por encima.
- PaaS
- Platform as a Service: un entorno de ejecución administrado en el que el cliente implementa código sin administrar servidores.
- SaaS
- Software as a Service: una aplicación completa que ejecuta el proveedor y usa el cliente.
- Hybrid cloud (nube híbrida)
- Una combinación de recursos locales o privados y servicios de nube pública que funcionan en conjunto.
- Variable
- Una ubicación de almacenamiento con nombre para un valor que un script puede leer y cambiar.
- Loop (bucle)
- Una estructura que repite comandos, como for (por cada elemento) o while (hasta que cambie una condición).
- Comparator (comparador)
- Un operador que compara valores, como -eq o -gt en los shells y == o > en Python.
- cron
- El programador de Linux que ejecuta comandos a horas establecidas definidas en un crontab.
- CMDB
- Configuration management database (base de datos de gestión de la configuración): un registro de los activos de TI, su configuración y sus relaciones.
- Baseline (línea base)
- Una configuración estándar documentada o un nivel de rendimiento normal que se usa como punto de comparación.
- Change management (gestión de cambios)
- Un proceso controlado para solicitar, aprobar, programar, implementar y documentar cambios con planes de reversión.
- SLA
- Service level agreement (acuerdo de nivel de servicio): un compromiso formal sobre el desempeño del servicio, como el tiempo de actividad o el tiempo de respuesta.
- Per-core licensing (licenciamiento por núcleo)
- Un modelo que cobra por cada núcleo físico del procesador, a menudo con mínimos por procesador o por servidor.
- CAL (client access license) (licencia de acceso de cliente)
- Una licencia que permite a un usuario o dispositivo acceder al software del servidor.
- Subscription license (licencia por suscripción)
- Una licencia con tarifa recurrente que incluye actualizaciones y termina cuando se dejan de hacer los pagos.
- Site license (licencia de sitio)
- Una licencia que permite el uso ilimitado dentro de una ubicación u organización definida por una tarifa fija.
Dominio 3: Security and disaster recovery (24%)
Consejos para el examen
- En reposo significa almacenado (BitLocker, LUKS, discos con autocifrado); en tránsito significa en movimiento (TLS, SSH, IPsec). Una contraseña de configuración del firmware impide los cambios en el orden de arranque; una contraseña de GRUB impide la edición de las entradas de arranque.
- Los mantraps/vestíbulos impiden el tailgating. Los sistemas de preacción y de agente limpio son los preferidos donde deben protegerse los equipos electrónicos; los rociadores estándar de tubería húmeda implican riesgo de daños por agua.
- La MFA debe combinar tipos de factores distintos; una contraseña más un PIN sigue siendo de un solo factor. Concede permisos a grupos, no a personas, y dale a las cuentas de servicio sus propias identidades con mínimo privilegio.
- Relaciona el riesgo con el control: la fuga de datos sensibles apunta a DLP, los medios perdidos al cifrado, las vulnerabilidades conocidas a los parches, la propagación lateral a la segmentación y la recuperación del ransomware a los respaldos fuera de línea o inmutables.
- Las respuestas sobre hardening normalmente implican eliminar o desactivar algo: servicios, software, cuentas y puertos sin uso. Reemplaza los protocolos de administración en texto plano (Telnet, FTP, HTTP) por protocolos cifrados (SSH, SFTP, HTTPS).
- La desmagnetización solo funciona en medios magnéticos, nunca en SSD. Formatear no es sanitizar. Para los SSD usa secure erase, crypto-erase o destrucción física, y conserva siempre un certificado de destrucción.
- Incremental: el respaldo más rápido, la restauración más lenta (completo + todos los incrementales). Diferencial: respaldo más lento, restauración más rápida (completo + último diferencial). 3-2-1 significa tres copias, dos tipos de medios, una fuera del sitio.
- La única forma de saber que los respaldos funcionan es una restauración de prueba. Fuera del sitio protege contra desastres del sitio; en sitio acelera la recuperación cotidiana. La frecuencia sigue al RPO, y la velocidad de restauración debe cumplir con el RTO.
- El RPO trata de la pérdida de datos (qué tan atrás), el RTO trata del tiempo de inactividad (cuánto tiempo). El sitio caliente es el más rápido y costoso, el frío el más lento y barato. Síncrono significa cero pérdida de datos pero distancias cortas; asíncrono permite distancia con algo de pérdida.
- Un MTBF más alto es bueno (falla con menos frecuencia); un MTTR más bajo es bueno (se repara más rápido). El BIA va primero y produce las prioridades y los objetivos que implementan los planes de DR.
Términos clave
- Encryption at rest (cifrado en reposo)
- Cifrar los datos almacenados para que sean ilegibles sin la clave si el medio es robado o copiado.
- Encryption in transit (cifrado en tránsito)
- Cifrar los datos mientras viajan por las redes, por ejemplo con TLS o SSH.
- Data retention policy (política de retención de datos)
- Reglas que especifican cuánto tiempo se conservan los datos y cuándo deben destruirse.
- Data sovereignty (soberanía de los datos)
- El principio de que los datos están sujetos a las leyes del país donde se almacenan físicamente.
- Access control vestibule (mantrap) (vestíbulo de control de acceso)
- Un espacio de entrada con dos puertas en el que solo una puerta puede abrirse a la vez, lo que impide el tailgating.
- Tailgating
- Seguir a una persona autorizada a través de una puerta segura sin autenticarse.
- Biometrics (biometría)
- Autenticación basada en características físicas, como las huellas dactilares o los patrones del iris.
- Clean agent suppression (supresión con agente limpio)
- Supresión de incendios que usa gases que extinguen el fuego sin daños por agua ni residuos en los equipos.
- Least privilege (mínimo privilegio)
- Conceder solo los permisos mínimos necesarios para realizar una tarea.
- RBAC (role-based access control) (control de acceso basado en roles)
- Asignar permisos a roles y colocar a los usuarios en roles en lugar de conceder derechos de forma individual.
- MFA (autenticación multifactor)
- Multifactor authentication: exigir dos o más tipos distintos de factores de autenticación.
- Service account (cuenta de servicio)
- Una cuenta no humana que usa una aplicación o un servicio para ejecutarse y acceder a recursos.
- DLP (data loss prevention) (prevención de pérdida de datos)
- Herramientas y políticas que detectan e impiden que los datos sensibles salgan de las ubicaciones autorizadas.
- Ransomware
- Malware que cifra los datos y exige un pago, y que a menudo también roba datos para extorsionar.
- Insider threat (amenaza interna)
- El riesgo que representan las personas con acceso legítimo que lo usan mal, de forma malintencionada o descuidada.
- Network segmentation (segmentación de red)
- Dividir una red en zonas aisladas para limitar el acceso y la propagación de los ataques.
- Attack surface (superficie de ataque)
- Todos los puntos en los que un atacante podría interactuar con un sistema o entrar en él.
- Host-based firewall (firewall basado en host)
- Un firewall que se ejecuta en el propio servidor y filtra su tráfico entrante y saliente.
- EDR
- Endpoint detection and response (detección y respuesta de endpoints): software de seguridad que monitorea el comportamiento del host, detecta amenazas y apoya la respuesta.
- Security baseline (línea base de seguridad)
- Un conjunto documentado de configuraciones de refuerzo que los sistemas deben cumplir.
- Wiping (borrado seguro)
- Sobrescribir todos los sectores de un medio de almacenamiento para que los datos anteriores no puedan recuperarse, lo que permite reutilizarlo.
- Degaussing (desmagnetización)
- Borrar medios magnéticos con un campo magnético fuerte, lo que deja inutilizables los discos duros; no es eficaz en los SSD.
- Crypto-erase (borrado criptográfico)
- Sanitizar un disco con autocifrado destruyendo su clave de cifrado.
- Certificate of destruction (certificado de destrucción)
- Un documento que confirma qué medios se destruyeron, cómo, cuándo y por quién.
- Incremental backup (respaldo incremental)
- Copia los datos que cambiaron desde el último respaldo de cualquier tipo; las restauraciones necesitan el completo más cada incremental posterior.
- Differential backup (respaldo diferencial)
- Copia los datos que cambiaron desde el último respaldo completo; las restauraciones necesitan el completo más el diferencial más reciente.
- Synthetic full (completo sintético)
- Un respaldo completo que se arma en el servidor de respaldos a partir de un completo anterior y los incrementales posteriores.
- Grandfather-father-son (GFS) (abuelo-padre-hijo)
- Un esquema de rotación que conserva conjuntos de respaldo diarios, semanales y mensuales durante distintos períodos de retención.
- Retention period (período de retención)
- Cuánto tiempo se conserva una copia de respaldo antes de que venza y se elimine.
- Off-site backup (respaldo fuera del sitio)
- Una copia de respaldo almacenada en una ubicación diferente para sobrevivir a desastres que afectan a todo el sitio.
- Test restore (restauración de prueba)
- Restaurar datos desde un respaldo para verificar que el respaldo esté completo y sea utilizable.
- Application-aware backup (respaldo con reconocimiento de aplicaciones)
- Un respaldo que se coordina con una aplicación para que sus datos se capturen en un estado consistente.
- RPO
- Recovery point objective (objetivo de punto de recuperación): la cantidad máxima aceptable de pérdida de datos, medida en tiempo.
- RTO
- Recovery time objective (objetivo de tiempo de recuperación): el tiempo máximo aceptable para restaurar un servicio.
- Hot site (sitio caliente)
- Un sitio de recuperación totalmente equipado con datos actuales, listo para tomar el control rápidamente.
- Synchronous replication (replicación síncrona)
- Replicación que confirma una escritura solo después de que ambos sitios la tienen, lo que da una pérdida de datos casi nula a costa de la latencia.
- BIA (business impact analysis) (análisis de impacto en el negocio)
- Un análisis de los procesos de negocio, sus dependencias y el impacto de su interrupción a lo largo del tiempo.
- MTBF (tiempo medio entre fallas)
- Mean time between failures: el tiempo promedio de funcionamiento entre fallas de un elemento reparable.
- MTTR (tiempo medio de reparación)
- Mean time to repair: el tiempo promedio necesario para restaurar un elemento o servicio que falló.
- Communication plan (plan de comunicación)
- El proceso documentado y los contactos para compartir información durante un incidente.
Dominio 4: Troubleshooting (28%)
Consejos para el examen
- Conoce el orden y busca el paso que se omitió. Cuestiona lo obvio y pregunta qué cambió durante el paso 1; respalda antes de hacer cambios; verifica la funcionalidad completa antes de documentar.
- La falla de piezas redundantes no detiene el servidor, así que el examen a menudo pregunta por el siguiente paso: revisa las causas simples (cable, PDU, circuito) y luego intercambia la pieza en caliente. Muchos servidores sobrecalentándose a la vez sugieren una causa ambiental, no un solo ventilador.
- Con un arreglo degradado, respalda primero y reemplaza el disco correcto. Una caída repentina en la velocidad de escritura en RAID por hardware a menudo significa que la batería de la caché falló y la controladora pasó a write-through.
- Ejecuta fsck o chkdsk solo en volúmenes desmontados (o de solo lectura) y respalda primero. Extender una partición no es suficiente; también hay que hacer crecer el sistema de archivos.
- Una ralentización gradual que se corrige con un reinicio sugiere una fuga de memoria. Un servicio que falla justo después de un cambio de contraseña apunta a las credenciales de su cuenta de servicio. Un fallo después de instalar un driver nuevo significa revertir el driver.
- La distinción entre los logs Application, System y Security es común en el examen: las fallas de servicios y drivers van a System, los errores de programas a Application y los eventos de inicio de sesión a Security. journalctl -u filtra por servicio, -b por arranque.
- Llega a hosts locales pero a nada remoto: revisa la puerta de enlace. Funciona por IP pero no por nombre: revisa el DNS. Lento con errores en la interfaz: sospecha de una discrepancia de dúplex. El ping funciona pero un puerto falla: sospecha de una regla de firewall.
- ping prueba la accesibilidad, no los puertos; usa Test-NetConnection, telnet o nc para los puertos. nslookup/dig para el DNS, tracert/traceroute para la ruta, netstat/ss para lo que está escuchando, arp para la asociación IP-MAC.
- En los recursos compartidos, el acceso efectivo es el más restrictivo entre los permisos del recurso compartido y los NTFS, y la denegación explícita gana. Corrige los problemas de seguridad de forma específica (una regla o exclusión concreta) en lugar de desactivar el control.
- Compara con una línea base para ver qué cambió, y correlaciona los logs por hora. Cuidado con los cuellos de botella disfrazados: la paginación intensa por poca memoria a menudo parece un problema de disco.
Términos clave
- Theory of probable cause (teoría de la causa probable)
- La mejor explicación actual de un problema, formada después de reunir información y probada antes de actuar.
- Escalation (escalamiento)
- Pasar un problema a alguien con más experiencia o autoridad cuando no puedes resolverlo.
- Preventive measures (medidas preventivas)
- Acciones que se toman después de una solución para evitar que el mismo problema vuelva a ocurrir.
- Scope (alcance)
- Qué tan extendido está un problema, por ejemplo, un usuario, un servidor o todo un sitio.
- POST
- Power-on self-test (autoprueba de encendido): verificaciones del firmware que se ejecutan al arrancar y reportan fallas de hardware.
- Beep code (código de pitidos)
- Un patrón de pitidos al arrancar que indica un error de hardware; los significados varían según el fabricante.
- Predictive failure (falla predictiva)
- Una alerta de que un componente, como un disco, muestra señales de que probablemente fallará pronto.
- UID LED
- Una luz de identificación de unidad que se usa para localizar un servidor o componente específico en un rack.
- Degraded array (arreglo degradado)
- Un arreglo RAID que ha perdido un miembro pero sigue sirviendo datos sin redundancia.
- Write-back cache (caché write-back)
- Caché de la controladora que confirma las escrituras antes de que lleguen al disco; requiere protección por batería o flash.
- Write-through
- Modo de caché que confirma las escrituras solo después de que llegan al disco; más seguro pero más lento.
- fstab
- El archivo de Linux que enumera qué sistemas de archivos montar al arrancar y dónde.
- chkdsk
- Herramienta de Windows que verifica y repara errores del sistema de archivos; /f corrige los errores y /r además busca sectores defectuosos.
- fsck
- Verificador de consistencia de sistemas de archivos de Linux, que se ejecuta en sistemas de archivos desmontados.
- smartctl
- Una herramienta de línea de comandos que lee los datos de salud SMART de los discos.
- parted
- Una herramienta de particionado de Linux que admite discos GPT y el redimensionamiento.
- Memory leak (fuga de memoria)
- Un defecto en el que un programa sigue asignando memoria sin liberarla, agotando gradualmente la RAM.
- Runaway process (proceso descontrolado)
- Un proceso que consume CPU o recursos en exceso, a menudo atascado en un bucle.
- Boot loop (bucle de arranque)
- Una condición en la que un sistema se reinicia repetidamente sin completar el inicio.
- Service dependency (dependencia de servicio)
- Otro servicio que debe estar en ejecución antes de que un servicio determinado pueda iniciar.
- Event Viewer (Visor de eventos)
- La herramienta de Windows para leer los logs Application, System, Security y otros registros de eventos.
- journalctl
- El comando para consultar el diario de systemd en Linux, filtrable por unidad, arranque, prioridad y hora.
- Performance Monitor (Monitor de rendimiento)
- La herramienta de Windows que muestra y registra contadores de rendimiento a lo largo del tiempo.
- Safe mode (modo seguro)
- Un modo de inicio de Windows que carga solo los drivers y servicios esenciales para la resolución de problemas.
- APIPA
- Automatic Private IP Addressing: una dirección 169.254.x.x que un host Windows se asigna a sí mismo cuando falla DHCP.
- Default gateway (puerta de enlace predeterminada)
- La dirección del router que usa un host para llegar a las redes fuera de su propia subred.
- Duplex mismatch (discrepancia de dúplex)
- Un enlace en el que un lado funciona en dúplex completo y el otro en semidúplex, lo que causa errores y mal rendimiento.
- Hosts file (archivo hosts)
- Un archivo local que asocia nombres con direcciones IP y que se consulta antes que el DNS en la mayoría de los sistemas.
- traceroute/tracert
- Una herramienta que enumera cada salto de router hacia un destino y el retardo hasta cada uno.
- nslookup/dig
- Herramientas que consultan directamente a los servidores DNS para comprobar la resolución de nombres.
- ss/netstat
- Herramientas que enumeran las conexiones de red y los puertos en escucha, opcionalmente con el proceso propietario.
- Test-NetConnection
- Un cmdlet de PowerShell que prueba la conectividad, incluido si un puerto TCP es accesible.
- Effective permissions (permisos efectivos)
- El acceso real que tiene un usuario después de combinar todos los permisos de grupo, las entradas de denegación y los permisos del recurso compartido y NTFS.
- Certificate chain (cadena de certificados)
- El certificado del servidor más los certificados intermedios que lo vinculan con una raíz de confianza.
- False positive (falso positivo)
- Una herramienta de seguridad que marca como maliciosos actividades o archivos legítimos.
- Indicator of compromise (indicador de compromiso)
- Evidencia, como inicios de sesión inusuales o servicios desconocidos, que sugiere que un sistema o una cuenta han sido vulnerados.
- Root cause (causa raíz)
- La razón subyacente por la que ocurrió un problema y que, al corregirse, evita que se repita.
- Performance counter (contador de rendimiento)
- Un valor medido, como la longitud de la cola de disco o la memoria disponible, que registran el sistema operativo o las herramientas de monitoreo.
- Bottleneck (cuello de botella)
- El recurso que limita el rendimiento general porque está saturado.
- SIEM
- Security information and event management (gestión de información y eventos de seguridad): un sistema que recopila y correlaciona logs de muchas fuentes.
Estudia Server+ gratis
Plan semana a semana con lecciones, cuestionarios, simulaciones de examen y práctica, en español.
Abrir el plan de estudioPlan semana a semana con lecciones, cuestionarios, simulaciones de examen y práctica, en español.