Soy Damien Dye.
Ingeniero de preventa para Europa y APAC en croit GmbH, miembro fundador de la Ceph Foundation y Proxmox Gold Partner oficial.
Veintitantos años de eso han sido la parte pagada: plataformas Microsoft, Linux, aplicaciones empresariales, virtualización, redes, almacenamiento y seguridad. La parte pagada no es el todo. Construyo cosas y las rompo desde mediados de los noventa, y llevo Linux en serio desde 1999, años antes de que a nadie le pareciera digno de pagarme por ello, y cuento esos años porque se aprende tanto de un equipo que es tuyo como de uno que ha asegurado otro.
South Yorkshire, así que lo tendrás sin rodeos. Si algo funciona, te diré por qué. Si no funciona, te lo diré también, y antes de que te hayas gastado el dinero mejor que después.
Los primeros años
Desmonto ordenadores desde los ocho años. Mi primera máquina fue un Atari STfm con 512K de memoria.
Mi primer PC llegó a los doce, con Windows 3.11, y de ahí pasé por toda la serie: 95, 95b, 95c, 98, 98SE y luego Windows 2000.
Aquello no era usar software. Era averiguar qué cambiaba de una versión a la siguiente, qué se rompía por el camino, y cómo poner en marcha algo que había decidido que prefería no hacerlo.
Mi primera conexión a internet fue un módem de 56k en Freeserve — uno de los primeros proveedores gratuitos del Reino Unido. Pasé a ADSL en cuanto estuvo disponible en 2001, con Demon Internet. Luego a VDSL en 2008, y por fin a fibra con Zen Internet en 2017 — ahí llegó el IPv6 nativo. Ahí empezó todo en lo que a redes se refiere, y hay un buen trecho hasta las mallas de 100GbE que diseño ahora. Pero la curiosidad era la misma.
La red local empezó aún antes, y más a lo bruto. Mi primera LAN fue 10BASE2 — cable coaxial fino, conectores BNC y un terminador de 50 ohmios en cada extremo, con todas las máquinas compartiendo un mismo bus de 10 Mbit. Conseguí que dos PC hablaran por ahí, y añadí un concentrador de 5 puertos cuando aparecieron más máquinas. Aquel concentrador acabó siendo un conmutador — un salto de verdad, porque cada puerto tenía su propio dominio de colisión en lugar de pelearse todo por un coaxial compartido. Después llegó el inalámbrico, en cuanto fue asequible: 802.11b a 11 Mbit, en tarjetas PCMCIA Orinoco Gold en los portátiles. Bus coaxial, concentrador compartido, Ethernet conmutado, wifi — recorrí cada paso a mano.
También construí instalaciones de Windows XP totalmente desatendidas. Usaban los viejos DriverPacks para inyectar controladores y scripts propios para instalar aplicaciones automáticamente. Se pasaba de la máquina desnuda a un sistema plenamente configurado sin tocar el teclado. Aquello era pensar en automatización años antes de oír hablar de Ansible — y era sobre Windows, no sobre Linux.
Encontrar Linux
Empecé con Linux a los quince, en SuSE 6. Fui directo a las distribuciones que te obligan a entender qué pasa por debajo.
En las vacaciones de Navidad de 2001 construí un sistema completo con el libro Linux From Scratch. Cada paquete compilado a mano. Cada dependencia entendida. Cada decisión de configuración tomada a propósito.
Para 2002 había pasado a Gentoo. Gentoo funciona con el mismo principio: construyes todo el sistema desde el código fuente, entiendes qué hace cada bandera USE, y cuando algo se rompe sabes exactamente dónde mirar.
Explorar otras plataformas
Nunca me quedé con una sola arquitectura.
Tuve un sistema DEC Alpha de 2001 a 2007. El Alpha era el procesador RISC de 64 bits de Digital Equipment Corporation, lanzado en 1992 — una máquina de 64 bits de verdad más de una década antes de que el x86 lo alcanzara con AMD64 en 2003. Corría Tru64 UNIX, OpenVMS, Windows NT y Linux, y durante un tiempo fue más o menos lo más rápido que podías poner en un escritorio. A través de las discusiones de la comunidad conseguí que funcionaran el USB y el FireWire. Hasta le monté un adaptador de PCMCIA a ISA por detrás, para que las mismas tarjetas PC que usaba en los portátiles — la Orinoco Gold entre ellas — funcionaran en el Alpha de sobremesa. No es poca cosa en una plataforma donde nada estaba garantizado.
Le eché un vistazo a BeOS. Abordaba el multihilo y el multimedia de una forma completamente distinta a todo lo demás de entonces.
En la universidad, un colega y yo rescatamos estaciones Sun SPARC que iban a la basura y construimos Gentoo en ellas. SPARC era la arquitectura RISC de Sun Microsystems, presentada en 1987 — el motor de las estaciones y servidores Sun que sostuvieron buena parte del mundo Unix en los noventa, normalmente bajo Solaris. Poner un Linux compilado desde el código a funcionar en ese hardware era el objetivo entero. Porque por qué no, si el equipo está ahí y quieres ver si funciona.
También he construido y trabajado con Linux en ARM y ARM64, en Raspberry Pi y Odroid. Y he usado Windows en ARM64.
Usa el mismo sistema operativo en x86, Alpha, SPARC, ARM y ARM64 y las suposiciones que hiciste en uno no te siguen al siguiente — orden de bytes, alineación, tamaño de página, soporte de controladores y rarezas de la cadena de compilación se mueven todos bajo tus pies. Eso importa más que nunca ahora que ARM64 está en el centro de datos junto al x86, y es el razonamiento que mantiene honesto un parque Ceph o Proxmox de arquitecturas mezcladas.
También experimenté con IPv6 muy pronto.
Tenía acceso a 6bone — la red de pruebas experimental de IPv6.
6bone fue un banco de pruebas mundial que arrancó en 1996 para desarrollar y desplegar IPv6 antes de que internet en producción estuviera preparado.
Llevaba IPv6 sobre todo por túneles IPv4, usaba su propio rango 3ffe::/16, y se apagó a propósito el 6 de junio de 2006, una vez que el IPv6 nativo maduró lo bastante para sostenerse solo.
Usaba tanto la pila IPv6 de Linux como la de Microsoft Research para Windows XP.
He pasado por todo.
Empecé con túneles de IPv6 dentro de IPv4.
Pasé a 6to4 (RFC 3056) para el tunelado automático.
Y después al IPv6 nativo completo cuando me fui a un proveedor decente — Zen Internet.
La mayoría de la gente no tocó IPv6 hasta que su empresa les obligó.
Para entonces yo ya había pasado por todos los mecanismos de transición, en Linux y en Windows, porque quería entender hacia dónde iban las redes.
Por eso IPv6 me resulta natural ahora en lugar de algo añadido después.
Hoy, el noventa por ciento de mi tráfico va por IPv6 nativo.
Uso una extensión de navegador llamada IPvFoo que me enseña qué usa cada conexión y si los sitios sirven protocolos mezclados o solo IPv4.
Vieja costumbre — prefiero ver qué pasa de verdad, no suponerlo.
Aprender haciendo
Todo lo que sé técnicamente lo aprendí poniéndome a ello. Construí cosas, las rompí, averigüé por qué se rompían, las volví a construir.
La carrera fue Business Studies y Computer Network Engineering en Sheffield Hallam, y me dio lo único que no da aprender por tu cuenta — cómo funciona de verdad una empresa, cómo una decisión técnica se convierte en un resultado comercial, y cómo pensar un sistema en función del problema que resuelve para quien lo paga. Eso ha marcado todos los puestos desde entonces.
Las habilidades técnicas vinieron de hacer, eso sí, no de estudiar. Los problemas de producción no llegan con una bibliografía. Saber resolver algo desde los principios vale más que un certificado en la pared, y no caduca.
De dónde viene el código abierto
Cuando la dirección de Microsoft describió el código abierto como «un cáncer» a principios de los 2000, yo ya estaba metido de lleno en Linux. Construyendo sistemas desde cero. Usando Gentoo. Contribuyendo en comunidades.
Esa clase de hostilidad hacia gente que comparte conocimiento y construye junta no me echó para atrás. Me empujó más adentro. Si la respuesta de una empresa al desarrollo colaborativo es llamarlo enfermedad, eso dice más de la empresa que del software. Me metí más a fondo en el código abierto y lo convertí en mi primera opción, en lugar de respaldar esa mentalidad.
Con los años, el argumento práctico alcanzó al de principios. Las plataformas propietarias funcionan bastante bien hasta que el fabricante cambia las licencias, lo compran, o decide que tu caso de uso no merece la pena. Entonces te quedas atrapado. Tus datos, tus procesos y el conocimiento de tu equipo están todos atados a una plataforma que ya no controlas. La compra de VMware por Broadcom es el ejemplo más reciente y visible, pero ni de lejos el único.
El mismo razonamiento vale para la nube. Pregunta qué estás alquilando de verdad y la respuesta es capacidad que podrías haber tenido en propiedad, con un contador que no para nunca. Los beneficios prometidos — agilidad, elasticidad, menos que gestionar — rara vez llegan con la forma que describía la presentación, y el coste se acumula año tras año como no lo hace el equipo propio. Como tal, he podido demostrar, cada vez que alguien me lo ha pedido, que el código abierto sobre hardware bien diseñado da mejor relación, más control y menos sorpresas. No es una postura de moda. Pero es una que puedo respaldar con cifras.
Construir una carrera
Mi carrera empezó en 2005 en una fundición de precisión en Worksop. Técnico informático, en un equipo pequeño, dando servicio a unos cincuenta usuarios.
Aquel primer puesto abarcaba una amplitud considerable. Mantenimiento del ERP Manusoft y del archivo documental. Administración de servidores Linux y Windows 2003. Desarrollo en Crystal Reports para las decisiones de producción y mantenimiento. Administración de la centralita. Integración de sistemas CAD/CAM y gestión de la fabricación robotizada asistida por ordenador. Compra de hardware y software. Formación de usuarios y soporte en su propio puesto.
También escribía automatización desde el primer día. Actualicé el Active Directory de la empresa y escribí scripts VB que conectaban unidades, asignaban impresoras y desplegaban software automáticamente según la pertenencia a grupos. Eso fue en 2006 — automatización de infraestructura de verdad en mi primer puesto profesional.
Eso es informática industrial. Cuando la línea se para por algo de lo que tú te ocupas, descubres deprisa que la fiabilidad no es una preferencia, y la gente que está junto a la máquina te lo dirá ella misma. Fue también la primera vez que llevé Linux y Windows en el mismo edificio para ganarme la vida, y ese ha sido el patrón desde entonces.
De ahí pasé al soporte técnico de primera línea. Primer y segundo nivel, en un puesto dedicado a un gran cliente multinacional. Escritorios Windows, Active Directory, Exchange 2007, VPN de Cisco, Cisco Call Manager, gestión de tickets con ITIL en Remedy. Esa disciplina ITIL — gestión del cambio, gestión de problemas, procesos estructurados — me ha seguido a todos los puestos desde entonces. También tendí pronto un puente entre los mundos Linux y Windows — configurando Services for Unix y resolviendo el acceso de Citrix a recursos NFS de Unix.
Incluso en ese puesto construía más allá de la descripción del trabajo. Escribí una interfaz que daba de alta y de baja cuentas de usuario directamente desde los datos de RR. HH. en Agresso, gestionando la cuenta de Active Directory, las pertenencias a grupos, la configuración de Office Communicator, el buzón de Exchange y los alias. Eso es integración de sistemas desde un asiento de primer nivel, que no era lo que decía el cargo.
Uno de los clientes a los que atendía en ese puesto me contrató después en la empresa siguiente.
Luego una empresa global de comunicaciones, TIC y seguridad. Ahí empezó de verdad el desarrollo de aplicaciones. En dos años y medio construí seis sistemas internos distintos o contribuí a ellos. Una herramienta web propia de presupuestos. Interfaces de procesamiento de pedidos entre Salesforce y Agresso. Un catálogo de datos maestros en SharePoint alimentado desde Salesforce y Agresso. Un sistema web propio de gestión de proyectos con interfaces hacia MSPE y Agresso para el tratamiento financiero. Y una migración de una aplicación personalizada de Salesforce Service Cloud a ServiceNow con implantación completa de procesos ITIL. También escribía la arquitectura de interfaces SQL para las aplicaciones corporativas y afinaba el rendimiento de MS SQL. Administraba IIS y los Terminal Services de Windows Server 2008, y era responsable del modelo de datos corporativo. Los servicios de directorio — Active Directory y LDAP — se convirtieron aquí en una habilidad central que me siguió en todos los puestos posteriores.
También dirigí un programa nacional de sustitución con Windows 7, pasando a toda la base de usuarios británica a equipos HP nuevos en tres semanas, con un 95 % declarando que no había sufrido ninguna interrupción de su trabajo. Tres semanas es la clase de cifra que solo sale si la preparación se hizo bien, y la preparación es la mitad sin glamur por la que nadie pregunta después.
Luego llegó la gestión. Una casa de diseño de semiconductores con un equipo pequeño de ingenieros repartido por varios países. Aquello juntó varios hilos a la vez. Desarrollaba en la plataforma Force.com — disparadores, páginas Visualforce, controladores propios — para integrar globalmente la contabilidad de Financial Force y los sistemas PSA. A la vez construía dos clústeres HPC separados con arranque PXE. Uno para la ingeniería europea en el Reino Unido y otro para la ingeniería china. Ambos con Red Hat y sistemas de ficheros raíz por NFS, para granjas de cálculo sin disco, consistentes y repetibles al 100 %. Desplegué ZFS sobre Linux con equipos Dell PowerVault para almacenamiento unificado. Sustituí entornos de seguridad antiguos y aislados por un Active Directory de Windows Server con Kerberos y LDAP nativos para inicio de sesión único entre Linux y Windows. Estabilicé la conectividad internacional construyendo una red unificada con túneles OpenVPN a través de condiciones de operación difíciles hacia China.
Durante buena parte de ese puesto fui el único que cubría todo aquello: las granjas de cálculo Linux, el soporte de Windows, el desarrollo en Salesforce y la atención a usuarios en varias zonas horarias, bajo cargas de diseño de SoC en nodos tecnológicos avanzados. Uno de los ingenieros que me reportaban acabó siendo desarrollador de Salesforce, y cuento eso como el mejor resultado de aquellos años.
Después, una inmersión de verdad en Linux. Soporte de tercer nivel en Pulsant, un proveedor de nube y alojamiento, a lo largo de toda la pila. RHEL, CentOS, Ubuntu. Clústeres MySQL con Galera, fragmentación de MongoDB, HAProxy con SNI y terminación SSL, Apache, PostgreSQL, ajuste de PHP-FPM para comercio electrónico exigente, correo Postfix, BIND y PowerDNS para alojamiento DNS, Varnish para caché web, Squid para caché de proxy. IPTables, IPset y Cisco ASA para cortafuegos y protección contra DoS. Optimización de servidores Linux para red y almacenamiento. Resolución de problemas de CPanel, desarrollo de plantillas de monitorización en SolarWinds y administración de New Relic. Todo sobre VMware 5.5 con vCloud Director por debajo.
Y no era solo soporte. Allí diseñé un producto de replicación de bases de datos Galera y lo llevé del concepto al prototipo y luego a un servicio por el que los clientes pagaban. Aquello no fue un ejercicio de laboratorio. Se construyó y se probó contra cargas reales de clientes reales que pagaban, y eso un proveedor de alojamiento no lo suelta a la ligera.
El tercer nivel te enseña lo que significa ser la última línea de escalado. Cuando llega a ti, nadie por detrás va a arreglarlo.
Luego Nominet — el registro detrás de cada nombre de dominio .uk. DNS a escala nacional. La infraestructura tiene que estar firme veinticuatro horas al día, todos los días, sin caídas y con guardia fuera de horario. VMware 5.5 y 6, almacenamiento HP 3par con zonificación de fibra en Brocade, RHEL 6 y 7 gestionados con Puppet, balanceadores F5 en IPv4 e IPv6, correo Postfix, y un despliegue de Zabbix que construí para sustituir la envejecida monitorización de VMware Hyperic. También adopté y personalicé ServiceNow, implantando flujos de trabajo, despliegue de aplicaciones y descubrimiento de nodos Linux para la gestión de configuración y el inventario. Ayudé a diseñar y construir los procesos para externalizar el servicio de atención fuera de horario, y aligerar así la guardia.
En Nominet acabé siendo la primera persona a la que se preguntaba, fuera de Linux, de Unix, de ServiceNow o de algo que nadie sabía encajar, y me empeñaba en volver con algo que funcionara en lugar de algo que sonara bien. Ese es el tipo de sitio donde aprendes que el enfoque aburrido y disciplinado de la infraestructura es el que sobrevive al contacto con un martes por la mañana.
Después de Nominet pasé por infraestructura y alojamiento. VMware 6.7, Zerto para recuperación ante desastres, almacenamiento Dell Compellent y Nexsan con zonificación de fibra Brocade, Citrix Cloud con gestión de perfiles FSLogix junto a Azure. Allí también introduje la monitorización con Zabbix, diseñando las plantillas y los scripts desde cero.
Luego el comercio minorista. Dirigiendo un equipo pequeño, recuperando internamente la administración de VMware 6.7 que llevaba un tercero, desplegando Zabbix (otra vez, sustituyendo un intento fallido), rehaciendo el despliegue de sistemas en torno a PXE y Chocolatey, renovando la red con equipos Fortinet, y poniendo en orden las compras de hardware.
Luego el puesto que lo cambió todo. En el UK Centre for Ecology & Hydrology dirigí el equipo de computación científica — cuatro personas a mi cargo — y reconstruí la infraestructura desde los cimientos. Una nube privada de 7 nodos Proxmox VE con almacenamiento Ceph hiperconvergido sobre conmutación doble de 100Gb. Un clúster HPC de 8 nodos sobre InfiniBand HDR con Slurm, con SR-IOV para el acceso de las VM a la malla y EasyBuild para compilar software. Migración de GPFS a almacenamiento Ceph todo NVMe. Ansible con Netbox como fuente de verdad para todo — gestión de parches, control de la deriva de configuración, integraciones con Cloudflare, PowerDNS y Active Directory. Enrutamiento dinámico OSPF para las redes de la nube. Espejos de repositorios locales para la máxima velocidad y consistencia de despliegue. Redespliegue del entorno HPC de CentOS 7 a Rocky 9. Cloudflare para DNS (DNSSEC incluido), protección contra DDoS y acceso remoto Zero Trust. Eso incluyó migrar 25 zonas DNS autoritativas de un BIND 9 autoalojado a Cloudflare en dos días laborables. Se actualizaron varios registros, y todo el conjunto quedó integrado con Ansible y Let’s Encrypt.
Todo sobre herramientas de código abierto, con presupuesto ajustado, construido a propósito para esquivar la trampa de licencias de Broadcom y VMware antes de que se cerrara. Aquello zanjó la discusión. La infraestructura de código abierto a esa escala no solo es viable — es mejor, y tengo el clúster y las facturas para decirlo.
La otra mitad de aquel trabajo eran las cuatro personas del equipo. A los científicos les da igual cómo se llame el almacenamiento. Les importa si el cálculo termina esta noche, y si la persona a quien preguntan sabe explicarles la respuesta sin hacerles sentir tontos por preguntar.
Cómo encaja todo
El paso a preventa en croit no fue un cambio de rumbo. Fue todo aterrizando en un mismo sitio.
La informática industrial me enseñó que la fiabilidad deja de ser una preferencia en el momento en que la producción depende de ella. El soporte de primera línea me enseñó a escuchar antes que nada. El desarrollo de aplicaciones me enseñó a construir sistemas que resuelven un problema de negocio y no uno interesante. Dirigir un equipo global me enseñó a cargar con lo técnico y aun así hacer crecer a la gente de alrededor, que es más difícil que cualquiera de las dos mitades por separado. El Linux de tercer nivel me enseñó qué se siente en la última línea de escalado. Veinte años de Windows y Linux en paralelo me enseñaron cómo se comportan de verdad las plataformas bajo carga, frente a lo que dice la hoja de datos. VMware, que llevé en casi todos los puestos desde 2008, me enseñó cómo es la virtualización empresarial a escala — y luego qué pasa cuando el terreno comercial se mueve bajo una plataforma sobre la que se asienta todo el parque. El almacenamiento y la red me enseñaron dónde viven los problemas difíciles. La seguridad ha atravesado todo, de los cortafuegos y las VPN de entonces al DNSSEC, el Zero Trust y el endurecimiento de ahora. Nominet me enseñó disciplina.
Junta todo eso y sale la preventa. Diseñas el sistema, luego defiendes el diseño, y sigues siendo honesto sobre lo que no hará, porque alguien está a punto de gastarse dinero de verdad fiándose de tu palabra.
En croit eso significa trabajar con organizaciones de Europa y Asia-Pacífico que están replanteándose su virtualización y su almacenamiento. Las conversaciones suelen ir de dejar VMware por Proxmox VE con Ceph. Las cargas que se mudan son en su mayoría Windows, así que la experiencia multiplataforma no es historia antigua. Es lo que hago ahora.
Lo que me importa es la honestidad. Lo que le pongo delante a alguien tiene que ser lo que funciona en su edificio, a su escala, con las limitaciones que tiene de verdad, y si su equipo actual ya hace casi todo el trabajo, eso es lo que le diré.
Almacenamiento
El almacenamiento acabó siendo una y otra vez donde estaban los problemas más duros. No fue un plan de carrera deliberado — simplemente salió así.
La fascinación empezó pronto. En los noventa soñaba con los discos Iomega Zip y Jaz — 100 MB, y luego un gigabyte entero, en un solo cartucho extraíble, cuando los disquetes que todos se pasaban guardaban 1,44 MB. Eran equipos caros, así que durante años se quedaron en deseo y no en posesión. Para cuando por fin tuve una unidad Zip por USB, acababan de aparecer las memorias USB — y el formato que tanto había querido ya iba de salida. Una lección temprana sobre lo deprisa que se mueve el almacenamiento, y lo rápido que lo imprescindible de hoy se convierte en el trasto del cajón de mañana.
Lo óptico formaba parte de la misma historia. En 1998 tenía una grabadora HP CD-RW de cuádruple velocidad, y era una maravilla. Leía y reescribía discos que unidades posteriores, más rápidas, sencillamente rechazaban — así que se ganó el sitio como unidad de rescate mucho después de la edad de jubilarse.
Empezó en la interconexión. He trabajado con hardware de almacenamiento de todo tipo. IDE, varias generaciones de SCSI, SATA, SAS y NVMe en la conexión directa. ATA sobre Ethernet e iSCSI en el almacenamiento en red. HP 3par, Dell Compellent, Dell PowerVault, Nexsan — cada uno con sus rarezas y sus modos de fallo.
De ahí se sube por la pila. El LVM en clúster me enseñó cómo se comporta el almacenamiento compartido cuando varios nodos necesitan acceso simultáneo — y qué pasa cuando el bloqueo y el aislamiento no están bien. ZFS me enseñó qué pasa cuando piensas de verdad en la integridad de los datos a nivel de sistema de ficheros. GPFS me enseñó los sistemas de ficheros paralelos a escala. Ceph me enseñó cómo se comportan de forma distinta los sistemas distribuidos ante un fallo.
Con los años, «la persona que además lleva el almacenamiento» se convirtió en «la persona a la que llamas cuando el almacenamiento hay que diseñarlo bien».
Redes
Las redes han estado ahí desde el principio. No es una habilidad de apoyo — es una habilidad central. TCP/IP, DHCP y DNS abarcan todos y cada uno de los puestos que he tenido desde McKenna.
Trabajar en Nominet significaba trabajar en la infraestructura detrás del registro de nombres de dominio británico. Eso es DNS a escala nacional. Nombrado, resolución, delegación, y la expectativa de que funcione todas y cada una de las veces.
He llevado zonas autoritativas en BIND 9, configurado DNSSEC, montado balanceadores F5 para IPv4 e IPv6, y después migrado parques DNS a Cloudflare con automatización por API e integración con Let’s Encrypt. He construido infraestructura DNS de arranque PXE para despliegues de clústeres tanto en el Reino Unido como en China. Entiendo el DNS por los dos lados. Autoalojado, donde cada fallo es tuyo. Y gestionado, donde confías en un proveedor y tienes que verificar esa confianza con monitorización.
Más allá del DNS, la red atraviesa todos los puestos que he tenido. VLAN, agregación, LACP, zonificación de fibra con Brocade, cortafuegos Fortinet y Cisco ASA, IPTables e IPset. Diseño de mallas de 25GbE y 100GbE, BGP, enrutamiento dinámico OSPF, gestión de MTU, arquitectura IPv6. Túneles VPN — de OpenVPN sobre enlaces internacionales difíciles a WireGuard y cloudflared para acceso seguro moderno. Samba ha sido también una habilidad profesional en varios puestos, tendiendo un puente entre la compartición de ficheros de Linux y la integración de dominio de Windows, mucho antes de que yo probara la implementación de AD en alfa.
Un clúster Ceph es una aplicación de red. El techo de rendimiento del almacenamiento lo pone la red que hay debajo. Los modos de fallo son modos de fallo de red. Eso no se aprende en un libro de texto. Se aprende resolviendo problemas a las dos de la madrugada.
Linux
Llevo más de dos décadas trabajando con las familias RHEL, Debian, SUSE y Fedora. Profesionalmente eso ha significado RHEL y CentOS para servicios en producción, Ubuntu para alojamiento de aplicaciones, Rocky para HPC, y Gentoo y Fedora para uso personal. He superado la evaluación de competencias de Linux de LinkedIn.
La profundidad vino de problemas sin respuesta en Stack Overflow, y ahí es donde acabas aprendiendo el subsistema PCI de verdad y no de oídas: grupos IOMMU, ACS, VFIO, SR-IOV, Resizable BAR y lo que la traducción DMA te está costando en silencio, y los parámetros de arranque del kernel como controles que cambian el comportamiento de la máquina, no como una lista que copiar de un wiki porque el blog de alguien decía que le arregló lo suyo.
Los problemas de rendimiento de almacenamiento y virtualización casi siempre se remontan a una capa que nadie miró. Ahí es donde vive mi conocimiento de Linux.
Windows
Linux es donde paso el tiempo ahora, pero el lado Windows es igual de real y ha estado presente en todos los trabajos que he tenido. Windows Server, Active Directory, LDAP, Exchange, IIS, Microsoft SQL Server. Nada de eso es una habilidad heredada que haya dejado aparcada.
Importa a nivel del invitado, y ahí es donde la mayoría deja de mirar. Cuando una carga Windows corre sobre KVM, la persona que sabe decirte cómo se comporta ese invitado bajo una topología de CPU concreta, y sabe rastrear una queja de rendimiento hasta un parche de Microsoft en lugar de culpar al hipervisor, es la que ha pasado años a ambos lados de la valla. La mayoría de las discusiones de rendimiento de VM que he presenciado las ganó alguien que conocía el invitado, no el anfitrión.
La gente a la que he dado soporte va de catedráticos y miembros de consejos de administración al equipo que cuida de los edificios. El trabajo es el mismo en todos los casos. Averiguar qué necesitan de verdad, ponerlo en marcha, y explicarlo de forma que no se queden sintiéndose tontos por haber preguntado.
VMware
VMware es la plataforma con la que crecí profesionalmente, a lo largo de siete puestos desde 2008, y he llevado toda su pila: ESXi, vCenter, vSAN, clústeres vSphere, vMotion. Sé lo que hace bien. Sé dónde no. Y vi cómo la compra por Broadcom reescribía la realidad comercial bajo organizaciones que habían construido todo su parque sobre ella, que es algo distinto de leerlo.
No puedes ayudar a alguien a dejar una plataforma sobre la que nunca trabajaste de verdad. Como tal, puedo decirles qué están dejando, qué obtienen, y qué parte de la migración será peor de lo que les han hecho creer.
Automatización
Pensar en automatización empezó en mi primer puesto profesional en 2006. Scripts VB en McKenna para automatizar la conexión de unidades de AD, la asignación de impresoras y el despliegue de software. Luego herramientas de aprovisionamiento de RR. HH. a AD en BT Engage IT. Luego sistemas de arranque PXE para clústeres de cálculo sin disco en Sondrel. Luego Puppet en Nominet. Luego empaquetado con Chocolatey y reconstrucción por PXE en una empresa de comercio minorista. Luego personalización de flujos de ServiceNow en varios puestos.
Ahora es Ansible con Netbox como fuente de verdad. No porque estén de moda, sino porque una infraestructura que no puedes reconstruir desde código no es una infraestructura en la que puedas confiar.
La documentación es el mismo argumento. El conocimiento que solo vive en la cabeza de alguien es un punto único de fallo, y sale del edificio a las cinco con todos los demás. Igual que un disco sin redundancia detrás, y hay que tratarlo con la misma seriedad.
Monitorización
Mi recorrido en monitorización empezó con SolarWinds en Pulsant, llevando monitorización a escala sobre el parque de alojamiento. Zabbix vino después, y se ha ganado una mención propia porque lo he implantado en casi todos los sitios desde entonces. Empezó en Nominet, donde llevé el concurso y las pruebas y después nos pasé a Zabbix para sustituir el envejecido montaje de VMware Hyperic, y ganó por ser genuinamente intuitivo y no otra cosa con Nagios por debajo. Después lo implanté desde cero en una plataforma de alojamiento e infraestructura, sustituí el intento fallido de alguien en el comercio minorista, y lo usé para vigilar un clúster HPC de 8 nodos en el UKCEH.
Cada vez diseñé yo mismo las plantillas de monitorización y escribí los scripts. Cuando me presenté a los exámenes Zabbix Specialist y Professional en 2018, llevaba años desplegándolo.
Comunicación
Trabajar en infraestructura crítica te enseña a ser preciso. Trabajar en preventa te enseña a ser claro. Las dos cosas están relacionadas pero no son lo mismo.
Ser preciso no sirve de nada si quien escucha no puede seguir el razonamiento, así que he tenido que aprender a dar la misma explicación dos veces: una para la ingeniera que quiere ver el mapa CRUSH, y otra para quien tiene que firmar por qué el presupuesto es la cifra que es. No simplifico nada hasta lo infantil. Solo hago visible cada paso del razonamiento, y les dejo pararme donde quieran.
Años de usuarios finales me enseñaron otra clase de paciencia. Los que se creen los más listos de la sala suelen ser los que se comportan de forma más desvalida. Los que empiezan con «no soy muy técnico» tienden a escuchar, seguir los pasos y resolverlo en diez minutos. Y los que te dicen que saben exactamente lo que hacen suelen haberlo empeorado antes de descolgar el teléfono.
La base en sistemas de gestión ayuda aquí más de lo que la gente espera, porque siempre he tenido que traducir en las dos direcciones. Arquitectura SQL para una responsable de operaciones, un diseño de almacenamiento para un director técnico, o sentarme al lado de alguien en su propia mesa y enseñarle lo que nunca le enseñaron. La misma habilidad cada vez.
Comunidad
Compartir conocimiento recorre toda la carrera.
Estuve activo en los foros de Gentoo cuando construía sistemas desde el código y necesitaba entender por qué una combinación de banderas USE rompía una compilación. Contribuí en los foros de Samba cuando trabajaba en problemas de compartición de ficheros e integración de dominio entre Linux y Windows. Aquello fue más allá de preguntar. Construí un controlador de dominio de Active Directory basado en Samba cuando el soporte de AD estaba todavía en alfa. Lo probé contra clientes Windows 2000, XP y Vista y lo devolví a la comunidad.
Ahora contribuyo activamente en los foros de la comunidad Proxmox como DamienDye. Ayudo con el rendimiento del passthrough NVMe, el ajuste de VM Windows, la resolución de problemas de Ceph y las redes de clúster.
Las tecnologías cambian. El principio no. Si he resuelto un problema, no se gana nada quedándose sentado encima, y alguien, a las dos de la madrugada dentro de seis meses, se alegrará de que esté escrito.
También tengo la costumbre de escarbar en los problemas más allá de lo que la tarea pide estrictamente. He diseñado una placa casera de protección contra cortes de alimentación para NVMe, porque quería entender exactamente por qué se produce la corrupción de la FTL a nivel de hardware. He investigado los protocolos de correo autoalojado porque quería entender JMAP desde el RFC en lugar de fiarme sin más de un proveedor. Construí este blog porque escribir las cosas como es debido es la forma de encontrar los huecos en tu propia comprensión.
Comunidad lejos del teclado
No todo han sido foros.
En 2018 fui uno de los fundadores de la Longford Park Community Association en Banbury, en la urbanización donde vivo. Cuatro fases de obra nueva, un centro comunitario escrito en los planos, y nada que existiera para hacerlo funcionar. Así que un puñado de vecinos montó algo.
Hice primero la parte informática, porque era lo que tenía que aportar. El dominio lpca.org.uk se puso en marcha en enero de 2018, y detrás construí el sitio web, los sistemas de correo y las listas de la junta, y redacté la política de privacidad.
Estuve en la junta desde el principio, y fui su presidente de diciembre de 2018 a febrero de 2020. Catorce meses, y las cosas que de verdad importaban aterrizaron todas dentro de ese plazo. Lo registramos como entidad benéfica el 11 de febrero de 2019, con el número 1181953. Arreglé el contrato de arrendamiento comercial del edificio. Y luego abrimos el centro.
Para eso servía la presidencia. No para órdenes del día y actas. Para abrir un edificio en el que unos cientos de hogares pudieran entrar. Voluntarios del barrio lo siguen llevando a lo largo de las fases 1 a 4 de la urbanización — tres salas, una cocina y un aparcamiento, alquilados por horas a quien de la urbanización los quiera.
Las juntas de voluntarios funcionan con buena voluntad, y la buena voluntad no es un modelo de gobernanza. Así que apliqué los estatutos a la gente, a mí incluido. Pregunté por qué reclutábamos fuera cuando los estatutos decían que había que implicar a los vecinos, y paré un envío masivo que habría acabado en todas las carpetas de correo no deseado de la urbanización. No por ponerme difícil. Una asociación de vecinos que no puede llegar a los vecinos ya ha fallado en la única tarea que tiene, y mandé los enlaces para arreglarlo junto con la queja.
El centro sigue abierto y yo ya no estoy en la junta, y ese es el orden correcto. Lo que solo funciona mientras estás ahí sujetándolo nunca se construyó bien.
Este sitio
Este blog es un sitio estático de Hugo con el tema PaperMod. Está alojado en Cloudflare Workers, sirviendo el sitio construido como recursos estáticos.
Escribo aquí sobre la infraestructura con la que trabajo a diario: Proxmox VE, Ceph, Ansible, Netbox, certificados y en lo que sea que haya estado escarbando esa semana. Está escrito para usarse, con los comandos y las cifras dentro, porque una entrada que no puedes seguir con el teclado delante es decoración. Sin palabrería de marketing. Si algo tiene aristas, la entrada lo dice.
Contacto
Me encuentras en LinkedIn o en los foros de Proxmox.
Si estás mirando Ceph o Proxmox para tu organización y quieres una conversación de verdad en lugar de una presentación comercial, escríbeme. Trae la carga de trabajo, las limitaciones y el presupuesto que tienes de verdad. Te diré qué va a hacer, qué no, y si la respuesta honrada es que deberías quedarte con lo que tienes y configurarlo bien, también tendrás esa respuesta.