Anuncio del futuro del estado de la infraestructura
El artículo anuncia una nueva plataforma para el estado de la infraestructura, diseñada para reducir el tiempo de inactividad causado en gran medida por errores humanos, mediante la correlación de estadísticas de funcionamiento, registros y datos de configuración entre los distintos componentes de la infraestructura. Explica el problema operativo por el que más del 70 % de las interrupciones se deben a factores humanos —presión de tiempo, estrés, complejidad, procedimientos e interfaces deficientes— y muestra cómo el producto anterior de la empresa permitía a los operadores actuar de forma proactiva al ofrecer información útil. La plataforma amplía ese enfoque para que los socios y los usuarios puedan crear rápidamente «checks» (y, con el tiempo, utilizar «checks» generados por aprendizaje automático) para muchos más tipos de dispositivos, con el fin de mejorar el tiempo de actividad en entornos de red, seguridad, computación y almacenamiento.
What specific operational problem is the new platform intended to solve?
The platform targets the high rate of outages caused by human error—over 70% according to the article—by addressing the root causes operators face daily: lack of time, stress, task complexity, insufficient training and procedures, poor human‑machine interaction, and thinly staffed teams. It solves this by collecting and correlating three information streams—running statistics, logs and configurations—then using on‑board knowledge to identify issues and recommend corrective action. The result is fewer firefights, earlier detection of problems, reduced operator stress, and reclaimed engineering time for higher‑value work.
How does the new platform differ from existing monitoring, log management, and configuration tools?
Unlike traditional tools that focus on a single element (monitoring, logs, or configuration) or that aggregate data but fail to correlate it meaningfully, the platform is designed to collect all three data types and apply on‑board knowledge to identify cross‑element conditions that require attention. The article emphasizes that many solutions either do not correlate these elements or lack the domain knowledge to know what to look for. The platform enables actionable alerts that point to root causes and remediation steps, turning reactive operators into proactive teams and substantially reducing incidents before they occur.
What are the next steps for the platform and how can organizations participate?
The company has built the platform to simplify authoring of checks for new infrastructure types; writing a specific check currently takes a few hours and is planned to drop to 30 minutes within six months. Machine learning teams are also developing automated systems to generate checks. The article outlines participation paths: customers should contact [email protected], channel and technology partners via [email protected], individuals contributing knowledge at [email protected], and R&D or San Francisco roles via the respective careers email addresses. The existing product will be migrated onto the platform over the coming year, with customers able to migrate initially without write capabilities.
Hoy me complace anunciar nuestra plataforma para el estado de la infraestructura. Antes de entrar en detalle sobre lo que acabamos de hacer, permíteme explicarte por qué.
¿Cuál es el estado actual de la salud de la infraestructura?
¿Qué es exactamente lo que falla en las operaciones de infraestructura? ¿Por qué las empresas de todo el mundo siguen lidiando con los tiempos de inactividad?
Nuestras investigaciones, así como las de otros, apuntan al factor humano. Más del 70 % de todas las interrupciones del servicio se deben a errores humanos. Esto resulta desconcertante: las personas encargadas de gestionar la infraestructura se encuentran entre las más inteligentes que hay. Me reúno con ellos habitualmente y sé que conocen bien su trabajo. Muchos de ellos cuentan con una década o más de experiencia en lo que hacen. Aun así, se producen errores. ¿A qué se debe esto?
Hace unos años, el Laboratorio Nacional de Idaho, que forma parte del Departamento de Energía de EE. UU., publicó un breve artículo sobre el error humano en el sector energético. Es sorprendente observar el parecido entre los errores humanos en diferentes sectores. En él se señalan algunos problemas críticos que provocan el error humano:
- Falta de tiempo para completar adecuadamente la tarea.
- Estrés: físico y mental.
- Complejidad de la tarea en cuestión.
- Experiencia y formación.
- Procedimientos y procesos de trabajo ausentes o insuficientes.
- Interacción deficiente entre el usuario y la máquina (piensa en la interfaz de usuario).
- Condición física (¿enfermo? ¿cansado?)
Cuando hablamos con los responsables del buen funcionamiento de la infraestructura digital mundial, nos sorprende descubrir la gran cantidad de componentes diferentes de los que se encargan. Por ejemplo, una administradora se encarga, ella sola, del mantenimiento de más de 200 componentes repartidos por todo Estados Unidos. Lo único de lo que dispone es un sistema de monitorización básico que le avisa si alguno de los componentes falla. Para complicar aún más las cosas, algunos de estos componentes tienen una conexión a Internet lenta y se desconectan sin motivo aparente. Cada día es una lucha constante para ella, tratando de averiguar qué ha fallado y solucionarlo lo antes posible. Está estresada, trabaja con falta de tiempo, en un entorno muy complejo, con formación insuficiente, sin procedimientos claros y con una interfaz de usuario deficiente (en algunos productos), y es muy probable que esté agotada.
Así pues, está claro por qué los seres humanos pueden cometer errores. La pregunta es: ¿cómo se les puede ayudar?

Muchas empresas de software han intentado dar respuesta a esto en el pasado: sistemas de monitorización, gestión de registros e incluso gestión de la configuración. Lamentablemente, estos sistemas no son adecuados. No logran reducir de forma significativa el problema de las interrupciones del servicio y el tiempo de inactividad. Esto se debe a tres razones:
- La mayoría de estas soluciones se centran en un solo aspecto del estado de los componentes de la infraestructura: estadísticas de funcionamiento (supervisión), registros o configuración. No recogen los tres aspectos.
- Hay algunas soluciones que recopilan los tres elementos de información, pero no logran correlacionarlos adecuadamente. ¿Provocó una configuración específica un problema que quedó reflejado en un registro y que habría ayudado a anticipar un fallo del dispositivo? Estas soluciones no ayudan al usuario a averiguarlo. Ni de antemano ni siquiera a posteriori.
- Ninguna de las soluciones, salvo la de Indeni, saberealmente qué buscar en estos tres elementos de información. Son excelentes a la hora de presentar los datos que recopilan, pero dejan que sea el ser humano (ya de por sí sobrecargado de trabajo y con recursos limitados) quien les dé sentido.
¿Qué hemos hecho hasta ahora?
Hace unos años, el equipo de Indeni ideó una solución para esto. Desarrollamos un producto de software capaz de extraer estadísticas en tiempo real, registros y configuraciones de los componentes de la infraestructura y darles sentido. El producto utiliza su base de conocimientos integrada para identificar qué requiere atención y envía alertas al usuario informándole de lo que hay que hacer. Como dijo recientemente uno de nuestros clientes: «Indeni detecta los problemas antes de que ocurran y me avisa». De repente, las personas que gestionan la infraestructura digital mundial pasan a actuar de forma proactiva. Tienen la oportunidad de reducir ese 70 % que mencioné antes y acercarlo a cero. Otro cliente me comentó en nuestra reciente encuesta: «Antes de Indeni, mi infraestructura estaba plagada de problemas. Recibía llamadas a diario. Con Indeni, apenas recibo llamadas y puedo resolver los problemas antes de que mi jefe se entere. Me ha liberado muchísimo tiempo. Ahora soy arquitecto, cuando antes era ingeniero».
Así pues, el experimento ha funcionado. Nuestra tecnología ha ofrecido resultados notables. Los clientes están apostando por ella y están ampliando el uso del producto a un ritmo medio del 60 % al año. Y no solo eso: todos y cada uno de nuestros clientes nos han dicho que no tenemos competidores. Nuestra tecnología no tiene rival en su capacidad para identificar problemas complejos antes de que se produzcan.
Indeni aborda las principales fuentes de error humano, tal y como se ha descrito anteriormente:
- Liberamos tiempo, en algunos casos cientos de horas de trabajo al mes por persona, para centrarnos en los proyectos importantes que tenemos entre manos.
- Reducimos drásticamente el estrés mental al resolver los problemas antes de que el resto de la organización se entere de ellos.
- Reducimos la complejidad de las tareas señalando el origen de un problema y el curso de acción adecuado.
- Ampliamos la formación: señalamos problemas de los que el usuario quizá nunca haya oído hablar y le mostramos cómo resolverlos.
- Mejoramos los procesos de trabajo, especialmente la interacción entre los equipos de ingeniería y de operaciones, así como los distintos niveles de escalado dentro de los equipos de operaciones. La información se transmite de forma más fluida.
- Protegemos las espaldas de los administradores: así que, si están realizando un cambio crítico a las 2 de la madrugada debido a las restricciones de la ventana de mantenimiento, estamos ahí para detectar si un administrador cansado ha cometido un error.
Sin embargo, todo esto se limitaba a los cortafuegos de Check Point, los conmutadores de Cisco, los equilibradores de carga de F5 y los cortafuegos de Palo Alto Networks. Se trata de un pequeño subconjunto de la infraestructura mundial.

Es hora de expandirse
Una sola empresa, por muy grande que sea, nunca podrá abordar por sí sola el problema de abarcar todos los posibles tipos de componentes de infraestructura. El mundo es inmenso. Hay equipos por valor de billones de dólares desplegados por todas partes. Es imposible siquiera imaginar lo grande que es.
Así pues, decidimos crear una plataforma. Hemos aprovechado toda nuestra experiencia y conocimientos técnicos sobre cómo recopilar correctamente los tres elementos de datos (estadísticas de funcionamiento, registros y configuración) y correlacionarlos. Hemos creado una plataforma robusta, dotada de todas las capacidades que nosotros mismos necesitábamos para desarrollar nuestro primer producto. Su funcionamiento interno es complejo, pero lo mejor de todo es la sencillez con la que se puede desarrollar sobre ella. Hoy en día, escribir una comprobación para un posible error específico en un tipo concreto de componente de infraestructura nos llevará menos de unas pocas horas en nuestra nueva plataforma. En los próximos seis meses, reduciremos ese tiempo a 30 minutos.
Además, nuestro equipo de aprendizaje automático está desarrollando sistemas automatizados capaces de escribir sus propias comprobaciones en la misma plataforma. ¡Ordenadores que escriben código! Es alucinante.
Esto significa que, gracias a nuestra plataforma, ahora se podrán crear comprobaciones altamente inteligentes para cualquier elemento de infraestructura que exista, ya sea de propiedad privada o que forme parte de la nube pública.

Con nuestra plataforma, los errores humanos en las operaciones de infraestructura serán cosa del pasado.
Nuestro objetivo final
Nuestro objetivo es que todas las grandes empresas del mundo utilicen nuestra plataforma para garantizar la disponibilidad de toda su infraestructura: red, seguridad, virtualización, recursos informáticos, almacenamiento y mucho más. Para lograrlo, trabajaremos en estrecha colaboración con nuestros clientes, nuestros socios y la comunidad en general. Se trata de una iniciativa global y nos encantaría que te unieras a nosotros enviando un correo electrónico a la persona de contacto correspondiente que figura a continuación:
- Clientes:[email protected]
- Socios de canal (VAR/VAD/DMR) y socios tecnológicos:[email protected]
- Personas que deseen aportar sus conocimientos a la plataforma:[email protected]
- Ingenieros de I+D con talento que deseen unirse a nuestro equipo en Israel:[email protected]
- Representantes de ventas, ingenieros de soluciones, ingenieros de soporte y expertos en TI que deseen unirse a nuestro equipo en San Francisco:[email protected]
Si trabajamos todos juntos, las operaciones de infraestructura nunca volverán a ser las mismas.
Preguntas frecuentes: ¿Qué ocurre con el producto actual?
El producto actual, capaz de identificar problemas en cortafuegos de Check Point, conmutadores de Cisco y otros dispositivos, se migrará para que funcione sobre la plataforma a lo largo del próximo año. Los clientes actuales podrán migrar a la plataforma, aunque inicialmente no tendrán la posibilidad de desarrollar aplicaciones sobre ella. Si ya es cliente de Indeni y está interesado en trabajar con la plataforma, póngase en contacto con su persona de contacto en Indeni.