Resumen

  • draft-ietf-cats-metric-definition-11, publicado el 4 de septiembre de 2026, añade pautas operativas para acordar puntuaciones entre proveedores, limitar actualizaciones, tratar valores caducados y emitir alarmas. Sigue siendo un Internet-Draft.
  • CATS puede reducir medidas de cómputo, comunicación y servicio a una cifra sin unidad de un byte. Compartir el formato no hace comparables dos cifras construidas con límites, pesos o funciones diferentes.
  • La nueva sección exige un manifiesto versionado y sincronizado fuera de línea. La prueba aún debe mostrar que cada componente ejecutó esa versión y que la instancia elegida atendió la petición.

En un extremo, una granja convierte CPU libre y memoria en un ocho. En el otro, un nodo mezcla latencia, cola y éxito de solicitudes hasta obtener el mismo ocho. Una escala usa límites min-max; la otra, una curva sigmoide. Ambas cifras caben en el mismo octeto y llegan con firma válida.

El selector ve igualdad. La infraestructura no.

La revisión 11 de CATS Metrics Definition aborda precisamente esa costura. Computing-Aware Traffic Steering pretende escoger una ruta hacia una instancia de servicio combinando condiciones de red con disponibilidad informática o del servicio. En el marco CATS, C-SMA recoge información del servicio y del cómputo, C-NMA aporta la red y C-PS selecciona el camino.

El modelo tiene tres peldaños. Level 0 contiene observaciones brutas y específicas. Level 1 las reúne en las categorías computing, communication, service y composed. Level 2 comprime lo relevante en una única puntuación global normalizada.

La compresión resuelve una dificultad real: un equipo de red no necesita transportar y entender centenares de contadores propios de cada plataforma. Pero la tabla comparativa del propio borrador asigna a Level 0 precisión alta y complejidad alta, y a Level 2 complejidad baja, estabilidad alta y precisión baja. El valor global ocupa un byte, no conserva unidad física y declara Source: normalization.

Un byte común no crea una regla común

La escala propuesta va de cero a diez. Para normalizar, el texto cita min-max y sigmoide; para agregar, media, mínimo, máximo y media ponderada. Sin embargo, no estandariza esas funciones. La implementación y la política del operador eligen la receta.

El mismo porcentaje de CPU cambia de nota cuando cambian los extremos min-max. El mismo conjunto de entradas cambia cuando la cola recibe más peso que la latencia. Incluso el sentido importa: ¿es mejor un número alto o uno bajo? El campo puede ser interoperable mientras la comparación es injusta.

El registro conserva contexto limitado. Source diferencia lo nominal, estimado, medido directamente, agregado o normalizado. Statistics puede indicar máximo, mínimo, media o valor actual. Observation_Time puede fijar el instante conforme a RFC 3339, y Validity_Interval marca hasta cuándo se usa; si falta, manda la política local. RFC 5835 trata la composición de métricas y RFC 9439 informa la procedencia.

Esto ayuda a clasificar la afirmación, pero no guarda el cálculo. normalization no enumera muestras, descartes, pesos, límites, perfil de calibración ni versión del ejecutable. Una puntuación puede ser auténtica, reciente y semánticamente equivocada para el consumidor.

La sección operativa nueva obliga a tratar la comparabilidad como configuración. En un dominio administrativo con varios proveedores, todos deben acordar intervalo, tipo y parámetros de normalización, fórmula y coeficientes de agregación, y dirección de comparación. De lo contrario, advierte, la selección puede quedar sesgada.

El resultado se compila en un manifiesto formal, bajo control de versiones, y se sincroniza fuera de línea al inicializar. Ya en servicio, cada componente presupone que lo recibido fue calculado según el acuerdo; no hay negociación dinámica. Si no se alcanza el acuerdo, cabe centralizar el cálculo o usar una métrica Level 0 concreta.

Es una separación razonable entre plano de datos y política. También significa que el punto decisivo está fuera del mensaje. Que el repositorio contenga un manifiesto no prueba que todos los productores y consumidores lo tengan activo. La firma vincula al editor con el valor, no al valor con la fórmula correcta.

La continuidad reutiliza información que envejece

Las métricas de cómputo cambian deprisa y publicarlas tiene coste. La revisión recomienda no más de una actualización por instancia y ventana de medición, y exige calcular la carga al crecer a cientos o miles de instancias.

Las medidas de alivio son intercambios, no regalos. Ampliar una ventana de diez segundos a treinta o sesenta reduce señalización y aumenta la edad. Enviar solo Level 2 ahorra detalle. Enviar max, min, mean o cur resume la serie de maneras distintas. Lo que desaparece del control plane reaparece como incertidumbre.

Ante una fuente caída o un valor que no supera la comprobación de frescura, el borrador propone conservar por un tiempo el último dato bueno—por ejemplo dos o tres ventanas—y después degradar o excluir la instancia. El último recurso es seleccionar solo con la red. Pide alarmas por caducidad, componentes o publicaciones caídos, descensos bruscos, valores congelados y contradicciones entre Level 1 y Level 2.

Con una ventana de diez segundos y tres ventanas de gracia, un ocho antiguo puede gobernar durante unos treinta segundos. Tal política quizá proteja la continuidad, pero no mide capacidad actual. El recibo debe conservar instante de observación, recepción, edad, umbral aplicado y momento exacto de la exclusión.

La seguridad cubre integridad, autenticidad, autorización del publicador por servicio, repetición, frescura y cifrado. Son garantías necesarias porque estas cifras cambian el reenvío. Aun así, no validan el sensor ni los límites. Una fuente autorizada también puede ejecutar el manifiesto anterior.

La realidad empieza donde termina el panel

Las capas de realidad de Heng Lu permiten no confundir pasos. Primero hay observación; luego ventana estadística; después agregación y normalización; más tarde selección y forwarding; por último recepción, ejecución y efecto para el usuario. Ninguna capa acredita automáticamente la siguiente.

La primacía del código en funcionamiento requiere unir identificadores de muestras, unidad y ventana, hash del manifiesto, versión activa en productor y selector, puntuación anunciada, decisión de frescura, entradas del C-PS, CSCI-ID escogido, regla instalada y resultado de la petición.

Una especificación inicial mínima puede compartir campos, procedencia, tiempo e identidad de manifiesto sin decidir un peso mundial para CPU o latencia. La libertad local es compatible con interoperar si cada decisión conserva su autor y sus consecuencias.

La revisión 11 no demuestra implantación ni mejora de rendimiento. Sí reconoce que el sistema configura el significado antes de arrancar y luego lo da por hecho. Para que dos ochos sean comparables, esa hipótesis debe ser verificable mientras aún se puede corregir la ruta.

Fuentes