Un acuerdo de nivel de servicio no es un ejercicio de confianza ni un trofeo legal; es un sistema de medición compartido que le dice a ambas partes si la operación está sana y qué pasa cuando no lo está. Este artículo muestra cómo diseñar un SLA con un socio de suministro o de fulfillment (ejecución de pedidos): qué métricas pueden medirse de verdad, cómo fijar umbrales que cambien el comportamiento y la mecánica de revisión que mantiene vivo el documento después de la firma.
Para qué sirve realmente un SLA
Un SLA hace tres trabajos que la buena voluntad no puede. Convierte expectativas vagas —«despacho rápido», «buena calidad»— en definiciones que ambos lados pueden calcular de la misma manera. Crea consecuencias proporcionales a los fallos, para que el bajo rendimiento aflote como un número en lugar de como una sensación acumulada durante meses. Y crea un foro: una revisión programada donde los números se leen juntos, que es donde la mayoría de los problemas operativos se resuelven de verdad. Lo que un SLA no es, es un sustituto de elegir un socio competente —una operación débil con un SLA estricto produce disputas, no rendimiento. El documento formaliza una relación de trabajo; no puede crearla. Por eso los socios serios a menudo proponen SLAs ellos mismos: la disciplina de medición es un rasgo de las operaciones que esperan ser medidas.
Solo métricas con un dueño y una fuente de datos
La mayoría de los fallos de SLA son fallos de definición. «Los pedidos se envían rápido» colapsa ante la primera disputa; «los pedidos hechos antes de las 14:00 hora local se despachan el mismo día hábil, medido desde la marca temporal de escaneo de despacho del sistema de gestión de almacén, excluyendo retrasos de recolección confirmados por el transportista» no. Cada métrica de un SLA necesita tres cosas por escrito: una fórmula, una fuente de datos que ambas partes acepten, y un dueño que responda por ella. Las métricas que se ganan su lugar en la mayoría de los SLA de suministro de e-commerce, con definiciones y rangos objetivo de uso común —los rangos varían por categoría, ruta y programa, así que trátelos como puntos de partida de negociación y no como estándares:
| Métrica | Definición (fórmula y fuente) | Rango objetivo común | Notas |
|---|---|---|---|
| Tasa de despacho a tiempo | Pedidos despachados dentro de la ventana de manejo acordada tras el corte, por escaneo del WMS, dividido entre todos los pedidos | 97–99 % (varía) | Defina explícitamente la hora de corte y el manejo en día hábil |
| Tasa de sobreventa | Pedidos sobre-vendidos por cada 1.000 pedidos, según los registros del sistema de pedidos y de stock | Casi cero; menos de 1 por 1.000 (varía) | Depende de la cadencia de sincronización; defina el protocolo, no solo el número |
| Exactitud de picking | Envíos de artículo o cantidad equivocados por cada 1.000 pedidos, según reclamos y auditorías de calidad | Menos de 2 por 1.000 (varía) | Verifique por muestreo, no solo por los reclamos recibidos |
| Tasa de tránsito en rango | Paquetes entregados dentro del rango publicado de la ruta, según escaneos del transportista | 90–95 % (varía por ruta) | Propiedad del transportista; el diseño del remedio debe reflejar el control limitado del socio |
| Tasa de defectos reportados por clientes | Reclamos verificados como defectos por cada 100 pedidos, según tickets de soporte codificados | 0,5–2 % (varía por categoría) | Verifique contra registros de inspección; codifique los motivos, no los parafrasee |
| Primera respuesta a excepciones | Horas hasta la primera respuesta sustantiva en tickets de excepción, según el sistema de tickets | Dentro de 4–24 horas hábiles (varía) | «Sustantiva» necesita definirse; las respuestas automáticas no cuentan |
| De muelle a stock en entrada | Días hábiles desde la recepción en muelle hasta el inventario vendible, según marcas temporales del WMS | 1–3 días hábiles (varía) | Importa más antes de picos y campañas |
| Exactitud del conteo de stock | Coincidencias de conteo cíclico frente a los registros del sistema | 98–99,5 % (varía) | Acuerde la frecuencia y el método de conteo dentro del propio SLA |
Cinco a ocho métricas es el máximo de trabajo. Un SLA de cuarenta líneas es un documento que nadie lee y todos resienten; la disciplina de elegir qué cinco a ocho métricas cargan con el programa es en sí misma la mayor parte del trabajo de diseño.
Umbrales, bandas y ventanas de medición
Un único umbral de aprueba/falla desperdicia la información de los casi-fallos. Los SLA que funcionan usan tres bandas —un objetivo, un rango aceptable y una línea crítica— para que un mes con 96,8 % de despacho a tiempo se lea como «vigilar» y no como «incumplimiento». Fije las bandas desde datos y no desde la aspiración: tome los últimos tres meses de rendimiento real donde exista, añada la mejora por la que realmente está pagando, y fije la línea crítica donde empieza el daño real. Acuerde la ventana de medición explícitamente —las ventanas móviles mensuales suavizan las semanas malas aisladas, mientras que las ventanas semanales afloran problemas más rápido pero generan ruido en programas de bajo volumen. Y fije un volumen mínimo por debajo del cual una métrica se reporta pero no se hace cumplir; los objetivos porcentuales sobre treinta pedidos al mes miden suerte, no rendimiento.
Remedios que cambian el comportamiento
La sección de remedios de un SLA existe para cambiar incentivos, no para extraer renta, y el diseño se nota. Los créditos de servicio —un porcentaje de las comisiones del periodo afectado, escalado según cuán por debajo de la línea crítica cayó el rendimiento— son el instrumento estándar, y funcionan cuando son proporcionales y automáticos: calculados desde la fuente de datos acordada, aplicados sin negociación. Dos reglas de diseño mantienen sanos los remedios. Primera, iguale el control del remedio al control real: un socio no puede deber créditos por fallos de tránsito causados por el transportista más allá del deber de haber reservado un transportista competente y de haber escalado visiblemente. Segunda, empareje cada crédito con una obligación de causa raíz —una respuesta escrita a «qué falló y qué cambia»—, porque el crédito es compensación, y la causa raíz es prevención. Los fallos crónicos a través de ventanas consecutivas justifican una escalera de escalación que termina en un derecho de salida; un SLA bien construido incluye la puerta, lo que paradójicamente es lo que hace que ambas partes inviertan en no usarla jamás. Los flujos de trabajo de manejo de excepciones sobre los que se sientan estas cláusulas están cubiertos en nuestra guía de manejo de excepciones de pedidos.
La cadencia de revisión que mantiene honestos los SLA
Un SLA sin revisión programada es un PDF. La cadencia que funciona es semanal para las operaciones —una llamada de treinta minutos leyendo las métricas operativas, el registro de excepciones y los volúmenes de la próxima quincena— y mensual o trimestral para el SLA en sí: puntuaciones contra las bandas, créditos aplicados, causas raíz cerradas, umbrales recalibrados contra la realidad. Ambas partes deberían ver el mismo marcador generado desde las fuentes de datos acordadas; las hojas de cálculo en duelo son como empiezan las disputas de medición. Cuando la fontanería de datos viene de los sistemas del socio, los compromisos de visibilidad que hay que buscar son los descritos en nuestra página del servicio de fulfillment, y las métricas del lado de la calidad —tasas de defectos, cobertura de inspección— se apoyan en las prácticas de nuestro proceso de calidad y cumplimiento. La recalibración es parte del diseño: a medida que crecen los volúmenes y las rutas se estabilizan, las bandas objetivo de ayer deberían endurecerse, y la revisión programada es donde eso ocurre por acuerdo y no por emboscada.
Preguntas frecuentes
¿Qué pasa si un socio prospectivo se niega a firmar un SLA?+
Pregunte qué medirían en su lugar. La negativa a definir y compartir números de rendimiento es en sí misma diagnóstica, y la lectura más segura es que la operación no se mide a sí misma. Algunos socios resisten umbrales concretos mientras aceptan definiciones y reportes transparentes —esa es una negociación viable; rechazar la medición por completo no lo es.
¿Los remedios deberían ser penalizaciones o créditos de servicio?+
Los créditos de servicio calculados desde los datos acordados son el instrumento viable: automáticos, proporcionales y aburridos. Las penalizaciones puras invitan a la disputa sobre cada incidente, y los remedios que exigen litigio para activarse no protegen a nadie. La palanca más fuerte suele ser la escalera de escalación y el derecho de salida, no el tamaño del crédito.
¿Cuántas métricas debería contener un primer SLA?+
Cinco o seis. Despacho a tiempo, sobreventa o exactitud de picking, tránsito en rango, tasa de defectos, respuesta a excepciones y exactitud de stock cubren los modos de fallo que realmente dañan programas. Añada métricas cuando la operación pueda medir honestamente el primer conjunto —un SLA corto que se lee cada semana vence a uno largo que se archiva.
¿Con qué frecuencia deberían renegociarse los objetivos del SLA?+
Revise las puntuaciones mensualmente, recalibre las bandas cada trimestre, y renegocie el acuerdo completo cada año. Entre esos puntos, los objetivos solo deberían moverse por acuerdo escrito —los objetivos ajustados de palabra en el mes nueve son disputas programadas para el mes doce. El ritmo de recalibración es una ventaja: permite a ambas partes endurecer los estándares a medida que el rendimiento se los gana.
