Un proceso de alta puede esperar tres días una aprobación y otros cinco un documento. Mantener un hilo, contenedor o sesión RPA bloqueados durante ese tiempo desperdicia recursos y pierde estado ante un reinicio. Un workflow duradero persiste el avance y se reactiva por evento o vencimiento.

Modela estados de negocio

En vez de “el script está esperando”, expresa estados observables:

BORRADOR → PENDIENTE_APROBACION → PENDIENTE_DOCUMENTO
         ↘ RECHAZADO             ↘ VENCIDO
                     → ACTIVADO

Cada transición define evento permitido, autorización, efectos, vencimiento y siguiente responsable. Conserva el identificador del proceso, versión de definición y datos mínimos necesarios; los documentos viven en su almacén correspondiente.

AWS Step Functions diferencia workflows Standard, duraderos y auditables, de Express, orientados a alto volumen y corta duración. Los Standard pueden ejecutarse hasta un año y conservan historial, aunque tienen cuotas de eventos y retención que deben considerarse. La elección depende de garantías y duración, no solo del diagrama.

Espera sin ocupar ejecución activa

Para una fecha conocida, programa un temporizador durable. Para una respuesta externa, genera un token o correlación de callback de un solo uso. Al recibirlo:

  1. autentica el emisor;
  2. valida que el workflow sigue en el estado esperado;
  3. comprueba vencimiento;
  4. registra la transición de forma idempotente;
  5. ejecuta el siguiente efecto.

Una respuesta repetida no debe duplicar pagos, correos ni altas. Usa claves ligadas a workflow y transición, siguiendo el patrón de idempotencia.

Versiona procesos en curso

Un cambio de definición puede llegar mientras existen cientos de instancias esperando. Decide explícitamente:

  • las instancias antiguas terminan con su versión;
  • se migran mediante una transformación de estado probada;
  • se cancelan y reinician con comunicación y compensación.

No interpretes estados antiguos con reglas nuevas sin compatibilidad. Guarda versión, fecha de creación y decisiones tomadas.

Vencimientos y compensaciones

Cada espera necesita fecha límite y acción: recordar, escalar, caducar o pasar a revisión. Distingue tiempo natural de calendario laborable; los calendarios de automatización deben aportar la regla.

Una compensación no equivale siempre a “deshacer”. Si ya se envió información a un tercero, quizá corresponda emitir una cancelación, no borrar el rastro. Diseña efectos compensables y marca cuáles requieren intervención.

Operación y recuperación

Expón métricas de instancias por estado, edad, vencimientos próximos, transiciones fallidas y reintentos. Permite buscar una instancia y comprender por qué espera. Un operador autorizado debería poder reintentar una transición segura, aportar una corrección o terminar el proceso con motivo auditado.

Prueba reinicio del orquestador, callback duplicado, evento fuera de orden, vencimiento simultáneo, despliegue de versión nueva y dependencia caída. Controla crecimiento del historial: AWS recomienda continuar en nuevas ejecuciones cuando un workflow largo se acerca a cuotas.

La duración deja de ser un problema técnico cuando el estado está persistido, las transiciones son idempotentes y cada espera tiene vencimiento y propietario. El workflow puede dormir; la organización sigue sabiendo qué falta y cómo reanudarlo.