S3 Glacier Deep Archive es, de lejos, la forma más barata de guardar datos en AWS. Esa parte todos la saben. Lo que suele tomar por sorpresa a los equipos es el otro lado del contrato: la recuperación tiene reglas propias, y el peor momento para descubrirlas es durante un incidente.
Este texto es sobre esas reglas.
Recuperar no es leer
En un bucket común, leer un objeto es una solicitud y listo. En el archivado profundo, el objeto no está disponible para lectura — primero necesita ser restaurado, lo que crea una copia temporal accesible por un período que eliges.
Son dos pasos, y el primero no es instantáneo:
- Pides la restauración del objeto.
- Después de horas, queda disponible para descarga por N días.
- Pasado ese plazo, la copia temporal desaparece — el objeto archivado sigue ahí, pero tienes que pedirlo de nuevo.
Quien escribe automatización tratando el archivado como un bucket común lo descubre en producción, con la recuperación fallando porque el objeto "no está listo".
Las horas importan más de lo que parece
Deep Archive ofrece dos niveles de recuperación:
- Estándar — el objeto queda disponible en unas 12 horas.
- Masiva (bulk) — en unas 48 horas, a un costo bastante menor.
Doce horas es mucho tiempo cuando alguien borró un archivo por error y lo necesita hoy. Cuarenta y ocho es una eternidad. Ninguno de los dos es "respaldo para restaurar rápido" — y está bien, siempre que la expectativa esté alineada. El error es vender archivado profundo como si fuera la única capa de protección.
El diseño que funciona es por capas: una copia reciente en almacenamiento de acceso rápido para los incidentes del día a día, y el archivado profundo para retención larga, cumplimiento y el escenario catastrófico. El archivado es tu póliza, no tu herramienta de trabajo.
El período mínimo de 180 días
Los objetos en Deep Archive tienen cobro mínimo de 180 días. Si grabas hoy y borras en treinta días, pagas como si lo hubieras guardado seis meses.
Eso hace que la capa sea pésima para datos que cambian mucho, y excelente para lo que realmente no cambia. Una política de ciclo de vida mal calibrada — que mueve datos allí demasiado pronto y los expira poco después — logra la proeza de aumentar la factura mientras intenta reducirla.
El costo por objeto que se esconde en la cuenta
Cada objeto archivado lleva metadatos cobrados aparte: 32 KB a la tarifa de la propia capa y 8 KB a la tarifa de la clase estándar. Son 40 KB por objeto, independientemente del tamaño real.
Para archivos grandes, ruido. Para acervos con millones de archivos pequeños, esa partida puede superar el costo del propio dato — y es la razón por la que archivar objeto por objeto rara vez compensa en ese escenario. Agrupar los archivos en paquetes mayores antes de enviar resuelve las tres cosas a la vez: menos solicitudes, metadatos una vez por paquete y el mínimo de 180 días aplicado a pocos objetos.
La pregunta que separa respaldo de esperanza
Existe una diferencia enorme entre "los datos están archivados" y "sé que puedo recuperarlos". La primera es una afirmación sobre el pasado. La segunda exige prueba.
Un ejercicio de recuperación honesto responde:
- ¿Cuánto tiempo pasó entre pedir y tener el archivo en la mano?
- ¿El contenido recuperado coincide con el original?
- ¿Quién tiene permiso para ejecutar esto a las tres de la mañana?
- ¿Cuánto costó esa recuperación?
Si nunca hiciste ese ejercicio, lo que existe hoy no es un respaldo verificado — es un respaldo presunto. Y el momento de descubrir la diferencia no es durante el incidente.
Una trampa de permisos
La recuperación usa una operación distinta de la lectura. No basta con conceder permiso de lectura de objetos: hay que permitir también la operación de restauración. Es común que la política de acceso quede correcta para grabar e incompleta para recuperar — y nadie lo nota, porque el flujo de grabación corre todos los días y el de recuperación, nunca.
Prueba la recuperación con la misma identidad que la ejecutará de verdad, no con una credencial administrativa.
Resumen práctico
- El archivado profundo es retención larga, no recuperación rápida: cuenta con 12 h en modo estándar y 48 h en modo masivo.
- Restaurar es una solicitud asíncrona seguida de una ventana de disponibilidad — la automatización debe manejar eso explícitamente.
- Hay un mínimo de 180 días de cobro; un ciclo de vida demasiado agresivo cuesta más caro.
- Hay 40 KB de metadatos cobrados por objeto: en acervos de archivos pequeños, agrupar antes de enviar cambia el orden de magnitud de la cuenta.
- Prueba la recuperación, con la identidad real, y cronométrala.
Precios y plazos varían por región y cambian con el tiempo — confirma en la documentación oficial de AWS antes de cerrar cualquier diseño.
NubliVault empaqueta los archivos antes de archivar y mantiene un manifiesto consultable, lo que permite recuperar un archivo individual sin descargar el paquete entero — y seguir el ciclo de restauración desde la consola. Mira cómo funciona.