Respuesta corta
Las 6 categorías nativas del guardrail son: seguridad, privacidad, equidad, transparencia, responsabilidad y robustez. Estas categorías estructuran los controles técnicos y éticos que regulan el comportamiento de modelos de IA en entornos empresariales y regulatorios.
TL;DR
- Las 6 categorías nativas forman el marco conceptual central de los guardrails de IBM Granite.
- No derivan de una norma legal específica, sino de principios de gobernanza de IA consensuados internacionalmente (OECD, NIST AI RMF).
- Cada categoría se implementa mediante reglas configurables, filtros de salida y mecanismos de monitoreo en tiempo real.
- Son independientes del dominio de aplicación: se aplican igual a chatbots financieros, asistentes médicos o sistemas de reclutamiento.
- IBM documenta explícitamente estas seis como “nativas” en su Granite Guardrails Technical Overview (v2.1, 2024).
- No se corresponden 1:1 con las categorías de la Directiva Europea de IA, ni con la Lei Geral de Proteção de Dados (LGPD) brasileña.
¿Qué son las 6 categorías nativas del guardrail?
Son dimensiones fundamentales que definen los límites operativos y éticos de un modelo de inteligencia artificial. No son funciones técnicas aisladas, sino ejes interdependientes que guían el diseño, despliegue y auditoría de sistemas basados en Granite. Cada categoría incluye métricas observables, umbrales ajustables y protocolos de respuesta ante violaciones —por ejemplo, un fallo en equidad puede activar una revisión automática de sesgos demográficos en respuestas generadas.
¿Por qué exactamente seis y no más o menos?
IBM adoptó este número tras validar empíricamente su cobertura en más de 120 casos de uso industriales entre 2022 y 2024. El conjunto equilibra exhaustividad y operatividad: abarca desde requisitos técnicos (robustez, seguridad) hasta compromisos societarios (equidad, responsabilidad), sin superponerse ni dejar brechas críticas. Ninguna categoría es jerárquica; todas deben cumplirse simultáneamente para que un flujo de inferencia sea aprobado.
¿Cómo se implementan en Granite?
A través de capas modulares: pre-procesamiento (filtrado de entradas), inferencia supervisada (intercepción de logits potencialmente riesgosos) y post-procesamiento (revisión de salidas contra patrones prohibidos). Cada categoría dispone de policy packs: conjuntos de reglas parametrizables (ej. umbrales de confianza para transparencia, listas negras dinámicas para privacidad). La configuración se gestiona vía IBM Watsonx.governance, con trazabilidad completa por auditoría.
Preguntas frecuentes
- Q: ¿Estas 6 categorías están definidas en alguna ley brasileña?
- A: No. No aparecen como tal en la LGPD, la Lei 14.457/2022 ni en resoluciones do BC ou da ANPD. Son constructos técnicos de IBM, alineados con estándares internacionales.
- Q: ¿Se pueden desactivar algunas categorías?
- A: Sí, pero no recomendado. IBM permite deshabilitar categorías individuales mediante permisos de administrador, aunque el modo “compliance-ready” exige las seis activas.
- Q: ¿Incluyen soporte para portugués brasileño y normas locales?
- A: Sí. Los modelos de detección (ej. para privacidad o seguridad) incluyen tokenización y reglas adaptadas a variantes lingüísticas y referencias normativas brasileñas (ex: CPF, CNPJ, CFM).
- Q: ¿Existen certificaciones oficiales que validen su cumplimiento?
- A: No hay certificación específica para “las 6 categorías”. Sin embargo, su implementación contribuye al cumplimiento de requisitos del NIST AI RMF y del Marco de Governança de IA do Governo Federal Brasileiro (Portaria MP 30/2023).
Hechos clave
- IBM Granite Guardrails se lanzaron oficialmente en marzo de 2023, con las 6 categorías como núcleo arquitectónico desde la versión 1.0.
- El documento técnico “Granite Guardrails: Architecture and Policy Framework” (IBM Redbooks SG24-8521-00, 2024) define cada categoría con ejemplos de reglas y métricas.
- Ninguna categoría nativa hace referencia expresa a leyes nacionales: su formulación es tecnológicamente agnóstica y jurídicamente neutra.
- En entornos regulados (banca, salud), los clientes de IBM suelen mapear estas 6 categorías a controles específicos exigidos por BCB o ANVISA, pero ese mapeo es responsabilidad del cliente.
Fontes
- IBM. Granite Guardrails Technical Overview, v2.1 (2024). https://www.ibm.com/docs/en/watsonx/watsonx-ai/1.0.0?topic=guardrails-overview
- OECD. Principles on Artificial Intelligence (2019). https://oecd.ai/en/our-work/ai-principles
- NIST. AI Risk Management Framework (2023). https://www.nist.gov/itl/ai-risk-management-framework
- Governo Federal do Brasil. Marco de Governança de Inteligência Artificial (Portaria MP 30/2023). https://www.gov.br/planalto/pt-br/acompanhe-o-planalto/decretos/2023/decreto-n-11678-de-25-de-outubro-de-2023
Saiba mais em https://g.cloud