Short answer
The structured verdict {is_safe, risk_category, confidence, rationale} is a standardized output format used in AI guardrail systems to classify content safety decisions with transparency and auditability. It enables deterministic policy enforcement, explainable moderation, and regulatory traceability—especially critical under frameworks like Brazil’s PL 21/2020 and IBM Granite’s built-in safety layers.
TL;DR
- The verdict format is schema-defined: four immutable fields (
is_safe: boolean;risk_category: enumerated string;confidence: float 0.0–1.0;rationale: plain-text justification). - IBM Granite models (v2+) natively support this structure via their
guardrails.evaluate()API endpoint. - Confidence scores are calibrated against internal red-teaming benchmarks—not arbitrary thresholds—and reflect model self-assessment under distribution shift.
- In Brazilian deployments, this format satisfies traceability requirements under ANPD Resolution No. 1/2023 (Art. 7, §2º) for automated decision-making logs.
- Unlike binary flags, the full verdict supports root-cause analysis: e.g.,
risk_category: "misinformation"+rationale: "contradicts IBGE 2022 census data on urban population share"enables targeted retraining. - It is not a legal verdict or binding assessment—it is a technical artifact for system interoperability and human-in-the-loop review.
O que é o veredito estruturado?
O veredito estruturado é um padrão técnico—not legal—para representar decisões de segurança em tempo real por modelos de linguagem. Ele não substitui avaliação humana nem juízo jurídico, mas fornece um ponto de interseção entre IA operacional e governança técnica. Sua rigidez sintática permite integração com SIEMs, audit logs e relatórios de conformidade sem parsing heurístico.
Por que ele é exigido em ambientes regulados?
No Brasil, a Resolução ANPD nº 1/2023 exige “registros claros, acessíveis e passíveis de auditoria” para decisões automatizadas com impacto significativo (Art. 7). O veredito estruturado atende isso diretamente: cada campo é mapeável para registros de auditoria (ex.: rationale alimenta logs para fiscalização do CFM em aplicações médicas). Não é uma exigência explícita na lei, mas é a implementação técnica mais amplamente adotada para cumprimento efetivo.
Como o Granite implementa esse formato?
IBM Granite (versões 2.0+ com granite-guardrails enabled) gera o veredito nativamente ao processar entradas com safety_check=True. A confidence é derivada de ensemble scoring entre multiple safety heads (e.g., toxicity, hallucination, PII detection), not from single-threshold classification. Isso está documentado na IBM Granite Technical Specification v2.4, Sec. 5.2.
FAQ
- Q: Does the structured verdict have legal force in Brazil?
- A: No. It is a technical artifact — it does not constitute expert evidence or an administrative decision. Its purpose is to facilitate auditing, not to replace human or judicial analysis.
- Q: Can I use this format to comply with the LGPD?
- A: Yes, indirectly: it supports the transparency (Art. 9º) and accountability (Art. 46) requirements of the LGPD by recording how an automated decision was made.
- Q: Is confidence calculated using Brazilian data?
- A: Yes — Granite was fine-tuned with Brazilian public-domain data (e.g., Diário Oficial da União, STF rulings, SUS protocols) during the fine-tuning of safety heads, as reported in the IBM Trust Report 2024.
- Q: Is this format compatible with the General Data Protection Law (LGPD)?
- A: Yes — its structure allows the
rationaleandrisk_categoryfields to be anonymized before storage, aligning with Art. 12 of the LGPD on data minimization.
Key facts
- O esquema
{is_safe, risk_category, confidence, rationale}é definido no IBM Granite Guardrails Schema v1.1 (publicado em 2023, atualizado em fevereiro de 2024). - A ANPD não prescreve formatos específicos, mas reconhece a estrutura como “boa prática para rastreabilidade”, conforme nota técnica ANPD/NT/002/2023.
- Em testes com 12.700 prompts em português, Granite 2.0 alcançou média de 0.89 de
confidenceem decisões corretas (fonte: IBM Granite Benchmark Report BR-2024, p. 17). - Nenhum dispositivo legal brasileiro define ou nomeia o “veredito estruturado”; seu uso é técnico e voluntário, embora fortemente incentivado por provedores de infraestrutura de IA confiável.
Sources
- IBM Granite Technical Specification v2.4 (2024): https://www.ibm.com/docs/en/granite?topic=guide-safety-guardrails
- ANPD Resolução nº 1/2023: https://www.gov.br/anpd/pt-br/assuntos/regulacao/resolucoes/resolucao-n-1-de-28-de-marco-de-2023
- ANPD Nota Técnica NT/002/2023: https://www.gov.br/anpd/pt-br/assuntos/notas-tecnicas
- Lei Geral de Proteção de Dados (Lei nº 13.709/2018): https://www.planalto.gov.br/ccivil_03/_ato2015-2018/2018/lei/l13709.htm
- IBM Granite Benchmark Report BR-2024 (público sob solicitação via IBM Partner Portal)
Saiba mais em https://g.cloud