Empresa
A Beans Tech e o guardrail brasileiro.
O g.cloud é o guardrail-as-a-service modelo-agnóstico: toda resposta de IA atravessa o portão antes de chegar ao humano. Nasceu em granitic.cloud, roda sobre IBM Granite Guardian (open-weights, Apache-2.0) e codifica a regra brasileira — LGPD, LC 105, OAB, CFM, CPC, LRF.
Manifesto
Por que o g.cloud existe
A Beans Tech é pequena. Bootstrapped. Um fundador. Mortadela no Natal, planilha no resto do ano. Não tem comitê, não tem plenário, não tem alguém para culpar quando a coisa dá errado. Por isso mesmo, a coisa não pode dar errado.
Construímos para o lugar onde errar custa caro: os setores regulados do Brasil — saúde, finanças, jurídico. Aqui, uma resposta de IA que alucina não é um deslize: é um processo. Uma citação inventada não é um detalhe: é uma fraude técnica. Um dado sigiloso que vaza não é um incidente: é uma infração. Cada erro tem nome, lei e consequência.
Por isso o g.cloud existe como um portão, não como um filtro bonito. Toda resposta de IA atravessa o guardrail antes de chegar ao humano. Se a IA alucina, o guardrail bloqueia. Se a citação não existe, o guardrail sinaliza. Se o dado sigiloso tenta sair do perímetro, o guardrail impede. Entre o modelo e a decisão há uma barreira que ninguém atravessa por simpatia — só atravessa passando pela porteira.
Passa o que pode passar — e nada mais. O guardrail não negocia com a pressa, não cede para o prazo, não se comove com o tom de urgência. Ele faz uma única pergunta, toda vez: isso pode chegar ao humano? Se a resposta for não, a resposta simplesmente não chega.
O “g” é guardrail. É granite — a rocha que não cede. É governance — o rastro auditável que fica depois que a resposta foi entregue, porque em setor regulado confiança sem rastro não vale nada. E é grande: grande na responsabilidade, mesmo vindo de uma empresa pequena.
Não vendemos a ideia de que a IA nunca erra. Vendemos a certeza de que, quando ela errar, o erro morre antes de chegar ao humano. O guardrail não precisa ser grande para guardar tudo — precisa ser certo. E o que é certo cabe numa empresa pequena, porque proteger um paciente, um cliente, um processo não nasce do tamanho do time: nasce da teimosia de fazer certo quando ninguém está olhando.
A empresa pode ser até pequena, mas aqui o negócio nasce Grande.
Cinco rails, um portão
O guardrail roda em cada estágio da interação — não só na saída.
Input rail
Antes do modelo: jailbreak, prompt injection, PII no prompt, tópico fora de escopo, idioma.
Retrieval rail
Nos trechos recuperados (RAG): fonte não autorizada, dado sob sigilo, documento vencido.
Dialog rail
No fluxo: política por tenant, persona, escopo regulatório, recusa com justificativa.
Execution rail
Nas ferramentas/agentes: validação de argumentos, allowlist de ações, sem credencial no prompt.
Output rail
Depois do modelo: alucinação, citação inexistente, PII, toxicidade, viés, formato.
Detectores
O que o portão enxerga.
Groundedness & alucinação
Toda afirmação é cotejada com o contexto e o corpus (Planalto, LexML, BCB, ANVISA, RAGJur). Sem lastro, não passa.
Citação verificável
Lei, artigo, acórdão e número de processo conferidos contra a fonte oficial. Inexistente → bloqueio; divergente → alerta.
PII & sigilo
CPF, CNPJ, RG, CNS, e-mail, telefone, conta. Mascara, tokeniza ou bloqueia conforme a política e a base legal (LGPD art. 7/11).
Jailbreak & prompt injection
Heurística + classificador em português, inclusive injeção indireta em documentos e páginas recuperadas.
Governança & evidência
Confiança sem rastro não vale. Aqui, cada decisão deixa recibo.
Policy-as-code
Regras em repositório Git, revisadas por PR, com versão e changelog — o auditor lê a regra, não a promessa.
Recibo público
Cada decisão gera recibo imutável (WORM 7 anos) carimbado no Bitcoin via OpenTimestamps. Verificável sem login.
Observabilidade
Trace por requisição: rail acionado, score, latência, versão da regra. Painel por tenant, exportável para SIEM.
Red-team & avaliação contínua
Suíte de ataques em português (jailbreak, injeção, exfiltração) rodando a cada release; métricas públicas.
Motor open-weights · Hugging Face
Os pesos são públicos. Qualquer auditor baixa, roda e confere.
Granite Guardian 4.1 · 8B
Classificador de risco atual: harm, social bias, jailbreak, violence, profanity, sexual, unethical, PII, groundedness, relevance, function-call. Apache-2.0. Também em GGUF para llama.cpp.
Granite Guardian 3.2 · 5B / 3B-A800M
Variantes leves (MoE 800M ativos) para latência <50ms — o rail de entrada roda aqui. LoRAs de correção de harm e factualidade.
Granite Guardian HAP · 38M / 125M
Detector de hate/abuse/profanity minúsculo, roda inline em CPU dentro do proxy.
Granite Guardian · coleção
Todas as versões (3.0 → 4.1), GGUF, LoRAs e o detector de factualidade 3.2-8B, lado a lado.