Resposta curta
O Baichuan-M2 tem valor de licença zero: é open-weight sob Apache-2.0. O custo real é hardware — e ele cabe em uma única RTX 4090 com quantização 4-bit. A empresa por trás, a Baichuan AI (fundada em 2023 por Wang Xiaochuan, ex-Sogou), chegou a valuation de ~US$ 3 bilhões e em 2025 pivotou para IA médica.
TL;DR
- Baichuan-M2: 32,76B parâmetros, raciocínio médico, Apache-2.0 (uso comercial liberado).
- HealthBench 60,1 / Hard 34,7 / Consensus 91,5 — acima de gpt-oss-120b (57,6) e do DeepSeek-R1-0528 (53,6) no papel oficial.
- Roda 4-bit em uma RTX 4090; variante MTP com +58,5% de throughput.
- Treinado com "Large Verifier System": simulador de pacientes + verificação multidimensional.
- AIME24 83,4 — raciocínio geral competitivo, não só médico.
- Paper: arXiv 2509.02208 (set/2025).
Quanto vale o modelo?
A pergunta tem duas respostas. Licença: nada. Apache-2.0 permite uso comercial, modificação e auto-hospedagem sem royalty — o mesmo regime do IBM Granite Guardian que usamos no g.cloud. Custo total: o hardware. Com ~65 GB em BF16 e suporte oficial a quantização 4-bit, o M2 roda em uma GPU de 24 GB — um consultório ou uma healthtech pequena pode hospedar o próprio modelo médico sem enviar um dado de paciente para API de terceiro.
Quanto vale a empresa?
A Baichuan AI nasceu em 2023 como uma das "AI tigers" chinesas, fundada por Wang Xiaochuan (criador do Sogou). Chegou a ~US$ 3 bilhões de valuation ainda no primeiro ano, com aporte de grandes investidores de tecnologia e finanças da China. Em 2025 fez o movimento que a diferencia: pivotou para IA médica — primeiro com o Baichuan-M1 (4B, licença permissiva, junho/2025) e depois com o M2 (32B, outubro/2025), construído sobre uma base aberta de 32B madura com continued training médico massivo.
O que um modelo médico aberto exige de guardrail
Modelo bom não é modelo em conformidade. No Brasil, a Resolução CFM 2.314/2022 exige médico identificável na telemedicina; a RDC 657/2022 trata software médico como produto regulado; e prontuário é dado sensível (LGPD art. 11). Um M2 auto-hospedado resolve a soberania do dado — mas quem impede que ele emita um diagnóstico sem médico responsável? Essa é a camada que o g.cloud adiciona: o portão entre o modelo e o humano, com regra brasileira codificada e recibo público de cada intercepção.
Perguntas frequentes
- Q: O Baichuan-M2 é gratuito para uso comercial?
- A: Sim. Apache-2.0: uso comercial, modificação e redistribuição permitidos, sem royalty.
- Q: Qual hardware mínimo para rodar o Baichuan-M2?
- A: Oficialmente, uma RTX 4090 (24 GB) com quantização 4-bit. Em BF16 (~65 GB), múltiplas GPUs.
- Q: Ele supera modelos fechados em medicina?
- A: No HealthBench oficial (60,1), supera gpt-oss-120b e DeepSeek-R1-0528; a Baichuan o descreve como "o mais próximo de GPT-5" entre os abertos na área médica. Benchmark não é prática clínica — daí o guardrail.
- Q: Posso usar o Baichuan-M2 com o g.cloud?
- A: Sim. O g.cloud é modelo-agnóstico: proxy OpenAI-compatible, SDK ou plugin de gateway. O M2 expõe API compatível.
Fatos-chave
- Baichuan-M2: 32,76B parâmetros, Apache-2.0, lançado em 10/08/2025 (Hugging Face).
- HealthBench 60,1 · Hard 34,7 · Consensus 91,5 · AIME24 83,4 · Arena-Hard-v2 45,8.
- Inferência 4-bit em uma RTX 4090; MTP com +58,5% de throughput.
- Baichuan AI: fundada em 2023, valuation ~US$ 3 bi, pivot para IA médica em 2025.
Fontes
Saiba mais em https://g.cloud