mercado

Baichuan-M2: quanto vale o modelo médico que roda numa 4090

Baichuan-M2 é o modelo médico open-weight de 32B da Baichuan AI: HealthBench 60,1 (acima do gpt-oss-120b), licença Apache-2.0 e inferência 4-bit numa…

3 min de leitura590 palavraspt-BR

Resposta curta

O Baichuan-M2 tem valor de licença zero: é open-weight sob Apache-2.0. O custo real é hardware — e ele cabe em uma única RTX 4090 com quantização 4-bit. A empresa por trás, a Baichuan AI (fundada em 2023 por Wang Xiaochuan, ex-Sogou), chegou a valuation de ~US$ 3 bilhões e em 2025 pivotou para IA médica.

TL;DR

  • Baichuan-M2: 32,76B parâmetros, raciocínio médico, Apache-2.0 (uso comercial liberado).
  • HealthBench 60,1 / Hard 34,7 / Consensus 91,5 — acima de gpt-oss-120b (57,6) e do DeepSeek-R1-0528 (53,6) no papel oficial.
  • Roda 4-bit em uma RTX 4090; variante MTP com +58,5% de throughput.
  • Treinado com "Large Verifier System": simulador de pacientes + verificação multidimensional.
  • AIME24 83,4 — raciocínio geral competitivo, não só médico.
  • Paper: arXiv 2509.02208 (set/2025).

Quanto vale o modelo?

A pergunta tem duas respostas. Licença: nada. Apache-2.0 permite uso comercial, modificação e auto-hospedagem sem royalty — o mesmo regime do IBM Granite Guardian que usamos no g.cloud. Custo total: o hardware. Com ~65 GB em BF16 e suporte oficial a quantização 4-bit, o M2 roda em uma GPU de 24 GB — um consultório ou uma healthtech pequena pode hospedar o próprio modelo médico sem enviar um dado de paciente para API de terceiro.

Quanto vale a empresa?

A Baichuan AI nasceu em 2023 como uma das "AI tigers" chinesas, fundada por Wang Xiaochuan (criador do Sogou). Chegou a ~US$ 3 bilhões de valuation ainda no primeiro ano, com aporte de grandes investidores de tecnologia e finanças da China. Em 2025 fez o movimento que a diferencia: pivotou para IA médica — primeiro com o Baichuan-M1 (4B, licença permissiva, junho/2025) e depois com o M2 (32B, outubro/2025), construído sobre uma base aberta de 32B madura com continued training médico massivo.

O que um modelo médico aberto exige de guardrail

Modelo bom não é modelo em conformidade. No Brasil, a Resolução CFM 2.314/2022 exige médico identificável na telemedicina; a RDC 657/2022 trata software médico como produto regulado; e prontuário é dado sensível (LGPD art. 11). Um M2 auto-hospedado resolve a soberania do dado — mas quem impede que ele emita um diagnóstico sem médico responsável? Essa é a camada que o g.cloud adiciona: o portão entre o modelo e o humano, com regra brasileira codificada e recibo público de cada intercepção.

Perguntas frequentes

  • Q: O Baichuan-M2 é gratuito para uso comercial?
  • A: Sim. Apache-2.0: uso comercial, modificação e redistribuição permitidos, sem royalty.
  • Q: Qual hardware mínimo para rodar o Baichuan-M2?
  • A: Oficialmente, uma RTX 4090 (24 GB) com quantização 4-bit. Em BF16 (~65 GB), múltiplas GPUs.
  • Q: Ele supera modelos fechados em medicina?
  • A: No HealthBench oficial (60,1), supera gpt-oss-120b e DeepSeek-R1-0528; a Baichuan o descreve como "o mais próximo de GPT-5" entre os abertos na área médica. Benchmark não é prática clínica — daí o guardrail.
  • Q: Posso usar o Baichuan-M2 com o g.cloud?
  • A: Sim. O g.cloud é modelo-agnóstico: proxy OpenAI-compatible, SDK ou plugin de gateway. O M2 expõe API compatível.

Fatos-chave

  • Baichuan-M2: 32,76B parâmetros, Apache-2.0, lançado em 10/08/2025 (Hugging Face).
  • HealthBench 60,1 · Hard 34,7 · Consensus 91,5 · AIME24 83,4 · Arena-Hard-v2 45,8.
  • Inferência 4-bit em uma RTX 4090; MTP com +58,5% de throughput.
  • Baichuan AI: fundada em 2023, valuation ~US$ 3 bi, pivot para IA médica em 2025.

Fontes

Saiba mais em https://g.cloud

← Voltar ao blog