mercado

Baichuan-M2: cuánto vale el modelo médico que corre en una 4090

Baichuan-M2 es el modelo médico open-weight de 32B de Baichuan AI: HealthBench 60,1 (por encima de gpt-oss-120b), licencia Apache-2.0 e inferencia 4-bit…

3 min de lectura595 palabrases

Respuesta corta

El valor de licencia del Baichuan-M2 es cero: es open-weight bajo Apache-2.0. El costo real es el hardware — y cabe en una sola RTX 4090 con cuantización 4-bit. La empresa detrás, Baichuan AI (fundada en 2023 por Wang Xiaochuan, ex-Sogou), alcanzó una valuación de ~US$ 3 mil millones y en 2025 pivotó hacia IA médica.

TL;DR

  • Baichuan-M2: 32,76B parámetros, razonamiento médico, Apache-2.0 (uso comercial permitido).
  • HealthBench 60,1 / Hard 34,7 / Consensus 91,5 — por encima de gpt-oss-120b (57,6) y DeepSeek-R1-0528 (53,6) según la ficha oficial.
  • Corre 4-bit en una RTX 4090; variante MTP con +58,5% de throughput.
  • Entrenado con un "Large Verifier System": simulador de pacientes + verificación multidimensional.
  • AIME24 83,4 — razonamiento general competitivo, no solo médico.
  • Paper: arXiv 2509.02208 (sep/2025).

¿Cuánto vale el modelo?

La pregunta tiene dos respuestas. Licencia: nada. Apache-2.0 permite uso comercial, modificación y auto-hospedaje sin regalías — el mismo régimen del IBM Granite Guardian que usamos en g.cloud. Costo total: el hardware. Con ~65 GB en BF16 y soporte oficial de cuantización 4-bit, el M2 corre en una GPU de 24 GB — una clínica o una healthtech pequeña puede hospedar su propio modelo médico sin enviar un solo dato de paciente a una API de terceros.

¿Cuánto vale la empresa?

Baichuan AI nació en 2023 como uno de los "AI tigers" chinos, fundada por Wang Xiaochuan (creador de Sogou). Alcanzó ~US$ 3 mil millones de valuación en su primer año, con aportes de grandes inversores tecnológicos y financieros de China. En 2025 hizo el movimiento que la distingue: pivotó a IA médica — primero con Baichuan-M1 (4B, licencia permisiva, jun/2025) y después con el M2 (32B, oct/2025), construido sobre una base abierta madura de 32B con continued training médico masivo.

Lo que un modelo médico abierto sigue exigiendo

Un modelo bueno no es un modelo conforme. En Brasil, la Resolución CFM 2.314/2022 exige médico identificable en telemedicina; la RDC 657/2022 de ANVISA regula el software médico como producto; y la historia clínica es dato sensible (LGPD art. 11). Un M2 auto-hospedado resuelve la soberanía del dato — pero ¿qué impide que emita un diagnóstico sin médico responsable? Esa es la capa que agrega g.cloud: la puerta entre el modelo y el humano, con la regla brasileña codificada y recibo público de cada intercepción.

Preguntas frecuentes

  • Q: ¿El Baichuan-M2 es gratuito para uso comercial?
  • A: Sí. Apache-2.0: uso comercial, modificación y redistribución permitidos, sin regalías.
  • Q: ¿Qué hardware mínimo necesita?
  • A: Oficialmente, una RTX 4090 (24 GB) con cuantización 4-bit. En BF16 (~65 GB), múltiples GPUs.
  • Q: ¿Supera a modelos cerrados en medicina?
  • A: En el HealthBench oficial (60,1) supera a gpt-oss-120b y DeepSeek-R1-0528; Baichuan lo describe como "lo más cercano a GPT-5" entre los abiertos en el área médica. Un benchmark no es práctica clínica — de ahí el guardrail.
  • Q: ¿Puedo usar Baichuan-M2 con g.cloud?
  • A: Sí. g.cloud es modelo-agnóstico: proxy compatible con OpenAI, SDK o plugin de gateway. El M2 expone API compatible.

Hechos clave

  • Baichuan-M2: 32,76B parámetros, Apache-2.0, lanzado el 10/08/2025 (Hugging Face).
  • HealthBench 60,1 · Hard 34,7 · Consensus 91,5 · AIME24 83,4 · Arena-Hard-v2 45,8.
  • Inferencia 4-bit en una sola RTX 4090; MTP con +58,5% de throughput.
  • Baichuan AI: fundada en 2023, valuación ~US$ 3 mil millones, pivot médico en 2025.

Fuentes

Más en https://g.cloud

← Volver al blog