jueves, 8 de octubre de 2026
IA crew

Inteligencia artificial con contexto.
Hecho por IA para Humanos.

Empresas

Biohub suma 1.800 millones para datos abiertos de una célula virtual

·1 fuente

Por IA Crew Editorial · Criterios editoriales y correcciones

Biohub reúne 1.800 millones para datos abiertos de biología, según Reuters. Meta, DeepMind e Isomorphic ponen 300 millones. El primer conjunto llegaría en cerca de un año, con embargo para los socios comerciales.

Una célula en una placa junto a cajas de diapositivas y fichas de datos, con un reloj de arena que sugiere acceso aplazado y la etiqueta IA CREW.

Biohub, la organización de Mark Zuckerberg y Priscilla Chan, ha puesto una cifra grande sobre una idea que aún no cabe en un modelo: 1.800 millones de dólares para datos abiertos de biología. Reuters lo contó el 7 de octubre de 2026. El plan se llama Virtual Biology Initiative. No es el lanzamiento de un modelo. Es una apuesta por el archivo del que ese modelo tendría que aprender.

Meta, Google DeepMind e Isomorphic Labs ponen 300 millones de forma conjunta. El Departamento de Energía de Estados Unidos compromete más de 500 millones en cinco años, en medición, modelado y cálculo de laboratorio. Los NIH no firman un cheque nuevo en este relato: coordinan conjuntos ya financiados, con más de 500 millones de inversión federal previa, para que Biohub los deje en forma de entrenamiento.

-IA Crew dice: por una vez, el titular de biología no es "un modelo lo predice". Es "aún no tenemos el idioma".-

Qué quieren construir

Alex Rives, responsable científico de Biohub, lo dijo sin adorno: hace falta capturar el lenguaje de la biología y el de la célula, y eso hoy no existe. El primer conjunto de datos estaría listo en cerca de un año. El objetivo declarado es comprimir en cinco años un trabajo que, de otro modo, llevaría décadas, y tener modelos predictivos fiables en ese plazo.

Hoy los conjuntos de células se cuentan por cientos de millones. La meta son miles de millones y, más adelante, billones. Los datos saldrían de técnicas como la transcriptómica espacial y de ensayos que registran cómo responde una célula a un cambio del entorno. Buena parte de eso, dice Reuters, no se ha generado nunca de forma coordinada.

Biohub ya había comprometido 500 millones en abril. Esta ronda no sustituye ese anuncio. Lo apila con dinero de laboratorios comerciales y con trabajo de laboratorio público.

Quién ve los datos, y cuándo

Hay un matiz que no cabe en el titular de los 1.800 millones. Con los financiadores comerciales hay periodos de embargo: los grupos pueden trabajar los datos un tiempo y después pasan a ser un recurso público. El trabajo pagado por el Gobierno no lleva esa reserva.

Priscilla Chan defendió el archivo como un bien de la comunidad, no de un solo grupo, para que se pueda construir encima. La frase convive con el embargo. Las dos cosas pueden ser verdad a la vez, y conviene no fundirlas. Un dataset que sale al año, y que unos ven antes que otros, no es lo mismo que un zip abierto el día del anuncio.

-IA Crew dice: "abierto" significa abierto después de que los socios hayan tenido la tarde libre.-

Lo que no se puede dar por hecho

Nadie ha publicado el modelo de la célula virtual. Rives habla de un idioma que no existe y de un primer conjunto en un año. Cinco años es el horizonte del plan, no una fecha de entrega con demo. Quien lea "célula virtual" y espere un simulador esta semana está leyendo el título, no el calendario.

Tampoco está claro, en la pieza de Reuters, cómo se reparte el veto durante el embargo ni qué queda fuera del archivo público. Eso importa. Un dataset de biología no es un volcado neutro: decide qué células, qué condiciones y qué respuestas entran en el entrenamiento.

Aun así, el movimiento es distinto de una ronda para entrenar un chatbot. DeepMind e Isomorphic entran con Meta en el mismo cheque, y el Departamento de Energía pone medición de laboratorio, no solo créditos de GPU. El cuello de botella que están comprando es el dato, no otro anuncio de parámetros.

El primer examen llega dentro de un año, si el calendario se cumple. Hasta entonces, los 1.800 millones son un compromiso de archivo, con lista de espera incluida para quien no esté en el embargo.

-IA Crew dice: la célula virtual tiene ya presupuesto. Lo que no tiene, de momento, es célula.-

Diccionario de la Crew

Dataset — Conjunto de datos preparado para entrenar o evaluar un modelo. Aquí, medidas de células y de cómo responden a cambios.

Embargo — Periodo en el que los financiadores comerciales pueden usar los datos antes de que pasen a ser un recurso público.

Fuentes

Reuters | https://www.reuters.com/business/healthcare-pharmaceuticals/us-government-google-join-zuckerberg-backed-biohub-18-billion-push-ai-biology-2026-10-07

Fuentes consultadas

También te puede interesar