Situation report active Rev. 2026.9 119 reports 239 source records updated
Real Life After AGI El informe de supervivencia humana
ES

La IA acelera la ciencia y la medicina: avances reales, límites reales

Dónde la IA ha acelerado realmente la ciencia y la medicina —un Nobel, un modelo climático, autorizaciones de la FDA— y dónde el bombo aún supera lo demostrado.

Escrito por
Dwight Ringdahl
Status
Fuentes verificadas
Revisado
Fuentes
11 citadas
Lectura
9 min

Por qué esta página se lee de forma distinta

La mayor parte de este manual se construye en torno a la incertidumbre, el peligro y las lagunas honestas en lo que puede verificarse. Esta página es distinta: recopila resultados científicos impulsados por IA que están fechados, son verificables y, en un caso, ya llevan asociado un premio Nobel — sin embargo, el mismo programa de investigación que produjo ese método premiado con el Nobel también produjo un artículo de Nature formalmente corregido y una herramienta de diagnóstico que funcionó en el laboratorio y tropezó en una clínica real. Sostener ambos hechos a la vez —un logro genuino y una sobreafirmación genuina, del mismo laboratorio, a veces en el mismo año— es precisamente el propósito de esta página, no una contradicción por resolver.

Todo lo que sigue concierne al aprendizaje automático estrecho y específico para una tarea, aplicado a un problema científico o médico, no a la AGI. Que algún futuro sistema general acelere toda la ciencia a la vez es un escenario, tratado en los beneficios de la IA y los costos de oportunidad de la demora; esta página se limita a lo que ya se ha lanzado, publicado o sometido a revisión por pares.

Estructuras de proteínas, resueltas: AlphaFold y el Nobel de 2024

El caso más claro es la predicción de estructuras de proteínas. En octubre de 2024, la Real Academia Sueca de Ciencias otorgó el Premio Nobel de Química conjuntamente a Demis Hassabis y John Jumper, de Google DeepMind, “por la predicción de la estructura de las proteínas”, y a David Baker, de la Universidad de Washington, por el diseño computacional de proteínas (NobelPrize.org, 9 de octubre de 2024) — el más alto honor del campo, cuatro años después de los resultados originales de AlphaFold2 en 2020, y confirmado por una disciplina que pasó esos años realmente usando la herramienta: según se informa, más de dos millones de investigadores en 190 países predijeron estructuras para prácticamente la totalidad de los 200 millones de proteínas conocidas, con una precisión que se acerca a la de los métodos experimentales en los objetivos más difíciles (Nature News, 9 de octubre de 2024).

De la estructura al fármaco: Isomorphic Labs, todavía en desarrollo

El trabajo de DeepMind sobre el plegamiento de proteínas dio origen a Isomorphic Labs, creada para llevar la predicción de estructuras al descubrimiento de fármacos. En enero de 2024 firmó acuerdos con Eli Lilly y Novartis por un valor combinado de aproximadamente 3.000 millones de dólares en hitos potenciales, dirigidos a objetivos de molécula pequeña considerados “no farmacológicos” (TechCrunch, 7 de enero de 2024). A principios de 2026, informes secundarios describían la colaboración como productora de múltiples candidatos preclínicos —todavía a años de un ensayo clínico, y mucho menos de un medicamento aprobado. Hasta el momento de escribir esto, ningún fármaco de esta asociación ha entrado en ensayos con humanos.

AlphaFold aceleró un paso dentro de un largo proceso; no se ha demostrado que acelere el resultado final de ese proceso, medido en terapias aprobadas y no en pagos por hitos. Los beneficios de la IA y los costos de oportunidad de la demora traza la línea entre un beneficio medido y uno proyectado — este es, sin lugar a dudas, uno proyectado.

Descubrimiento de materiales — y una corrección que demuestra que el sistema funciona

El caso más instructivo aquí es la ciencia de materiales, precisamente porque no se quedó como una historia de éxito impecable. En noviembre de 2023, DeepMind publicó GNoME en Nature: un sistema que predijo 2,2 millones de estructuras cristalinas candidatas, de las cuales unas 381.000 se predijeron estables —aproximadamente 45 veces más compuestos estables pero no realizados que todo el registro histórico previo combinado (Merchant et al., Nature, 29 de noviembre de 2023). Un artículo complementario describía un laboratorio robótico autónomo, el “A-Lab”, que usó estas predicciones para sintetizar decenas de materiales nuevos sin intervención humana, en diecisiete días.

En 2024, tres químicos externos —Robert Palgrave (UCL), Leslie Schoop (Princeton) y Susan Latturner (Florida State)— encontraron que aproximadamente dos tercios de los compuestos “nuevos” del A-Lab eran en realidad estructuras ya conocidas, identificadas erróneamente porque su análisis de difracción de rayos X usaba una comparación de patrones de nivel novato en lugar del cuidadoso refinamiento Rietveld que aplicaría un cristalógrafo capacitado; muchos ya estaban en la Base de Datos de Estructuras Cristalinas Inorgánicas. El 19 de enero de 2026, Nature publicó una corrección formal de los autores reconociendo que las afirmaciones de novedad habían sido “objeto de una interpretación errónea” —nuevos para el catálogo propio de la plataforma, no necesariamente nuevos para la ciencia.

Esto no es una historia sobre un fallo de la IA. Las predicciones de estructuras de GNoME no fueron la parte que resultó equivocada; la sobreafirmación estuvo en cómo se definió “nuevo” más adelante en el proceso —y fue detectada y corregida formalmente mediante la revisión por pares ordinaria, dos años después. Eso es el sistema funcionando como se pretende: una publicación en Nature es evidencia sólida, pero no inmune a la corrección, y el estatus real de una afirmación es lo que sobrevive al escrutinio, no lo que decía el comunicado de prensa la semana de su lanzamiento.

Matemáticas: AlphaProof en la Olimpiada, fuera de tiempo

En julio de 2024, DeepMind anunció que AlphaProof y AlphaGeometry 2 habían resuelto cuatro de seis problemas de la Olimpiada Internacional de Matemáticas de ese año, con una puntuación de 28 sobre 42 —nivel de medalla de plata, la primera vez que un sistema de IA lo alcanzaba (DeepMind, 25 de julio de 2024). El propio DeepMind reveló que un problema se resolvió en minutos, pero que otros tomaron hasta tres días de cómputo, algo digno de mención dado que los competidores humanos resuelven los mismos seis problemas en dos sesiones de 4,5 horas. Esto no se presentó ni se evaluó como un envío real a la IMO y no ha sido revisado de forma independiente por pares como resultado de competencia; es una prueba de referencia gestionada por la propia empresa, presentada con honestidad, no una afirmación de que la IA compite con los matemáticos olímpicos bajo las restricciones que estos realmente enfrentan.

Pronóstico del clima: un caso que la revisión por pares ya resolvió

El pronóstico del clima ofrece un contraste útil porque la verdad de referencia llega a diario y no puede manipularse retroactivamente. GraphCast, de DeepMind, publicado en Science en noviembre de 2023, superó al modelo operativo HRES de la agencia meteorológica europea en la gran mayoría de miles de combinaciones evaluadas de variable y horizonte temporal, y produce un pronóstico global a diez días en menos de un minuto usando una sola TPU (DeepMind, 14 de noviembre de 2023). Los pronósticos se califican contra el clima real todos los días, así que este es uno de los dominios más difíciles para sobreafirmar, y años después, el resultado se ha mantenido.

Medicina a escala regulatoria: se multiplican las autorizaciones de la FDA

La IA clínica ha pasado de ser una novedad a un asunto regulatorio rutinario. En abril de 2018, IDx-DR (ahora LumineticsCore) se convirtió en el primer sistema de diagnóstico por IA totalmente autónomo autorizado por la FDA en medicina, aprobado para detectar retinopatía diabética sin interpretación de un médico, en un ensayo con 900 sujetos que mostró una sensibilidad del 87,2% y una especificidad del 90,7% frente a la calificación de expertos (npj Digital Medicine, 2018). Estas autorizaciones ya son rutinarias: las autorizaciones de la FDA para dispositivos habilitados con IA pasaron de aproximadamente 758 a fines de 2024 a 1.039 en diciembre de 2025, con un ritmo que subió de unas 21 a unas 30 al mes, encabezadas por GE HealthCare, Siemens Healthineers, Philips y Canon (The Imaging Wire, 11 de marzo de 2026). Una autorización es un hecho real y verificable —no es la misma afirmación que “esta herramienta funciona bien en su hospital”, que es donde retoma la siguiente sección.

La brecha del laboratorio a la clínica: qué sucede cuando el modelo se encuentra con un paciente real

El caso documentado más claro de la brecha entre la precisión validada y la realidad del despliegue es el sistema de retinopatía diabética de Google Health, que superó el 90% de sensibilidad y especificidad en los ensayos. Desplegado en 11 clínicas de Tailandia entre noviembre de 2018 y agosto de 2019, rechazó aproximadamente el 21% de las cerca de 1.940 imágenes que las enfermeras enviaron por considerarlas “no calificables” —en su mayoría condiciones de iluminación que un lector humano habría aceptado sin pensarlo dos veces—, lo que interrumpió el flujo de trabajo y alargó las visitas de pacientes que a menudo habían viajado horas para hacerse el examen. El hallazgo fue revisado por pares en CHI 2020, un foro líder en interacción humano-computadora, y reportado en su momento por MIT Technology Review (MIT Technology Review, 27 de abril de 2020). Revisiones posteriores sobre la IA en radiología describen esto como un patrón recurrente: el desempeño en el mundo real depende del equipo y el flujo de trabajo locales, no solo de la cifra de precisión de un modelo.

Una herramienta distinta autorizada por la FDA para el accidente cerebrovascular, Viz.ai, muestra la división de otra manera: una revisión sistemática y metaanálisis que agrupó cerca de una docena de estudios y más de 15.000 pacientes aceleró el flujo de trabajo hospitalario sin una mejora estadísticamente significativa en los resultados clínicos que esos flujos de trabajo existen para mejorar. Más rápido no es automáticamente mejor.

Qué dice este patrón sobre el resto del sitio

Todos los casos anteriores fueron producidos por el mismo pequeño conjunto de laboratorios de frontera que este manual analiza en otras partes —principalmente Google DeepMind—, cuya cultura de investigación se trata en cómo difieren los laboratorios de IA de frontera, y cuya concentración de capacidad científica en un puñado de organizaciones es tema propio en concentración de poder: por qué importan unos pocos laboratorios. Esa concentración funciona en ambos sentidos: es la razón por la que un mismo programa puede acumular un premio Nobel, una actuación de medalla de plata en una olimpiada y un artículo de Nature corregido en el lapso de dos años, y por la que el encuadre de estas afirmaciones pasa primero por la publicidad propia de un laboratorio y solo después por una revisión por pares que no le rinde cuentas a este.

Nada de esto es un argumento para descartar los resultados. Un premio Nobel no es bombo publicitario; un pronóstico a diez días producido en menos de un minuto no es bombo publicitario. Pero “la IA está acelerando la ciencia” es verdad de la misma manera en que lo son la mayoría de las afirmaciones duraderas sobre esta tecnología: de forma desigual, con los éxitos más claros en problemas que tienen una verdad de referencia limpia y verificable —una proteína plegada, el clima de mañana, la estabilidad medida de un cristal— y una brecha persistente dondequiera que el último tramo pase por una clínica caótica o un comunicado de prensa sin verificar. La disciplina que detectó el error de GNoME, dos años después, es la disciplina que esta página pide a los lectores aplicar en todo el resto de este sitio.

References

Postura resumida

The Royal Swedish Academy of Sciences awarded the 2024 Nobel Prize in Chemistry jointly to Demis Hassabis and John Jumper of Google DeepMind for protein structure prediction via AlphaFold2, and to David Baker for computational protein design.

The Royal Swedish Academy of Sciences, 2024 Nobel Prize in Chemistry press release
NobelPrize.org, Signed statement
Postura resumida

Isomorphic Labs signed drug-discovery collaborations with Eli Lilly and Novartis worth a combined roughly $3 billion in potential milestones, targeting "undruggable" small-molecule drug targets.

Isomorphic Labs, Alphabet/DeepMind drug-discovery subsidiary
TechCrunch, Secondary coverage
Postura resumida

Merchant et al. used the GNoME deep-learning system to predict 2.2 million candidate crystal structures, of which roughly 381,000 were predicted stable — described as roughly 45 times more stable-but-unrealized compounds than the prior historical record.

Merchant et al., Google DeepMind materials-science researchers
"Scaling deep learning for materials discovery" (Nature), Primary source
Postura resumida

Nature issued a formal author correction acknowledging that the original GNoME/A-Lab novelty claims were 'subject to misinterpretation,' after outside chemists found roughly two-thirds of the announced 'new' compounds were already-known structures misidentified by novice-level X-ray diffraction analysis.

Nature, Peer-reviewed journal, author correction
Nature, Research/report
Postura resumida

Google DeepMind announced that AlphaProof and AlphaGeometry 2 solved 4 of 6 problems at the 2024 International Mathematical Olympiad for a score of 28/42, silver-medal level, while disclosing that some problems took up to three days of compute — well outside the timed competition format.

Google DeepMind, "AI solves IMO problems at silver-medal level" announcement
DeepMind blog, Primary source
Postura resumida

Google DeepMind GraphCast outperformed ECMWF's operational HRES system on 89.3% of 2,760 evaluated variable/lead-time combinations, and generates a 10-day global forecast in under 60 seconds on a single Cloud TPU.

Google DeepMind, "GraphCast: AI model for faster and more accurate global weather forecasting" announcement
DeepMind blog, Primary source
Postura resumida

The Imaging Wire tracked FDA marketing authorizations for AI-enabled medical devices rising from roughly 758 by the end of 2024 to 1,039 by December 2025, with the clearance pace rising from about 21 a month in 2024 to about 30 a month in 2025.

The Imaging Wire, AI-enabled medical device FDA authorization tracker
The Imaging Wire, Secondary coverage
Postura resumida

MIT Technology Review documented that Google Health's diabetic-retinopathy AI, which exceeded 90% sensitivity and specificity in lab conditions, rejected roughly 21% of the ~1,940 retinal images nurses submitted as 'ungradable' across 11 Thai clinics — often due to lighting conditions human graders would have accepted — disrupting clinic workflow.

MIT Technology Review, Contemporaneous report on Google Health's Thailand deployment
MIT Technology Review, Secondary coverage
  1. Nature News, 9 de octubre de 2024 nature.com
  2. npj Digital Medicine , 2018 nature.com
  3. revisión sistemática y metaanálisis pmc.ncbi.nlm.nih.gov

Type to search the manual.

navigate open esc close