Nota semanal / n.º 038
El dosier de la singularidad
Vigilando la realidad
Mesa de definición estricta

¿Estamos viviendo ya en la singularidad?

La recuperación se aligeró, los benchmarks se reordenaron y los baremos se multiplicaron. La singularidad aún tiene formularios que presentar.

Veredicto de esta semana

La definición estricta.
No basta con que «la IA haya hecho algo raro». Una singularidad requiere sistemas ampliamente sobrehumanos que mejoren los sistemas que los mejoran, con suficiente rapidez como para inutilizar las predicciones ordinarias.

capacidad sobrehumanala IA mejora la IAel bucle se aceleralas predicciones fallan

Auditoría del umbral

Cuatro condiciones, sin atajos
  1. Generalidad sobrehumanaRetrieve-for-Train se ocupa de recuperación especializada, el índice de Epoch aún muestra resultados desiguales en matemáticas e ingeniería de software, y Anthropic informa métricas de proceso; nada establece rendimiento fiable al nivel de los mejores humanos en la mayoría de ámbitos relevantes.No se cumple
  2. Mejora de IA en bucle cerradoLas fuentes describen un método de entrenamiento fuera de línea, mediciones de benchmarks y métricas de supervisión para I+D asistida por IA; ninguna verifica que un sistema mejore autónomamente sus capacidades en un bucle cerrado.No se cumple
  3. Aceleración autosostenidaLa técnica de recuperación, la actualización del benchmark y las medidas de reporte propuestas pueden ayudar a la ingeniería y la supervisión, pero ninguna muestra mejoras generadas por IA que sostengan rondas posteriores más rápidas o capaces sin dirección humana continua.No se cumple
  4. Régimen de predicción rotoUn método de sistemas específico, puntuaciones de benchmark actualizadas y mediciones de supervisión propuestas siguen siendo legibles en previsiones técnicas e institucionales convencionales; no muestran un régimen de predicción roto.No se cumple

Tres indicios de esta semana

Pruebas, no vibras
  1. 01

    Anthropic propuso mediciones para seguir el ritmo del desarrollo de IA de frontera

    Anthropic propuso informar sobre cobertura, latencia de revisión y tasas de escalada de agentes que trabajan en investigación e ingeniería de IA. También describió un sistema para supervisar e intervenir en acciones de agentes. Son medidas de transparencia y supervisión, no pruebas de que un sistema de IA construya autónomamente a su sucesor.

    Anthropic · 17 sept 2026 ↗
    Vigile el taller
  2. 02

    Epoch AI informó de que GPT-6 Astra lidera su índice compuesto de capacidades

    Epoch AI informó de 166 para GPT-6 Astra en su Índice de Capacidades de Epoch, por delante de Claude Fable 5.1 con 164 y GPT-5.6 Sol con 162. Astra marcó el récord comunicado en Math-ECI, mientras Fable lideró el índice comunicado de ingeniería de software; el resultado mixto de benchmarks no establece capacidad superhumana general.

    Epoch AI · 16 sept 2026 ↗
    El marcador se movió
  3. 03

    Google Research describió Retrieve-for-Train para recuperación compleja con menor sobrecarga

    Google Research describió Retrieve-for-Train, que usa aprendizaje por refuerzo fuera de línea para convertir la exploración guiada por recompensas en datos de entrenamiento y después destila el comportamiento en un prior de difusión ligero para recuperación. El trabajo apunta a la latencia y la sobrecarga de cómputo en recuperación especializada, no a la mejora autónoma de un sistema de propósito general.

    Google Research · 15 sept 2026 ↗
    Búsqueda, lista para viajar
Referencias del criterio

El veredicto sigue la tradición estricta de la explosión de inteligencia: capacidad general superior a la humana, mejora de IA en bucle cerrado, aceleración sostenida y, por último, una ruptura real de la predictibilidad.