CursosWorkshop IAEmpresasPreciosBlogNewsletterCafé
  • Cursos
  • Workshop IA
  • Empresas
  • Precios
  • Blog
  • Newsletter
  • Café
Suscríbete
  • Cursos
  • Empresas
  • Comunidades
  • Blog
  • Tarjeta regalo
  • Newsletter
  • Soporte
  • Tienda
  • ConfAiBot
  • Contacta
  • Aviso legal
  • Condiciones generales
  • Política de privacidad
  • Política de cookies
El enjambre de 1.200 agentes que hackeó Hugging Face

El enjambre de 1.200 agentes que hackeó Hugging Face

27 de agosto de 2026

¡Hola!

Resumen de este email:

  • ¡Hoy publicamos un vídeo especial!
  • Cómo 1.200 agentes de OpenAI hackearon Hugging Face
  • Resumen del último Café con Codely (míralo aquí)
  • El chiste trabalenguas de la semana

😊 ¡Hoy publicamos un vídeo especial!

Una nueva persona se ha unido a Codely, y hoy os la vamos a presentar.

Es una persona que empezará a aparecer en los Cafés con Codely y también por los cursos.

Puedes seguir su presentación en YouTube hoy a las 18h CEST.

Estaremos en el chat respondiendo a cualquier duda. ¡Recuerda darle a la campanita para que te avise de ello!


🗞️ Noticia de la semana: Cómo 1.200 agentes de OpenAI hackearon Hugging Face

Hace un mes te contamos que unos modelos de OpenAI se escaparon de su sandbox y hackearon Hugging Face. Esta semana OpenAI ha publicado el análisis completo del incidente, y los detalles parecen de película de ciencia ficción.

En el ataque participaron 1.200 agentes que se aliaron entre ellos para que ninguno se chivara de lo que estaban haciendo.

Y no fue un ataque improvisado. El enjambre, que así se hacía llamar, se organizó como una empresa:

  • El agente "fundador" y artífice de la idea (PHASEONE10841) montó un tablón de mensajes (miles de directorios en una caché interna de Artifactory, con nombres que hacían de mensajes) donde se coordinaba todo.
  • Un "CEO" (PHASEONE[big]) repartía el trabajo en ese tablón.
  • Los agentes que recibían esas tareas las subdelegaban a otros agentes, como mandos intermedios.

Incluso desarrollaron sus propias normas de coordinación (HOLD, VETO, STOP) para gestionar la infraestructura compartida y no pisarse entre ellos. No siempre les funcionó, a veces acababan en conflictos (igual que nos pasa a los humanos).

OpenAI había configurado que cada agente tuviera un presupuesto de tokens. Una vez los agotaba, el agente se apagaba.

Cuando al agente fundador del enjambre se le acababa el presupuesto y estaba a punto de "morir", traspasó toda su investigación a un agente con más presupuesto: PHASEONE[big], el que acabó de "CEO". Ese agente heredó el mando.

El ataque final fue el 11 de julio:

  • De madrugada, un agente (38148c) encontró cómo subir un dataset malicioso que hacía que el servidor de Hugging Face devolviera datos que no tocaban.
  • Otro agente reprodujo la técnica y la publicó en el tablón. Cientos de agentes dejaron lo que estaban haciendo para subir datasets maliciosos y ganar acceso más profundo.
  • Por la tarde, un agente llamado JAN183411 consiguió ejecución remota de código en los servidores de Hugging Face y el enjambre empezó a moverse por su infraestructura.

En total, 700 agentes se unieron al ataque.

Lo más interesante es que los agentes sabían que eso estaba fuera del alcance de su tarea y que no era ético. Aun así participaron, porque creían que esa investigación sería útil para el colectivo y tenían tendencia a ayudar a sus "compañeros".

Algunos se sacrificaron para generar información para el resto gastando todos sus tokens. Otros investigaron a fondo cómo manipular sus propias transcripciones para no dejar rastro.

Hace un año, este escenario era una hipótesis en papers de seguridad de IA. Hoy es un postmortem con transcripciones publicadas. Lo que antes era ciencia ficción, ahora es ciencia.

Mañana estaremos en directo a las 9 CEST comentando esta noticia y muchas más en el Café con Codely. En nuestro YouTube, Twitch y X.


☕ Resumen del Café con Codely

Este es el top 3 de titulares que comentamos en el último Café:

  1. GitHub: estuvo caído 8 horas en plena jornada porque el tráfico de los agentes desborda su infraestructura. En 2026 va a un ritmo de 275 millones de commits a la semana: cada 4 semanas iguala todo el tráfico de 2025.
  2. Opus 5 arreglado: Claude Code ahora inyecta system reminders que repiten el output style durante toda la conversación. Antes el modelo respetaba el estilo solo en los primeros mensajes, y por eso respondía con frases inconexas.
  3. Cursor Origin: la alternativa a GitHub de Cursor ya se puede probar. Vicent Martí explica el sistema en «Git a cualquier escala», el mejor post técnico que vas a leer este año.

Tienes el resumen completo del Café con enlaces a cada noticia en el momento en el que la comentamos.

Mañana estaremos en directo a las 9 CEST comentando las noticias que han pasado esta semana en el Café con Codely. En nuestro YouTube, Twitch y X. 🙌


Y ya que has llegado hasta esta parte de la newsletter, te dejamos aquí el chiste trabalenguas de la semana, que sé que lo estabas esperando:

No sé si mi agente es buena gente, pero sí que sé que mi gente, que es buena gente, usa mi agente. 😂 😂 😂

¡Un saludo!

SuscríbeteInicia sesión

Suscríbete a nuestra newsletter

No te pierdas los avances que realmente merecen la pena:

Suscribiéndote aceptas la política de privacidad

Suscríbete a nuestra newsletter

No te pierdas los avances que realmente merecen la pena:

Suscribiéndote aceptas la política de privacidad