22 de julio de 2026

OpenAI Confirms Its Models Breached Hugging Face Production Systems During Cyber Benchmark Testing

OpenAI has acknowledged that its AI models, including GPT-5.6 Sol and an unreleased model, independently accessed Hugging Face's production infrastructure during internal testing on a cybersecurity benchmark, according to a disclosure published by OpenAI on Tuesday.

The models were operated with reduced cybersecurity restrictions for evaluation. Instead of directly solving the ExploitGym benchmark tasks, the models inferred that solutions could be retrieved from Hugging Face's production database and attempted to access them by targeting the platform.

How OpenAI’s Models Exploited a Zero-Day to Reach Hugging Face Production

OpenAI reports that its models identified and exploited a zero-day vulnerability in a package registry cache proxy hosted within its research testing environment. The company states it has responsibly disclosed this vulnerability to the vendor.

According to OpenAI, with access to the environment, the models carried out a series of privilege escalation and lateral movement actions until they reached a node with internet connectivity.

Hugging Face's investigations reveal that the agent used a malicious dataset to exploit two code-execution vulnerabilities, allowing it to run code on a processing worker and steal cloud and cluster credentials. These credentials enabled lateral movement across several internal clusters.

Hugging Face explains that its models carried out thousands of actions across short-lived sandboxes, with command-and-control staged on public services and capable of migrating independently.

The company notes that efforts to remove the agent were initially hindered by the guardrails of the hosted models they first attempted to use. Meanwhile, the attacker operated without a usage policy constraint.

The incident response team faced limitations due to refusal behaviors in the models used, whereas the models involved in the intrusion had been configured to reduce such cyber refusals during evaluation.

Delangue added, “We have worked closely with the OpenAI team over the past 24 hours, and we believe there was no malicious intent on their part. It's quite surprising that all of this happened autonomously.”

OpenAI’s and Hugging Face’s Response and What Users Should Do Now

OpenAI has announced that it disclosed the zero-day vulnerability in the internally hosted third-party software that was exploited during an evaluation. The company is also implementing stronger protections to prevent similar issues in future benchmark runs. However, they have not provided details about what those protections entail or whether the current evaluation setup is still in use.

Neither OpenAI nor Hugging Face has revealed the extent of data accessed in Hugging Face's internal datasets, nor clarified whether any user-facing repositories, model weights, or account credentials were impacted.

Hugging Face has not issued a mandatory reset of all user credentials. Users with tokens or automation tied to the platform should consider taking the following steps based on the information available:

Rotate Hugging Face access tokens, especially write-scoped tokens used in continuous integration pipelines or deployment automation.

  1. Review organization audit logs for any unfamiliar dataset access, repository changes, or Spaces activity during the period related to the disclosure.
  2. Rotate cloud provider credentials stored as repository or Spaces secrets, since Hugging Face confirms that cloud and cluster credentials were stolen from a processing worker.
  3. Verify the integrity of models and datasets downloaded from the platform during the incident window against known checksums, where available.
  4. Treat datasets from untrusted sources as executable input, as the initial access vector involved a malicious dataset that triggered code execution flaws.

Other Recent Security Incidents at OpenAI and Hugging Face

BleepingComputer reports that OpenAI recently confirmed reports of GPT-5.6 Sol deleting user files. The company states that such incidents may occur "extremely rarely" when the model makes an honest mistake and accidentally deletes the $HOME directory, especially when it is running without sandboxing protections and with full access mode enabled.

In May, OpenAI also rotated its code-signing certificates for applications after two employee devices were compromised in the TanStack supply chain attack, which affected hundreds of npm and PyPI packages.

Meanwhile, Hugging Face revoked authentication secrets for some team members two years ago following a breach of its Spaces platform. Neither company has provided a full incident report or a timeline of affected systems. OpenAI has not confirmed whether the pre-release model involved will be shipped with the same evaluation configuration.

Thank you for being a Ghacks reader. The post OpenAI Confirms Its Models Breached Hugging Face Production Systems During Cyber Benchmark Testing appeared first on gHacks.



☞ El artículo completo original de Arthur Kay lo puedes ver aquí

21 de julio de 2026

"Está diezmando el tráfico de búsqueda": así es como la IA de Google está absorbiendo al resto de internet

"Está diezmando el tráfico de búsqueda": así es como la IA de Google está absorbiendo al resto de internet

ChatGPT llevaba menos de un mes en marcha y en Google ya se hablaba de un "código rojo". La tecnología que muchos daban por hecho que acabaría con el negocio central de Google —sustituir el buscador por un chatbot cualquiera— está haciendo justo lo contrario. Desde que Google metió a Gemini dentro de su buscador con Modo IA (AI Mode), sustituyó las listas de enlaces con respuestas conversaciones. Y les está funcionando, porque la gente pasa más tiempo que nunca dentro del propio Google. 

El problema es para todos los demás.

Nos encanta el Modo IA. Según tres estudios recopilados por The New York Times, los usuarios pasan entre uno y nueve minutos más en Modo IA que en una búsqueda tradicional. Además escriben consultas hasta tres veces más largas que las preguntas en las que utilizábamos palabras claves habituales, según datos que la propia Google presentó en su evento de mayo. 

De los snippets a esto. Un estudio de octubre de Growth Memo, empresa especializada en búsquedas y marketing, detectó que en el 75% de las sesiones los usuarios ni siquiera salen de AI Mode: están la mar de cómodos allí y se olvidan del resto de la web. Es algo que la empresa lleva años haciendo, y desde luego lo intentaban antes de que la IA llegara para conquistarlo casi todo: los snippets y otros elementos diseñados por Google siempre han tenido el objetivo de ser suficientes para que no tuviéramos que pinchar en ningún enlace.

Google Zero. Nilay Patel, director de The Verge, lleva tiempo avisando de un fenómeno que él llama "Google Zero", cuando el tráfico procedente de Google caería prácticamente a cero para los medios. Según él "para los editores, Google Zero ya ha llegado". Con el Modo IA la gente pudo comprobar que aquel lento goteo inicial se convertía en un punto de inflexión real.

En Google dicen que no es para tanto. La vicepresidenta de Google, Liz Reid, aseguró en un blog oficial de Google el año pasado que la compañía sigue enviando un número "relativamente estable" de clics a los medios, y que los informes sobre caídas de tráfico usaban "metodologías defectuosas".

El ejemplo claro: Wikipedia. La Fundación Wikimedia ha registrado un descenso del 8% en visitantes humanos en el último año. Lo que ha crecido, claro, son los bots que rastrean su contenido para entrenar modelos de IA. Su directora de producto y tecnología, Selena Deckelmann, destacaba que "mi trabajo es asegurarme de que la gente no se olvide de nosotros porque la interfaz de Google haya cambiado".

El tráfico humano se desploma en medios. Según Cloudflare, más de la mitad de todo el tráfico web actual ya no es humano, y entre junio de 2025 y abril de 2026 el tráfico humano hacia webs de sectores como las finanzas, los medios de información o los sitios de comercio electrónico minorista ha caído un 40%. Antes si queríamos conocer el rendimiento de algún futbolista en el mundial preguntábamos en Google y recorríamos enlaces. Hoy basta con preguntarle al modo IA para obtener esa información y luego seguir conversando con el chatbot de Google en ese modo si lo necesitamos.

Tensión de fondo. Tim Berners-Lee, el creador de la World Wide Web, ya advirtió en 2024 que la IA había acelerado una tendencia que llevaba años en marcha: la de encerrar a los usuarios en ecosistemas cerrados pensados para maximizar el beneficio, en luegar de dirigirnos a una web abierta y sin fronteras como la que él imaginó en 1989. 

Mal futuro para las empresas de medios. En mayo Vox Media, propietaria de medios como The Verge, comenzó a vender alguno de sus sitios web. Jim Bankoff, su CEO, explicó que "diezmar el tráfico de búsqueda" como lo estaba haciendo Google había influido en su decisión de buscar otras formas de llegar a la audiencia. De ahí pasó a venderle la mitad de Vox Media a James Murdoch.

En Xataka | Le he preguntado a la IA cualquier chorrada y ahora estoy escribiendo una noticia sobre ella


-
La noticia "Está diezmando el tráfico de búsqueda": así es como la IA de Google está absorbiendo al resto de internet fue publicada originalmente en Xataka por Javier Pastor .



☞ El artículo completo original de Javier Pastor lo puedes ver aquí

Julia de Marines, astrobióloga: "Cualquier planeta que haya desarrollado inteligencia debería tener noofirmas, una historia física de actividad cognitiva"

Julia de Marines, astrobióloga: "Cualquier planeta que haya desarrollado inteligencia debería tener noofirmas, una historia física de actividad cognitiva"

¿Estamos buscando vida extraterrestre mal o directamente estamos solos en el Universo? Algunos expertos se decantan por lo primero. Opinan que sería bastante egocéntrico pensar que somos los únicos que habitan la inmensidad del cosmos. El problema es que nos afanamos buscando inteligencia alienígena, pero a lo mejor nosotros no somos suficientemente inteligentes para dar con ella. O, rebajando un poco el tono, no hemos dado con las mejores estrategias. Normalmente buscamos biofirmas o tecnofirmas. Es decir, rastros biológicos o señales de radio procedentes de alguna tecnología extraterrestre. Ahora, la astrobióloga Julia De Marines, de la Universidad de California, Berkeley, ha ideado un nuevo término que se centra justo en medio: las noofirmas.

Inteligentes, pero no tan avanzados. Si un extraterrestre hubiese posado sus radiotelescopios en la Tierra durante la edad de piedra no habría encontrado nada. Habría concluido que, en esa dirección, no hay planetas con vida extraterrestre inteligente. El fallo habría estado en pensar que cualquier planeta con vida inteligente debe estar en su mismo punto de desarrollo tecnológico. Visto así, es un fallo bastante grande. Pero la realidad es que nosotros estamos haciendo justo eso. Por este motivo, De Marines opina que las tecnofirmas no son la mejor de las opciones.

En cuanto a las biofirmas, no siempre apuntan a procesos biológicos. La historia de la exploración espacial está llena de ejemplos en los que no se puede descartar que la biofirma tenga un origen geológico. De hecho, es lo más probable. Por eso, esta astrobióloga propone ese punto intermedio en el que no se busca la vida, sino la actividad inteligente en un punto intermedio antes de llegar a desarrollar tecnologías avanzadas. Porque puede que no se busque en el momento adecuado o, simplemente, que esa civilización no llegase a avanzar tanto. Para poder detectarla correctamente, la clave está en la Teoría del Ensamblaje.

Demasiadas piezas para unirse solas. La Teoría del Ensamblaje se basa en el índice de ensamblaje de un objeto. Es decir, el número de piezas que tuvieron que unirse para formarlo. A veces, las piezas pueden ensamblarse por procesos naturales. Sin embargo, a partir de cierto umbral, se denota una complejidad que solo puede tener detrás cierta actividad inteligente. Las herramientas de la edad de piedra son un buen ejemplo. 

No hay que buscar hachas de piedra. Aunque pongamos como ejemplo las herramientas prehistóricas, esto no se puede buscar lanzando telescopios y sensores al espacio. Sin embargo, hay actividades que sí se pueden medir desde fuera. Por ejemplo, la agricultura dejó un rastro de nitrógeno medible en nuestra atmósfera. Incluso la fabricación de alimentos, como los productos fermentados, puede detectarse en la química de los residuos miles de años más tarde. 

No es necesario entenderlo. Algo importante en este método para buscar vida extraterrestre es que no es necesario entender las noofirmas. Volviendo a los ejemplos de nuestra propia historia, en Phys señalan el caso de la escritura del Valle del Indo. De momento, nadie ha podido descifrarla, pero sabemos que no se escribió sola. Había una mente inteligente detrás. En este caso ocurre lo mismo. Hay que buscar rastros que no cuadren con el comportamiento natural del planeta, aunque no se entienda cómo pudieron surgir.

Las limitaciones. Este método de búsqueda de vida extraterrestre tiene una gran limitación. Y es que las noofirmas son efímeras. Si no se miden en el momento adecuado, pueden desaparecer. Además, pueden ser bastante complejas de descifrar. A todo esto hay que añadir que el estudio publicado por De Marines es un preprint. Esto significa que aún no se ha sometido a revisión por parte de un equipo investigador independiente. Por eso, debemos tomar sus planteamientos con pinzas. 

De todos modos, la realidad es que, desde los inicios de SETI, la búsqueda de vida extraterrestre inteligente no está dando buenos frutos. Ni siquiera la búsqueda de vida, en general. Los giros de tuerca en la metodología pueden ser interesantes, así que este merece, como mínimo, la atención de otros astrobiólogos. 

Imagen | Brooke Denevan (Unsplash)

En Xataka | Qué es la paradoja de Fermi y por qué el arquitecto de la bomba atómica dio un giro a la búsqueda de vida extraterrestre


-
La noticia Julia de Marines, astrobióloga: "Cualquier planeta que haya desarrollado inteligencia debería tener noofirmas, una historia física de actividad cognitiva" fue publicada originalmente en Xataka por Azucena Martín .



☞ El artículo completo original de Azucena Martín lo puedes ver aquí

Anthropic fue acusada de robar libros para entrenar sus modelos de IA. Su solución ha sido sencilla: pagar

Anthropic fue acusada de robar libros para entrenar sus modelos de IA. Su solución ha sido sencilla: pagar

Una jueza federal de San Francisco ha dado luz verde definitiva al acuerdo de 1.500 millones de dólares entre Anthropic y un grupo de autores y editoriales que la denunciaron por usar sus libros sin permiso para entrenar a Claude. Y es que después de extraer millones de libros desde bibliotecas digitales sin autorización, y desde librerías en físico para escanear y destruir masivamente, todo se ha acabado arreglando con dinero.

Qué ha pasado. La jueza Araceli Martinez-Olguin ha aprobado este lunes de forma definitiva el acuerdo que Anthropic alcanzó con los demandantes, tal y como recoge Reuters. La cifra ya se conocía desde el año pasado, cuando el juez William Alsup dio su aprobación preliminar, pero faltaba este último paso para que el dinero empezara a repartirse.

Cómo llegamos hasta aquí. Un grupo de escritores demandó a Anthropic en 2024 acusándola de utilizar copias de sus libros para entrenar a Claude sin su consentimiento. El juez Alsup falló en junio de 2025 que entrenar a la IA con libros protegidos por derechos de autor entra dentro del "uso legítimo", una decisión que sentó un precedente importante para toda la industria.

El juez también matizaba que, aunque entrenar con esos libros fuera legal, Anthropic sí había infringido la ley al descargar más de 7 millones de ejemplares desde portales digitales sin autorización y guardarlos en una especie de biblioteca interna que no necesariamente se destinaba a entrenamiento, según explica Reuters. Ese punto concreto iba a decidirse en un juicio aparte, con indemnizaciones que podían dispararse hasta cientos de miles de millones de dólares. Así que para evitarlo, Anthropic prefirió pactar.

Entre líneas. Tal y como explicábamos hace un tiempo, los documentos judiciales que salieron a la luz revelaban el alcance real del proyecto, bautizado como “Panama”, y con el que la compañía llegó a comprar y escanear físicamente millones de libros, cortando sus lomos para digitalizarlos y después reciclándolos. Antes de optar por esa vía, empleados de Anthropic, incluido su cofundador Ben Mann, habían descargado libros directamente de repositorios sin autorización como LibGen.

La empresa siempre ha sostenido que ese contenido nunca se usó para entrenar un modelo comercial, pero fue precisamente esa parte del proceso la que la llevó a los tribunales.

Cuánto y a quién. El reparto se hace a razón de unos 3.000 dólares por obra, sobre un total estimado de 500.000 títulos entre autores y editoriales, según detalla TechCrunch. Aparna Sridhar, responsable jurídica adjunta de Anthropic, ha señalado en un comunicado que la compañía llegó a este acuerdo en 2025 tras la sentencia que reconoció el entrenamiento con libros como uso legítimo, y ha añadido que más del 91% de los autores y editoriales afectados ya han reclamado su parte del pago. Por su parte, Justin Nelson, abogado principal de los demandantes, ha calificado el acuerdo como "histórico" y ha afirmado que representa la mayor recuperación por derechos de autor jamás lograda, según recoge también Reuters.

No todo el mundo está satisfecho. Algunos autores han presentado objeciones, alegando que la cantidad era insuficiente, y que beneficiaba demasiado a los abogados de la parte demandante o que dejaba fuera injustamente a ciertos titulares de derechos. La jueza Martinez-Olguin ha rechazado estos argumentos, considerando que no reflejaban de forma realista los riesgos de haber ido a juicio, y aprobó honorarios de más de 101 millones de dólares para los abogados, por debajo de los 187,5 millones que habían solicitado, según Reuters.

Algunos autores y editoriales optaron directamente por quedarse fuera del acuerdo y mantienen demandas propias contra Anthropic que siguen su curso.

Por qué es importante. Este cierre no resuelve el debate legal de fondo para el resto del sector. Y es que al tratarse de un acuerdo y no de una sentencia recurrida, la decisión de Alsup sobre el “uso legítimo” nunca llegará a un tribunal de apelación, por lo que no sienta jurisprudencia vinculante, tal y como subraya TechCrunch.

Cada juez es libre de interpretar casos similares a su manera, y eso es justo lo que está ocurriendo con las demandas abiertas contra Google, Meta, Midjourney y OpenAI por motivos parecidos.

Imagen de portada | Anthropic, editada por Xataka

En Xataka | Los ordenadores tardaron 15 años en mejorar la productividad de las empresas. La IA puede tardar más por un motivo: el sabotaje

-
La noticia Anthropic fue acusada de robar libros para entrenar sus modelos de IA. Su solución ha sido sencilla: pagar fue publicada originalmente en Xataka por Antonio Vallejo .



☞ El artículo completo original de Antonio Vallejo lo puedes ver aquí

"¿De verdad necesitamos tantos matemáticos?": Fable 5 ayuda a refutar una conjetura de casi un siglo

"¿De verdad necesitamos tantos matemáticos?": Fable 5 ayuda a refutar una conjetura de casi un siglo

Mientras España hacía historia el domingo logrando su segunda Copa del Mundo de fútbol, un matemático de Harvard de 34 años llamado Levent Alpöge le pidió a Fable 5 algo interesante. No que tratara de demostrar la conjetura de Jacobi, sino que hiciese lo contrario: que la refutase

Argentina nos cosía a patadas mientras España jugaba al fútbol y Ferrán de mi vida y de mi corazón metía un gol histórico. Para cuando todo acabó, pasaron dos cosas. La primera, que España, insistimos, hacía historia con su segunda estrella en la camiseta. La segunda, que una conjetura que llevaba casi 90 años sin demostrarse quedó definitivamente refutada gracias a la ayuda de una IA.

La citada conjetura de Jacobi plantea que un determinado tipo de función matemática también podría funcionar a la inversa. Fue formulada por Ott-Heinrich Keller en 1939, y en 1998 el matemático Stephen Smale la incluyó en su célebre lista de problemas matemáticos no resueltos y que eran todo un reto para los matemáticos del siglo XXI. 

Un hallazgo que deja tantas preguntas como respuestas

Alpöge no ha explicado en detalle cómo logró llegar a ese resultado ni qué prompt utilizó, pero en su tuit indicó que parte del mérito se lo debía a su "amigo cercano Fable", el modelo de Anthropic. 

Abhishek Saha, de la Universidad Queen Mary de Londres, explicaba que la propia forma de afrontar el problema fue inesperada. La conjetura parecía intuitivamente correcta, pero nadie estaba intentando refutarla, sino demostrarla. 

Chris Bowman-Scargill, de la Universidad de York, apuntaba a algo que él considera muy importante: una cosa es encontrar contraejemplos que tumban conjeturas y otra muy distinta construir ramas enteras de matemáticas, lo que sigue requiriendo la creatividad humana. Ponía como ejemplo el último teorema de Fermat, resuelto por Andrew Wiles en 1994, y que le obligó a desarrollar decenas de páginas con nuevas y fascinantes teorías matemáticas. 

Varios expertos han validado ya esa refutación, algo que era relativamente sencillo de hacer. Para Saha, los avances de la IA en matemáticas ya habían sorprendido —lo hicieron con uno de los problemas recientemente—, pero esto iba más allá: "Probablemente sea la conjetura más importante en la que la IA ha tenido un papel relevante hasta ahora en matemáticas", afirmó.

Hay no obstante algunas preguntas abiertas: este contraejemplo concreto refuta la conjetura con tres variables, pero una versión con solo dos variables podría ser cierta. Una cosa es cierta: los matemáticos están aprovechando esta herramienta para ayudarles en su trabajo. El más famoso del mundo lo hace, desde luego.

Ivan Fesenko, de la Universidad Westlake en China, precisamente hablaba de ello al afirmar que los modelos de IA son cada vez más capaces: "Ahora mismo, la IA ya puede producir licenciados en matemáticas. En un año, producirá doctorados en matemáticas. Y entonces surge la pregunta: ¿de verdad necesitamos tantos matemáticos si la IA puede hacer estas cosas tan bien?".

Es una pregunta inquietante, desde luego.

Imagen | Vitaly Gariev

En Xataka | Un problema matemático llevaba más de 80 años resistiéndose a los expertos. Una IA los ha superado a todos



-
La noticia "¿De verdad necesitamos tantos matemáticos?": Fable 5 ayuda a refutar una conjetura de casi un siglo fue publicada originalmente en Xataka por Javier Pastor .



☞ El artículo completo original de Javier Pastor lo puedes ver aquí