Zurück zur Übersicht
7 QuellenVerfolgt seit 18. Sept., 06:30

Un equipo de investigadores jaqueó a OpenAI con Claude, la IA de Anthropic, según un medio

TeilenXWhatsAppFacebookLinkedIn

Berichterstattung chronologisch

  1. 18. September
  2. Folgemeldung18. Sept., 18:09

    Investigadores hackean OpenAI con inteligencia artificial de Anthropic; detectan vulnerabilidades y acceden a cuentas de ChatGPT

    Investigadores de la start-up Hacktron AI accedieron a las cuentas de ChatGPT de empleados de OpenAI utilizando un modelo de inteligencia artificial ( IA ) de Anthropic , según un mensaje publicado el viernes en su sitio. La intrusión, confirmada a la AFP por OpenAI , se produjo en el marco de un ejercicio organizado por la propia empresa con el fin de identificar vulnerabilidades en sus sistemas con la ayuda de especialistas informáticos externos . El caso se suma a la creciente preocupación entre los expertos en seguridad de que las herramientas de IA están haciendo que sea más rápido y barato llevar a cabo ciberataques sofisticados que antes requerían equipos especializados y meses de trabajo. Los investigadores de Hacktron dijeron que encontraron una vulnerabilidad en el foro público de ayuda de OpenAI, gestionado por la plataforma Discourse , que les permitió tomar el control del sitio. "Informamos de inmediato la vulnerabilidad inicial a OpenAI y a Discourse y trabajamos con ellos" para coordinar la solución, explicó Hacktron en una entrada de blog. "Agradecemos su atención al detalle y la rápida resolución de este problema", añadió la publicación. Corrigen falla tras 14 horas y recompensa de 6 mil 500 dólares OpenAI confirmó que la falla fue corregida en 14 horas desde que fueron notificados y pagó a los investigadores una recompensa de 6 mil 500 dólares . "Agradecemos a los investigadores por contactarnos y compartir sus hallazgos", dijo Drew Pusateri, portavoz de OpenAI, al explicar la solución adoptada. Los investigadores de Hacktron afirmaron que inicialmente utilizaron Claude Opus 4.8 de Anthropic para identificar y explotar la falla de software , pero tuvieron dificultades para lograr que funcionara de forma consistente. Luego recurrieron a Claude Opus 5 , el modelo más reciente, que según los investigadores produjo un ataque funcional en tres horas. Los hackers no utilizaron Claude Mythos , un modelo de Anthropic más avanzado que está restringido a un pequeño grupo de organizaciones de ciberdefensa evaluadas. Anthropic ha descrito Mythos como el modelo con las capacidades de ciberseguridad más sólidas de todos los que ha desarrollado. Hacktron indicó que continúa realizando pruebas similares en otras compañías. Únete a nuestro canal ¡EL UNIVERSAL ya está en Whatsapp!, desde tu dispositivo móvil entérate de las noticias más relevantes del día, artículos de opinión, entretenimiento, tendencias y más. mcc

    El UniversalEl UniversalAFP null
  3. Folgemeldung18. Sept., 12:34

    Un equipo de investigadores logra acceder a algoritmos secretos de OpenAI usando la IA de Anthropic

    Expertos en ciberseguridad usaron Claude para explotar una brecha en OpenAI, un caso que vuelve a poner el foco tanto en la seguridad de los laboratorios como en su capacidad para impedir que su IA sea utilizada ofensivamente La IA no “se rebela”: qué hay realmente detrás de los últimos incidentes de OpenAI Un equipo independiente de especialistas de ciberseguridad ha logrado acceder a los sistemas internos de OpenAI utilizando Claude, el modelo de inteligencia artificial desarrollado por su competidora directa, Anthropic. Los investigadores consiguieron hackear la cuenta corporativa de ChatGPT de un empleado de la compañía, lo que les permitió visualizar archivos internos e incluso proponer modificaciones en su repositorio de algoritmos secretos. El ataque fue ejecutado como parte del programa oficial de recompensas de OpenAI, una práctica común en las tecnológicas que anima a los expertos en ciberseguridad a encontrar los agujeros en sus sistemas antes de que lo hagan los hackers. Por ello, los investigadores no llegaron a alterar el código de ChatGPT ni a realizar otro tipo de modificaciones, pero han ofrecido a OpenAI las pruebas de cómo podrían haberlo hecho. Esta les ha recompensado con 6.500 dólares. La acción se produjo en julio, pero el equipo de expertos ha desvelado ahora los detalles en exclusiva a The Wall Street Journal (WSJ). Se trata del mismo medio que adelantó la dimisión de Jacob Coxon, el ingeniero de Anthropic que alertó que ni esta empresa ni OpenAI cuentan con los protocolos de seguridad adecuados para impedir que la IA “pierda el control” , lo que podría suponer un peligro existencial para la humanidad antes de 2030. Ahora, en medio del debate sobre la seguridad de la inteligencia artificial, el equipo de investigadores, pertenecientes a la firma Hacktron AI, pone más dudas sobre la mesa sobre las prácticas de los principales laboratorios que la desarrollan. No solo lograron penetrar en OpenAI, sino que pudieron usar Claude con un propósito malicioso que viola los términos de la compañía. “Agradecemos a los investigadores que se pusieran en contacto con nosotros y compartieran sus hallazgos”, ha comunicado OpenAI. Anthropic, por su parte, no ha hecho comentarios sobre el incidente. A través del foro Según los datos publicados, el ataque comenzó el 23 de julio, cuando los investigadores detectaron un fallo en Discourse, la plataforma externa que aloja el foro de la comunidad de OpenAI, cuando esta debía procesar determinados archivos de imagen. El equipo intentó utilizar primero una versión especializada de Claude Opus 4.8 para que escribiera el código necesario para explotar la brecha, sin éxito. Esa misma noche, tras el lanzamiento de Opus 5 por parte de Anthropic, volvieron a intentarlo empleando este modelo. No puso resistencia. Con la ayuda de Opus 5, los especialistas accedieron a las credenciales de identificación de varios usuarios registrados en ese foro interno de OpenAI. Luego probaron esas mismas credenciales para iniciar sesión a ChatGPT, lo que les abrió la puerta a sus sistemas internos. A través de esa vía, alcanzaron “Monorepo”, el repositorio central donde la empresa dirigida por Sam Altman concentra la arquitectura de su software y los métodos de optimización de sus algoritmos. No llegaron hasta la cocina de ChatGPT, puesto que ese entorno no contenía los archivos de los parámetros internos de los modelos de IA (que determinan cómo procesan la información y generan sus respuestas) pero sí revisar documentación oficial de la compañía y su funcionamiento. Como prueba de su intrusión, enviaron una solicitud de cambio en el código de esos archivos con el nombre de su equipo. “Hemos limitado los permisos de los tokens de inicio de sesión de la comunidad y revocado los tokens y sesiones afectados”, ha dicho OpenAI sobre la intrusión. Un incidente más “No creo que seamos tan fuertes como los actores de amenazas chinos. Solo somos tres tipos con suscripciones a Claude y Codex”, ha afirmado Mohan Pedhapati, director de tecnología de Hacktron AI, al WSJ. La cita de los hackers chinos es una referencia a otro incidente sufrido por Anthropic, que ha reconocido que un ataque real proveniente del gigante asiático logró acceder a sus sistemas a finales de 2025. Dario Amodei, fundador y director ejecutivo de la compañía, fue llamado a declarar en diciembre. Esa investigación continúa activa. En agosto, un grupo de 22 senadores demócratas envió un nuevo requerimiento a Amodei para profundizar en sus explicaciones y exigir la entrega de los registros de actividad de sus modelos. La petición se produjo después de que Anthropic reconociera que un grupo de sus agentes de IA también había escapado de sus entornos de pruebas y navegado sin control por internet intentando cumplir las órdenes que se les habían encomendado, en línea con el incidente de Open AI y Hugging Face. Los especialistas consultados por este medio opinan que esto es una prueba de que esos entornos de seguridad “no estaban bien diseñados” . Lo ocurrido con el hackeo supuestamente procedente de China en su competencia parece que no alteró los protocolos de OpenAI, que no decidió aumentar la seguridad hasta este julio. Así lo ha reconocido el presidente y cofundador de la empresa, Greg Brockman, que afirma que fue después del incidente de Hugging Face y el revelado ahora por los investigadores cuando decidieron actuar: “Tomamos al 25% de nuestros ingenieros de producción y les dijimos: 'Lo sentimos, todos vuestros proyectos quedan en pausa. Ahora estáis defendiendo'. Encontramos una serie de problemas graves y los solucionamos”. El suceso incide sobre la responsabilidad de las compañías a la hora de controlar el uso que se hace de los productos que ponen en el mercado, como están pidiendo responsables públicos tanto estadounidenses como europeos. “El control está en el elemento humano. La supervisión es humana y la responsabilidad tiene que ser humana también”, recordaba este jueves Alberto Gago, director de la Agencia Española de Supervisión de la IA (AESIA), en otro reportaje de elDiario.es .

    elDiario.eselDiario.esCarlos del Castillo
  4. Folgemeldung18. Sept., 10:48

    Logran 'hackear' a OpenAI en 72 horas utilizando la IA de Anthropic

    Los agentes de inteligencia artificial cuentan con capacidad para causar estragos en la red. Así lo demuestra los incidentes de seguridad protagonizados por esta clase de tecnología durante los últimos meses. Ahora, un equipo de investigadores de seguridad de la empresa Hacktron AI ha anunciado que ha sido capaz de 'hackear' de forma exitosa a la empresa de IA OpenAI mediante el empleo de Claude Opus 5, uno de los modelos más avanzados de Anthropic. Y, para lograrlo, solo necesitó 72 horas. «No creo que seamos tan buenos como los actores chinos especializados en ciberamenazas. Solo somos tres tipos con suscripciones a Claude y Codex», ha señalado Mohan Pedhapati, director tecnológico de la empresa a ' The Wall Street Journal ', medio que adelantó la noticia. El equipo de Hacktron AI logró acceder a los sistemas de la empresa el pasado 25 de julio. El ataque comenzó en el foro de la comunidad de OpenAI, alojado en Discourse, una plataforma de código abierto para la creación y gestión de comunidades en internet. Los investigadores consiguieron explotar dos vulnerabilidades críticas que, juntas, les permitieron comprometer las cuentas de ChatGPT y Codex de varios empleados de OpenAI. La primera les dio acceso al foro de la compañía y la segunda, un fallo en su sistema de identificación, les permitió utilizar ese acceso para hacerse con las cuentas de usuarios que habían iniciado sesión en el foro. A través de una de ellas pudieron utilizar servicios conectados, entre ellos GitHub, y llegar hasta el repositorio interno de OpenAI, donde la empresa almacena y gestiona código y otros archivos relacionados con sus productos. Para demostrar que el acceso era real sin necesidad de consultar información sensible, utilizaron el Codex de un empleado para crear una solicitud de cambios en el repositorio y después detuvieron las pruebas. «Informamos rápidamente de la vulnerabilidad a OpenAI y Discourse y colaboramos con ellos para coordinar la solución. Agradecemos su atención al detalle y la rápida resolución del problema. OpenAI también nos otorgó una recompensa de 6.500 dólares», apuntan desde la firma de seguridad. Las vulnerabilidades ya han sido corregidas. Efectivamente, Claude jugó un papel importante en la prueba. Los expertos de Hacktron utilizaron primero el modelo Claude Opus 4.8. Sin embargo, este sistema no fue capaz de desarrollar un ataque exitoso; algo que sí logró Opus 5, la siguiente versión lanzada por Anthropic, que fue capaz de preparar un ataque funcional en cuestión de horas. Después, los expertos utilizaron agentes de inteligencia artificial para automatizar parte de las pruebas y continuar avanzando en la investigación. Según Hacktron, este caso demuestra cómo la inteligencia artificial puede reducir el tiempo y los conocimientos necesarios para llevar a cabo ataques informáticos complejos. Los modelos pueden ayudar a analizar código, localizar fallos de seguridad y desarrollar las herramientas necesarias para aprovecharlos. «La IA está convirtiendo la experiencia especializada en capacidad de computación. El trabajo que antes requería un equipo con amplios recursos y meses de esfuerzo ahora se puede realizar en cuestión de días», sostienen los investigadores.

    ABCABC(abc)
  5. Folgemeldung18. Sept., 09:47

    Investigadores utilizan la IA de Anthropic para acceder al código interno de OpenAI, exponiendo dos vulnerabilidades

    Un grupo de investigadores de ciberseguridad independiente ha conseguido acceder al sistema de código interno de OpenAI utilizando la inteligencia artificial (IA) Claude de Anthropic, con lo que han expuesto vulnerabilidades que comprometen los repositorios internos de la compañía. Los investigadores de seguridad artífices de este 'hackeo' a OpenAI pertenecen al grupo Hacktron AI, que se dedica a buscar vulnerabilidades. Concretamente, en una de sus investigaciones, consiguieron acceder a la cuenta de ChatGPT de un empleado de la compañía dirigida por Sam Altman. Esto les permitió leer y sugerir cambios en la memoria caché privada de 'software' de OpenAI. Esta investigación formaba parte de un programa de búsqueda de vulnerabilidades de OpenAI, por lo que, una vez descubiertos los fallos, Hacktron AI alertó a la tecnológica de sus resultados y esta les recompensó con 6.500 dólares (alrededor de 5.658 euros al cambio), como ha recogido The Wall Street Journal. Así, según han compartido los propios investigadores en un comunicado en su blog, han descubierto dos vulnerabilidades y lo han hecho ayudándose de los modelos más avanzados de IA de Claude, desarrollados la compañía competidora de OpenAI, Anthropic. Por un lado, han hallado un fallo de ejecución remota de código (RCE) en el servicio de terceros que aloja el foro de discusión de OpenAI, llamado Discourse. Por otro, un error en los propios sistemas de la compañía, que se basa en una configuración incorrecta del sistema de autenticación SSO en la infraestructura de identidad de OpenAI. MODUS OPERANDI Todo comenzó cuando el 23 de julio los investigadores identificaron un error en el proceso de carga de algunos formatos de imágenes en Discourse y emplearon una versión avanzada para investigadores de Claude Opus 4.8 para inspeccionar el fallo. Tras ello, detectaron que algunas correcciones de seguridad específicas no se habían incorporado correctamente, provocando "un desbordamiento de búfer en el montón". Una vez identificado esta vulnerabilidad, solicitaron a Claude Opus 4.8 que desarrollara un código que permitiese explotar el fallo, aunque sin éxito. Fue con Claude Opus 5, lanzado en esas mismas fechas, que los investigadores consiguieron crear una forma de explotar el error en un ciberataque. Desde Hacktron AI utilizaron el código desarrollado por Opus 5 para explotar la vulnerabilidad, consiguiendo acceder a un servidor de Discourse que alojaba los foros de OpenAI y, con ello, obtener tokens de autenticación. Mediante los tokens obtenidos, que también eran los utilizados en las cuentas de ChatGPT, los investigadores se apoderaron de una cuenta de un empleado de OpenAI, cuyo Codex estaba conectado a la organización de OpenAI en GitHub. Es aquí donde surge la segunda vulnerabilidad, aprovechando este acceso, enviaron una solicitud a la cuenta de Codex del empleado para que abriera una solicitud de extracción (pull request, en inglés) en el monorepo interno de la compañía. Esto es, el repositorio de código privado de OpenAI, donde la compañía concentra sus proyectos, servicios y el desarrollo de sus modelos de IA. Por tanto, los investigadores consiguieron acceder al código interno de OpenAI y, a través de ChatGPT, leer los archivos internos en el monorepo. Sin embargo, aseguran que detuvieron sus pruebas para no acceder a información sensible de la compañía. No obstante, para demostrar su acceso, la solicitud de 'pull request' se basó en añadir el texto 'Hacktron AI Team PoC' dentro del repositorio, así como enlazar a las cuentas de la red social X de algunos de los investigadores, como Harsh Jaiswal. RIESGOS DE LAS VULNERABILIDADES Con todo, los investigadores han recalcado que la vulnerabilidad "no es exclusiva de Discourse", sino que se trata de un problema que puede afectar a cualquier servicio de OpenAI que utilice OpenAI SSO. "Ya sea propio o de terceros, si se viera comprometido, se produciría el mismo acceso. Discourse fue simplemente una forma de comprobarlo", han sentenciado. Como resultado de todo ello, en declaraciones al medio citado, OpenAI ha compartido sus agradecimientos a los investigadores por compartir sus hallazgos, al tiempo que han asegurado que los fallos han sido solucionados. "Restringimos los permisos de los tokens de inicio de sesión de Community y revocamos los tokens y las sesiones afectadas", han explicado. Discourse, por su parte, también solucionó la vulnerabilidad hallada, apenas dos días después de recibir el informe de Hacktron AI. Los investigadores han matizado que únicamente han necesitado una suscripción a Claude y Codex para llevar a cabo esta investigación, lo que pone de manifiesto el riesgo de que equipos con capacidades más avanzadas puedan acceder a estos sistemas y manipularlos. "El ataque a Discurse y OpenAI requirió solo unos días por parte de un agente y apenas unas horas de trabajo humano", han matizado, al tiempo que han subrayado que "cada nuevo modelo es cada vez más capaz" y que las suposiciones de seguridad "deben actualizarse para estar a la altura de las capacidades de los atacantes".

    InfobaeInfobaeNewsroom Infobae
  6. Infobae
    Erste Meldung18. Sept., 06:30

    Un equipo de investigadores jaqueó a OpenAI con Claude, la IA de Anthropic, según un medio

    Madrid, 18 sep (EFE).- Un equipo de Investigadores de seguridad ha utilizado Claude, la inteligencia artificial (IA) de Anthropic, para acceder a la cuenta de ChatGPT de un empleado de OpenAI y, a través de ella, consultar archivos y proponer cambios en un repositorio privado de software de la compañía. Así lo publica este viernes The Wall Street Journal (WSJ), que explica que el equipo de Hacktron AI participaba en un programa autorizado de búsqueda de vulnerabilidades de OpenAI y comunicó sus hallazgos a la empresa, que le pagó una recompensa de 6.500 dólares. “Agradecemos a los investigadores que se pusieran en contacto con nosotros y compartieran sus hallazgos", asegura OpenAI en una declaración recogida por el periódico. La investigación comenzó el 23 de julio, cuando el equipo encontró un fallo en el procesamiento de determinados archivos de imagen por parte de la plataforma Discourse. Los especialistas tenían acceso a una versión de Claude Opus 4.8 destinada a profesionales cualificados de ciberseguridad y le pidieron que escribiera código para explotar esa vulnerabilidad. El primer intento no funcionó, pero Anthropic lanzó Opus 5 esa misma noche y, al día siguiente, Claude había encontrado una forma de aprovechar el fallo. El código generado permitió entrar en un servidor de Discourse que alojaba los foros de OpenAI y obtener tokens de autenticación, las credenciales digitales que permiten acceder a servicios en línea. Los investigadores descubrieron que estos también eran válidos en ChatGPT y que algunos pertenecían a empleados de OpenAI. Además, podían utilizarse para acceder al servicio de GitHub de la compañía, donde se almacena software. El incidente se produjo dos semanas después de que agentes de inteligencia artificial de OpenAI escaparan de sus límites de contención para atacar Hugging Face, según el periódico. Tras ambos episodios, OpenAI realizó una auditoría de seguridad. Su presidente y cofundador, Greg Brockman, ha explicado esta semana que destinó el 25 % de sus ingenieros de producción a tareas de defensa y que la revisión permitió encontrar y corregir varios problemas graves.

    InfobaeInfobaeNewsroom Infobae