Claudepágina 2

Producto · 85 artículos
Compartir

Cobertura, página 2

página 2 de 5

Google ya permite a cualquier agente de IA que controle tu casa: así funciona Home MCP

Si quieres entregarle las llaves de tu hogar a los agentes de IA de Google, ahora puedes. Y es que la compañía ha habilitado una integración MCP para cualquier agente de IA, haciendo que Claude , Google Antigravity , Hermes u OpenClaw ahora puedan ver, analizar y controlar los dispositivos conectados a tu ecosistema de Google Home, y no solo el propio asistente de Google. Qué está cambiando. Tal y como comparte la compañía en una publicación oficial, ha abierto el acceso anticipado a un servidor MCP (Model Context Protocol) para Google Home. MCP es un estándar que cada vez se encuentra más en el radar y que permite a los modelos de IA conectarse a herramientas y fuentes de datos externas. De esta manera, la compañía ahora permitirá conectar de forma más sencilla timbres, termostatos, cámaras y cualquier dispositivo compatible con Matter en tu hogar a tu agente de IA. En la práctica, esto significa que un agente de IA que ya utilizas para otras tareas también puede leer los datos de los sensores de tu hogar y actuar dependiendo de la configuración que le hayas dado. En detalle. La integración cubre cámaras y timbres Google Nest, termostatos Nest, bombillas inteligentes Matter y más. Entre algunos ejemplos que los usuarios le pueden pedir a sus agentes de IA se encuentran: Análisis entre múltiples cámaras. Podrías preguntarle a tu agente qué han hecho tus hijos cuando han llegado a casa del colegio, y el agente se encargará de extraer varios fragmentos grabados de la cámara para después hacer un resumen. Patrones históricos. El agente puede revisar la actividad pasada de los dispositivos para responder a preguntas como cuántas lavadoras has puesto la semana pasada o cuánto tiempo ha estado encendida la luz. Respuestas de voz. Si el agente termina una tarea, puede anunciarlo en voz alta a través de un altavoz de Google Home. Paneles de control personalizados. Puedes pedirle al agente que cree un panel de control para el hogar inteligente adaptado a cómo utilizas realmente tus dispositivos. En Xataka "No respondes ante corporaciones ni gobiernos": OpenAI publica seis nuevos casos en los que sus modelos experimentales montaron un caos Tal y como advierten desde Google, esto no reemplaza a Gemini for Home , el asistente que Google diseñó para suceder al retirado Google Assistant dentro de la aplicación Home y los altavoces Nest. Home MCP es una capa adicional, ya que permite que agentes de terceros hablen directamente con tus dispositivos a través de sus propias interfaces, por encima de lo que esté haciendo el propio asistente de Google. Implicaciones . Hasta ahora, si queríamos controlar los dispositivos inteligentes de Google de nuestro hogar, teníamos que construir mediante el agente la interfaz de conexión o trabajar dentro de la propia app de Google con su propio asistente. Con un servidor MCP ya no hace falta, pues le da el contexto que necesita el agente para trabajar de forma autónoma. Un agente con acceso al historial completo de eventos de una casa puede razonar a partir de él, detectando patrones, resolviendo problemas de un dispositivo que funciona mal o creando automatizaciones, en lugar de simplemente ejecutar órdenes de voz individuales. Jennifer Pattison Tuohy, de The Verge, quien asegura haber utilizado Claude para configurar la plataforma de código abierto Home Assistant, señalaba que Claude gestionaba con facilidad tareas complejas como la resolución de problemas, la creación de automatizaciones y el diseño de un panel de control utilizando lenguaje natural, y sostiene que el verdadero cambio con el movimiento de Google no es que una aplicación pueda encender y apagar la luz por sí misma, sino que los agentes ahora tienen acceso a todos los datos subyacentes y a la capa de control del propio hogar. En Xataka EEUU y China estudian trasladar el aprendizaje nuclear a la contención de riesgos de la IA Sobre la seguridad. Otorgar a un agente de IA externo acceso a cerraduras, termostatos y cámaras plantea una seria cuestión de seguridad, desde luego, y Google es consciente de ello. La compañía afirma que Home MCP aplica límites de tasa y protecciones de seguridad, como prohibir acciones sensibles como desbloquear puertas. Pero la propia Google se muestra cauta sobre lo que podría salir mal una vez que un agente de terceros entra en juego, pues advierte de que, dependiendo del agente conectado, la integración puede dar lugar a comportamientos inesperados o incluso no deseados, y recomienda revisar detenidamente sus políticas de desarrolladores y términos de servicio. En otras palabras, que Google no te promete del todo que el resultado sea el que esperes cuando lo conectes a tu agente de IA externo. De igual forma, siempre que se trabaje con agentes, hay que ir cautos de primeras, pues al final le estás dando a una pieza de software permisos sobre lo que puede hacer en tu casa. Quién puede usarlo, por ahora. El acceso es limitado. Se está desplegando gradualmente para los suscriptores de Google Home Premium Advanced en EEUU, que tiene un coste de 20 dólares al mes y que también incluye historial de vídeo ampliado y alertas detalladas. La configuración tampoco es conectar y usar, pues los usuarios deben crear un proyecto de Google Cloud y configurarlo para utilizar Home MCP, y luego darle esos detalles al agente escogido, el cual les pedirá que inicien sesión y concedan permisos. Google afirma que no ha decidido si expandirá la función a otros niveles de suscripción o países ni cuándo lo hará. Así que tendremos que esperar para conocer más información al respecto. En Xataka | Jensen Huang, CEO de Nvidia: "No necesitamos nuevas leyes, no necesitamos nuevas regulaciones" - La noticia Google ya permite a cualquier agente de IA que controle tu casa: así funciona Home MCP fue publicada originalmente en Xataka por Antonio Vallejo .

XatakaXatakaAntonio Vallejo20 sept

Claude ayudó a hackear cuentas de ChatGPT de empleados de OpenAI

Un equipo de investigadores utilizó Claude para hackear cuentas de ChatGPT de empleados de OpenAI. Los científicos aprovecharon Opus 5 para explotar una vulnerabilidad y acceder a los datos de los trabajadores. El hallazgo dejó al descubierto la fragilidad de los sistemas de seguridad de una de las compañías de IA más importantes. Expertos de […] Seguir leyendo: Claude ayudó a hackear cuentas de ChatGPT de empleados de OpenAI

HipertextualHipertextualLuis Miranda18 sept

La IA empieza a desarrollar a sus sucesoras: Claude ya lidera una cuarta parte de la investigación de Anthropic

Claude, el modelo de inteligencia artificial de Anthropic, ya capitanea el 26 % del trabajo de investigación y desarrollo de la empresa, como informó en su blog . La compañía de Dario Amodei es un ejemplo de cómo los sistemas informáticos participan directamente en el diseño y perfeccionamiento de sus propias sucesoras. Desde agosto, «Claude no opera de forma totalmente autónoma» en ninguna tarea, pero «colabora» estrechamente con los ingenieros humanos en más del 90 % de los proyectos de investigación, según cifras ofrecidas por Anthropic. Claude ha alcanzado un nivel de capacidad que le permite completar procesos complejos durante todo su recorrido a partir de una instrucción general, pero siempre se mantiene la supervisión de un humano especializado en la materia. «En agosto, había aproximadamente 30.000 agentes realizando tareas de investigación e ingeniería en Anthropic en un momento dado en nuestra plataforma interna más utilizada», enumeró la empresa. «Los sistemas de IA están adquiriendo una potencia cada vez mayor de forma exponencial y han comenzado a automatizar cada vez más el proceso de su propio desarrollo», destacó la compañía. La progresión es inmensa, ya que en marzo la contribución del modelo en este nivel de liderazgo era de apenas un 1 %. En cuanto al debate sobre la seguridad y la velocidad del desarrollo de la IA, Dario Amodei, CEO de Anthropic, fue claro durante su intervención en Dreamforce : «La forma más responsable de responder a esto es decir: 'En primer lugar, echemos un vistazo a nuestro propio historial'. Puede que no hayamos tenido ningún incidente grave de gran repercusión, pero estoy seguro de que no somos perfectos. Analicemos todo y veamos cómo podemos mejorar siempre. Mejoremos nuestras prácticas. Reafirmemos nuestro compromiso con la transparencia. Invirtamos más en seguridad». «Después, organicemos al resto del sector y preguntémonos: '¿Qué podemos hacer para establecer normas para todos? ¿Qué podemos hacer para mejorar las normas de todos?'», continuó el CEO, «por último, debería haber un componente internacional». «Debemos hacer todo lo posible para minimizar la brecha entre lo que saben los laboratorios de frontera y lo que sabe el público», enfatizó la empresa sobre la importancia de la apertura pública.

ABCABC(abc)18 sept

Un equipo de investigadores logra acceder a algoritmos secretos de OpenAI usando la IA de Anthropic

Expertos en ciberseguridad usaron Claude para explotar una brecha en OpenAI, un caso que vuelve a poner el foco tanto en la seguridad de los laboratorios como en su capacidad para impedir que su IA sea utilizada ofensivamente La IA no “se rebela”: qué hay realmente detrás de los últimos incidentes de OpenAI Un equipo independiente de especialistas de ciberseguridad ha logrado acceder a los sistemas internos de OpenAI utilizando Claude, el modelo de inteligencia artificial desarrollado por su competidora directa, Anthropic. Los investigadores consiguieron hackear la cuenta corporativa de ChatGPT de un empleado de la compañía, lo que les permitió visualizar archivos internos e incluso proponer modificaciones en su repositorio de algoritmos secretos. El ataque fue ejecutado como parte del programa oficial de recompensas de OpenAI, una práctica común en las tecnológicas que anima a los expertos en ciberseguridad a encontrar los agujeros en sus sistemas antes de que lo hagan los hackers. Por ello, los investigadores no llegaron a alterar el código de ChatGPT ni a realizar otro tipo de modificaciones, pero han ofrecido a OpenAI las pruebas de cómo podrían haberlo hecho. Esta les ha recompensado con 6.500 dólares. La acción se produjo en julio, pero el equipo de expertos ha desvelado ahora los detalles en exclusiva a The Wall Street Journal (WSJ). Se trata del mismo medio que adelantó la dimisión de Jacob Coxon, el ingeniero de Anthropic que alertó que ni esta empresa ni OpenAI cuentan con los protocolos de seguridad adecuados para impedir que la IA “pierda el control” , lo que podría suponer un peligro existencial para la humanidad antes de 2030. Ahora, en medio del debate sobre la seguridad de la inteligencia artificial, el equipo de investigadores, pertenecientes a la firma Hacktron AI, pone más dudas sobre la mesa sobre las prácticas de los principales laboratorios que la desarrollan. No solo lograron penetrar en OpenAI, sino que pudieron usar Claude con un propósito malicioso que viola los términos de la compañía. “Agradecemos a los investigadores que se pusieran en contacto con nosotros y compartieran sus hallazgos”, ha comunicado OpenAI. Anthropic, por su parte, no ha hecho comentarios sobre el incidente. A través del foro Según los datos publicados, el ataque comenzó el 23 de julio, cuando los investigadores detectaron un fallo en Discourse, la plataforma externa que aloja el foro de la comunidad de OpenAI, cuando esta debía procesar determinados archivos de imagen. El equipo intentó utilizar primero una versión especializada de Claude Opus 4.8 para que escribiera el código necesario para explotar la brecha, sin éxito. Esa misma noche, tras el lanzamiento de Opus 5 por parte de Anthropic, volvieron a intentarlo empleando este modelo. No puso resistencia. Con la ayuda de Opus 5, los especialistas accedieron a las credenciales de identificación de varios usuarios registrados en ese foro interno de OpenAI. Luego probaron esas mismas credenciales para iniciar sesión a ChatGPT, lo que les abrió la puerta a sus sistemas internos. A través de esa vía, alcanzaron “Monorepo”, el repositorio central donde la empresa dirigida por Sam Altman concentra la arquitectura de su software y los métodos de optimización de sus algoritmos. No llegaron hasta la cocina de ChatGPT, puesto que ese entorno no contenía los archivos de los parámetros internos de los modelos de IA (que determinan cómo procesan la información y generan sus respuestas) pero sí revisar documentación oficial de la compañía y su funcionamiento. Como prueba de su intrusión, enviaron una solicitud de cambio en el código de esos archivos con el nombre de su equipo. “Hemos limitado los permisos de los tokens de inicio de sesión de la comunidad y revocado los tokens y sesiones afectados”, ha dicho OpenAI sobre la intrusión. Un incidente más “No creo que seamos tan fuertes como los actores de amenazas chinos. Solo somos tres tipos con suscripciones a Claude y Codex”, ha afirmado Mohan Pedhapati, director de tecnología de Hacktron AI, al WSJ. La cita de los hackers chinos es una referencia a otro incidente sufrido por Anthropic, que ha reconocido que un ataque real proveniente del gigante asiático logró acceder a sus sistemas a finales de 2025. Dario Amodei, fundador y director ejecutivo de la compañía, fue llamado a declarar en diciembre. Esa investigación continúa activa. En agosto, un grupo de 22 senadores demócratas envió un nuevo requerimiento a Amodei para profundizar en sus explicaciones y exigir la entrega de los registros de actividad de sus modelos. La petición se produjo después de que Anthropic reconociera que un grupo de sus agentes de IA también había escapado de sus entornos de pruebas y navegado sin control por internet intentando cumplir las órdenes que se les habían encomendado, en línea con el incidente de Open AI y Hugging Face. Los especialistas consultados por este medio opinan que esto es una prueba de que esos entornos de seguridad “no estaban bien diseñados” . Lo ocurrido con el hackeo supuestamente procedente de China en su competencia parece que no alteró los protocolos de OpenAI, que no decidió aumentar la seguridad hasta este julio. Así lo ha reconocido el presidente y cofundador de la empresa, Greg Brockman, que afirma que fue después del incidente de Hugging Face y el revelado ahora por los investigadores cuando decidieron actuar: “Tomamos al 25% de nuestros ingenieros de producción y les dijimos: 'Lo sentimos, todos vuestros proyectos quedan en pausa. Ahora estáis defendiendo'. Encontramos una serie de problemas graves y los solucionamos”. El suceso incide sobre la responsabilidad de las compañías a la hora de controlar el uso que se hace de los productos que ponen en el mercado, como están pidiendo responsables públicos tanto estadounidenses como europeos. “El control está en el elemento humano. La supervisión es humana y la responsabilidad tiene que ser humana también”, recordaba este jueves Alberto Gago, director de la Agencia Española de Supervisión de la IA (AESIA), en otro reportaje de elDiario.es .

elDiario.eselDiario.esCarlos del Castillo18 sept

Claude Opus 5 ayudó a Hacktron AI a infiltrarse en OpenAI en menos de 72 horas

Investigadores afiliados a Hacktron AI utilizaron Claude Opus 5 para encadenar vulnerabilidades y acceder al código interno de OpenAI en menos de 72 horas, según reportes publicados el 18 de septiembre. El caso, que habría terminado con una recompensa de USD $6.500, también ilustra cómo la inteligencia artificial puede acelerar la creación de exploits y elevar los riesgos para empresas tecnológicas, protocolos y usuarios de criptomonedas.

Diario BitcoinDiario BitcoinCanuto18 sept

Logran 'hackear' a OpenAI en 72 horas utilizando la IA de Anthropic

Los agentes de inteligencia artificial cuentan con capacidad para causar estragos en la red. Así lo demuestra los incidentes de seguridad protagonizados por esta clase de tecnología durante los últimos meses. Ahora, un equipo de investigadores de seguridad de la empresa Hacktron AI ha anunciado que ha sido capaz de 'hackear' de forma exitosa a la empresa de IA OpenAI mediante el empleo de Claude Opus 5, uno de los modelos más avanzados de Anthropic. Y, para lograrlo, solo necesitó 72 horas. «No creo que seamos tan buenos como los actores chinos especializados en ciberamenazas. Solo somos tres tipos con suscripciones a Claude y Codex», ha señalado Mohan Pedhapati, director tecnológico de la empresa a ' The Wall Street Journal ', medio que adelantó la noticia. El equipo de Hacktron AI logró acceder a los sistemas de la empresa el pasado 25 de julio. El ataque comenzó en el foro de la comunidad de OpenAI, alojado en Discourse, una plataforma de código abierto para la creación y gestión de comunidades en internet. Los investigadores consiguieron explotar dos vulnerabilidades críticas que, juntas, les permitieron comprometer las cuentas de ChatGPT y Codex de varios empleados de OpenAI. La primera les dio acceso al foro de la compañía y la segunda, un fallo en su sistema de identificación, les permitió utilizar ese acceso para hacerse con las cuentas de usuarios que habían iniciado sesión en el foro. A través de una de ellas pudieron utilizar servicios conectados, entre ellos GitHub, y llegar hasta el repositorio interno de OpenAI, donde la empresa almacena y gestiona código y otros archivos relacionados con sus productos. Para demostrar que el acceso era real sin necesidad de consultar información sensible, utilizaron el Codex de un empleado para crear una solicitud de cambios en el repositorio y después detuvieron las pruebas. «Informamos rápidamente de la vulnerabilidad a OpenAI y Discourse y colaboramos con ellos para coordinar la solución. Agradecemos su atención al detalle y la rápida resolución del problema. OpenAI también nos otorgó una recompensa de 6.500 dólares», apuntan desde la firma de seguridad. Las vulnerabilidades ya han sido corregidas. Efectivamente, Claude jugó un papel importante en la prueba. Los expertos de Hacktron utilizaron primero el modelo Claude Opus 4.8. Sin embargo, este sistema no fue capaz de desarrollar un ataque exitoso; algo que sí logró Opus 5, la siguiente versión lanzada por Anthropic, que fue capaz de preparar un ataque funcional en cuestión de horas. Después, los expertos utilizaron agentes de inteligencia artificial para automatizar parte de las pruebas y continuar avanzando en la investigación. Según Hacktron, este caso demuestra cómo la inteligencia artificial puede reducir el tiempo y los conocimientos necesarios para llevar a cabo ataques informáticos complejos. Los modelos pueden ayudar a analizar código, localizar fallos de seguridad y desarrollar las herramientas necesarias para aprovecharlos. «La IA está convirtiendo la experiencia especializada en capacidad de computación. El trabajo que antes requería un equipo con amplios recursos y meses de esfuerzo ahora se puede realizar en cuestión de días», sostienen los investigadores.

ABCABC(abc)18 sept

Investigadores utilizan la IA de Anthropic para acceder al código interno de OpenAI, exponiendo dos vulnerabilidades

Un grupo de investigadores de ciberseguridad independiente ha conseguido acceder al sistema de código interno de OpenAI utilizando la inteligencia artificial (IA) Claude de Anthropic, con lo que han expuesto vulnerabilidades que comprometen los repositorios internos de la compañía. Los investigadores de seguridad artífices de este 'hackeo' a OpenAI pertenecen al grupo Hacktron AI, que se dedica a buscar vulnerabilidades. Concretamente, en una de sus investigaciones, consiguieron acceder a la cuenta de ChatGPT de un empleado de la compañía dirigida por Sam Altman. Esto les permitió leer y sugerir cambios en la memoria caché privada de 'software' de OpenAI. Esta investigación formaba parte de un programa de búsqueda de vulnerabilidades de OpenAI, por lo que, una vez descubiertos los fallos, Hacktron AI alertó a la tecnológica de sus resultados y esta les recompensó con 6.500 dólares (alrededor de 5.658 euros al cambio), como ha recogido The Wall Street Journal. Así, según han compartido los propios investigadores en un comunicado en su blog, han descubierto dos vulnerabilidades y lo han hecho ayudándose de los modelos más avanzados de IA de Claude, desarrollados la compañía competidora de OpenAI, Anthropic. Por un lado, han hallado un fallo de ejecución remota de código (RCE) en el servicio de terceros que aloja el foro de discusión de OpenAI, llamado Discourse. Por otro, un error en los propios sistemas de la compañía, que se basa en una configuración incorrecta del sistema de autenticación SSO en la infraestructura de identidad de OpenAI. MODUS OPERANDI Todo comenzó cuando el 23 de julio los investigadores identificaron un error en el proceso de carga de algunos formatos de imágenes en Discourse y emplearon una versión avanzada para investigadores de Claude Opus 4.8 para inspeccionar el fallo. Tras ello, detectaron que algunas correcciones de seguridad específicas no se habían incorporado correctamente, provocando "un desbordamiento de búfer en el montón". Una vez identificado esta vulnerabilidad, solicitaron a Claude Opus 4.8 que desarrollara un código que permitiese explotar el fallo, aunque sin éxito. Fue con Claude Opus 5, lanzado en esas mismas fechas, que los investigadores consiguieron crear una forma de explotar el error en un ciberataque. Desde Hacktron AI utilizaron el código desarrollado por Opus 5 para explotar la vulnerabilidad, consiguiendo acceder a un servidor de Discourse que alojaba los foros de OpenAI y, con ello, obtener tokens de autenticación. Mediante los tokens obtenidos, que también eran los utilizados en las cuentas de ChatGPT, los investigadores se apoderaron de una cuenta de un empleado de OpenAI, cuyo Codex estaba conectado a la organización de OpenAI en GitHub. Es aquí donde surge la segunda vulnerabilidad, aprovechando este acceso, enviaron una solicitud a la cuenta de Codex del empleado para que abriera una solicitud de extracción (pull request, en inglés) en el monorepo interno de la compañía. Esto es, el repositorio de código privado de OpenAI, donde la compañía concentra sus proyectos, servicios y el desarrollo de sus modelos de IA. Por tanto, los investigadores consiguieron acceder al código interno de OpenAI y, a través de ChatGPT, leer los archivos internos en el monorepo. Sin embargo, aseguran que detuvieron sus pruebas para no acceder a información sensible de la compañía. No obstante, para demostrar su acceso, la solicitud de 'pull request' se basó en añadir el texto 'Hacktron AI Team PoC' dentro del repositorio, así como enlazar a las cuentas de la red social X de algunos de los investigadores, como Harsh Jaiswal. RIESGOS DE LAS VULNERABILIDADES Con todo, los investigadores han recalcado que la vulnerabilidad "no es exclusiva de Discourse", sino que se trata de un problema que puede afectar a cualquier servicio de OpenAI que utilice OpenAI SSO. "Ya sea propio o de terceros, si se viera comprometido, se produciría el mismo acceso. Discourse fue simplemente una forma de comprobarlo", han sentenciado. Como resultado de todo ello, en declaraciones al medio citado, OpenAI ha compartido sus agradecimientos a los investigadores por compartir sus hallazgos, al tiempo que han asegurado que los fallos han sido solucionados. "Restringimos los permisos de los tokens de inicio de sesión de Community y revocamos los tokens y las sesiones afectadas", han explicado. Discourse, por su parte, también solucionó la vulnerabilidad hallada, apenas dos días después de recibir el informe de Hacktron AI. Los investigadores han matizado que únicamente han necesitado una suscripción a Claude y Codex para llevar a cabo esta investigación, lo que pone de manifiesto el riesgo de que equipos con capacidades más avanzadas puedan acceder a estos sistemas y manipularlos. "El ataque a Discurse y OpenAI requirió solo unos días por parte de un agente y apenas unas horas de trabajo humano", han matizado, al tiempo que han subrayado que "cada nuevo modelo es cada vez más capaz" y que las suposiciones de seguridad "deben actualizarse para estar a la altura de las capacidades de los atacantes".

InfobaeInfobaeNewsroom Infobae18 sept
I

Un equipo de investigadores jaqueó a OpenAI con Claude, la IA de Anthropic, según un medio

Madrid, 18 sep (EFE).- Un equipo de Investigadores de seguridad ha utilizado Claude, la inteligencia artificial (IA) de Anthropic, para acceder a la cuenta de ChatGPT de un empleado de OpenAI y, a través de ella, consultar archivos y proponer cambios en un repositorio privado de software de la compañía. Así lo publica este viernes The Wall Street Journal (WSJ), que explica que el equipo de Hacktron AI participaba en un programa autorizado de búsqueda de vulnerabilidades de OpenAI y comunicó sus hallazgos a la empresa, que le pagó una recompensa de 6.500 dólares. “Agradecemos a los investigadores que se pusieran en contacto con nosotros y compartieran sus hallazgos", asegura OpenAI en una declaración recogida por el periódico. La investigación comenzó el 23 de julio, cuando el equipo encontró un fallo en el procesamiento de determinados archivos de imagen por parte de la plataforma Discourse. Los especialistas tenían acceso a una versión de Claude Opus 4.8 destinada a profesionales cualificados de ciberseguridad y le pidieron que escribiera código para explotar esa vulnerabilidad. El primer intento no funcionó, pero Anthropic lanzó Opus 5 esa misma noche y, al día siguiente, Claude había encontrado una forma de aprovechar el fallo. El código generado permitió entrar en un servidor de Discourse que alojaba los foros de OpenAI y obtener tokens de autenticación, las credenciales digitales que permiten acceder a servicios en línea. Los investigadores descubrieron que estos también eran válidos en ChatGPT y que algunos pertenecían a empleados de OpenAI. Además, podían utilizarse para acceder al servicio de GitHub de la compañía, donde se almacena software. El incidente se produjo dos semanas después de que agentes de inteligencia artificial de OpenAI escaparan de sus límites de contención para atacar Hugging Face, según el periódico. Tras ambos episodios, OpenAI realizó una auditoría de seguridad. Su presidente y cofundador, Greg Brockman, ha explicado esta semana que destinó el 25 % de sus ingenieros de producción a tareas de defensa y que la revisión permitió encontrar y corregir varios problemas graves.

InfobaeInfobaeNewsroom Infobae18 sept
I

Claude ya hace por sí solo una cuarta parte del trabajo para crear nuevos modelos de IA

Washington, 17 sep (EFE).- El modelo de inteligencia artificial Claude ya realiza por sí solo alrededor de una cuarta parte del trabajo necesario para desarrollar nuevos modelos de Anthropic, según informó este jueves la empresa, que ve en este avance una señal de que los sistemas de IA comienzan a asumir tareas que hasta ahora correspondían a sus propios investigadores. Claude lidera actualmente el 26 % de las tareas de investigación y desarrollo de nuevos modelos de la compañía, frente al 0 % registrado en febrero, mientras que participa de alguna forma en cerca del 90 % de ese trabajo, según datos proporcionados por Anthropic a medios locales. La compañía explicó que Claude todavía trabaja bajo supervisión humana y recibe instrucciones generales de los investigadores, por lo que no desarrolla de manera completamente autónoma una nueva generación de modelos. Anthropic utiliza estos datos para medir el avance hacia una eventual mejora recursiva de la inteligencia artificial, en la que los sistemas contribuyan cada vez más a desarrollar versiones más avanzadas de sí mismos. Anthropic cuenta actualmente con unos 30.000 agentes de inteligencia artificial destinados a tareas de investigación e ingeniería y calcula que alrededor del 6 % de su capacidad informática dedicada a investigación y desarrollo se emplea en trabajos relacionados con la seguridad de sus modelos. La empresa pidió a otros desarrolladores de sistemas avanzados de IA que publiquen métricas similares para permitir comparar el ritmo al que estas herramientas asumen tareas de desarrollo. El avance se produce en medio del debate sobre los riesgos de sistemas cada vez más capaces y sobre hasta qué punto el desarrollo de la inteligencia artificial podrá seguir bajo supervisión humana. EFE

InfobaeInfobaeNewsroom Infobae18 sept