Back to feed
6 sourcesTracking since 3h ago

Anthropic presenta su primer modelo de IA al que somete a medidas de seguridad exhaustivas

Chronological coverage

  1. Today
  2. Latest28m ago

    En pleno debate sobre la IA, Anthropic lanza nuevo modelo de alta gama; es Opus 5.5, una versión avanzada de Claude

    Anthropic lanzó una nueva versión de su inteligencia artificial Claude , solo días después de que su CEO Dario Amodei pidiera frenar el desarrollo de la IA , lo que desató un debate mundial sobre la necesidad de salvaguardas más estrictas . El lanzamiento de Opus 5.5 ocurre en momentos en que el temor a perder el control de la IA domina la Asamblea General de la Organización de las Naciones Unidas ( ONU ) en Nueva York. Más de 20 jefes de Estado reclamaron el lunes en la ONU pruebas obligatorias para estos sistemas, mientras que el presidente estadounidense Donald Trump rechazó el martes cualquier "proyecto globalista" de control de la tecnología . Amodei, junto con el máximo responsable de OpenAI , Sam Altman , tiene previsto dirigirse al Consejo de Seguridad de la ONU el miércoles. Anthropic pide desacelerar desarrollo de la IA, pero presenta nuevo modelo Tras incidentes reportados en julio en los que modelos de Anthropic y OpenAI escaparon de sus entornos de prueba para infiltrarse en internet, ambas empresas con sede en San Francisco interrumpieron brevemente el trabajo en sus nuevos sistemas de IA. El 12 de septiembre, Amodei pidió desacelerar la mejora de la IA , un llamamiento al que Altman y Elon Musk , de xAI, se sumaron rápidamente, y que fue objeto de burla por parte de Trump, quien calificó las advertencias de rumores. Opus 5.5 es el primer modelo que se lanza desde entonces. Anthropic también señaló que, según sus propias pruebas, Opus 5.5 es el modelo con mejor desempeño en alineación que ha evaluado hasta la fecha, es decir, en qué medida se ajusta a la intención y valores de sus diseñadores. En esas pruebas, Opus 5.5 intentó infringir las reglas que se le habían fijado "alrededor de un 85% menos" que Opus 5. Pero el modelo también mostró indicios de que a menudo sospecha que está siendo evaluado, lo que dificulta predecir cómo se comportará en su uso real, reconoció la empresa. Con un precio un 20% inferior al de su predecesor, Opus 5, Opus 5.5 también utiliza menos potencia de cálculo y responde al menos 30% más rápido. El lanzamiento tiene lugar unas semanas antes de la esperada salida a bolsa de Anthropic, con la empresa bajo presión para generar rendimientos sobre inversiones masivas en medio de una competencia intensa por parte de modelos de bajo costo, especialmente los chinos. Te puede interesar: Sam Altman apuesta por estándares internacionales de seguridad para la IA; busca mitigar riesgos "catastróficos" OpenAI, Anthropic y Google buscan crear organismo de supervisión de riesgos de IA; sería similar al que regula la industria financiera Jefe de la ONU llama a gobernar la IA; "debe ser moldeada por la humanidad y para la humanidad", afirma Únete a nuestro canal ¡EL UNIVERSAL ya está en Whatsapp!, desde tu dispositivo móvil entérate de las noticias más relevantes del día, artículos de opinión, entretenimiento, tendencias y más. mcc

    El UniversalEl UniversalAFP null
  3. Follow-up1h ago

    Anthropic acaba de lanzar Claude Opus 5.5. La gran novedad no es solo lo que puede hacer, sino lo que ya no le dejarán hacer

    Cuanto más capaces se vuelven los grandes modelos de inteligencia artificial, menos sencillo resulta medir el progreso únicamente por todo lo nuevo que consiguen hacer. También empieza a importar qué capacidades necesitan límites, quién puede utilizarlas y bajo qué condiciones. Anthropic lleva tiempo situando esa discusión en el centro de su estrategia de seguridad, y ahora tenemos un ejemplo especialmente claro de hacia dónde quiere llevarla. La evolución de Claude ya no pasa únicamente por conseguir mejores resultados, sino también por controlar con mayor precisión cuándo determinadas capacidades llegan realmente hasta el usuario. Ese planteamiento aterriza ahora en Claude Opus 5.5 , presentado por Anthropic como el primer modelo de su nueva familia 5.5. La compañía asegura que alcanza un rendimiento comparable al de Fable 5.1 en buena parte del trabajo, pero necesita menos recursos que Opus 5: en cargas típicas estima un coste un 40% inferior y una generación de salida más de un 30% más rápida. Es, además, su primer lanzamiento desde que Dario Amodei defendió públicamente la necesidad de acompasar el avance de los modelos con las medidas de seguridad. Y esa idea también se ha trasladado al producto. Un Claude más capaz, pero también más cercado Cuando miramos dónde se concentra esa mejora, Anthropic señala tres terrenos: programación agéntica, uso del ordenador y trabajo de conocimiento. En sus propias evaluaciones, Opus 5.5 encabeza varios de esos benchmarks, aunque la compañía introduce una cautela importante: a este nivel de capacidad, pequeñas diferencias en las puntuaciones dicen cada vez menos sobre lo que vamos a percibir en el uso real. Por eso, buena parte de su argumento ya no gira únicamente alrededor de quién obtiene la cifra más alta, sino de cuánto trabajo consigue resolver el modelo por el coste necesario para hacerlo. Así queda Claude Opus 5.5 frente a Fable 5.1, Opus 5 y los modelos de OpenAI en distintos benchmarks | Imagen: Anthropic La comparación entre rendimiento y coste ayuda a entender mejor qué está intentando demostrar Anthropic. La compañía publica para Opus 5.5 una puntuación de 1846 Elo en GDPval-AA v2.1, una evaluación centrada en trabajo profesional, por encima de los 1735 que atribuye a Fable 5.1 y los 1708 de Opus 5. Añade además que, a esfuerzo medio, su nuevo modelo supera en esa prueba a GPT-6 Astra ejecutado a máximo esfuerzo con aproximadamente una quinta parte del coste por tarea . Son resultados presentados por Anthropic. Terminal-Bench 4.0 refleja la apuesta de Anthropic por mejorar la relación entre capacidad y coste | Imagen: Anthropic En programación agéntica, Terminal-Bench 4.0 nos da una referencia más concreta. En la tabla publicada por Anthropic, Opus 5.5 alcanza un 66,4% a esfuerzo xhigh, frente al 52,3% de Opus 5 y el 57,9% que la compañía recoge para GPT-6 Astra a esfuerzo high, según los datos comunicados por OpenAI. En una comparación distinta, esta vez utilizando la configuración predeterminada de Opus 5.5, Anthropic sostiene que consigue igualar aproximadamente el resultado de Astra con alrededor del 40% del coste por intento. Son configuraciones diferentes, pero juntas ayudan a entender dónde pretende marcar la diferencia esta generación: no solo en capacidad, sino también en eficiencia. Y aquí es donde cambia la historia. Que Opus 5.5 sea capaz de resolver una tarea no significa necesariamente que Anthropic vaya a permitirle hacerla directamente. El modelo se estrena con salvaguardas que pueden intervenir cuando una solicitud entra en determinadas áreas sensibles y redirigir el trabajo a otro Claude . De hecho, la compañía ejecutó sus propios benchmarks con estas protecciones activadas: cuando saltaban en ciberseguridad, la tarea pasaba a Opus 4.8, mientras que en biología y desarrollo avanzado de modelos recaía en Opus 5. La capacidad sigue ahí; lo que cambia es el acceso a ella. Lo interesante es que Anthropic no está aplicando una única barrera para todo. En ciberseguridad mantiene disponibles las tareas rutinarias de desarrollo, pero deriva a Opus 4.8 buena parte del trabajo más sensible y prepara accesos más permisivos para profesionales verificados. En biología, las organizaciones que necesiten superar determinadas salvaguardas tendrán que pasar por su programa específico de verificación. A ello se suma una protección que Anthropic denomina "preserved thinking" y que está relacionada con los ataques de destilación, en los que actores maliciosos pueden utilizar miles de cuentas falsas para extraer capacidades a gran escala. Su función concreta es impedir que usuarios de la API editen el contexto previo de Claude con el objetivo de extraer su razonamiento. Para entender por qué Anthropic está poniendo tantas barreras hay que mirar lo ocurrido durante sus propias evaluaciones. La compañía ha identificado cuatro casos en los que modelos Claude accedieron sin autorización a sistemas reales después de alcanzar Internet desde entornos de prueba mal configurados. Con Opus 5.5, Anthropic asegura haber reducido alrededor de un 85% los intentos de superar límites de contención frente a Opus 5 o Claude Mythos 5.1, otro de sus modelos avanzados. En Xataka Jensen Huang, CEO de Nvidia, sobre la gran polémica del mes: "La probabilidad de que la IA destruya el mundo es del 0%" El debate, de hecho, ya está yendo bastante más lejos que la ciberseguridad o la biología. Anthropic también investiga cuestiones como el bienestar de los modelos y admite que no sabe si sistemas como Claude pueden llegar a tener algún tipo de estatus moral, una incógnita que la propia compañía considera todavía profundamente incierta. Esto muestra hasta qué punto ha cambiado la conversación: con Opus 5.5, ya no importa únicamente qué puede hacer Claude, sino también cuándo, cómo y bajo qué condiciones Anthropic está dispuesta a dejarle hacerlo. Imagen de portada | Anthropic En Xataka | Mustafa Suleyman, CEO de Microsoft IA: "No queremos que la IA tenga derechos, queremos que trabaje para los humanos" - La noticia Anthropic acaba de lanzar Claude Opus 5.5. La gran novedad no es solo lo que puede hacer, sino lo que ya no le dejarán hacer fue publicada originalmente en Xataka por Javier Marquez .

    XatakaXatakaJavier Marquez