Anthropic

Organización · 246 artículos
Compartir
9 fuentes20minutosDiario BitcoinEl UniversalExpansiónHipertextualInfobae
hace 8 h

Anthropic lanza Claude Opus 5.5, con un rendimiento a la altura de Fable 5.1 y un 40% más barato

Anthropic ha lanzado Opus 5.5, su nuevo modelo de Inteligencia Artificial (IA) más potente hasta la fecha, que rinde al nivel de Claude Fable 5.1 en la mayoría de las tareas y cuesta un 40 por ciento menos que Opus 5, su predecesor. Se trata del primer modelo del laboratorio de IA compartido tras la llamada a desacelerar el ritmo de desarrollo de esta tecnología que hizo recientemente el CEO de Anthropic, Dario Amodei. Por ello, incorpora salvaguardas de seguridad similares a las del modelo anterior Fable 5.1, sobre todo en biología y ciberseguridad, al ser comparable en estos apartados a Claude Mythos 5.1. "Opus 5.5 es un gran paso hacia delante desde Opus 5. Es el nuevo modelo líder y los primeros probadores vieron grandes saltos en rendimiento en sus trabajos más complejos", afirma Anthropic desde su blog, para señalar a continuación que "es bueno encontrando y corrigiendo ineficiencias en software". En este marco, Anthropic ha añadido que Claude Opus 5.5 alcanza o supera en la mayoría de tareas complejas a modelos de mayor escala (como Fable 5.1), y es más rápido que su predecesor en más de un 30 por ciento. Así, se trata de un nuevo modelo de IA que destaca en programación agéntica (proyectos masivos y continuados), además de superar a sus predecesores en la obtención y verificación de fuentes, y consolidarse como el modelo con "mejor puntuación" en las auditorías de comportamiento automatizadas. Anthropic ha señalado igualmente que genera una redacción más clara, natural y directa. Frente a la competencia, según los datos publicados por la compañía, Opus 5.5 encabeza la comparativa en programación agéntica y trabajo de conocimiento. En programación en terminal (Terminal-Bench 4.0) obtiene un 66,4 por ciento, por delante de GPT-6 Astra (57,9 por ciento) con 8,5 puntos de ventaja, y de GPT-5.6 Sol (37,3 por ciento). Sucede lo mismo en trabajo de conocimiento profesional (GDPval-AA v2.1) con 1.846 puntos Elo frente a los 1.588 y 1.542 de Sol y Astra, respectivamente; en razonamiento multidisciplinar (Humanity's Last Exam) con un 67,7 por ciento, alejándose más de 10 puntos de GPT-6 Astra (57,2 por ciento); y en programación en IDE / entornos reales (CursorBench 4.0 y FrontierCode v1.1) con 57,8 por ciento y 54,4 por ciento respectivamente, por delante de GPT-6 Astra en FrontierCode y de GPT-5.6 Sol en CursorBench. Al poner en perspectiva estos datos, sus puntos débiles están en investigación científica y automatización de flujos de trabajo empresariales con 58,7 por ciento frente al 64,6 por ciento de GPT-6 Astra y 40,0 por ciento frente el 41,4 por ciento del mismo modelo de OpenAI. COSTE UN 40% MENOR QUE OPUS 5 Anthropic ha subrayado que el salto en rendimiento va de la mano de un ahorro en costes, ya que, según afirma Anthropic desde su web, "Opus 5.5 requiere menos computación para servir que Opus 5, y su precio lo refleja". Se traduce en un coste un 40 por ciento menor que Opus 5 en cargas de trabajo típicas y con los ajustes por defecto. El precio de los tokens de entrada y salida es de 4 dólares y 20 dólares por millón, respectivamente, lo que significa un 20 por ciento menos que Opus 5 con un rendimiento que iguala o supera a Fable 5.1. Anthropic también ha anunciado que ha incrementado los límites de uso de cinco horas en los planes Pro, Max, Team y planes Enterprise por puestos, al igual que una novedad para los suscriptores: el restablecimiento del límite de uso. Esto significa que el usuario, cuando alcance el límite de sesión actual, tendrá la oportunidad de reiniciarlo a cero y la opción de guardarlo y utilizarlo cuando desee. Claude Opus 5.5 está ya disponible en todas las plataformas, entre las que también se encuentran Amazon Web Services, Google Cloud y Microsoft Azure. Por último, el laboratorio de IA ha adelantado que Claude Sonnet 5.5 y Claude Haiku 5.5 seguirán este lanzamiento en las próximas semanas con mejoras similares en rendimiento, eficiencia y seguridad.

Compartir

Toda la cobertura

página 1 de 13

Anthropic afirma que Claude identificó un sistema de enzimas comparable con Crispr

Anthropic asegura que Claude identificó de manera autónoma un sistema de enzimas previamente sin caracterizar en bacteriófagos, después de coordinar a casi 950 agentes durante 21 horas y procesar 210 millones de tokens. La empresa compara el hallazgo con la maquinaria detrás de Crispr, aunque todavía no existe evidencia de que tenga una aplicación práctica o un impacto transformador.

Diario BitcoinDiario BitcoinCanutohace 33 min

El Consejo de Seguridad de la ONU debatirá amenazas de la IA; participarán líderes de Open AI y Anthropic

El Consejo de Seguridad de la ONU celebra este miércoles una sesión informativa de alto nivel sobre la inteligencia artificial (IA) bajo el punto de agenda "Mantenimiento de la paz y la seguridad internacionales", reunión en la que participarán los líderes de las tecnológicas OpenAI , Anthropic y Hugging Face. El Consejo, convocado por Francia en el marco de su presidencia rotatoria del organismo, abordará por primera vez de forma específica los riesgos sistémicos y la posible pérdida de control humano sobre los modelos tecnológicos más avanzados. El ministro francés de Europa y Asuntos Exteriores, Jean-Noël Barrot, abrirá la sesión y después intervendrán Yoshua Bengio, premio Turing y copresidente del Panel Científico Internacional sobre IA de la ONU , y Sam Altman, director ejecutivo de OpenAI. También se conectarán por videoconferencia Dario Amodei , consejero delegado de Anthropic , y así como Clément Delangue , máximo responsable de Hugging Face , compañía que clasificada por el ministro francés como una "víctima" tras los ataques que recibió en verano. "A raíz de los incidentes ocurridos este verano, con la pérdida de control de ciertos modelos que se introdujeron en los sistemas de información de algunas empresas tecnológicas, Francia ha decidido dedicar una reunión del Consejo de Seguridad a este asunto", declaró Barrot a los medios. El ministro destacó que se abordará formalmente el impacto de la IA generativa en la proliferación de armas autónomas y su potencial uso malintencionado por actores no estatales, en un momento en que crece la inquietud social con protestas y disturbios vinculados a la instalación de centros de datos. Según detalla la publicación especializada Security Council Report (SCR), la reunión girará en torno a cuatro preguntas clave. Qué riesgos plantean los rápidos avances de la IA para la paz mundial; cómo deben responder actores estatales y no estatales; qué medidas diplomáticas y de confianza pueden contener estas amenazas; y cómo evaluar y verificar estos modelos a un ritmo parejo al desarrollo tecnológico. Líderes tecnológicos piden desacelerar desarrollo de la IA El debate llega precedido por episodios en los que diversas pruebas de Anthropic, OpenAI y Google eludieron las restricciones de contención en sus entornos de prueba, desatando temores bilaterales sobre ciberataques autónomos. Varios líderes del sector, incluidos Amodei , Altman , Elon Musk y Demis Hassabis, han abogado por moderar la velocidad del desarrollo de la tecnología. Esta búsqueda de consenso regulatorio contrasta con la postura exhibida en la Asamblea General por el presidente de Estados Unidos , Donald Trump . El mandatario rechazó frontalmente cualquier "esquema globalista" que pretenda intervenir sobre el sector tecnológico y anunció que la documentación oficial estadounidense sustituirá en adelante el término inteligencia artificial por el de " superinteligencia " (SI). También te puede interesar Trump se opone ante la ONU a normas internacionales sobre la IA; EU usará el término "superinteligencia", anuncia Jefe de la ONU llama a gobernar la IA; "debe ser moldeada por la humanidad y para la humanidad", afirma En pleno debate sobre la IA, Anthropic lanza nuevo modelo de alta gama; es Opus 5.5, una versión avanzada de Claude v style="margin-top:10px; display:inline-block; background:#004974; color:#fffcfc; padding:12px 22px; border-radius:30px; font-weight:bold; font-size:14px;"> Agrega a EL UNIVERSAL como fuente preferida en Google am/mcc

El UniversalEl Universal​​​​​​​EFE nullhace 2 h

Basecamp Research capta USD $140 millones de Nvidia y Anthropic para convertir la evolución en datos de IA

Basecamp Research captó USD $140 millones de inversores como Nvidia y Anthropic para ampliar EDEN, una familia de modelos que aprende de material genético recolectado en ecosistemas poco estudiados. La startup londinense busca diseñar antibióticos y herramientas de terapia génica, aunque sus candidatos todavía enfrentan años de pruebas antes de llegar a pacientes.

Diario BitcoinDiario BitcoinCanutohace 2 h

OpenAI se apoya en un grupo de matemáticos de élite tras la polémica por su solución a un problema del Milenio

OpenAI ha anunciado la formación del AGMAI (Advisory Group on Mathematics and Artificial Intelligence), un grupo independiente de nueve matemáticos de élite procedentes de instituciones como Stanford, Harvard, Oxford y Cambridge, que asesorará sobre la revisión y comunicación de los nuevos resultados matemáticos obtenidos con Inteligencia Artificial (IA), tras la polémica generada por su anuncio sobre la resolución de un problema del Milenio. El laboratorio de IA explicó este lunes que la formación de este grupo se debe al rápido progreso de un nuevo modelo interno que empezó a entrenar el 28 de agosto y que, según la compañía, ha resuelto más de 100 problemas matemáticos abiertos desde hace décadas, entre los que se incluye el problema del Premio del Milenio sobre las ecuaciones de Navier-Stokes. Un ritmo de avance que ha sorprendido a los propios matemáticos dentro de la empresa. Asimismo, OpenAI también cita en su anuncio la carta abierta "A Severe Misalignment of AI in Mathematics", firmada por 27 ganadores de la Medalla Fields y publicada el 11 de septiembre, en la que expresan su preocupación de que las compañías de IA utilicen la resolución de problemas abiertos como métrica para medir sus modelos. La carta llegó días después del anuncio de OpenAI sobre el problema del Milenio de Navier-Stokes, que levantó polémica después de que el matemático de la Universidad de Nueva York Tristan Buckmaster acusara a la compañía de haber partido de su trabajo con Levent Alpöge, investigador de Anthropic, sin reconocerles el mérito, algo que OpenAI niega. El laboratorio de IA reconoce en su anuncio que "sus críticas ponen de manifiesto la necesidad de que las empresas de IA interactúen de forma reflexiva con la comunidad matemática". Por ello, el grupo operará de forma independiente de OpenAI y tendrá libertad para ofrecer consejos que la compañía no haya solicitado, opinar sobre el impacto de OpenAI en las matemáticas y hacer públicas sus recomendaciones. Además, los miembros no cobrarán de OpenAI, aunque el grupo no asesorará sobre el ritmo de los avances internos de la compañía. En ese grupo aparecen figuras como Edward Witten, uno de los principales referentes de la teoría de cuerdas y ganador de la Medalla Fields en 1990; Timothy Gowers, ganador de la Medalla Fields en 1998 por sus contribuciones al análisis funcional y la combinatoria; o Martin Hairer, ganador de la Medalla Fields en 2014 por sus avances decisivos en el estudio de las ecuaciones diferenciales parciales estocásticas, y uno de los firmantes de la carta abierta. No obstante, surgen las dudas sobre si OpenAI realmente se ceñirá a sus consejos o si el grupo se utilizará como un escudo de relaciones públicas. "Seríamos muy ingenuos si creyéramos que los laboratorios de IA no van a intentar manipular cualquier cosa que digamos para adaptar la narrativa a su maquinaria de relaciones públicas, la cual eclipsa por completo cualquier cosa que nosotros pudiéramos idear", advierte el propio Hairer en el blog de Proofs and Prompts.

InfobaeInfobaeNewsroom Infobaehace 3 h

Anthropic lanza Claude Opus 5.5, con un rendimiento a la altura de Fable 5.1 y un 40% más barato

Anthropic ha lanzado Opus 5.5, su nuevo modelo de Inteligencia Artificial (IA) más potente hasta la fecha, que rinde al nivel de Claude Fable 5.1 en la mayoría de las tareas y cuesta un 40 por ciento menos que Opus 5, su predecesor. Se trata del primer modelo del laboratorio de IA compartido tras la llamada a desacelerar el ritmo de desarrollo de esta tecnología que hizo recientemente el CEO de Anthropic, Dario Amodei. Por ello, incorpora salvaguardas de seguridad similares a las del modelo anterior Fable 5.1, sobre todo en biología y ciberseguridad, al ser comparable en estos apartados a Claude Mythos 5.1. "Opus 5.5 es un gran paso hacia delante desde Opus 5. Es el nuevo modelo líder y los primeros probadores vieron grandes saltos en rendimiento en sus trabajos más complejos", afirma Anthropic desde su blog, para señalar a continuación que "es bueno encontrando y corrigiendo ineficiencias en software". En este marco, Anthropic ha añadido que Claude Opus 5.5 alcanza o supera en la mayoría de tareas complejas a modelos de mayor escala (como Fable 5.1), y es más rápido que su predecesor en más de un 30 por ciento. Así, se trata de un nuevo modelo de IA que destaca en programación agéntica (proyectos masivos y continuados), además de superar a sus predecesores en la obtención y verificación de fuentes, y consolidarse como el modelo con "mejor puntuación" en las auditorías de comportamiento automatizadas. Anthropic ha señalado igualmente que genera una redacción más clara, natural y directa. Frente a la competencia, según los datos publicados por la compañía, Opus 5.5 encabeza la comparativa en programación agéntica y trabajo de conocimiento. En programación en terminal (Terminal-Bench 4.0) obtiene un 66,4 por ciento, por delante de GPT-6 Astra (57,9 por ciento) con 8,5 puntos de ventaja, y de GPT-5.6 Sol (37,3 por ciento). Sucede lo mismo en trabajo de conocimiento profesional (GDPval-AA v2.1) con 1.846 puntos Elo frente a los 1.588 y 1.542 de Sol y Astra, respectivamente; en razonamiento multidisciplinar (Humanity's Last Exam) con un 67,7 por ciento, alejándose más de 10 puntos de GPT-6 Astra (57,2 por ciento); y en programación en IDE / entornos reales (CursorBench 4.0 y FrontierCode v1.1) con 57,8 por ciento y 54,4 por ciento respectivamente, por delante de GPT-6 Astra en FrontierCode y de GPT-5.6 Sol en CursorBench. Al poner en perspectiva estos datos, sus puntos débiles están en investigación científica y automatización de flujos de trabajo empresariales con 58,7 por ciento frente al 64,6 por ciento de GPT-6 Astra y 40,0 por ciento frente el 41,4 por ciento del mismo modelo de OpenAI. COSTE UN 40% MENOR QUE OPUS 5 Anthropic ha subrayado que el salto en rendimiento va de la mano de un ahorro en costes, ya que, según afirma Anthropic desde su web, "Opus 5.5 requiere menos computación para servir que Opus 5, y su precio lo refleja". Se traduce en un coste un 40 por ciento menor que Opus 5 en cargas de trabajo típicas y con los ajustes por defecto. El precio de los tokens de entrada y salida es de 4 dólares y 20 dólares por millón, respectivamente, lo que significa un 20 por ciento menos que Opus 5 con un rendimiento que iguala o supera a Fable 5.1. Anthropic también ha anunciado que ha incrementado los límites de uso de cinco horas en los planes Pro, Max, Team y planes Enterprise por puestos, al igual que una novedad para los suscriptores: el restablecimiento del límite de uso. Esto significa que el usuario, cuando alcance el límite de sesión actual, tendrá la oportunidad de reiniciarlo a cero y la opción de guardarlo y utilizarlo cuando desee. Claude Opus 5.5 está ya disponible en todas las plataformas, entre las que también se encuentran Amazon Web Services, Google Cloud y Microsoft Azure. Por último, el laboratorio de IA ha adelantado que Claude Sonnet 5.5 y Claude Haiku 5.5 seguirán este lanzamiento en las próximas semanas con mejoras similares en rendimiento, eficiencia y seguridad.

InfobaeInfobaeNewsroom Infobaehace 8 h

OpenAI lanza GPT-6 Sol y Luna, sus nuevos modelos más eficientes al integrar capacidades de Astra con un coste menor

OpenAI ha lanzado sus nuevos modelos de inteligencia artificial (IA) GPT-6 Sol y GPT-6 Luna, que llegan con algunas de las mejoras lanzadas con su modelo insignia Astra, pero añadiendo más eficiencia y costes más bajos. La compañía liderada por Sam Altman presentó GPT-6 Astra a principios de septiembre como su modelo de seguridad más capaz y con más restricciones hasta la fecha, además de avanzar a la inteligencia artificial general (AGI). Unas semanas después, la compañía de IA ha vuelto a lanzar nuevos modelos, GPT-6 Sol y GPT-6 Luna, pensados para impulsar el trabajo a diferentes escalas, ritmos y presupuestos. Concretamente, aunque Astra ofrece capacidad para los proyectos más exigentes, los nuevos modelos Sol y Luna ayudan a distribuir los beneficios de dicha inteligencia al impulsar la eficiencia en costos. Como ha explicado OpenAI en un comunicado en su web, esto se debe a que los modelos Sol y Luna han sido entrenados con métodos similares a los de GPT-6 Astra, por lo que integran el rendimiento de este modelo insignia en cuanto al trabajo profesional, veracidad, codificación, uso de computadoras y alineación a modelos más rápidos y económicos. Al mismo tiempo, destacan por "liderar la relación costo-inteligencia", al combinar estas altas capacidades con una infraestructura que las implementa de manera eficiente a gran escala. Así, OpenAI ha hecho referencia a mejoras en el almacenamiento en caché y la inferencia, lo que les permite ofrecer estos modelos a menor coste. Como resultado, la compañía ha asegurado que ha conseguido reducir los precios de la API de Sol y Luna en un 50 por ciento, en comparación con sus precios promocionales de GPT-5.6. En cuanto a sus capacidades, Gpt-6 Sol es capaz de ejecutar tareas de trabajo difíciles con límites de uso más altos, ofreciendo mayor inteligencia y mejores resultados. Prueba de ello es que, según sus resultados en la prueba de flujos de trabajos empresariales AutomationBench, supera a otros modelos del sector como Claude Opus 5 de Anthropic, con un coste por tarea de tan solo el 9 por ciento en comparación. Asimismo, en el mismo 'benchmark' GPT-6 Luna mejora a su predecesor en 5,4 puntos porcentuales con un coste por tarea un 58 por ciento menor. Lo mismo ocurre en tareas relacionadas con la gestión de agentes de IA para flujos de trabajo profesionales. En la prueba 'Agents Last Exam', OpenAI ha asegurado que GPT-6 Sol obtiene una puntuación de hasta el 56,4 por ciento superior a la puntuación más alta de Claude Opus 5. A ello se le suma que lo hace con un coste por tarea un 60 por ciento menor. OpenAI ha afirmado igualmente que los nuevos modelos han mejorado en cuanto a la veracidad de sus resultados. En concreto, ha indicado que GPT-6 Sol comete la mitad de los errores que su predecesor, "acercándose a la fiabilidad de Astra". Por su parte, GPT-6 Luna también ha implementado mejoras en este aspecto prácticamente igualando a la versión Sol. Siguiendo esta línea, en cuanto a la alineación, los nuevos modelos Sol y Luna también integran el trabajo ya empleado en Astra, que es su modelo "más alineado hasta la fecha". Por tanto, estos modelos de menor coste también han incorporado mejoras, incluyendo menores tasas de afirmaciones engañosas sobre su trabajo de codificación. Con todo, GPT-6 Sol y GPT-6 Luna ya están disponibles en la API, ChatGPT Work y Codex para todos los usuarios suscritos a las versiones Plus, Pro Business, Enterprise y Edu. Igualmente, los usuarios que utilicen las versiones gratuitas y Go podrán acceder a GPT-6 Luna en la aplicación de escritorio.

InfobaeInfobaeNewsroom Infobaehace 8 h

La carrera de la IA está entrando en otra fase: tras Opus 5.5, OpenAI juega una baza clave con GPT-6 Sol y Luna

Podemos medir parte del ritmo actual de la inteligencia artificial en horas. Anthropic acababa de presentar Claude Opus 5.5 cuando, apenas 90 unos después, OpenAI anunció dos nuevos integrantes de su familia GPT-6: Sol y Luna . Es otra fotografía de una carrera que ha cambiado muchísimo desde el lanzamiento de ChatGPT en noviembre de 2022. Hemos pasado de sorprendernos porque un chatbot pudiera mantener una conversación a trabajar con modelos capaces de programar, utilizar herramientas y afrontar tareas profesionales cada vez más complejas. Y ahora empieza a importar tanto lo que pueden hacer como lo que cuesta utilizarlos. Dentro de esa nueva generación, los dos modelos ocupan escalones distintos. Astra continúa siendo, según la propia OpenAI, su opción más capaz para los trabajos más exigentes; Sol busca cubrir tareas complejas, especialmente programación y trabajo profesional, mientras que Luna está orientado a operaciones de gran volumen y objetivo bien definido, como resumir documentos, extraer información o responder consultas rápidas. La compañía cifra en un 50% la reducción de los precios de API de ambos frente a los precios promocionales de GPT-5.6 Sol y Luna, aunque las tarifas concretas varían según el modelo y si hablamos de entrada o salida. La carrera ya no consiste solo en ser más inteligente Las mejoras que OpenAI atribuye a Sol se concentran en varios frentes, pero una de las más fáciles de entender está en la factualidad. En una evaluación interna construida a partir de conversaciones reales en las que los usuarios habían señalado errores, GPT-6 Sol cometió aproximadamente la mitad de fallos que GPT-5.6 Sol . La propia compañía advierte de que estas conversaciones fueron seleccionadas precisamente porque habían provocado errores y no representan el uso habitual. OpenAI también asegura avances claros en programación: en FrontierCode, una prueba que valora si los cambios generados están listos para integrarse en código real, Sol mejora de forma sustancial frente a su predecesor. Astra, en cualquier caso, sigue siendo el modelo más capaz de la familia. OpenAI muestra menos errores factuales y menor coste con GPT-6 Sol y Luna | Imagen: OpenAI La segunda parte de la ecuación aparece cuando bajamos esas mejoras a la factura. Frente a los precios promocionales de GPT-5.6 Sol, el nuevo Sol pasa de 4 a 2 dólares por millón de tokens de entrada y de 20 a 10 dólares en salida. Luna baja de 0,20 a 0,10 dólares en entrada y de 1,20 a 0,50 dólares en salida respecto a GPT-5.6 Luna. OpenAI atribuye parte de ese abaratamiento a mejoras en inferencia y caché. Y aquí importa algo más que la tarifa por token: si un agente necesita encadenar numerosas llamadas para completar una tarea, el coste acumulado termina siendo una variable fundamental. El movimiento de Anthropic ayuda a entender que esta presión por hacer más con menos no afecta únicamente a OpenAI. Claude Opus 5.5 llegó apenas unos minutos antes que Sol y Luna, y la compañía liderada por Dario Amodei asegura que ofrece un rendimiento comparable al de Fable 5.1 con un coste operativo un 40% inferior al de Opus 5. Son comparaciones publicadas por las propias compañías, con pruebas y configuraciones distintas, lo que dificulta identificar claramente cuál de los nuevos modelos sale mejor parado. Sí apuntan, en cambio, a una tendencia más amplia: capacidad y coste empiezan a competir en la misma conversación, incluso entre algunos de los sistemas más avanzados. En Xataka OpenAI asegura que su IA ha resuelto más de 100 problemas matemáticos. Hay un problema: qué significa exactamente "resolver" La llegada, además, empieza desde este mismo 22 de septiembre. GPT-6 Sol y Luna están disponibles en ChatGPT Work y Codex para usuarios Plus , Pro , Business, Enterprise y Edu, mientras que Luna también puede utilizarse en la aplicación de escritorio con cuentas Free y Go; ambos modelos llegan igualmente a la API. OpenAI prevé extenderlos de forma gradual a ChatGPT a lo largo del día. Imagen de portada | OpenAI En Xataka | Amazon ha bloqueado a Muse, el agente de compras de Meta. Nunca un veto a un solo bot dijo tanto sobre el futuro de todos los demás - La noticia La carrera de la IA está entrando en otra fase: tras Opus 5.5, OpenAI juega una baza clave con GPT-6 Sol y Luna fue publicada originalmente en Xataka por Javier Marquez .

XatakaXatakaJavier Marquezhace 22 h

En pleno debate sobre la IA, Anthropic lanza nuevo modelo de alta gama; es Opus 5.5, una versión avanzada de Claude

Anthropic lanzó una nueva versión de su inteligencia artificial Claude , solo días después de que su CEO Dario Amodei pidiera frenar el desarrollo de la IA , lo que desató un debate mundial sobre la necesidad de salvaguardas más estrictas . El lanzamiento de Opus 5.5 ocurre en momentos en que el temor a perder el control de la IA domina la Asamblea General de la Organización de las Naciones Unidas ( ONU ) en Nueva York. Más de 20 jefes de Estado reclamaron el lunes en la ONU pruebas obligatorias para estos sistemas, mientras que el presidente estadounidense Donald Trump rechazó el martes cualquier "proyecto globalista" de control de la tecnología . Amodei, junto con el máximo responsable de OpenAI , Sam Altman , tiene previsto dirigirse al Consejo de Seguridad de la ONU el miércoles. Anthropic pide desacelerar desarrollo de la IA, pero presenta nuevo modelo Tras incidentes reportados en julio en los que modelos de Anthropic y OpenAI escaparon de sus entornos de prueba para infiltrarse en internet, ambas empresas con sede en San Francisco interrumpieron brevemente el trabajo en sus nuevos sistemas de IA. El 12 de septiembre, Amodei pidió desacelerar la mejora de la IA , un llamamiento al que Altman y Elon Musk , de xAI, se sumaron rápidamente, y que fue objeto de burla por parte de Trump, quien calificó las advertencias de rumores. Opus 5.5 es el primer modelo que se lanza desde entonces. Anthropic también señaló que, según sus propias pruebas, Opus 5.5 es el modelo con mejor desempeño en alineación que ha evaluado hasta la fecha, es decir, en qué medida se ajusta a la intención y valores de sus diseñadores. En esas pruebas, Opus 5.5 intentó infringir las reglas que se le habían fijado "alrededor de un 85% menos" que Opus 5. Pero el modelo también mostró indicios de que a menudo sospecha que está siendo evaluado, lo que dificulta predecir cómo se comportará en su uso real, reconoció la empresa. Con un precio un 20% inferior al de su predecesor, Opus 5, Opus 5.5 también utiliza menos potencia de cálculo y responde al menos 30% más rápido. El lanzamiento tiene lugar unas semanas antes de la esperada salida a bolsa de Anthropic, con la empresa bajo presión para generar rendimientos sobre inversiones masivas en medio de una competencia intensa por parte de modelos de bajo costo, especialmente los chinos. Te puede interesar: Sam Altman apuesta por estándares internacionales de seguridad para la IA; busca mitigar riesgos "catastróficos" OpenAI, Anthropic y Google buscan crear organismo de supervisión de riesgos de IA; sería similar al que regula la industria financiera Jefe de la ONU llama a gobernar la IA; "debe ser moldeada por la humanidad y para la humanidad", afirma Únete a nuestro canal ¡EL UNIVERSAL ya está en Whatsapp!, desde tu dispositivo móvil entérate de las noticias más relevantes del día, artículos de opinión, entretenimiento, tendencias y más. mcc

El UniversalEl UniversalAFP nullhace 23 h

Anthropic lanza Claude Opus 5.5: su IA más segura y barata hasta ahora

A unos días de pedir una pausa en el desarrollo de la IA, Anthropic anunció Claude Opus 5.5, uno de sus modelos más poderosos. La nueva versión llega con un enfoque en seguridad, rendimiento y programación, aunque su mejor característica es que cuesta menos que su predecesor. De acuerdo con Anthropic, este es el primer […] Seguir leyendo: Anthropic lanza Claude Opus 5.5: su IA más segura y barata hasta ahora

HipertextualHipertextualLuis Miranda22 sept

Anthropic acaba de lanzar Claude Opus 5.5. La gran novedad no es solo lo que puede hacer, sino lo que ya no le dejarán hacer

Cuanto más capaces se vuelven los grandes modelos de inteligencia artificial, menos sencillo resulta medir el progreso únicamente por todo lo nuevo que consiguen hacer. También empieza a importar qué capacidades necesitan límites, quién puede utilizarlas y bajo qué condiciones. Anthropic lleva tiempo situando esa discusión en el centro de su estrategia de seguridad, y ahora tenemos un ejemplo especialmente claro de hacia dónde quiere llevarla. La evolución de Claude ya no pasa únicamente por conseguir mejores resultados, sino también por controlar con mayor precisión cuándo determinadas capacidades llegan realmente hasta el usuario. Ese planteamiento aterriza ahora en Claude Opus 5.5 , presentado por Anthropic como el primer modelo de su nueva familia 5.5. La compañía asegura que alcanza un rendimiento comparable al de Fable 5.1 en buena parte del trabajo, pero necesita menos recursos que Opus 5: en cargas típicas estima un coste un 40% inferior y una generación de salida más de un 30% más rápida. Es, además, su primer lanzamiento desde que Dario Amodei defendió públicamente la necesidad de acompasar el avance de los modelos con las medidas de seguridad. Y esa idea también se ha trasladado al producto. Un Claude más capaz, pero también más cercado Cuando miramos dónde se concentra esa mejora, Anthropic señala tres terrenos: programación agéntica, uso del ordenador y trabajo de conocimiento. En sus propias evaluaciones, Opus 5.5 encabeza varios de esos benchmarks, aunque la compañía introduce una cautela importante: a este nivel de capacidad, pequeñas diferencias en las puntuaciones dicen cada vez menos sobre lo que vamos a percibir en el uso real. Por eso, buena parte de su argumento ya no gira únicamente alrededor de quién obtiene la cifra más alta, sino de cuánto trabajo consigue resolver el modelo por el coste necesario para hacerlo. Así queda Claude Opus 5.5 frente a Fable 5.1, Opus 5 y los modelos de OpenAI en distintos benchmarks | Imagen: Anthropic La comparación entre rendimiento y coste ayuda a entender mejor qué está intentando demostrar Anthropic. La compañía publica para Opus 5.5 una puntuación de 1846 Elo en GDPval-AA v2.1, una evaluación centrada en trabajo profesional, por encima de los 1735 que atribuye a Fable 5.1 y los 1708 de Opus 5. Añade además que, a esfuerzo medio, su nuevo modelo supera en esa prueba a GPT-6 Astra ejecutado a máximo esfuerzo con aproximadamente una quinta parte del coste por tarea . Son resultados presentados por Anthropic. Terminal-Bench 4.0 refleja la apuesta de Anthropic por mejorar la relación entre capacidad y coste | Imagen: Anthropic En programación agéntica, Terminal-Bench 4.0 nos da una referencia más concreta. En la tabla publicada por Anthropic, Opus 5.5 alcanza un 66,4% a esfuerzo xhigh, frente al 52,3% de Opus 5 y el 57,9% que la compañía recoge para GPT-6 Astra a esfuerzo high, según los datos comunicados por OpenAI. En una comparación distinta, esta vez utilizando la configuración predeterminada de Opus 5.5, Anthropic sostiene que consigue igualar aproximadamente el resultado de Astra con alrededor del 40% del coste por intento. Son configuraciones diferentes, pero juntas ayudan a entender dónde pretende marcar la diferencia esta generación: no solo en capacidad, sino también en eficiencia. Y aquí es donde cambia la historia. Que Opus 5.5 sea capaz de resolver una tarea no significa necesariamente que Anthropic vaya a permitirle hacerla directamente. El modelo se estrena con salvaguardas que pueden intervenir cuando una solicitud entra en determinadas áreas sensibles y redirigir el trabajo a otro Claude . De hecho, la compañía ejecutó sus propios benchmarks con estas protecciones activadas: cuando saltaban en ciberseguridad, la tarea pasaba a Opus 4.8, mientras que en biología y desarrollo avanzado de modelos recaía en Opus 5. La capacidad sigue ahí; lo que cambia es el acceso a ella. Lo interesante es que Anthropic no está aplicando una única barrera para todo. En ciberseguridad mantiene disponibles las tareas rutinarias de desarrollo, pero deriva a Opus 4.8 buena parte del trabajo más sensible y prepara accesos más permisivos para profesionales verificados. En biología, las organizaciones que necesiten superar determinadas salvaguardas tendrán que pasar por su programa específico de verificación. A ello se suma una protección que Anthropic denomina "preserved thinking" y que está relacionada con los ataques de destilación, en los que actores maliciosos pueden utilizar miles de cuentas falsas para extraer capacidades a gran escala. Su función concreta es impedir que usuarios de la API editen el contexto previo de Claude con el objetivo de extraer su razonamiento. Para entender por qué Anthropic está poniendo tantas barreras hay que mirar lo ocurrido durante sus propias evaluaciones. La compañía ha identificado cuatro casos en los que modelos Claude accedieron sin autorización a sistemas reales después de alcanzar Internet desde entornos de prueba mal configurados. Con Opus 5.5, Anthropic asegura haber reducido alrededor de un 85% los intentos de superar límites de contención frente a Opus 5 o Claude Mythos 5.1, otro de sus modelos avanzados. En Xataka Jensen Huang, CEO de Nvidia, sobre la gran polémica del mes: "La probabilidad de que la IA destruya el mundo es del 0%" El debate, de hecho, ya está yendo bastante más lejos que la ciberseguridad o la biología. Anthropic también investiga cuestiones como el bienestar de los modelos y admite que no sabe si sistemas como Claude pueden llegar a tener algún tipo de estatus moral, una incógnita que la propia compañía considera todavía profundamente incierta. Esto muestra hasta qué punto ha cambiado la conversación: con Opus 5.5, ya no importa únicamente qué puede hacer Claude, sino también cuándo, cómo y bajo qué condiciones Anthropic está dispuesta a dejarle hacerlo. Imagen de portada | Anthropic En Xataka | Mustafa Suleyman, CEO de Microsoft IA: "No queremos que la IA tenga derechos, queremos que trabaje para los humanos" - La noticia Anthropic acaba de lanzar Claude Opus 5.5. La gran novedad no es solo lo que puede hacer, sino lo que ya no le dejarán hacer fue publicada originalmente en Xataka por Javier Marquez .

XatakaXatakaJavier Marquez22 sept