Entradas

Mostrando las entradas con la etiqueta Anthropic

Anthropic niega jailbreak en modelo de IA Claude Fable 5

Anthropic ha rechazado las acusaciones sobre un jailbreak basado en prompts que afecta a su modelo de IA Claude Fable 5. La empresa destaca la robustez de su sistema de clasificación y los esfuerzos de red-teaming realizados antes de su lanzamiento. Claude Fable 5 se hizo disponible al público el martes, cuando Anthropic lo presentó como un potente modelo de IA de clase Mythos con salvaguardias que restringen su uso en dominios de alto riesgo como la ciberseguridad, donde Mythos ha demostrado ser particularmente eficaz. En áreas sensibles como la ciberseguridad, donde podría ser mal utilizado para desarrollar exploits, y en biología, donde podría ser aprovechado para desarrollar armas biológicas y químicas, el modelo automáticamente retrocede al menos capaz Claude Opus 4.8. Anthropic afirmó haber llevado a cabo un extenso red-teaming interno y externo para garantizar que Fable 5 no pueda ser fácilmente liberado. Sin embargo, poco después de su lanzamiento, un individuo con el seudó...

Análisis de impacto: El Modelo Mythos y el Panorama de la Ciberseguridad

El 7 de abril de 2026, Anthropic anunció Claude Mythos Preview , su modelo de mayor capacidad hasta la fecha. Paralelamente, el análisis Eye on the Market de J.P. Morgan (Cembalest, 13 de abril) ofrece una lectura técnico-financiera sobre sus implicaciones. Este artículo sintetiza ambas fuentes con énfasis en los vectores de amenaza más relevantes para infraestructuras críticas y entornos empresariales. Evolución del Rendimiento Mythos supera a sus predecesores en el Epoch Capabilities Index —un índice compuesto por 40 benchmarks independientes— con una aceleración sin precedente en el histórico de la plataforma. Resulta especialmente notable que supere a versiones lanzadas hace apenas dos meses, señalando una compresión del ciclo de mejora. 73% Tasa de éxito en CTFs de nivel experto (AISI) 24/32 Pasos promedio completados en ataque corporativo simulado +1000 Zero-days identificados en semanas de us...

Anthropic presenta Project Glasswing: Claude Mythos detecta miles de fallos zero-day en sistemas críticos

Anthropic anunció Project Glasswing, una iniciativa de ciberseguridad que utiliza una versión preliminar de Claude Mythos para encontrar y corregir vulnerabilidades en software crítico. Según la compañía, el modelo ya identificó miles de fallos zero-day de alta severidad en sistemas operativos y navegadores, lo que refuerza el debate sobre el uso defensivo de la IA avanzada y sus riesgos de abuso. Anthropic ha presentado Project Glasswing, un nuevo programa de ciberseguridad diseñado para aprovechar las capacidades de su modelo Claude Mythos Preview en la detección y corrección de vulnerabilidades. La iniciativa se enfocará en software crítico y contará con la participación de un grupo reducido de organizaciones, entre ellas Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorgan Chase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks y la propia Anthropic. La decisión de no liberar el modelo de forma general responde, según la empresa, a su nivel de capaci...

El Futuro de la IA Puede ser de Código Abierto o Cerrado

Imagen
El Futuro de la IA Puede ser de Código Abierto o Cerrado. Los Gigantes Tecnológicos están Divididos mientras Hacen Lobby ante los Reguladores Meta, la empresa matriz de Facebook, y IBM lanzaron un nuevo grupo llamado la AI Alliance que aboga por un enfoque de "ciencia abierta" para el desarrollo de la IA. Los líderes tecnológicos han sido defensores vocales de la necesidad de regular la inteligencia artificial, pero también están haciendo lobby con fuerza para asegurarse de que las nuevas reglas funcionen a su favor. Esto no significa que todos quieran lo mismo. Meta, la empresa matriz de Facebook, e IBM lanzaron el martes un nuevo grupo llamado la AI Alliance que aboga por un enfoque de "ciencia abierta" para el desarrollo de la IA, lo que los coloca en desacuerdo con los rivales Google, Microsoft y OpenAI, el creador de ChatGPT. Estos dos campos divergentes, el abierto y el cerrado, no están de acuerdo sobre si construir la IA de una manera que haga que la tecnol...