Anthropic restablece Claude Fable 5 tras el levantamiento de las restricciones de exportación en EE. UU.

XPoint
Publicado el 01/07/2026

Anthropic restablece Claude Fable 5

La decisión devuelve al mercado uno de los modelos de IA más avanzados de Anthropic, después de una suspensión provocada por preocupaciones de seguridad, jailbreaks y uso dual en ciberseguridad.

Una decisión que marca un precedente para la industria de la inteligencia artificial

Anthropic confirmó el restablecimiento global de Claude Fable 5, uno de sus modelos de inteligencia artificial más avanzados, luego de que el Departamento de Comercio de Estados Unidos levantara las restricciones de exportación que había impuesto semanas antes.

Desde el 1 de julio de 2026, Fable 5 volvió a estar disponible para usuarios de Claude.ai, Claude Platform, Claude Code y Claude Cowork. La medida pone fin a una suspensión que generó inquietud en la industria tecnológica y abrió una discusión más amplia sobre cómo deben controlarse los modelos de frontera cuando tienen capacidades relevantes para ciberseguridad.

El caso no solo afecta a Anthropic. También expone una tensión creciente entre innovación, seguridad nacional, competencia internacional y gobernanza de modelos avanzados de IA.

Por qué fue restringido Claude Fable 5

El origen del conflicto fue el hallazgo de un jailbreak, es decir, una técnica diseñada para inducir a un modelo a ignorar o eludir sus reglas de seguridad mediante instrucciones especialmente construidas.

Investigadores de Amazon identificaron un prompt que, según los reportes entregados a las autoridades estadounidenses, permitía que Claude Fable 5 analizara vulnerabilidades de software y, en ciertos escenarios, generara código demostrativo sobre cómo una falla podía ser aprovechada.

Anthropic reconoció el hallazgo, pero sostuvo que la conducta observada no representaba una capacidad secreta ni exclusiva de Fable 5. Según la compañía, solicitudes similares podrían obtener resultados comparables en otros modelos avanzados, especialmente cuando se enmarcan en tareas legítimas de análisis defensivo, investigación de seguridad o revisión de código.

Aun así, el gobierno estadounidense consideró que el riesgo era suficientemente relevante como para aplicar una medida de emergencia.

Una medida excepcional con efectos globales

El 12 de junio de 2026, el Departamento de Comercio de Estados Unidos ordenó restringir el acceso a Claude Fable 5 y a Mythos 5, un modelo relacionado con menos controles de seguridad y destinado a usos más avanzados.

La restricción aplicaba a cualquier ciudadano extranjero, incluso si se encontraba dentro de Estados Unidos o trabajaba para la propia Anthropic.

El problema operativo fue inmediato: Anthropic no contaba con un mecanismo confiable para verificar en tiempo real la nacionalidad de cada usuario. Ante esa imposibilidad, la empresa optó por suspender temporalmente ambos modelos para todos los usuarios a nivel global.

La decisión evidenció una debilidad regulatoria importante: todavía no existe un proceso claro, obligatorio y específico para gestionar riesgos urgentes asociados a modelos de IA de frontera.

La respuesta técnica de Anthropic

Para responder a las preocupaciones del gobierno, Anthropic desarrolló un nuevo sistema de protección basado en un clasificador de seguridad. Este mecanismo fue entrenado para detectar la técnica específica de jailbreak reportada y bloquearla antes de que el modelo procese la solicitud.

Según la compañía, el nuevo control logra detener más del 99 % de los intentos conocidos asociados a ese método.

Cuando el sistema detecta una solicitud considerada riesgosa, esta ya no es procesada por Fable 5. En su lugar, se deriva a un modelo más limitado, Claude Opus 4.8, y el usuario es informado de ese cambio.

Esta solución mejora la seguridad, pero tiene un costo: puede aumentar los falsos positivos en tareas legítimas de programación, depuración o análisis técnico.

Mythos 5 sigue bajo controles más estrictos

Mientras Fable 5 volvió a estar disponible de manera global, Mythos 5 continúa con acceso restringido.

Actualmente, solo un grupo reducido de organizaciones estadounidenses, incluyendo agencias federales y empresas vinculadas a infraestructura crítica, tiene autorización para utilizarlo.

Anthropic indicó que seguirá trabajando con el gobierno para ampliar progresivamente el acceso, siempre que existan condiciones de seguridad, monitoreo y control suficientes.

Un nuevo marco de colaboración entre gobierno e industria

Como parte del acuerdo que permitió levantar las restricciones, Anthropic asumió nuevos compromisos frente al Departamento de Comercio de Estados Unidos.

Entre ellos se incluyen:

  • Realizar evaluaciones internas continuas sobre la seguridad de sus modelos.
  • Reportar usos maliciosos detectados en sus plataformas.
  • Coordinar lanzamientos futuros de modelos avanzados con autoridades estadounidenses.
  • Permitir pruebas anticipadas de modelos de frontera antes de su liberación pública.
  • Mejorar la respuesta frente a reportes de jailbreaks críticos.

Este enfoque muestra una transición hacia un modelo de colaboración permanente entre desarrolladores de IA y reguladores, en lugar de depender únicamente de bloqueos o restricciones de emergencia.

La industria busca medir mejor la gravedad de los jailbreaks

Uno de los puntos más relevantes del caso es la propuesta de Anthropic para crear un estándar común que permita medir la gravedad real de un jailbreak.

La iniciativa, desarrollada junto a socios como Amazon, Microsoft, Google y otros actores del sector, busca evaluar cada técnica según cuatro criterios principales:

  • Incremento de capacidades: cuánto más puede hacer el usuario gracias al jailbreak.
  • Amplitud: cuántos tipos de ataques o abusos distintos permite.
  • Facilidad de uso malicioso: cuánto conocimiento técnico requiere convertirlo en un ataque real.
  • Facilidad de descubrimiento: qué tan simple es encontrar o replicar la técnica.

La propuesta apunta a resolver un problema de fondo: no todos los jailbreaks tienen el mismo impacto. Algunos solo producen respuestas indebidas de bajo riesgo, mientras que otros pueden habilitar capacidades peligrosas para ciberataques, fraude, ingeniería social o abuso de infraestructura crítica.

El desafío del uso dual en ciberseguridad

El caso Fable 5 vuelve a poner sobre la mesa el concepto de uso dual. Un modelo capaz de ayudar a un equipo defensivo a encontrar vulnerabilidades también puede ayudar a un atacante a identificarlas, explotarlas o automatizar partes de una cadena ofensiva.

Esta tensión no es nueva, pero se vuelve más crítica a medida que los modelos de IA mejoran sus capacidades de razonamiento, análisis de código, generación de exploits, automatización de tareas y asistencia en operaciones técnicas complejas.

OpenAI también ha tomado medidas similares con modelos recientes, limitando inicialmente el acceso a grupos controlados por preocupaciones similares de seguridad y uso dual.

La pregunta de fondo no es si estos modelos pueden ser útiles para ciberseguridad. Lo son. La pregunta es cómo se evita que esa misma capacidad sea utilizada de forma maliciosa.

Competencia global y presión geopolítica

El episodio también estuvo marcado por la competencia internacional. Mientras Estados Unidos evalúa cómo controlar el acceso a modelos avanzados, modelos abiertos y de bajo costo desarrollados fuera del país siguen ganando terreno.

Algunos ejecutivos del sector han advertido que restringir demasiado rápido los modelos estadounidenses podría entregar ventaja competitiva a rivales internacionales, especialmente si los usuarios migran hacia alternativas menos reguladas.

Por eso, la discusión no se limita a seguridad. También incluye innovación, liderazgo tecnológico, soberanía digital y competencia global.

Un vacío regulatorio todavía abierto

Estados Unidos ya cuenta con mecanismos voluntarios para evaluar modelos de frontera antes de su lanzamiento, pero este caso mostró que esos procesos aún no son suficientes cuando surge una preocupación urgente.

Claude Fable 5 no pasó por ese canal antes de su liberación, y el gobierno terminó recurriendo a controles de exportación, una herramienta diseñada originalmente para tecnologías sensibles, no necesariamente para plataformas de IA de consumo global.

Esa improvisación deja una señal clara: la regulación de la IA avanzada todavía está en construcción.

Conclusión

El regreso de Claude Fable 5 resuelve una crisis inmediata, pero no cierra la discusión.

Los modelos de IA avanzados ya no son solo herramientas de productividad. También pueden analizar vulnerabilidades, escribir código, automatizar tareas técnicas y acelerar procesos que antes requerían equipos especializados.

El desafío para gobiernos, empresas y laboratorios de IA será encontrar un equilibrio realista entre innovación, seguridad y control.

La pregunta clave ya no es únicamente qué tan poderoso puede ser un modelo, sino bajo qué condiciones debe estar disponible.

 


Anthropic Restores Claude Fable 5 After the U.S. Lifts Export Restrictions

Anthropic has resumed worldwide access to Claude Fable 5 after the U.S. government lifted temporary export restrictions imposed over concerns about jailbreak techniques and the cybersecurity capabilities of frontier AI models.

A Decision That Could Shape the Future of AI Regulation

Anthropic has officially restored global access to Claude Fable 5, one of its most advanced artificial intelligence models, following the U.S. Department of Commerce’s decision to lift export restrictions that had been in place for just over two weeks.

Beginning July 1, 2026, Fable 5 became available again through Claude.ai, the Claude Platform, Claude Code, and Claude Cowork. The decision ends a temporary suspension that sparked widespread debate across the technology industry regarding how governments should regulate frontier AI models capable of performing advanced cybersecurity tasks.

The incident extends far beyond Anthropic itself. It highlights the growing tension between technological innovation, national security, international competitiveness, and responsible governance of increasingly capable AI systems.

Why Was Claude Fable 5 Restricted?

The controversy began after researchers from Amazon discovered a jailbreak, a technique specifically designed to bypass an AI model’s built-in safety mechanisms using carefully crafted prompts.

According to reports submitted to U.S. authorities, the prompt enabled Claude Fable 5 to identify software vulnerabilities and, under certain conditions, generate proof-of-concept code demonstrating how those vulnerabilities could potentially be exploited.

Anthropic acknowledged the issue but argued that the observed behavior did not represent a unique or hidden capability exclusive to Fable 5. The company stated that comparable results could be achieved using several other state-of-the-art language models, particularly when conducting legitimate defensive security research, vulnerability analysis, or secure code reviews.

Despite those arguments, U.S. regulators concluded that the potential cybersecurity implications justified immediate restrictions while additional safeguards were implemented.

An Extraordinary Government Action With Global Consequences

On June 12, 2026, the U.S. Department of Commerce ordered Anthropic to suspend access to both Claude Fable 5 and Mythos 5, a related research model with fewer built-in restrictions.

The order prohibited access by foreign nationals regardless of whether they were located inside or outside the United States, including Anthropic’s own international employees.

Because Anthropic lacked a reliable mechanism to verify every user’s nationality in real time, the company made the difficult decision to temporarily disable both models worldwide.

The situation exposed a significant regulatory gap: governments currently lack standardized mechanisms to rapidly manage emerging risks associated with frontier AI systems.

Anthropic’s Technical Response

To address regulators’ concerns, Anthropic developed a new security classifier specifically trained to detect and block the reported jailbreak technique before it reaches the model.

According to the company, the new safeguard successfully blocks more than 99% of known attempts using that specific attack method.

Whenever the classifier detects suspicious activity, requests are automatically redirected to Claude Opus 4.8, a less capable model with stronger security restrictions. Users are also informed that their request has been processed by a different model.

While this approach substantially improves security, Anthropic acknowledges that it may also increase false positives during legitimate programming, debugging, and software development tasks.

Mythos 5 Remains Under Strict Controls

Unlike Fable 5, Mythos 5 continues to operate under significantly tighter access controls.

Currently, only a limited group of U.S. organizations—including federal agencies and companies responsible for protecting critical infrastructure—are authorized to use the model.

Anthropic stated that it continues to work closely with U.S. government agencies to gradually expand access while maintaining rigorous security oversight.

A New Model for Government–Industry Collaboration

As part of the agreement that led to the removal of the export restrictions, Anthropic committed to several ongoing security initiatives with the U.S. Department of Commerce.

  • Continuously perform internal security evaluations of frontier models.
  • Report malicious use whenever identified.
  • Coordinate future releases of advanced AI models with government agencies.
  • Provide early access for government security testing before public deployment.
  • Improve monitoring and response capabilities for future jailbreak reports.

The agreement signals a broader shift toward long-term collaboration between AI developers and regulators instead of relying solely on emergency restrictions.

Creating an Industry Standard for Jailbreak Severity

One of Anthropic’s most significant announcements is its proposal to establish a standardized framework for evaluating the severity of AI jailbreaks.

Developed together with partners including Amazon, Microsoft, Google, and other industry leaders, the framework evaluates each jailbreak according to four key dimensions:

  • Capability Gain: How much additional capability the jailbreak provides beyond the model’s intended functionality.
  • Breadth: The number of attack scenarios enabled by the same technique.
  • Ease of Weaponization: The level of expertise required to convert the jailbreak into a practical cyberattack.
  • Discoverability: How easily the technique can be found, replicated, or shared.

The initiative seeks to establish objective criteria for determining when a jailbreak presents a sufficiently serious risk to justify immediate mitigation or government intervention.

The Growing Challenge of Dual-Use AI

The Fable 5 incident highlights the increasingly important concept of dual-use AI.

A model capable of helping cybersecurity professionals identify vulnerabilities can also assist malicious actors in discovering weaknesses, developing exploits, or automating portions of sophisticated cyberattacks.

As AI models continue improving their reasoning capabilities, software analysis, exploit generation, and automation skills, balancing innovation and security becomes increasingly difficult.

OpenAI has recently adopted similar precautions by initially limiting access to GPT-5.6 for selected government-approved organizations due to comparable dual-use concerns.

The challenge is no longer whether these models are valuable for cybersecurity—they clearly are—but rather how society can maximize their benefits while minimizing opportunities for abuse.

Geopolitical Competition Is Driving AI Policy

The debate surrounding Claude Fable 5 also reflects growing geopolitical competition in artificial intelligence.

While the United States explores stronger oversight of frontier AI systems, increasingly capable and affordable open-source models developed outside the country continue to gain global adoption.

Several technology executives have warned that prolonged restrictions on U.S.-developed AI could unintentionally strengthen international competitors by encouraging organizations to migrate toward less regulated alternatives.

Consequently, the discussion now extends well beyond cybersecurity, encompassing technological leadership, economic competitiveness, digital sovereignty, and global AI governance.

A Regulatory Framework Still Under Construction

Although recent U.S. Executive Orders introduced voluntary evaluation pathways for frontier AI systems before public deployment, the Claude Fable 5 incident demonstrated that these mechanisms remain incomplete.

Because Fable 5 had not undergone that voluntary review process, regulators ultimately relied on export controls—an instrument originally designed for sensitive technologies rather than globally accessible AI platforms.

Many experts believe this case will become an important precedent for future AI governance frameworks worldwide.

Conclusion

The return of Claude Fable 5 resolves one immediate crisis, but it also raises broader questions about the future governance of advanced artificial intelligence.

Modern AI models are no longer simple productivity tools. They are increasingly capable of identifying vulnerabilities, analyzing software, generating code, assisting security researchers, and automating highly technical workflows.

Governments, technology companies, and regulators now face the challenge of balancing innovation with security while preserving the enormous societal benefits these systems can provide.

Ultimately, the most important question is no longer how powerful AI models can become—but under what conditions they should be deployed safely and responsibly.

Preguntas frecuentes

¿Qué es y para qué sirve el Monitoreo de Dominios?

+

El Monitoreo de Dominios es un servicio de ciberseguridad que vigila en forma continua tus dominios y todo lo que se parezca a ellos para detectar señales tempranas de suplantación, phishing y abuso de marca.

Sirve para:

  • Detectar dominios parecidos (typosquatting, homoglyphs, TLDs distintos) usados para engañar a usuarios.

  • Identificar sitios clonados que imitan tu web, login, pagos o portales (phishing).

  • Monitorear cambios de DNS (MX, SPF, DKIM, DMARC, A/AAAA, NS) que puedan habilitar fraude o desvío de correo.

  • Detectar certificados TLS/SSL emitidos para dominios sospechosos (señal típica de campañas de phishing).

  • Alertar sobre infraestructura maliciosa asociada (IPs, hosting, patrones repetidos) y priorizar por riesgo.

  • Apoyar acciones de takedown y bloqueo (registradores, hosting, listas de denegación, gateways de correo).

En simple: te permite ver y cortar rápido los intentos de suplantación digital antes de que afecten a clientes, pacientes, usuarios o colaboradores, y reduce fraude, pérdida de confianza y riesgo reputacional.

¿Qué es y para qué sirve el Monitoreo Darkweb?

+

El Monitoreo de Dark Web es un servicio de ciberinteligencia que busca y vigila de forma continua en foros clandestinos, marketplaces, sitios de leaks y comunidades cerradas donde se publican, venden o comparten datos robados.

Sirve para:

  • Detectar filtraciones asociadas a tu organización (bases de datos, documentos, correos, PII).

  • Encontrar credenciales comprometidas (usuarios/contraseñas) antes de que se usen en accesos no autorizados.

  • Identificar venta de accesos a sistemas (VPN, RDP, correo, SSO, paneles).

  • Anticipar extorsión/ransomware (menciones, “samples”, anuncios de leak).

  • Proteger marca y clientes: señales de phishing, suplantación, fraude.

  • Entregar alertas y evidencia para investigación y respuesta a incidentes.

En simple: te da visibilidad de lo que pasa fuera de tu perímetro, donde normalmente aparece la información robada antes de que el ataque escale o se haga público.

¿Qué es y para qué sirve el Servicio CTI?

+

El servicio de CTI (Cyber Threat Intelligence) es la capacidad de buscar, analizar y transformar información sobre ciberamenazas en decisiones concretas para reducir riesgo. Sirve para anticiparse: entender quién te puede atacar, cómo lo haría, qué señales dejaría y qué debes reforzar antes de que pase.

  • Para qué sirve CTI (en la práctica)
  • Detectar amenazas relevantes para tu negocio (ransomware, fraude, APT, hacktivismo) y priorizar lo que realmente te afecta.
  • Alertar temprano sobre campañas activas, vulnerabilidades explotadas y señales de ataque dirigidas a tu industria.
  • Monitorear exposición externa: credenciales filtradas, leaks, suplantación de marca, dominios falsos, deep/dark web.
  • Mejorar la defensa: entregar IoCs, TTPs y recomendaciones para SIEM/EDR/SOC (reglas, playbooks, hardening).
  • Apoyar respuesta a incidentes: atribución probable, alcance, riesgos secundarios, y evidencia externa.
  • Reducir fraude y daño reputacional: detectar phishing, impersonación, venta de datos y accesos.

 

¿Qué entrega normalmente?

  • Alertas (críticas en tiempo real) + reportes (semanales/mensuales) con riesgo, impacto y acciones.
  • IoCs (IPs, dominios, URLs, hashes) y TTPs (MITRE ATT&CK) para detección.
  • Recomendaciones accionables priorizadas por criticidad.

En una frase: CTI convierte ruido del mundo criminal en inteligencia accionable para prevenir, detectar y responder mejor.

¿Qué es y para qué sirve un CyberSOC?

+

Un CyberSOC (Cyber Security Operations Center) es un centro especializado que monitorea, detecta y responde a amenazas de ciberseguridad de forma continua (24×7). Su función es proteger los activos digitales de una organización mediante el análisis de eventos, correlación de alertas y gestión estructurada de incidentes.

Sirve para identificar ataques en tiempo real, reducir el impacto de incidentes, cumplir con normativas y fortalecer la postura de seguridad del negocio. En simple: es el equipo y la tecnología que vigilan tu infraestructura digital para que tu operación no se detenga frente a ciberamenazas.

¿Para que sirve el Pentesting?

+

El pentesting o Test de penetración, en español) es una técnica de ciberseguridad que consistente en atacar entornos informáticos con la intención de descubrir vulnerabilidades en los mismos, con el objetivo de reunir la información necesaria para poder prevenir en el futuro ataques externos hacia esos mismos …

¿Qué es y para qué la Seguridad en el Desarrollo Ágil?

+

El Servicio de Seguridad en Ciclo de Desarrollo es un enfoque integral que garantiza la protección de los proyectos de software desde su fase inicial de diseño hasta su implementación final. Esto implica integrar medidas de seguridad en cada etapa del proceso de desarrollo, desde la planificación hasta la entrega del producto. La importancia de este servicio radica en varios aspectos:

  1. Protección temprana contra amenazas: Al abordar la seguridad desde el principio del ciclo de desarrollo, se pueden identificar y mitigar riesgos de seguridad antes de que se conviertan en problemas costosos o críticos en etapas posteriores del proyecto.
  2. Reducción de costos y tiempo: Corregir problemas de seguridad durante las etapas iniciales del desarrollo es más económico y rápido que hacerlo después de que el producto esté en producción. Esto puede ayudar a evitar retrasos en el lanzamiento del producto y ahorros significativos en costos asociados con la corrección de brechas de seguridad.
  3. Cumplimiento normativo: Muchas regulaciones y estándares de la industria requieren que los productos de software cumplan con ciertos requisitos de seguridad y protección de datos. Integrar la seguridad en el ciclo de desarrollo ayuda a garantizar el cumplimiento de estas regulaciones desde el principio, evitando posibles multas y sanciones legales.
  4. Confianza del cliente: La seguridad de los datos y la protección de la privacidad son preocupaciones importantes para los clientes. Al demostrar un compromiso con la seguridad a lo largo de todo el ciclo de desarrollo, las empresas pueden construir y mantener la confianza del cliente en sus productos y servicios.

En resumen, el Servicio de Seguridad en Ciclo de Desarrollo es esencial para garantizar que los productos de software sean seguros, confiables y cumplan con los estándares de seguridad y privacidad, lo que resulta en beneficios tanto para la empresa como para sus clientes.

¿Qué es el Phishing Ético?

+

El Phishing Ético es una servicio que consiste en realizar actividades de Ingeniería Social con propósitos legítimos y éticos, generalmente como parte de una Campaña de Concientización, Evaluación de Seguridad, Prueba de un Pentesting o Red Team.

Para más información ingresa aquí: https://www.xpoint.cl/phishing-etico/

¿Qué es un Red Team en Ciberseguridad?

+

Un Red Team en ciberseguridad es un grupo de profesionales que simulan ser adversarios externos para evaluar la seguridad de un sistema o red. Utilizan tácticas similares a las de ciberdelincuentes reales, llevan a cabo pruebas de penetración, analizan riesgos y proporcionan recomendaciones para mejorar la seguridad. Su enfoque proactivo ayuda a las organizaciones a identificar y abordar vulnerabilidades, fortaleciendo así sus defensas contra amenazas potenciales.

¿Qué es la Gestión de Vulnerabilidades?

+

La gestión de vulnerabilidades es un proceso integral que se centra en identificar, evaluar y abordar las debilidades en la seguridad de un sistema o red. Este proceso sigue varios pasos clave:

  1. Identificación de Vulnerabilidades
  2. Evaluación de Riesgos
  3. Priorización
  4. Mitigación y Solución
  5. Seguimiento Continuo
  6. Comunicación y Documentación
  7. Formación y Concienciación

La gestión de vulnerabilidades es esencial para mantener la seguridad de la información en un entorno digital en constante cambio, minimizando el riesgo de explotación y fortaleciendo las defensas contra posibles amenazas.

¿Tienes dudas?, contáctanos