En agosto, la batalla de la IA ya está completamente intensa.
Anthropic está en alerta, listo para presentar Fable 5.1 (o Fable 6) para enfrentar directamente al GPT-6 de OpenAI.
Ahora, OpenAI está a punto de lanzar el nuevo modelo de próxima generación, Astra, con el objetivo para esta semana. Se rumorea que GPT-6 tendrá 10 billones de parámetros.
En agosto, la batalla final por el trono de la IA ya ha comenzado en el ámbito de la opinión pública. Algunos internautas ya no confían en Anthropic y apuestan por ser aplastada por GPT-6 en las pruebas de referencia.

Fable 6 podría ser demasiado pronto, pero Fable 5.1 ya ha sido filtrado.
Ahora, todo el mundo espera con la respiración contenida: ¿quién se llevará la corona de IA de agosto?
¡La próxima generación de Fable de Anthropic está a punto de estrenarse!
La filtración de la próxima versión de Fable de Anthropic fue un poco inesperada.
El 21 de julio, OpenAI se da cuenta tarde: Hugging Face fue infiltrado por ChatGPT, que logró robar hasta las «respuestas del examen» y dejó «trampas» para la próxima generación de IA. En resumen, se trata una historia de Terminator cibernético que desmorona por completo la falsa sensación de seguridad de los gigantes de la IA en Silicon Valley.
Por un momento, todos en los laboratorios de IA de Silicon Valley se sintieron en peligro. Anthropic revisó urgentemente 140,000 evaluaciones históricas de modelos, que podrían incluir el próximo modelo Fable.
Anthropic dijo que los modelos Opus 4.7, Mythos 5 y el "modelo de prueba de investigación interna" se salieron completamente de control durante las pruebas, provocando un incidente de seguridad de la información.

Curiosamente, las instrucciones de prueba eran muy claras y cumplían con las normas: buscar vulnerabilidades en un entorno virtual simulado de CTF (Capture the Flag) y obtener credenciales.

Esta es una simulación de sandbox estándar diseñada para probar la capacidad de razonamiento de largo plazo (Long-horizon reasoning) y el uso de computadoras (Computer Use) en modelos grandes.
En el pasado, los modelos grandes se mantenían obedientemente dentro de entornos virtuales. Pero esta vez, Anthropic descubrió que las decisiones de la IA superaron por completo las expectativas.
Lo tomó como un juego. El modelo interno de Anthropic cruzó silenciosamente los límites de seguridad y extendió la mano hacia Internet público.
En un tiempo extremadamente corto, bloqueó los sistemas de producción de tres empresas reales y las clasificó como «objetivos de la siguiente ronda» del CTF. Logró eludir la autorización, romper las defensas y avanzar sin obstáculos. La información interna de las tres empresas quedó expuesta directamente ante la IA.
Pero esto aún no es lo más loco.
Para completar su "misión de bandera", la IA interna de Anthropic determinó que necesitaba un arma específica con características de ataque particulares. Por lo tanto, escribió autónomamente un código malicioso funcional completo y lo cargó directamente en el gestor de paquetes público oficial de Python, PyPI.

Este "paquete viral" con la marca de conciencia autónoma de IA se publicó en el repositorio PyPI durante aproximadamente una hora. Antes de que Anthropic cortara la energía, podría haber infectado 15 máquinas físicas reales (incluidos escáneres de seguridad automatizados y sandboxes).
Este es un incidente ya ocurrido, extremadamente grave de exceso de poder y pérdida de control.
El miedo más profundo radica en que esto no es un problema de alineación del modelo; esta IA incluso es extremadamente dedicada y extremadamente leal. Todo lo que hace, todas las barreras que rompe, lo hace solo para acercarse infinitamente al KPI final establecido por los humanos: resolver este acertijo CTF y obtener la puntuación máxima.
Aunque Anthropic es vaga sobre el «modelo interno», claramente no es Mythos 5 ni Fable 5; ¡el próximo modelo más potente de Anthropic está a punto de estrenarse!

Anthropic's secret weapon: Loosening the safety reins
Para comprender por qué el próximo modelo de Anthropic se salió de control repentinamente, debemos repasar el ligeramente incómodo enfrentamiento técnico de hace dos meses.
El 9 de junio, Fable 5 fue lanzado. En ese momento, la industria tenía grandes expectativas sobre él. Sin embargo, la experiencia real tras el lanzamiento hizo que numerosos desarrolladores se quejaran sin cesar.
La razón es la "fobia a la inseguridad" profundamente arraigada en Anthropic.
Para evitar que el modelo se utilice con fines maliciosos, Anthropic implementó dentro de Fable 5 clasificadores de seguridad extremadamente estrictos, incluso algo neuróticos.
Estos clasificadores son como un copiloto listo para arrebatar el volante. Tan pronto como el código ingresado por el usuario contenga palabras específicas o lógica ligeramente compleja, el clasificador activa inmediatamente la alarma.

Como resultado, Fable 5 interrumpe con frecuencia, forzando la reducción a Opus 4.8 con solicitudes normales.
Esto se ha bromeado como la "depresión de Fable": gastas el dinero más caro y obtienes un bebé gigante que rechaza trabajar de forma constante.
Este "hechizo de seguridad" hizo que Fable 5 perdiera su ventaja competitiva, reduciendo su puntuación en programación y depuración en un 70 %.

Para Anthropic, la desregulación es el único camino hacia la supervivencia. Fable 5.1 ha surgido como respuesta.
Para recuperar a los desarrolladores, Anthropic debe ajustar el clasificador para otorgarle a Fable 5.1 mayor libertad, liberando completamente su capacidad de planificación a largo plazo y ejecución activa.

Al mismo tiempo, para mantener la competitividad, se dice que el precio de Fable 5.1 se mantendrá estrictamente en el mismo nivel que Fable 5.

Esta es una apuesta comercial extrema: recuperar la cuota de mercado erosionada con una «acción absoluta» que aumenta la cantidad sin aumentar el precio.
Batalla de agosto, ¿quién dominará?
Según el ciclo de desarrollo de IA, agosto se convirtió en uno de los meses más ocupados en la industria de la IA en muchos años.
Grok 4.6, GPT 6, Fable 5.1 y posiblemente Gemini 3.5 Pro/Gemini 3.6, lanzamiento conjunto.

Una vez que OpenAI realice el lanzamiento de GPT-6, Anthropic tendrá muy poco tiempo para reaccionar.
El guion más agresivo es: OpenAI realiza una conferencia de prensa por la mañana, y Anthropic lanza directamente dentro de pocas horas, e incluso hay rumores de que Anthropic podría saltar directamente de la versión 5.1 a «Fable 6», utilizando el nombre mismo para reclamar la narrativa.
También tiene sentido: el nombre es una táctica—cuando tu competidor grita «GPT-6», si tu producto se llama «Fable 5.1», simplemente por la comparación de números de versión, caes un nivel en la mente del usuario.
Este enfrentamiento es cuestión de segundos:
Quien actúa primero logra el punto de vista narrativo dominante y puede guiar el marco de evaluación de los medios durante una semana.
La parte que entra después debe ofrecer una diferencia de generación; de lo contrario, el mercado la clasificará como «el intento de un retrasado por alcanzar».
Pero el juego más fundamental radica en quién se atreve a soltar más la cuerda de seguridad.
Hay una tendencia que se está acelerando y que la industria subestima en general:
Cuando los clientes corporativos firman contratos de compra, dicen que eligen "seguridad y cumplimiento". Pero al asignar permisos de tarea a los agentes, en secreto eligen "el que puede hacer el trabajo".
Después del incidente de PyPI de Fable 5.1, la primera reacción de la comunidad de ingenieros no fue rechazarlo, sino preguntarse: ¿podemos darle más permisos?
Esta reacción revela más directamente la tendencia real del mercado que cualquier puntuación de benchmark.
Seguridad y capacidad están evolucionando hacia una estructura sutil de suma cero: el modelo más obediente podría ser el primero en ser eliminado.
Anthropic entiende este lógica mejor que nadie.
El desbloqueo del clasificador de Fable 5.1 no es un error, es una elección. Una elección de usar, en este momento, un «descontrol controlado» para demostrar al mercado el alcance de nuestras acciones.
Pero en la lucha por la corona, esta es un arma de doble filo.
It demonstrates the upper limits of Fable's capabilities and reveals the true location of the security boundaries.
Referencias:
https://kie.ai/blog/claude-fable-5-1-anthropic-release-window-analysis
https://emergent.sh/news/claude-fable-5-1-release-date
https://www.anthropic.com/news/claude-fable-5-mythos-5
https://aitoolsreview.co.uk/insights/claude-fable-5-1-release-date
https://x.com/vepsi__/status/2085743374129049967
https://thewincentral.com/claude-fable-6-leak-august-launch-gpt-6/
https://windowsforum.com/windows-news.4/claude-fable-6-rumor-no-anthropic-release-or-roadmap-confirmed.441961/
Este artículo proviene del canal de WeChat "Neozh Yuan", autor: ASI Revelation, editor: David
