Anthropic: un falso dorado en la carrera de la ia - filtraciones y debilidades reveladas

La promesa de Claude Mythos, la última apuesta de anthropic, se ha desmoronado con una filtración de datos que expone serias vulnerabilidades de seguridad. Lo que parecía un modelo de IA con el potencial de superar a sus competidores se ha convertido en un foco de atención para los hackers, desatando una nueva ola de preocupación sobre el control y la fiabilidad de estas tecnologías.

El desastre en discord: acceso no autorizado a un modelo de vanguardia

Según un informe de Bloomberg, un grupo de usuarios de Discord ha logrado acceder a una versión preliminar de Claude Mythos. Esto ocurre en un momento crucial, justo cuando anthropic se prepara para limitar el acceso del modelo a empresas selectas. La empresa, que inicialmente había sugerido que su IA era tan potente que su despliegue público era demasiado arriesgado, ahora se enfrenta a la cruda realidad de una brecha de seguridad.

La situación se agrava con la confirmación de que Mythos ha revelado 271 vulnerabilidades en Firefox, una demostración alarmante de sus fallos de seguridad. Hace tan solo unos meses, tareas tan complejas como las que ahora ejecuta la IA eran impensables para las máquinas. Esto implica que, aunque la capacidad de Mythos es notable, su seguridad es, al menos por ahora, lamentablemente deficiente.

Más problemas para un gigante en crisis

Más problemas para un gigante en crisis

Esta filtración se produce en un momento delicado para anthropic, que aún se está recuperando de la reciente filtración de código de Claude Code. El ataque actual, confirmado por Anthropic a través de un portavoz, no revela evidencia de un hackeo masivo, pero sí pone de manifiesto una falla crítica en la protección de sus modelos. La compañía se limita a reconocer “un informe que alega un acceso no autorizado” sin profundizar en los detalles.

Dario Amodei, CEO de Anthropic, defiende la herramienta, afirmando su capacidad para infiltrarse en “todos los principales sistemas operativos y navegadores web cuando un usuario se lo ordena”. Una declaración que, en este contexto, suena más a autopromoción que a una evaluación objetiva de la realidad. El modelo, por el momento, está restringido a gigantes como Apple, Microsoft y Amazon, una medida evidentemente impuesta por la necesidad de mitigar riesgos.

Aunque los hackers, según fuentes cercanas, no buscaban causar daño a Anthropic, el acceso no autorizado sienta un precedente peligroso. La posibilidad de que otros actores con intenciones más nefastas puedan obtener acceso a Mythos es ahora una preocupación real. Es una señal de advertencia que exige una revisión urgente de las estrategias de seguridad de la compañía.

La empresa, lejos de lamentar pérdidas económicas, se enfrenta a un dilema ético y de reputación que podría tener consecuencias a largo plazo. El acceso prematuro a un modelo tan potente podría comprometer la confianza de los usuarios y, potencialmente, poner en riesgo la seguridad de los sistemas que utiliza.