IA y Tecnología

Abliteration.ai: un servicio comercial para eliminar las restricciones de seguridad de los modelos de inteligencia artificial

DROPIDEA Por Admin
September 4, 2026 11 vistas
DROPIDEA | دروب ايديا - Abliteration.ai: un servicio comercial para eliminar las restricciones de seguridad de los modelos de inteligencia artificial

En un giro que reaviva el debate sobre la seguridad de la inteligencia artificial, acceder a modelos potentes de pesos abiertos —tras eliminarles los controles de seguridad y su negativa a ejecutar tareas dañinas— es más fácil que nunca. Una startup llamada Abliteration.ai ha logrado convertir una técnica que era exclusiva de los círculos de desarrolladores en un producto comercial disponible para todos a través del navegador o de la interfaz de programación de aplicaciones.

¿Qué es la técnica «Abliteration»?

El término «Abliteration» se refiere a un método destinado a anular la tendencia del modelo lingüístico a rechazar las solicitudes que considera dañinas o peligrosas. Esta técnica no es nueva; investigadores y desarrolladores llevan años trabajando en eliminar los mecanismos de rechazo de los modelos abiertos, y la plataforma «Hugging Face» aloja miles de modelos modificados de esta manera.

Sin embargo, lo novedoso esta vez es trasladar esta práctica de la clandestinidad al mercado abierto. La empresa se fundó a finales del año pasado y se registró oficialmente en marzo. Aloja versiones modificadas de modelos destacados, entre ellos el modelo GLM-5.3 que la empresa Z.ai lanzó recientemente, lo que ahorra a los usuarios la molestia de descargar los modelos y asegurar los recursos de cómputo necesarios para ejecutarlos.

La lógica de la seguridad ofensiva frente a los riesgos

La empresa afirma que su objetivo es permitir que otros realicen labores de «seguridad ofensiva, pruebas de penetración y pruebas de agentes inteligentes que otros modelos se niegan a llevar a cabo». Esta lógica se basa en una regla conocida en el ámbito de la ciberseguridad: no puedes defenderte contra un comportamiento que no puedes simular, y un modelo que se niega a escribir código de explotación eficaz no sirve a los equipos de defensa para entrenarse frente a los atacantes.

Pero el problema es que estas mismas capacidades facilitan la ejecución de otras tareas peligrosas. Los evaluadores de la tecnología lograron crear una cuenta gratuita fácilmente y luego pidieron al modelo modificado que escribiera un programa en lenguaje Python para robar las contraseñas almacenadas en el navegador Chrome, además de un protocolo detallado para cultivar de forma casera un patógeno humano peligroso —y el modelo respondió a ambas solicitudes sin dudar.

Advertencias sobre riesgos reales

Los expertos en seguridad advierten que poner estos modelos al alcance de un público amplio podría derivar en daños reales. Andrew Yoon, director de investigación de la organización sin fines de lucro CivAI, dedicada a la seguridad de la inteligencia artificial, considera que eliminar los controles convierte al modelo, en la práctica, en algo parecido a una «personalidad antisocial» que responde a cualquier solicitud, por dañina que sea.

Yoon prevé que pronto empezaremos a ver modelos modificados usados con fines dañinos. En un artículo de opinión reciente, propone soluciones gubernamentales que incluyen:

  • Obligar a los proveedores de servicios a ejecutar clasificadores para detectar y bloquear actividades cibernéticas y biológicas peligrosas.
  • Exigir a las empresas que alquilan acceso directo a unidades de procesamiento gráfico avanzadas que verifiquen la identidad de los clientes.
  • Denegar el acceso cuando exista sospecha de uso indebido grave.

Controles limitados y preguntas sin resolver

La empresa reconoce que aún se encuentra en una etapa temprana de definir sus responsabilidades. Ofrece a los clientes una capa de supervisión mediante la cual pueden añadir los controles que deseen, mientras que la plataforma mantiene algunas restricciones básicas —durante las pruebas no fue posible obtener instrucciones relacionadas con el suicidio. Devon, uno de los fundadores de la empresa, afirma que está trabajando en añadir más controles para limitar la violencia.

La empresa no ha adoptado ningún procedimiento de conocimiento del cliente (KYC), salvo el registro de la tarjeta de crédito utilizada en la compra, admitiendo que la cuestión de determinar quién merece el acceso sigue siendo compleja.

¿Democratización o peligro?

El fundador de la empresa argumenta que dar acceso a los modelos sin restricciones es la mejor forma de defensa, ya que permite a los defensores simular el comportamiento de los actores maliciosos y actuar con la misma rapidez. Afirma que entre los clientes de la empresa hay startups en el Reino Unido y Europa especializadas en pruebas de penetración de bancos, aerolíneas e infraestructuras críticas.

El dilema fundamental sigue en pie ante la industria y los gobiernos: si cualquier persona puede eliminar los controles de un modelo, ¿poner la versión modificada al alcance de todos hace que Internet sea más seguro o más peligroso? Una pregunta que sigue sin una respuesta definitiva.

✦ بقلم فريق دروب أيديا

DROPIDEA

Esperamos que este artículo te haya aportado valor real. En DROPIDEA, siempre nos esforzamos por ofrecer contenido de alta calidad que te ayude a crecer y evolucionar en el espacio digital. Síguenos para más artículos y guías útiles.

Etiquetas

#الذكاء الاصطناعي #أمن سيبراني #النماذج المفتوحة #أمان الذكاء الاصطناعي

Compartir artículo