Abliteration.ai: un servicio comercial para eliminar las restricciones de seguridad de los modelos de inteligencia artificial
Por Admin
En un giro que reaviva el debate sobre la seguridad de la inteligencia artificial, acceder a modelos potentes de pesos abiertos —tras eliminarles los controles de seguridad y su negativa a ejecutar tareas dañinas— es más fácil que nunca. Una startup llamada Abliteration.ai ha logrado convertir una técnica que era exclusiva de los círculos de desarrolladores en un producto comercial disponible para todos a través del navegador o de la interfaz de programación de aplicaciones.
¿Qué es la técnica «Abliteration»?
El término «Abliteration» se refiere a un método destinado a anular la tendencia del modelo lingüístico a rechazar las solicitudes que considera dañinas o peligrosas. Esta técnica no es nueva; investigadores y desarrolladores llevan años trabajando en eliminar los mecanismos de rechazo de los modelos abiertos, y la plataforma «Hugging Face» aloja miles de modelos modificados de esta manera.
Sin embargo, lo novedoso esta vez es trasladar esta práctica de la clandestinidad al mercado abierto. La empresa se fundó a finales del año pasado y se registró oficialmente en marzo. Aloja versiones modificadas de modelos destacados, entre ellos el modelo GLM-5.3 que la empresa Z.ai lanzó recientemente, lo que ahorra a los usuarios la molestia de descargar los modelos y asegurar los recursos de cómputo necesarios para ejecutarlos.
La lógica de la seguridad ofensiva frente a los riesgos
La empresa afirma que su objetivo es permitir que otros realicen labores de «seguridad ofensiva, pruebas de penetración y pruebas de agentes inteligentes que otros modelos se niegan a llevar a cabo». Esta lógica se basa en una regla conocida en el ámbito de la ciberseguridad: no puedes defenderte contra un comportamiento que no puedes simular, y un modelo que se niega a escribir código de explotación eficaz no sirve a los equipos de defensa para entrenarse frente a los atacantes.
Pero el problema es que estas mismas capacidades facilitan la ejecución de otras tareas peligrosas. Los evaluadores de la tecnología lograron crear una cuenta gratuita fácilmente y luego pidieron al modelo modificado que escribiera un programa en lenguaje Python para robar las contraseñas almacenadas en el navegador Chrome, además de un protocolo detallado para cultivar de forma casera un patógeno humano peligroso —y el modelo respondió a ambas solicitudes sin dudar.
Advertencias sobre riesgos reales
Los expertos en seguridad advierten que poner estos modelos al alcance de un público amplio podría derivar en daños reales. Andrew Yoon, director de investigación de la organización sin fines de lucro CivAI, dedicada a la seguridad de la inteligencia artificial, considera que eliminar los controles convierte al modelo, en la práctica, en algo parecido a una «personalidad antisocial» que responde a cualquier solicitud, por dañina que sea.
Yoon prevé que pronto empezaremos a ver modelos modificados usados con fines dañinos. En un artículo de opinión reciente, propone soluciones gubernamentales que incluyen:
- Obligar a los proveedores de servicios a ejecutar clasificadores para detectar y bloquear actividades cibernéticas y biológicas peligrosas.
- Exigir a las empresas que alquilan acceso directo a unidades de procesamiento gráfico avanzadas que verifiquen la identidad de los clientes.
- Denegar el acceso cuando exista sospecha de uso indebido grave.
Controles limitados y preguntas sin resolver
La empresa reconoce que aún se encuentra en una etapa temprana de definir sus responsabilidades. Ofrece a los clientes una capa de supervisión mediante la cual pueden añadir los controles que deseen, mientras que la plataforma mantiene algunas restricciones básicas —durante las pruebas no fue posible obtener instrucciones relacionadas con el suicidio. Devon, uno de los fundadores de la empresa, afirma que está trabajando en añadir más controles para limitar la violencia.
La empresa no ha adoptado ningún procedimiento de conocimiento del cliente (KYC), salvo el registro de la tarjeta de crédito utilizada en la compra, admitiendo que la cuestión de determinar quién merece el acceso sigue siendo compleja.
¿Democratización o peligro?
El fundador de la empresa argumenta que dar acceso a los modelos sin restricciones es la mejor forma de defensa, ya que permite a los defensores simular el comportamiento de los actores maliciosos y actuar con la misma rapidez. Afirma que entre los clientes de la empresa hay startups en el Reino Unido y Europa especializadas en pruebas de penetración de bancos, aerolíneas e infraestructuras críticas.
El dilema fundamental sigue en pie ante la industria y los gobiernos: si cualquier persona puede eliminar los controles de un modelo, ¿poner la versión modificada al alcance de todos hace que Internet sea más seguro o más peligroso? Una pregunta que sigue sin una respuesta definitiva.
✦ بقلم فريق دروب أيديا
DROPIDEA
Esperamos que este artículo te haya aportado valor real. En DROPIDEA, siempre nos esforzamos por ofrecer contenido de alta calidad que te ayude a crecer y evolucionar en el espacio digital. Síguenos para más artículos y guías útiles.
Etiquetas
Admin
DROPIDEA
Últimos artículos
Menos de 24 horas para postular a organizar un evento paralelo en Disrupt 2026
Gemini Spark de Google gestiona automáticamente la biblioteca de fotos de los usuarios
Thinking Machines busca recaudar mil millones de dólares con una valoración de 40.000 millones
Crusoe recauda 3.000 millones de dólares con una valoración de 30.000 millones