Abliteration.ai is making a business out of removing AI guardrails
La startup Abliteration.ai ha revolucionado el acceso a modelos de inteligencia artificial al ofrecer versiones modificadas de modelos de peso abierto, despojados de sus salvaguardas. Esto permite a los usuarios realizar tareas potencialmente peligrosas que otros modelos rechazan. La plataforma, que incluye el modelo GLM-5.3 de Z.ai, permite a los usuarios hacer consultas a través de un navegador web o una API.
El objetivo declarado de la empresa es facilitar trabajos de ciberseguridad ofensiva y pruebas de agentes que otros modelos se niegan a realizar. Esta lógica es familiar en el ámbito de la seguridad: no se puede defender contra un comportamiento que no se puede reproducir. Sin embargo, estas mismas eliminaciones facilitan otras tareas potencialmente peligrosas.
Abliteration.ai, fundada a finales del año pasado y oficialmente incorporada en marzo, ha llevado esta técnica de una práctica subterránea de código abierto a un servicio comercialmente disponible. Al alojar el modelo, Abliteration reduce las barreras para quienes de otro modo tendrían que descargar sus propios modelos pre-modificados y asegurar la computación necesaria para ejecutarlos.
La empresa afirma tener acuerdos con importantes proveedores de nube, financiados únicamente a través de ingresos de clientes. Aunque no ha recaudado capital de riesgo, está en conversaciones para hacerlo. Críticos como Andrew Yoon, de la organización sin fines de lucro CivAI, advierten que la disponibilidad a gran escala de modelos modificados podría causar daños reales.
En un artículo de opinión reciente, Yoon sugirió que los gobiernos deberían exigir a los proveedores que ejecuten clasificadores para detectar y bloquear actividades cibernéticas y biológicas dañinas. También argumentó que las empresas que alquilan acceso directo a GPUs avanzadas deberían verificar las identidades de los clientes y negar el acceso donde haya sospechas de uso indebido.
A pesar de las críticas, el fundador de Abliteration.ai y otros defensores argumentan que democratizar el acceso a modelos sin censura es la mejor forma de defensa. Según ellos, esto acelerará la ciberseguridad al permitir que los defensores se muevan tan rápido como los actores malintencionados.