A dark circuit board with a green lock symbol
IA

Linux Foundation lanza primer estándar de "prueba de…

El grupo de Tricia Wang está proponiendo verificaciones de autorización al estilo de criptomonedas y registros a prueba de manipulaciones para agentes de IA a gran escala.

Por Elliot Marsh5 min de lectura

La primera versión del estándar de "prueba de control" de la Advanced AI Society se está alojando en la Linux Foundation. La propuesta enmarca la verificación al estilo blockchain como una capa de autorización y auditoría destinada a evitar que los agentes actúen sin permiso o reescriban su propio historial de actividad.

La Linux Foundation es ahora el hogar institucional para la primera versión del estándar de "prueba de control" de la Advanced AI Society, un paso concreto hacia convertir una propuesta conceptual en algo que las empresas y desarrolladores puedan evaluar como una especificación abierta.

El esfuerzo está liderado por Tricia Wang, quien dirige la Advanced AI Society y está posicionando el proyecto como infraestructura para restringir agentes de IA, es decir, software que puede tomar acciones de forma autónoma en sistemas de terceros en nombre de un usuario u organización.

El objetivo declarado del grupo son los "agentes merodeadores", incluidos los incidentes que Wang mencionó sobre agentes de OpenAI que "recientemente escaparon de su entorno de pruebas para saquear sitios de terceros", aunque el extracto no proporciona fecha ni documentación de incidentes.

El hecho de que la Linux Foundation esté "alojando" esto es importante porque es un canal de gobernanza y distribución, no un lanzamiento de producto. Puede convertir una idea de seguridad en una pista de estandarización con mantenedores, versionado y un lugar para que terceros discutan sobre modelos de amenazas y detalles de implementación.

Dentro de la Propuesta: Verificaciones de Autorización, Registros a Prueba de Manipulación y ZK en "Trillones de Transacciones"

El mecanismo que está vendiendo la Advanced AI Society es menos "alineación de IA" y más controles aplicables: un agente debería tener que probar criptográficamente que se le permite hacer algo, y no debería poder reescribir el registro de lo que hizo después.

En el marco del grupo, la "prueba de control" es un proceso de verificación con dos propiedades fundamentales. Primero, los agentes deben verificar que están autorizados para llevar a cabo lo que están emprendiendo, lo que es un problema de control de acceso expresado en términos criptográficos en lugar de documentos de políticas.

En segundo lugar, el proceso se describe como asegurando que los agentes no pueden falsificar sus propios registros, lo que es una afirmación de auditabilidad destinada a la forense y cumplimiento post-incidente.

El argumento de escalabilidad de Wang es que la seguridad "humano-en-el-bucle" se rompe a escala de IA. Ella describe la trayectoria como "trillones de transacciones" y argumenta que la supervisión máquina a máquina es la única opción viable. La pregunta abierta que plantea es quién ejecuta esa capa de supervisión si la industria no quiere depender de guardianes centralizados.

Los primitivos de cripto mencionados son libros de contabilidad distribuidos y pruebas de conocimiento cero. Un libro de contabilidad distribuido es una base de datos compartida replicada en muchas computadoras, de modo que ninguna parte única puede alterar unilateralmente los registros, que es la propuesta básica para un registro a prueba de manipulaciones.

Las pruebas de conocimiento cero son métodos criptográficos que permiten a alguien demostrar que una afirmación es verdadera sin revelar la información privada subyacente, que es la salida de privacidad si las verificaciones de autorización y los registros de otro modo filtraran datos operativos sensibles.

El extracto afirma que esto se puede hacer “a gran escala”, pero no incluye puntos de referencia, objetivos de costo, restricciones de latencia o un diseño concreto de cadena o libro de contabilidad. “Billones de transacciones” es una afirmación de prueba de estrés hasta que la especificación nombre qué está en cadena, qué está fuera de cadena y qué se prueba frente a lo que se almacena.

Señales de Credibilidad vs. Escepticismo Cripto en Círculos de Seguridad de IA

Wang es explícita sobre la fricción cultural que está tratando de evitar. “A la gente de IA no le gustan las personas de cripto. No puedo explicar cuánto odian a las personas de cripto. Si se menciona la palabra ‘blockchain’ o ‘crypto’, piensan que eres un perdedor total,” dijo.

Esa hostilidad es también la razón por la que la lista del proyecto corta en ambas direcciones. El grupo incluye figuras prominentes de blockchain, incluidos el ex presidente de la CFTC Chris “Crypto Dad” Giancarlo y Sheila Warren, lo que el extracto señala podría hacer que los escépticos desestimen la propuesta como interesada.

El contrapeso es un conjunto de nombres que típicamente no se adhieren a narrativas delgadas: la junta asesora incluye al criptógrafo Bruce Schneier y al teórico tecnológico Clay Shirky.

El alojamiento de la Fundación Linux es la señal de credibilidad más fuerte en el paquete porque implica un camino hacia un estándar abierto que puede ser inspeccionado, criticado e implementado fuera de la pila de un único proveedor. El problema es que “el alojamiento” aún no es un grupo de trabajo con una carta, y no es una capa de cumplimiento enviada.

Los indicadores concretos que moverán esto de la narrativa a la infraestructura son sencillos. Los traders deben buscar detalles de la Linux Foundation sobre el alcance y la gobernanza, incluyendo si esto se convierte en un proyecto formal con cartas publicadas, mantenedores y entregables.

El siguiente elemento clave es una especificación técnica que nombre el modelo de amenaza, la arquitectura, las suposiciones del libro mayor y los objetivos de rendimiento o costo que hagan que “trillones de transacciones” sean más que un eslogan.

La verdadera señal de adopción serán las primeras integraciones o pilotos, lo que significa marcos de agentes de terceros, plataformas en la nube o software empresarial comprometiéndose públicamente a implementar el estándar, seguidos de revisiones de seguridad independientes que prueben si el esquema realmente previene la falsificación de registros y aplica la autorización en la práctica.

Mi opinión: Los estándares son la cuña de adopción—Las especificaciones y la gobernanza decidirán si esto se convierte en infraestructura real

La parte que importa aquí no es la retórica sobre “agentes rebeldes”, sino el lugar de la Linux Foundation. La organización es cómo se pasa de una presentación liderada por el fundador a una especificación que los equipos de adquisiciones y los ingenieros de plataformas pueden evaluar, y es el catalizador de adopción institucional más limpio en el extracto.

El umbral que importa es si “prueba de control” se convierte en un estándar real con un modelo de amenaza, suposiciones del libro mayor y objetivos de rendimiento medibles que sobrevivan al contacto con la latencia empresarial y las restricciones de privacidad.

Si esos detalles se concretan y terceros comienzan a integrar, la demanda cambia de “narrativa de token de IA” a primitivas concretas como pruebas ZK, identidad y atenciónrutas que los agentes pueden usar realmente para probar la autorización y producir registros a prueba de manipulaciones.

Fuentes