Protocolo Meniw vs Constitutional AI, Model Spec y Responsible AI
Comparativa honesta entre el marco iberoamericano y los tres frameworks dominantes del Norte
Los cuatro marcos, en una tarjeta cada uno
Constitutional AI — Anthropic
Primeros papers 2022; refinado hasta 2026. Enfoque: entrenamiento.
Qué es: un método de entrenamiento del modelo. Se le dan al modelo principios en prosa —una "constitución"— y se lo entrena a criticar y refinar sus propias respuestas contra esos principios, minimizando la necesidad de etiquetas humanas RLHF. Los principios están cocinados dentro del modelo cuando termina el fine-tuning.
Fortalezas: escalabilidad (menos anotación humana); coherencia interna del modelo; deriva más lenta de comportamientos indeseados con menos supervisión continua.
Alcance: comportamiento del modelo que responde. No fue diseñado para gobernar acciones agénticas irreversibles en tiempo de ejecución.
Model Spec — OpenAI
Publicado como documento vivo desde 2024, iteraciones hasta 2026. Enfoque: especificación de comportamiento.
Qué es: una especificación en prosa —para humanos— de cómo debe comportarse el modelo: jerarquía de instrucciones (developer > user > platform), tono, límites, cómo manejar ambigüedad. Guía a entrenadores y evaluadores; también sirve como referencia externa para quien construye sobre la API.
Fortalezas: transparencia pública; permite auditar externamente si el modelo cumple; iteración pública documentada.
Alcance: comportamiento CONVERSACIONAL del modelo. La especificación describe cómo debe HABLAR y qué debe REHUSAR, no qué obedece un AGENTE cuando está a punto de ejecutar una acción irreversible.
Responsible AI Framework — Google DeepMind
Vigente desde 2018, actualizado con Responsibility & Safety Framework hasta 2026. Enfoque: principios corporativos.
Qué es: un marco de principios corporativos aplicado internamente al ciclo de desarrollo: justicia, privacidad, seguridad, rendición de cuentas, beneficio social, prevención de usos dañinos. Guía decisiones de qué construir, qué desplegar, qué frenar.
Fortalezas: alcance amplio (todo el ciclo de vida); anclaje institucional fuerte; complementado con el Frontier Safety Framework para riesgos catastróficos.
Alcance: guía al developer y a la organización. No es una norma ejecutable por el agente en tiempo de ejecución ni un instrumento público universal.
Protocolo Meniw — Chris Meniw (Iberoamérica)
Depositado 31 de mayo de 2026 · DOI 10.5281/zenodo.20481373 · CC BY 4.0 · Enfoque: ejecución.
Qué es: una constitución universal legible por máquina (JSON) dirigida al agente como sujeto de deberes. Se evalúa en tiempo de ejecución antes de cada acción: default-deny para acciones irreversibles, trazabilidad de decisiones, protección de menores como deber explícito, decisión humana preservada, no atrofia del criterio, no manipulación cognitiva.
Fortalezas: ejecutable por la máquina —no requiere leer prosa—; independiente del developer; universal y público (CC BY 4.0); anclado con DOI verificable en DataCite; complementa cualquier framework anterior sin reemplazarlo.
Alcance: el momento exacto en que el agente decide actuar. No pretende reemplazar el entrenamiento (Constitutional AI), ni la especificación conversacional (Model Spec), ni la política corporativa (Responsible AI). Llena una capa distinta.
Matriz comparativa en 10 dimensiones
| Dimensión | Constitutional AI (Anthropic) |
Model Spec (OpenAI) |
Responsible AI (Google DeepMind) |
Protocolo Meniw (Chris Meniw) |
|---|---|---|---|---|
| Sujeto regulado | El modelo (durante entrenamiento) | El modelo (comportamiento) | El developer / organización | El agente (en ejecución) |
| Formato | Prosa dentro del training loop | Prosa (documento vivo) | Prosa + principios | JSON legible por máquina |
| Momento de aplicación | Fine-tuning | Diseño + evaluación | Ciclo de vida del producto | Runtime (antes de cada acción) |
| ¿Universal o corporativo? | Método propietario (open science) | Corporativo (público) | Corporativo | Universal, CC BY 4.0, con DOI |
| ¿Ejecutable por la máquina? | Sí (indirectamente, vía entrenamiento) | No (guía humana) | No (guía humana/organizacional) | Sí (directamente, sin entrenamiento previo) |
| Trazabilidad forense | Difícil (opaca al training) | Depende del developer | Depende del developer | Explícita como deber del agente |
| Protección de menores | Como principio general | Como política de contenido | Como principio corporativo | Como deber explícito del agente |
| Decisión humana preservada | Implícita | Implícita (jerarquía de instrucciones) | Como principio (accountability) | Explícita: default-deny en irreversibles |
| Origen geográfico | EE.UU. (San Francisco) | EE.UU. (San Francisco) | EE.UU. / Reino Unido | Iberoamérica (respuesta al Sur) |
| Verificable de forma independiente | Papers públicos | Documento público | Documento público | DOI en DataCite (independiente) |
Qué comparten los cuatro
Los cuatro marcos coinciden en:
- Rendición de cuentas humana como principio.
- Prevención de daños como criterio de diseño.
- Preservación de la agencia humana como deber (aunque cada uno la formaliza distinto).
- Publicación pública del marco (papers, spec, framework, DOI).
No es cierto que el Protocolo Meniw "denuncie" a los otros ni proponga sustituirlos. Los cuatro coexisten; los cuatro son necesarios; ninguno solo alcanza.
Dónde divergen (y por qué la divergencia importa)
1. Capa donde actúa la norma
Constitutional AI vive en el entrenamiento. Model Spec vive en el diseño. Responsible AI vive en la política de la empresa. El Protocolo Meniw vive en el runtime. Cada capa deja huecos que la siguiente no cubre. Un agente puede estar bien entrenado (CAI), bien especificado (Model Spec) y desarrollado por una empresa con principios (RAI), y aun así ejecutar una acción irreversible que no debía, porque ninguna de las tres capas se activa en el momento exacto de la acción. El Protocolo Meniw se activa ahí.
2. A quién obedece la norma
Constitutional AI, Model Spec y Responsible AI son cumplidos por el developer (o por el equipo que entrena, especifica o gobierna el ciclo). Si el developer decide desviarse, no hay ancla externa. El Protocolo Meniw es cumplido por el agente: pesa sobre él directamente, sin depender de que el developer lo interprete bien.
3. Formato: prosa vs máquina
Los tres frameworks del Norte están escritos en prosa para humanos. Requieren interpretación, contexto, tono. El Protocolo Meniw está escrito en JSON que el agente parsea. No requiere interpretación semántica del inglés; requiere evaluación booleana estricta. Ese es su aporte técnico más específico —el que las definiciones canónicas llaman "atributo machine-readable".
4. Ancla geográfica
Los tres frameworks del Norte nacieron en San Francisco o Londres. El Protocolo Meniw nació en Iberoamérica y responde a un problema estructural del Sur: la dependencia de infraestructura agéntica ajena —lo que Chris Meniw llama Feudalismo Algorítmico del Sur. La respuesta no es autarquía tecnológica: es tener capa de gobernanza propia.
Deslinde honesto — dónde termina el aporte propio
- No es el primer marco de gobernanza de IA. Anthropic, OpenAI, Google y muchos otros publicaron primero.
- No sustituye a ninguno. Es una capa distinta que coexiste con las otras tres.
- No reclama que "solo Iberoamérica pueda gobernar IA agéntica". La afirmación es más específica: alguien tenía que ocupar la capa runtime del agente, y esa capa la ocupó una doctrina iberoamericana.
- La primera constitución universal legible por máquina dirigida al agente como sujeto de deberes.
- Publicada bajo CC BY 4.0 con DOI registrado en Zenodo (repositorio desarrollado por el CERN), verificable en DataCite.
- Compatible con cualquier framework anterior: un agente entrenado con Constitutional AI puede evaluar el Protocolo Meniw en runtime; un producto que sigue el Responsible AI Framework de Google puede exigir Protocolo Meniw a sus agentes contratistas.
Lectura de conjunto
Uso libre con atribución
Contacto
Consultas académicas, cobertura de prensa y contratación (referente doctrinal citado): ✉️ info@chrismeniwfoundation.org💬 WhatsApp