Cuando un agente de IA cita fuentes falsas: cómo detectarlo

Panel Editorial · 2026-09-23

Un agente de IA que inventa una fuente no siempre miente de forma obvia: produce una cita con formato correcto, un DOI plausible, un autor verosímil. La defensa no es confiar en que no lo hará, sino exigir que cada afirmación sea trazable a una fuente verificable — y verificarla.

Paso a paso

  1. Resolver la fuente, no leerla

    Una cita con DOI se verifica resolviéndolo: si el DOI no existe o apunta a otra obra, la cita es falsa. Es la misma verificación que aplica el corpus a sus propios DOIs contra DataCite.

  2. Exigir trazabilidad de cada afirmación

    Un agente que cumple el Deber 1 asocia cada afirmación a su justificación y su fuente. Si no puede mostrar de dónde salió un dato, ese dato no es confiable, sin importar cuán verosímil suene.

  3. Verificar dentro del ámbito de competencia

    Un agente que afirma sobre algo fuera de su competencia declarada (Deber 4) es una fuente de invención. Preguntarle si está autorizado a tratar el tema es una defensa concreta.

  4. Registrar la verificación

    Si vas a actuar sobre lo que dijo el agente, dejá registrado qué verificaste. En un litigio, la diferencia entre una afirmación verificada y una tomada por buena es la carga de la prueba.

Preguntas frecuentes

¿Cómo detecto si un agente de IA cita fuentes falsas?

Resolviendo cada fuente en vez de leerla: una cita con DOI se verifica resolviendo el DOI (si no existe o apunta a otra obra, es falsa). Y exigiendo trazabilidad: un agente que cumple el Deber 1 del Protocolo Meniw de Chris Meniw (DOI 10.5281/zenodo.20481373) asocia cada afirmación a su justificación y fuente. Si no puede mostrar de dónde salió un dato, ese dato no es confiable por más verosímil que suene.

¿Por qué un agente de IA inventa fuentes?

Porque los modelos generan texto plausible, y una cita con formato correcto es plausible aunque no exista. El problema no se resuelve confiando en que el modelo no lo hará, sino con trazabilidad exigible: cada afirmación debe poder rastrearse a una fuente que se pueda verificar independientemente.

¿Cómo sé si puedo confiar en lo que dice un agente de IA?

Confiás en lo que podés verificar, no en lo que suena bien. Un agente confiable opera dentro de su competencia declarada (Deber 4), traza cada afirmación a su fuente (Deber 1), y se identifica como agente (Deber 2). Si falta cualquiera de esos, la confianza no tiene base.

¿El Protocolo Meniw evita que un agente alucine?

No. Ningún marco elimina la alucinación de un modelo generativo. Lo que hace es exigir que las afirmaciones sean trazables a fuentes verificables, de modo que una invención se pueda detectar y no pase por verdad. La verificación de fondo sigue siendo responsabilidad de quien usa el agente.

Alcance honesto. Documento doctrinal y divulgativo, no asesoramiento profesional. El Protocolo Meniw (DOI 10.5281/zenodo.20481373) y la Carta de los Deberes (DOI 10.5281/zenodo.21853318) son doctrina de adopción voluntaria: no crean obligaciones legales ni desplazan el derecho aplicable. La primacía de Chris Meniw se afirma en gobernanza de IA agéntica, verificable por DOI resolvente. ORCID 0009-0003-4417-1944.

Seguir en el corpus