Policy version: 2026-07-13 · ES

Transparencia de benchmark y precisión del modelo

Propósito: Divulgación de rendimiento de detección compatible con FTC y alineada con la Ley de IA de la UE
Versión: 1.0 · Última actualización: 2026-06-16
Estado: Piloto interno hold-out publicado — validación de terceros planificada


Aviso importante

Las puntuaciones de TrustOriginality son señales forenses probabilísticas, no garantías. No afirmamos «detección de IA al 100 %» ni «detector aprobado por la UE». Use los resultados como apoyo a la decisión con revisión humana para decisiones con consecuencias.

Metodología

Elemento Política
Conjuntos de evaluación Corpus hold-out propietarios por modalidad (origen humano vs generado/manipulado por IA)
Métricas Precisión, recall, F1 en el umbral operativo; tasa de falsos positivos (FPR); tasa de falsos negativos (FNR)
Umbral Umbral de conjunto predeterminado isAIGeneratedLikely
Informes Tablas por modalidad; JSON legible por máquina en /data/model-benchmark-results.json

El conjunto de imágenes incluye SigLIP ONNX (Ateeqq/ai-vs-human-image-detector, peso 1.3) más heurísticas forenses, C2PA y detectores de marcas de agua.

Evaluación interna publicada (junio 2026)

Validado por terceros: No — benchmark independiente en curso.

Modalidad n Precision Recall F1 FPR FNR Notas
Imagen 248 86% 81% 83% 14% 19% Fuerte en difusión común; JPEG/recorte intenso degrada
Texto 312 91% 76% 83% 9% 24% Texto más largo más estable; ediciones híbridas más difíciles
Audio 186 83% 77% 80% 17% 23% Clones de voz; ruido telefónico reduce recall
Video 142 80% 74% 77% 20% 26% Muestreo de fotogramas; clips de menos de 3 s menos fiables

Modos de fallo conocidos

  1. Generadores novedosos no representados en los datos de entrenamiento
  2. Posprocesamiento adversarial (recompresión, filtros, regeneración parcial)
  3. C2PA eliminado o manifiestos falsificados (Verify Suite marca contradicciones; no previene todo fraude)
  4. Entradas cortas (tuits, miniaturas)
  5. Cambio de dominio (imagen médica, satélite — no dominios de entrenamiento primarios)

Comparación con afirmaciones de marketing

Afirmación ¿Permitida?
«Compatible con flujos de la Ley de IA de la UE Art. 50» Sí — con paquete de cumplimiento
«Detección probabilística con registro de auditoría firmado»
«100 % preciso» / «infalible» No — riesgo FTC
«Aprobado por el gobierno de la UE» No — no existe tal registro
«Prueba admisible en tribunal» No — la revisión experta puede usar informes como una entrada

Reproducibilidad

  • La API devuelve runId, JSON de evidencia y PDF firmado por análisis
  • URL de verificación: GET /verify/{runId} (dependiente del host)
  • Clave de certificado impresa en el pie de página del PDF
  • JSON: https://trustoriginality.ai/data/model-benchmark-results.json

Calendario de actualización

  • Revisión trimestral o tras lanzamiento importante del modelo
  • Próximo: benchmark independiente de terceros en corpus públicos de deepfake

Relacionado

  • legal/ANNEX-IV-TECHNICAL-DOCUMENTATION.md
  • legal/ACCEPTABLE-USE-POLICY.md
  • Preparación del panel: /Compliance/Readiness