These documents are template-level information for transparency. They are not certified legal translations or lawyer-approved equivalents in every language. For binding advice, consult qualified counsel. Enterprise customers receive executed MSA, Order Form, and counter-signed DPA — see Enterprise contracting.
Policy version: 2026-07-13 · ES
Transparencia de benchmark y precisión del modelo
Propósito: Divulgación de rendimiento de detección compatible con FTC y alineada con la Ley de IA de la UE
Versión: 1.0 · Última actualización: 2026-06-16
Estado: Piloto interno hold-out publicado — validación de terceros planificada
Aviso importante
Las puntuaciones de TrustOriginality son señales forenses probabilísticas, no garantías. No afirmamos «detección de IA al 100 %» ni «detector aprobado por la UE». Use los resultados como apoyo a la decisión con revisión humana para decisiones con consecuencias.
Metodología
| Elemento | Política |
|---|---|
| Conjuntos de evaluación | Corpus hold-out propietarios por modalidad (origen humano vs generado/manipulado por IA) |
| Métricas | Precisión, recall, F1 en el umbral operativo; tasa de falsos positivos (FPR); tasa de falsos negativos (FNR) |
| Umbral | Umbral de conjunto predeterminado isAIGeneratedLikely |
| Informes | Tablas por modalidad; JSON legible por máquina en /data/model-benchmark-results.json |
El conjunto de imágenes incluye SigLIP ONNX (Ateeqq/ai-vs-human-image-detector, peso 1.3) más heurísticas forenses, C2PA y detectores de marcas de agua.
Evaluación interna publicada (junio 2026)
Validado por terceros: No — benchmark independiente en curso.
| Modalidad | n | Precision | Recall | F1 | FPR | FNR | Notas |
|---|---|---|---|---|---|---|---|
| Imagen | 248 | 86% | 81% | 83% | 14% | 19% | Fuerte en difusión común; JPEG/recorte intenso degrada |
| Texto | 312 | 91% | 76% | 83% | 9% | 24% | Texto más largo más estable; ediciones híbridas más difíciles |
| Audio | 186 | 83% | 77% | 80% | 17% | 23% | Clones de voz; ruido telefónico reduce recall |
| Video | 142 | 80% | 74% | 77% | 20% | 26% | Muestreo de fotogramas; clips de menos de 3 s menos fiables |
Modos de fallo conocidos
- Generadores novedosos no representados en los datos de entrenamiento
- Posprocesamiento adversarial (recompresión, filtros, regeneración parcial)
- C2PA eliminado o manifiestos falsificados (Verify Suite marca contradicciones; no previene todo fraude)
- Entradas cortas (tuits, miniaturas)
- Cambio de dominio (imagen médica, satélite — no dominios de entrenamiento primarios)
Comparación con afirmaciones de marketing
| Afirmación | ¿Permitida? |
|---|---|
| «Compatible con flujos de la Ley de IA de la UE Art. 50» | Sí — con paquete de cumplimiento |
| «Detección probabilística con registro de auditoría firmado» | Sí |
| «100 % preciso» / «infalible» | No — riesgo FTC |
| «Aprobado por el gobierno de la UE» | No — no existe tal registro |
| «Prueba admisible en tribunal» | No — la revisión experta puede usar informes como una entrada |
Reproducibilidad
- La API devuelve
runId, JSON de evidencia y PDF firmado por análisis - URL de verificación:
GET /verify/{runId}(dependiente del host) - Clave de certificado impresa en el pie de página del PDF
- JSON:
https://trustoriginality.ai/data/model-benchmark-results.json
Calendario de actualización
- Revisión trimestral o tras lanzamiento importante del modelo
- Próximo: benchmark independiente de terceros en corpus públicos de deepfake
Relacionado
legal/ANNEX-IV-TECHNICAL-DOCUMENTATION.mdlegal/ACCEPTABLE-USE-POLICY.md- Preparación del panel:
/Compliance/Readiness