Un registro público de métodos, límites y verificaciones que respaldan el uso de identidades sintéticas en el entrenamiento de modelos de reconocimiento. Nada aquí se apoya en métricas infladas ni en bases personales reales.
Si querés ver cómo se traduce esto en un flujo de trabajo concreto, revisá los formatos de acompañamiento o escribinos desde contacto con el caso que tenés en mente.
Los proyectos de identificación sintética se sostienen sobre acuerdos concretos. Aquí reunimos las instituciones y grupos de trabajo que nos han permitido publicar, auditar y reutilizar corpus sintéticos sin exponer datos personales reales.
Coordinación técnica para la generación de rostros sintéticos con control de sesgo demográfico. El acuerdo cubre la revisión de atributos y la validación cruzada de conjuntos de prueba usados en publicaciones conjuntas.
Revisión independiente de nuestros protocolos de anonimización y trazabilidad. Emitieron observaciones sobre el manejo de metadatos y sobre los criterios de descarte aplicados a muestras sintéticas.
Participación en la mesa de trabajo sobre estándares de evaluación para modelos entrenados sin bases personales. Aportamos casos de uso y recibimos comentarios sobre métricas de equidad entre subgrupos.
Intercambio de pipelines de generación y verificación. El consorcio aportó documentación sobre licencias de uso y sobre límites de redistribución de los corpus sintéticos compartidos.
Acompañamiento en la redacción de consentimientos informados para estudios con datos sintéticos. Revisaron también los criterios de comunicación pública de resultados preliminares.