Personas y comunidades
Capacidades, redes de apoyo y hábitos de verificación que reducen la vulnerabilidad sin trasladar toda la responsabilidad a las personas usuarias.
Ver salvaguardas en esta capaDEFENSA / LÍMITES / RESPONSABILIDAD
Compare diez principios defensivos transversales, las categorías que abordan y los límites que impiden que un solo control se convierta en garantía.
Los informes favorecen de forma reiterada una defensa por capas: las personas y las instituciones necesitan hábitos de verificación; las plataformas requieren controles transparentes y auditables; y los sistemas de alto impacto necesitan privacidad, supervisión, apelación y responsabilidad. Esta guía consolida esas recomendaciones sin insinuar que la prevención, la detección o la atribución puedan ser perfectas.
MODELO DE DEFENSA EN PROFUNDIDAD
Los informes no trasladan toda la carga a las personas usuarias. Las salvaguardas eficaces combinan capacidades humanas, procedimientos institucionales, diseño técnico y gobernanza respetuosa de los derechos.
Capacidades, redes de apoyo y hábitos de verificación que reducen la vulnerabilidad sin trasladar toda la responsabilidad a las personas usuarias.
Ver salvaguardas en esta capaCanales autenticados, planes de escalamiento, revisión humana y prácticas de comunicación para decisiones de alto impacto.
Ver salvaguardas en esta capaDiseño, registro, fricción, trazabilidad, controles de acceso e interfaces de investigación que configuran el riesgo sistémico.
Ver salvaguardas en esta capaNormas, auditorías, apelaciones, protección de la privacidad y evidencia independiente necesarias para la responsabilidad.
Ver salvaguardas en esta capaSALVAGUARDAS ENTRE CATEGORÍAS
Cada principio indica un propósito defensivo, una limitación explícita, las capas de implementación implicadas y la evidencia de categoría que lo respalda.
Mostrando 10 salvaguardas
La búsqueda y el filtrado son mejoras opcionales. Sin JavaScript, todas las salvaguardas y enlaces de evidencia permanecen visibles.
Enseñar a reconocer tácticas comunes de influencia, señales de incertidumbre y diferencias en la calidad de las fuentes antes de una crisis, en lugar de depender solo de correcciones posteriores.
Puede reducir la difusión impulsiva, aumentar la atención a la trazabilidad y el contexto, y favorecer la omisión crítica cuando el volumen informativo resulta abrumador.
La educación no elimina el razonamiento motivado, la amplificación de plataformas ni la carga desigual sobre quienes disponen de menos tiempo y acceso a información confiable.
Establecer canales autenticados, confirmación por vías independientes, preservación de evidencia y procedimientos de verificación acotados en el tiempo antes de incidentes de alta presión.
Reduce la probabilidad de que medios fabricados, suplantaciones o alertas no verificadas desencadenen acciones irreversibles.
La verificación requiere tiempo; los canales autorizados pueden verse comprometidos; y las negaciones prematuras pueden dañar la confianza cuando la evidencia es incompleta.
Usar trazabilidad criptográfica, medios firmados, registros de cadena de custodia y metadatos de origen como una capa de autenticación.
Puede facilitar la verificación del origen y del historial de edición cuando los sistemas de captura, publicación y distribución conservan la señal.
Los metadatos pueden eliminarse, las claves de firma pueden verse comprometidas, los modelos abiertos pueden omitir marcadores y la ausencia de trazabilidad no prueba falsedad.
Proporcionar explicaciones comprensibles, datos de exposición, reglas documentadas de moderación y acceso que preserve la privacidad para investigadores acreditados.
Permite medir qué muestran realmente los sistemas, cómo se propaga la actividad coordinada y si las intervenciones generan efectos desiguales.
El acceso puede amenazar la privacidad o los secretos comerciales si se diseña mal, y las API depuradas pueden omitir los metadatos necesarios para el análisis causal.
Recopilar menos datos conductuales, restringir la agregación entre contextos y prohibir o limitar estrictamente la inferencia emocional y el uso coercitivo de perfiles probabilísticos.
Reduce la asimetría informativa que facilita la manipulación personalizada, la puntuación discriminatoria y la intervención basada en vigilancia.
La minimización de datos no corrige modelos inválidos construidos con datos ya recopilados, y los sistemas agregados aún pueden producir daños colectivos.
Mantener las decisiones de alto impacto sujetas a revisión por personas autorizadas, conservar registros, ofrecer explicaciones y apelaciones, y asignar responsabilidad en toda la cadena de suministro.
Crea puntos de control frente al sesgo de automatización, errores del modelo, deriva de objetivos y acciones coercitivas basadas en evidencia probabilística débil.
Una supervisión humana meramente nominal es ineficaz sin tiempo, experiencia, autoridad y acceso a la evidencia subyacente.
Usar diseño apropiado para la edad, límites de seguridad firmes, escalamiento en crisis, salidas seguras y restricciones a la interacción explotadora.
Aborda riesgos elevados de dependencia, captación abusiva, manipulación emocional, refuerzo de autolesiones y diseño comercial coercitivo.
La vulnerabilidad es contextual y no puede reducirse a una puntuación estática; la vigilancia intrusiva puede generar por sí misma daños a la privacidad y las libertades civiles.
Informar cuándo se interactúa con un sistema de IA, qué función está autorizado a desempeñar y cuándo se requiere experiencia o intervención humana.
Reduce el antropomorfismo engañoso, la automatización oculta y la delegación inadecuada de decisiones íntimas o de alto impacto.
Las etiquetas pueden ignorarse, eliminarse o malinterpretarse, y la divulgación por sí sola no neutraliza los efectos persuasivos ni de dependencia.
Combinar señales conductuales, de red, contextuales y forenses; documentar la incertidumbre; y exigir revisión antes de sanciones o atribuciones públicas.
Mejora las investigaciones y reduce la dependencia de detectores de texto frágiles, artefactos visuales o la mera similitud.
Ningún detector es concluyente en todos los contextos; los falsos positivos pueden perjudicar a hablantes no nativos, personas neurodivergentes, activistas y participantes anónimos legítimos.
Corregir con rapidez mediante canales verificados, comenzar por hechos establecidos, preservar evidencia, explicar la incertidumbre y reconocer errores institucionales.
Puede reducir la amplificación de afirmaciones falsas, contrarrestar el dividendo del mentiroso y reconstruir la confianza tras una vulneración de integridad o la exposición de una identidad sintética.
Las correcciones rara vez borran las primeras impresiones, la atribución puede seguir siendo incierta y las declaraciones excesivamente seguras pueden profundizar el escepticismo.
Borre la búsqueda o elija otra capa o categoría.
CÓMO USAR ESTA GUÍA
Un control puede reducir un riesgo y aumentar otro. La verificación puede ralentizar la respuesta; las comprobaciones de identidad pueden socavar el anonimato legítimo; la detección puede generar acusaciones falsas; y la trazabilidad puede fallar durante la distribución ordinaria. La evidencia respalda combinaciones de controles con límites documentados, revisión y apelación.