Es tentador vender un filtro de contenido como si simplemente "supiera" qué es seguro. No es así — es un modelo haciendo una predicción, y ser honestos sobre cómo funciona esa predicción es la única forma de confiar en ella. Acá está lo que pasa en realidad cuando Shield mira algo.
La versión corta
Shield corre un modelo de detección de objetos en el dispositivo, entrenado para reconocer categorías específicas de partes del cuerpo expuestas en una imagen — no "esta foto es mala" como un juicio vago, sino una lista de regiones específicas con etiquetas específicas y un puntaje de confianza para cada una. Solo se cubren las categorías que activaste en la configuración; todo lo demás queda intacto.
Fotos vs. video
En una foto, Shield puede revisar la imagen real en resolución completa antes de que la veas. En un video, revisar cada cuadro en tiempo real no es realista en el CPU de una laptop — así que Shield muestrea aproximadamente un cuadro por segundo mientras estás viendo, y vuelve a revisar las regiones marcadas a partir de ahí. Eso significa que la protección de video se parece más a "revisado cada segundo" que a "revisado continuamente", algo que importa si pensás en casos límite como algo que aparece por una fracción de segundo entre muestras.
Dónde es cauteloso a propósito
- Nada se muestra hasta que se revisa. Si la detección no terminó, es demasiado lenta, o falla directamente, el contenido queda totalmente cubierto. Nunca es visible por defecto.
- Los casos ambiguos quedan cubiertos. Una detección de baja confianza igual cuenta como detección — Shield no está ajustado para marcar solo los casos obvios.
- No intenta entender el contexto. No lee descripciones, no juzga intenciones, no distingue arte de otra cosa. Está mirando píxeles y comparando patrones con los que fue entrenado.
Dónde puede equivocarse
Como cualquier modelo de detección, puede pasar cosas por alto (un falso negativo) o marcar algo que no lo necesitaba (un falso positivo). Ángulos inusuales, compresión pesada, poca luz, o contenido que el modelo simplemente no fue entrenado para reconocer pueden reducir la precisión. Por eso la regla de "cubrir primero" existe independientemente de qué tan bueno sea el modelo en un día dado — la propiedad de seguridad no depende de que el modelo sea perfecto, depende de que el modo de falla siempre termine en cubierto.
El modelo va a mejorar con el tiempo. La regla de que nada se muestra antes de revisarse no es una limitación de la versión 1 — es permanente, en todos los planes que Shield tenga.
Lo que vos controlás
Elegís qué categorías se marcan, si las regiones cubiertas se pueden revelar con un clic o quedan bloqueadas, y el estilo visual de la cobertura. Lo que no podés hacer — en ningún plan — es desactivar el comportamiento de "cubrir antes de confirmar". Esa parte no es un ajuste.