La IA que reconoce personas
Al girar la cabeza, el recuadro amarillo desapareció primero. Los puntos azules aguantaron bastante más.
El método de 2001 solo aprendió la forma de una cara de frente: que donde están los ojos es más oscuro que lo de debajo, que el caballete de la nariz es más claro que los lados. Al girar la cabeza esa relación se rompe.
Los dos barren
Pero aquí hay que ver algo más importante. Activa Ver cómo barre el método antiguo.
Un cuadradito va barriendo toda la pantalla. Es exactamente lo mismo que vimos en 2.2: una ventanita que se mueve casilla a casilla por encima de la imagen.
Los sitios que se ven claros son los que pasaron varias etapas. Y casi todos los sitios de la pantalla caen en la primera etapa. Por eso el método de 2001 era rápido: en cuanto ve que no, lo tira enseguida.
El método de hoy también barre la imagen. Lo que cambia es qué busca. Los dos barren, pero el antiguo busca «forma de cara» y el de hoy busca «dónde van los puntos».
El trabajo de acertar dónde van los puntos
Al apagar el vídeo solo quedan los puntos. Lo único que maneja la IA son estos puntos.
En una cara hay 478 puntos. Se colocan muy juntos siguiendo los ojos, la boca y la línea de la barbilla. A estos puntos los llamamos .
Cambia a Manos y a Postura. Hace exactamente lo mismo: acertar dónde van los puntos.
La IA no sabe «qué es una cara». Sabe dónde hay que poner los puntos. Eso es lo que de verdad hay detrás de reconocer.
No existe el 100 %
Cambia a Manos y mira cuánta seguridad tiene sobre qué mano es. ¿Pone 100 %?
No. Reconocer es siempre . Quiere decir «hay un 87 % de que esto sea la mano derecha», no «es la mano derecha».
Prueba a esquivar también el método de hoy. Tápate media cara, apaga la luz o ponte muy de lado. Antes o después lo pierde.
Lo de hoy no es perfecto: solo lo hace mejor.
Ahora toca el sonido
Hasta aquí todo iba de ver con los ojos. Pero la IA también maneja sonido.
El sonido no es un dibujo, así que ¿cómo lo hace? La respuesta llega en el próximo capítulo, y es un poco inesperada.
Lo que sostiene este capítulo
- 19 Viola & Jones, "Rapid Object Detection using a Boosted Cascade of Simple Features", CVPR 2001
- 21 Fujifilm, "FinePix S6500fd" press release and specifications (2006-07-13) — the first Fujifilm camera with face detection
- H11 Es el detector de caras frontales de OpenCV (BSD-3 · Apache-2.0). No hemos tocado sus números
- H11·P4 Son tres vídeos alternativos hechos por quien escribió este libro. En pantalla se indica que están hechos con IA
- P4 Son los modelos de cara, manos y postura de MediaPipe (Apache-2.0). Van todos incluidos, así que no sale ninguna petición al exterior
- H11 Medimos en segundos el tramo en el que el método de 2001 pierde la cara en el vídeo y ajustamos el ejercicio para que pase por ese tramo