¿Qué es la visión por computadora?
Miras una foto y en un instante sabes que es un gato, sin esfuerzo. La visión por computadora (CV) intenta darle a las máquinas ese mismo truco: leer una imagen o un vídeo, reconocer objetos, entender la escena, seguir el movimiento e incluso captar qué está pasando.¿Cómo funciona?
Las imágenes son númerosPara una máquina, una foto es una cuadrícula enorme de píxeles, cada uno con valores de rojo, verde y azul. El trabajo de la CV es sacar «gato», «coche» o «cara» de todos esos números.
De las características al significado
Los primeros sistemas usaban características diseñadas a mano. Hoy la mayoría se apoya en redes neuronales convolucionales (CNN) que aprenden solas. Capa a capa pasan de bordes y texturas a ojos y orejas, y al final arman la idea de «gato».
¿Dónde trabaja ya?
Coches autónomosLas cámaras detectan carriles, peatones, vehículos y señales en tiempo real para que el coche «vea» la carretera.
Seguridad y vigilancia
Los sistemas marcan anomalías en horas de vídeo y reconocen caras y matrículas.
Imagen médica
La IA ayuda a los médicos a encontrar lesiones en TC y radiografías, detectando problemas antes.
La cámara de tu móvil
El modo retrato, las fotos nocturnas y el escaneo de QR funcionan con visión por computadora.
¿Por qué es difícil?
Lo que para nosotros es «obvio» para una máquina es brutal. Oclusiones, cambios de luz, ángulos raros: cualquiera de ellos la confunde, por eso la CV necesita océanos de datos etiquetados para entrenarse.En resumen: la visión por computadora le da a las máquinas un par de ojos capaces de entender el mundo.
Comentarios