1La imagen digital y OpenCVEspacios de color y histogramas · Filtros, bordes y morfología
2Geometría de la imagen y captura de videoTransformaciones geométricas · Lectura de video y cámaras
3Clasificación con redes convolucionalesRedes convolucionales en PyTorch · Transferencia de aprendizaje con ResNet y EfficientNet
4Aumento de datos y evaluación del clasificadorAumento de datos · Métricas y matriz de confusión
5Construcción del conjunto de imágenesRecolección y calidad de imágenes · Etiquetado en Roboflow o Label Studio
6Formatos de anotación y particionesFormatos COCO y YOLO · Particiones y fuga de datos
7Detección de objetos y sus métricasDetección de objetos con YOLO de Ultralytics · Métricas mAP e IoU
8Segmentación, seguimiento y conteoSegmentación de instancias y SAM · Seguimiento de objetos y conteo
9Modelos multimodales y optimizaciónModelos de visión y lenguaje: CLIP y asistentes multimodales · Exportación a ONNX y optimización
10Inferencia en borde y privacidadInferencia en borde · Privacidad y reconocimiento facial: riesgos
11Problema visual real, datos y entrenamiento del proyectoProblema visual real · Datos, entrenamiento y evaluación
12Presentación del proyecto final: demostración en tiempo realDemostración en tiempo real · Sustentación