Computación visual, redes neuronales convolucionales e ingeniería del software, enseñadas construyendo sistemas reales que hoy están desplegados y en producción. 17 clases · 9 soluciones · 3 laboratorios · 85 nodos de ruta.
Aquí se construye el sistema completo, se rompe, y se documenta el número real que salió.
No qué función llamar, sino qué problema resuelve y cuándo falla. Con el error de diseño que costó descubrirlo.
Arquitectura, pipeline, inventario de archivos y la tabla completa de variables ajustables con el efecto de subir o bajar cada una.
Comentado línea por línea en español, con un reto para romperlo a propósito y ver qué pasa.
La detección en vivo corre en tu propia tarjeta gráfica dentro de la pestaña, con tu cámara. Tu vídeo nunca sale de tu equipo. Medido: 14-16 FPS con WebGPU, lo mismo que en nativo con CUDA.
Entrenar tus propios modelos, el vocabulario abierto y los tres laboratorios necesitan GPU local: eso no cabe en una pestaña, y decirlo claro vale más que un botón que decepcione. Se descarga desde tu cuenta.
Aquí se ve que el modelo es el 20 % del problema y el dominio el 80 %.
Por qué un detector COCO dice «person» sobre una radiografía, y qué sí se puede vender.
Medir técnica de remada: ángulos, fases, ritmo, errores y triangulación 3D.
Autos, camiones, mulas, grúas y maquinaria amarilla + lectura de placas.
De «qué es un píxel» a «sistema desplegado que factura».
Montamos el entorno con GPU y detectamos 80 objetos en vivo con la webcam.
Qué devuelve el modelo por dentro: el tensor, las cajas, las métricas.
Control de aforo: define una zona y cuenta objetos dentro en tiempo real.
IDs estables por objeto, trayectorias y conteo por cruce de línea.
Transfer learning sin etiquetado manual: captura, entrena y clasifica.
Máscaras por píxel y esqueleto de 17 puntos. La puerta a medir movimiento.
De la laptop al VPS: nginx, HTTPS, ONNX y medición en el navegador.
Matriz capacidad → producto → mercado, pricing y modelo de ingresos.
Nueve soluciones listas: mapa de calor, conteo, velocidad, colas y más.
Detectar por TEXTO lo que el modelo nunca entrenó.
Segmentar cualquier cosa y convertir detecciones en dataset.
Detector transformer sin NMS y cómo elegir modelo por restricciones.
ONNX, TorchScript y cuánto se gana de verdad al exportar.
La máscara de cualquier objeto que nombres, en tiempo real.
Clasificador propio de gestos con anti-rebote para disparar acciones.
21 puntos de la mano entrenando pose sobre un dataset propio.
OCR de matrícula naval con validación por norma y dígito verificador.
Las 17 clases, las 9 soluciones y los 3 laboratorios, con sus informes técnicos y todo el código comentado.