• Home / Noticias / Pablo Arbeláez participará en CVPR 2020, la mayor conferencia mundial de visión por computador
  • Pablo Arbeláez participará en CVPR 2020, la mayor conferencia mundial de visión por computador

    • Pablo Arbeláez participará en CVPR 2020, la mayor conferencia mundial de visión por computador
      Pablo Arbeláez participará en CVPR 2020, la mayor conferencia mundial de visión por computador
31/03/2020

Su estudiante doctoral Juan Carlos León también participará en la conferencia.

Pablo Arbeláez, profesor asociado de Ingeniería Biomédica y su estudiante doctoral, Juan Carlos León; participarán en CVPR 2020, la mayor conferencia mundial de visión por computador, que se celebrará en junio de 2020 en Seattle, Washington (Estados Unidos).

El comité científico de la conferencia aceptó el artículo de los investigadores que es producto de una colaboración con Adobe en edición de video con el uso de Inteligencia Artificial.

El objetivo principal del proyecto de los investigadores uniandinos es detectar lo que se conoce como "hablantes activos" que son las personas que están hablando y son visibles en un video arbitrario.

De esta manera la tarea se divide en tres pasos: primero localizar todas las personas en un video, segundo identificar si el audio corresponde a la voz humana y tercero identificar entre todas las personas cual o cuales están hablando.

La tarea suena extraña, pero es muy útil en la edición de video debido a que permite alinear automáticamente segmentos del video, así como enfocar al hablante activo. Por esta razón, el trabajo se realizó durante una pasantía en la división de investigación de Adobe Inc. y en colaboración con el laboratorio IVUL de la Universidad de KAUST (Emiratos Árabes Unidos).

Hoy en día, los métodos más avanzados para este problema se basan en analizar un único rostro y estimar una correspondencia entre el movimiento de la cara y la señal de audio. El método propuesto por los investigadores biomédicos parte de la misma base, pero es el primero que logra integrar información de múltiples rostros.

Esta solución se logró mediante dos técnicas complementarias: por un lado, una red neuronal siamesa que nos permite fusionar información visual (imágenes) y la señal de audio y por otro lado, usar una técnica conocida como "auto-atención" que básicamente le asigna un peso (importancia) a todos los rostros detectados en una escena. Esta combinación de fusión y auto-atención permite estimar la probabilidad que una persona sea el hablante activo analizando la escena completa, no un solo rostro.

Los resultados de esta investigación han superado a soluciones propuestas por Google, la Academia de Ciencias de China, y estudiantes del grupo de visión de Oxford, a la vez que utiliza muchos menos recursos computaciones, un aspecto que es crítico en el análisis de video dado el tamaño de los datos de entrada.

La participación uniandina en esta importante conferencia es un logro de la línea de investigación de Visión Artificial Biomédica que lidera el profesor Arbeláez en la Facultad de Ingeniería.

Noticias Recientes

  • Una semana para recargar cuerpo, mente y energía
    En la Facultad de Ingeniería sabemos que las grandes ideas, los proyectos que transforman el mundo y los retos que...
  • Trabajo en equipo, la apuesta de la ingeniería uniandina para construir equidad
    La equidad en ingeniería suele medirse en cifras: cuántas mujeres ingresan a las carreras, cuántas llegan a cargos de...
  • Startups de ingenieros uniandinos llegan a 2600 Campus para impulsar su expansión global
    Cinco startups fundadas y lideradas por ingenieros de la Universidad de los Andes fueron seleccionadas para hacer parte...
  • Del shiitake al snack: un hongo transformado con ingenio uniandino
    Cada vez son más las personas que cambian las papas fritas, las galletas o los pasabocas tradicionales por opciones con...
  • Conversamos con el nuevo decano, Bernardo Caicedo
    Desde el día en que llegó a la Universidad de los Andes, hace 35 años, el profesor Bernardo Caicedo encontró el lugar...
  • Campamento de programación, donde aprender código es solo el comienzo
    Hace cuatro años Sara decidió aprender a tocar flauta traversa porque, según cuenta entre risas, era el único...
  • Así se vive la ingeniería en la Escuela de Verano para Jóvenes
    En tan solo dos semanas analizaron muestras para identificar las condiciones necesarias para la existencia de vida en...
  • "Esta podría ser la última generación de líderes exclusivamente humanos": Jorge Arias
    La inteligencia artificial está entrando en una nueva etapa. Si durante los últimos años las herramientas generativas...
  • Datacenters: los nuevos puertos de la economía digital
    La inteligencia artificial avanza a una velocidad sin precedentes y, detrás de cada modelo, plataforma o aplicación...
  • Natalia Villegas, ingeniera por admiración, Suma Cum Laude por pasión
    Desde muy pequeña, mientras escuchaba a su mamá explicarle matemáticas a su hermana mayor, algo hizo clic en ella. Tal...
  • Robots, médicos e inteligencia artificial: así se transforma el futuro de la medicina
    El pasado 7 de mayo, el Auditorio Mario Laserna de Universidad de los Andes reunió a investigadores, médicos,...
  • Olimpiadas STEM-Uniandes, cuando las matemáticas se convierten en inspiración
    “La prueba fue muy linda y retadora, pero a mí me encantan los retos. Incluso, después de la segunda ronda, me llevé...