domingo, 28 de abril de 2019

PROPTECH: LOS ALGORITMOS QUE GENTRIFICAN TU CIUDAD


         Si pensamos en la relación entre las nuevas tecnologías y la gentrificación seguramente lo primero que nos venga a la mente sea Airbnb. El capitalismo de plataforma aplicado al turismo ha sido uno de los factores que ha encarecido la vivienda en muchas ciudades, aunque no el único. Pero la tecnología ha creado una nueva rama de herramientas y empresas tecnológicas bajo el nombre de PropTech.

   Las ciudades, y las personas que las habitamos, están totalmente mapeadas. El flujo de datos que producimos mediante el uso de las redes sociales, la geolocalización de nuestro teléfono o aquellos que cedemos cuando clickeamos en esa pestaña en la que "aceptamos las condiciones” están siendo aprovechados por una nueva oleada de start-ups tecnológicas al servicio del sector inmobiliario y de inversores que quieren volver a él. Algoritmos que cruzan tus "me gusta" con datos sobre evolución de precios de viviendas, tus "estrellas" al último restaurante en el que has comido con el precio del metro cuadrado de solares vacíos de la misma zona, los follows a una cadena de gimnasios con la permisividad de la legislación urbanística y fiscal para nuevos inversores. Big data y machine learning que acaba señalando puntos concretos a inversores, constructoras o inmobiliarias para que rentabilicen al máximo su dinero. 


INTELIGENCIA ARTIFICIAL ASESORANDO A FONDOS BUITRE
   Skyline AI, fundada en Nueva York hace tan solo dos años es una tecnológica que extrae datos de más de 130 fuentes diferentes utilizando machine learning, software que aprende y evoluciona de manera autómata, con el fin de "mejorar la experiencia existente para lograr un elevado rendimiento a lo largo del ciclo de vida de la inversión". La empresa realiza un estudio algorítmico sobre mapas de Google para identificar bloques de apartamentos a los que se les puede sacar una rentabilidad futura mayor.
El cruce del big data sobre distancias a restaurantes, escuelas de calidad u otras facilidades señala a Skyline AI el punto exacto. Una vez elegido el edificio, la empresa ofrece dicha información a los fondos de inversión inmobiliarios para realizar ofertas por el edificio de manera conjunta. Según datos de la propia empresa, actualmente tienen cartografiados y digitalizado los datos de 400.000 edificios en los Estados Unidos.


FACEBOOK CONFIRMA QUE "MILLONES DE CONTRASEÑAS" DE INSTAGRAM ESTUVIERON ALMACENADAS EN TEXTO PLANO Y A LA VISTA DE SUS EMPLEADOS


            El pasado 21 de marzo, Facebook confirmó que habían almacenado por error más de 200 millones de contraseñas de usuarios de Facebook en texto plano y a la vista de unos 2.000 desarrolladores e ingenieros de la compañía. La compañía de Mark Zuckerberg también mencionó que "millones" de estas contraseñas pertenecían a usuarios de Instagram.

"Descubrimos registros adicionales que pertenecen a contraseñas de Instagram que se almacenaron en un formato legible. Ahora estimamos que este problema afectó a millones de usuarios de Instagram. Notificaremos a estos usuarios como lo hicimos con los demás. Nuestra investigación ha determinado que estas contraseñas almacenadas no fueron usadas de forma malintencionada de forma interna o se tuvo acceso a ellas de forma externa."

   Dentro de esta misma publicación, el resto se mantiene tal cual, es decir, seguimos sin saber al cifra exacta de afectados, tampoco hay detalles de estos nuevos registros pertenecientes a Instagram, ni se sabe cómo ocurrió este error y cómo llegaron a él.

   Facebook afirma que han resuelto el error y están notificando a las personas afectadas, pero que no será necesario restablecer la contraseña, aunque sí mencionan que lo mejor sería cambiarla. Tampoco se especifica cómo se resolvió el error o cómo se garantizará que esto no vuelva a ocurrir.

   Cuando se llevó a cabo el primer anuncio relacionado con esta brecha de seguridad, KrebsOnSecurity afirmó que entre 200 y 600 millones de contraseñas, sin ningún tipo de cifrado, habían estado a la vista desde 2012 a los ojos de unos 20.000 empleados de la compañía, unos 2.000 ingenieros, y se generaron unos 9.000 millones de accesos a estos datos en texto plano.

Fuente: Xataka


martes, 16 de abril de 2019

LOS TRABAJADORES DE AMAZON ESCUCHAN CONVERSACIONES DE LOS USUARIOS DE ALEXA, SEGÚN BLOOMBERG


         En plena era de los asistentes virtuales, Alexa, del gigante Amazon, el más completo, arroja dudas sobre qué es lo que realmente escuchan y almacenan estos asistentes, dejándonos en ocasiones casos preocupantes, como el de un usuario que pidió a Amazon sus datos de actividad y acabó recibiendo 1.700 grabaciones de un desconocido.

   Bloomberg, quien deja caer la sospecha de que los trabajadores de la compañía escuchan lo que los usuarios dicen a Alexa. Un equipo entero estaría dedicado a analizar los clips de audio, en aras de mejorar el propio funcionamiento del asistente.
   Según Bloomberg, siete personas que han trabajado en los equipos de revisión de Alexa, afirman que hay todo un equipo analizando los clips de audios del asistente. Las grabaciones se envían, transcriben y posteriormente se vuelven a enviar al propio asistente, con el fin de ayudar a Alexa a ser "más humano" y comprender de mejor forma nuestro lenguaje. Ha de tenerse en cuenta asimismo que Alexa es incapaz de activarse sin escuchar su palabra de activación (su nombre), por lo que no se escuchan todas las conversaciones, aunque se saben de falsos positivos que activan Alexa y se queda a la escucha.

Los propios trabajadores destacan que a pesar de que Alexa mejora constantemente gracias a la nube, no se puede obviar el factor humano en este tipo de tecnologías, por lo que se hace necesario un equipo que analice y envíe feedback al asistente para su mejora.

Según dichas fuentes de Bloomberg, un equipo global con trabajadores de práticamente todas partes del mundo, trabajan en una oficina que ocupa tres de los pisos de un bloque en Rumanía, en el que no se puede ver letrero alguno de Amazon. Algunos de los trabajadores tienen la función de transcribir las grabaciones para compararlas con la propia transcripción que hace Alexa, analizando así si la respuesta dada por el asistente fue precisa o no.
   Otros tienen la función de anotar todo lo que escucha Alexa, desde conversaciones hasta ruidos de fondo. Cuando se detecta información personal, el trabajador debe anotar que el archivo contiene datos críticos. Escuchar todo lo que dice Alexa conlleva acabar oyendo grabaciones con contenido sensible (posibles crímenes), asaltos sexuales... Ante estas situaciones los trabajadores de Amazon no intervienen.

   Lo curioso del caso es que las fuentes apuntan a que la propia compañía establece procedimientos a seguir en el caso de oír este tipo de grabaciones, pero los trabajadores afirman que, tras consultar a Amazon sobre los mismos, la respuesta que recibieron era la de no entrometerse.

    "Nos tomamos en serio la seguridad y privacidad de la información personal de nuestros clientes. Solo anotamos una muestra pequeña de las grabaciones de voz de Alexa para mejorar la experiencia del cliente". Portavoz de Amazon

   Según Bloomberg, un portavoz de Amazon relató vía email que la muestra que analizan los trabajadores de la compañía es mínima, y que el obejtivo no es más que mejorar la propia experiencia del cliente. El tratamiento de esa información, según el portavoz, ayuda a que Alexa reconozca y comprenda el lenguaje de una forma más natural.
   Apunta también a que los empleados no tienen acceso directo a información que pueda identificar a una persona, y que todos los datos obtenidos se tratan con confidencialidad, cifrando y restringiendo el acceso a los mismos.

   Los datos enviados parecen no almacenar información acerca del nombre y dirección del usuario, ya que van ligados al número de serie del dispositivo, y al nombre de usuario de Amazon.

Fuente: Genbeta


ENCUENTRAN UNA BASE DE DATOS CON 540 MILLONES DE DATOS DE USUARIOS DE FACEBOOK EN UN SERVIDOR SIN CONTRASEÑA NI CIFRADO


         Los problemas en cuanto a la seguridad y falta de privacidad en Facebook continúan. Hoy la firma de seguridad UpGuard asegura haber encontrado una base de datos dentro de los servidores de Amazon, la cual no tenía contraseña ni ningún tipo de cifrado, vamos, en texto plano, y que contenía 540 millones de registros pertenecientes a usuarios de Facebook.

   Según la información, esta base de datos de 146 GB pertenece a la compañía 'Cultura Colectiva', con sede en Ciudad de México, la cual habría almacenado de forma pública toda esta información, donde se incluyen gran parte de las actividades de estos 540 millones de usuarios, como comentarios, 'likes', contraseñas, reacciones, nombres de cuentas y más.

   La base de datos propiedad de 'Cultura Colectiva' estaba en un servidor de almacenamiento de Amazon S3. Tras informar a Facebook de esto, la compañía de Zuckerberg se puso en contacto con Amazon para cerrar el acceso a toda esta información, según apunta Bloomberg.

   UpGuard también encontró una segunda base de datos propiedad de 'At the Pool', un fabricante de aplicaciones que actualmente ya no está operativo, en dicha base de datos se encontraban datos más delicados como nombres, listas de amigos, fotos, intereses, suscripciones a grupos y localizaciones, los cuales pertenecían a poco más de 22.000 usuarios de Facebook.

   Según UpGuard, se pusieron en contacto tanto con 'Cultura Colectiva' como con 'At the Pool' para informar de los riesgos de seguridad de estas bases de datos expuestas, pero nunca tuvieron respuesta.

   Según Facebook, ambas bases de datos ya han sido eliminadas y hasta el momento no hay evidencia de que los datos hayan sido usados con fines maliciosos.

Fuente: Xataka


domingo, 31 de marzo de 2019

FACEBOOK CONOCÍA LAS PRÁCTICAS DE CAMBRIGDE ANALYTICA MESES ANTES DE QUE SE DESTAPARA EL ESCÁNDALO


        Aunque Facebook lleva unos años saltando de escándalo en escándalo, el caso Cambrigde Analytica es quizás uno de sus puntos más negros y que más daño ha hecho a la imagen de la compañía.

   Tras destaparse estas prácticas a finales de 2015, hemos visto como Mark Zuckerberg testificaba ante el Congreso y Senado de los EEUU, como la compañía recibía multas millonarias o como muchísimos usuarios se sumaban a un boicot para abandonar la red social.

   Pues parece que Facebook todavía no ha podido cerrar este episodio, y seguimos conociendo datos acerca de cómo se produjo este escándalo. Ahora sabemos que algunos empleados de la compañía conocían lo que estaba ocurriendo con Cambridge Analytica y alertaron a sus superiores en septiembre de 2015. Eso significa que había trabajadores dentro de la red social que sabían lo que estaba haciendo Cambridge Analytica meses antes de que esta noticia publicara en los medios.

   No olvidemos que Facebook, y Mark Zuckerberg, hasta ahora había mantenido que se habían enterado de lo ocurrido por la prensa. Gracias a una demanda presentada por el fiscal general de Washington DC ahora sabemos que algunos empleados de la red social ya conocían las "prácticas inadecuadas" de Cambridge Analityca meses antes de saltar la información a la prensa.
   Mediante un comunicado, un portavoz de la compañía ha afirmado que "Facebook no engañó en absoluto a nadie sobre esta línea de tiempo":

    "En septiembre de 2015, los empleados escucharon especulaciones de que Cambridge Analytica estaba reuniendo datos, algo que desafortunadamente es común en cualquier servicio de Internet.

    En diciembre de 2015, nos enteramos por primera vez a través de los medios de comunicación de que Kogan vendía datos a Cambridge Analytica, y tomamos medidas. Esas eran dos cosas diferentes".

   Debemos recordar que Cambridge Analytica utilizó los datos de 87 millones de usuarios para influir en las pasadas elecciones en Estados Unidos (en las que, como ya sabemos, acabó consiguiendo la victoria Donald Trump).

Fuente: Genbeta

 

lunes, 25 de marzo de 2019

ASÍ ES COMO EN POCOS AÑOS PODRÁS PERDER TU PRIVACIDAD


       Lo que consideramos privado cada vez lo es menos, pero a su vez, informarse al respecto es una forma de protegerse. ¿Has hablado con alguien y después te ha aparecido publicidad en tu teléfono acerca de lo que comentaste?

   Facebook, Instagram, Twitter, juegos entretenidos para pasar el día, aplicaciones que reconocen esa canción que no conoces, test de personalidad, mapas celestiales que dictan tu horóscopo y que recopilan tu fecha de nacimiento, intereses y más. Todo esto lo puedes hacer gratis desde tu celular, sólo necesitas acceso a Internet (incluso hay aplicaciones con las que ya no necesitas consumir datos para usarlas) e incluso hay lugares donde a cambio de algunas preguntas, te regalan horas de acceso a la red.

   Parece algo gratis, pero en realidad estás pagando todo eso con información personal. Cada vez que navegas en Facebook y entras a grupos de tu interés, toda la data recopilada la almacena Facebook para después mostrarte publicidad personalizada.
   Esto no es nuevo. Desde hace años cuando googleabas algo, el big data comenzaba a trabajar para mostrarte lo que podrías comprar. En ese entonces parecía una ganancia, pues al ser un buscador y no tener una inteligencia artificial tan precisa como ahora, en verdad parecía una ganancia, pero ahora vivimos en una era más cercana a Black Mirror que a una utopía tecnológica.

   Hace unos días en un grupo de Whatsapp (compañía que pertenece a Facebook) un amigo preguntó dónde podía comer un buen cheescake en la ciudad. La conversación no fue de más de 6 mensajes en los que la palabra cheecake sólo se mencionó dos veces y después cambiamos de tema.
   Sin embargo, 10 minutos después, una de las personas de ese grupo (que no había participado en ese intercambio de mensajes) envió una captura de pantalla en la que Facebook ya le estaba mostrando publicidad acerca de ese postre.

   Hoy muchos memes muestran lo que la gente sospecha desde hace mucho, que el micrófono del teléfono se activa para escuchar las conversaciones de los usuarios y seguir recopilando información, pues muchos juran que después de una conversación, incluso sin haber buscado nunca algo relacionado a eso en sus teléfonos, aparece publicidad acerca de lo que comentaban.

   Hoy los bancos nos piden acceso a nuestra cuenta por medio de nuestra voz, pero, ¿qué tan seguro eso eso? las extorsiones telefónicas se limitan a hacernos decir “sí” o “no”; nos venden la idea de que usar nuestro rostro para desbloquear nuestro teléfono o hacerlo un emoji animado es una buena idea, pero ¿cuánto falta para que nos obliguen a ver (sin quitar los ojos del teléfono) un anuncio para así poder seguir navegando?

   Hoy en China existe un gran programa de reconocimiento facial que va de la mano con un sistema de puntos por buen comportamiento para los ciudadanos. El mensaje es claro, el que nada debe nada teme. Si no haces nada malo, ¿por qué te molestaría que el gobierno pueda ver cada uno de tus movimientos? Estos programas hacen que los pobres vivan en una marginación aún mayor y que el miedo de ser sorprendidos haciendo algo malo se convierta en terrorismo local.

   Estos programas están comenzando a ser exportados. Hoy muchas empresas –propiedad privada por lo que uno debe someterse a sus normas si quiere laborar ahí– lo usan, pero poco a poco los países occidentales comienzan a ver eso como un arma para combatir la delincuencia. Y así es como nos acercamos cada vez más a un mundo como el que imaginó George Orwell en “1984”.

Fuente: Bioguia


UN ESTUDIO CONSTATA EL ESPIONAJE MASIVO A LOS USUARIOS DE MÓVILES


        Los teléfonos móviles se han convertido en el principal instrumento de captación de datos privados con valor comercial de los ciudadanos, según un estudio de la Universidad Carlos III de Madrid cuyas principales conclusiones fueron divulgadas este lunes. El trabajo constató el espionaje masivo que sufren los usuarios a través de aplicaciones (apps) instaladas en miles de terminales de 214 marcas gracias a un "complejo sistema desarrolladores y acuerdos comerciales en el que las apps preinstaladas disponen de permisos privilegiados y sin posibilidad de que un usuario medio pueda desinstalarlas.

   El estudio, uno de los más serios realizados hasta la fecha, identifica más de 1.200 compañías que hacen uso intensivo de esa información con un total de 11.000 librerías o conjunto de datos destinados en su mayoría a la publicidad y monitorización on line con fines comerciales sin conocimiento de los usuarios.

   Un análisis exhaustivo de esas apps reveló que una fracción importante de las mismas «presenta comportamientos potencialmente maliciosos o no deseados, como muestras de malware, troyanos genéricos o software preinstalado que facilitaría prácticas fraudulentas».
En relación con la información ofrecida al iniciar un nuevo terminal, se pone de manifiesto un «déficit de transparencia de las apps y del propio sistema operativo Android» al mostrar al usuario una «relación de permisos distinta de la real, limitando su capacidad de decisión para gestionar su información personal».

   La Agencia Española de Protección de Datos (AEPD), que contribuye a la difusión del estudio por el impacto masivo de los resultados en la privacidad de los ciudadanos, presentará los resultados de la investigación el próximo 1 de abril.
   El trabajo, realizado por el Instituto IMDEA Networks y la Universidad Carlos III de Madrid, abarca más de 82.000 apps preinstaladas en más de 1.700 dispositivos Android fabricados por 214 marcas y tuvo entre sus objetivos identificar los agentes presentes en el software preinstalado en Android y que utilizan el acceso privilegiado a recursos del sistema para la obtención de datos personales de usuarios; revelar los acuerdos comerciales entre vendedores de dispositivos Android y terceros, incluyendo organizaciones especializadas en la monitorización y rastreo de usuarios y en proporcionar publicidad en internet; detectar y analizar vulnerabilidades y otras prácticas opacas y analizar la transparencia en la información proporcionada al usuario.

   Del estudio se desprende que el modelo de permisos del sistema operativo Android y de sus apps permite que un gran número de actores puedan monitorizar y obtener información personal de los usuarios a nivel del sistema operativo. Además, el usuario final desconoce la presencia de estos actores en sus terminales Android y las implicaciones que dichas prácticas tienen sobre su privacidad y se establecen mecanismos para dificultar la eliminación de esos programas intrusivos si no se es un usuario experto.

   El mecanismo utilizado para apoderarse de la información personal de cada usuario se articula a través de 4.845 permisos propietarios o personalizados por los intervinientes en la fabricación de los terminales: «Este tipo de permisos permite que apps publicadas en Google Play eludan el modelo de permisos de Android para acceder a datos del usuario sin requerir su consentimiento al instalar una nueva app», afirma el estudio.

Fuente: El Periodico

 

FACEBOOK SE ENFRENTA A UNA INVESTIGACIÓN CRIMINAL POR HABER COMPARTIDO DATOS PERSONALES CON MÁS DE 150 COMPAÑÍAS


         Facebook está siendo investigada por fiscales federales del estado de Nueva York, quienes buscan saber qué fue lo que pasó y quién o quiénes son los responsables de aquellos acuerdos que se establecieron entre Facebook y más de 150 compañías, los cuales permitían compartir datos privados de los usuarios.

   Según el New York Times, se trata de una investigación criminal que inició desde hace varios días y de la que no existen detalles públicos, por lo que se desconoce cuándo se integró el jurado y cuáles son los cargos, pero al tratarse de una "investigación criminal" estaríamos ante imputaciones penales que no se resolverían sólo con una multa económica.
   Según la información, los fiscales federales están analizando las negociaciones que permitieron que empresas ajenas a Facebook pudieran tener acceso a datos confidenciales, como mensajes privados e información de contacto, sin el consentimiento de los usuarios.

   Entre estas negociaciones hay nombres de compañías como Netflix, Spotify o Amazon. En junio pasado, se creía que estos acuerdos sólo abarcaban a algunos fabricantes de smartphones, como Apple, Samsung, Microsoft o BlackBerry, pero a finales de 2018 se descubrió que estas alianzas iban más allá, llegando a una lista de más de 150 compañías.

   Según Facebook, estas alianzas no tienen nada de ilegal ya que se habrían hecho con el permiso de los usuarios y por lo tanto no se infringía el acuerdo que la compañía hizo con la FTC (Comisión Federal de Comercio) en 2012, que precisamente limitaba a Facebook para compartir y comercializar los datos de sus usuarios con terceros ajenos a la plataforma.

   Según el Times, el jurado a cargo de esta investigación criminal ya emitió un par de citatorios a "al menos dos destacados fabricantes de smartphones y otros dispositivos", quienes deberán presentarse a declarar para dar detalles de las negociaciones que realizaron con Facebook. Pero como mencionaba, al no existir información pública de la investigación, no se sabe cuándo se llevará a cabo la audiencia o las comparencias.

   Ante esta nueva información, Facebook ha salido a ofrecer las siguientes declaraciones:

    "Ya se ha informado que hay investigaciones federales en curso, incluso por parte del Departamento de Justicia. Como hemos dicho antes, estamos cooperando con los investigadores y tomamos todo esto con seriedad. Hemos dado testimonio públicos, respondido preguntas y prometemos que seguiremos haciéndolo".


   Hay que recodar que esta no es la única investigación en curso relacionada con la falta de privacidad en Facebook, también hay una por parte de la Comisión Federal de Comercio relacionada con el robo de datos de aproximadamente 87 millones de usuarios, la cual apunta a que terminará en una multa de miles de millones de dólares.

   Asimismo, también están las acusaciones por parte del Departamento de Justicia ante el escándalo de Cambridge Analytica, las cuales llevaron a Mark Zuckerberg a declarar ante el congreso de los Estados Unidos, y con la que se busca aprobar una legislación general sobre privacidad de datos a finales de este año.

Fuente: Xataka


jueves, 14 de marzo de 2019

ASÍ ES CÓMO GOOGLE NOS VIGILA Y CONOCE NUESTROS MOVIMIENTOS A TRAVÉS DE LAS REDES WI-FI, SEGÚN ORACLE


      El gigante de las búsquedas, de una u otra forma, conoce muchas cosas de nuestro día a día. Recopila información de qué buscamos, por dónde vamos a través de Google Maps, etc.
Un informe presentado por Oracle asegura que Google crea perfiles de usuarios de Android con información sobre dónde trabajan, viven, cómo se mueven, etc. Básicamente un registro de todo lo que hacen y cuándo lo hacen.

   Como podemos imaginar, esta información puede ser valiosa de cara a posibles anunciantes. Google recoge todos estos datos, crea informes sobre nuestras actividades, lugar de residencia… Oracle asegura que recogen información personal, de nuestro día a día, estilo de vida e incluso datos de nuestro hogar o lugar de trabajo.

   Pero, ¿cómo sabe toda esta información Google? Según este informe de Oracle del que nos hacemos eco, utiliza las redes Wi-Fi a las que nos conectamos los usuarios. De esta forma es capaz de crear informes según la ubicación de las mismas o el tiempo que pasamos conectados.
   Un ejemplo, si cada día de lunes a viernes nos conectamos por la mañana de una hora a otra hora determinada, puede interpretar que es nuestro lugar de trabajo. Si cada día nos conectamos a una hora por la tarde o noche y pasamos allí toda la noche, lo considerará como nuestro lugar de residencia habitual. Todo esto lo utiliza para crear informes y puede conocer cuánto tiempo trabajamos, dónde trabajamos, qué hábitos tenemos según el tiempo que pasemos en casa, etc.

   Esto ha provocado la ira de Oracle, que ha presentado un informe ante las autoridades australianas para que lo analicen. Quieren saber qué hay realmente detrás de todo esto y para qué utiliza Google todos estos datos.
   Lógicamente Google no utiliza solo lo relacionado con el Wi-Fi. Como hemos mencionado, conoce todas nuestras búsquedas y datos que recopila a través de sus aplicaciones. Puede utilizar todo esto para venderlo a empresas de publicidad. De esta forma podrían orientar publicidad relacionada con nuestros hábitos.

   En definitiva, según informa Oracle, Google puede atentar contra la privacidad de los usuarios y crear informes donde recopila todos nuestros hábitos. Todo ello lo consigue a través de nuestras búsquedas y aplicaciones que utilizamos. Pero además también es capaz de registrarnos a través de nuestro móvil Android, según las redes Wi-Fi a las que nos conectamos.

   Por tanto, cuando escuchemos eso de que Google sabe todo de nosotros, lo cierto es que puede saber incluso más de lo que creemos. Las herramientas al menos las tiene.

Fuente: Redeszone


ASÍ APROVECHÓ IBM MILLONES DE FOTOS DE FLICKR CON LICENCIA CREATIVE COMMONS PARA MEJORAR SU RECONOCIMIENTO FACIAL


         Los sistemas de reconocimiento facial están por todas partes, pero necesitan una materia prima esencial: datos y más datos. Para entrenar los algoritmos, los investigadores no solo trabajan en mejorar sus modelos, también necesitan grandes bases de datos para poder probar si los sistemas funcionan. ¿De dónde salen estos datos? En el caso de IBM, según ha revelado NBCNews, de imágenes con licencia CC de Flickr.

   IBM publicó el año pasado un conjunto de datos denominado 'Diversity in Faces'. Se trata de un trabajo interesante ya que en vez de basarse en imágenes de personas famosas, mostraban la amplia pluralidad de rostros que pueden existir. Algo que sirve para mejorar el reconocimiento facial en su tratamiento, por ejemplo, con diversos tonos de piel.
   Pero lo que no se conocía es que muchas de estas imágenes han sido extraídas de Flickr e incluyen imágenes personales. Tanto es así que muchos usuarios se han encontrado sorprendidos al conocer que estaban en esa base de datos, sin haber dado consentimiento previo para tal uso.

   Según explica un fotógrafo afectado a la NBC, "ninguna de las personas que fotografié tenían idea que sus fotos iban a ser utilizadas de esta manera". La clave del asunto está en el uso de la licencia Creative Commons; mientras que sí se permite utilizar estas imágenes, era difícil anticipar que se utilizarían estas imágenes para entrenar sistemas de reconocimiento facial y que posteriormente pueden clasificar rostros en función del género, el color de pelo o la etnia.