
Enfrentando un par de demandas relacionadas, Amazon y Microsoft reconocen que las personas que trabajan en sus respectivas tecnologías de reconocimiento facial descargaron la base de datos de fotos «Diversity in Faces» de IBM, compilada a partir de 1 millón de fotos cargadas por usuarios de Flickr, para ver si las imágenes mejoraron su IA. algoritmos
La respuesta, insisten ambas compañías, fue no.
Los investigadores y otros en Amazon y Microsoft determinaron de forma independiente en 2019 que la base de datos no ayudaría a la precisión de sus tecnologías de reconocimiento facial y decidieron no usarla, afirman los abogados de las empresas en presentaciones separadas en un tribunal federal en Seattle.
Pero los demandantes, dos hombres del área de Chicago que subieron miles de fotos a sus cuentas de Flickr bajo licencias Creative Commons, dicen que la evidencia muestra que Microsoft y Amazon usaron incorrectamente sus imágenes sin previo aviso por escrito y sin consentimiento, violando sus derechos bajo la Ley de Privacidad de Información Biométrica de Illinois. .
Y no fueron solo ellos, alegan: las demandas buscan el estatus de demanda colectiva, proponiendo representar a miles de personas cuyas fotografías se incluyeron en la base de datos sin su conocimiento.
Implicaciones mayores: Las demandas ilustran una serie de problemas más amplios que enfrentan la industria tecnológica y la sociedad, incluida la falta de una ley nacional de privacidad en los Estados Unidos; las compensaciones inherentes al desarrollo de modelos precisos de inteligencia artificial; y la difuminación de las líneas jurisdiccionales debido al auge de la computación en la nube.
Incluso si hubieran usado los datos, afirman Amazon y Microsoft, no están sujetos a la ley de privacidad de Illinois, porque la evidencia no ha establecido que los datos se descargaron y almacenaron en ningún servidor en el estado.
Los demandantes responden que la ley se aplica de todos modos, porque viven en el estado.
Aunque las fotos se subieron bajo licencias Creative Commons, los abogados de los demandantes dicen que usaron versiones de la licencia que prohibían el uso comercial y requerían la atribución a la fuente de las imágenes.
Nuevas acusaciones: Ambas demandas se presentaron en julio de 2020 en el Tribunal de Distrito de EE. UU. en Seattle, pero las presentaciones recientes agregan nuevos reclamos, basados en parte en declaraciones y documentos entregados por las empresas en el proceso de descubrimiento.
Los abogados de los demandantes, Steven Vance y Tim Janecyk de Tinley Park, Ill., alegaron en un par de documentos presentados la semana pasada que las personas que trabajan para Amazon y Microsoft hicieron más con las bases de datos de lo que ambas empresas habían dejado entrever inicialmente.
Los científicos investigadores de Amazon Web Services “hicieron un uso extensivo de los datos biométricos” derivados de las fotos, dicen los demandantes, afirmando que los argumentos de la empresa “se basan en una versión sesgada del expediente de hechos”.
El uso de la base de datos por parte de Microsoft fue «sustancial», alegan, «incluido, entre otros, el uso de metadatos contenidos en el conjunto de datos, la descarga de todo el millón de fotografías vinculadas allí, la ejecución de su tecnología de reconocimiento facial en un subconjunto de esos rostros, y potencialmente usándolo para evaluar otro sistema de reconocimiento facial que estaba buscando adquirir”.

Pero en un giro irónico, Microsoft y Amazon persuadieron a la corte para que les diera su propio grado de privacidad. Las versiones públicas de las últimas presentaciones judiciales redactan sentencias que de otro modo revelarían información recopilada por los demandantes en el proceso de descubrimiento, aparentemente para evitar que los secretos corporativos se hicieran públicos.
Privacidad frente a precisión: Las demandas contra Amazon y Microsoft, y las acciones relacionadas contra IBM en Illinois y Google en California, demuestran las compensaciones entre privacidad y precisión en el desarrollo de modelos de IA hambrientos de datos.
IBM lanzó originalmente la base de datos Diversity in Faces en enero de 2019 con el objetivo declarado de hacer que la inteligencia artificial sea más justa y equitativa entre géneros y colores de piel.
“Creemos que al extraer y publicar estas anotaciones del esquema de codificación facial en un gran conjunto de datos de 1 millón de imágenes de rostros, aceleraremos el estudio de la diversidad y la cobertura de datos para los sistemas de reconocimiento facial de IA para garantizar sistemas de IA más justos y precisos”, dijo el dijo la compañía en ese momento.
Desde entonces, los mayores desafíos del reconocimiento facial han provocado que las empresas de toda la industria retrocedan.
IBM le dijo a The Verge que solo se incluyeron imágenes disponibles públicamente en la base de datos, a la que solo podían acceder investigadores verificados, con la posibilidad de que las personas optaran por no participar en el conjunto de datos, según la compañía.
Según documentos judiciales, las inconsistencias en las fotos fueron una de las razones por las que la base de datos no fue útil para Microsoft y Amazon. Los sujetos miraban en diferentes direcciones y eran fotografiados a distancias y ángulos variables.
Falta de una ley nacional de privacidad: Las demandas ponen a prueba el alcance de la ley de privacidad de un estado, ilustrando las complicaciones creadas por la mezcla heterogénea de leyes estatales que han surgido en ausencia de leyes nacionales de privacidad.
La Ley de Transparencia de la Información y Control de Datos Personales, un proyecto de ley de privacidad a nivel nacional presentado el año pasado por la representante de EE. UU. Suzan DelBene, D-Wa, buscaba evitar lo que DelBene llamó un «mosaico» de leyes estatales de privacidad.

Sin embargo, el proyecto de ley no llegó a abordar el tema candente del reconocimiento facial. DelBene, una ex ejecutiva de Microsoft, dijo en ese momento que esperaba que la legislación tuviera más posibilidades de aprobarse como una ley básica de privacidad, dejando problemas más complejos para el futuro. La legislación se estancó de todos modos.
Microsoft y Amazon se encuentran entre las empresas que han pedido una legislación nacional de privacidad para brindarles un conjunto uniforme de reglas en todo el país.
Jurisdicción legal en la era de la nube: En documentos judiciales, Microsoft dice que un contratista y un pasante de la empresa descargaron el conjunto de datos «DiF» de IBM desde ubicaciones en el estado de Washington y Nueva York, «determinaron rápidamente que era inútil para los fines de investigación de Microsoft y, por lo tanto, no lo usaron para nada». .”
La empresa reconoce que, hipotéticamente, una parte encriptada de la base de datos podría haberse almacenado en un centro de datos en Chicago si el contratista o el pasante la hubieran subido a OneDrive. Sin embargo, la compañía dice que «no tiene motivos para creer que el conjunto de datos DiF se guardó alguna vez en OneDrive».
Incluso si una parte de la base de datos se almacenó en Illinois, la compañía afirma que la disposición pertinente de la ley estatal de privacidad “regula solo la adquisición de datos a través de una conducta principalmente y sustancialmente en Illinois, no el almacenamiento encriptado de datos fragmentados después de la adquisición”, sin crear jurisdicción legal en su opinión.
La defensa de Amazon sobre este tema es más directa, diciendo que la base de datos fue descargada por investigadores en el estado de Washington y Georgia, y cargada en Amazon Web Services US West Region en Oregón.
Los abogados de los demandantes no están de acuerdo con ambas compañías sobre este tema, citando un fallo de la Corte de Apelaciones del Noveno Circuito en un caso separado contra Facebook, calificando como «razonable inferir» que la legislatura estatal pretendía que la ley se aplicara a los residentes de Illinois » incluso si algunas actividades relevantes ocurren fuera del estado”.
El destino de las demandas podría depender de la perspectiva del tribunal sobre el tema de la jurisdicción. Mociones separadas para juicio sumario de Microsoft y Amazon están pendientes ante el juez federal de distrito James Robart en Seattle.
Presentaciones judiciales: Los casos son Vance contra Amazon.com Inc (2:20-cv-01084) y Vance contra Microsoft Corporation (2:20-cv-01082). Aquí están las últimas mociones y respuestas de Microsoft, Amazon y los demandantes:

Deja una respuesta