Google agrega barandillas para mantener la IA bajo control
GOOGLE I/O 2023, VISTA A LA MONTAÑA, CALIFORNIA – Entre los principales anuncios en Google I/O, los ejecutivos de la compañía discutieron las medidas de seguridad para sus nuevos productos de IA para garantizar que se usen de manera responsable y no se abuse de ellos.
Muchos de los ejecutivos, incluido el CEO de Google, Sundar Pichai, señalaron algunas preocupaciones de seguridad asociadas con las tecnologías avanzadas de IA que salen de los laboratorios. La proliferación de información errónea, falsificaciones profundas y textos o imágenes ofensivos generados por IA sería extremadamente dañino si Google fuera responsable del modelo que creó ese contenido, dice James Sanders, analista principal de CCS Insight.
“La seguridad en el contexto de la IA se refiere al impacto de la inteligencia artificial en la sociedad. Los intereses de Google en la IA responsable están motivados, al menos en parte, por proteger su reputación y evitar la interferencia de los reguladores», dice Sanders.
Por ejemplo, Universal Translator es una rama de video AI de Google Translate que puede tomar grabaciones de una persona hablando y traducir el discurso a otro idioma. La aplicación podría expandir potencialmente la audiencia del video para incluir personas que no hablan el idioma original.
Pero la tecnología también podría erosionar la confianza en el material de origen, ya que la IA altera el movimiento de los labios para que parezca que la persona está hablando en el idioma traducido, dijo James Manyika, vicepresidente senior de Google y responsable del desarrollo responsable de la IA. demostró la aplicación en el escenario.
“Hay una tensión inherente aquí. Puede ver cuán increíblemente útil puede ser esto, pero los actores maliciosos pueden abusar de algunas de las tecnologías subyacentes para crear falsificaciones profundas. Hemos construido el servicio alrededor de barandillas para evitar abusos y hacerlo accesible solo para socios autorizados», dijo Manyika.
Configuración de barandillas personalizadas
Diferentes empresas abordan las pautas de IA de manera diferente. Google se enfoca en controlar los resultados generados por las herramientas de inteligencia artificial y restringir quién puede realmente usar las tecnologías. Por ejemplo, Universal Translators tiene menos de 10 socios disponibles. ChatGPT ha sido programado de tal manera que no puede responder ciertos tipos de preguntas si la pregunta o la respuesta pueden causar daño.
Nvidia tiene Barreras de seguridad NeMo, una herramienta de código abierto para garantizar que las respuestas coincidan con los parámetros especificados. También la tecnología evita que la IA alucine, el término para una respuesta segura que no está justificada por los datos de entrenamiento. Si el programa de Nvidia determina que la respuesta no es relevante dentro de ciertos parámetros, puede negarse a responder la pregunta o enviar la información a otro sistema para encontrar respuestas más relevantes.
Google lo compartió Investigación sobre medidas de protección en su nuevo modelo PaLM-2 de lenguaje grande, también anunciado en Google I/O. Este documento técnico de Palm-2 explica que hay algunas preguntas en ciertas categorías que no son manejadas por el motor de IA.
“Google confía en las pruebas automáticas de adversarios para identificar y reducir estos gastos. Los investigadores académicos utilizan la Perspective API de Google, creada para este propósito, para probar modelos de OpenAI y Anthropic, entre otros”, dijo Sanders de CCS Insight.
Patear los neumáticos en DEF CON
Los comentarios de Manyika encajan en la narrativa del uso responsable de la IA, que ha cobrado urgencia en medio de las preocupaciones sobre el uso indebido de tecnologías como ChatGPT por parte de actores malintencionados. Crear enfoques de phishing o generar código malicioso irrumpir en los sistemas.
AI ya se ha utilizado para videos y voces deepfake. La empresa de IA Graphika, que cuenta entre sus clientes al Ministerio de Defensa, identificó recientemente casos de Imágenes generadas por IA utilizado para influir en la opinión pública. «Creemos que la implementación de productos de IA disponibles comercialmente permitirá a los actores de IO crear contenido engañoso de calidad cada vez mayor a mayor escala y más rápido», escribió el equipo de Graphika en su informe de deepfakes.
La Casa Blanca se ha sumado al pedido de guardarraíles para frenar el abuso de la tecnología de IA. A principios de este mes, la administración de Biden aseguró compromisos de empresas como Google, Microsoft, Nvidia, OpenAI y Stability AI para permitir que los participantes lo hagan. calificar sus sistemas de IA públicamente durante DEF CON 31, que se llevará a cabo en Las Vegas en agosto. Los modelos se integran en equipo rojo utilizando una plataforma de evaluación desarrollada por Scale AI.
«Este ejercicio independiente proporcionará a los investigadores y al público información importante sobre las implicaciones de estos modelos y permitirá a las empresas y desarrolladores de IA tomar medidas para abordar los problemas que se encuentran en estos modelos», dijo el comunicado de la Casa Blanca.
Este contenido de ciberseguridad nos ha llegado de: DarkReading
Llegarás a la noticia original en el enlace que sigue: https://www.darkreading.com/dr-tech/google-adds-guardrails-to-keep-ai-in-check
