Microsoft ha lanzado un innovador sistema de seguridad diseñado para detectar alucinaciones en las aplicaciones de inteligencia artificial (IA) de sus clientes. Esta solución, integrada en las herramientas Azure AI Studio, tiene como objetivo proteger a los usuarios de posibles ataques maliciosos y respuestas no admitidas, conocidas como alucinaciones.

Sarah Bird, directora de productos de inteligencia artificial responsable de Microsoft, explicó en una entrevista con The Verge que estas nuevas características están diseñadas para ser fácilmente accesibles para los clientes de Azure, sin necesidad de contratar equipos especializados para probar los servicios de IA. Las herramientas, potenciadas por LLM, pueden detectar vulnerabilidades potenciales, monitorizar alucinaciones “plausibles pero no admitidas” y bloquear solicitudes maliciosas en tiempo real.

Estas medidas de seguridad buscan prevenir controversias generadas por respuestas no deseadas o inapropiadas, como las recientes relacionadas con imágenes falsas de celebridades o situaciones históricamente inexactas. Para lograrlo, Microsoft ha implementado tres características principales: Escudos de Solicitud, Detección de Fundamentación y evaluaciones de seguridad, disponibles en vista previa en Azure AI. Además, están en desarrollo dos características adicionales para dirigir modelos hacia salidas seguras y rastrear solicitudes problemáticas.

Uno de los aspectos destacados de esta solución es su capacidad para adaptarse a diferentes contextos de uso, ya sea que el usuario esté escribiendo una solicitud o que el modelo esté procesando datos de terceros. El sistema de monitoreo evalúa la entrada del usuario en busca de palabras prohibidas o solicitudes ocultas antes de enviarla al modelo, y luego verifica la respuesta del modelo en busca de posibles alucinaciones.

Bird también enfatizó que estas características de seguridad están integradas con modelos populares como GPT-4 y Llama 2. Sin embargo, para los usuarios de modelos menos conocidos, puede ser necesario configurar manualmente las características de seguridad.

Esta iniciativa refleja el compromiso de Microsoft con la seguridad y la expansión de la IA. La empresa ha estado trabajando activamente para fortalecer la seguridad de su software, especialmente en el contexto del creciente interés de los clientes en acceder a modelos de IA a través de Azure. Además, Microsoft ha ampliado su oferta de modelos de IA, recientemente firmando un acuerdo exclusivo con la empresa francesa de IA Mistral.

Con estas medidas, Microsoft busca brindar a sus clientes una experiencia de IA más segura y confiable, protegiendo contra posibles amenazas y promoviendo un uso ético y responsable de la tecnología.

Leave a Reply

Your email address will not be published. Required fields are marked *

You May Also Like

La Carrera de Chips Windows en Arm: MediaTek Desafía a Qualcomm

El mercado de los chips Windows en Arm está en pleno auge…

Los AirPods Max de Apple ahora disponibles por debajo de los $400 por primera vez

Los AirPods Max de Apple, conocidos por su calidad de sonido excepcional,…

Ex empleados de OpenAI advierten sobre falta de transparencia en seguridad de IA

Ex miembros del equipo de OpenAI alertan sobre falta de supervisión en…

Falla informática global afecta a aerolíneas, hospitales y más

Una gran falla informática provocó el viernes incidencias de calado en todo…

Nuestros servicios y aplicaciones favoritas para escuchar música

En el mundo actual, la música se ha convertido en una parte…

HP OmniBook X 14: Un portátil empresarial con gran duración de batería y rendimiento sólido

Descubre el HP OmniBook X 14, un portátil empresarial con impresionante duración…

Roku arruina televisores: Actualización de software impone suavizado de movimiento sin desactivación

El 6 de junio, el sistema operativo Roku de mi televisor TCL…

Google Inc. Avanza con el Modo ‘Live’ para Google Lens y AI Mode: Conversaciones en Tiempo Real con

En los últimos meses, Google ha estado revolucionando la manera en que…

Cómo eliminar los molestos correos promocionales en Gmail

¿Cansado de los correos promocionales que inundan tu bandeja de entrada? Aprende…

WhatsApp Lanza Transcripción Automática de Mensajes de Voz: Mejorando la Experiencia de Comunicación para Usuarios de iOS y Android

La nueva función de WhatsApp permite a los usuarios transcribir sus mensajes…