IA | Control

Amazon lanza "Guardrails for Amazon Bedrock" para controlar lenguaje AI

Amazon anuncia nuevas herramientas para controlar los modelos de lenguaje y evitar respuestas inapropiadas

En el evento AWS re:Invent que se está celebrando en Las Vegas, el CEO de Amazon Web Services (AWS), Adam Selipsky, ha anunciado una nueva herramienta llamada "Guardrails for Amazon Bedrock". Esta herramienta tiene como objetivo proporcionar un mayor control sobre los modelos de lenguaje utilizados en aplicaciones de inteligencia artificial, permitiendo a las empresas definir y limitar los tipos de lenguaje que un modelo puede utilizar.

En una publicación de blog, Amazon explica que con Guardrails for Amazon Bedrock, las empresas pueden implementar salvaguardias para ofrecer experiencias de usuario relevantes y seguras, alineadas con las políticas y principios de la compañía. Esta herramienta es especialmente útil para evitar respuestas inapropiadas o ofensivas que podrían dañar la reputación de una marca.

Controlando las respuestas de los modelos de lenguaje

La nueva herramienta de Amazon permite a las empresas definir temas que están fuera de los límites del modelo de lenguaje, de modo que no responda a preguntas irrelevantes. Por ejemplo, una empresa de servicios financieros puede evitar que el modelo de lenguaje proporcione consejos de inversión inapropiados que los clientes puedan tomar en serio. Además, es posible filtrar palabras y frases específicas para eliminar cualquier tipo de contenido ofensivo.

Amazon también ofrece la opción de filtrar datos de información personal identificable (PII, por sus siglas en inglés) para evitar que los modelos de lenguaje accedan a datos privados al proporcionar respuestas. Esto es especialmente importante en términos de privacidad y seguridad de los datos.

El desafío de desarrollar inteligencia artificial responsable

Según Ray Wang, fundador y analista principal de Constellation Research, esta herramienta puede ser fundamental para los desarrolladores que trabajan con modelos de lenguaje, ya que les ayuda a controlar las respuestas no deseadas. Wang destaca que uno de los mayores desafíos en la creación de inteligencia artificial responsable es garantizar la seguridad y facilidad de uso. La filtración de contenido y la protección de la información personal son dos de los principales desafíos a los que se enfrentan los desarrolladores. Además, destaca la importancia de la transparencia, explicabilidad y reversibilidad en el desarrollo de modelos de lenguaje.

Disponibilidad y próximos pasos

La función de guardrails anunciada por Amazon está actualmente en versión de prueba. Se espera que esté disponible para todos los clientes el próximo año. Esta herramienta representa un paso importante en el control de los modelos de lenguaje utilizados en aplicaciones de inteligencia artificial, permitiendo a las empresas garantizar respuestas relevantes y seguras para los usuarios, al tiempo que evitan cualquier tipo de contenido inapropiado u ofensivo.


Podcast El Desván de las Paradojas
Publicidad


Otras noticias • IA

Asistente personalizado

Bluesky lanza Attie, asistente de IA para personalizar feeds

Bluesky ha lanzado Attie, un asistente de IA que permite a los usuarios personalizar sus feeds sociales y realizar preguntas abiertas mediante la funcionalidad Quests....

Interacción vocal

ChatGPT ahora permite interacción por voz para mayor eficiencia

OpenAI ha lanzado una actualización de ChatGPT que permite la interacción por voz, mejorando la eficiencia y naturalidad en el uso de la inteligencia artificial....

Revolución IA

AMD lanza Helios para competir con Nvidia en IA

AMD ha lanzado Helios, un sistema de rack diseñado para revolucionar la computación en inteligencia artificial, desafiando a Nvidia. Con el procesador Venice-X en camino,...

Ciberseguridad innovadora

AegisAI lucha contra el phishing impulsado por inteligencia artificial

La inteligencia artificial está potenciando ataques cibernéticos, especialmente a través del correo electrónico. AegisAI, una startup fundada por exejecutivos de Google, desarrolla soluciones innovadoras para...

Asistente mejorado

Claude mejora rendimiento y se integra con Gmail y Slack

Anthropic ha actualizado su asistente virtual Claude, mejorando su rendimiento en conversaciones y permitiendo integración con aplicaciones como Gmail y Slack. La nueva versión ofrece...

Revolución médica

ChatGPT Health transforma acceso médico pero plantea riesgos importantes

ChatGPT Health de OpenAI está revolucionando el acceso a información médica en EE. UU. Sin embargo, su uso plantea riesgos, como lo evidenció una demanda...

Crecimiento notable

Gemini de Google supera 950 millones de usuarios mensuales

Google ha anunciado que su asistente AI, Gemini, ha alcanzado más de 950 millones de usuarios mensuales, triplicando su base en un año. Con innovaciones...

Exploración lunar

Colaboración NASA y Lunar Outpost impulsa exploración lunar sostenible

La exploración lunar avanza con la colaboración de empresas como Lunar Outpost y la NASA, utilizando tecnología como los chips Jetson de Nvidia en rovers....