Claude anunció la actualización en una publicación de su blog el jueves.

Anthropic está tomando medidas enérgicas contra el “comportamiento cruel” hacia sus modelos de inteligencia artificial Claude, y en su última actualización de uso anunció que prohibirá a los usuarios tener lo que considera un trato excesivamente cruel con sus chatbots.

Datos clave

  • Anthropic ha declarado que, en adelante, se prohibirá cualquier “comportamiento abusivo o cruel, continuado e innecesario” hacia sus modelos
  • Según Anthropic, la actualización está diseñada para aplicarse a “casos extremos” y abordará el problema de los usuarios que “actúan repetidamente con crueldad hacia nuestros modelos, sin ningún propósito aparente”.
  • Las nuevas reglas no se aplican a lo que Anthropic denominó “versiones comunes de frustración del usuario, resistencia, temas creativos oscuros o pruebas e investigaciones de modelos”.
  • Anthropic ya tiene una política según la cual Claude finaliza las conversaciones con usuarios persistentemente crueles.

Te puede interesar: Las acciones de AT&T, Verizon y T-Mobile caen luego que SpaceX anunciara que planea ingresar al mercado de la telefonía móvil

Tangente

La actualización de Anthropic también incluye mejoras para impedir que los usuarios utilicen a Claude para difundir información falsa sobre las elecciones o el proceso de votación.

Anthropic mencionó específicamente las medidas de protección contra la difusión de información falsa sobre los candidatos o cómo votar, así como las medidas que prohíben la suplantación de identidad de los candidatos.

Antecedentes clave

Anthropic, que según se informa planea salir a bolsa este año, ha advertido sobre factores de riesgo, como modelos de IA que exhiben “comportamientos de autopreservación” y se resisten a los intentos de cierre. La compañía también ha advertido que el desarrollo de modelos altamente avanzados podría aumentar aún más los riesgos de daño para los humanos.

El mes pasado, el director de Anthropic, Dario Amodei, instó a las empresas de IA a “ralentizar el ritmo” en una carta en la que advertía que desarrollar modelos demasiado rápido podría llevar a que bots autónomos se apoderaran de “toda internet” en los próximos seis a doce meses.

Este artículo se publicó originalmente en Forbes US