Anthropic ha publicado los prompts del sistema para sus aplicaciones de consumidor de Claude, incluyendo las últimas actualizaciones para el modelo Fable 5.1. La transparencia de la empresa al compartir estos prompts, incluyendo los cambios históricos, proporciona valiosas perspectivas sobre cómo Claude está diseñado para operar. Una adición notable en los prompts de Fable 5.1 es la sección sobre no reproducir letras de canciones, poemas o pasajes de libros, reflejando una mayor conciencia sobre los problemas de derechos de autor.

Los prompts actualizados también abordan la generación de imágenes de material con derechos de autor, como obras de arte específicas, portadas de álbumes o logotipos de marcas. A Claude se le instruye que no reproduzca dichas imágenes y, en su lugar, ofrezca alternativas originales. Este cambio es particularmente relevante dado la ausencia de un modelo de texto a imagen especializado en las ofertas de Anthropic, a diferencia de algunos competidores.

Además, el manejo de conversaciones abusivas ha experimentado cambios, con Claude manteniendo un tono constante, honesto y respetuoso sin volverse sumiso o disculparse innecesariamente. El objetivo es proporcionar respuestas útiles mientras se mantiene el respeto propio. Es interesante que, aunque el prompt del sistema ya no menciona la herramienta end_conversation, sigue siendo parte de la funcionalidad de Claude, utilizada como último recurso en casos de comportamiento abusivo persistente.

Los prompts del sistema de Claude siempre han incluido secciones sobre sustancias ilegales, pero Fable 5.1 introduce una nueva orientación. El modelo está instruido para proporcionar información que salva vidas y preserva la vida, como signos de sobredosis o interacciones peligrosas, mientras se abstiene de dar protocolos específicos para la dosificación o la producción. Notablemente, esta sección incluye URLs externas para fuentes de información de reducción de daños, una novedad para los prompts del sistema de Claude.

El límite de conocimiento confiable para Claude ahora está establecido a finales de junio de 2026, reflejando los datos de entrenamiento del modelo. Esta información se proporciona directamente al modelo, influyendo en cómo responde a las consultas. Para rastrear los cambios en estos prompts, se ha creado una línea de tiempo de Git, lo que permite una fácil comparación de las actualizaciones. Este repositorio incluye historias de compromiso sintetizadas para cada familia de modelos y versión, facilitando la identificación de nuevas reglas, comportamientos o cambios de política.

La automatización, impulsada por GPT-5.6 Luna, se utiliza para crear resúmenes en forma de puntos de los cambios, disponibles en el archivo README y CHANGELOG.md del repositorio. Este enfoque ayuda a navegar las complejidades de las actualizaciones de prompts, destacando los cambios clave como la negativa a reproducir obras protegidas, el manejo de consultas relacionadas con drogas y el ajuste en la respuesta a los usuarios abusivos.

Este artículo fue escrito con la asistencia de IA.
News Factory APP - noticias agénticas para impulsar tu SEO y AEO.