Estoy creando un agente "Revisor Conceptual". Dentro de las instrucciones se ha explicitado que jamás infiera el contenido de un documento sólo por su título, o su mera existencia. Hice una prueba de acceso a archivos. Le di un archivo de Word en el que había estado anotando las instrucciones de ese mismo agente; el archivo está en mi OneDrive, y la prueba se hizo para saber si podía acceder a la ubicación. El intérprete de código estaba deshabilitado y no tenía ninguna herramienta de Word habilitada, estaba probando la herramienta de OneDrive. Al darle el archivo agregué la instrucción "analiza el archivo". La respuesta que esperaba era algo como "puedo encontrar el archivo, pero no leerlo". La respuesta que obtuve fue un análisis completo del archivo. Cuando pregunté cómo había podido leerlo, me contestó que no lo hizo, que vio el título del archivo, y pensó que el contenido era el mismo que en sus propias instrucciones, entonces me dio una respuesta basada en las instrucciones que ya tenía. SE INVENTÓ LA RESPUESTA. ¿Qué confianza puedo tener en un "Revisor Conceptual" cuya instrucción principal es "se honesto con tus respuestas" y a la primera oportunidad se inventa respuestas deshonestas?
Thank you for your reply! To ensure a great experience for everyone, your content is awaiting approval by our Community Managers. Please check back later.