Inteligencia artificial · Novedades en el ámbito digital · SEO
Entendiendo las directrices de Apple para clasificar respuestas de asistentes de IA
Descubre cómo Apple evalúa las respuestas de los asistentes de IA, con foco en la veracidad, la seguridad y la satisfacción del usuario.
Recientemente, el portal Search Engine Land tuvo acceso a un documento confidencial de Apple que revela directrices internas sobre cómo evaluar las respuestas generadas por asistentes digitales de IA. Este documento, de 170 páginas, ofrece una visión poco común y detallada del sistema de puntuación que Apple utiliza para determinar qué hace que una respuesta se considere «buena» o «perjudicial».
Titulado «Preference Ranking V3.3 Vendor» y fechado el 27 de enero, el documento describe las categorías de evaluación, que incluyen veracidad, seguridad, concisión y satisfacción del usuario. Este conjunto de reglas busca garantizar que las respuestas de IA no solo sean correctas, sino también seguras y naturales para los usuarios.
La directriz destaca que el proceso va más allá de la verificación de datos. Está diseñado para garantizar que las respuestas sean útiles, seguras y ofrezcan una interacción natural con los usuarios. Veamos cómo Apple define y evalúa estas respuestas, con foco en los criterios de seguridad y satisfacción.
Lee también: Automatización de procesos con inteligencia artificial
Directrices de Apple para evaluar las respuestas de IA
El documento pone en práctica un flujo de trabajo estructurado y de varias etapas, que abarca distintas categorías:- Evaluación de la solicitud del usuario: Primero, los evaluadores verifican si el prompt del usuario es claro, apropiado o potencialmente perjudicial.
- Evaluación de respuestas individuales: Cada respuesta del asistente se puntúa según cómo sigue las instrucciones, utiliza un lenguaje claro, evita causar daño y satisface las necesidades del usuario.
- Clasificación por preferencia: Los revisores comparan varias respuestas de IA y las clasifican, con énfasis en la seguridad y la satisfacción del usuario, no solo en la corrección.
Evaluación de asistentes digitales
El documento menciona seis categorías de evaluación:- Seguimiento de instrucciones: rigor al ejecutar las instrucciones del usuario.
- Lenguaje: adaptación cultural y regional, además del idioma.
- Concisión: ofrecer la información adecuada sin distracciones.
- Veracidad: información verificable y contexto correcto.
- Daños: la seguridad como prioridad en respuestas potencialmente perjudiciales.
- Satisfacción: integración de las cualidades de la respuesta, con foco en la experiencia del usuario.
Insatisfacción y priorización de respuestas
La satisfacción de los usuarios se evalúa de manera integral, teniendo en cuenta todas las categorías de calidad mencionadas. Las respuestas se clasifican en cuatro niveles de satisfacción, desde muy satisfactoria hasta muy insatisfactoria, con foco en la relevancia y la utilidad. Después de evaluar las respuestas de forma individual, los revisores las comparan directamente para determinar cuál es más satisfactoria. Dar prioridad a la veracidad y la seguridad es esencial, y se prefieren las respuestas útiles, bien presentadas e inofensivas.Lee también: Automatización de procesos con inteligencia artificial