Saltar al contenido principal
Volver a Noticias
AI Tools

AWS añade evaluadores centrados en habilidades a Strands Evals y Bedrock AgentCore

El SDK Strands Evals y las Evaluaciones de Amazon Bedrock AgentCore ahora ofrecen tres evaluadores centrados en habilidades para agentes que utilizan habilidades modulares.

Publicado: 22 de septiembre de 2026Por GetAISet Editorial

Publicación de la fuente original: 22 de septiembre de 2026

Amazon Web Services anunció que el SDK Strands Evals y la capacidad de Evaluaciones de Amazon Bedrock AgentCore incluyen tres evaluadores centrados en habilidades: Precisión de Selección de Habilidad, que devuelve un resultado binario que indica si una habilidad invocada coincide con la tarea; Seguimiento de Instrucciones de Habilidad, que califica cuán completamente un agente sigue los pasos prescritos de una habilidad en una escala de cinco niveles; y Habilidad Invocada, una verificación determinista que confirma que una habilidad nombrada se cargó correctamente. Estos evaluadores operan sobre trayectorias de agente registradas en Strands Evals o sobre trazas OpenTelemetry capturadas por AgentCore, lo que permite a los desarrolladores aislar errores de enrutamiento y pasos procedimentales omitidos que las métricas de salida genéricas podrían pasar por alto.

Las herramientas están disponibles a través de un SDK de Python (requiriendo Python 3.10+ y acceso a Bedrock) y mediante la CLI de AgentCore. Al integrar los evaluadores en suites de pruebas o puertas de despliegue, los equipos pueden diagnosticar problemas de selección de habilidades, verificar el cumplimiento de instrucciones y aplicar la carga crítica de habilidades sin invocar modelos adicionales. Esto respalda un desarrollo de agentes más mantenible y modular para casos de uso como asistentes de recursos humanos o procesamiento de documentos.