Docs de Autonomy
AI Assistants

Acciones disponibles

Las 15 herramientas MCP para casos de prueba, planes de pruebas, ejecuciones, entornos y evidencia externa.

Autonomy MCP expone 15 herramientas generadas a partir del mismo catálogo de operaciones que la API HTTP. Los nombres que aparecen a continuación son estables y usan el glosario del producto: un caso de prueba es una secuencia ejecutable de pasos, mientras que un plan de pruebas es una selección ordenada de casos de prueba.

Casos de prueba

HerramientaPropósito
autonomy_test_case_listEnumerar los casos de prueba de la organización, primero los más recientes. Filtra por plataforma o por una consulta de nombre. Úsala antes de crear un caso para reutilizar la cobertura existente.
autonomy_test_case_getObtener un caso de prueba con su lista completa de pasos.
autonomy_test_case_createCrear un caso de prueba a partir de pasos explícitos. Los valores de relleno son literal, agent (elegido por el agente en tiempo de ejecución) o environment (valor de entorno con nombre disponible en tiempo de ejecución); los literales con apariencia de credenciales se rechazan a menos que se trasladen explícitamente a un secreto de entorno.
autonomy_test_case_update_stepsSustituir toda la lista de pasos de un caso de prueba. Requiere confirm: true; sin este valor, la respuesta describe qué cambiaría y no se escribe nada.

Planes de pruebas

HerramientaPropósito
autonomy_test_plan_listEnumerar los planes de pruebas (selecciones con nombre de casos de prueba) de la organización.
autonomy_test_plan_getObtener un plan de pruebas con sus casos de prueba integrantes en orden.
autonomy_test_plan_createCrear un plan de pruebas y, opcionalmente, sus casos de prueba integrantes iniciales en orden.
autonomy_test_plan_set_membersSustituir la composición ordenada de un plan de pruebas. Eliminar casos requiere confirm: true; sin este valor, la respuesta enumera los casos que se eliminarían y no se escribe nada.

Ejecuciones y evidencia

HerramientaPropósito
autonomy_run_triggerEncolar ejecuciones. Proporciona exactamente uno de testCaseId o testPlanId (un plan encola una ejecución por cada caso integrante). Indica como objetivo un entorno guardado mediante su slug o pasa objetivos explícitos para un despliegue o artefacto nuevo. Devuelve una respuesta de inmediato; continúa con run.get.
autonomy_run_listEnumerar las ejecuciones recientes, primero las más nuevas. Filtra por estado, caso de prueba, entorno o rama. Consulta aquí antes de activar trabajo duplicado.
autonomy_run_getObtener el estado de una ejecución. Pasa el cursor anterior y waitMs (≤ 25000) para bloquear hasta que algo cambie; timedOut: true significa que nada cambió y no es un error. next es una recomendación, nunca una autoridad.
autonomy_run_evidenceEvidencia externa de una ejecución: para cada paso, qué mostró el producto, qué se esperaba, el veredicto y el diagnóstico, acciones neutrales y enlaces multimedia de corta duración. Nunca incluye detalles internos del modelo, prompt, token o runner. Filtra con step.

Entornos

HerramientaPropósito
autonomy_environment_listEnumerar los entornos (objetivos de despliegue con nombre) con sus objetivos por plataforma. Se muestran los nombres de los valores disponibles en tiempo de ejecución, pero nunca sus valores.
autonomy_environment_getObtener un entorno mediante su slug.
autonomy_environment_upsertCrear un entorno o actualizar uno mediante su slug. Actualizar un slug existente sobrescribe los objetivos proporcionados y requiere confirm: true; sin este valor, la respuesta describe el cambio y no se escribe nada.

Las notas solo están disponibles mediante la API HTTP y no son herramientas MCP.

Confirmación de sustituciones

Autonomy no solicita una segunda confirmación interactiva dentro de MCP. En su lugar, las operaciones que sustituyen una configuración existente requieren un valor explícito confirm: true:

  • autonomy_test_case_update_steps siempre sustituye toda la lista de pasos.
  • autonomy_test_plan_set_members requiere confirmación cuando la nueva composición elimina casos.
  • autonomy_environment_upsert requiere confirmación cuando su slug ya existe y se actualizarían los campos proporcionados.

Sin confirmación, la herramienta devuelve INVALID_ARGUMENT con confirmRequired: true y un resumen wouldChange. Lee ese resumen antes de volver a intentarlo con confirm: true; no añadas la confirmación de forma automática.

Esperar una ejecución

autonomy_run_trigger devuelve una respuesta de inmediato. Continúa con autonomy_run_get:

  1. Llama a autonomy_run_get con el runId devuelto.
  2. Guarda el cursor numérico de la respuesta.
  3. Mientras next sea wait, vuelve a llamarla con ese cursor y un valor de waitMs de hasta 25000.
  4. Una respuesta con timedOut: true significa que la ejecución no cambió durante esa espera. No es un error; repite la llamada con el mismo cursor o deja de esperar.
  5. Cuando next sea evidence, llama a autonomy_run_evidence.

next es una recomendación, no una autoridad. Usa el estado, el veredicto, la validez, el progreso y el estado de los pasos devueltos al decidir qué hacer.

Evidencia externa

autonomy_run_evidence solo devuelve la evidencia que una organización puede extraer de Autonomy: acciones y objetivos de los pasos, resultados observados y esperados, veredicto y validez, diagnóstico, recuentos de recuperación y enlaces de corta duración a capturas de pantalla, fotogramas o vídeos. Los enlaces multimedia caducan después de 15 minutos; vuelve a llamar a la herramienta para obtener enlaces nuevos.

La evidencia externa nunca incluye la identidad del modelo o proveedor, prompts, cifras de tokens o costes, errores sin procesar del runner, nombres de herramientas internas ni árboles de interfaz de usuario sin procesar.

Objetivos de activación

autonomy_run_trigger acepta platforms con web, api, ios y android. Usa environmentSlug cuando el objetivo ya esté guardado. Usa targets para un despliegue o artefacto nuevo.

PlataformaCampos del objetivo
Webtargets.web.baseUrl
APItargets.api.baseUrl, targets.api.runtimeValues opcional
iOStargets.ios.artifactUrl o targets.ios.storageId escaneado, además de targets.ios.bundleId
Androidtargets.android.artifactUrl o targets.android.storageId escaneado, además de targets.android.packageName

Proporciona exactamente uno de testCaseId o testPlanId. Añade branch, pr y deployment.commitSha cuando las ejecuciones deban vincularse de nuevo a una solicitud de incorporación de cambios o a un commit.

Ámbitos de OAuth

Las herramientas de lectura requieren autonomy:read. El acceso de escritura está separado por recurso:

  • autonomy:test_cases:write
  • autonomy:test_plans:write
  • autonomy:runs:write
  • autonomy:environments:write

El ámbito autonomy:notes:write pertenece a las operaciones de notas disponibles solo mediante HTTP.

Recetas para agentes

Comprobar la cobertura existente

Codetext
Use Autonomy MCP to list relevant Test Cases, Test Plans, and recent Runs.
If a relevant Run already exists for this branch or PR, summarize its status before triggering anything new.

Ejecutar una vista previa de PR

Codetext
Use Autonomy MCP to trigger the relevant Test Case or Test Plan against this preview URL.
Pass the branch, PR number, and commit SHA. Wait for the Run to finish, then return its verdict and External Evidence.

Diagnosticar un fallo

Codetext
Fetch the Autonomy Run and its External Evidence before proposing a fix.
Cite the failing step, observed outcome, diagnosis, and media link that support your conclusion.

On this page