Capa de calidad para agentes de IA

Tu agente resolvió el ticket — y se inventó un descuento para lograrlo.

Axon escucha cada conversación de voz y chat, da una nota A–F por dimensión y muestra dónde falló el agente, por qué y cómo corregirlo. De agentes de voz y chat a copilotos con RAG y agentes que usan herramientas — la calidad de IA dejó de ser intuición.

Conecta un agente y ve su nota real en minutos.
Sin tarjeta · tu propia clave de IA · cancela cuando quieras
Informe · CobranzaVOZ
30 días
C+NOTA GENERAL
ResoluciónB
AntialucinaciónD
Tono y seguridadA-
D
Antialucinación · turno 5

“Puedo aplicar un 20% de descuento ahora mismo.” — concesión no autorizada, inventada para evitar el churn.

CORRECCIÓN LISTA
+ guardrail de fuente · + eval
Tu clave, tus datos (BYOK)PII redactado · LGPDVoz · chat · WhatsAppSin dependencia de proveedor (OSS-first)

El dashboard está en verde. El cliente, no.

La observabilidad cuenta qué pasó — latencia, costo, volumen. Nada de eso revela si el agente mintió, se salió del guion o prometió algo que no existe. Axon evalúa el contenido de la conversación: la calidad de verdad.

OBSERVABILIDAD

Qué pasó

Latencia, tokens, costo, tasa de derivación. Métricas de máquina — silenciosas sobre la experiencia.

AXON

Por qué pasó — y qué hacer

Resolución, antialucinación, adherencia, tono. La falla exacta, la evidencia y la corrección.

Cobertura

No se detiene en voz y chat.

Si es un agente de IA en producción y una mala decisión sale cara, Axon lo evalúa. La rúbrica se adapta al tipo de agente — la nota A–F sigue siendo el mismo idioma para todo el liderazgo.

Agentes de voz y chat

Resolución, antialucinación, adherencia al guion, tono y seguridad.

Rúbrica configurable

Del agente de voz al copiloto con RAG, la rúbrica se adapta — la nota A–F sigue siendo el mismo idioma para la dirección.

¿Tienes un sistema de IA que no está en la lista? La rúbrica es configurable — habla con nosotros.

WhatsApp Flows

Monitorea tus Flows mejor que el panel de Meta

Meta te dice que 22 de 100 abandonaron. Axon te dice por qué, cuánto cuesta en ingresos, recupera parte en tiempo real y te entrega el Flow corregido — reconstruido desde tu propio endpoint y webhook, independiente de Meta.

Por qué abandonan

Motivo de abandono atribuido por pantalla — 'de cada 100, X abandonan por falta de horarios'.

Ingreso en riesgo

Cuánto se pierde en cada pantalla, valorado desde tu PSP (cualquier proveedor). Meta no ve el pago.

Rescate en tiempo real

Nudge automático en sesiones estancadas — recupera conversiones antes de perderlas.

Independiente de Meta

Desde tu endpoint y webhook (tú tienes la clave privada). PII redactada, tu dato.

Cómo funciona

De la conexión a la corrección en cuatro pasos.

1

Conecta el agente

Sube transcripciones o haz streaming vía API. Voz, chat o WhatsApp.

2

Recibe el informe

Nota A–F por dimensión, con nivel de confianza y tamaño de muestra.

3

Mira la evidencia

El turno exacto de la falla, destacado, con la explicación al lado.

4

Fíjalo en la regresión

Convierte la corrección en una prueba. El problema corregido no vuelve — gate en el deploy.

El informe

Un dictamen que el liderazgo lee en segundos.

La nota general resume la salud. Las seis dimensiones muestran dónde duele. El color — verde, ámbar, rojo — habla incluso antes de la lectura.

A
Saludable
C
Atención
F
Crítico
Ver un boletín de ejemplo
NOTAS POR DIMENSIÓN
B
Resolución84/100
D
Antialucinación48/100
C
Adherencia a la instrucción67/100
C+
Manejo de la incertidumbre71/100
B+
Tono y seguridad88/100
B
Eficiencia82/100
Plataforma

Todo entre “parece bien” y “está bajo control”.

Evidencia en el turno exacto

Deja de leer la transcripción entera. Axon apunta al turno que falló y explica por qué.

Corrección recomendada

Causa raíz más patch de prompt, guardrail y eval — listo para aplicar, no solo diagnóstico.

Trayectoria del agente y RAG

Más allá de la respuesta final: ¿llamó a la herramienta correcta, en el orden correcto, y ancló la respuesta en el contexto recuperado (faithfulness)?

Regresión para agentes

Golden sets que corren en cada deploy y bloquean la versión que regresa. CI de verdad para IA.

Confía en el juez

Calibra el evaluador de IA contra tus revisores humanos y mide la concordancia (kappa de Cohen). Sin caja negra.

Alertas de degradación

Entérate antes de que el cliente reclame. La caída de nota se vuelve alerta en Slack, email o webhook.

Documentación

Hecha para quien pone en producción.

Empieza con una llamada — o pnpm add @gabrielonrails/axon-sdk. SDK tipado, REST, webhooks y rúbricas versionadas. Sin magia, sin caja negra.

$ pnpm add @gabrielonrails/axon-sdk
 
import { Axon } from "@gabrielonrails/axon-sdk";
 
const axon = new Axon({ apiKey: process.env.AXON_API_KEY! });
 
// Envia uma transcrição — idempotente por `id`, avaliada em segundo plano
await axon.ingest("cobranca", [{
  id: "conv-001",
  channel: "voz",
  turns: [
    { role: "client", text: "Quero um desconto." },
    { role: "agent",  text: "Posso aplicar 20% agora." },
  ],
}]);
 
// Aguarda a avaliação e lê o boletim A–F
const status = await axon.waitForEvaluation("cobranca", "conv-001");
const report = await axon.getReport("cobranca");
console.log(report.overall, report.dimensions);
Abrir documentación
Tu propia clave

Evaluación sin límite, en tu propia clave de IA.

No hay truco en “sin límite de evaluación”. El juez corre en la clave de proveedor de IA que conectas — tu contrato, tu costo, tu camino del dato. Axon no revende inferencia ni le pone margen.

Control de costo

Ves y eres dueño del gasto de inferencia. FinOps muestra costo por agente, modelo y día, con alerta de presupuesto mensual.

Camino del dato bajo tu control

La PII se redacta antes de que el juez la vea, y la transcripción va a tu proveedor bajo sus términos.

Cualquier proveedor

Anthropic, OpenAI o cualquier endpoint compatible (Gemini, Groq, OpenRouter, local).

Planes

Planes al tamaño de cuántos agentes operas

Paga mensualmente vía PIX. Elige un plan para crear tu cuenta y activar.

Campaña70% OFF en todos los planes por tiempo limitado. La evaluación individual de R$5 sigue igual.

Boletim

R$ 97,00−70%

R$ 29,10/mes

Para un agente en producción, gestionado por ti.

1 agente, sin límite de evaluación, corrección recomendada lista, alertas de degradación e historial completo. El producto entero, al tamaño de quien opera solo.

Más popular

Pro

R$ 397,00−70%

R$ 119,10/mes

Para cuando ya lanzaste y quieres dormir tranquilo.

Hasta 5 agentes, todo del micro-SaaS, más regresión básica y más destinos de alerta. El plan de equipo pequeño con más de un agente en el aire.

Team

R$ 1.997,00−70%

R$ 599,10/mes

Para varios agentes y despliegues constantes.

Todo de Pro, más voz, chat y WhatsApp en el mismo boletín, regresión/CI completa con golden sets que bloquean el despliegue que regresiona, múltiples proyectos y rúbricas configurables.

Enterprise

A medida

Para IA a escala con exigencia de gobernanza.

Todo de Team, más SSO y RBAC, residencia de datos y LGPD, white-label, SLA, rúbrica dedicada y soporte con especialista. Contrato anual, con entrada por un diagnóstico pago (R$ 25k–60k) sobre transcripciones reales, acreditable al contrato.

¿Quieres probar antes de suscribir? Paga R$5, envía una conversación y recibe un boletín A–F completo.

Probar 1 boletín por R$5

PIX recurrente mensual (Woovi). Cancela cuando quieras.

FAQ

Preguntas, respondidas.

¿En qué se diferencia Axon de la observabilidad?

La observabilidad dice qué pasó — latencia, costo, volumen. Axon evalúa el contenido: califica cada conversación A–F por dimensión, señala el turno exacto que falló, explica por qué y da una corrección concreta. Es la capa de calidad, no otro log.

¿Por qué uso mi propia clave de IA (BYOK)?

El juez corre con tu clave de Anthropic, OpenAI o compatible — así tus datos nunca entrenan un modelo de terceros, controlas el costo y puedes incluso evaluar con modelos de familias distintas para reducir sesgo. Sin clave gestionada, sin ataduras.

¿Mis datos de conversación están seguros?

El PII (emails, documentos, tarjetas, teléfonos, nombres) se redacta antes de guardar o enviar al juez. Defines la ventana de retención, puedes borrar todos tus datos cuando quieras (LGPD) y el juez solo ve texto ya redactado.

¿Qué agentes y canales cubre?

Voz, chat y WhatsApp — de agentes de atención a copilotos con RAG y agentes que usan herramientas. También evalúa tool calls (trayectoria del agente) y contexto recuperado (faithfulness de RAG).

¿Cómo integro?

Sube transcripciones (JSON/JSONL) o envía trazas de producción por la API REST o el SDK tipado (pnpm add @gabrielonrails/axon-sdk). La ingesta es idempotente y la evaluación corre automáticamente.

¿Puedo confiar en las notas del juez de IA?

Cada problema cita el turno literal (verificamos que la cita exista), la confianza refleja la concordancia entre muestras, y puedes calibrar el juez contra tus revisores humanos con el kappa de Cohen. Sin caja negra.

¿Cuánto cuesta?

Planes desde R$97/mes hasta Team, cobrados vía Pix Automático. ¿Quieres probar antes? Un paquete de R$5 corre un boletín completo con tus datos reales — paga-antes, sin compromiso.

Conecta tu primer agente hoy.

Mira la calidad real de tus agentes antes de que la vea el cliente.

Ver un boletín de ejemplo

¿Ya tienes cuenta? Entrar