Compara primero el contrato de salida
Jev recibe contexto y preguntas tipadas. Sus primitivas documentadas eligen una opción, asignan una puntuación o estiman una proposición mediante un valor Noul. No redacta respuestas, explica su razonamiento en prosa ni ejecuta herramientas. Un LLM generativo es un candidato cuando necesitas correos, resúmenes, explicaciones o código. Algunos también admiten salidas estructuradas restringidas: devolver JSON no basta para preferir Jev.
Define el campo exacto que consume el siguiente paso. Si es una cola existente, compara métodos de clasificación. Si es una respuesta útil al cliente, evalúa generación. Puedes combinar ambos, pero un clasificador separado debe justificar su presencia con mejores resultados, menor coste total o una operación más sencilla.
Introducción y primitivas de TypeSafe · Entender las salidas estructuradas
Usa un ticket para delimitar la tarea
Piensa en este mensaje: Me cobraron dos veces y no puedo acceder a mi cuenta. Una sola etiqueta puede ocultar parte del problema. Decide si debes elegir el primer equipo responsable, identificar varios problemas o redactar una respuesta. Son tres criterios de aceptación diferentes. Para asignar un responsable inicial, documenta si facturación tiene prioridad y contempla revisión cuando falta contexto.
Durante la prueba, conserva el resultado como sugerencia. Una etiqueta no debe activar por sí sola un reembolso, un cambio de cuenta ni un correo. Tu aplicación controla esas acciones y sus permisos. Si también generas una respuesta, evalúa su exactitud por separado: acertar la cola no demuestra que el texto propuesto sea correcto o útil.
Separa la corrección de la confianza
Una etiqueta válida puede ser incorrecta. TypeSafe documenta una confianza derivada de la distribución de respuestas para Choice y Score; no garantiza por separado que esta respuesta concreta sea correcta. Tampoco equivale a pedir a un modelo generativo que declare su propia certeza. Son señales distintas con fallos distintos.
Elige los umbrales con ejemplos etiquetados por tu equipo. Mide los errores entre los resultados aceptados y la proporción enviada a revisión. Desglosa por cola, idioma y longitud. Un buen promedio puede ocultar errores costosos en una categoría pequeña. Incluye mensajes ambiguos y casos fuera de las categorías habituales; haz visibles las respuestas ausentes o mal formadas.
Definición de confianza de TypeSafe · Elegir un umbral de confianza
Compara con una referencia sencilla
Reserva ejemplos que no utilices para ajustar instrucciones. Entrega a cada candidato el mismo contexto necesario, categorías y resultado esperado. Incluye reglas o un clasificador existente como referencia. Si una regla determinista ya resuelve bien el trabajo, otra llamada de red puede no aportar nada. Mantén cálculos exactos, validaciones y permisos en código convencional.
Registra versión del modelo, instrucciones, fecha, fallos y latencia observada por tu aplicación. Cuenta también las solicitudes fallidas. Las limitaciones publicadas de Jev incluyen dificultades con razonamiento numérico preciso y ciertas ambigüedades: incorpóralas a la evaluación. Una demostración, una prueba del proveedor o un solo ticket correcto no valida tu carga de producción.
Limitaciones publicadas de Jev 1.13 · Crear un conjunto de evaluación
Calcula el coste por resultado útil
La tarifa por tokens es solo una parte. Estima solicitudes, reintentos, llamadas de respaldo y tiempo de revisión humana. Compara ese total con las tareas terminadas correctamente. Una primera llamada barata puede resultar más cara si deriva casi todo a otro modelo o exige corregir asignaciones a mano.
Las referencias de precios se comprobaron el 25 de septiembre de 2026 y pueden cambiar. La API directa de TypeSafe, OpenRouter y este espacio tienen servicios y facturación distintos. Una tarifa de tokens del proveedor no es el precio de una suscripción a Jev API Pro ni garantiza los créditos de un plan. Comprueba la ruta que vas a utilizar antes de presupuestar.
Precios actuales de modelos TypeSafe · Planes y créditos del espacio
Elige el flujo más sencillo que supere la prueba
Usa Jev cuando una decisión delimitada cumpla tus requisitos de calidad y mejore una parte medible del flujo. Usa generación cuando debas redactar o sintetizar. Usa código normal cuando exista una regla exacta. Combina opciones solo si cada traspaso tiene un responsable, un contrato validado y una respuesta útil ante fallos.
Empieza con una muestra sin automatizar acciones y compara sugerencias con decisiones reales del equipo. Define qué ocurre cuando el proveedor no responde, la respuesta es inválida o hace falta revisión. Guarda las credenciales en el servidor. Prueba el contrato de clasificación e inspecciona sus resultados antes de asumir que sustituir todas las llamadas mejorará el producto.
Inicio rápido y acceso a Jev API · Revisar decisiones dudosas
