Guía independienteUna guía independiente sobre Jev, el modelo de TypeSafe AI
La guía práctica de Jev

Conoce hasta dónde llegan las pruebas

Limitaciones de Jev y cuestiones pendientes

Comprende los límites de entrada y salida de Jev, las advertencias por versión, la incertidumbre, los informes de la comunidad y las pruebas que aún necesita una integración.

Guía independienteÚltima revisión

Lo esencial

Una respuesta con el formato correcto puede ser errónea. Importan la entrada, las preguntas, las opciones y las reglas posteriores.

Una respuesta acotada puede seguir siendo incorrecta

Jev devuelve decisiones mediante una interfaz definida. Eso ayuda al software a consumir un resultado, pero no demuestra que la categoría seleccionada corresponda a la realidad. Trata una respuesta válida como una valoración que evaluar, no como una prueba de cómo es el mundo.

TypeSafe describe la calibración como una propiedad de grupos de predicciones. Una probabilidad comunicada no garantiza que una decisión concreta sea correcta. Explicación de la calibración

Piensa en una ruta de soporte válida pero equivocada. El análisis de la respuesta funciona y la cola existe, pero el cliente sigue esperando al equipo incorrecto. Mide directamente ese fallo, en lugar de contar las respuestas de solicitudes a la API completadas con éxito como resultados satisfactorios.

Límites de entrada y salida

La interfaz documentada acepta texto, incluido texto estructurado en JSON, en lugar de imágenes, audio o vídeo sin procesar. No escribe respuestas de texto libre, código ni explicaciones de razonamiento. Capacidades de System One

Si tu flujo comienza con un escaneo o una grabación, otro componente debe preparar el texto. Revisa los errores que se introduzcan allí: una negación omitida en una transcripción puede cambiar la decisión final aunque todos los componentes posteriores funcionen según su diseño. Si necesitas una explicación para el usuario, conserva pruebas que puedan examinarse y diseña esa explicación por separado; no inventes un razonamiento a partir de una probabilidad.

Problemas por versión que debes tener en cuenta

La página de limitaciones conocidas de Jev 1.13 de TypeSafe, revisada el 16 de septiembre de 2026, señala debilidades con la redacción literal, la precisión numérica, la comparación de fechas, el razonamiento indirecto, el contexto irrelevante, las entradas hostiles y las instrucciones contradictorias. Indica dos restricciones de contexto: 64k tokens entre el estado y todas las preguntas, y 32k entre el estado y la pregunta más larga. Son afirmaciones del proveedor específicas de esa versión, no mediciones nuestras.

Nuestra respuesta práctica es mantener los cálculos exactos y la ordenación de fechas en el código, identificar explícitamente los registros pertinentes y redactar preguntas cuyos criterios coincidan con sus instrucciones. Una mayor capacidad de entrada no significa que llenarla de material ajeno a la tarea ayude.

No interpretes un Score fraccionario como una medida exacta. Score es una posición ponderada entre los niveles de la rúbrica; distribuciones distintas pueden producir el mismo valor. Lee la distribución junto con la puntuación. Interpretación de Score

Entradas hostiles y límites de las acciones

El texto de un documento, correo electrónico o pasaje recuperado puede intentar influir en el sistema. El recetario de RAG de TypeSafe advierte expresamente de que su filtro de inyección no constituye un límite de seguridad; un pasaje por debajo del umbral aún puede llegar al generador.

Mantén los permisos y las comprobaciones de ejecución fuera del modelo. Por ejemplo, una instrucción en un correo no debe conceder acceso a otra cuenta, y una acción sugerida debe seguir cumpliendo las reglas de autorización de tu aplicación. Decide cómo tratar un tiempo de espera agotado o una respuesta ambigua antes de habilitar acciones. Una cola de revisión humana solo es útil si alguien se responsabiliza de ella y puede examinar las pruebas.

Las observaciones de la comunidad requieren atribuciones cuidadosas

Dos desarrolladores de la comunidad informaron de que los nombres de las etiquetas de Choice o su orden de inserción podían afectar a las probabilidades de salida en jev-1.13.0. La conversación incluyó solicitudes repetidas y un seguimiento con datos de reordenación. Consulta el informe inicial y el informe de seguimiento, publicados el 17 de septiembre de 2026.

Son observaciones comunicadas por sus autores, no pruebas independientes. No hemos repetido los experimentos ni verificado el conjunto de datos externo. No demuestran qué representación es más exacta, una preferencia universal por la primera opción ni que Choice no pueda ordenar resultados útiles. No se observó una explicación o corrección oficial verificada en el hilo capturado. Los enlaces pueden requerir acceso a la comunidad y la investigación no cubrió todas las conversaciones.

Por ello, recomendamos versionar toda la definición de la pregunta: modelo, instrucciones, primitiva, etiquetas, descripciones y orden. Vuelve a comprobar las decisiones cuando cambie esa definición. No supongas que cambiar una tarea de sí o no de Noul a Choice conserva valores de probabilidad idénticos.

Acceso, versiones y supuestos operativos

Un alias móvil puede seleccionar un modelo más reciente sin cambiar la aplicación, y los límites de frecuencia del acceso anticipado pueden variar. La página de modelos es la referencia para las versiones y límites actuales. Registra la versión a la que se resuelve el alias y revisa los umbrales antes de adoptar una actualización.

Esta guía no acredita una garantía de disponibilidad, un acuerdo empresarial de tratamiento de datos, una política de retención para tu cuenta ni la idoneidad para decisiones reguladas. Confirma los requisitos con TypeSafe antes de enviar material sensible. La falta de pruebas aquí significa que algo no está verificado, no que no esté admitido.

Los 12 idiomas de lectura del sitio son una característica editorial. No demuestran qué idiomas admite Jev ni una calidad equivalente entre idiomas. Incluye en tu propia evaluación los idiomas, la terminología del sector y los casos ambiguos que realmente producen tus usuarios.

Un alcance sensato para una prueba inicial

Elige una recomendación acotada y reversible con una vía de revisión visible. Conserva ejemplos donde la respuesta falte, sea poco clara, contradictoria o no encaje en tus categorías. Registra las decisiones incorrectas y los casos sin resolver, y después decide si la mejora justifica mantener el componente adicional.

Para esta edición no se realizaron ejecuciones independientes de la API, mediciones de fiabilidad ni evaluaciones comparativas de calidad. Lee nuestra política de evidencia, examina los casos documentados o vuelve al recorrido de integración.

Fuentes y lecturas adicionales

Esta guía se apoya en documentación oficial e informes de la comunidad enlazados. Las observaciones de la comunidad se atribuyen a sus autores.

  1. Límites de entrada y salida de System One
  2. Limitaciones conocidas oficiales de Jev 1.13
  3. Objetivo de calibración en los fundamentos de IA
  4. Interpretación de Score
  5. Filtrado RAG y advertencia sobre el límite de seguridad
  6. Versiones actuales de los modelos y límites de acceso
  7. Informe de la comunidad sobre la representación en Choice
  8. Seguimiento de la comunidad sobre datos de reordenación
Cómo comprobamos nuestras fuentes