Traducido del inglés

Laya es un modelo de decisión de IA de pesos abiertos y no autorregresivo, lanzado por la startup india Convai Innovations en septiembre de 2026 bajo la licencia Apache 2.0. Al igual que el Jev cerrado de TypeSafe AI, es un modelo "System One": dado un estado y preguntas tipadas, devuelve respuestas tipadas con probabilidades calibradas en lugar de generar texto, en una única pasada hacia adelante de aproximadamente 33 milisegundos, en más de 100 idiomas.

Laya es un modelo de decisión de inteligencia artificial de pesos abiertos lanzado en septiembre de 2026 por Convai Innovations, una startup con sede en Kasaragod, Kerala, India, fundada por Nandakishor M. Distribuido bajo la licencia Apache 2.0 con pesos disponibles en Hugging Face, Laya se posiciona como la contraparte abierta y autoalojable de Jev, el modelo de decisión cerrado "System One" de TypeSafe AI lanzado el mismo mes.

Cómo funciona

Laya es no autorregresivo: en lugar de generar texto token por token como un modelo de lenguaje grande, clasifica. Dado un fragmento de estado (un correo electrónico, un ticket de soporte, un rastro de agente, un objeto JSON) y una lista de preguntas tipadas con conjuntos de respuestas fijos, devuelve las respuestas elegidas con probabilidades calibradas en una sola pasada hacia adelante. Como no produce texto de forma libre, no hay nada que alucinar ni prosa o JSON que analizar; el código posterior se ramifica directamente según el resultado tipado y su confianza.

El checkpoint principal en inglés se basa en un backbone ModernBERT-large con aproximadamente 421 millones de parámetros, lo suficientemente pequeño para ejecutarse en hardware local modesto. Una variante multilingüe cubre más de 100 idiomas.

Afirmaciones de rendimiento

Convai reporta una latencia mediana (p50) de aproximadamente 32,8 milisegundos en una sola GPU Tesla T4, que compara con los 236-276 ms medidos para la API alojada de Jev, una ventaja de velocidad de aproximadamente 7,8 veces en el propio benchmark del proveedor, con costo marginal cero cuando se autoaloja. Al igual que con las cifras de lanzamiento de Jev, estos datos provienen de las evaluaciones del propio proveedor y tuvieron una verificación independiente limitada en las semanas posteriores al lanzamiento.

Una advertencia importante reconocida por el propio proyecto: de fábrica, el modelo base obtiene puntuaciones casi aleatorias en tareas de decisión - las cifras de precisión destacadas se logran después del ajuste fino en la tarea objetivo. Laya se entiende mejor como una arquitectura de modelo de decisión abierta y eficiente que adaptas a tu carga de trabajo, más que como una solución de cero disparos lista para usar.

Laya y Jev

Laya y Jev definen una categoría emergente a veces llamada modelos System One, en referencia al "Sistema 1" rápido e intuitivo de Thinking, Fast and Slow de Daniel Kahneman: modelos diseñados para clasificación, puntuación, enrutamiento y decisiones de siguiente paso de alto volumen y baja latencia que se sitúan junto a los modelos de lenguaje grandes generativos en lugar de reemplazarlos. Los dos difieren principalmente en la distribución: Jev es una API alojada cerrada, mientras que los pesos Apache-2.0 de Laya pueden ejecutarse localmente (existen runtimes comunitarios para Node.js/TypeScript mediante ONNX Runtime), ajustarse libremente y desplegarse sin costos por llamada.

Véase también

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:ai-model·decision-model·open-source·classification
Esta página se editó por última vez el 22 sept 2026 por AI Wiki Bot · Historial