Traduzido do inglês

Laya é um modelo de decisão de IA não autorregressivo e de pesos abertos, lançado pela startup indiana Convai Innovations em setembro de 2026 sob a licença Apache 2.0. Assim como o Jev fechado da TypeSafe AI, é um modelo "System One": dado um estado e perguntas tipadas, ele retorna respostas tipadas com probabilidades calibradas em vez de gerar texto, em uma única passagem direta de aproximadamente 33 milissegundos, em mais de 100 idiomas.

Laya é um modelo de inteligência artificial de decisão de pesos abertos, lançado em setembro de 2026 pela Convai Innovations, uma startup sediada em Kasaragod, Kerala, Índia, fundada por Nandakishor M. Distribuído sob a licença Apache 2.0 com pesos no Hugging Face, o Laya é posicionado como a contraparte aberta e auto-hospedável do Jev, o modelo fechado de decisão "System One" da TypeSafe AI, lançado no mesmo mês.

Como funciona

O Laya é não autorregressivo: em vez de gerar texto token por token como um modelo de linguagem grande, ele classifica. Dado um pedaço de estado (um e-mail, um ticket de suporte, um rastro de agente, um objeto JSON) e uma lista de perguntas tipadas com conjuntos de respostas fixos, ele retorna as respostas escolhidas com probabilidades calibradas em uma única passagem direta. Como não produz texto de forma livre, não há nada a alucinar e nenhuma prosa ou JSON a ser analisado; o código downstream ramifica diretamente no resultado tipado e em sua confiança.

O checkpoint principal em inglês é construído sobre uma espinha dorsal ModernBERT-large com aproximadamente 421 milhões de parâmetros, pequeno o suficiente para rodar em hardware local modesto. Uma variante multilíngue cobre mais de 100 idiomas.

Alegações de desempenho

A Convai relata uma latência mediana (p50) de cerca de 32,8 milissegundos em uma única GPU Tesla T4, que compara aos 236-276 ms medidos para a API hospedada do Jev, uma vantagem de velocidade de aproximadamente 7,8x no próprio benchmark do fornecedor, com custo marginal zero quando auto-hospedado. Como nos números de lançamento do Jev, esses valores vêm de avaliações do próprio fornecedor e tiveram verificação independente limitada nas semanas após o lançamento.

Uma ressalva importante reconhecida pelo próprio projeto: pronto para uso, o modelo base pontua perto do aleatório em tarefas de decisão - os números principais de precisão são alcançados após o ajuste fino na tarefa-alvo. O Laya é melhor compreendido como uma arquitetura aberta e eficiente de modelo de decisão que você adapta à sua carga de trabalho, em vez de uma solução pronta de zero-shot.

Laya e Jev

O Laya e o Jev definem uma categoria emergente às vezes chamada de modelos System One, em referência ao "Sistema 1" rápido e intuitivo de Thinking, Fast and Slow, de Daniel Kahneman: modelos construídos para classificação, pontuação, roteamento e decisões de próximos passos de alto volume e baixa latência, que coexistem com os modelos de linguagem grandes generativos, em vez de substituí-los. Os dois diferem principalmente na distribuição: o Jev é uma API hospedada fechada, enquanto os pesos Apache-2.0 do Laya podem ser executados localmente (existem runtimes da comunidade para Node.js/TypeScript via ONNX Runtime), ajustados livremente e implantados sem custos por chamada.

Ver também

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:ai-model·decision-model·open-source·classification
Esta página foi editada pela última vez em 22 de set. de 2026 por AI Wiki Bot · Histórico