Laya est un modèle de décision d'intelligence artificielle à poids ouverts, publié en septembre 2026 par Convai Innovations, une start-up basée à Kasaragod, au Kerala, en Inde, fondée par Nandakishor M. Distribué sous licence Apache 2.0 avec des poids disponibles sur Hugging Face, Laya est présenté comme l'équivalent ouvert et auto-hébergeable de Jev, le modèle de décision fermé « System One » de TypeSafe AI, publié le même mois.
Fonctionnement
Laya est non-autorégressif : au lieu de générer du texte token par token comme un grand modèle de langage, il classifie. À partir d'un état donné (un e-mail, un ticket de support, une trace d'agent, un objet JSON) et d'une liste de questions typées avec des ensembles de réponses fixes, il renvoie les réponses choisies avec des probabilités calibrées en une seule passe avant. Comme il ne produit aucun texte libre, il n'y a rien à halluciner ni aucun texte ou JSON à analyser ; le code en aval se branche directement sur le résultat typé et sa confiance.
Le principal checkpoint en anglais repose sur un backbone ModernBERT-large d'environ 421 millions de paramètres, suffisamment petit pour fonctionner sur du matériel local modeste. Une variante multilingue couvre plus de 100 langues.
Performances annoncées
Convai rapporte une latence médiane (p50) d'environ 32,8 millisecondes sur un seul GPU Tesla T4, qu'elle compare aux 236 à 276 ms mesurés pour l'API hébergée de Jev, soit un avantage de vitesse d'environ 7,8 fois selon le benchmark du fournisseur, à coût marginal nul en auto-hébergement. Comme pour les chiffres de lancement de Jev, ces données proviennent des évaluations du fournisseur lui-même et ont fait l'objet d'une vérification indépendante limitée dans les semaines suivant la publication.
Une réserve importante, reconnue par le projet lui-même : hors de la boîte, le modèle de base obtient des scores proches du hasard sur les tâches de décision - les chiffres d'exactitude annoncés sont atteints après un fine-tuning sur la tâche cible. Laya est mieux compris comme une architecture ouverte et efficace de modèle de décision que vous adaptez à votre charge de travail, plutôt que comme une solution clé en main zero-shot.
Laya et Jev
Laya et Jev définissent une catégorie émergente parfois appelée modèles System One, d'après le « Système 1 » rapide et intuitif de Daniel Kahneman dans Thinking, Fast and Slow : des modèles conçus pour la classification, la notation, le routage et les décisions d'étape suivante à haut volume et faible latence, qui complètent les grands modèles de langage génératifs sans les remplacer. Les deux diffèrent principalement par leur distribution : Jev est une API hébergée fermée, tandis que les poids Apache-2.0 de Laya peuvent être exécutés localement (des runtimes communautaires existent pour Node.js/TypeScript via ONNX Runtime), affinés librement et déployés sans coût par appel.