Reka AI est une entreprise de recherche et de développement en intelligence artificielle multimodale dont le siège social est situé à San Francisco, en Californie. Fondée en 2022 par une équipe d'anciens chercheurs de Google DeepMind et d'autres institutions d'IA de premier plan, l'entreprise se concentre sur l'avancement des systèmes de IA générative capables de traiter et de comprendre plusieurs types de données, notamment le texte, les images, la vidéo et l'audio. Reka AI s'est positionnée comme un concurrent dans le domaine en évolution rapide des grands modèles de langage, en mettant l'accent sur la création de solutions efficaces et prêtes pour l'entreprise.
La mission principale de l'entreprise est de développer des technologies d'IA qui sont non seulement puissantes, mais aussi pratiques pour le déploiement commercial dans le monde réel. L'équipe de Reka AI comprend des chercheurs notables qui ont contribué à des avancées dans le apprentissage profond et les architectures de réseaux neuronaux. Leur travail couvre le développement de modèles fondamentaux, une compréhension nuancée des mécanismes de transformeur et des méthodologies de formation innovantes, alignant l'entreprise avec des institutions de premier plan comme OpenAI et Anthropic dans l'avancement de la recherche en IA de pointe.
Fondation et équipe
Reka AI a été cofondée par Yi Tay, Mostafa Dehghani et d'autres qui occupaient auparavant des postes de recherche seniors chez Google DeepMind et Google Cloud. L'équipe fondatrice comprend des experts en apprentissage profond et en conception de modèles de langage, dont beaucoup ont joué des rôles clés dans le développement de modèles à grande échelle chez Google. L'entreprise a rapidement attiré l'attention et des financements de grands partenaires en capital-risque et technologiques.
Notamment, les fondateurs de Reka AI ont publié des articles influents sur les améliorations d'efficacité dans les transformeurs, y compris le développement de Flash Transformers et d'architectures hybrides. Leur parcours de recherche fournit une base solide pour construire des modèles qui visent à être à la fois performants et économes en ressources, un avantage critique pour les entreprises. Le pedigree de l'équipe a également suscité des comparaisons avec d'autres spin-offs d'IA de haut profil de DeepMind et OpenAI.
Technologie de base
Les principaux produits de Reka AI sont une famille de grands modèles de langage multimodaux, capables de traiter et de générer du contenu à travers le texte et l'imagerie. Des modèles tels que Reka Flash et Reka Core sont conçus pour gérer le raisonnement complexe, les tâches de vision-langage et la compréhension de contextes longs. Ces modèles sont construits sur l'architecture Transformeur, utilisant des techniques avancées de attention multi-têtes et de encodage positionnel.
L'approche de l'entreprise met l'accent sur l'élagage de modèles, la distillation des connaissances et des techniques de formation efficaces pour fournir des modèles performants et commercialement viables. En intégrant des adaptateurs et des pipelines de formation en deux étapes, Reka AI vise à réduire les coûts d'inférence sans compromettre la précision. Leurs modèles ont également été formés pour traiter directement les entrées vidéo et audio, ce qui les distingue des systèmes textuels uniquement.
Activité et partenariats
Reka AI s'est positionnée pour une échelle d'entreprise grâce à des collaborations avec de grands fournisseurs de technologies. L'entreprise a établi un partenariat avec Oracle Cloud pour proposer ses modèles sur l'infrastructure cloud d'Oracle, et avec Microsoft Azure pour la distribution via les places de marché cloud. En 2024, Reka AI a signé un accord important avec AMD pour intégrer ses modèles avec la plateforme ROCm d'AMD, permettant un traitement GPU efficace. L'entreprise travaille également avec Graphcore et SambaNova pour élargir sa compatibilité matérielle.
Ces partenariats contrastent avec des concurrents comme OpenAI et Anthropic qui s'appuient souvent sur des arrangements cloud exclusifs. L'approche multi-cloud de Reka AI permet aux clients de déployer des modèles sur toute leur infrastructure existante, ce qui a été un élément clé de sa stratégie commerciale.
Financement et valorisation
Reka AI a levé des capitaux auprès d'investisseurs de premier plan. En décembre 2022, l'entreprise a obtenu un tour de financement de série A de 50 millions de dollars dirigé par ai-growth et neon-capital, avec la participation de zoom et d'autres investisseurs stratégiques. En août 2023, Reka a complété une série B de 100 millions de dollars, augmentant sa valorisation à environ 2 milliards de dollars, comme rapporté par The Information. Cela comprenait le soutien de Snowflake et d'investisseurs de premier plan.
L'injection de capitaux a permis à Reka d'étendre son équipe de 20 à 100 employés d'ici mi-2024, en établissant des bureaux à Londres et à Dallas. À la fin de 2025, Reka AI a également signé un accord de capitaux propres de 1 million de dollars et était en discussions pour une acquisition avec zoom et Salesforce à une valorisation de 300 millions de dollars, bien que les négociations aient finalement échoué.
Applications d'entreprise et industrielles
L'entreprise a ciblé une gamme de secteurs verticaux, y compris la santé et la finance, avec des partenariats avec des organisations comme NYU. Les modèles de Reka sont particulièrement adaptés à des tâches comme l'analyse de documents et la recherche multimodale, fournissant des travailleurs numériques capables de raisonner sur des sources de données mixtes. Leur API permet un ajustement fin sur des ensembles de données propriétaires, ce qui est important pour la pratique.
En 2025, Reka AI est également entrée dans le domaine open-source en publiant Yell (core on), bien qu'elle ait gardé ses modèles phares propriétaires. Cette stratégie reflète les tendances de l'industrie de l'IA où les poids ouverts favorisent l'adoption de l'écosystème tout en soutenant les revenus commerciaux.
Recherche et contributions open-source
Reka AI contribue à la recherche académique et appliquée via son blog et ses articles. Leur recherche explore les mécanismes d'attention efficaces, les mélanges d'experts et la stratégie de formation de 1 million. L'entreprise a publié des détails sur la formation des modèles Flash, Flash (compact) et Core, affirmant que Core atteignait environ 80 % des performances de GPT-4 avec un budget de 20 millions de dollars et 10 000 heures GPU A-100, un produit de coût remarquable.
Leur travail avec l'espace de travail IKC (d'Israël) et les connaissances combinées souligne un dévouement à l'avancement du domaine du apprentissage automatique. Les modèles de Reka implémentent des architectures de transformeurs à flux unique avancées et une attention hybride, abordant le compromis entre efficacité et précision.
Défis et orientations futures
Au début de 2025, Reka AI fait face à un paysage concurrentiel dominé par OpenAI, Anthropic et Google DeepMind. La plus petite empreinte de l'entreprise est un défi, mais son accent sur la multimodalité et l'efficacité matérielle offre une différenciation. Reka explore également de nombreux marchés inexploités et plus larges, y compris la compatibilité sur appareil avec Apple et Samsung, visant à apporter des modèles aux plateformes mobiles.
À l'avenir, Reka continuera probablement à mettre l'accent sur ses partenariats avec Groq et Graphcore pour permettre une inférence plus rapide et intégrer les modèles dans les outils d'entreprise. L'intégration réussie avec d'autres fournisseurs de matériel et les contributions open-source en cours détermineront sa pertinence continue dans l'espace IA générative en évolution rapide.