Traduit de l'anglais

Krisp est une entreprise technologique qui développe des solutions d'annulation de bruit et de clarté vocale basées sur l'IA pour la communication en temps réel, fondée en 2017 et dont le siège social est situé à San Francisco.

Krisp est une entreprise logicielle spécialisée dans la suppression de bruit et l'amélioration vocale basées sur l'intelligence artificielle pour les plateformes de communication. Fondée en 2017, l'entreprise fournit une application de bureau et un SDK qui éliminent en temps réel les bruits de fond, les échos et la réverbération des flux audio entrants et sortants, améliorant ainsi la qualité des appels sur divers outils de visioconférence. Sa technologie principale s'appuie sur des modèles d'apprentissage profond pour séparer la parole humaine des sons ambiants sans nécessiter de matériel spécialisé.

Les solutions de Krisp sont utilisées par des particuliers, des équipes distantes et des entreprises pour améliorer la productivité lors de réunions virtuelles, de webinaires et d'interactions de support client. L'entreprise a intégré sa technologie dans de nombreuses plateformes de communication et propose des offres grand public et professionnelles, avec un accent sur le traitement à faible latence et la préservation de la vie privée.

Technologie

La suppression de bruit de Krisp repose sur des architectures de apprentissage profond et de réseaux de neurones, notamment des modèles de réseau résiduel et de U-Net qui traitent des spectrogrammes audio. Le système analyse les trames audio entrantes, identifie les composantes non vocales telles que les clics de clavier, les aboiements de chien ou le trafic, et les supprime tout en préservant la voix de l'orateur. Cela est réalisé grâce à une approche séquence à séquence qui mappe l'audio bruité à une parole propre, entraînée sur de grands ensembles de données d'enregistrements appariés bruités et propres.

L'entreprise utilise des techniques de augmentation de données pour simuler divers environnements acoustiques, améliorant ainsi la robustesse des modèles. Krisp utilise également la normalisation par lots et le abandon pour stabiliser l'entraînement et prévenir le surapprentissage. Le traitement s'exécute localement sur l'appareil de l'utilisateur, garantissant une faible latence (généralement inférieure à 10 millisecondes) et aucune donnée audio ne quitte l'appareil, répondant ainsi aux préoccupations de confidentialité.

Les modèles de Krisp sont optimisés pour l'inférence en temps réel, en tirant parti de la élagage de modèles et de calculs efficaces pour fonctionner sur des processeurs standard sans nécessiter d'accélérateurs dédiés. L'entreprise met continuellement à jour ses algorithmes pour traiter de nouveaux types de bruit et améliorer la clarté vocale, y compris des fonctionnalités comme l'annulation d'écho et l'amélioration vocale pour les intervenants ayant une qualité audio inférieure.

Historique

Krisp a été fondée en 2017 par Davit Baghdasaryan et Artavazd Minasyan, qui avaient précédemment travaillé sur la reconnaissance vocale et le traitement audio. L'entreprise a initialement lancé une application mobile pour l'enregistrement et la transcription d'appels, mais s'est réorientée vers la suppression de bruit après avoir reconnu la demande croissante pour les outils de communication à distance. En 2019, Krisp a publié sa première application de bureau pour Windows et macOS, gagnant rapidement en adoption parmi les travailleurs à distance.

En 2020, Krisp a levé un tour de table de 5 millions de dollars mené par le fonds de démarrage d'OpenAI, suivi d'une série A de 35 millions de dollars en 2021. Ce financement a soutenu l'expansion de son équipe d'ingénierie et le développement de fonctionnalités pour entreprises. D'ici 2022, Krisp avait intégré son SDK dans des plateformes majeures comme Zoom, Microsoft Teams et Google Meet, et rapportait plus de 100 millions de minutes sans bruit traitées mensuellement.

Produits et intégration

Krisp propose une application de bureau autonome pour Windows, macOS et Linux qui fonctionne avec toute application de communication, y compris la visioconférence, la VoIP et les jeux en ligne. L'application offre une suppression de bruit en temps réel pour l'entrée microphone et la sortie haut-parleur, avec des niveaux d'intensité réglables. Elle inclut également des fonctionnalités d'amélioration vocale qui améliorent la clarté pour les intervenants à voix basse.

Pour les développeurs, Krisp fournit un kit de développement logiciel (SDK) pouvant être intégré dans des applications tierces. Le SDK prend en charge plusieurs langages de programmation et plateformes, permettant l'intégration dans des services cloud basés sur Amazon Web Services et Azure. Krisp a établi des partenariats avec des fabricants de matériel pour préinstaller sa technologie sur des ordinateurs portables et des casques, et propose une offre professionnelle avec gestion centralisée et analyses.

Marché et impact

La montée du travail à distance et des réunions virtuelles a accru la demande de solutions de qualité audio. Krisp concurrence d'autres fournisseurs de suppression de bruit basés sur l'IA, mais se différencie par son traitement sur appareil et sa large compatibilité. La technologie de l'entreprise a été adoptée par des centres de service client, des établissements d'enseignement et des prestataires de soins de santé pour améliorer la clarté de la communication.

L'impact de Krisp s'étend à l'accessibilité, car son amélioration vocale aide les personnes souffrant de troubles de la parole à être mieux comprises. L'entreprise met également l'accent sur la confidentialité, car tout le traitement se déroule localement, contrairement aux alternatives basées sur le cloud. En 2024, Krisp continue d'étendre sa gamme de produits, y compris des fonctionnalités de transcription en temps réel et de résumés de réunions, en tirant parti des technologies de IA générative et de grands modèles de langage.

Voir aussi

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:artificial-intelligence·audio-processing·software·remote-work
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique