译自英文

Krisp是一家开发用于实时通信的AI降噪和语音清晰度解决方案的科技公司,成立于2017年,总部位于旧金山。

Krisp是一家专注于人工智能降噪和语音增强的软件公司,其技术应用于各类通信平台。公司成立于2017年,提供桌面应用程序和SDK,能够实时去除输入和输出音频中的背景噪音、回声和混响,提升各种会议工具的通话质量。其核心技术利用深度学习模型将人声与周围环境声音分离,无需专用硬件即可实现。

Krisp的解决方案被个人用户、远程团队和企业广泛采用,用于提升虚拟会议、网络研讨会和客户支持互动中的工作效率。公司已将其技术集成到众多通信平台中,并提供消费级和商业级两种服务层级,重点强调低延迟处理和隐私保护。

技术

Krisp的降噪功能基于深度学习神经网络架构,具体采用残差网络U-Net模型处理音频频谱图。系统分析输入的音频帧,识别非语音成分(如键盘敲击声、狗吠声或交通噪音)并将其抑制,同时保留说话者的声音。这一过程通过序列到序列方法实现,将嘈杂音频映射为清晰语音,模型基于大量成对的嘈杂和干净录音数据集进行训练。

公司采用数据增强技术模拟多样化的声学环境,提升模型的鲁棒性。Krisp还使用批归一化随机失活来稳定训练过程并防止过拟合。处理过程在用户设备本地运行,确保低延迟(通常低于10毫秒),且音频数据不会离开设备,从而解决隐私问题。

Krisp的模型针对实时推理进行了优化,利用模型剪枝和高效计算,可在标准CPU上运行,无需专用加速器。公司持续更新算法以应对新型噪音并提升语音清晰度,包括回声消除和针对低音质说话者的语音增强功能。

历史

Krisp由Davit Baghdasaryan和Artavazd Minasyan于2017年创立,两人此前从事语音识别和音频处理工作。公司最初以移动应用形式推出,提供通话录音和转写功能,但在认识到远程通信工具需求增长后,转型专注于降噪领域。2019年,Krisp发布了首款适用于Windows和macOS的桌面应用,迅速获得远程工作者的广泛采用。

2020年,Krisp获得了由OpenAI创业基金领投的500万美元种子轮融资,随后于2021年完成3500万美元的A轮融资。这些资金支持了工程团队的扩展和企业级功能的开发。到2022年,Krisp已将其SDK集成到zoom、microsoft-teams和google-meet等主要平台中,并报告每月处理超过1亿分钟的无噪音通话时长。

产品与集成

Krisp提供适用于Windows、macOS和Linux的独立桌面应用,可与任何通信应用(包括视频会议、VoIP和在线游戏)配合使用。该应用为麦克风输入和扬声器输出提供实时降噪功能,并支持可调节的强度级别。此外,它还包含语音增强功能,可提升安静说话者的清晰度。

对于开发者,Krisp提供了可嵌入第三方应用的软件开发工具包(SDK)。该SDK支持多种编程语言和平台,能够集成到亚马逊网络服务Azure等云服务中。Krisp还与硬件制造商合作,在笔记本电脑和耳机上预装其技术,并提供具有集中管理和分析功能的商业级服务。

市场与影响

远程工作和虚拟会议的兴起增加了对音频质量解决方案的需求。Krisp与其他基于AI的降噪提供商竞争,但通过设备端处理和广泛兼容性实现差异化。公司的技术已被客户服务中心、教育机构和医疗机构采用,以提升通信清晰度。

Krisp的影响还延伸至无障碍领域,其语音增强功能帮助有言语障碍的人士更好地被理解。公司同样强调隐私保护,因为所有处理均在本地进行,这与基于云的替代方案形成对比。截至2024年,Krisp持续扩展其产品线,包括实时转写和会议摘要功能,利用生成式AI大语言模型技术。

参见

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:artificial-intelligence·audio-processing·software·remote-work
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史