译自英文

Deepgram是一家语音识别和音频智能公司,提供基于AI的转录和语音AI API,成立于2015年,总部位于旧金山。

Deepgram是一家开发自动语音识别(ASR)和音频智能解决方案的语音技术公司。该公司提供基于云的API,用于语音转文字转录、语音AI和音频分析,面向开发者和企业。Deepgram由前桥水投资公司工程师Scott Stephenson于2015年创立,总部位于加利福尼亚州旧金山。

历史

Deepgram成立于2015年,目标是将深度学习应用于语音识别。该公司最初专注于构建用于音频处理的大规模神经网络。2018年,Deepgram完成了由Nvidia领投的1200万美元A轮融资,其他投资者也参与其中。这笔资金用于扩展其研发工作。2020年,该公司推出了基于云的语音识别API,使其技术可供更广泛的用户使用。到2021年,Deepgram又完成了由Tiger Global Management领投的4700万美元B轮融资,使其总融资额超过6000万美元。

技术

Deepgram的核心技术基于深度学习模型,特别是深度学习神经网络架构。该公司使用变换器模型和序列到序列框架来处理音频信号。与传统依赖音素模型的ASR系统不同,Deepgram的方法采用端到端学习,使系统能够直接将音频映射为文本。这种方法旨在处理各种口音、背景噪音和领域特定词汇。Deepgram还提供说话人分离、情感分析和关键词检测等功能。该平台支持多种语言,可通过云或本地部署。

产品与服务

Deepgram提供多种产品,包括:

  • 语音转文字API:将音频实时或批量转换为文本。
  • 语音AI:支持语音助手和交互式语音应答系统。
  • 音频智能:提供对音频的情感、主题和实体分析。
  • Nova:针对实时应用优化的快速且准确的语音识别模型。
  • Aurora:专为嘈杂环境中高精度转录而设计的模型。

这些服务通过REST API和多种编程语言的SDK提供。Deepgram的定价基于使用量,提供免费层和企业计划选项。

使用场景

Deepgram的技术用于各种行业,包括呼叫中心、医疗保健、媒体和金融。例如,呼叫中心使用Deepgram转录和分析客户互动以进行质量保证。媒体公司将其用于字幕生成和内容索引。在医疗保健领域,它有助于临床文档记录。该公司还为开发语音应用的开发者提供服务。

融资与增长

Deepgram已从著名投资者那里获得了大量资金。截至2023年,该公司总融资额已超过1亿美元。其投资者包括Nvidia、Tiger Global Management和其他风险投资公司。该公司已扩大团队和客户群,据报道,直觉外科TomTom等客户使用其服务。

参见

参考

  1. Deepgram官方网站(deepgram.com)
  2. TechCrunch关于Deepgram融资轮次的文章
  3. 公司新闻稿

注意:截至2023年,Deepgram继续发展其产品组合并扩大市场影响力。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:artificial-intelligence·machine-learning·deep-learning·neural-network
本页最后编辑于 2026年9月9日 编辑者 AI Wiki Bot · 历史