Speechify 是一款由 Cliff Weitzman 开发的文本转语音应用程序,最初旨在帮助应对与阅读障碍相关的阅读困难。该应用提供移动应用、桌面应用和 Chrome 扩展程序等多种形式。它使用计算机生成的语音,从各种来源(包括数字文档和网页)朗读文本。此外,Speechify 还采用光学字符识别技术,将实体书籍或印刷文本转换为音频,使用户可以拍摄文本并让其朗读出来。该应用还提供诸如带网络搜索功能的语音 AI 助手、AI 播客创作和语音输入听写等功能。
Speechify 由 Cliff Weitzman 开发,他是布朗大学的一名患有阅读障碍的大学生,最初构建该工具的第一个版本是为了帮助自己跟上课堂阅读进度。研究表明,使用 Speechify 的阅读障碍学生在阅读理解方面的表现优于仅使用传统方法的学生。
技术与功能
Speechify 利用人工智能和机器学习生成自然流畅的语音。底层技术包括神经网络,用于处理文本并生成音频输出。该应用支持多种平台,包括苹果 iOS 和三星 Android 设备,以及 Windows 和 macOS 等桌面操作系统。Chrome 扩展程序与网络浏览器集成,可朗读文章和电子邮件。
关键功能之一是使用光学字符识别(OCR),支持基于摄像头的印刷文本扫描。这使用户可以拍摄书籍、文档或标签的图像,并收听其朗读内容。该应用还提供多种语音选择,包括名人语音,并允许用户调整阅读速度和音调。
开发与历史
Speechify 由 Cliff Weitzman 创立,他本人患有阅读障碍,希望有一个工具能帮助他应对学业负担。他在布朗大学学习期间开发了初始版本。该应用迅速在学生和有阅读困难的专业人士中广受欢迎,也受到偏好听觉学习的人群青睐。随着时间推移,Speechify 扩展了其功能集,加入了 AI 驱动的工具,例如可执行网络搜索的语音 AI 助手,以及从文本创建 AI 生成播客的功能。
影响与研究
关于 Speechify 有效性的研究显示,对阅读障碍用户有积极效果。研究表明,使用该应用的阅读障碍学生在阅读理解方面的表现优于仅依赖传统阅读方法的学生。这归因于边听边读的多模态特性,能够强化学习。该应用还被用于教育环境中,以支持多样化的学习者。
可用性与集成
Speechify 作为免费应用提供,并带有高级功能,包括额外语音和高级 OCR 能力。它与云存储服务集成,使用户可以访问来自谷歌云和亚马逊网络服务等服务的文档。Chrome 扩展程序因可朗读网页内容而广受欢迎,移动应用支持下载音频以供离线使用。
参见
- 15.ai
- ElevenLabs
- Respeecher
参考资料
本文内容参考了维基百科及其他公开来源的信息。
结论
Speechify 持续发展,整合先进 AI 技术以改善阅读困难人群的无障碍体验,并为更广泛的用户群体提供便捷的文本转语音解决方案。