语音

收集全球10,000⁺个好用的AI软件

首页 > 语音

MaskGCT

MaskGCT是一个创新的零样本文本到语音转换（TTS）模型，它通过消除显式对齐信息和音素级持续时间预测的需求，解决了自回归和非自回归系统中存在的问题...
GLM-4-Voice

GLM-4-Voice是由清华大学团队开发的端到端语音模型，能够直接理解和生成中英文语音，进行实时语音对话。它通过先进的语音识别和合成技术，实现了语音...
MaskGCT TTS Demo

MaskGCT TTS Demo 是一个基于MaskGCT模型的文本到语音（TTS）演示，由Hugging Face平台上的amphion提供。该模型...
Moonshine

Moonshine 是一系列为资源受限设备优化的语音转文本模型，非常适合实时、设备上的应用程序，如现场转录和语音命令识别。在 HuggingFace ...
Canonical AI

Canonical AI提供的声音AI分析工具，专注于分析和优化语音助手的通话性能。该工具通过可视化通话流程、识别关键性能指标（KPIs）和自定义度量...
SoundStorm

SoundStorm是由Google Research开发的一种音频生成技术，它通过并行生成音频令牌来大幅减少音频合成的时间。这项技术能够生成高质量、...
AI Studios.com

AI Studios是一个提供全方位AI视频生成解决方案的平台，它结合了自然语言处理、机器学习等先进技术，使用户能够快速创建高质量的视频内容。该平台的...
Universal-2

Universal-2是AssemblyAI推出的最新语音识别模型，它在准确度和精确度上超越了前一代Universal-1，能够更好地捕捉人类语言的复...
Transcribro

Transcribro是一款运行在Android平台上的私有、设备端语音识别键盘和文字服务应用，它使用whisper.cpp来运行OpenAI Whi...
Fish Agent V0.1 3B

Fish Agent V0.1 3B是一个开创性的语音转语音模型，能够以前所未有的精确度捕捉和生成环境音频信息。该模型采用了无语义标记架构，消除了传统...
hertz-dev

hertz-dev是Standard Intelligence开源的全双工、仅音频的变换器基础模型，拥有85亿参数。该模型代表了可扩展的跨模态学习技术...
MiniMates

MiniMates是一款轻量级的图片数字人驱动算法，能够在普通电脑上实时运行，支持语音驱动和表情驱动两种模式。它比市面上的liveportrait、E...
Fish Speech

Fish Speech是一款专注于语音合成的产品，它通过使用先进的深度学习技术，能够将文本转换为自然流畅的语音。该产品支持多种语言，包括中文、英文等，...
OuteTTS-0.1-350M

OuteTTS-0.1-350M是一款基于纯语言模型的文本到语音合成技术，它不需要外部适配器或复杂架构，通过精心设计的提示和音频标记实现高质量的语音合...
OuteTTS

OuteTTS是一个使用纯语言建模方法生成语音的实验性文本到语音模型。它的重要性在于能够通过先进的语言模型技术，将文本转换为自然听起来的语音，这对于语...
Nijta

Nijta提供基于AI的语音匿名化技术，帮助企业在不泄露隐私和保密性的情况下大规模使用语音数据。这项技术的重要性在于，它允许企业在遵守法规的同时，充分...
Voxa

Voxa是一个智能语音助手，旨在通过简单的语音命令简化用户的日常生活和工作流程。它集成了任务管理、日程安排、笔记记录和提醒功能，通过与Google T...
AI Voice Lab

AI Voice Lab免费 AI 文字转语音神器是一个利用最新的类GPT AI语音模型技术，提供超级逼真的配音结果，支持20+种语言和100+种声音...
Google Gemini App

Google Gemini是一款由Google开发的AI助手应用，旨在通过人工智能技术帮助用户提高创造力和生产力。它允许用户通过语音与应用交互，进行头...
PlayDialog

PlayDialog是Play.ai推出的一款端到端AI语音模型，它利用对话的历史背景来控制韵律、语调、情感和节奏，以提供更自然的声音，为匹配人类在现...

«
1
2
...
28
29
30
31
32
33
34
...
42
43
»

AI爱好者的一站式人工智能AI工具箱，累计收录全球10,000⁺好用的AI工具软件和网站，方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用，力争做全球排名前三的AI网址导航网站，欢迎您成为我们的一员。

隐私策略免责条款服务协议关于我们