一个开源工具包,可实现语音、声音和歌唱功能
Amphion是一个开源工具包,可实现语音、声音和歌唱功能。除了文字转语音功能,它还能将一首歌的声音换成另一个歌手的声音,并支持声音转换、歌声合成、文本到音频、文本到音乐等功能。
一个可以自己托管的 Whisper 解决方案,服务端是 Python,客户端是 JS,基于 WebSocket 实时通信,可以做到语音的实时传输和文本转换。
这个网站里面的内容,使用生成对抗网络(GAN),他们是如此真实,却都是由电脑虚构出来的。
专门用于生成 SQL 语句的模型
WPS AI是由金山办公发布的具备大语言模型能力的人工智能应用,为用户提供智能文档写作、阅读理解和问答、智能人机交互的能力。作为WPS办公套件的重要组成部分,WPS AI将与WPS其他产品无缝衔接,让用户在办公、写作、文档处理等方面实现更高效、更智能的体验。
借助大语言模型(LLM)处理音频的工具
使用文本描述创建动态电影艺术图像