自动音乐生成研究的演示网站列表
一个使用OpenAI的Whisper Large v2进行语音识别的脚本,能够在短短10分钟内转录300分钟的音频。
一种分层自适应零样本语音风格转换模型
能够在几分钟内生成专业的人物头像
1,100 多种语言推出语音转文本、文本转语音等功能,语音转文本的错误率只有 Whisper 的一半
金融领域的大语言模型
一款专业的人物肖像提示词生成工具