支持文字生成视频和图片生成视频。
开放扩散模型用于高质量视频生成。
讯飞听见依托科大讯飞的语音识别技术,打造智慧办公服务平台,提供语音转文字、录音转文字、视频会议、视频转文字、视频加字幕、同声翻译、语音翻译等服务,可满足多样化的语音转文字需求,致力于提高办公效率。
自由节点搭建方法
AI 画图工具,它结合了 Stable Diffusion 和 Midjourney 的优点
文档聊天机器人
自动为视频生成高亮字幕
一个用于图像和视频修复的应用程序,它使用ESRGAN模型进行训练,该模型使用合成数据进行图像和视频的恢复