工作流广场
选择感兴趣的工作流,输入参数即可生成
视频制作12
视频
文生视频(MiniMax H3)
输入文案,基于 MiniMax H3 生成视频
视频
多参考图生视频(MiniMax H3)
上传多张参考图,输入文案,基于 MiniMax H3 生成多参考视频
视频
对口型视频
上传人物图 + 音频,自动生成对口型视频
视频
动作迁移(Wan2.1)
上传视频 + 角色图片,将视频中的角色替换为目标角色,生成新视频
视频
数字人口播(LTX2.3)
上传人物照片 + 音色文件,生成数字人口播视频
视频
去字幕(LTX)
上传视频,智能去除视频中的字幕,输出干净画面
视频
音/视频合并
将视频和音频合并,输出带配音的完整视频
视频
真人转绘视频
将真人视频进行风格转绘,输出艺术化处理的视频
视频
首尾帧视频(Wan2.2)
上传首帧和尾帧图片 + 提示词,生成从首帧过渡到尾帧的 WAN2.2 视频
视频
首中尾帧视频(WAN22 REMIX)
上传首帧、中帧、尾帧图片 + 提示词,生成 WAN22 REMIX V2 三段过渡视频
视频
凡人口播(LTX2.3)
上传人物照片,选择内置音色,输入文案生成数字人口播视频
视频
视频高清放大(SeedVR2)
上传视频,通过 SeedVR2 模型智能放大分辨率,输出高清视频
图像生成7
图片
动作迁移(qwen2.5)
上传人物图 + 背景图,将人物动作迁移到背景图中生成新图像
图片
多视角图(qwen2.5)
上传单张人物或物体图片,生成多角度/多视角的图像
图片
扩图(qwen2.5)
上传图片,智能扩展画面边界
图片
换装(FLUX-Klein)
上传人物图片和衣服图片,自动将衣服穿到人物身上
图片
图片分镜(FLUX-Klein)
上传图片,基于 FLUX-Klein 生成图片分镜
图片
洗图(zImage)
上传图片,根据图片优化部分细节,去ai味
图片
高清修复(Flash VSR + SeedVR2)
主要是对老照片,低像素照片进行修复
音频创作7
音频
音色+文案生成音频(CosyVoice3)
上传参考音色音频 + 输入文案,生成克隆声音的音频(基于 CosyVoice3 Cross-Lingual)
音频
音频替换音色
上传原音频和目标音色音频,将原音频的音色替换为目标音色
音频
音频替换音色(内置pth)
上传音频 + 选择内置音色模型,将原音频转换为目标音色
音频
音色克隆(LongCat-AudioDIT-TTS)
上传参考音频 + 输入文案,基于 LongCat-AudioDIT-TTS 生成克隆声音的音频
音频
人声/伴奏分离
上传音频文件,分离出人声和伴奏音轨
音频
视频提取音频
上传视频文件,提取出音频轨(MP3)
音频
音频替换音色(内置模型)
上传音频,选择内置唱歌音色模型(6 种女声 + 2 种男声)进行音色替换
文本生成1
文本
视频反推提示词
上传视频,AI 自动拉片分析并反推可用于 AI 视频生成的详细结构化提示词(镜头/运镜/光影/音频 + 英文 Prompt)