视频模型、图片模型和对话模型都会产生成本,因此更建议把付费流程拆成剧情诊断、分镜验证、短视频样片和正式视频。
视频会调用高成本视频模型,并且还需要图片、文本和队列处理配合,成本明显高于纯文本生成。
先用剧情和分镜确认方向,再用短秒数样片验证效果,最后再生成正式视频。