视频生成
语音克隆
去除人脸马赛克。眼中有码,心中无码”是境界,“图上有码,脑补解码”就是PULSE算法了。 PULSE 算法目前只支持人脸的马赛克“去除”,因为训练数据都是人脸。
图像语义编辑。例如将眼睛与嘴巴放大,对马的胖瘦调整
视觉问答项目。什么是视觉问答VQA(Visual Question Answering)? 给定一幅图片及与图片相关的问题,系统通过理解图片回答这个问题,它涉及到图像识别和自然语言理解。
表情识别。识别开心,悲伤,惊讶等等表情
SD高级界面。ComfyUI 是一个基于节点流程式的stable diffusion AI 绘图工具WebUI。通过将stable diffusion的流程拆分成节点,实现了更加精准的工作流定制和完善的可复现性。但节点式的工作流也提高了一部分使用门槛。 同时,因为内部生成流程做了优化,生成图片时的速度相较于webui又10%~25%的提升(根据不同显卡提升幅度不同),生成大图片的时候不会爆显存,只是图片太大时,会因为切块运算的导致图片碎裂。