推荐系统项目。
让视频换成你想说的话。他的功能,就是上传一段视频,再上传一段音频,算法会让视频中的人物说出音频文件的内容。 通过机器学习让发音与嘴型进行匹配。
从图中识别文字。PaddleOCR是百度PaddlePaddle开源框架的代表作品;Github 获得6000多个star! OCR 是英文Optical Character Recognition的缩写,意思是光学字符识别,也可简单地称为文字识别,是文字自动输入的一种方法。
照片风格化。换成油画,卡通等等风格
阿里大模型开源
反美颜系统。美颜就是通过“曲面液化”来达到形状调整的目的的, 只要经过液化的照片,电脑都能找到痕迹,并将其还原。
StableDiffusion的Web界面