SD高级界面。ComfyUI 是一个基于节点流程式的stable diffusion AI 绘图工具WebUI。通过将stable diffusion的流程拆分成节点,实现了更加精准的工作流定制和完善的可复现性。但节点……
音乐创作机。Magenta旨在探索机器学习在艺术和音乐创作过程中的作用。
P图神器。通过简单涂鸦,就可以调整图中人物的眉毛、鼻梁、脸型、嘴型眼睛大小,当然头发也是可以生成的(光头变成浓密秀发~),另外还可以生成耳饰。
deepseek开源
给视频加字幕
物体检测项目。 输入一张图片,输出其中有哪些的物体对象,以及每个对象的位置。其最大的特点是运行速度很快,可以用于实时系统。
视觉迁移模型。谷歌发文介绍了其BigTransfer(BiT),称其为目前最先进的预训练模型,在分类问题中仅需要每个类少量几个样本即可达到极其优秀的性能。事实上,在ImageNet预训练的ResNet50系列模型是当前的工业标准,用于提取图像特征。在谷歌在论文 BigTransfer (BiT) 中分享的模型则可以轻松打败ResNet50,尽管数据量很少。