首页/新闻资讯/正文详情

OOTDiffusion:一条命令试穿衣服,一次跑出 4 张候选图

发布时间:2026/9/24 23:19:37 来源:云帆数科 栏目:资讯中心
OOTDiffusion:一条命令试穿衣服,一次跑出 4 张候选图
OOTDiffusion一条命令试穿衣服一次跑出 4 张候选图【免费下载链接】OOTDiffusion[AAAI 2025] Official implementation of OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on项目地址: https://gitcode.com/GitHub_Trending/oo/OOTDiffusion网购下单前你总得在脑子里想象衣服上身后的样子OOTDiffusion 用生成的虚拟试穿图像替代这种想象。它只需一张模特图和一张服装图一次运行就能输出 4 张候选试穿图默认 20 步去噪。这是 AAAI 2025 论文 Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on 的官方开源实现半身与全身两套模型权重均已放出。下面是使用教程从克隆仓库到看到图像只需跑通 4 行命令。一句话定位OOTDiffusion 是基于服装融合Outfitting Fusion的潜空间扩散虚拟试穿模型给定人物照片和服装图片生成该人物穿上该服装的照片。先看效果OOTDiffusion 试衣结果图中同一模特穿上不同服装全部由项目生成服装的颜色、图案、领型跟随服装图人物的姿态与面貌来自模特图。跑起来 OOTDiffusion最小命令集环境要求一行带过Linux官方仅在 Ubuntu 22.04 测试过、NVIDIA GPU、Python 3.10。git clone https://gitcode.com/GitHub_Trending/oo/OOTDiffusion conda create -n ootd python3.10 conda activate ootd pip install torch2.0.1 torchvision0.15.2 torchaudio2.0.2 pip install -r requirements.txt cd OOTDiffusion/run python run_ootd.py --model_path examples/model/01008_00.jpg --cloth_path examples/garment/00055_00.jpg --scale 2.0 --sample 4运行前需先把 ootd、humanparsing、openpose、clip-vit-large-patch14 四组权重放进checkpoints/目录说明见 checkpoints/README.txt。预期输出run_ootd.py 会在run/images_output/写出out_hd_0.png到out_hd_3.png四张 PNG外加一张展示换衣区域的mask.jpg。命令中的两张示例图就在仓库run/examples/里可直接照跑。两个 checkpoint 怎么选hd 与 dc半身模型hd默认不用加参数在 VITON-HD 数据集上训练只支持上衣类服装--category必须为 0脚本会直接报错拦截其他取值。全身模型dc在 Dress Code 数据集上训练支持上衣、下装、连衣裙三类运行时加--model_type dc --category 0/1/20上衣1下装2连衣裙。README 明确要求类别必须与服装实际类型配对否则换衣区域会错。不想记参数的话可以起本地网页界面 gradio_ootd.pypython gradio_ootd.py浏览器打开http://127.0.0.1:7865上下两个区域分别对应 hd 与 dc 模型每侧都提供了仓库自带的示例图可点选也可上传自己的图dc 区域有一个服装类别下拉框是必填项。该脚本会在 GPU 0 与 GPU 1 上各加载一套模型。影响出图的 4 个参数run_ootd.py暴露的四个参数各有明确作用--scale是服装特征引导强度默认 2.0网页界面给出的可调范围是 1.0–5.0--step是去噪步数默认 20界面范围 20–40--sample是每次运行的候选图数量1–4--seed是随机种子-1表示每次不同。要对比同一输入在不同参数下的差异时固定--seed即可保证可比。OOTDiffusion 管线从解析到去噪生成图像前两个预处理器先把人物标出来OpenPose 检测姿态关键点人体解析preprocess/humanparsing/下的 onnx 模型把人物分成上衣、手臂、腿等 18 个类别utils_ootd.py 把两者结合算出待换装的区域掩码并盖在原图上。生成阶段CLIP 视觉编码器CLIP 是一种同时理解图像与语义的预训练编码器提取服装图特征作为引导定制的 OotdPipeline 用两个 UNetunet_garm 处理服装、unet_vton 处理人物在去噪过程中完成服装融合最后由 VAE 把潜码解码回图像。常见坑与调优权重没放对位置模型加载路径硬编码在../checkpoints/...克隆后第一件事就是把 ootd、humanparsing、openpose、clip-vit-large-patch14 放进checkpoints/缺一项首次启动就会失败。服装类别没配对dc模型要求--category与图片类型一致0 上衣 / 1 下装 / 2 连衣裙给连衣裙传 0 会导致换衣区域错误网页界面里这一项也被标注为重要选项。单卡跑不了网页版gradio_ootd.py需要两块卡同时加载 hd 与 dc 模型只有一张卡时用命令行模式分别跑hd或dc即可。调参入口想让颜色、图案更贴服装动--scale1.0–5.0默认 2.0想更充分地还原细节把--step提到 20–40一次要多看几种效果用--sample 4。适合谁与局限适合购买前想看自己照片上特定服装效果的用户Linux NVIDIA GPU 环境官方测试环境为 Ubuntu 22.04想快速接入虚拟试穿功能的开发者推理代码模块化可直接引用 ootd/inference_ootd.py不适合不想碰 WSL 的 Windows 用户期望试穿鞋、帽、配饰的场景仅支持上衣、下装、连衣裙三类商业集成项目采用 CC BY-NC-SA 4.0 许可证不允许商业用途需要用自有数据继续训练的场景README 的 TODO 显示训练代码尚未放出下一步README.md安装步骤与两种推理命令checkpoints/README.txt需要下载的四组权重清单run/示例图片与运行目录全部脚本OOTDiffusion 目前提供的是从人物图 服装图到试穿图的完整推理链路第一步是把四组权重下全用仓库自带示例图跑通一次。【免费下载链接】OOTDiffusion[AAAI 2025] Official implementation of OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on项目地址: https://gitcode.com/GitHub_Trending/oo/OOTDiffusion创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关推荐

Coder部署与Qwen Coder接入:构建私有云开发环境实战
Coder部署与Qwen Coder接入:构建私有云开发环境实战

最近无论是技术群、评论区还是后台私信,"coder"这个词的出现频率高得吓人。我打开一看,问法五花八门:有人问"Coder咋下载",有人在问"Qwen Coder在Mac上怎么部署",还有人直接抛出"A… · 2026/9/24 23:19:37

T/CAAMTB 163–2023:48V车载ECU电压可靠性强制标准解析
T/CAAMTB 163–2023:48V车载ECU电压可靠性强制标准解析

简介:本资源为《T/CAAMTB 163—2023 道路车辆 48V供电电压的电气及电子部件电性能要求和试验方法》团体标准正式版PDF文件,面向汽车电子工程师、整车厂测试人员、零部件供应商研发与认证团队,解决48V轻混系统中电气部件设计验证、型式试验及合… · 2026/9/24 23:19:37

SpringBoot+Vue国产动漫网站全流程实战:从选题到部署交付
SpringBoot+Vue国产动漫网站全流程实战:从选题到部署交付

SpringBootVue国产动漫网站:从选题到部署交付的全流程实战记录做毕设最怕什么?不是写代码,而是不知道代码从哪开始写。前后端分离选什么技术栈、数据库表怎么设计、论文怎么写才不单薄、部署文档怎么保证导师照着就能跑通?这套基于… · 2026/9/24 23:19:31

MCP实战:一行配置接入GitHub工具,让AI直接操作代码仓库
MCP实战:一行配置接入GitHub工具,让AI直接操作代码仓库

MCP 这阵子在开发圈里算是彻底火了。不管是 Claude Desktop、Codex、Trae 这些 AI 客户端,还是各种自研的编辑器插件,都在往 MCP(Model Context Protocol,模型上下文协议)上靠。我自己的体验是,真正把一个 … · 2026/9/24 23:54:26

混沌增强黏菌算法求解分布式置换流水车间调度问题及Matlab实现
混沌增强黏菌算法求解分布式置换流水车间调度问题及Matlab实现

分布式置换流水车间调度问题(DPFSP)这两年被讨论的次数越来越多了,原因其实很现实——越来越多的制造企业开始按多工厂、多车间组织生产,原来那种“一条流水线打天下”的假设不再成立。我前阵子接手一个多厂协同排程的仿真项目&am… · 2026/9/24 23:54:26

用Python落地格雷厄姆特价股票策略:安全边际与财务质量筛选实战
用Python落地格雷厄姆特价股票策略:安全边际与财务质量筛选实战

做投资的人,书架上大概率都放着一本《聪明的投资者》。翻过的人不少,但真正照着格雷厄姆这套特价股票理论去筛选股票的人,少之又少。原因不难理解:他当年提出的那些指标,放到今天要么数据找不到,要么阈值明… · 2026/9/24 23:54:26

x86电脑如何编译ARM程序?交叉编译原理与实战指南
x86电脑如何编译ARM程序?交叉编译原理与实战指南

刚入行那会儿,我也被这个问题绕晕过:手里明明是一台 x86 电脑,软硬件全是 Intel/AMD 那套生态链,凭什么能把代码编成 ARM 可执行文件?ARM 程序不是在 ARM 开发板、ARM 服务器上才能生成吗?后来被前辈点了一… · 2026/9/24 23:54:26

OpenClaw两日两更:适配GPT 5.4,告别抽卡式Prompt
OpenClaw两日两更:适配GPT 5.4,告别抽卡式Prompt

这个月AI圈里让我最意外的一条动态,不是某个新模型发布,而是一个开源Agent项目在两天之内连续放出两个大版本,GitHub星标直接冲到29万量级——说的就是OpenClaw。作为一个常年泡在AI工程和自动化工具里的老玩家,我对这种“刷版本”… · 2026/9/24 23:54:26

LTE A3事件切换参数动态优化:基于UE速度的自适应算法与仿真验证
LTE A3事件切换参数动态优化:基于UE速度的自适应算法与仿真验证

1. 项目背景与问题拆解1.1 A3事件切换机制回顾做过LTE移动性管理相关工作的朋友,对A3事件应该都不陌生。A3事件是LTE系统里用来触发同频切换的核心测量事件,标准定义很简洁:当邻小区的RSRP(参考信号接收功率)满足特定条… · 2026/9/24 23:54:20

基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程

简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13

1D-CNN时间序列建模实战:从Conv1d原理到工业落地
1D-CNN时间序列建模实战:从Conv1d原理到工业落地

简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26

柔软的L:汉语语流中被忽视的舌肌张力控制
柔软的L:汉语语流中被忽视的舌肌张力控制

1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码