OOTDiffusion 虚拟试穿部署完整教程从环境搭建到出图【免费下载链接】OOTDiffusion[AAAI 2025] Official implementation of OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on项目地址: https://gitcode.com/GitHub_Trending/oo/OOTDiffusionOOTDiffusion 是基于潜在扩散模型的服装试穿项目能把一件衣服的图合成到一张模特图上支持半身上衣和全身上装、下装、连衣裙两种场景适合电商做商品展示或批量出图的开发者。功能速览输入一张模特图 一张衣服图输出一张穿上这件衣服的模特图。提供半身模型hd和全身模型dc两套权重由 run/run_ootd.py 一键推理。自带命令行脚本和 Gradio 网页界面无需写代码即可调参出图。前置依赖人体解析和姿态估计OpenPose仓库已内置推理模块。仓库在 Ubuntu 22.04 / Linux 上验证建议同环境部署。前置检查硬件需要一块带 CUDA 的 NVIDIA 显卡显存建议 8GB 起步--sample越大越吃显存。软件LinuxUbuntu 22.04 最稳已装 condaPython 需固定为 3.10。磁盘模型权重与依赖约需数 GB建议预留 10GB 以上。网络能访问 pip 源和模型权重下载源。部署三步走第一步取代码git clone https://gitcode.com/GitHub_Trending/oo/OOTDiffusion cd OOTDiffusion怎么确认成功进入目录后能看到run/、ootd/、preprocess/、checkpoints/四个目录其中 checkpoints/ 下只有一篇 README.txt说明还没放权重。第二步备环境conda create -n ootd python3.10 conda activate ootd pip install torch2.0.1 torchvision0.15.2 torchaudio2.0.2 pip install -r requirements.txt怎么确认成功激活环境后运行下面命令打印2.0.1 True第二项为 True 表示检测到 GPUpython -c import torch; print(torch.__version__, torch.cuda.is_available())依赖清单见 requirements.txt核心是diffusers、transformers、onnxruntime、gradio。第三步拿权重推理代码会到 checkpoints/ 下读取四组文件全部下齐并放进对应子目录权重目录位置作用ootdcheckpoints/ootd/试穿主模型含ootd_hd/checkpoint-36000、ootd_dc/checkpoint-36000和 VAEhumanparsingcheckpoints/humanparsing/人体解析parsing_atr.onnx、parsing_lip.onnxopenposecheckpoints/openpose/ckpts/姿态估计body_pose_model.pthclip-vit-large-patch14checkpoints/clip-vit-large-patch14/文本/图像特征编码这些路径由 ootd/inference_ootd_hd.py、preprocess/humanparsing/run_parsing.py、preprocess/openpose/annotator/util.py 指定请严格按目录摆放。怎么确认成功ls checkpoints能看到ootd、humanparsing、openpose、clip-vit-large-patch14四组且各自的.onnx/.pth/ 权重文件都在位。首次运行先跑最小命令半身模型上衣cd run python run_ootd.py --model_path examples/model/model_1.png --cloth_path examples/garment/03244_00.jpg --scale 2.0 --sample 4怎么判断结果正常当前run/目录下会生成images_output/里面有mask.jpg和out_hd_0.png到out_hd_3.png。打开out_hd_*.png模特身上的衣服已换成指定上衣即为成功。全身模型连衣裙示例cd run python run_ootd.py --model_path examples/model/model_8.png --cloth_path examples/garment/048554_1.jpg --model_type dc --category 2 --scale 2.0 --sample 4若想要网页界面启动 Gradio见 run/gradio_ootd.pycd run python gradio_ootd.py浏览器访问http://localhost:7865可分别用半身、全身两块上传示例图调参。参数速查以下参数由 run/run_ootd.py 解析参数作用推荐值--model_type模型类型hd半身 /dc全身hd默认--category服装类别 0 上衣 / 1 下装 / 2 连衣裙须与model_type匹配0hd仅支持 0--scale引导强度越大越贴合衣服纹理2.0范围 1.0–5.0--step扩散步数越大越细腻越慢20范围 20–40--sample一次生成几张1范围 1–4--seed随机种子固定可复现结果-1随机常见问题自查现象运行报CUDA out of memory。原因显存不足--sample或--step偏大。解法把--sample降到 1--step降到 20。现象半身模式加--category 1或2时直接报错退出。原因hd模型只支持上衣代码对类别做了强校验。解法半身用--category 0要下装或连衣裙就换--model_type dc。现象启动报找不到parsing_atr.onnx、body_pose_model.pth或checkpoint-36000。原因checkpoints/ 下权重没下全或目录层级不对。解法按第三步拿权重的表格补全四组文件注意openpose还要进ckpts/子目录。现象能出图但衣服颜色/图案没换上去像是只换了个轮廓。原因引导强度偏低生成偏向原图。解法把--scale提到 2.5–3.0 再试。收尾到这里你已完成 OOTDiffusion 的代码拉取、环境搭建、权重放置与首次出图并掌握了命令行与 Gradio 两种用法。后续可阅读 ootd/pipelines_ootd/pipeline_ootd.py 了解推理管线或对照 run/utils_ootd.py 理解 mask 生成逻辑。【免费下载链接】OOTDiffusion[AAAI 2025] Official implementation of OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on项目地址: https://gitcode.com/GitHub_Trending/oo/OOTDiffusion创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
企业数字化 ERP 产品动态
相关推荐
OpenLayers 6.15.1 补丁深度解读:确保数据源加载完成后图层正确渲染 OpenLayers 6.15.1 补丁深度解读:确保数据源加载完成后图层正确渲染 【免费下载链接】openlayers OpenLayers 项目地址: https://gitcode.com/gh_mirrors/op/openlayers
导读
OpenLayers 6.15.1 是紧随 6.15.0 之后发布的一个补丁版本(patch rel… · 2026/9/24 16:26:19
Boto3 从 Python 2 迁移到 Python 3:官方升级指南与源码级解读 后端云原生 【免费下载链接】boto3 AWS SDK for Python (Boto3) 项目地址: https://gitcode.com/gh_mirrors/bo/boto3 点击查看 免费下载 本指南以 AWS SDK for Python(Boto3)官方迁移文档(docs/source/guide/migrationpy3.rst&a… · 2026/9/24 16:26:12
Presto SHOW STATS 命令完全指南:表与查询的列统计信息查看 大数据数据库后端 【免费下载链接】presto The official home of the Presto distributed SQL query engine for big data 项目地址: https://gitcode.com/gh_mirrors/pre/presto 点击查看 免费下载 本文是 Presto 分布式 SQL 查询引擎中 SHOW STATS 命令的权威技术… · 2026/9/24 16:26:12
【Coze】【视频】三分钟读一本书 今天给大家演示一个 《三分钟读一本书》Coze 工作流。该工作流通过大模型驱动的分镜文案生成、图像合成、语音合成以及视频草稿自动创建等一整套流程,将一本书的内容浓缩为一个三分钟的视频,实现从文本到成片的全自动化制作。用户只需输入书名、作者和个人账号信息,即可得到… · 2026/9/24 17:02:12
第24篇-MCP-Client架构-Host应用如何管理多个Server连接 【MCP 全栈教程】第 24 篇:MCP Client 架构——Host 应用如何管理多个 Server 连接 本系列定位:从协议原理到 Server 开发、Client 开发、再到各大平台实战集成,系统化掌握 MCP(Model Context Protocol)全栈技术体系。… · 2026/9/24 17:01:59
第21篇-MCP-Server测试-MCP-Inspector与自动化测试 【MCP 全栈教程】第 21 篇:MCP Server 测试——MCP Inspector 与自动化测试 本系列定位:从协议原理到 Server 开发、Client 开发、再到各大平台实战集成,系统化掌握 MCP(Model Context Protocol)全栈技术体系。 本篇你… · 2026/9/24 17:01:59
OneNote 笔记如何备份才不丢数据:3 种方案完整保姆级攻略 OneNote 笔记如何备份才不丢数据:3 种方案完整保姆级攻略 【免费下载链接】cs-408 计算机考研专业课程408相关的复习经验,资源和OneNote笔记 项目地址: https://gitcode.com/GitHub_Trending/cs/cs-408
用 OneNote 攒了几个月笔记,某次… · 2026/9/24 17:01:59
使用 AWS SDK for C++ 编写 Hello SNS:通过 ListTopics 入门 Amazon SNS 示例工程教程后端 【免费下载链接】aws-doc-sdk-examples Welcome to the AWS Code Examples Repository. This repo contains code examples used in the AWS documentation, AWS SDK Developer Guides, and more. For more information, see the Readme.md file below. 项目地… · 2026/9/24 17:01:53
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程 简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13
1D-CNN时间序列建模实战:从Conv1d原理到工业落地 简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26
柔软的L:汉语语流中被忽视的舌肌张力控制 1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44