Skip to main content
使用 Qwen-Image 2.1 从文字描述生成图片,或编辑已有图片。

准备模型

从 Hugging Face 上的 Qwen/Qwen-Image-2.1 下载模型权重。 你需要 Python 3.12 或更高版本、uv,以及支持 CUDA 的 NVIDIA GPU。在 PhyAI 仓库根目录运行以下命令,将 checkpoint 路径替换为保存模型的文件夹:

生成图片

下面的示例使用两张 GPU,生成一张 512 × 512 的 PNG 图片。先用 nvidia-smi 查看可用 GPU,再按需调整 CUDA_VISIBLE_DEVICES。
打开 .cache/qwen_image_21.png 查看结果。脚本会自动创建输出文件夹。

编辑图片

通过 --image 指定输入图片,在 --prompt 中描述想要的修改:
重复添加 --image 可以提供多张参考图片,最多 10 张。

常用参数

使用单张 GPU 时,设置 CUDA_VISIBLE_DEVICES=0 和 --tp 1。使用八张 GPU 时,设置 CUDA_VISIBLE_DEVICES=0,1,2,3,4,5,6,7 和 --tp 8。 查看全部参数: