作者trfmk1 (TRF小兵)
看板PC_Shopping
标题[心得] ComfyUI RX 9070XT便携包分享
时间Sun Jun 21 21:11:25 2026
ComfyUI for AMD RX 9070XT便携包更新
ComfyUI_Win_portable_RX9070 TRFv0.3-Lite
https://drive.google.com/file/d/1PasVAW889I1uzwtDBcWIP3IoeC-aIogi/view?usp=sharing
更新的轨迹
https://forum.gamer.com.tw/C.php?page=1&bsn=60030&snA=679332&gothis=2554285#2554285
ComfyUI更新到 0.25.0
第一次使用请先点击Update ROCm.bat
安装ROCm 与 PyTorch
https://i.imgur.com/Mcndnz5.png
选择 1. 多架构 ROCm 与 PyTorch (gfx1201)
即可安装最新版本ROCm/TheRock
安装完可以选择
4. 清除 UV 套件快取
接着点击Start.bat会开始载入ComfyUI
跑完後将
http://127.0.0.1:8188 贴到浏览器启动ComfyUI
1.此版本改用 SageAttention 2.2.0
https://github.com/thu-ml/SageAttention/pull/368
这是AMD的工程师jammm
针对RDNA4架构的特殊版本
QK 使用 int8 WMMA,对 PV 使用 fp8 WMMA
使用C++ 配合 AMD 的 HIP 框架来编写底层 Kernel
最近的更新还支援了head_dim 256
https://i.imgur.com/CNynjM0.png
WAN2.2 480X832 81帧 57.45秒
https://i.imgur.com/ACDjIAi.png
WAN2.2 720X1088 81帧 153.03秒
https://i.imgur.com/TOzyPck.png
WAN2.2 720X1280 81帧 199.5秒
https://i.imgur.com/UeTNIMz.png
Z-image-turbo 1024*1204 6步 4.15秒
2.Flash_attn-2.8.4 RDNA4 CK(Composable Kernel 後端)支持
有些情况跑图如果想要更高的精度
或者SageAttention出问题的情况
可以考虑换用Flash Attention
基本上SageAttention 2.2.0
RDNA4特化的版本速度是全面提升
PyTorch Version: 2.12.0+rocm7.14.0a20260620
ROCm Version (from PyTorch): 7.14.60850
https://i.imgur.com/04OiC7Z.png
https://i.imgur.com/YwJYmDQ.png
安装好ROCm
点击Start.bat启动
https://i.imgur.com/dDXDxuL.png
步骤1~3建议选择1即可
步骤 4: 选择 VRAM 模式
https://i.imgur.com/z8NfqnK.png
系统记忆体比较小者
可以选择2. 开启动态 VRAM (--enable-dynamic-vram)
ComfyUI 0.25.0 多了很多自定义参数
动态显存管理
旧的
-reserve-vram [GB]:手动预留一部分显存(单位 GB)给操作系统或其它软件,防
止 ComfyUI 把VRAM全部吃光导致系统卡死。
新的
-vram-headroom [GB]:为动态显存(DynamicVRAM)设置额外的安全缓冲空间。
ComfyUI 会尽量保持这部分VRAM完全空闲。
节点的缓存管理参数
-cache-ram:【默认模式】基於系统RAM压力进行缓存。可传入 1 或 2 个值(如
--cache-ram 4 2),分别代表活动缓存和非活动缓存的RAM保留阈值。
-cache-classic:使用旧版的激进缓存机制(只要RAM够就拼命缓存)。
-cache-none:完全不缓存任何中间结果。每次点生成,所有节点全部重新执行。极度
省VRAM/RAM,但连续生成速度会变慢。
-high-ram:高性能内存模式,如果系统内存极大或者比起频繁加载模型更愿意吃虚拟
RAM,开启此项可微幅提升性能(内部会激活经典缓存)。
-fast-disk:当VRAM不够时,优先把模型缓存到高速SSD(如 NVME SSD)上,而不是
系统RAM。
上面参数有其相关性
--high-ram与--fast-disk两个互相冲突
一个是积极使用系统RAM
一个是优先使用硬碟当缓存
用--high-ram会强制连动使用--cache-classic模式
--cache-ram与--high-ram也冲突
因为会强制用--cache-classic
我做了一些调整让这功能在A卡上稳定一些
许多变数与参数都写在Start.bat里面
https://i.imgur.com/W9YFMMf.png
预设我是使用--high-ram --vram-headroom 2
系统记忆体较小者可以尝试
-fast-disk --vram-headroom 2
甚至
-fast-disk --cache-none --vram-headroom 2
步骤 5: 选择智慧记忆体模式
单纯跑图 选择1. 预设模式会比较快
如果要跑Wan2.2或LTX-2.3
选择2. 关闭智慧记忆体 (--disable-smart-memory)会比较稳定
里面内建了一些工作流
也可以从ComfyUI内建的工作流开始学起
目前ComfyUI压根不想对GGUF量化做优化支持
动态显存也不支持GGUF量化
建议模型都用FP8
我这里提供一些基础模型
https://drive.google.com/drive/folders/1A9YgUdtGQiTltQTz-kJxdR6A323ihS6Y
civitai也都抓的到
https://civitai.red/?sync-account=green
ComfyUI目前建议不要随便更新
他们常常想干嘛就干嘛
常常破坏性更新
除非你有自行除错的能力
就算你用N卡也有可能一更新就发现怎麽性能下降
甚至工作流直接报错
非RDNA4架构的使用者
可以尝试使用这个版本
https://www.bilibili.com/video/BV1LijF6iE8J/?spm_id_from=333.1387.list.card_archive.click
这个UP主我在QQ群有跟他交流分享
他本身是7900XT的用户
基本上理念是不卖课免费分享
我将优化过的SageAttention1 Triton分享给他
跟怎麽调整参数也一并说明
让7900XTX基本上提速30~40%
算是造福不少老卡用户
https://www.bilibili.com/video/BV1PjEW6sEfD/?share_source=copy_web&vd_source=eb2
他比较倾向照顾所有A卡使用者
RDNA1~4全部支持跑ComfyUI
甚至照顾一群小白把屎把尿的
更新就没有我的便携包激进
我只单独针对RDNA4调整比较没包袱
我实在没什麽耐心面对那麽多小白
不过也能去看他影片学习工作流怎麽使用
他都是跟A卡做试配的
最後一些图片分享
https://i.imgur.com/mTsLAzH.jpeg
https://i.imgur.com/NLTJknJ.jpeg
https://i.imgur.com/7Rt8I8H.jpeg
https://i.imgur.com/lzC3lOo.jpeg
https://i.imgur.com/CsdkAOx.jpeg
https://i.imgur.com/HpAeniO.jpeg
https://i.imgur.com/HateKwx.jpeg
ANIMA基本上只要你想
怎麽玩都可以
https://i.imgur.com/jHPklY8.jpeg
多角色PLAY也不是问题
ROCm这半年加强旧卡支援
https://i.imgur.com/WHWnnao.png
也算是战未来?
即将ROCm迎来8.0
AMD下半年如何
等7/22 Advancing Al 2026吧
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 125.229.59.186 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/PC_Shopping/M.1782047488.A.7C9.html
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/21/2026 21:12:36
1F:推 pxhome: 治天七看来是没机会了 49.216.42.109 06/21 21:13
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/21/2026 21:15:45
2F:→ freeunixer: 它对 inter arc Bx0 的支援好吗? 60.250.90.238 06/21 21:17
3F:推 WeasoN: 未看先推 220.133.186.61 06/21 21:31
4F:推 sporocyst: 感谢你对魔法研究的贡献 180.176.191.21 06/21 21:31
5F:推 dw7931425: 可是ComfyUI的工作流复杂到我不知该如 114.33.133.253 06/21 21:34
6F:→ dw7931425: 何下手... 114.33.133.253 06/21 21:34
7F:→ spfy: 要从简单的开始 可以直接问AI 有模型有编解 39.14.40.74 06/21 21:34
8F:→ spfy: 码和prompt就好了 我随便玩玩就从三四个node 39.14.40.74 06/21 21:35
9F:→ spfy: 慢慢试的 觉得不太满足了再加节点 39.14.40.74 06/21 21:36
10F:推 fu1vu03: 洛西加太大了吧(x 125.229.5.91 06/21 21:39
11F:推 nrsair: AI125.224.110.207 06/21 21:41
12F:→ a27588679: 看到便携包我以为是方便带着显卡走的包 106.1.227.146 06/21 21:42
13F:→ a27588679: 包 106.1.227.146 06/21 21:42
14F:→ crimsonmoon9: 先叫GPT帮你生一个最基础三四个节点 223.138.56.192 06/21 21:53
15F:→ crimsonmoon9: 能出图的接法 之後想要更进一步就会 223.138.56.192 06/21 21:53
16F:→ crimsonmoon9: 尝试去自己找资料了XD 223.138.56.192 06/21 21:53
17F:推 MiluPeko: 如果我想做类似推特上特定画师的画风 39.15.9.152 06/21 22:04
18F:→ MiluPeko: 是有办法特别去找模型吗?还是要自己训 39.15.9.152 06/21 22:04
19F:→ MiluPeko: 练呢? 39.15.9.152 06/21 22:04
嘛...我临时弄了个工作流
https://forum.gamer.com.tw/Co.php?bsn=60030&sn=2555454
增加Anima绘师、角色、服装选择工具
应该能满足大多人需求
20F:→ gbcg9725: 可以去civitai找模型或lora 还有问ai 119.14.217.132 06/21 22:08
21F:→ gbcg9725: controlnet怎麽用 不得已再训练 119.14.217.132 06/21 22:08
22F:→ oread168: 6~7已经巨大提升喷到该有的性能 8是不太 1.170.248.101 06/21 22:12
23F:→ oread168: 期待了== 1.170.248.101 06/21 22:12
其实RDNA4理论还能提速20%
24F:推 MiluPeko: 收到 乾虾 39.15.9.152 06/21 22:12
25F:推 v86861062: 推推 220.134.60.79 06/21 22:27
26F:→ tazi: RDNA2也能用的话,我6800xt不就可以拿来玩XD 114.26.186.198 06/21 22:31
27F:推 proton63: ,推111.242.119.125 06/21 22:52
28F:推 sdbb: 谢谢 112.104.153.3 06/21 22:55
29F:→ spfy: 其实也可以下载这包 拿里面的模型就好了 39.14.40.74 06/21 23:06
30F:→ spfy: 原po有蒐集一些很常见的模型 光是用档名就能 39.14.40.74 06/21 23:07
31F:→ spfy: 找到一堆资料的那种 我懒直接Nova Anime XL 39.14.40.74 06/21 23:07
32F:推 mizumutsuki: 推推! 1.169.228.212 06/21 23:09
33F:推 Justapig: 推推好厉害 42.75.20.128 06/21 23:16
34F:推 grtfor: 分享推 114.33.43.179 06/21 23:25
35F:推 pcfox: 好东西 推 苏妈的好朋友 36.231.86.65 06/21 23:35
36F:推 htps0763: 接触一年ROCM,卷积演算法搜寻终於能跳122.121.195.201 06/21 23:37
37F:→ htps0763: 过最慢了,不懂这麽简单的实作放了这麽122.121.195.201 06/21 23:37
38F:→ htps0763: 多年122.121.195.201 06/21 23:37
因为之前ROCm只注重CDNA架构
更别说在Win上面跑
今年才回头支援消费级显卡
为了多架构CI整个仓库炸了三个月
一堆PR卡住进不来
到6月才把炸掉的坑补起来
39F:推 hangtenboy: 推推,目前用得很开心 101.10.79.248 06/21 23:44
40F:→ ganei: 未下先推,佛心分享118.165.157.193 06/21 23:49
41F:推 CrackedVoice: 先推再说! 110.28.105.73 06/21 23:54
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/22/2026 00:38:54
42F:推 Rafale: 推111.240.145.138 06/22 00:56
43F:推 skyshadow83: 推122.121.151.112 06/22 01:15
44F:推 ss70012: 推问个anima 1024*1024 30步要多久? 36.231.93.79 06/22 01:17
我自己弄的工作量流15秒左右
挂加速LORA 10秒左右
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/22/2026 01:55:02
45F:推 silveryiris: 先推再看 111.83.39.71 06/22 03:23
46F:推 ganei: 忘记先前推文太近,补推一下118.165.131.169 06/22 04:16
47F:推 Laviathan: 不分享到ai_art群组吗?之前为了让ma 49.216.16.132 06/22 06:25
48F:→ Laviathan: x+395生成动画,搞sageattention弄的 49.216.16.132 06/22 06:25
49F:→ Laviathan: 我头很大 49.216.16.132 06/22 06:25
只能说RDNA4是个质变
支援FP8 AI算力又大幅提升
现状除非要玩LLM语言模型
需要很大的VRAM
生图的扩散模型反而需要的是算力
50F:推 aacj2642: 你们都很伟大 101.9.99.127 06/22 08:24
51F:推 tn601374: 推 36.224.246.190 06/22 08:29
52F:推 lolicat: 来了 昨天才刚看完小屋 结果我一换新版本 49.215.241.195 06/22 08:52
53F:→ lolicat: 就跳了一个没遇过的错误 还没研究清楚 先 49.215.241.195 06/22 08:52
54F:→ lolicat: 推 49.215.241.195 06/22 08:52
55F:→ lolicat: 我只会简单的文生图 图转影片这种 太复杂 49.215.241.195 06/22 08:53
56F:→ lolicat: 的工作流也是一阵一阵玩一下 49.215.241.195 06/22 08:54
57F:推 dice456: 真有心 推个 124.218.134.80 06/22 09:39
58F:推 ss70012: 感谢,amd还是很棒啊 36.231.93.79 06/22 09:40
59F:推 vsbrm: A卡推广大使~223.138.126.199 06/22 09:59
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/22/2026 10:00:37
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/22/2026 10:13:41
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/22/2026 10:15:41
60F:推 Tosca: 推推~~~~~ 203.75.79.40 06/22 10:40
61F:推 taobnug: 有人试过2个不同的portable版comfyui有223.141.143.217 06/22 11:06
62F:→ taobnug: 什麽互相隔离的好方法吗?223.141.143.217 06/22 11:06
63F:推 Sousake: AMD YES114.137.111.161 06/22 11:12
64F:推 blueballer: 推 感谢大神 223.137.69.238 06/22 11:22
65F:推 bunjie: 补帧王出品 先推 111.82.214.58 06/22 11:42
66F:→ bunjie: 现在应该是生图王了 111.82.214.58 06/22 11:42
67F:推 NorAku: 露露卡真香(? 111.248.88.189 06/22 12:44
68F:→ spfy: 两个不同的ortable放不同资料夹就隔离了吧? 202.173.43.207 06/22 13:05
69F:→ tokikaze: comfyui这种东西摆不同资料夹就隔离了 114.27.101.35 06/22 13:13
70F:→ tokikaze: 。被工作流快取搞到可以去改设定或干脆 114.27.101.35 06/22 13:13
71F:→ tokikaze: 不同任务用不同浏览器开 114.27.101.35 06/22 13:13
72F:→ tokikaze: 干脆(x 乾脆(o 114.27.101.35 06/22 13:14
73F:推 APC: 现在 DIY 市场有的玩就感恩蛤 39.15.40.58 06/22 14:28
74F:推 a83a83cjcj: 推推 101.8.137.201 06/22 16:58
75F:推 taobnug: 用不同的浏览器来做隔离了,感谢。 118.232.3.255 06/22 19:19
76F:推 ssds: 感谢大大分享 1.162.30.197 06/22 19:48
77F:推 ch410773: 我用这个只会生涩图跟影片 14.183.214.193 06/22 22:13
78F:→ losmith: 想请问9070XT能跑LTX2.3吗? 1.163.215.108 06/23 12:44
79F:→ losmith: 之前我9070XT那台想试 但都跑不起来 QQ 1.163.215.108 06/23 12:46
80F:推 losmith: 大大真的是AMD AI推广大神 绘师工具太神 1.163.215.108 06/23 12:48
LTX2.3能跑啊
A卡还很适合跑
只是现状我觉得没有研究的价值
※ 编辑: trfmk1 (125.229.59.186 台湾), 06/23/2026 14:31:28
81F:→ losmith: 居然!那应该是我工作流没挑好 各种跳错QQ 1.163.215.108 06/23 18:55
82F:→ losmith: 晚上下班回家更新大大这版後再试试~ XD 1.163.215.108 06/23 18:56
83F:→ losmith: 想试LTX2.3是因为他在我N卡机器上跑超快 1.163.215.108 06/23 18:57
84F:→ pentw: 不知道能否在linux上跑 210.68.242.236 06/23 22:30
85F:→ pentw: 载下来参考安装的套件可以跑了 210.68.242.236 06/24 07:59
86F:→ losmith: 9070XT跑LTX2.3跑Q5KM.GGUF生成5秒影片 1.163.210.100 07/01 17:25
87F:→ losmith: 第一次需时41分...第二次1小时40分钟... 1.163.210.100 07/01 17:26
88F:→ losmith: 第三次需时高达2小时45分钟 XD 1.163.210.100 07/01 17:26
89F:→ losmith: 难怪大大说没有研究的价值 真的太没效益 1.163.210.100 07/01 17:27