comfyuiman commited on
Commit
b892713
·
verified ·
1 Parent(s): cf508eb

Upload folder using huggingface_hub

Browse files
.huggingfaceignore ADDED
@@ -0,0 +1 @@
 
 
1
+ *.db-wal
.job_config.json CHANGED
@@ -1,7 +1,7 @@
1
  {
2
  "job": "extension",
3
  "config": {
4
- "name": "goldenboy_ltx",
5
  "process": [
6
  {
7
  "type": "diffusion_trainer",
@@ -31,7 +31,7 @@
31
  },
32
  "datasets": [
33
  {
34
- "folder_path": "/app/ai-toolkit/datasets/16_frames",
35
  "mask_path": null,
36
  "mask_min_value": 0.1,
37
  "default_caption": "",
@@ -46,16 +46,17 @@
46
  ],
47
  "controls": [],
48
  "shrink_video_to_frames": true,
49
- "num_frames": 9,
50
  "flip_x": false,
51
  "flip_y": false,
52
  "num_repeats": 1,
53
- "do_i2v": true,
54
  "do_audio": true,
55
- "fps": 24
 
56
  },
57
  {
58
- "folder_path": "/app/ai-toolkit/datasets/24_frames",
59
  "mask_path": null,
60
  "mask_min_value": 0.1,
61
  "default_caption": "",
@@ -70,15 +71,16 @@
70
  ],
71
  "controls": [],
72
  "shrink_video_to_frames": true,
73
- "num_frames": 17,
74
  "flip_x": false,
75
  "flip_y": false,
76
  "num_repeats": 1,
77
- "do_i2v": true,
78
- "do_audio": true
 
79
  },
80
  {
81
- "folder_path": "/app/ai-toolkit/datasets/32_frames",
82
  "mask_path": null,
83
  "mask_min_value": 0.1,
84
  "default_caption": "",
@@ -93,15 +95,16 @@
93
  ],
94
  "controls": [],
95
  "shrink_video_to_frames": true,
96
- "num_frames": 25,
97
  "flip_x": false,
98
  "flip_y": false,
99
  "num_repeats": 1,
100
- "do_i2v": true,
101
- "do_audio": true
 
102
  },
103
  {
104
- "folder_path": "/app/ai-toolkit/datasets/40_frames",
105
  "mask_path": null,
106
  "mask_min_value": 0.1,
107
  "default_caption": "",
@@ -116,15 +119,15 @@
116
  ],
117
  "controls": [],
118
  "shrink_video_to_frames": true,
119
- "num_frames": 33,
120
  "flip_x": false,
121
  "flip_y": false,
122
  "num_repeats": 1,
123
- "do_i2v": true,
124
- "do_audio": true
125
  },
126
  {
127
- "folder_path": "/app/ai-toolkit/datasets/48_frames",
128
  "mask_path": null,
129
  "mask_min_value": 0.1,
130
  "default_caption": "",
@@ -139,12 +142,60 @@
139
  ],
140
  "controls": [],
141
  "shrink_video_to_frames": true,
142
- "num_frames": 41,
143
  "flip_x": false,
144
  "flip_y": false,
145
  "num_repeats": 1,
146
- "do_i2v": true,
147
- "do_audio": true
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
148
  },
149
  {
150
  "folder_path": "/app/ai-toolkit/datasets/images",
@@ -165,14 +216,13 @@
165
  "num_frames": 1,
166
  "flip_x": false,
167
  "flip_y": false,
168
- "num_repeats": 1,
169
- "do_i2v": true
170
  }
171
  ],
172
  "train": {
173
  "batch_size": 1,
174
  "bypass_guidance_embedding": false,
175
- "steps": 15000,
176
  "gradient_accumulation": 1,
177
  "train_unet": true,
178
  "train_text_encoder": false,
@@ -230,7 +280,7 @@
230
  "guidance_scale": 4,
231
  "sample_steps": 25,
232
  "num_frames": 121,
233
- "fps": 24
234
  }
235
  }
236
  ]
 
1
  {
2
  "job": "extension",
3
  "config": {
4
+ "name": "goldenboy_ltx_3",
5
  "process": [
6
  {
7
  "type": "diffusion_trainer",
 
31
  },
32
  "datasets": [
33
  {
34
+ "folder_path": "/app/ai-toolkit/datasets/bucket_17",
35
  "mask_path": null,
36
  "mask_min_value": 0.1,
37
  "default_caption": "",
 
46
  ],
47
  "controls": [],
48
  "shrink_video_to_frames": true,
49
+ "num_frames": 17,
50
  "flip_x": false,
51
  "flip_y": false,
52
  "num_repeats": 1,
53
+ "do_i2v": false,
54
  "do_audio": true,
55
+ "fps": 16,
56
+ "audio_normalize": true
57
  },
58
  {
59
+ "folder_path": "/app/ai-toolkit/datasets/bucket_25",
60
  "mask_path": null,
61
  "mask_min_value": 0.1,
62
  "default_caption": "",
 
71
  ],
72
  "controls": [],
73
  "shrink_video_to_frames": true,
74
+ "num_frames": 25,
75
  "flip_x": false,
76
  "flip_y": false,
77
  "num_repeats": 1,
78
+ "do_audio": true,
79
+ "fps": 16,
80
+ "audio_normalize": true
81
  },
82
  {
83
+ "folder_path": "/app/ai-toolkit/datasets/bucket_33",
84
  "mask_path": null,
85
  "mask_min_value": 0.1,
86
  "default_caption": "",
 
95
  ],
96
  "controls": [],
97
  "shrink_video_to_frames": true,
98
+ "num_frames": 33,
99
  "flip_x": false,
100
  "flip_y": false,
101
  "num_repeats": 1,
102
+ "do_audio": true,
103
+ "fps": 16,
104
+ "audio_normalize": true
105
  },
106
  {
107
+ "folder_path": "/app/ai-toolkit/datasets/bucket_41",
108
  "mask_path": null,
109
  "mask_min_value": 0.1,
110
  "default_caption": "",
 
119
  ],
120
  "controls": [],
121
  "shrink_video_to_frames": true,
122
+ "num_frames": 41,
123
  "flip_x": false,
124
  "flip_y": false,
125
  "num_repeats": 1,
126
+ "do_audio": true,
127
+ "audio_normalize": true
128
  },
129
  {
130
+ "folder_path": "/app/ai-toolkit/datasets/bucket_49",
131
  "mask_path": null,
132
  "mask_min_value": 0.1,
133
  "default_caption": "",
 
142
  ],
143
  "controls": [],
144
  "shrink_video_to_frames": true,
145
+ "num_frames": 49,
146
  "flip_x": false,
147
  "flip_y": false,
148
  "num_repeats": 1,
149
+ "do_audio": true,
150
+ "fps": 16,
151
+ "audio_normalize": true
152
+ },
153
+ {
154
+ "folder_path": "/app/ai-toolkit/datasets/bucket_57",
155
+ "mask_path": null,
156
+ "mask_min_value": 0.1,
157
+ "default_caption": "",
158
+ "caption_ext": "txt",
159
+ "caption_dropout_rate": 0.05,
160
+ "cache_latents_to_disk": true,
161
+ "is_reg": false,
162
+ "network_weight": 1,
163
+ "resolution": [
164
+ 512,
165
+ 768
166
+ ],
167
+ "controls": [],
168
+ "shrink_video_to_frames": true,
169
+ "num_frames": 57,
170
+ "flip_x": false,
171
+ "flip_y": false,
172
+ "num_repeats": 1,
173
+ "do_audio": true,
174
+ "audio_normalize": true
175
+ },
176
+ {
177
+ "folder_path": "/app/ai-toolkit/datasets/bucket_65",
178
+ "mask_path": null,
179
+ "mask_min_value": 0.1,
180
+ "default_caption": "",
181
+ "caption_ext": "txt",
182
+ "caption_dropout_rate": 0.05,
183
+ "cache_latents_to_disk": true,
184
+ "is_reg": false,
185
+ "network_weight": 1,
186
+ "resolution": [
187
+ 512,
188
+ 768
189
+ ],
190
+ "controls": [],
191
+ "shrink_video_to_frames": true,
192
+ "num_frames": 65,
193
+ "flip_x": false,
194
+ "flip_y": false,
195
+ "num_repeats": 1,
196
+ "do_audio": true,
197
+ "fps": 16,
198
+ "audio_normalize": true
199
  },
200
  {
201
  "folder_path": "/app/ai-toolkit/datasets/images",
 
216
  "num_frames": 1,
217
  "flip_x": false,
218
  "flip_y": false,
219
+ "num_repeats": 1
 
220
  }
221
  ],
222
  "train": {
223
  "batch_size": 1,
224
  "bypass_guidance_embedding": false,
225
+ "steps": 16000,
226
  "gradient_accumulation": 1,
227
  "train_unet": true,
228
  "train_text_encoder": false,
 
280
  "guidance_scale": 4,
281
  "sample_steps": 25,
282
  "num_frames": 121,
283
+ "fps": 16
284
  }
285
  }
286
  ]
config.yaml CHANGED
@@ -1,6 +1,6 @@
1
  job: extension
2
  config:
3
- name: goldenboy_ltx
4
  process:
5
  - type: diffusion_trainer
6
  training_folder: /app/ai-toolkit/output
@@ -25,7 +25,7 @@ config:
25
  save_format: diffusers
26
  push_to_hub: false
27
  datasets:
28
- - folder_path: /app/ai-toolkit/datasets/16_frames
29
  mask_path: null
30
  mask_min_value: 0.1
31
  default_caption: ''
@@ -39,14 +39,15 @@ config:
39
  - 768
40
  controls: []
41
  shrink_video_to_frames: true
42
- num_frames: 9
43
  flip_x: false
44
  flip_y: false
45
  num_repeats: 1
46
- do_i2v: true
47
  do_audio: true
48
- fps: 24
49
- - folder_path: /app/ai-toolkit/datasets/24_frames
 
50
  mask_path: null
51
  mask_min_value: 0.1
52
  default_caption: ''
@@ -60,13 +61,14 @@ config:
60
  - 768
61
  controls: []
62
  shrink_video_to_frames: true
63
- num_frames: 17
64
  flip_x: false
65
  flip_y: false
66
  num_repeats: 1
67
- do_i2v: true
68
  do_audio: true
69
- - folder_path: /app/ai-toolkit/datasets/32_frames
 
 
70
  mask_path: null
71
  mask_min_value: 0.1
72
  default_caption: ''
@@ -80,13 +82,14 @@ config:
80
  - 768
81
  controls: []
82
  shrink_video_to_frames: true
83
- num_frames: 25
84
  flip_x: false
85
  flip_y: false
86
  num_repeats: 1
87
- do_i2v: true
88
  do_audio: true
89
- - folder_path: /app/ai-toolkit/datasets/40_frames
 
 
90
  mask_path: null
91
  mask_min_value: 0.1
92
  default_caption: ''
@@ -100,13 +103,13 @@ config:
100
  - 768
101
  controls: []
102
  shrink_video_to_frames: true
103
- num_frames: 33
104
  flip_x: false
105
  flip_y: false
106
  num_repeats: 1
107
- do_i2v: true
108
  do_audio: true
109
- - folder_path: /app/ai-toolkit/datasets/48_frames
 
110
  mask_path: null
111
  mask_min_value: 0.1
112
  default_caption: ''
@@ -120,12 +123,54 @@ config:
120
  - 768
121
  controls: []
122
  shrink_video_to_frames: true
123
- num_frames: 41
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
124
  flip_x: false
125
  flip_y: false
126
  num_repeats: 1
127
- do_i2v: true
128
  do_audio: true
 
 
129
  - folder_path: /app/ai-toolkit/datasets/images
130
  mask_path: null
131
  mask_min_value: 0.1
@@ -144,11 +189,10 @@ config:
144
  flip_x: false
145
  flip_y: false
146
  num_repeats: 1
147
- do_i2v: true
148
  train:
149
  batch_size: 1
150
  bypass_guidance_embedding: false
151
- steps: 15000
152
  gradient_accumulation: 1
153
  train_unet: true
154
  train_text_encoder: false
@@ -201,7 +245,7 @@ config:
201
  guidance_scale: 4
202
  sample_steps: 25
203
  num_frames: 121
204
- fps: 24
205
  meta:
206
- name: goldenboy_ltx
207
  version: '1.0'
 
1
  job: extension
2
  config:
3
+ name: goldenboy_ltx_3
4
  process:
5
  - type: diffusion_trainer
6
  training_folder: /app/ai-toolkit/output
 
25
  save_format: diffusers
26
  push_to_hub: false
27
  datasets:
28
+ - folder_path: /app/ai-toolkit/datasets/bucket_17
29
  mask_path: null
30
  mask_min_value: 0.1
31
  default_caption: ''
 
39
  - 768
40
  controls: []
41
  shrink_video_to_frames: true
42
+ num_frames: 17
43
  flip_x: false
44
  flip_y: false
45
  num_repeats: 1
46
+ do_i2v: false
47
  do_audio: true
48
+ fps: 16
49
+ audio_normalize: true
50
+ - folder_path: /app/ai-toolkit/datasets/bucket_25
51
  mask_path: null
52
  mask_min_value: 0.1
53
  default_caption: ''
 
61
  - 768
62
  controls: []
63
  shrink_video_to_frames: true
64
+ num_frames: 25
65
  flip_x: false
66
  flip_y: false
67
  num_repeats: 1
 
68
  do_audio: true
69
+ fps: 16
70
+ audio_normalize: true
71
+ - folder_path: /app/ai-toolkit/datasets/bucket_33
72
  mask_path: null
73
  mask_min_value: 0.1
74
  default_caption: ''
 
82
  - 768
83
  controls: []
84
  shrink_video_to_frames: true
85
+ num_frames: 33
86
  flip_x: false
87
  flip_y: false
88
  num_repeats: 1
 
89
  do_audio: true
90
+ fps: 16
91
+ audio_normalize: true
92
+ - folder_path: /app/ai-toolkit/datasets/bucket_41
93
  mask_path: null
94
  mask_min_value: 0.1
95
  default_caption: ''
 
103
  - 768
104
  controls: []
105
  shrink_video_to_frames: true
106
+ num_frames: 41
107
  flip_x: false
108
  flip_y: false
109
  num_repeats: 1
 
110
  do_audio: true
111
+ audio_normalize: true
112
+ - folder_path: /app/ai-toolkit/datasets/bucket_49
113
  mask_path: null
114
  mask_min_value: 0.1
115
  default_caption: ''
 
123
  - 768
124
  controls: []
125
  shrink_video_to_frames: true
126
+ num_frames: 49
127
+ flip_x: false
128
+ flip_y: false
129
+ num_repeats: 1
130
+ do_audio: true
131
+ fps: 16
132
+ audio_normalize: true
133
+ - folder_path: /app/ai-toolkit/datasets/bucket_57
134
+ mask_path: null
135
+ mask_min_value: 0.1
136
+ default_caption: ''
137
+ caption_ext: txt
138
+ caption_dropout_rate: 0.05
139
+ cache_latents_to_disk: true
140
+ is_reg: false
141
+ network_weight: 1
142
+ resolution:
143
+ - 512
144
+ - 768
145
+ controls: []
146
+ shrink_video_to_frames: true
147
+ num_frames: 57
148
+ flip_x: false
149
+ flip_y: false
150
+ num_repeats: 1
151
+ do_audio: true
152
+ audio_normalize: true
153
+ - folder_path: /app/ai-toolkit/datasets/bucket_65
154
+ mask_path: null
155
+ mask_min_value: 0.1
156
+ default_caption: ''
157
+ caption_ext: txt
158
+ caption_dropout_rate: 0.05
159
+ cache_latents_to_disk: true
160
+ is_reg: false
161
+ network_weight: 1
162
+ resolution:
163
+ - 512
164
+ - 768
165
+ controls: []
166
+ shrink_video_to_frames: true
167
+ num_frames: 65
168
  flip_x: false
169
  flip_y: false
170
  num_repeats: 1
 
171
  do_audio: true
172
+ fps: 16
173
+ audio_normalize: true
174
  - folder_path: /app/ai-toolkit/datasets/images
175
  mask_path: null
176
  mask_min_value: 0.1
 
189
  flip_x: false
190
  flip_y: false
191
  num_repeats: 1
 
192
  train:
193
  batch_size: 1
194
  bypass_guidance_embedding: false
195
+ steps: 16000
196
  gradient_accumulation: 1
197
  train_unet: true
198
  train_text_encoder: false
 
245
  guidance_scale: 4
246
  sample_steps: 25
247
  num_frames: 121
248
+ fps: 16
249
  meta:
250
+ name: goldenboy_ltx_3
251
  version: '1.0'
goldenboy_ltx_3_000000500.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:21ddd9d7a4826fb6e1d30f0c19e0767d08f9d33b84cad1cc02ca3df0e283e0f0
3
+ size 616948944
goldenboy_ltx_3_000001000.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2fac467fd995054393d7381cd7b21ff32b980972a52bf88734c006354a1ef746
3
+ size 616948944
goldenboy_ltx_3_000001500.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b6e6f23d2efbb2d1b78c6749eba7989d1546b18db283149c5848a712072389d2
3
+ size 616948944
goldenboy_ltx_3_000002000.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3222d1ce20948cacdeb4b91d2b8c028a30c187519aae2587d6c642c43968070e
3
+ size 616948944
goldenboy_ltx_3_000002500.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:93671dad41919e0b6ad44c9ab678ed951675cdd08cb6aa01b81ef76516b685bf
3
+ size 616948944
goldenboy_ltx_3_000003000.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:93e47650d09b75586b84f957ea7756841a6a79c4783d8bdce3441b7134ca2f23
3
+ size 616948944
goldenboy_ltx_3_000003500.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c1fb49831425ea426d0fd2317c0f2730a85780407d0924d1bea59e8ed8bdbd05
3
+ size 616948944
goldenboy_ltx_3_000004000.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4839a3e431ee917baae154b3e28ab70acebf5acae6c50b3b9ac9588a626e5437
3
+ size 616948944
goldenboy_ltx_3_000004500.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:65dd6a0de990b712247cecc179a180178983babe437058715ab606d0de9daa14
3
+ size 616948944
goldenboy_ltx_3_000005000.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5c4077c6b9b9cb178dacb44a180232584f2046177c06dcd52ceecb84e50778ab
3
+ size 616948944
goldenboy_ltx_3_000005500.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:409bfc06813b3635e4f4719022e91f8a6aaf2232553c76c78b255f245a558685
3
+ size 616948944
goldenboy_ltx_3_000006000.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:366f99eb33d9a60ae5c15c3143758962eed5e7395e05a0f295dc455a97e6a271
3
+ size 616948944
goldenboy_ltx_3_000006500.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:21c4552642a95e0aff05b899006516029c22dc2abce47d63377697b61284cd9b
3
+ size 616948944
goldenboy_ltx_3_000007000.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:869effddf480c88d964a12c0491d335c5729fed6d6bd97a9725ab86868280795
3
+ size 616948944
log.txt CHANGED
The diff for this file is too large to render. See raw diff
 
logs/0_log.txt CHANGED
The diff for this file is too large to render. See raw diff
 
loss_log.db CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:6aa662c41fec1f1f45d47035c32621ef8d7499273bdf63fe68e9e31cd7d5f813
3
- size 552960
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:17c4943a586299d5fb18dd0f71b6e6dd5c843e616b6539f683bd3495fa574bd3
3
+ size 1302528
optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a3b687f9f2b72f297ba51fd5e6e76fedabf3116d7efce10b1268eb16f1fb8506
3
  size 629359959
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:43a357089e72f58a4648ef8d85916100ea742694dddc168a5664964393b88e36
3
  size 629359959
pid.txt CHANGED
@@ -1 +1 @@
1
- 473
 
1
+ 610988