Works quite well
training notes: 32/32, 150 images, detailed qwenvl3 caption, 0.0002
spreadergagv212.safetensors