🌍 English first — Deutsche Version folgt darunter.
🇬🇧 🚀 What’s new in v3.0?
Version 3.0 is a major rebuild of the Long Video system:
🖼️ Four-scene cycle: Four independent images, each with its own positive and negative prompt, rotate automatically.
🧬 Freer movement with better identity control: The old static whole-character frame flood was replaced by single-image identity guidance and Native Latent Extend. This reduces the constant snap-back to the starting pose and allows more natural character and camera movement.
🔄 Regular re-anchoring: The prepared preset uses two 10-second segments per scene before switching to the next original image. This is designed to reduce cumulative character drift and quality loss.
🧠 Long-video memory management: Only the newest required context is retained, with optional VRAM cleanup between segments.
🎙️ Preview Audio Sync: Segment previews now receive sample-accurate audio alignment, while the Director timeline, lip-sync conditioning and final continuous soundtrack remain unchanged.
✨ Flexible upscaling: Lanczos and RTX Super Resolution can be switched independently after RIFE.
📘 Need the complete guide?
A detailed bilingual guide is available in my separate article. You can also download it as an .md file, and the same guide is included inside the ZIP containing the workflow.
LTX 2.3 Creator Studio v3.0 — Guide/Anleitung
🇩🇪 🚀 Was ist neu in v3.0?
Version 3.0 ist eine umfassende Überarbeitung des Long-Video-Systems:
🖼️ Vier-Szenen-Zyklus: Vier unabhängige Bilder mit jeweils eigenem positiven und negativen Prompt wechseln automatisch.
🧬 Freie Bewegungen bei besserer Identity-Führung: Die alte Flutung mit statischen Ganzkörper-Referenzframes wurde durch Single-Image-Identity-Guidance und Native Latent Extend ersetzt. Dadurch springt der Character nicht ständig zur Ausgangspose zurück und natürlichere Körper- sowie Kamerabewegungen werden möglich.
🔄 Regelmäßiges Neuankern: Das vorbereitete Preset verwendet zwei 10-Sekunden-Segmente pro Szene und wechselt danach zum nächsten Originalbild. Dadurch sollen zunehmender Character Drift und Qualitätsverlust reduziert werden.
🧠 Speicherverwaltung für lange Videos: Es wird nur der zuletzt benötigte Kontext behalten; zwischen den Segmenten kann der VRAM automatisch bereinigt werden.
🎙️ Synchrones Preview-Audio: Die Segmentvorschauen erhalten jetzt eine samplegenaue Audiospur. Director-Timeline, Lip-Sync-Konditionierung und die durchgehende finale Tonspur bleiben unverändert.
✨ Flexibles Upscaling: Lanczos und RTX Super Resolution können nach RIFE unabhängig voneinander ein- oder ausgeschaltet werden.
📘 Du möchtest alle Einzelheiten erfahren?
Den ausführlichen zweisprachigen Guide findest du in meinem separaten Artikel. Zusätzlich kannst du ihn als .md-Datei herunterladen. Dieselbe Guide-Datei ist außerdem im ZIP-Ordner des Workflows enthalten.
LTX 2.3 Creator Studio v3.0 — Guide/Anleitung
-
🚀 WHAT’S NEW IN THIS UPDATE? v2.0
This update focuses on longer videos, stronger whole-character consistency, synchronized frame rates, smoother segment transitions, improved VRAM management, and easier operation.
🎬 Long Video Auto Sequence
Long audio tracks are automatically divided into configurable LTX segments.
Press Queue Prompt only once — all remaining segments are generated and queued automatically.
Default segment length: 5 seconds.
Default overlap: 0.2 seconds, fully adjustable.
The last frame of the previous segment is used to continue motion, pose, framing, and scene composition.
All completed segments are automatically normalized and assembled into one synchronized MP4.
Optional smooth crossfades help conceal visible segment boundaries.
✂️ Director Trim Now Controls the Real Video Length
The visible audio range selected inside LTX Director now determines:
the total video duration;
the number of generated segments;
the starting point of every segment;
the final audio trim;
the final MP4 duration.
A full-source-audio mode remains available when the entire original audio file should be used.
🧬 Ingredients Whole-Character Consistency
A new permanent original-character reference system has been added using the LTX Ingredients IC-LoRA.
The reference image is automatically synchronized from the main Load Image node when a new sequence starts.
Ingredients conditioning is applied during both LTX sampling passes.
It is designed to preserve the face, hairstyle, skin tone, outfit, body proportions, colors, and visible accessories.
The previous segment frame controls motion continuity, while the untouched original image remains the permanent identity reference.
This is generative character conditioning — not a face swap — so there is no separately pasted face-mask effect.
Recommended Ingredients strength: 1.0.
An additional guide for optional personally trained Character ID LoRAs is also included.
🎞️ Base FPS and RIFE Auto Sync
A new central FPS Selector keeps all timing-sensitive parts of the workflow synchronized.
Available Base FPS values:
24 FPS
25 FPS
30 FPS
RIFE interpolation can be selected from 1x to 5x.
The selector automatically controls:
LTX generation FPS;
LTX Director timeline FPS;
segment and overlap calculations;
RIFE interpolation;
Video Combine FPS;
final MP4 and crossfade FPS.
The prepared default is 24 Base FPS with 3x interpolation for 72 Final FPS.
🧮 Correct LTX Frame Calculation
The automatic frame calculation has been corrected to always produce a valid 8n + 1 LTX frame count.
This prevents invalid duration values and keeps generation timing consistent with the selected FPS.
🎥 Final Long-Video Preview
The complete assembled video can now be previewed directly inside the LFPERFECT Long Video Auto Sequence node.
The controller provides:
an integrated final-video player;
automatic preview updates after final assembly;
preview restoration from ComfyUI history;
the resolved MP4 output path;
an Open Final Video link.
The normal Video Combine preview may still display an individual segment. The complete video appears inside the Long Video controller.
🧠 Improved VRAM Management
VRAM can be cleared automatically between long-video segments.
LTX models are unloaded before RIFE interpolation or RTX processing.
This reduces unnecessary memory usage during longer generation sequences.
🚀 Standalone RTX Video Super Resolution
A separate fifth workflow has been added for processing already completed videos with RTX Video Super Resolution.
It preserves:
the original video frames;
the original frame rate;
the existing audio track.
This allows RTX upscaling to run separately without keeping LTX, ACE-Step, or TTS models loaded.
📐 Updated Resize-a-Tron LTX Edition
Resize-a-Tron has been updated using the corrected revision by MGHerder.
Width and height are now correctly rounded to the nearest 64-pixel increment.
The same sizing logic is applied to the main generation image and the permanent Ingredients character reference.
Manual width and height calculations are no longer necessary.
The reference remains aligned with the selected LTX form factor and two-pass resolution chain.
🙏 Special thanks to MGHerder for the updated Resize-a-Tron LTX Edition and its corrected 64-pixel sizing logic.
🛡️ Additional Stability Improvements
Expanded negative prompt for identity, outfit, body, background, camera, and temporal stability.
Sampler seeds are fixed by default for more reproducible testing.
The optional prompt enhancer is bypassed by default to preserve the user’s original prompt.
Improved model cleanup before interpolation and upscaling.
📚 New Detailed Bilingual Guides
Detailed English and German guides are now included directly inside the workflow for:
Long Video Auto Sequence;
Director Trim and segment continuity;
Ingredients whole-character consistency;
FPS and RIFE synchronization;
Resize-a-Tron;
optional Character ID LoRAs;
final long-video preview;
standalone RTX upscaling.
The existing LTX, ACE-Step Music, and TTS sections remain available.
# 🙏 CREDITS & ZUSAMMENARBEIT
# 🙏 CREDITS & COLLABORATION
⚠️ Text-to-Video Compatibility Note
The new Long Video Auto Sequence and Ingredients Whole-Character Lock are currently optimized for Image-to-Video and reference-guided generation.
Pure Text-to-Video without an uploaded reference image is not yet integrated with the automatic multi-segment continuation system. The original T2V path remains available, but the Long Video controller and Ingredients reference branch must be disabled or bypassed when using pure T2V.
Automatic T2V long-video generation — starting the first segment from text and continuing all following segments from the previously generated frame — is planned for a future update.
⚠️ Segment Transitions and Overlap
The automatic segment assembly is fully functional, but transitions are not guaranteed to be completely seamless in every video. Each segment begins a new LTX denoising process, so small changes in pose, framing, lighting, or motion may remain visible even when the previous final frame is used for continuity.
Use the Segment Overlap control together with Smooth Crossfade to conceal these boundaries as much as possible.
Recommended starting point:
segment_overlap_seconds: 0.2smooth_crossfade: TRUE
Depending on the reference image, composition, prompt, and amount of motion, values between approximately 0.2 and 0.4 seconds may work better. Experiment with the slider to find the best result for each video.
Relatively static portrait videos — such as talking or singing characters with mainly facial animation, blinking, and subtle head movement — usually produce smoother transitions.
Transitions may be more noticeable when the character performs large body movements, changes pose, moves across the frame, or when the camera moves strongly between segments.
A larger overlap is not always better. Excessive values can create visible dissolves, ghosting, or repeated motion. Increase the overlap gradually and test short clips before starting a long render.
🚀 WAS IST NEU IN DIESEM UPDATE? v2.0
Dieses Update konzentriert sich auf längere Videos, eine stabilere Darstellung des gesamten Charakters, synchronisierte Bildraten, weichere Segmentübergänge, eine bessere VRAM-Verwaltung und eine einfachere Bedienung.
🎬 Long Video Auto Sequence
Lange Audiodateien werden automatisch in konfigurierbare LTX-Segmente aufgeteilt.
Queue Prompt muss nur einmal gestartet werden — alle weiteren Segmente werden automatisch erzeugt und eingereiht.
Standard-Segmentlänge: 5 Sekunden.
Standard-Overlap: 0,2 Sekunden, vollständig anpassbar.
Der letzte Frame des vorherigen Segments führt Bewegung, Pose, Bildausschnitt und Szene im nächsten Segment weiter.
Alle fertigen Segmente werden automatisch normalisiert und zu einer synchronisierten MP4 zusammengesetzt.
Optionale weiche Crossfades helfen dabei, sichtbare Segmentgrenzen zu kaschieren.
✂️ Director Trim steuert jetzt die tatsächliche Videolänge
Der im LTX Director sichtbare Audiobereich bestimmt jetzt:
die gesamte Videolänge;
die Anzahl der Segmente;
den Startpunkt jedes Segments;
den finalen Audiobeschnitt;
die Länge der fertigen MP4.
Alternativ kann weiterhin die vollständige ursprüngliche Audiodatei verwendet werden.
🧬 Ingredients-Lock für den gesamten Charakter
Mit der LTX Ingredients IC-LoRA wurde ein permanentes Referenzsystem für den ursprünglichen Charakter ergänzt.
Das Referenzbild wird beim Start einer neuen Sequenz automatisch mit dem normalen Load-Image-Knoten synchronisiert.
Die Ingredients-Konditionierung wird in beiden LTX-Sampling-Pässen verwendet.
Das System soll Gesicht, Frisur, Hautton, Outfit, Körperproportionen, Farben und sichtbare Accessoires stabil halten.
Der vorherige Segmentframe sorgt für Bewegungskontinuität, während das unveränderte Originalbild dauerhaft als Identitätsreferenz erhalten bleibt.
Es handelt sich um generative Charakterkonditionierung und nicht um einen Face Swap. Dadurch entsteht kein nachträglich aufgesetzter Maskeneffekt.
Empfohlene Ingredients-Stärke: 1,0.
Zusätzlich ist ein Guide für optionale, persönlich trainierte Character-ID-LoRAs enthalten.
🎞️ Automatische Synchronisierung von Basis-FPS und RIFE
Ein neuer zentraler FPS Selector hält alle zeitabhängigen Bereiche des Workflows synchron.
Verfügbare Basis-FPS:
24 FPS
25 FPS
30 FPS
Die RIFE-Interpolation kann von 1x bis 5x eingestellt werden.
Der Selector steuert automatisch:
die LTX-Generierungs-FPS;
die Zeitleisten-FPS des LTX Directors;
Segment- und Overlap-Berechnungen;
die RIFE-Interpolation;
die FPS von Video Combine;
die finalen MP4- und Crossfade-FPS.
Der vorbereitete Standard ist 24 Basis-FPS mit 3x-Interpolation für 72 finale FPS.
🧮 Korrigierte LTX-Frameberechnung
Die automatische Frameberechnung erzeugt jetzt zuverlässig eine gültige 8n + 1 Frameanzahl für LTX.
Dadurch werden ungültige Framewerte vermieden und die Generierungsdauer bleibt mit den ausgewählten FPS synchron.
🎥 Vorschau des fertigen langen Videos
Das vollständig zusammengesetzte Video kann jetzt direkt im Knoten LFPERFECT Long Video Auto Sequence angesehen werden.
Der Controller bietet:
einen integrierten Player für das fertige Video;
automatische Aktualisierung nach dem finalen Zusammensetzen;
Wiederherstellung der Vorschau aus der ComfyUI-Historie;
Anzeige des vollständigen MP4-Ausgabepfads;
einen Open Final Video-Link.
Die normale Video-Combine-Vorschau kann weiterhin nur ein einzelnes Segment anzeigen. Das vollständige Video erscheint im Long-Video-Controller.
🧠 Verbesserte VRAM-Verwaltung
VRAM kann automatisch zwischen den Langvideo-Segmenten geleert werden.
LTX-Modelle werden vor RIFE oder der RTX-Verarbeitung entladen.
Dadurch wird bei langen Generierungen unnötig belegter Grafikspeicher reduziert.
🚀 Separater RTX Video Super Resolution Workflow
Ein fünfter Workflow für die nachträgliche Verarbeitung bereits fertiggestellter Videos wurde hinzugefügt.
Dabei bleiben erhalten:
sämtliche Videoframes;
die ursprüngliche Bildrate;
die vorhandene Audiospur.
Der RTX-Upscaler kann dadurch separat ausgeführt werden, ohne gleichzeitig LTX-, ACE-Step- oder TTS-Modelle im Speicher zu halten.
📐 Aktualisierte Resize-a-Tron LTX Edition
Resize-a-Tron wurde mit der korrigierten Überarbeitung von MGHerder aktualisiert.
Breite und Höhe werden jetzt korrekt auf den nächsten passenden 64-Pixel-Schritt gerundet.
Dieselbe Größenlogik wird auf das Hauptbild und die permanente Ingredients-Charakterreferenz angewendet.
Manuelle Berechnungen von Breite und Höhe sind nicht mehr notwendig.
Die Referenz bleibt mit dem gewählten LTX-Seitenverhältnis und der zweistufigen Auflösungskette abgestimmt.
🙏 Besonderer Dank an MGHerder für die aktualisierte Resize-a-Tron LTX Edition und die korrigierte 64-Pixel-Größenberechnung.
🛡️ Weitere Stabilitätsverbesserungen
Erweiterter negativer Prompt für Identität, Outfit, Körper, Hintergrund, Kamera und zeitliche Stabilität.
Die Sampler-Seeds sind standardmäßig fest eingestellt, um Tests besser reproduzierbar zu machen.
Der optionale Prompt Enhancer ist standardmäßig deaktiviert, damit der ursprüngliche Prompt unverändert bleibt.
Verbesserte Modellbereinigung vor Interpolation und Upscaling.
📚 Neue ausführliche zweisprachige Guides
Direkt im Workflow befinden sich neue englische und deutsche Anleitungen für:
Long Video Auto Sequence;
Director Trim und Segmentkontinuität;
Ingredients-Lock für den gesamten Charakter;
FPS- und RIFE-Synchronisierung;
Resize-a-Tron;
optionale Character-ID-LoRAs;
Vorschau des fertigen Langvideos;
separates RTX-Upscaling.
Die vorhandenen Bereiche für LTX, ACE-Step Music und TTS bleiben weiterhin verfügbar.
⚠️ Hinweis zur Text-to-Video-Kompatibilität
Die neue Long Video Auto Sequence und der Ingredients Whole-Character-Lock sind aktuell für Image-to-Video und referenzbasierte Generierungen optimiert.
Reines Text-to-Video ohne hochgeladenes Referenzbild ist noch nicht mit der automatischen Multi-Segment-Fortsetzung verbunden. Der ursprüngliche T2V-Pfad ist weiterhin im Workflow enthalten, für reines T2V müssen der Long-Video-Controller und der Ingredients-Referenzpfad jedoch deaktiviert oder umgangen werden.
Eine automatische T2V-Langvideo-Funktion, bei der das erste Segment ausschließlich aus Text entsteht und alle folgenden Segmente mit dem zuletzt generierten Frame fortgesetzt werden, ist für ein späteres Update geplant.
⚠️ Segmentübergänge und Overlap
Das automatische Zusammensetzen der Segmente funktioniert, allerdings können nicht bei jedem Video vollständig nahtlose Übergänge garantiert werden. Jedes Segment beginnt einen neuen LTX-Denoising-Prozess. Deshalb können trotz der Verwendung des vorherigen letzten Frames kleine Veränderungen bei Pose, Bildausschnitt, Beleuchtung oder Bewegung sichtbar bleiben.
Verwende den Regler Segment Overlap zusammen mit aktiviertem Smooth Crossfade, um diese Übergänge möglichst gut zu kaschieren.
Empfohlener Startwert:
segment_overlap_seconds: 0.2smooth_crossfade: TRUE
Abhängig vom Referenzbild, Bildaufbau, Prompt und der Bewegungsstärke können Werte zwischen ungefähr 0,2 und 0,4 Sekunden besser funktionieren. Experimentiere deshalb bei jedem Video etwas mit dem Regler.
Relativ statische Portraitvideos – beispielsweise sprechende oder singende Charaktere mit hauptsächlich animierten Gesichtszügen, Blinzeln und dezenten Kopfbewegungen – erzeugen normalerweise weichere Übergänge.
Bei starken Körperbewegungen, deutlichen Posenwechseln, Bewegungen durch das Bild oder ausgeprägten Kamerafahrten können die Segmentgrenzen stärker sichtbar werden.
Ein größerer Overlap ist nicht automatisch besser. Zu hohe Werte können sichtbare Überblendungen, Ghosting oder wiederholte Bewegungen erzeugen. Erhöhe den Wert deshalb schrittweise und teste zunächst kurze Clips, bevor du eine lange Generierung startest.
---
# 🇩🇪 DEUTSCHE VERSION
## 🎬 Grundlage des LTX-Workflows
Der Hauptaufbau des ursprünglichen LTX Video 2.3 Workflows basiert auf der Arbeit von MGHerder.
🔗 CivitAI-Profil von MGHerder:
https://civarchive.com/user/MGHerder
MGHerder hat mir ausdrücklich erlaubt, meine erweiterte Version zuerst zu veröffentlichen. Er schlug außerdem vor, diese Weiterentwicklung als eine Form der Zusammenarbeit zu betrachten, da wir gegenseitig von unseren Workflows, Ideen und Erfahrungen lernen.
Die Bereiche für:
- Custom Audio
- audio-gesteuerten Lip-Sync
- LTX Director 2.0
- die Verbindung der einzelnen Workflow-Bereiche
- den zentralen Workflow-Selector
- TTS
- ACE-Step-Musikgenerierung
- RTX Super Resolution
- Organisation, Layout und Dokumentation
wurden für diese Version von LFPERFECT integriert, erweitert oder angepasst.
Ein besonderer Dank geht an MGHerder für seine ursprüngliche Workflow-Grundlage, sein Feedback, seine Unterstützung und die Erlaubnis zur Veröffentlichung.
---
## 📌 Hinweis zur ursprünglichen Quelle
MGHerder teilte mir außerdem mit, dass sein ursprünglicher Workflow selbst auf einem älteren Workflow eines anderen Creators auf Hugging Face basierte.
Der Name beziehungsweise die genaue Originalquelle konnte bisher noch nicht eindeutig ermittelt werden.
Sobald der ursprüngliche Creator oder Workflow gefunden wurde, wird der entsprechende Credit ergänzt.
Vielen Dank auch an diesen bisher unbekannten Creator für die ursprüngliche Grundlage, auf der spätere Versionen aufgebaut wurden.
-->## 🧩 Update! ->>
## 🧩 Entwicklung und Danksagungen
Im LTX 2.3 Creator Studio Workflow habe ich die Creator-Studio-Integration, LTX Director 2.0, Custom Audio, Lip-Sync, ACE-Step, TTS, den separaten RTX-Super-Resolution-Workflow sowie die Organisation und vollständige Dokumentation hinzugefügt.
Ein besonderer Dank geht an:
- RuneXX – für den früheren LTX-Workflow auf Hugging Face, der als ursprüngliche Grundlage für den LTX-Basic-Workflow diente. Zu dessen zentralen Funktionen gehören unter anderem der Prompt Enhancer, die Taeltx-KSampler-Vorschau und das zweistufige Sampling.
- MGHerder – für LTXExpress, das Resize-a-Tron-System, den Upscaling- und Interpolationsaufbau, das Speichern des letzten Frames mit eingebettetem Workflow und weitere Bestandteile.
Vielen Dank an alle beteiligten Creator für ihre Arbeit, ihre Ideen und ihre Beiträge zur ComfyUI-Community.
---
## 🎵 ACE-Step 1.5 Musik-Workflows
Die Bereiche:
- ACE-Step 1.5 XL Basic
- ACE-Step 1.5 XL All-in-One
basieren auf den Workflows, die in folgendem YouTube-Video vorgestellt wurden:
🔗 https://youtu.be/BmbatXlyj84
Vielen Dank an den Creator des Tutorials und der darin gezeigten Workflows.
Die Musikbereiche wurden für dieses Creator Studio angepasst, neu angeordnet und mit dem zentralen Workflow-Selector verbunden. Die kommerzielle Nutzung von generierten Inhalten ist nur zulässig, wenn die Lizenzen der ausgewählten Modelle, LoRAs und anderen Komponenten dies zulassen.
---
## 🛠️ Erweiterung und Integration
Workflow-Erweiterung, Custom-Audio- und Lip-Sync-Integration, LTX Director 2.0, TTS, ACE-Step-Integration, RTX Super Resolution, Organisation und Dokumentation:
LFPERFECT
Dieses Projekt ist aus Community-Arbeit, gegenseitigem Lernen und der Weiterentwicklung bestehender Ideen entstanden.
Bitte unterstützt die ursprünglichen Creator und beachtet die jeweiligen Lizenzen und Nutzungsbedingungen aller verwendeten Modelle, LoRAs und Custom Nodes.
---
# 🇬🇧 ENGLISH VERSION
## 🎬 LTX Workflow Foundation
The main structure of the original LTX Video 2.3 workflow is based on the work of MGHerder.
🔗 MGHerder’s CivitAI profile:
https://civarchive.com/user/MGHerder
MGHerder explicitly gave me permission to publish my expanded version first. He also suggested considering this development a form of collaboration, as we have both learned from each other’s workflows, ideas, and experiences.
The following parts were integrated, expanded, or adapted for this version by LFPERFECT:
- Custom Audio
- audio-driven Lip Sync
- LTX Director 2.0
- integration of the individual workflow sections
- central workflow selector
- Text-to-Speech
- ACE-Step music generation
- RTX Super Resolution
- organization, layout, and documentation
Special thanks to MGHerder for the original workflow foundation, his feedback, his support, and his permission to publish this expanded version.
---
## 📌 Note About the Original Source
MGHerder also informed me that his original workflow was itself based on an older workflow created by another user on Hugging Face.
The name and exact original source have not yet been identified.
The appropriate credit will be added as soon as the original creator or workflow can be confirmed.
Many thanks also to this currently unidentified creator for the original foundation upon which later versions were developed.
-->## 🧩 --> Update! -->
## 🧩 Development and Acknowledgements
In the LTX 2.3 Creator Studio workflow, I added the Creator Studio integration, LTX Director 2.0, Custom Audio, Lip-Sync, ACE-Step, TTS, the standalone RTX Super Resolution workflow, organization, and complete documentation.
Special thanks to:
- RuneXX – for the earlier Hugging Face LTX workflow that served as the original foundation for the LTX Basic workflow. Some of its main core features include the Prompt Enhancer, Taeltx KSampler preview, and two-stage sampling.
- MGHerder – for LTXExpress, the Resize-a-Tron system, upscaling, interpolation, last-frame saving with the embedded workflow, and other components.
Many thanks to all involved creators for their work, ideas, and contributions to the ComfyUI community.
---
## 🎵 ACE-Step 1.5 Music Workflows
The following sections:
- ACE-Step 1.5 XL Basic
- ACE-Step 1.5 XL All-in-One
are based on the workflows demonstrated in the following YouTube video:
🔗 https://youtu.be/BmbatXlyj84
Many thanks to the creator of the tutorial and the workflows shown in the video.
The music sections were adapted, reorganized, and connected to the central workflow selector for this Creator Studio. Commercial use of generated content is only permitted where the licenses of the selected models, LoRAs, and other components allow it.
---
## 🛠️ Expansion and Integration
Workflow expansion, Custom Audio and Lip-Sync integration, LTX Director 2.0, TTS, ACE-Step integration, RTX Super Resolution, organization, and documentation:
LFPERFECT
This project was made possible through community work, shared learning, and the continued development of existing ideas.
Please support the original creators and respect the individual licenses and usage terms of all models, LoRAs, and custom nodes used in this workflow.
Description
Initial v1.0 release of LTX 2.3 Creator Studio by LFPERFECT.
Includes:
• LTX Video 2.3 Image-to-Video and Text-to-Video
• LTX Director 2.0
• Custom Audio and audio-driven Lip Sync
• ACE-Step 1.5 XL Basic Music
• ACE-Step 1.5 XL All-in-One Music
• Idea-to-Music, Image-to-Music and Music-to-Music
• Multilingual Chatterbox Text-to-Speech
• Optional reference voice cloning
• Two-stage latent upscaling
• RIFE frame interpolation
• Optional NVIDIA RTX Super Resolution
• German and English workflow guides
• Direct links to the required models
• Central selector for activating one complete workflow at a time
Main LTX workflow foundation by MGHerder.
Workflow expansion, Lip-Sync integration, Creator Studio organization and documentation by LFPERFECT.
FAQ
Comments (7)
Congratulations on your latest workflow release. I look forward to trying your version and the additions. Seriously, well done!
Thank you so much! Your workflow and resize logic gave me the foundation to build all of this, so your support really means a lot to me. I’m excited to hear what you think once you’ve tried the full version, especially the lip-sync, music, and TTS additions. I’m very happy we can call this a collaboration — we’ve definitely learned a lot from each other. 🤝
@LFPerfect Yes, those lip sync elements are exactly what I wanted to add to my workflow but never got around to it. You added a ton of advanced features. It’s really impressive.
Thank you, that really means a lot to me, especially coming from you. The lip-sync integration was one of the most important parts I wanted to get right, and once it started working well, I kept building more features around it.
Your workflow gave me such a strong foundation that it made much more sense to expand it than to start over from scratch. I’m really looking forward to hearing how the full version works on your setup and what ideas you might have after trying it. I’m sure we’ll both keep learning from and improving each other’s work.
# ⚠️ Performance & Recommended Starting Settings
# ⚠️ Leistung und empfohlene Starteinstellungen
## 🇩🇪 Deutsch
Die benötigte Generierungszeit und der VRAM-Verbrauch hängen stark von der verwendeten Grafikkarte, der Auflösung, der Videolänge und den aktivierten Upscaling-Optionen ab.
Beginne deshalb zunächst mit einer niedrigeren Auflösung und einem kurzen Clip. Erhöhe die Einstellungen anschließend schrittweise, bis du eine gute Balance zwischen Qualität, Geschwindigkeit und Speicherverbrauch für dein System gefunden hast.
Empfohlener Einstieg:
- kurze Clips von ungefähr 5 bis 6 Sekunden
- eine moderate Ausgangsauflösung
- zunächst kein zusätzliches RTX Super Resolution
- Upscale Factor zunächst auf 1.0 oder 1.5
- erst danach Auflösung und Videolänge erhöhen
Je höher die Auflösung und je länger das Video, desto länger dauert die Generierung und desto mehr VRAM und Arbeitsspeicher werden benötigt.
### img_compression
Der Wert *img_compression** im LTXV-Preprocess-Node steht in diesem Workflow standardmäßig auf:
33
Die offiziellen LTX-2.3-Beispielworkflows verwenden häufig einen niedrigeren Wert wie 18, wodurch mehr Details des Eingabebildes erhalten bleiben.
Ein niedrigerer Wert bedeutet weniger Kompression und potenziell mehr erhaltene Details. Ein höherer Wert bedeutet stärkere Kompression und kann das Aussehen beziehungsweise die Interpretation des Referenzbildes beeinflussen.
Ich habe 33 als Standard beibehalten, da meine Tests und die veröffentlichten Beispielvideos damit bereits sehr gute und stabile Ergebnisse geliefert haben.
Für maximale Detailtreue kannst du Werte zwischen ungefähr 18 und 25 testen. Vergleiche Änderungen am besten mit demselben Bild, Prompt, Seed und denselben übrigen Einstellungen.
---
## 🇬🇧 English
Generation time and VRAM usage depend heavily on your graphics card, resolution, video duration, and the enabled upscaling options.
Start with a lower resolution and a short clip first. Then gradually increase the settings until you find a good balance between quality, speed, and memory usage for your system.
Recommended starting point:
- short clips of approximately 5 to 6 seconds
- a moderate initial resolution
- disable additional RTX Super Resolution for the first tests
- begin with an Upscale Factor of 1.0 or 1.5
- increase the resolution and video duration afterward
Higher resolutions and longer videos require considerably more processing time, VRAM, and system memory.
### img_compression
The *img_compression** value inside the LTXV Preprocess node is set to:
33
Official LTX-2.3 example workflows commonly use a lower value such as 18, which preserves more detail from the input image.
A lower value means less compression and potentially more retained detail. A higher value applies stronger compression and may influence how the reference image is interpreted.
I kept 33 as the default because my own tests and the published example videos already produced very good and stable results with this setting.
For maximum input detail, you can test values between approximately 18 and 25. For a meaningful comparison, use the same image, prompt, seed, and all other settings.
Workflow with images and sound so users can instantly get a feel of what it is. Godlike!
Amazing - einfach nur top...