Skip to main content
AI Tool Radar
OSI-openMedien, Design und Video

OpenChatCut

0xsline

Open-Source-Videoeditor, der eine echte, editierbare Timeline behält, während konversationelle KI-Agents die Schnitte machen.

2.0k Stars(Stand 2026-09-23)Auf GitHub ansehenHomepage

Was ist OpenChatCut?

Ein Desktop-Videoeditor (Electron, React 19, TypeScript, Vite), der eine Multitrack-Timeline mit KI-Agents koppelt, mit denen du sprichst: Der Agent bearbeitet echte Spuren, Clips, Übergänge und Untertitel, statt ein einmaliges, unveränderliches Video zu erzeugen. Er unterstützt transkriptgetriebenes Schneiden, KI-generierte Bilder/Videos/Sprache/Musik und stellt einen MCP-Server bereit, über den externe Coding-Agents (Codex, Claude Code) das Projekt direkt steuern können.

OpenChatCut auf einen Blick
MerkmalWert
Maintainer0xsline
GitHub-Stars1.979 (Stand 2026-09-23)
Forks289
LizenzAGPL-3.0
LizenztypOSI-open
KategorieMedien, Design und Video
StatusAufsteigend
Edition2026-09
Zuletzt geprüft2026-09-23

OpenChatCut im Detail

KI-Videotools zwingen meist zu einer Wahl zwischen zwei schlechten Optionen: ein klassischer Editor, in dem du alles von Hand machst, Clip für Clip, oder ein One-Shot-KI-Generator, der dir ein fertiges Video liefert, das du nicht wirklich bearbeiten kannst, sondern nur mit einem anderen Prompt komplett neu generierst. OpenChatCut verweigert diese Wahl. Es setzt einen konversationellen KI-Agent in einen echten Multitrack-Videoeditor, sodass der Agent dieselben Spuren, Clips, Übergänge und Untertitel bearbeitet wie ein menschlicher Editor, statt eine undurchsichtige gerenderte Datei zu erzeugen, die in dem Moment aufhört, ein Projekt zu sein, in dem sie entsteht.

Unter der Haube ist es eine Desktop-App (Electron, React 19, TypeScript, Vite), gebaut auf Remotion und FFmpeg fürs Rendern, mit wortgenauem, transkriptgetriebenem Schneiden, verknüpften Untertiteln und KI-Generierung für Bilder, Video, Sprache, Musik und Soundeffekte, eingebunden über das Vercel AI SDK über mehrere Provider hinweg. Motion-Graphics-Vorlagen und WebGL-Effekte sitzen neben der Timeline, und ein MCP-Server öffnet das ganze Projekt für externe Coding-Agents wie Codex oder Claude Code, sodass ein Agent Schnitte genauso steuern kann wie der eingebaute konversationelle Agent. Exporte decken MP4, Audio, Untertitel und FCPXML für die Übergabe an andere Tools ab.

Es passt zu Kreativen und kleinen Teams, die KI nutzen wollen, um das Schneiden zu beschleunigen - Transkript-Bereinigung, Rohschnitte, Untertitel-Generierung -, ohne danach die Fähigkeit zu verlieren, gezielt einen bestimmten Frame, Übergang oder eine Dialogzeile von Hand zu korrigieren. Weil Projekte und Medien standardmässig lokal bleiben und Desktop-Installer für macOS, Windows und Linux existieren, passt es zudem zu allen, die eine selbst gehostete Alternative zu reinen Cloud-KI-Videoeditoren wollen, und die MCP-Unterstützung macht es zu einer natürlichen Wahl, wenn du andere Teile deines Workflows schon über Coding-Agents automatisierst.

AGPL-3.0 ist hier der wichtige Vorbehalt: Es ist eine starke Copyleft-Lizenz, baust du also einen gehosteten Dienst auf OpenChatCut und bietest ihn Nutzern über ein Netzwerk an, musst du in der Regel auch deine Änderungen als Quellcode veröffentlichen, das solltest du vor einem kommerziellen Produkt darauf mit einem Anwalt klären. Auch die KI-Generierungsfeatures sind nicht in sich geschlossen, Bild-, Sprach-, Musik- und Videogenerierung rufen alle externe Provider-APIs auf (OpenAI, Anthropic, Gemini, Fal.ai und andere), du brauchst also eigene Keys und akzeptierst die Kosten und Bedingungen dieser Anbieter. Es gibt keine veröffentlichten unabhängigen oder auch nur selbst gemessenen Performance-Benchmarks, die Vorteile sind architektonische Behauptungen, keine gemessenen.

Das Fazit: OpenChatCut ist eine überzeugende Wahl, wenn dein Kernproblem mit KI-Videotools ist, dass sie die Editierbarkeit wegwerfen, und du einen agentenunterstützten Editor willst, bei dem jede KI-gesteuerte Änderung als echte, nachvollziehbare Timeline-Bearbeitung landet statt als Black-Box-Render. Es wird aktiv entwickelt mit einer stetigen Release- und Installer-Kadenz, behandle es also als heute nutzbar, nicht als experimentell. Plane aber externe KI-API-Kosten ein, da nichts mitgeliefert wird, und lies die AGPL-3.0-Bedingungen genau, bevor du es in ein kommerzielles, gehostetes Angebot einpackst.

Vor- & Nachteile

Pros

  • Behält ein editierbares Projekt (echte Timeline, Clips, Übergänge) statt eines fertig gerenderten, unveränderlichen Videos, ein echter architektonischer Unterschied zu One-Shot-KI-Videotools
  • Fertige Desktop-App mit signierten Installern für macOS, Windows und Linux, kein blosses Skript
  • MCP-Server erlaubt Coding-Agents (Codex, Claude Code), Schnitte programmatisch zu steuern, zusätzlich zum eigenen konversationellen Agent

Cons

  • AGPL-3.0: starkes Copyleft, ein gehosteter SaaS-Fork müsste in der Regel auch seinen Quellcode veröffentlichen, das solltest du vor einem kommerziellen Dienst darauf prüfen
  • KI-Generierungsfeatures (Bilder, Sprache, Musik) hängen von externen Provider-API-Keys ab (OpenAI, Anthropic, Gemini, Fal.ai), keine vollständig lokale Pipeline
  • Keine veröffentlichten Performance- oder Qualitäts-Benchmarks, die Behauptungen sind architektonisch, nicht gemessen

Lizenz

AGPL-3.0 (OSI-open)

Wann interessant

Teams, die KI-gestütztes Videoschneiden wollen, das Ergebnis aber ein voll editierbares Projekt bleiben soll, keine gerenderte Sackgasse.

Wann zu früh

alle, die einen gehosteten Dienst darauf bauen wollen, wegen der AGPL-3.0-Copyleft-Bedingungen.

Dieses Repo war in der Ausgabe 2026-09 des Open-Source-KI-Radars.