Instagrams Edits: Neuer KI-Assistent wertet Daten für bessere Videos aus

Instagram führt in seiner Video-App Edits einen dialogbasierten KI-Assistenten ein. Die App tritt ist eine Alternative zu TikToks CapCut. Amanda Silberling berichtet für TechCrunch, dass das Werkzeug Creator mit individuellen Hinweisen unterstützen soll, statt nur allgemeine Tipps zu liefern. Der Assistent greift laut Instagram auf Kennzahlen des jeweiligen Kontos zu. Dazu zählen neue Follower, Aufrufe, …

Weiterlesen …

World Labs Atlas erstellt aus wenigen Bildern steuerbare 3D-Szenen

World Labs hat mit Atlas ein multimodales KI-Modell vorgestellt, das Szenen erzeugen, räumlich rekonstruieren und simulieren soll. Das World-Labs-Team stellt Atlas in einem offiziellen Blogbeitrag vor. Das System verarbeitet Text, Bilder, Videos, Kamerapositionen und Tiefendaten gemeinsam als räumlichen Kontext. Im Mittelpunkt steht die Kontrolle über die Kamera. Atlas kann laut World Labs aus einem oder …

Weiterlesen …

Google erweitert Gemini Omni 1.1 Flash um Szenenverlängerung und 4K

Google bringt mit Gemini Omni 1.1 Flash eine neue Version seines Modells für generative Videos. Die Aktualisierung soll Entwicklern und Kreativteams mehr Einfluss auf die Erstellung, Verlängerung und Nachbearbeitung von Videoclips geben. Neu sind unter anderem die Fortsetzung bestehender Szenen, Vorgaben für Anfangs- und Endbild, günstigere Entwürfe sowie Video-Referenzen und Ausgaben bis 4K. Im Mittelpunkt …

Weiterlesen …

Alibaba greift mit Wan3.0 den Markt für Unternehmensvideos an

Alibaba hat mit Wan3.0 ein neues Modell zur Videogenerierung vorgestellt, das Clips von bis zu 30 Sekunden in einem Durchgang erstellen soll. Ana Maria Constantin berichtet für The Next Web, dass der Start kurz nach einer Aktienplatzierung in Hongkong im Umfang von rund 10,2 Milliarden US-Dollar erfolgt. Die Erlöse will Alibaba vollständig in KI investieren. …

Weiterlesen …

Google macht sichtbare Wasserzeichen für generierte Fotos und Videos optional

Google führt eine Einstellung ein, mit der sich sichtbare Wasserzeichen bei KI-erzeugten Bildern, Videos und Musik aus Gemini und Flow abschalten lassen. Emma Roth berichtet für The Verge, dass die Option das kleine Symbol unten rechts in Medien steuert, die mit Googles Modellen Nano Banana und Omni erstellt wurden. Nutzer finden die neue Einstellung „Media …

Weiterlesen …

LTX-2.5 ist ein offenes Videomodell mit direkter ComfyUI-Integration

LTX veröffentlicht mit LTX-2.5 ein Open-Weights-Modell für Video und simulierte Umgebungen, das auf schnelle Generierung und den Einsatz auf eigener Hardware zielt. Carl Franzen berichtet für VentureBeat, dass das Modell über Hugging Face, die LTX-API und direkt in ComfyUI verfügbar ist. Zu den wichtigsten Neuerungen gehört die Erzeugung mehrerer zusammenhängender Einstellungen in einem Durchlauf. LTX …

Weiterlesen …

ByteDance Seedance 2.5 ermöglicht längere KI-Videos und präzise Bearbeitung

ByteDance hat Seedance 2.5 vorgestellt, ein Modell zur Videogenerierung mit längeren Clips, mehr Referenzmaterial und genauer steuerbaren Änderungen. ByteDance kündigt das Modell in einem offiziellen Beitrag des Seed-Blogs an und beschreibt es als Schritt von einzelnen Videoclips hin zu vollständiger produzierten audiovisuellen Inhalten. Das Modell erstellt laut ByteDance in einem Durchgang Videos mit Ton von …

Weiterlesen …

MiniMax stellt H3 für KI-Videos mit 2K und Stereo-Ton vor

Das chinesische KI-Unternehmen MiniMax hat mit H3 ein Modell vorgestellt, das Text, Bilder, Videos und Audio in einer Anfrage verarbeiten kann. Nach Angaben des Unternehmens erstellt H3 Videos mit einer Länge von bis zu 15 Sekunden, 2K-Auflösung und nativem Stereo-Ton. Das Modell soll außerdem bestehende Inhalte bearbeiten und Bewegungen aus Referenzvideos übernehmen können. Mit dem …

Weiterlesen …

Palmier Pro lässt Claude und Codex Routinearbeit im Videoschnitt übernehmen

Palmier Pro ist ein neues Open-Source-Schnittprogramm für macOS. Es verbindet eine klassische Zeitleiste mit KI-Generierung und Schnittstellen für KI-Agenten. Mitgründer Harrison Tin stellt das Projekt in einem Show-HN-Beitrag auf Hacker News vor. Das Ziel sei, wiederkehrende Arbeit in der Videoproduktion zu verringern, nicht kreative Entscheidungen von Menschen zu ersetzen. In der Anwendung lassen sich Bilder, …

Weiterlesen …

Black Forest Labs FLUX 3 ist ein multimodales Modell für Bild und Video

Das deutsche Startup Black Forest Labs hat mit FLUX 3 ein neues KI-Modell vorgestellt. Es soll Bilder sowie Videos mit passendem Ton erzeugen und zugleich als Grundlage für Robotik dienen. Zunächst gibt das Unternehmen den Zugang nur im Rahmen eines genehmigungspflichtigen Frühzugangs frei. Nach Angaben von Black Forest Labs erstellt FLUX 3 Video aus einer …

Weiterlesen …

×