Tencent bringt dialogbasierte Bildbearbeitung in Hy Image 3.5 Preview

Tencent veröffentlicht mit Hy Image 3.5 Preview eine Bild-KI, die Bearbeitungen über mehrere Gesprächsschritte hinweg fortführen kann. Die API kostet laut Tencent 0,024 US-Dollar pro erzeugtem Bild und verarbeitet Textanweisungen, Referenzbilder sowie aufeinanderfolgende Änderungen. Ryan Merket berichtet für RuntimeWire, dass Tencent damit vor allem Anwendungen für iterative kreative Arbeit ansprechen will. Bei Hy Image 3.5 …

Weiterlesen …

Qwen veröffentlicht Qwen-Image-2.1 mit Transparenz und Bildbearbeitung

Alibabas KI-Sparte Qwen hat Qwen-Image-2.1 veröffentlicht, ein Open-Weight-Modell für Bildgenerierung und Bildbearbeitung mit einer visuellen Komponente von 7 Milliarden Parametern. Qwen stellt das Modell in einem offiziellen Blogbeitrag vor und nennt Transparenz, Bearbeitung mehrerer Vorlagen und effizientere Berechnungen als zentrale Neuerungen. Das Modell soll Bilder nicht nur aus Texteingaben erzeugen. Es kann vorhandene Bilder verändern, …

Weiterlesen …

World Labs Atlas erstellt aus wenigen Bildern steuerbare 3D-Szenen

World Labs hat mit Atlas ein multimodales KI-Modell vorgestellt, das Szenen erzeugen, räumlich rekonstruieren und simulieren soll. Das World-Labs-Team stellt Atlas in einem offiziellen Blogbeitrag vor. Das System verarbeitet Text, Bilder, Videos, Kamerapositionen und Tiefendaten gemeinsam als räumlichen Kontext. Im Mittelpunkt steht die Kontrolle über die Kamera. Atlas kann laut World Labs aus einem oder …

Weiterlesen …

Google Pics fordert Canva mit KI-Tools für Design heraus

Google führt mit Google Pics eine neue Anwendung für KI-gestützte Bilderstellung und Bildbearbeitung in Workspace ein. Jess Weatherbed berichtet für The Verge, dass die Software auf Gemini und dem Bildmodell Nano Banana basiert und sich an Teams richtet, die etwa Grafiken für Marketing, Präsentationen oder Produktkommunikation erstellen. Google Pics erscheint als eigenständige Workspace-App sowie als …

Weiterlesen …

Google DeepMinds „Backstory“ unterstützt Faktenchecks zu verdächtigen Bildern

Google DeepMind erprobt mit Backstory ein KI-gestütztes Werkzeug für die Prüfung von potenziell manipulierten, irreführenden oder KI-generierten Bildern. Andrew Deck schreibt für Nieman Lab, dass der Dienst über Googles Trusted Testers Program ausgewählten Journalistinnen und Journalisten, OSINT-Fachleuten, Bibliotheken sowie Forschenden zur Medienkompetenz offensteht. Nutzer laden dazu ein Bild hoch und stellen eine einfache Frage. Backstory …

Weiterlesen …

Google macht sichtbare Wasserzeichen für generierte Fotos und Videos optional

Google führt eine Einstellung ein, mit der sich sichtbare Wasserzeichen bei KI-erzeugten Bildern, Videos und Musik aus Gemini und Flow abschalten lassen. Emma Roth berichtet für The Verge, dass die Option das kleine Symbol unten rechts in Medien steuert, die mit Googles Modellen Nano Banana und Omni erstellt wurden. Nutzer finden die neue Einstellung „Media …

Weiterlesen …

AI Fail: Xiaomi 17 Ultra verwechselt bei Sonnenfinsternis Sonne und Mond

Das Xiaomi 17 Ultra hat bei Fotos einer Sonnenfinsternis offenbar eine Mondkorrektur auf die Sonne angewendet. Auf mindestens einer Aufnahme erscheinen kraterähnliche Strukturen und Linien auf der rötlich leuchtenden Sonnenscheibe. Omar Belkaab berichtet für Frandroid über den Fehler, der bei einem Vergleich von vier Smartphones während der Sonnenfinsternis am 12. August auffiel. Das Xiaomi-Modell lieferte …

Weiterlesen …

Googles SynthID übersteht zahlreiche Bearbeitungen, stoppt aber keine KI-Täuschungen

Googles unsichtbares Wasserzeichen SynthID bleibt auch nach starker Komprimierung, Größenänderungen und Bildschirmfotos oft erkennbar. Gegen KI-Desinformation reicht diese Technik jedoch nicht aus. Ryan Whitwam schreibt bei Ars Technica, dass SynthID in Tests nach 300 Durchläufen aus Komprimierung und erneuter Speicherung noch nachweisbar ist. Google bettet die Kennzeichnung direkt in die Bildpunkte ein. Damit ist sie …

Weiterlesen …

Palmier Pro lässt Claude und Codex Routinearbeit im Videoschnitt übernehmen

Palmier Pro ist ein neues Open-Source-Schnittprogramm für macOS. Es verbindet eine klassische Zeitleiste mit KI-Generierung und Schnittstellen für KI-Agenten. Mitgründer Harrison Tin stellt das Projekt in einem Show-HN-Beitrag auf Hacker News vor. Das Ziel sei, wiederkehrende Arbeit in der Videoproduktion zu verringern, nicht kreative Entscheidungen von Menschen zu ersetzen. In der Anwendung lassen sich Bilder, …

Weiterlesen …

Black Forest Labs FLUX 3 ist ein multimodales Modell für Bild und Video

Das deutsche Startup Black Forest Labs hat mit FLUX 3 ein neues KI-Modell vorgestellt. Es soll Bilder sowie Videos mit passendem Ton erzeugen und zugleich als Grundlage für Robotik dienen. Zunächst gibt das Unternehmen den Zugang nur im Rahmen eines genehmigungspflichtigen Frühzugangs frei. Nach Angaben von Black Forest Labs erstellt FLUX 3 Video aus einer …

Weiterlesen …

×