Google Pics fordert Canva mit KI-Tools für Design heraus

Google führt mit Google Pics eine neue Anwendung für KI-gestützte Bilderstellung und Bildbearbeitung in Workspace ein. Jess Weatherbed berichtet für The Verge, dass die Software auf Gemini und dem Bildmodell Nano Banana basiert und sich an Teams richtet, die etwa Grafiken für Marketing, Präsentationen oder Produktkommunikation erstellen. Google Pics erscheint als eigenständige Workspace-App sowie als …

Weiterlesen …

Gemini Notebook macht die eigenen E-Books zu einer Quelle für KI-Antworten

Google erweitert Gemini Notebook um Expert Intelligence. Mit der Funktion können Nutzer ausgewählte Bücher, die sie bei Google Play Books gekauft haben, als Quellen in die KI-Anwendung übernehmen. Emma Roth berichtet für The Verge, dass sich daraus Fragen beantworten sowie Pläne, Infografiken und KI-Podcasts erstellen lassen. Nutzer können den vollständigen Text solcher Bücher auch direkt …

Weiterlesen …

Google erweitert Gemini Omni 1.1 Flash um Szenenverlängerung und 4K

Google bringt mit Gemini Omni 1.1 Flash eine neue Version seines Modells für generative Videos. Die Aktualisierung soll Entwicklern und Kreativteams mehr Einfluss auf die Erstellung, Verlängerung und Nachbearbeitung von Videoclips geben. Neu sind unter anderem die Fortsetzung bestehender Szenen, Vorgaben für Anfangs- und Endbild, günstigere Entwürfe sowie Video-Referenzen und Ausgaben bis 4K. Im Mittelpunkt …

Weiterlesen …

Gemini Live erhält Sprachsteuerung für Aufgaben, Tagesüberblicke und E-Mails

Google baut Gemini Live zu einem Sprachassistenten für komplexere Aufgaben, Tageszusammenfassungen und die E-Mail-Verwaltung aus. In einem offiziellen Beitrag im Google Blog kündigt Neel Joshi die Verbindung von Gemini Live mit Spark an. Spark soll mehrstufige Aufträge selbstständig bearbeiten. Nutzer können ihr Ziel per Sprache beschreiben. Das System arbeitet laut Google mit Docs, Sheets, Drive …

Weiterlesen …

Gemini 3.5 Transcribe von Google soll aus gesprochener Sprache sauberen Text machen

Google stellt mit Gemini 3.5 Transcribe ein neues Modell für die Umwandlung von Sprache in Text vor. Es richtet sich an Anwendungen für Live-Gespräche, Meeting-Aufzeichnungen und sprachgesteuerte Arbeitsabläufe. Nach Angaben des Unternehmens verarbeitet das Modell auch Hintergrundgeräusche, Fachbegriffe, Akzente und Selbstkorrekturen besser als herkömmliche Spracherkennung. Für Entwickler gibt es zwei Schnittstellen. gemini-3.5-transcribe-live arbeitet über die …

Weiterlesen …

Google integriert Ask Gemini in Chat für Workspace

Google erweitert Google Chat um Ask Gemini. Die neue Oberfläche soll Nutzerinnen und Nutzern helfen, Informationen zu finden, Inhalte zu erstellen und Aufgaben direkt im Chat zu erledigen. Das Unternehmen kündigt dies in einem offiziellen Beitrag bei Google Workspace Updates an. Die Einführung beginnt am 26. August. Ask Gemini ist im Menü „Shortcuts“ von Google …

Weiterlesen …

Google DeepMinds „Backstory“ unterstützt Faktenchecks zu verdächtigen Bildern

Google DeepMind erprobt mit Backstory ein KI-gestütztes Werkzeug für die Prüfung von potenziell manipulierten, irreführenden oder KI-generierten Bildern. Andrew Deck schreibt für Nieman Lab, dass der Dienst über Googles Trusted Testers Program ausgewählten Journalistinnen und Journalisten, OSINT-Fachleuten, Bibliotheken sowie Forschenden zur Medienkompetenz offensteht. Nutzer laden dazu ein Bild hoch und stellen eine einfache Frage. Backstory …

Weiterlesen …

Meinung: Googles KI-Suche gefährdet den Zugang zu öffentlichem Wissen

KI-Zusammenfassungen in der Google-Suche verschärfen die Sorge, dass verlässliche Informationen im Netz schwerer auffindbar werden. Vass Bednar schreibt in The Walrus, dass fehlerhafte KI-Antworten, gelöschte Webseiten und unter Druck geratene Archive die Funktion des Internets als öffentliches Gedächtnis gefährden können. Google stellt mit AI Overviews oft eine automatisch erzeugte Antwort vor die ursprüngliche Quelle. Bednar …

Weiterlesen …

Google macht sichtbare Wasserzeichen für generierte Fotos und Videos optional

Google führt eine Einstellung ein, mit der sich sichtbare Wasserzeichen bei KI-erzeugten Bildern, Videos und Musik aus Gemini und Flow abschalten lassen. Emma Roth berichtet für The Verge, dass die Option das kleine Symbol unten rechts in Medien steuert, die mit Googles Modellen Nano Banana und Omni erstellt wurden. Nutzer finden die neue Einstellung „Media …

Weiterlesen …

Google startet Gemini 3.7 Flash mit günstigeren Einführungspreisen

Google stellt mit Gemini 3.7 Flash eine neue Version seines preisgünstigeren KI Modells vor. Das Modell richtet sich an Programmierung, Wissensarbeit und KI Agenten, die auf Anwendungen und Dateien zugreifen. Für die API verlangt Google bis Ende 2026 zunächst 0,75 US Dollar pro Million Eingabe Tokens und 3,75 US Dollar pro Million Ausgabe Tokens. Ab …

Weiterlesen …

×