Google präsentiert Gemini-Agenten für lang laufende Unternehmensaufgaben

Google Cloud stellt einen universellen Gemini-Agenten vor, der Unternehmensaufgaben über mehrere Anwendungen hinweg bearbeiten und über Stunden oder Tage fortführen soll. Carl Franzen berichtet für VentureBeat, dass das System unter anderem mit Google Workspace, Microsoft 365 und Slack arbeiten soll. Google will Beschäftigten damit einen zentralen KI-Agenten für umfangreichere Aufträge bieten. Nutzer könnten ihn etwa …

Weiterlesen …

Google AI Edge Foresight erstellt Besprechungsnotizen direkt auf dem Mac

Google hat mit Google AI Edge Foresight eine macOS-App für Besprechungsnotizen vorgestellt, die vollständig ohne Internetverbindung arbeiten kann. Ivan Mehta berichtet für TechCrunch, dass die Anwendung vom selben Google-Team stammt wie ein zuvor veröffentlichter, experimenteller Diktierdienst mit lokalen KI-Modellen. Die Software kann Gespräche in verschiedenen Anwendungen sowie persönliche Treffen erfassen und transkribieren. Sie ist für …

Weiterlesen …

Microsoft und Ghost setzen auf neue Computer für lokale KI

Microsoft und das Start-up Ghost bringen neue, hochpreisige Computer auf den Markt, die KI-Modelle direkt auf dem Gerät ausführen sollen. Damit wächst das Angebot an Hardware, die weniger auf Rechenleistung aus der Cloud angewiesen ist. Microsoft nimmt Vorbestellungen für die Surface RTX Spark Dev Box entgegen. Der kompakte Entwicklerrechner kostet 5.999 Dollar und soll im …

Weiterlesen …

Wasserzeichen für KI-Inhalte: Google öffnet SynthID Detector

Google stellt mit SynthID Detector eine öffentliche Website bereit, die Bilder, Videos und Audiodateien auf das KI-Wasserzeichen des Unternehmens prüft. Ivan Mehta berichtet für TechCrunch, dass der Dienst nach einer Testphase mit Journalisten, Medienschaffenden und Forschenden nun allgemein zugänglich ist. Die Website unterstützt zahlreiche verbreitete Dateiformate. Bei Bildern gehören dazu JPG, PNG, WebP, AVIF, HEIC, …

Weiterlesen …

OpenAI bringt GPT-6 mit interaktiven Antworten zu ChatGPT

OpenAI führt GPT-6 in ChatGPT ein und ergänzt den Dienst um Intelligent UI. Diese Funktion kann Antworten um interaktive Elemente wie Diagramme, Schaltflächen, Formulare, Karten und Rechner erweitern. OpenAI kündigt den Start in einem offiziellen Blogbeitrag an und weitet damit den Zugang zum neuen Modell für ChatGPT-Nutzer aus. Welche Darstellung erscheint, soll von der jeweiligen …

Weiterlesen …

Anthropic macht aus Claude Haiku 5.5 einen schnellen Spezialisten für KI-Agenten

Anthropic stellt mit Claude Haiku 5.5 ein neues kompaktes KI-Modell für häufige und klar umrissene Aufgaben vor. Es soll Zusammenfassungen, Klassifizierungen, Datenbankabfragen, Dokumentenrecherchen und Anfragen im Kundensupport bearbeiten. Nach Angaben des Unternehmens ist es das bisher schnellste Modell von Anthropic und das erste Haiku-Modell mit einstellbarem „Denkaufwand“. Darüber können Entwickler festlegen, wie viel Rechenaufwand das …

Weiterlesen …

Nano Banana 2.1: bessere Bilder, mehr Optionen, geringere Kosten

Google hat mit Nano Banana 2.1 ein neues Modell für Bildgenerierung und Bildbearbeitung veröffentlicht. Es löst Nano Banana 2 ab und senkt die Preise laut Google in vielen Fällen um etwa die Hälfte. Matthias Bastian berichtet bei The Decoder, dass das Modell auf Gemini 3.6 Flash basiert und bereits in mehreren Google-Produkten eingeführt wird. Nach …

Weiterlesen …

Mistral Large 4: Open-Weight-Modell mit einer Billion Parametern

Mistral hat eine öffentliche Vorschau auf Mistral Large 4 gestartet. Das Modell ist das bislang größte System des französischen KI-Unternehmens und soll den Markt für leistungsfähige Open-Weight-Modelle erweitern. Die Gewichte will Mistral noch in diesem Monat veröffentlichen. Unternehmen könnten das Modell dann selbst betreiben und anpassen. Mistral Large 4, kurz ML4 und intern auch „Le …

Weiterlesen …

AWS veröffentlicht Strands Decider 2B als offene Alternative zu Jev

AWS hat mit Strands Decider 2B ein kostenloses Open-Source-Modell vorgestellt, das KI-Agenten bei klar abgegrenzten Entscheidungen unterstützen soll. Carl Franzen berichtet für VentureBeat, dass das Modell aus dem experimentellen AWS-Projekt Strands Labs für die Entwicklung von Agenten stammt. Strands Decider 2B ist kein Chatbot für ausführliche Antworten. Das Modell soll zwischen vorgegebenen Möglichkeiten wählen. Es …

Weiterlesen …

Microsoft stellt Echtzeit-Transkription und mehrsprachige Sprachmodelle vor

Microsoft hat mit MAI-Transcribe-2-Streaming ein neues Modell für Live-Transkriptionen vorgestellt. Microsoft AI informiert in einem offiziellen Blogbeitrag über die neuen Modelle, zu denen auch die Sprachsynthese-Systeme MAI-Voice-2.1 und MAI-Voice-2.1-Flash gehören. MAI-Transcribe-2-Streaming verarbeitet gesprochene Sprache nach Angaben des Unternehmens in 60 Sprachen. Es soll die verwendete Sprache zudem fortlaufend automatisch erkennen. Das Modell wartet nicht bis …

Weiterlesen …

×