Google Gemini Spark: Ein KI-Agent, der rund um die Uhr arbeitet

Google hat auf seiner jährlichen Entwicklerkonferenz I/O den KI-Agenten Gemini Spark vorgestellt. Das System läuft dauerhaft in der Cloud und erledigt Aufgaben, ohne dass Nutzer aktiv eingreifen müssen. Spark basiert auf dem Modell Gemini 3.5 Flash und ist direkt mit Google-Workspace-Diensten wie Gmail, Docs und Slides verbunden. Nutzer können dem Agenten Aufgaben übertragen, etwa das …

Weiterlesen …

Gemini Omni: Bild, Ton und Video in einem einzigen Modell

Google hat Gemini Omni vorgestellt, ein neues KI-Modell, das Text, Bilder, Audio und Video als Eingabe akzeptiert und daraus Videos erstellt. Das Unternehmen beschreibt es als nativ multimodal: Ein einziges Modell verarbeitet alle Inhaltstypen, ohne Aufgaben an separate Systeme weiterzugeben. Das erste Modell der Familie, Gemini Omni Flash, ist jetzt für Abonnenten der Google-Pläne AI …

Weiterlesen …

Google Gemini 3.5 Flash: Schneller denken und weniger zahlen

Google hat Gemini 3.5 Flash vorgestellt. Das neue Modell für künstliche Intelligenz soll komplexe Aufgaben schnell und kostengünstig erledigen. Bisher mussten sich Unternehmen oft zwischen schnellen, günstigen Modellen und langsameren, leistungsfähigeren Systemen entscheiden. Dieses Problem möchte Google mit der Neuvorstellung lösen. Nach Angaben von Google übertrifft das neue Modell das bisherige Flaggschiff Gemini 3.1 Pro …

Weiterlesen …

Google gestaltet seine Suchleiste zum ersten Mal seit 25 Jahren um

Google hat seine Suchleiste zum ersten Mal seit 2001 grundlegend überarbeitet. Das Unternehmen stellte die Änderungen auf seiner jährlichen Entwicklerkonferenz I/O in Mountain View, Kalifornien, vor. Die neue Oberfläche nimmt längere, gesprächsartige Anfragen entgegen und unterstützt Eingaben wie Bilder, Videos, PDFs und Inhalte aus Chrome-Tabs. Viele dieser Funktionen waren bisher nur über einen separaten Bereich …

Weiterlesen …

Alexa+ produziert Podcasts nach Wunsch mit KI

Amazon hat seinen KI-Sprachassistenten Alexa+ um eine Podcast-Funktion erweitert. Todd Spangler berichtet für Variety, dass das neue Feature namens Alexa Podcasts Audioepisoden vollständig durch künstliche Intelligenz erstellt, mit zwei synthetischen Stimmen als Gastgeber. Nutzer nennen Alexa+ per Sprache ein gewünschtes Thema. Der Assistent erstellt daraufhin eine Übersicht des geplanten Inhalts. Länge und Schwerpunkte lassen sich …

Weiterlesen …

Thinking Machines zeigt KI-Modell, das in Echtzeit zuhört und antwortet

Das KI-Unternehmen Thinking Machines, mitgegründet von der früheren OpenAI-Technikchefin Mira Murati, hat eine Forschungsvorschau sogenannter „Interaction Models“ veröffentlicht. Diese KI-Systeme sollen in Echtzeit wahrnehmen und antworten, anstatt auf das Ende einer Eingabe zu warten. Bisherige KI-Modelle arbeiten im Wechsel: Der Nutzer schickt eine Eingabe, das Modell verarbeitet sie und antwortet. Thinking Machines sieht darin eine …

Weiterlesen …

Claude for Small Business: Tool-Integrationen und kostenloses Training für KMU

Anthropic hat Claude for Small Business gestartet. Das Produkt ist ein Paket aus Software-Integrationen und vorgefertigten Arbeitsabläufen, das den KI-Assistenten Claude in den Alltag kleiner und mittlerer Unternehmen bringen soll. Es läuft innerhalb von Claude Cowork, der Automatisierungsplattform von Anthropic, und verbindet sich mit Tools, die Kleinunternehmen oftmals bereits nutzen. Das Paket umfasst Integrationen mit …

Weiterlesen …

Google bringt KI-Automatisierung und Kreativfunktionen zu Android 17

Google hat eine Reihe neuer Funktionen für Android 17 angekündigt und mehrere KI-Fähigkeiten unter dem Namen Gemini Intelligence zusammengefasst. Die Funktionen sollen Nutzern helfen, alltägliche Aufgaben mit weniger manuellem Aufwand zu erledigen. Laut Google beginnt der Rollout von Gemini Intelligence zunächst auf Samsung-Galaxy- und Google-Pixel-Smartphones. Weitere Geräte wie Uhren, Autos, Brillen und Laptops sollen im …

Weiterlesen …

OpenAI: Neue Modelle für Reasoning, Übersetzung und Transkription in der Sprach-API

OpenAI hat drei neue Audio-Sprachmodelle über seine Realtime API veröffentlicht. Jedes Modell erfüllt eine andere Aufgabe: Reasoning, Übersetzung und Transkription. Das erste Modell, GPT-Realtime-2, bringt Reasoning auf GPT-5-Niveau in Live-Gespräche. Laut OpenAI kann es komplexe Anfragen bearbeiten, Unterbrechungen verarbeiten und externe Tools aufrufen, ohne den Gesprächsfluss zu unterbrechen. Das zweite Modell, GPT-Realtime-Translate, übersetzt gesprochene Sprache …

Weiterlesen …

Google arbeitet an neuem KI-Agenten namens Remy

Google entwickelt einen neuen KI-Agenten für seine Gemini-Plattform. Der Agent soll eigenständig Aufgaben für Nutzer erledigen. Hilary Langley berichtet für Business Insider, dass das Projekt intern „Remy“ heißt und derzeit von Google-Mitarbeitern getestet wird. Laut einem internen Dokument, das Business Insider vorliegt, läuft Remy in einer mitarbeiterexklusiven Version der Gemini-App. Der Agent ist mit verschiedenen …

Weiterlesen …

×