Xiaomi veröffentlicht offene MiMo-V2.6-Modelle für KI-Agenten und mehr

Xiaomi hat zwei offene multimodale KI-Modelle veröffentlicht, die anspruchsvolle Agentenaufgaben zu deutlich niedrigeren Kosten als viele proprietäre Angebote übernehmen sollen. MiMo-V2.6-Pro und MiMo-V2.6-Flash verarbeiten Text, Bilder, Audio und Video. Sie unterstützen ein Kontextfenster von bis zu einer Million Tokens und richten sich an Aufgaben mit vielen Arbeitsschritten, etwa Programmierung, Recherche, Gestaltung und die Bedienung von …

Weiterlesen …

Tencent bringt dialogbasierte Bildbearbeitung in Hy Image 3.5 Preview

Tencent veröffentlicht mit Hy Image 3.5 Preview eine Bild-KI, die Bearbeitungen über mehrere Gesprächsschritte hinweg fortführen kann. Die API kostet laut Tencent 0,024 US-Dollar pro erzeugtem Bild und verarbeitet Textanweisungen, Referenzbilder sowie aufeinanderfolgende Änderungen. Ryan Merket berichtet für RuntimeWire, dass Tencent damit vor allem Anwendungen für iterative kreative Arbeit ansprechen will. Bei Hy Image 3.5 …

Weiterlesen …

Anthropic baut Claude Projects für parallele Arbeitsabläufe um

Anthropic erweitert seine Projects-Funktion in Claude Code: Nutzer sollen ein übergeordnetes Arbeitsziel in einem Chat formulieren können, während Claude die Aufgaben auf mehrere parallele Threads verteilt. Anthropic kündigt dies in einem offiziellen Beitrag im Claude-Blog an. Die überarbeitete Funktion startet zunächst als Beta für ausgewählte Pro- und Max-Abonnenten mit Cloud-Sitzungen in Claude Code. Im Zentrum …

Weiterlesen …

Google stellt Gemini 3.8 Live für Sprachassistenten vor

Google bringt mit Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking zwei neue KI-Modelle für gesprochene Gespräche, Sprachassistenten und Aufgaben mit Bildverständnis und Werkzeugaufrufen auf den Markt. Tom Ouyang und Malini Jaganathan stellen die Modelle im offiziellen Blog von Google vor. Gemini 3.8 Live richtet sich laut Google an Anwendungen, die viele Gespräche effizient …

Weiterlesen …

Qwen veröffentlicht Qwen-Image-2.1 mit Transparenz und Bildbearbeitung

Alibabas KI-Sparte Qwen hat Qwen-Image-2.1 veröffentlicht, ein Open-Weight-Modell für Bildgenerierung und Bildbearbeitung mit einer visuellen Komponente von 7 Milliarden Parametern. Qwen stellt das Modell in einem offiziellen Blogbeitrag vor und nennt Transparenz, Bearbeitung mehrerer Vorlagen und effizientere Berechnungen als zentrale Neuerungen. Das Modell soll Bilder nicht nur aus Texteingaben erzeugen. Es kann vorhandene Bilder verändern, …

Weiterlesen …

OpenAI holt GPT-6 mit Sol und Luna aus der High-End-Nische

OpenAI stellt mit GPT-6 Sol und GPT-6 Luna zwei günstigere Modelle für professionelle Aufgaben, Softwareentwicklung und KI-Agenten vor. Nach Angaben des Unternehmens basieren beide Modelle auf ähnlichen Trainingsmethoden wie das Spitzenmodell GPT-6 Astra. Gleichzeitig sinken die API-Preise gegenüber den Aktionspreisen der Vorgängermodelle GPT-5.6 um rund 50 Prozent. GPT-6 Sol kostet für Entwickler 2 US-Dollar pro …

Weiterlesen …

Claude Opus 5.5 liefert Spitzenleistung deutlich günstiger

Anthropic hat mit Claude Opus 5.5 ein neues Spitzenmodell veröffentlicht. Nach Angaben des Unternehmens erreicht es bei den meisten Aufgaben annähernd das Niveau von Claude Fable 5.1. Gegenüber Opus 5 sollen die typischen Betriebskosten zugleich um 40 Prozent sinken. Das Modell verbindet niedrigere Preise, schnellere Antworten und zusätzliche Kontrollen für riskante Anfragen. Claude Opus 5.5 …

Weiterlesen …

Mac Studio M5 Ultra und Mac mini M6 im Test: Zwei Optionen für lokale KI

Apple trennt seine Desktop-Modelle bei lokalen KI-Anwendungen künftig deutlicher. Der Mac Studio mit M5 Ultra bietet bis zu 512GB Unified Memory und kann damit sehr große KI-Modelle direkt vor Ort ausführen. Der kleinere Mac mini mit M6 liefert zwar viel Leistung für alltägliche Aufgaben, bleibt bei anspruchsvollen Anwendungen der generativen KI aber deutlich eingeschränkter. Die …

Weiterlesen …

ChatGPT Images 2.5 bringt Skizzen, Bildkommentare und kürzere Wartezeiten

OpenAI veröffentlicht ChatGPT Images 2.5, eine neue Version seines Systems zur Bildgenerierung und Bildbearbeitung. Nach Angaben des Unternehmens sollen Bilder schneller entstehen, Vorlagen besser wiedererkannt werden und gezielte Änderungen zuverlässiger gelingen. Neu sind außerdem Werkzeuge zum Zeichnen, Kommentieren und Vorbereiten gängiger Bildformate. OpenAI zufolge sinkt die Wartezeit bei der Bildgenerierung gegenüber Images 2.0 um bis …

Weiterlesen …

Meta startet Muse, einen persönlichen KI-Agenten für Alltagsaufgaben

Meta hat mit Muse einen persönlichen KI-Agenten vorgestellt, der Aufgaben selbstständig erledigen soll. Dazu gehören etwa Terminbuchungen, Ticketkäufe, Online-Formulare und die Organisation persönlicher Informationen. Das Angebot richtet sich zunächst an volljährige Nutzerinnen und Nutzer in den USA und ist für iOS, Android, im Web, über WhatsApp sowie inzwischen auch als Mac-App verfügbar. Muse soll mehr …

Weiterlesen …

×