Black Forest Labs FLUX 3 ist ein multimodales Modell für Bild und Video

Das deutsche Startup Black Forest Labs hat mit FLUX 3 ein neues KI-Modell vorgestellt. Es soll Bilder sowie Videos mit passendem Ton erzeugen und zugleich als Grundlage für Robotik dienen. Zunächst gibt das Unternehmen den Zugang nur im Rahmen eines genehmigungspflichtigen Frühzugangs frei. Nach Angaben von Black Forest Labs erstellt FLUX 3 Video aus einer …

Weiterlesen …

Claudes Sprachmodus kann jetzt auch Opus und Sonnet nutzen

Anthropic erweitert den Sprachmodus von Claude um die leistungsfähigeren Modelle Opus und Sonnet. Neben dem schnelleren Haiku stehen sie nun für längere und anspruchsvollere Gespräche zur Verfügung. Das soll etwa bei Kundenterminen, Präsentationen oder schwierigen Entscheidungen helfen. Nutzer können das Modell während eines Gesprächs wechseln. Alternativ übernimmt Claude das zuletzt im Textchat verwendete Modell. Anthropic …

Weiterlesen …

Kimi Work fordert Claude Cowork und ChatGPT Work heraus

Kimi hat mit Kimi Work eine Desktop-Anwendung für macOS und Windows vorgestellt. Sie verbindet KI-Chat mit Zugriff auf lokale Dateien, Browser-Automatisierung und geplanten Aufgaben. Kimi stellt das Produkt in einem offiziellen Blogbeitrag vor und beschreibt es als Werkzeug für längere Arbeitsabläufe, die fertige Dateien, Berichte oder Code liefern sollen. Nach Angaben des Unternehmens kann Kimi …

Weiterlesen …

Qwen Image 3.0: Lange Prompts und bessere Texterzeugung

Qwen hat mit Qwen-Image-3.0 ein neues Modell zur Bildgenerierung vorgestellt. Es soll umfangreiche Bildinhalte, sehr kleine Schrift und realistische Oberflächen besser erzeugen können. QwenTeam kündigt das Modell in einem offiziellen Blogbeitrag von Qwen an und beschreibt den Anspruch, KI-Bilder stärker für praktische Arbeitsabläufe nutzbar zu machen. Nach Angaben des Unternehmens verarbeitet Qwen-Image-3.0 Anweisungen mit bis …

Weiterlesen …

Google stellt Gemini 3.6 Flash und „Cyber“-Modell vor

Google erweitert die Gemini-Familie um zwei preisgünstigere Allround-Modelle und ein spezialisiertes System für Cybersicherheit. Das Sicherheitsmodell steht zunächst nur Regierungen und ausgewählten vertrauenswürdigen Partnern zur Verfügung. Mit den neuen Angeboten setzt Google auf niedrigere Kosten, hohe Geschwindigkeit und einen effizienteren Betrieb von KI-Anwendungen. Das leistungsstärkste neue frei verfügbare Modell heißt Gemini 3.6 Flash. Es soll …

Weiterlesen …

Alibaba zeigt mit Qwen3.8 Max ein neues Spitzenmodell

Alibaba hat eine Vorschau auf Qwen3.8 Max veröffentlicht. Das neue Spitzenmodell der KI-Sparte Qwen soll mit den leistungsfähigsten KI-Systemen auf dem Markt konkurrieren. Bloomberg News berichtet, Alibaba ordne Qwen3.8 Max hinter Anthropic Fable 5 ein. Entwickler können die Vorabversion über Alibabas Programmierplattformen nutzen, darunter Qoder. Nach Angaben des Unternehmens verfügt das Modell über 2,4 Billionen …

Weiterlesen …

Google Vids erhält persönliche KI Avatare und Gemini Omni

Google baut Vids zu einer umfassenderen Plattform für die Videoproduktion aus. Neu ist vor allem die Möglichkeit, einen persönlichen KI-Avatar zu erstellen, der dem Nutzer ähnlich sieht und auch so klingt. Sarah Perez berichtet für TechCrunch, dass Google Vids dafür ein hochgeladenes Selfie und eine Sprachaufnahme verwendet. Der Avatar kann anschließend in KI-erzeugten Videos auftreten. …

Weiterlesen …

Wie Claude Code zum Produktivitätssystem für Nicht-Programmierer wird

Anthropics Coding-Assistent Claude Code findet ein unerwartetes Publikum: Menschen, die nie eine Zeile Code schreiben. Nolen Jonker schreibt für XDA Developers, dass das Tool in diesem Jahr zur persönlich meistgenutzten Produktivitäts-App wurde. Der Trick: Claude Code auf einen unaufgeräumten Ordner richten statt auf eine Codebasis. Die Idee dahinter ist simpel. Jonker organisiert persönliche Notizen seit …

Weiterlesen …

PrismML bringt ein 27-Milliarden-Parameter-Modell aufs Smartphone

PrismML stellt mit Bonsai 27B ein komprimiertes Sprachmodell vor, das nach Angaben des Unternehmens erstmals ein Modell dieser Größenklasse auf einem Smartphone lauffähig macht. PrismML kündigt in einem offiziellen Blogbeitrag an, dass das auf Qwen3.6 27B basierende Modell trotz drastischer Verkleinerung Denkfähigkeit, Werkzeugnutzung und Bildverständnis behält. Bonsai 27B erscheint in zwei Varianten. Ternary Bonsai 27B …

Weiterlesen …

Soofi S: Deutsches KI-Konsortium veröffentlicht offenes 30B-Modell mit Bestwerten auf Englisch und Deutsch

Ein deutsches Forschungskonsortium hat mit Soofi S ein offenes Sprachmodell veröffentlicht. Es wurde vollständig auf der KI-Cloud-Infrastruktur der Deutschen Telekom in München trainiert. Jonathan Kemper berichtet für The Decoder, dass das 30B-Modell unter den offenen Modellen die besten Werte auf Englisch und Deutsch erreicht. Es übertrifft dabei OLMo 3 32B und Apertus 70B. Effizient durch …

Weiterlesen …

×