Dieser neue KI-Agent von Microsoft schlägt GPT-4o und schützt deine Daten

Microsoft hat mit Fara-7B einen neuen KI-Agenten vorgestellt, der komplexe Aufgaben direkt auf dem Computer des Nutzers ausführen kann. Das Modell ist klein genug, um lokal zu laufen. Dies erhöht die Datensicherheit und den Datenschutz, da sensible Informationen das Gerät nicht verlassen. Wie Ben Dickson für VentureBeat berichtet, bedient der Agent den Computer, indem er …

Weiterlesen …

Black Forest Labs FLUX.2 ist eine KI für professionelle Bilderzeugung

Das deutsche KI-Start-up Black Forest Labs, gegründet von den Entwicklern von Stable Diffusion, hat FLUX.2 vorgestellt. Das ist eine neue Familie von KI-Modellen zur Erzeugung und Bearbeitung von Bildern. Laut Unternehmensangaben ist das System für professionelle kreative Arbeitsabläufe konzipiert. Ziel sind Zuverlässigkeit und Kontrolle statt einmaliger Demonstrationen. FLUX.2 führt mehrere wichtige Verbesserungen gegenüber seinem Vorgänger …

Weiterlesen …

Kimi K2 Thinking: Neues Open Source KI-Modell erreicht Leistung führender kommerzieller Systeme

Ein neues Open Source KI-Modell des chinesischen Startups Moonshot AI hat die Leistung führender kommerzieller Systeme erreicht oder übertroffen. Das betrifft OpenAI’s GPT-5 und Anthropic’s Claude Sonnet 4.5 in mehreren Leistungstests. Carl Franzen berichtet für VentureBeat, dass das Kimi K2 Thinking Modell 44,9 Prozent bei Humanity’s Last Exam erreichte. Bei BrowseComp waren es 60,2 Prozent …

Weiterlesen …

IBMs neue KI-Modelle sind klein genug für Laptops und Browser

IBM hat vier neue KI-Modelle vorgestellt, die klein genug sind, um auf einem normalen Laptop oder sogar in einem Webbrowser zu laufen. Carl Franzen berichtet für VentureBeat, dass diese „Granite 4.0 Nano“ genannten Modelle einen Wandel in der KI-Entwicklung anzeigen. Effizienz wird hier über schiere Größe gestellt. Die Modelle sind Open Source und unter der …

Weiterlesen …

Neues KI-Modell Qwen3-VL soll sehen, verstehen und handeln

Das QwenTeam hat eine neue Serie quelloffener Vision-Language-Modelle namens Qwen3-VL veröffentlicht. Laut der offiziellen Ankündigung sollen die Modelle nicht nur Bilder und Videos erkennen, sondern auch Kontexte verstehen, logisch schlussfolgern und Aktionen ausführen. Das Spitzenmodell der Reihe, Qwen3-VL-235B-A22B, wird in zwei Versionen angeboten. Die Entwickler berichten, dass die „Instruct“-Version in wichtigen Tests zur visuellen Wahrnehmung …

Weiterlesen …

Qwen3-Omni ist ein Open-Source-Modell für Text, Bild, Audio und Video

Das chinesische Technologieunternehmen Alibaba hat Qwen3-Omni veröffentlicht. Es ist ein neues generatives KI-Modell, das eine Kombination aus Text, Bildern, Audio und Video verarbeiten kann. Das Modell zeichnet sich durch seine „omni-modalen“ Fähigkeiten und seine Open-Source-Lizenz aus. Damit positioniert es sich als direkter Konkurrent zu proprietären Modellen von US-Technologiekonzernen wie OpenAI und Google. Nach von Alibaba …

Weiterlesen …

Alibaba stellt neue effiziente KI-Modellarchitektur vor

Alibaba hat eine neue Generation von KI-Modellen namens Qwen3-Next vorgestellt, die auf hohe Leistung bei geringem Rechenaufwand ausgelegt ist. Crystal Liu schreibt für Alibaba, dass die neue Architektur dies durch mehrere Innovationen erreicht. Das erste Modell der Serie, Qwen3-Next-80B, ist ab sofort als Open Source verfügbar. Laut dem Unternehmen aktiviert dieses Modell mit 80 Milliarden …

Weiterlesen …

Schweiz startet Open-Source-KI-Modell Apertus als transparente ChatGPT-Alternative

Die Schweiz steigt mit Apertus in das KI-Rennen ein. Das neue Open-Source Large Language Model wurde von führenden Schweizer Universitäten entwickelt und soll eine transparente Alternative zu kommerziellen KI-Systemen wie ChatGPT und Metas Llama bieten. Apertus, lateinisch für „offen“, entstand durch die Zusammenarbeit der ETH Lausanne (EPFL), ETH Zürich und des Swiss National Supercomputing Centre. …

Weiterlesen …

Tencent stellt KI-Modell vor, das aus Fotos navigierbare 3D-Videos erstellt

Der chinesische Technologiekonzern Tencent hat HunyuanWorld-Voyager veröffentlicht, ein KI-Modell, das statische Bilder in navigierbare 3D-ähnliche Videosequenzen verwandelt. Benj Edwards von Ars Technica berichtet über die Ankündigung. Das System erzeugt aus einem einzigen Foto 49-Frame-Videoclips von etwa zwei Sekunden Länge. Nutzer können Kamerabewegungen wie Vorwärts-, Rückwärts- und Drehbewegungen definieren, um virtuelle Szenen zu erkunden. Mehrere Clips …

Weiterlesen …

Hermes 4 ist ein frei verfügbarer ChatGPT-Konkurrent

Das Startup Nous Research hat Hermes 4 veröffentlicht, eine Familie von KI-Sprachmodellen, die nach Firmenangaben die Leistung führender kommerzieller Angebote erreicht. Gleichzeitig verzichtet das System auf die meisten Inhaltsbeschränkungen. Michael Nuñez berichtet für VentureBeat über die Veröffentlichung. Anders als ChatGPT oder Claude antwortet Hermes 4 auf nahezu jede Anfrage. Das System verzichtet auf Sicherheitsvorkehrungen, die …

Weiterlesen …

×