Mistral Small 4 vereint Reasoning, Bildverarbeitung und Coding

Mistral AI hat das neue Sprachmodell Mistral Small 4 veröffentlicht. Es vereint Reasoning, multimodale Verarbeitung und Programmierfähigkeiten in einem einzigen System. Das Unternehmen erklärt, dass Nutzer deshalb nicht mehr zwischen verschiedenen spezialisierten Modellen wechseln müssen. Das Modell basiert auf einer sogenannten Mixture-of-Experts-Architektur mit 128 Spezialisten. Pro verarbeitetem Textabschnitt sind jeweils vier davon aktiv. Diese Methode …

Weiterlesen …

Denken nur wenn nötig: Microsofts neue KI weiß, wann sie sich die Mühe sparen kann

Microsoft hat das KI-Modell Phi-4-reasoning-vision-15B veröffentlicht. Es verarbeitet sowohl Bilder als auch Text und kann komplexe Mathematik- und Wissenschaftsaufgaben lösen. Michael Nuñez berichtet für VentureBeat, dass das Modell mit 15 Milliarden Parametern deutlich größere Systeme in vielen Bereichen einholt oder übertrifft. Der Rechenaufwand und der Bedarf an Trainingsdaten sind dabei deutlich geringer. Das Modell ist …

Weiterlesen …

Alibaba veröffentlicht neue Qwen3.5-Modelle für Laptops und Smartphones

Alibabas Forschungsteam hat zwei neue Serien von Open-Source-KI-Modellen veröffentlicht, die auf Consumer-Hardware laufen, vom Desktop-PC bis zum Smartphone. Die Modelle umfassen eine Spanne von 0,8 bis 122 Milliarden Parametern und sind kostenlos unter der Apache-2.0-Lizenz auf Hugging Face und ModelScope verfügbar. Die größere Qwen3.5-Medium-Serie enthält vier Modelle. Das Hauptmodell, Qwen3.5-35B-A3B, nutzt ein Verfahren namens Mixture-of-Experts. …

Weiterlesen …

MiniMax veröffentlicht KI-Modell M2.5 zu einem Bruchteil der Konkurrenzpreise

Das chinesische KI-Unternehmen MiniMax hat M2.5 veröffentlicht, ein neues großes Sprachmodell, das laut Unternehmensangaben mit Spitzenmodellen von Anthropic und Google mithalten soll — zu deutlich niedrigeren Kosten. MiniMax bietet zwei Versionen über seine API an. M2.5-Lightning verarbeitet 100 Token pro Sekunde und kostet 0,30 Dollar pro Million Eingabe-Token und 2,40 Dollar pro Million Ausgabe-Token. Das …

Weiterlesen …

Mistral veröffentlicht Voxtral Transcribe 2: Transkription direkt auf dem Handy

Mistral AI hat Voxtral Transcribe 2 veröffentlicht, eine Familie von Speech-to-Text-Modellen für Batch-Verarbeitung und Echtzeit-Transkription. Das Unternehmen positioniert die Technologie als präziser und deutlich günstiger als konkurrierende Services und ermöglicht gleichzeitig lokale Verarbeitung für sensible Daten. Die Veröffentlichung umfasst zwei Modelle. Voxtral Mini Transcribe V2 verarbeitet voraufgezeichnete Audiodateien für $0.003 pro Minute, was laut Mistral …

Weiterlesen …

OpenClaw: Dieser KI-Assistent kann sich selbst verbessern und steuert dein digitales Leben

Ein quelloffener KI-Assistent namens OpenClaw zeigt, wie künftige digitale Helfer funktionieren könnten. Das System war bis vor Kurzem als Clawdbot und Moltbot bekannt und arbeitet vollständig auf dem eigenen Computer und bietet umfassende Anpassungsmöglichkeiten. Federico Viticci schreibt bei MacStories, dass das Projekt die Nutzung leistungsstarker Sprachmodelle über vertraute Messenger-Apps wie Telegram oder iMessage ermöglicht. Der …

Weiterlesen …

Black Forest Labs: Neue Modelle erzeugen Bilder in weniger als einer Sekunde

Black Forest Labs hat eine neue Serie von KI-Bildgeneratoren namens FLUX.2 [klein] vorgestellt. Diese Modellfamilie setzt auf hohe Geschwindigkeit und geringe Hardwareanforderungen. Das Unternehmen gibt an, dass die Modelle die Erzeugung und Bearbeitung von Bildern in einer einzigen Architektur vereinen. Laut der Ankündigung erstellen die Systeme Bilder auf moderner Hardware in weniger als einer Sekunde. …

Weiterlesen …

Open Source Modell GLM Image schlägt Googles Bild-KI bei Textdarstellung

Ein neues Open Source Modell setzt Maßstäbe bei der Erstellung von komplexen Grafiken mit viel Text. Die Software GLM Image des Startups Z.ai übertrifft in Tests sogar die Leistung von Googles Nano Banana Pro. Carl Franzen berichtet für VentureBeat über die wachsende Konkurrenz für den Tech Riesen aus den USA. GLM Image nutzt eine Architektur …

Weiterlesen …

Qwen-Image-2512: Neues KI-Modell fordert Google mit fotorealistischen Bildern heraus

Das Qwen-Team von Alibaba hat Qwen-Image-2512 veröffentlicht. Dieses Update verbessert das bestehende Basismodell zur Erzeugung von Bildern aus Text. Das Modell steht nun für die öffentliche Nutzung und für Unternehmen zur Verfügung. Laut den Entwicklern konzentriert sich diese Version auf drei Bereiche: menschlichen Realismus, natürliche Details und die Darstellung von Text. Das Modell soll das …

Weiterlesen …

Mistral AI veröffentlicht 10 Open-Source-Modelle für lokale KI und Unternehmenseinsatz

Mistral AI hat Mistral 3 veröffentlicht, eine Sammlung von 10 Open-Source-Modellen für künstliche Intelligenz. Die Modelle laufen auf Geräten vom Smartphone bis zu Cloud-Systemen für Unternehmen. Das französische Startup hat alle Modelle unter der Apache 2.0-Lizenz veröffentlicht, die kommerzielle Nutzung ohne Einschränkungen erlaubt. Die Veröffentlichung umfasst Mistral Large 3, das Flaggschiff-Modell des Unternehmens, und die …

Weiterlesen …

×