Microsoft und Ghost setzen auf neue Computer für lokale KI

Microsoft und das Start-up Ghost bringen neue, hochpreisige Computer auf den Markt, die KI-Modelle direkt auf dem Gerät ausführen sollen. Damit wächst das Angebot an Hardware, die weniger auf Rechenleistung aus der Cloud angewiesen ist. Microsoft nimmt Vorbestellungen für die Surface RTX Spark Dev Box entgegen. Der kompakte Entwicklerrechner kostet 5.999 Dollar und soll im …

Weiterlesen …

AWS veröffentlicht Strands Decider 2B als offene Alternative zu Jev

AWS hat mit Strands Decider 2B ein kostenloses Open-Source-Modell vorgestellt, das KI-Agenten bei klar abgegrenzten Entscheidungen unterstützen soll. Carl Franzen berichtet für VentureBeat, dass das Modell aus dem experimentellen AWS-Projekt Strands Labs für die Entwicklung von Agenten stammt. Strands Decider 2B ist kein Chatbot für ausführliche Antworten. Das Modell soll zwischen vorgegebenen Möglichkeiten wählen. Es …

Weiterlesen …

Aleph Alphas Kolibri ist ein offenes KI-Modell für Deutsch und Englisch

Aleph Alpha hat mit Kolibri ein Open-Weight-Sprachmodell für Deutsch und Englisch veröffentlicht. Das Unternehmen richtet das Modell an Behörden, Industrieunternehmen, Luftfahrtfirmen, Banken und andere Organisationen, die KI auf eigener Infrastruktur einsetzen wollen. Kolibri nutzt eine Mixture-of-Experts-Architektur. Das Modell besitzt insgesamt 78,1 Milliarden Parameter. Pro verarbeitetem Token, also einer Texteinheit, werden jedoch nur etwa 3,46 Milliarden …

Weiterlesen …

Fireworks stellt Ember-1 als sparsamere Alternative zu Kimi K3 vor

Fireworks AI hat mit Ember-1 ein spezialisiertes Reasoning-Modell vorgestellt, das Ergebnisse auf dem Niveau von Kimi K3 liefern und dabei deutlich weniger Tokens verbrauchen soll. Fireworks AI teilt in einem offiziellen Blogbeitrag mit, dass Ember-1 den gesamten Tokenverbrauch um rund 40 Prozent senkt. Das soll vor allem KI-gestützte Programmierung und mehrstufige Agenten-Workflows günstiger machen. Reasoning-Modelle …

Weiterlesen …

Clef gegen Jev: Cloudflare verspricht schnellere Entscheidungen für KI-Agenten

Cloudflare veröffentlicht mit Clef und Clef-flash zwei Modelle, die KI-Systeme bei klar umrissenen Entscheidungen unterstützen sollen. Die Modelle liefern keine frei formulierten Antworten wie ein Chatbot. Stattdessen geben sie strukturierte Ergebnisse für feste Fragen aus, etwa für Ja-Nein-Entscheidungen, Auswahlmöglichkeiten oder Rangfolgen. Cloudflare stellt die Modelle über Workers AI bereit und veröffentlicht die Modellgewichte unter der …

Weiterlesen …

Xiaomi veröffentlicht offene MiMo-V2.6-Modelle für KI-Agenten und mehr

Xiaomi hat zwei offene multimodale KI-Modelle veröffentlicht, die anspruchsvolle Agentenaufgaben zu deutlich niedrigeren Kosten als viele proprietäre Angebote übernehmen sollen. MiMo-V2.6-Pro und MiMo-V2.6-Flash verarbeiten Text, Bilder, Audio und Video. Sie unterstützen ein Kontextfenster von bis zu einer Million Tokens und richten sich an Aufgaben mit vielen Arbeitsschritten, etwa Programmierung, Recherche, Gestaltung und die Bedienung von …

Weiterlesen …

Qwen veröffentlicht Qwen-Image-2.1 mit Transparenz und Bildbearbeitung

Alibabas KI-Sparte Qwen hat Qwen-Image-2.1 veröffentlicht, ein Open-Weight-Modell für Bildgenerierung und Bildbearbeitung mit einer visuellen Komponente von 7 Milliarden Parametern. Qwen stellt das Modell in einem offiziellen Blogbeitrag vor und nennt Transparenz, Bearbeitung mehrerer Vorlagen und effizientere Berechnungen als zentrale Neuerungen. Das Modell soll Bilder nicht nur aus Texteingaben erzeugen. Es kann vorhandene Bilder verändern, …

Weiterlesen …

Mac Studio M5 Ultra und Mac mini M6 im Test: Zwei Optionen für lokale KI

Apple trennt seine Desktop-Modelle bei lokalen KI-Anwendungen künftig deutlicher. Der Mac Studio mit M5 Ultra bietet bis zu 512GB Unified Memory und kann damit sehr große KI-Modelle direkt vor Ort ausführen. Der kleinere Mac mini mit M6 liefert zwar viel Leistung für alltägliche Aufgaben, bleibt bei anspruchsvollen Anwendungen der generativen KI aber deutlich eingeschränkter. Die …

Weiterlesen …

IFA: Nvidia RTX Spark bringt lokale KI auf Laptops und Mini-PCs

Nvidias RTX-Spark-Chip kommt in Laptops und kompakte Desktop-PCs, die KI-Modelle direkt auf dem Gerät ausführen sollen. Die auf der IFA in Berlin vorgestellten Systeme richten sich an Menschen, die KI-Agenten und andere anspruchsvolle Anwendungen nutzen möchten, ohne vertrauliche Daten an Cloud-Dienste zu übertragen. Luke Larsen berichtet für WIRED, dass Lenovo, Dell, Asus, Microsoft, HP und …

Weiterlesen …

Im Test: Qwen3.8 27B erledigt lokale KI-Aufgaben zuverlässig, aber manchmal zu langsam

Das KI-Modell Qwen3.8 27B kann alltägliche Aufgaben lokal übernehmen, etwa Zusammenfassungen, die Ablage gescannter Dokumente und die Auswertung langer Forendiskussionen. Auf Apple-Hardware arbeitet es laut einem Praxistest jedoch deutlich langsamer als sein Vorgänger. Hemant Kumar schreibt bei TerminalBytes von Messungen auf einem Mac Studio mit M3 Ultra und 256GB gemeinsamem Speicher. Die Standardversion Q4_K_M von …

Weiterlesen …

×