PrismML bringt ein 27-Milliarden-Parameter-Modell aufs Smartphone

PrismML stellt mit Bonsai 27B ein komprimiertes Sprachmodell vor, das nach Angaben des Unternehmens erstmals ein Modell dieser Größenklasse auf einem Smartphone lauffähig macht. PrismML kündigt in einem offiziellen Blogbeitrag an, dass das auf Qwen3.6 27B basierende Modell trotz drastischer Verkleinerung Denkfähigkeit, Werkzeugnutzung und Bildverständnis behält. Bonsai 27B erscheint in zwei Varianten. Ternary Bonsai 27B …

Weiterlesen …

Moonshot AI veröffentlicht Kimi K3, das bislang größte Open-Source-KI-Modell

Das Pekinger Start-up Moonshot AI hat Kimi K3 veröffentlicht. Das Unternehmen bezeichnet das Modell in einem offiziellen Blogbeitrag als das weltweit erste offene KI-Modell der 3-Billionen-Parameter-Klasse. Kimi K3 hat 2,8 Billionen Parameter. Es basiert auf zwei neuen Architekturbausteinen: Kimi Delta Attention und Attention Residuals. Das Modell verfügt zudem über ein Kontextfenster von einer Million Tokens …

Weiterlesen …

Thinking Machines veröffentlicht Inkling, ein quelloffenes multimodales KI-Modell

Das KI-Start-up Thinking Machines von Mira Murati, der früheren technischen Leiterin von OpenAI, veröffentlicht sein erstes großes Sprachmodell unter einer Open-Source-Lizenz. Carl Franzen berichtet für VentureBeat, dass sich das Modell namens Inkling an Unternehmen richtet, die KI auf eigenen Servern betreiben und dabei Kosten sparen wollen. Zudem soll das Modell ideologische Filterung vermeiden. Auch das …

Weiterlesen …

Rowboat bringt lokal arbeitenden KI-Kollegen auf den Desktop

Ein neues Open-Source-Tool namens Rowboat will KI-Assistenten in einen vollwertigen Arbeitsraum verwandeln, statt sie nur als Chatfenster anzubieten. Der Entwickler, der unter dem Namen segmenta auftritt, stellt das Projekt in einem Show-HN-Beitrag auf Hacker News vor und beschreibt es als lokal arbeitende Alternative zu Claude Desktop. Das Team hinter Rowboat entwickelte zuvor KI-Werkzeuge für Support-Teams …

Weiterlesen …

Warum winzige KI-Modelle manchmal mehr leisten als große Chatbots

2019 erlebte der nigerianische Unternehmer Adebayo Alonge ein technisches Debakel bei einer Produktvorführung in Kapstadt: Sein KI-gestützter Pillenscanner musste ein Rechenzentrum 14.000 Kilometer entfernt erreichen, aber die Verbindung war viel zu langsam. David Berreby berichtet für IEEE Spectrum, dass dieser Vorfall Alonge dazu brachte, sein KI-Modell innerhalb weniger Stunden zu verkleinern. Danach lief es direkt …

Weiterlesen …

Halb so groß, keine Lizenzfallen: Tencents Hy3 fordert GLM-5.2 heraus

Tencent hat die finale Version seines Sprachmodells Hy3 veröffentlicht. Neu ist die Lizenz: Apache 2.0, ohne regionale Einschränkungen. Sam Witteveen berichtet für VentureBeat, dass frühere Versionen Nutzer aus der EU, Großbritannien und Südkorea ausschlossen. Genau diese Änderung sorgt für die größte Resonanz in der Open-Source-Community. Hy3 ist ein Mixture-of-Experts-Modell mit 295 Milliarden Parametern, von denen …

Weiterlesen …

GPT-NL: Niederlande entwickeln KI-Sprachmodell und wollen Abhängigkeit von US-Konzernen verringern

Die Niederlande entwickeln ein eigenes großes Sprachmodell, das unabhängig von amerikanischen KI-Anbietern betrieben werden soll. TNO schreibt, dass das Projekt unter dem Namen GPT-NL vom Forschungsinstitut TNO gemeinsam mit SURF und dem Niederländischen Forensischen Institut (NFI) umgesetzt wird. Die niederländische Regierung stellt dafür 13,5 Millionen Euro über die Niederländische Unternehmensagentur bereit. Ziel des Projekts ist …

Weiterlesen …

Google DiffusionGemma ist bis zu viermal schneller als herkömmliche Sprachmodelle

Google hat DiffusionGemma veröffentlicht, ein experimentelles KI-Modell mit einem grundlegend anderen Ansatz zur Textgenerierung. Brendan O’Donoghue und Sebastian Flennerhag schreiben im Google-Blog „The Keyword“, dass das Modell auf dedizierten GPUs bis zu viermal schneller Text erzeugt als herkömmliche große Sprachmodelle. Es steht unter einer Apache-2.0-Lizenz zur freien Verfügung. Klassische Sprachmodelle arbeiten wie eine Schreibmaschine: Sie …

Weiterlesen …

Odysseus will ChatGPT und Claude auf dem Heimserver ersetzen

Odysseus ist ein neues Open-Source-Projekt, das einen vollständigen KI-Arbeitsbereich auf eigener Hardware ermöglicht. Entwickler pewdiepie-archdaemon veröffentlicht das Projekt auf GitHub als selbst gehostete Alternative zu kommerziellen KI-Oberflächen wie ChatGPT und Claude. Der Fokus liegt auf Datenschutz und lokaler Datenhaltung. Und, ja: Dahinter steht tatsächlich YouTube-Promi PewDiePie. Die Anwendung bündelt viele Funktionen in einer einzigen Oberfläche. …

Weiterlesen …

×