Jetzt verfügbar: Qwen3.8-Max soll tagelang selbstständig arbeiten

Qwen stellt sein Modell Qwen3.8-Max allgemein über QwenCloud bereit und bezeichnet es als das bisher leistungsfähigste Modell der eigenen Familie. Qwen kündigt im offiziellen Blog an, dass das Modell 2,4 Billionen Parameter besitzt. Davon sind nach Unternehmensangaben 95 Milliarden Parameter aktiv. Die offenen Modellgewichte sollen in der kommenden Woche folgen. Qwen3.8-Max baut laut Qwen auf …

Weiterlesen …

Thinking Machines Inkling-Small soll KI-Kosten senken, ohne zu viele Fähigkeiten einzubüßen

Thinking Machines Lab hat Inkling-Small veröffentlicht, ein offenes KI-Modell mit deutlich geringerem Rechenbedarf als das bisherige Modell Inkling. Nach Angaben des Unternehmens erreicht Inkling-Small bei Reasoning, Programmieraufgaben und multimodalen Anwendungen in vielen Fällen ein ähnliches Niveau wie das wesentlich größere Schwestermodell. Inkling-Small besitzt insgesamt 276 Milliarden Parameter. Bei der Verarbeitung eines Tokens sind davon 12 …

Weiterlesen …

Black Forest Labs FLUX 3 ist ein multimodales Modell für Bild und Video

Das deutsche Startup Black Forest Labs hat mit FLUX 3 ein neues KI-Modell vorgestellt. Es soll Bilder sowie Videos mit passendem Ton erzeugen und zugleich als Grundlage für Robotik dienen. Zunächst gibt das Unternehmen den Zugang nur im Rahmen eines genehmigungspflichtigen Frühzugangs frei. Nach Angaben von Black Forest Labs erstellt FLUX 3 Video aus einer …

Weiterlesen …

Thinking Machines veröffentlicht Inkling, ein quelloffenes multimodales KI-Modell

Das KI-Start-up Thinking Machines von Mira Murati, der früheren technischen Leiterin von OpenAI, veröffentlicht sein erstes großes Sprachmodell unter einer Open-Source-Lizenz. Carl Franzen berichtet für VentureBeat, dass sich das Modell namens Inkling an Unternehmen richtet, die KI auf eigenen Servern betreiben und dabei Kosten sparen wollen. Zudem soll das Modell ideologische Filterung vermeiden. Auch das …

Weiterlesen …

Gemini Omni: Bild, Ton und Video in einem einzigen Modell

Google hat Gemini Omni vorgestellt, ein neues KI-Modell, das Text, Bilder, Audio und Video als Eingabe akzeptiert und daraus Videos erstellt. Das Unternehmen beschreibt es als nativ multimodal: Ein einziges Modell verarbeitet alle Inhaltstypen, ohne Aufgaben an separate Systeme weiterzugeben. Das erste Modell der Familie, Gemini Omni Flash, ist jetzt für Abonnenten der Google-Pläne AI …

Weiterlesen …

Thinking Machines zeigt KI-Modell, das in Echtzeit zuhört und antwortet

Das KI-Unternehmen Thinking Machines, mitgegründet von der früheren OpenAI-Technikchefin Mira Murati, hat eine Forschungsvorschau sogenannter „Interaction Models“ veröffentlicht. Diese KI-Systeme sollen in Echtzeit wahrnehmen und antworten, anstatt auf das Ende einer Eingabe zu warten. Bisherige KI-Modelle arbeiten im Wechsel: Der Nutzer schickt eine Eingabe, das Modell verarbeitet sie und antwortet. Thinking Machines sieht darin eine …

Weiterlesen …

Nvidia bündelt Sprache, Bild und Ton in Nemotron 3 Nano Omni

Nvidia hat Nemotron 3 Nano Omni vorgestellt, ein offenes KI-Modell, das Text, Bild und Audio in einem System vereint. Bisherige KI-Agenten nutzen für jede dieser Aufgaben separate Modelle. Das verlangsamt die Verarbeitung und erhöht die Kosten. Nvidia will dieses Problem mit dem neuen Modell lösen. Das Modell basiert auf einer hybriden Mixture-of-Experts-Architektur mit 30 Milliarden …

Weiterlesen …

Anthropic veröffentlicht Claude Opus 4.7

Anthropic hat Claude Opus 4.7 veröffentlicht, das bisher leistungsstärkste öffentlich verfügbare KI-Modell des Unternehmens. Laut Anthropic übertrifft das Modell seinen Vorgänger Claude Opus 4.6 in den Bereichen Softwareentwicklung, Dokumentenanalyse und Bildverarbeitung. Ein zentrales Merkmal ist die Fähigkeit zur Selbstüberprüfung. Bei internen Tests entwickelte Opus 4.7 eigenständig eine Text-zu-Sprache-Software in der Programmiersprache Rust und prüfte das …

Weiterlesen …

Meta veröffentlicht proprietäres KI-Modell Muse Spark

Meta hat Muse Spark veröffentlicht, ein neues proprietäres KI-Modell seiner internen Abteilung Meta Superintelligence Labs. Das Modell ist über die Meta AI App und die Website verfügbar, mit einem privaten API-Zugang für ausgewählte Nutzer. Anders als Metas frühere Llama-Modelle ist Muse Spark kein Open-Source-Modell. Muse Spark verarbeitet Text und Bilder gemeinsam. Meta nennt diese Fähigkeit …

Weiterlesen …

×