DeepMind FACTS Grounding ist ein neues Bewertungssystem für KI-Genauigkeit
Google DeepMind hat ein neues Bewertungssystem namens FACTS Grounding eingeführt. Wie Taryn Plumb in VentureBeat berichtet, testet das System die Fähigkeit von Sprachmodellen, faktisch korrekte Antworten zu generieren. Das Benchmark-System verwendet 1.719 Beispiele aus verschiedenen Bereichen wie Finanzen, Technologie und Medizin. Die Bewertung erfolgt durch drei verschiedene KI-Modelle: Gemini 1.5 Pro, GPT-4o und Claude 3.5 …