Beobachtetes Signal · 21. Sept. 2026 · Research Study · Quelle: t3n · Relevanz: 2/5 · Sentiment: Negativ

KI-Chatbots liefern bei Finanzfragen in 57% der Fälle falsche Antworten

Zusammenfassung des Signals

Eine Studie des Technologieunternehmens Saturn ergab, dass beliebte KI-Chatbots wie ChatGPT, Claude, Copilot, Grok und Gemini bei Finanzfragen in durchschnittlich 57 % der Fälle falsche Antworten liefern. Bei komplexen Fragen, die mehrere Rechenschritte erfordern, steigt die Fehlerquote auf 88 %, wobei einige Modelle in 99 % der Fälle falsch lagen. Das beste Modell, Claude Opus 5 im Reasoning-Modus, lag immer noch in 39 % der Antworten falsch. Die Studie basiert auf über 100 Finanzfragen und deckte Rechenfehler, veraltete Steuerinformationen und halluzinierte Regeln auf. Beispielsweise behauptete Claude Haiku 4.5 fälschlicherweise, dass britische Sparer 17.500 Pfund Steuern nachzahlen müssten, und ein anderes Modell erfand eine Regel, wonach Studenten bei Umzug ins Ausland die Rückzahlung ihrer Studiendarlehen einstellen könnten. Saturn-CEO Amal Jolly warnte, dass Millionen von Menschen durch das Vertrauen in KI-Modelle finanzielle Verluste erleiden könnten.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Diese Studie zeigt erhebliche Zuverlässigkeitsprobleme von KI-Chatbots bei Finanzfragen auf, was das Vertrauen in KI-gesteuerte Lösungen in der gesamten Branche untergraben könnte, einschließlich der AdTech-Branche, wo KI zunehmend für Kampagnenoptimierung und Kundeneinblicke eingesetzt wird.

SIGNAL RADAR

Marktsignale zu MediaMarktSaturn in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • Eine Studie des Technologieunternehmens Saturn ergab, dass KI-Chatbots bei Finanzfragen in 57% der Fälle falsche Antworten liefern.
  • Die Fehlerquote steigt bei komplexen Finanzfragen mit mehreren Rechenschritten auf 88%.
  • Claude Opus 5 im Reasoning-Modus schnitt mit 39% Fehlerquote am besten ab.
  • Claude Haiku 4.5 behauptete fälschlicherweise, dass ein britischer Sparer 17.500 Pfund Steuern nachzahlen müsste.
  • Ein KI-Chatbot erfand eine nicht existierende Regel zur Rückzahlung von Studienkrediten bei Umzug ins Ausland.

Verknüpfte Unternehmen

6 verknüpfte Unternehmen

“Populäre KI-Modelle wie ChatGPT, Claude, Copilot, Grok und Gemini lieferten demnach bei Finanzfragen im Durchschnitt in 57 Prozent der Fälle...”

“Populäre KI-Modelle wie ChatGPT, Claude, Copilot, Grok und Gemini lieferten demnach bei Finanzfragen im Durchschnitt in 57 Prozent der Fälle...”

“Populäre KI-Modelle wie ChatGPT, Claude, Copilot, Grok und Gemini lieferten demnach bei Finanzfragen im Durchschnitt in 57 Prozent der Fälle...”

“Populäre KI-Modelle wie ChatGPT, Claude, Copilot, Grok und Gemini lieferten demnach bei Finanzfragen im Durchschnitt in 57 Prozent der Fälle...”

Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: t3n•Veröffentlicht: 21. Sept. 2026
Ursprünglicher Berichttitel: “Studie zeigt: KI-Chatbots liefern bei Finanzfragen in 57 Prozent der Fälle falsche Antworten”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

Conversational AI & Chatbots20. Apr. 2026

MIT-Professor zeigt, wie präzise ChatGPT-Prompts die Finanzberatung verbessern

Laut MIT-Professor Andrew Lo können KI-Chatbots wie ChatGPT, Gemini und Claude valide Finanzberatung liefern, sofern die Prompt-Qualität stimmt. Einer Intuit-CreditKarma-Studie zufolge nutzen zwei Drittel aller US-Verbraucher generatives KI-Tool für Finanzfragen, bei Millennials und der Generation Z sind es sogar über 80 Prozent – rund 85 Prozent setzten die Empfehlungen direkt um. Lo empfiehlt hochgradig detaillierte Prompts, die finanzielle Ziele, Restriktionen, Steuerklassen, Wohnort, Vermögenswerte, Zeitrahmen und Risikotoleranz umfassen. Zudem sollten Nutzer die Modelle auffordern, fehlende Informationen zu benennen und Unsicherheiten transparent auszudrücken. Angesichts von Halluzinationen und Rechengrenzen mahnt der Beitrag zur Vorsicht, empfiehlt die Verifizierung von Quellen und das wiederholte Ausführen von Prompts.

Signal analysieren
Large Language Models (LLM) & AI5. Aug. 2026

KI wird häufig für Finanzberatung genutzt, liefert aber oft falsche Ergebnisse

Eine Analyse aus dem Jahr 2026 zeigt, dass KI für viele US-Bürger zu einem primären Finanzberater geworden ist. Mittlerweile nutzen 55 Prozent KI zur Geldverwaltung, verglichen mit 10 Prozent im Vorjahr. Personalisierte KI-Ratschläge können jedoch voreingenommen und ungenau sein. Forscher des MIT Sloan führten Simulationen mit Chat-Modellen durch und stellten fest, dass Nutzer mit geringem Finanzwissen im Alter von 60 Jahren fast 50.000 US-Dollar weniger Vermögen besaßen. Von Frauen verfasste Prompts führten zu rund 60.000 US-Dollar weniger simuliertem Lebenseinkommen als die von Männern. Weitere Evaluierungen ergaben, dass KI bei Fragen zu persönlichen Finanzen in 56 Prozent der Fälle richtig lag, in 27 Prozent täuschte oder irreführte und in 17 Prozent schlicht falsch lag. Der Bericht hebt zudem Datenschutzrisiken hervor und betont, dass KI keine treuhänderische Pflicht besitzt.

Signal analysieren
Conversational AI & LLM guidance20. Apr. 2026

MIT-Professor: Präzise Prompts für fundierte Finanzberatung durch KI

Millionen Nutzer greifen auf KI-Chatbots wie ChatGPT, Gemini und Claude für Finanztipps zurück, doch die Qualität der Empfehlungen hängt laut MIT-Professor Andrew Lo stark vom Prompt-Design ab. Eine Intuit-Creditkarma-Studie zeigt, dass zwei Drittel der US-KI-Nutzer solche Tools für Finanzfragen konsultieren (bei Millennials und Gen Z sind es über 80 %) und rund 85 % die Ratschläge auch umsetzen. Lo empfiehlt, Prompts mit konkreten persönlichen Details wie Zielen, Restriktionen, Steuerklasse, Wohnort, Vermögen, Zeithorizont und Risikotoleranz anzureichern sowie nach fehlenden Informationen und Unsicherheiten zu fragen. Zudem rat Experten dazu, der KI eine professionelle Beraterrolle zuzuweisen und die Ergebnisse stets zu verifizieren, da Halluzinationen und Rechenschwächen die Empfehlungen verzerren können. Das Medium t3n führte dazu einen Praxistest zur Portfolioerstellung via ChatGPT durch.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.