Beobachtetes Signal · 11. März 2024 · Technical Release · Quelle: Trending Topics · Relevanz: 2/5 · Sentiment: Neutral
Claude-3 übertrifft ChatGPT-4 im KI-IQ-Ranking und knackt Mensa-Grenze
In einem von Blogger Maxim Lott durchgeführten Intelligenztest basierend auf dem norwegischen Mensa-Test hat Anthropics Claude-3 als erstes KI-Modell die durchschnittliche menschliche Intelligenz von 100 Punkten übertroffen und erreichte einen IQ von 101. Damit schlug das Modell OpenAI's ChatGPT-4, das in dem 35 Fragen umfassenden sprachbasierten Test einen IQ von 85 erzielte. Der Fokus lag dabei rein auf logischem Denken statt visueller Interpretation. Ältere Versionen wie Claude-1 und Claude-2 kamen auf Werte von 64 beziehungsweise 82, während Microsofts Bing Copilot 79 und Googles Gemini 77,5 erreichten. Prognosen deuten darauf hin, dass kommende Modelle in den nächsten 12 bis 16 Monaten IQ-Werte von 120 bis 140 erreichen könnten, was das rasante Entwicklungstempo im Bereich der GenAI unterstreicht.
Das KI-Modell-IQ-Ranking demonstriert die rasante Weiterentwicklung von GenAI-Modellen mit Relevanz für datengetriebene Tools, stellt jedoch kein marktveränderndes Ereignis für die Werbe- und Mediatec-Branche dar.
Marktsignale zu Anthropic in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Anthropics Claude-3 erreichte in einem verbalen Mensa-Test einen IQ von 101.
- OpenAI's ChatGPT-4 erzielte im gleichen Test einen IQ von 85.
- Der Test von Maxim Lott bestand aus 35 Fragen basierend auf dem norwegischen Mensa-IQ-Test.
- Claude-1 erzielte 64, Claude-2 82, Bing Copilot 79 und Gemini 77,5 Punkte.
- Es wird prognostiziert, dass künftige KI-Modelle in 12 bis 16 Monaten einen IQ von 120 erreichen könnten.
Verknüpfte Unternehmen
4 verknüpfte Unternehmen“Anthropic's Claude-3 has been shown to beat its rivals, including OpenAI's ChatGPT-4, and is also the first AI to exceed the usual human IQ ...”
“When Lott ChatGPT-4 described the matrices in words, it resulted in an assessable IQ. On average, OpenAI's model answered an average of 13 o...”
“In fourth place is Bing Copilot from Microsoft with an IQ of 79....”
“In fifth place is Gemini from Google with an IQ of 77.5....”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
OpenAI holt im KI-Preiskampf gegen Anthropic auf
Laut einem Bericht des Wall Street Journal hat OpenAI den Rückstand auf Anthropic bei Firmenkunden, die über die Plattform OpenRouter einkaufen, nahezu aufgeholt. Im September teilten sich die beiden Rivalen die Ausgaben von rund 120.000 Unternehmen nahezu hälftig, während zu Jahresbeginn noch etwa drei Viertel auf Anthropic entfielen. OpenAIs aggressive Preisgestaltung, insbesondere die GPT-5.6-Modellfamilie mit Preissenkungen von bis zu 80 %, war ein entscheidender Faktor. Anthropic kämpft mit Kapazitätsengpässen bei Claude Code und einer Datenschutzdebatte über die 30-tägige Speicherung von Nutzerdaten. Beide Unternehmen bereiten sich auf Börsengänge vor und benötigen nachhaltige Umsätze, um Bewertungen von über 1 Billion Dollar zu rechtfertigen.
Musk's Grok Bot nutzt künftig Claude und andere Konkurrenz-KI
Elon Musk hat angekündigt, dass der KI-Agent Grok Bot nicht mehr ausschließlich auf die hauseigenen Grok-Modelle setzen wird, sondern für jede Aufgabe das beste Backend-Modell verwenden soll. Als Beispiele nannte er Claude Opus 5.5 von Anthropic, den Bildgenerator Midjourney und den Musikgenerator Suno. Die Ankündigung, die zuerst von The Information berichtet wurde, markiert eine strategische Wende für Musks KI-Einheit, die Milliarden in das Training eigener Modelle investiert hat. Dieser Schritt spiegelt einen breiteren Branchentrend des Model-Routings wider, wie ihn Microsoft mit Anthropic-Modellen in Copilot und Perplexity mit der Auswahl von Modellen demonstriert. Die Entscheidung erfolgt nach Nutzerbeschwerden über die Erreichbarkeit der Grok-App. Musks KI-Einheit, die nun Teil von SpaceX ist und kürzlich umbenannt wurde (SpaceXAI, dann SpaceXSI), scheint damit anzuerkennen, dass die eigenen Modelle nicht in allen Bereichen führend sind, da Claude Opus 5.5 im Artificial-Analysis-Ranking vor der Konkurrenz liegt.
Ethereum-Forscher warnt: KI könnte Blockchain-Verschlüsselung knacken
Justin Drake, Forscher bei der Ethereum Foundation, hat die Krypto-Branche aufgerufen, sich auf einen möglichen 'Bunker-Modus' vorzubereiten: die kontrollierte Migration von Guthaben auf frische Adressen. Er warnt, dass KI-gestützte Mathematik das ECDSA-Signaturverfahren, das Bitcoin und Ethereum nutzen, schneller brechen könnte als erwartet – möglicherweise innerhalb von Monaten. Während der Quantencomputer (Q-Day) als Bedrohung für die 2030er-Jahre gilt, könnte KI diese Entwicklung überholen. Drake empfiehlt, Salden auf Adressen zu verschieben, die noch nie signiert haben, und fordert große Verwahrer wie Binance und Tether auf, ihre Cold Storage zu härten. Vitalik Buterin mahnt zur Ruhe, während andere wie Yehuda Lindell von Coinbase keine Belege für eine unmittelbare Gefahr sehen. Die Debatte umfasst auch Bitcoin-Verbesserungsvorschläge (BIP-360, BIP-361), die anfällige Adressen ausphasen wollen, aber umstritten sind.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
