Beobachtetes Signal · 4. Aug. 2023 · Research Study · Quelle: Trending Topics · Relevanz: 2/5 · Sentiment: Positiv
UCLA-Studie: GPT-3 erreicht bei Logiktests das Niveau von Studierenden
Forscher der University of California, Los Angeles (UCLA) haben das Sprachmodell GPT-3 von OpenAI bei Denkaufgaben getestet und festgestellt, dass es in mehreren Bereichen ähnlich gut oder besser abschneidet als College-Studierende. Die in Nature Human Behavior veröffentlichte Studie nutzte Aufgaben im Stil von Raven's Progressive Matrices, bei denen GPT-3 80 Prozent korrekt löste, während der menschliche Durchschnitt bei knapp unter 60 Prozent lag. Zudem übertraf GPT-3 den menschlichen Durchschnitt bei SAT-Analogiefragen, die nach Annahme der Forscher nie online veröffentlicht wurden. Bei Analogieaufgaben basierend auf Kurzgeschichten schnitt die KI jedoch schwächer ab als Studierende, wobei GPT-4 bessere Ergebnisse erzielte. Hauptautorin Hongjing Lu wies darauf hin, dass GPT-3 ähnliche Fehler wie Menschen machte. Die Ergebnisse stellen infrage, ob analogisches Denken eine exklusiv menschliche Fähigkeit ist, und werfen die Frage auf, ob GPT-3 menschliches Denken lediglich imitiert oder grundlegend neue kognitive Prozesse anwendet.
Demonstriert, dass LLMs wie GPT-3 bei standardisierten Logiktests die menschliche Leistung erreichen oder übertreffen können. Dies signalisiert eine Reifung der KI-Fähigkeiten für die Automatisierung von Wissensarbeit, auch wenn keine direkte AdTech-Anwendung genannt wird.
Marktsignale zu OpenAI in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- GPT-3 löste 80 Prozent der Logikaufgaben im Stil von Raven's Progressive Matrices, verglichen mit einem menschlichen Durchschnitt von knapp unter 60 Prozent.
- GPT-3 übertraf den menschlichen Durchschnitt bei SAT-Analogiefragen, die vermutlich nicht Teil der Trainingsdaten waren.
- Bei Analogieaufgaben auf Basis von Kurzgeschichten schnitt GPT-3 schlechter ab als Studierende; GPT-4 erzielte hier bessere Ergebnisse.
- Die Studie wurde von UCLA-Forschern in Nature Human Behavior veröffentlicht.
- Forscher wiesen darauf hin, dass GPT-3 bei einfachen menschlichen Aufgaben wie der Werkzeugnutzung zur Lösung physikalischer Probleme weiterhin versagt.
Verknüpfte Unternehmen
1 verknüpfte Unternehmen“The UCLA researchers cannot say with certainty how GPT-3's reasoning abilities work without access to its inner workings, which are protecte...”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Grok Bot durchsucht X und nutzt Konkurrenzmodelle
SpaceXAI hat seinen AI-Agenten Grok Bot um die Fähigkeit erweitert, die gesamte X-Plattform kontinuierlich zu durchsuchen und zu analysieren. Nutzer können den Agenten nun für 24/7-Social-Listening, Markenüberwachung und Trendanalysen einsetzen, ähnlich wie bei Googles Information Agents. Grok Bot wird je nach Aufgabenstellung auch Modelle von Konkurrenten wie Claude Opus 5.5, Midjourney und Suno integrieren. Dieser Schritt signalisiert einen Wandel hin zu Multi-Modell-AI-Agenten und erweitert die Möglichkeiten der KI-gestützten Social-Media-Analyse.
OpenAI-Experte: Token-Effizienz für KI-Agenten optimieren
In einem Interview mit t3n erklärt Maximilian Hudlberger, Applied AI Engineer bei OpenAI, dass trotz sinkender Token-Preise die KI-Kosten für Unternehmen deutlich steigen können, insbesondere durch den zunehmenden Einsatz von KI-Agenten. Er argumentiert, dass das wahre Maß für Wirtschaftlichkeit nicht der Preis pro Token ist, sondern die Anzahl der erledigten Aufgaben mit einem gegebenen Budget. Unnötige Kosten entstehen oft dadurch, dass für jede Aufgabe das stärkste Modell verwendet wird, obwohl einfachere Modelle ausreichen würden. Unternehmen sollten daher in erledigten Aufgaben denken und ihre Modellwahl für wirtschaftliche Effizienz optimieren. Der Artikel betont, dass der wachsende Einsatz von KI-Agenten in Unternehmensworkflows den Token-Verbrauch erhöht und Kostenmanagement zu einem kritischen Geschäftsfaktor macht.
OpenAI führt visuelle Werbung in ChatGPT ein
OpenAI hat den Start visueller Werbung in ChatGPT angekündigt, ein bedeutender Schritt zur Monetarisierung seines beliebten KI-Assistenten. Das neue Anzeigenformat ermöglicht es Werbetreibenden, visuelle Inhalte direkt in Chat-Interaktionen einzublenden und Nutzer basierend auf dem Gesprächskontext anzusprechen. Dieser Schritt positioniert OpenAI als wichtigen Akteur im Bereich der digitalen Werbung und nutzt seine große Nutzerbasis und fortschrittliche KI-Fähigkeiten. Die Anzeigen sollen nicht intrusiv und relevant sein, wobei OpenAI die Benutzererfahrung und den Datenschutz betont. Diese Entwicklung könnte die AdTech-Landschaft neu gestalten, indem sie einen neuen, hoch engagierten Kanal für Marken einführt. Die verfügbaren Inhalte waren jedoch nur eine Schlagzeile, daher wurden keine spezifischen Partner, Starttermine oder Erlösmodelle genannt.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
